蚂蚁开源首个100B扩散语言模型LLaDA2.0

钛媒体App 12月12日消息,蚂蚁技术研究院今日宣布推出LLaDA2.0系列离散扩散大语言模型(dLLM),并同步公开了背后的技术报告。LLaDA2.0包含MoE架构的16B (mini)和100B (flash)两个版本,将Diffusion模型的参数规模首次扩展到了100B量级。(广角观察)

本文内容仅供参考,不构成投资建议,请谨慎对待。

评论
0 / 300

根据《网络安全法》实名制要求,请绑定手机号后发表评论

登录后输入评论内容
投资日历
更多