2026 itvalue快报详情

信通院MCP专项测试:StartLux-27B综合第二,超越284B DeepSeek V4 Flash

钛媒体App 8月31日,中国信通院人工智能研究所公布的可信AI大模型基准测试MCP专项测试显示,上海原点星辉研发的StartLux-V1.0-27B-Preview以27B参数量取得综合性能排名第二,得分39.25%,高于第三名284B的DeepSeek-V4-Flash-0731(38.24%),并以1个百分点之差紧追1.6T的DeepSeek-V4-Pro。测试于8月3日启动,经三轮完整测试取均值,覆盖位置导航、网页搜索、浏览器自动化、金融分析、代码仓库管理及3D设计6类专项共7项检验。 同等参数规模下,StartLux-27B较Qwen-3.6-27B高出5.34个百分点;位置导航任务排名第一,浏览器自动化、金融分析与DeepSeek-V4-Pro并列第一。该模型以Qwen3.6-27B为基座,采用"AI训练AI"方法后训练,是国内首个以此方法进行后训练的本地Agent模型,可在消费级个人电脑运行,团队计划年内推出第一代本地智能解决方案。

本文内容仅供参考,不构成投资建议,请谨慎对待。

评论
0 / 300

根据《网络安全法》实名制要求,请绑定手机号后发表评论

登录后输入评论内容
投资日历
更多