大模型领域跑出新玩家,StartLux-27B本地大模型打赢DeepSeek V4 Flash
本地大模型上牌桌,性能正面硬刚DeepSeek。图片来源:unsplash近日,中国工信部信息通信研究院(以下简称“中国信通院”)人工智能研究所公布的一份检验报告显示,上海原点星辉科学技术有限公司(下简称StartLux)研发的本地大模型StartLux-V1.0-27B-Preview,在可信AI大模型基准测试——MCP专项测试中,以27B参数量取得综合性能排名第二的成绩,高于第三名的DeepSeek-V4-Flash,能力范围已经进入DeepSeek-V4-Pro所代表的万亿参数模型能力区间。 可信AI大模型基准测试——MCP专项测试涵盖位置导航、网页搜索、浏览器自动化、金融分析、代码仓库管理、3D 设计6类专项任务及综合评估,共7项检验项目,重点考察大模型在多工具协同、复杂任务执行及真实环境交互等方面的综合表现,该专项测试部分指标和数据参考了开源项目MCP-Universe。参测
原文:钛媒体