36氪大模型1 天前
最前线|本地大模型 StartLux-27B 通过 MCP-Universe 测评:综合第二,多项专项第一
摘要 · 近日,工信部中国信息通信研究院(以下简称“中国信通院”)人工智能研究所公布的一份检验报告显示,上海原点星辉科学技术有限公司(下简称StartLux)研发的本地大模型 StartLux-V1.0-27B-Preview,在可信AI大模型基准测试——MCP专项测试中,以 27B 参数量取得综合性能排名第二的成绩,高于第三名的DeepSeek-V4-Flash,能力范围已经进入DeepSeek-V4-Pro所代表的万亿参数模型能力区间。 可信AI大模型基准测试——MCP 专项测试涵盖位置导航、网页搜索、浏览器自动化、金融分析、代码仓库管理、3D 设计 6 类专项任务及综合评估,共 7 项检验项目,重
阅读原文 · 36氪 →
大模型近日,工信部中国信息通信研究院(以下简称“中国信通院”)人工智能研究所公布的一份检验报告显示,上海原点星辉科学技术有限公司(下简称StartLux)研发的本地大模型 StartLux-V1.0-27B-Preview,在可信AI大模型基准测试——MCP专项测试中,以 27B 参数量取得综合性能排名第二的成绩,高于第三名的DeepSeek-V4-Flash,能力范围已经进入DeepSeek-V4-Pro所代表的万亿参数模型能力区间。 可信AI大模型基准测试——MCP 专项测试涵盖位置导航、网页搜索、浏览器自动化、金融分析、代码仓库管理、3D 设计 6 类专项任务及综合评估,共 7 项检验项目,重
原文:https://36kr.com/p/3963345222147335?f=rss
0 条评论 · 观点来自社区X微博Telegram
评论区 0 条讨论