产业观察
智能体终端编程中文测评榜单:小米MiMo登顶
📋总体概括
SuperCLUE发布智能体终端编程中文测评榜单,小米MiMo V2.6 Pro以64.65分登顶综合总分第一,且每题成本仅1.52元,性价比突出。Kimi、GLM、Hy4分列二至四位,MiMo V2.6 Flash以53.54分、0.67元/题居第五且成本最低。该测评以Claude Code为固定框架,考察中文需求理解、任务规划、工具调用与交付能力,显示国产大模型在硬核工程任务上已能与海外主流产品竞争。
⚡关键信息
- ▸SuperCLUE智能体终端编程中文榜单:小米MiMo V2.6 Pro以64.65分夺综合第一
- ▸MiMo V2.6 Pro每题成本1.52元,得分高于Hy4-Preview(high)的55.56分且成本远低于其11.61元/题
- ▸MiMo V2.6 Flash以53.54分排第五,0.67元/题为全场最低成本
- ▸DeepSeek-V4.1-Flash(max)得50.51分、1.86元/题,但时间效率表现突出
- ▸测评固定使用Claude Code框架,考察中文理解、任务规划、工具调用与错误排查能力
🔥犀利点评
小米这波是真给「车厂」长了脸——一个跨界玩家把Kimi、GLM、DeepSeek按在榜单下面,还顺手把价格打到底。当然要泼冷水:单一测评、单一框架、单一任务集的榜首含金量有限,SuperCLUE自己也说没有模型能替代程序员。但国产模型在中文工程场景的性价比优势已经不虚了,真正该焦虑的是按token收高价却跑不过1.52元/题的那些对手。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 驱动之家 阅读全文 →