产业观察
RSI再创奇迹!StartLux推出开源决策模型StartLux-Decision,38项基准中31项高于Jev
📋总体概括
StartLux宣布推出开源决策模型StartLux-Decision,主打的27B版本在独立评测Decision Index 0.2.1中取得63.88分,38项基准中有31项超过对比对象Jev 1.13;在上海AI实验室发布Intern-Decision时采用的七项评测中,27B版本平均准确率达91.82%,高于Jev的88.74%。官方以多项第三方基准对比强调其开源决策模型在推理与决策能力上的领先性,试图在开源社区树立技术标杆。
⚡关键信息
- ▸StartLux推出开源决策模型StartLux-Decision
- ▸Decision Index 0.2.1评测中27B版本得分为63.88
- ▸38项基准中31项高于Jev 1.13,占比超八成
- ▸上海AI实验室的七项评测中平均准确率91.82%,高于Jev的88.74%
🔥犀利点评
又是一个「31/38高于友商」的Benchmark奇迹。问题在于:评测集谁定的、Jev 1.13是哪个版本、决策类任务的真实场景泛化如何?模型行业早已证明跑分领先和实际可用是两回事。开源是好事,但靠刷榜营销只会透支信任。真正的检验标准只有一个——有团队拿它做出能落地的决策系统。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 钛媒体 阅读全文 →