资讯
谷歌、Meta被揭露AI跑分作弊 华裔高管回应:OpenAI也一样
📋总体概括
SemiAnalysis发文指控谷歌Gemini 3.8 Flash与Meta Muse Spark 1.3在AA榜单上的高分存在过拟合、即针对评测刷分的嫌疑。此前两家在AI竞争中落后于OpenAI和Anthropic,如今凭新模型一度反超,遭质疑后Meta AI负责人Alexandr Wang回应称OpenAI也一样刷分。榜单刷分在AI圈早已不是新闻,只是以往矛头多指向国产大模型,如今美国巨头同样被点名,暴露行业评测体系的公信力危机。
⚡关键信息
- ▸分析机构SemiAnalysis指出谷歌Gemini 3.8 Flash与Meta Muse Spark 1.3存在过拟合,涉嫌针对榜单评测刷分
- ▸两家此前在AI竞争中落后于OpenAI与Anthropic,新模型在AA榜单上一度反超对方旗舰模型
- ▸Meta AI业务主管Alexandr Wang回应作弊指控,称OpenAI同样存在刷分行为
- ▸Alexandr Wang是Scale AI创始人,Scale被Meta收购后其执掌Meta AI业务,Spark模型出自其团队
- ▸榜单刷分争议过去多指向国产大模型,如今谷歌、Meta也被质疑,行业评测公信力受冲击
🔥犀利点评
刷分指控本身不是重点,重点是Wang的回应方式——不否认自己刷分,只强调对手也刷。这等于公开承认榜单已是营销工具而非能力证明。当评测被过拟合污染,用户根本无法分辨模型真实水平,最终损害的是整个行业的信任基础。榜单刷分从国产模型的『专利』变成美国巨头的标配,恰恰说明这不是谁的道德问题,而是竞赛压力下的系统性行为。指望厂商自律没戏,需要第三方评测机制的重构。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 驱动之家 阅读全文 →