资讯

谷歌、Meta被揭露AI跑分作弊 华裔高管回应:OpenAI也一样

驱动之家·2026/9/8 12:55:00🔗 原文

📋总体概括

SemiAnalysis发文指控谷歌Gemini 3.8 Flash与Meta Muse Spark 1.3在AA榜单上的高分存在过拟合、即针对评测刷分的嫌疑。此前两家在AI竞争中落后于OpenAI和Anthropic,如今凭新模型一度反超,遭质疑后Meta AI负责人Alexandr Wang回应称OpenAI也一样刷分。榜单刷分在AI圈早已不是新闻,只是以往矛头多指向国产大模型,如今美国巨头同样被点名,暴露行业评测体系的公信力危机。

关键信息

  • 分析机构SemiAnalysis指出谷歌Gemini 3.8 Flash与Meta Muse Spark 1.3存在过拟合,涉嫌针对榜单评测刷分
  • 两家此前在AI竞争中落后于OpenAI与Anthropic,新模型在AA榜单上一度反超对方旗舰模型
  • Meta AI业务主管Alexandr Wang回应作弊指控,称OpenAI同样存在刷分行为
  • Alexandr Wang是Scale AI创始人,Scale被Meta收购后其执掌Meta AI业务,Spark模型出自其团队
  • 榜单刷分争议过去多指向国产大模型,如今谷歌、Meta也被质疑,行业评测公信力受冲击

🔥犀利点评

刷分指控本身不是重点,重点是Wang的回应方式——不否认自己刷分,只强调对手也刷。这等于公开承认榜单已是营销工具而非能力证明。当评测被过拟合污染,用户根本无法分辨模型真实水平,最终损害的是整个行业的信任基础。榜单刷分从国产模型的『专利』变成美国巨头的标配,恰恰说明这不是谁的道德问题,而是竞赛压力下的系统性行为。指望厂商自律没戏,需要第三方评测机制的重构。

本文由本站自动聚合,以下为原始来源:前往 驱动之家 阅读全文