谷歌AI硬气一回:Gemini 3.8仅用15%价格接近Opus5 斩获8项编程第一
📌 概要
谷歌发布Gemini 3.8 Flash,在放弃Pro市场后专攻低价快速模型。该模型输入0.75美元/百万token,价格仅为Opus5的15%左右,却在14组基准评测中拿下8项第一,DeepSWE从65.3%提升至71.0%,整体性能接近Opus5的74.0%,编程能力表现亮眼。不过优惠价仅持续至今年底,2027年起价格翻倍。
⚡ 关键要点
- ▸Gemini 3.8 Flash发布,价格仅为Opus5的15%,输入0.75美元/百万token
- ▸14组基准评测拿下8项第一,DeepSWE提升至71.0%,接近Opus5的74.0%
- ▸上下文100万token,多模态优势明显,但优惠价2027年起翻倍
快科技9月3日消息,谷歌Gemini Flash模型大力出奇迹,刚刚发布的Gemini 3.8 Flash很亮眼,多项性能超过了当前的旗舰大模型Opus5。
作为御三家AI巨头之一,谷歌今年在AI大模型上掉队明显,Gemini 3.5 Pro的多次跳票打击了大家对它的信心,索性就暂时放弃了Pro市场,专攻廉价快速模型的Flash系列升级倒是很快,最近一路从3.5升级到了Gemini 3.8 Flash,而且性能越来越猛。
这次的Gemini 3.8 Flash依然保持了低价优势,输入0.75美元/百万token,输出3.75美元/百万token,上下文100万,输出上限6.5万,不过价格优惠只到12月31日,2027年1月 1日起翻倍。
与Opus5相比,目前Gemini 3.8 Flash整体价位只有后者的15%左右,也就是跑Opus5的任务能跑7次Gemini 3.8 Flash,再加上多模态的优势,很适合干一些杂活,效率高,费用低。

但是Gemini 3.8 Flash的性能可不弱,14组基准评测中拿下8个第一,DeepSWE v1.1从 65.3%提升到71.0%,整体性能接近Opus 5的74.0%。
Terminal-bench 2.1这样的测试中达到89.4%,略高于Opus 5的89.1%以及GPT-5.6 Sol的 88.8%,表现达到了顶级大模型的水平。
另外在金融 Agent、法律 Agent、复杂图表推理和长视频理解上也拿到最高分。
当然也有差的地方,Terminal-bench 4.0只有19.1%,相比之下Opus 5达到了51.8%,而OSWorld-2.0也只有59.0%,大幅落后于Opus 5的75.4%。
另外值得说明的是,Gemini 3.8 Flash虽然上下文窗口是100万,但输出只给64K token,这点上很小气,也注定了它不太可能胜任大型任务。
目前Gemini 3.8 Flash已通过Gemini应用、AI Studio和Gemini API等渠道分发。
