产业观察

谷歌推出Gemini 3.8 Live及扩展思考版,强化实时语音交互

36氪快讯·2026/9/16 01:07:57🔗 原文

📋总体概括

谷歌于9月15日发布Gemini 3.8 Live和扩展思考版两款实时对话模型,主打语音交互、实时推理与复杂任务执行。新模型支持近实时视觉输入、自动切换97种语言,并可在后台调用工具和API;扩展思考版支持边思考边语音交流,面向多步骤复杂任务。两款模型已通过Gemini API和Google AI Studio向开发者开放,并分别落地Search Live和Gemini Live。此举显示谷歌正加速将实时多模态AI推向开发者生态,语音交互赛道竞争进一步升温。

关键信息

  • 谷歌9月15日推出Gemini 3.8 Live及扩展思考版两款实时对话模型
  • 新模型支持近实时视觉输入,可在对话中自动切换97种语言
  • 支持后台执行工具和API调用,扩展思考版可边思考边语音交流
  • 模型已通过Gemini API和Google AI Studio向开发者开放
  • Gemini 3.8 Live上线Search Live,扩展思考版面向Gemini Live用户推出

🔥犀利点评

97种语言实时切换加近实时视觉输入,谷歌这是把实时多模态交互直接拉到量产水平,目标显然不只是聊天,而是抢占语音Agent入口。对座舱和智驾交互生态来说,压力来自云端巨头的降维打击——当API级语音交互便宜又好用,自研语音链路的车企价值会被迅速稀释。

本文由本站自动聚合,以下为原始来源:前往 36氪快讯 阅读全文