产业观察🔥7.0
谷歌推出Gemini 3.8 Live及扩展思考版,强化实时语音交互
📋总体概括
谷歌于9月15日发布Gemini 3.8 Live与Gemini 3.8 Live Extended Thinking两款实时对话模型,聚焦语音交互、实时推理与复杂任务执行。Live版支持近实时视觉输入、97种语言自动切换及后台工具和API调用;扩展思考版可边思考边语音交流,定位多步骤复杂任务。两款模型已通过Gemini API和Google AI Studio向开发者开放,Live版同步登陆Search Live,扩展思考版面向Gemini Live用户推出,显示谷歌加速将实时多模态能力商业化落地。
⚡关键信息
- ▸谷歌9月15日推出Gemini 3.8 Live和扩展思考版两款实时对话模型
- ▸Live版支持近实时视觉输入,可在对话中自动切换97种语言
- ▸两款模型支持后台执行工具和API调用,强化复杂任务执行能力
- ▸扩展思考版支持边思考边语音交流,面向多步骤复杂任务场景
- ▸模型已通过Gemini API和Google AI Studio开放,并登陆Search Live与Gemini Live
🔥犀利点评
谷歌这波发布明显是冲着实时语音AI的卡位战去的——97种语言切换加边想边说,摆明了要在OpenAI反应过来之前把「实时多模态」的心智占住。但真正的护城河不是演示里的丝滑对话,而是后台工具调用能否稳定跑通。API和Search Live同步铺开说明谷歌想快速换数据、换生态,节奏是对的,就看真实场景里翻不翻车。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 36氪快讯 阅读全文 →