Google 9 月 15 日发布 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking。前者侧重规模化部署与成本效率,后者面向需要多步推理的复杂任务,两款模型均围绕实时语音交互设计。
据官方介绍,Gemini 3.8 Live 能结合近实时视觉输入回答问题,在对话中识别并切换支持的 97 种语言,也能一边回应用户、一边在后台执行工具和 API 调用。Extended Thinking 则把推理与说话并行处理,用简短回应和进度说明衔接后台任务,减少用户等待时的对话中断。
此次更新不仅涉及 Gemini 应用,还面向 Workspace、Search 与通过 Live API 开发语音界面的团队。对开发者而言,重点是复杂任务执行与自然对话能否同时成立;官方展示的基准成绩和演示不代表所有业务场景的完成率,具体语言、产品入口和账户可用范围仍需分别确认。