谷歌Gemini 3.8 Live发布:AI语音首创"边说边想"
AI大模型

谷歌Gemini 3.8 Live发布:AI语音首创"边说边想"

谷歌刚发布了两款实时语音推理模型:Gemini 3.8 Live和Gemini 3.8 Live Extended Thinking。它们能在低延迟语音流中直接做多步深层推理,对话和思考同步进行,主打"边说边想"。支持97种语言无缝切换,原生端到端音频交互,延迟降了不少,听着也更自然。这次直接重写了语音AI的交互方式。

这次最大的突破是对话和任务执行能同时跑。你跟它聊天时,它后台照样调工具和API,搜索、处理复杂任务都不耽误说话。以前的语音AI要么能说要么能想,现在两件事同时干了。遇到复杂的专业场景,你可以一边跟它讨论方案,一边让它查资料、调数据,交流完全不会卡壳。

两款模型已经上了Gemini API和AI Studio平台,Search Live、Enterprise、Workspace、Gemini Live等产品场景都能用。开发者和普通用户正陆续收到推送。扩展思考版专门给需要深度推理的专业场景用,语音AI的能力更强了。支持97种语言也足够覆盖全球主要市场。

谷歌这次彻底把对话、推理、任务执行三件事打通了。语音AI成了能同时干多件事的并行系统。其他同行得加快节奏了。