服务端检索
7天新闻
本页 30 / 共 1057 条市场新闻0
全部30 条
谷歌发布Gemini 3.8 Live和Gemini 3.8 Live Extended Thinking实时音频模型,支持97种语言与异步工具调用,后者语音质量指数得分82.6,已通过API和AI Studio开放
打开永久阅读页 ↗打开后标记为已读
J/K 切换S 收藏F 专注模式
重要度75
影响方向正向
影响强度+85
分析置信62%
2026年9月15日,谷歌发布Gemini 3.8 Live和Gemini 3.8 Live Extended Thinking两款实时音频模型。两款模型均为原生端到端语音模型,可在对话不中断的情况下调用工具、处理视觉信息和执行复杂任务。谷歌公布的信息显示,Gemini 3.8 Live支持实时视觉上下文和多语言对话,Gemini 3.8 Live Extended Thinking增加深度推理能力,在用户继续交流的同时于后台完成多步骤任务。
Gemini 3.8 Live支持97种语言,能够在对话过程中自动识别
关联行业
影响路径
谷歌发布原生端到端实时音频模型,支持异步工具调用、实时视觉和深度推理,提升AI智能体与实时交互能力,推动人工智能应用边界扩展。
模型能力升级实时多模态交互开发者生态扩展行业竞争加剧