Fluid, natural voice translation with Gemini 3.5 Live Translate
Google DeepMind 于 2026 年 6 月 9 日发布 Gemini 3.5 Live Translate,提供近实时、自然的语音翻译,并集成到 Google AI Studio、Google Translate 和 Google Meet。
发展脉络
- 首次出现9 demos of Gemini Omni and Gemini 3.5 in actionGoogle AI
- 行业反馈Fluid, natural voice translation with Gemini 3.5 Live TranslateGoogle DeepMind
- 当前判断将实时翻译直接集成到 Google Meet 和 Google Translate 等主流产品中,表明实时语音翻译正从独立功能变为平台级能力。这可能推动会议、客服等场景的全球化协作,并加剧与同类产品的竞争。Agent Pulse · 分析
Google DeepMind 在 2026 年 6 月 9 日发布了 Gemini 3.5 Live Translate,该功能提供近实时、自然的语音翻译,并已集成到 Google AI Studio、Google Translate 和 Google Meet 中。这一发布基于 Gemini 3.5 模型,该模型在 2026 年 5 月 29 日的 Google I/O 上通过 9 个演示视频展示了其能力。
Gemini 3.5 Live Translate 实现了近实时的语音翻译,表明模型在语音到语音的延迟和自然度上取得了进展。这可能需要端到端的语音建模和高效的推理优化。下一步可关注其支持的语种数量、翻译质量评测以及 API 的延迟指标。
将实时翻译直接集成到 Google Meet 和 Google Translate 等主流产品中,表明实时语音翻译正从独立功能变为平台级能力。这可能推动会议、客服等场景的全球化协作,并加剧与同类产品的竞争。
对 Google 而言,该功能增强了其生产力套件的竞争力,可能提升用户粘性并吸引企业客户。对开发者而言,通过 Google AI Studio 的 API 集成,可降低构建多语言应用的复杂度。
未来可观察该功能在 Google Meet 中的实际采用率,以及是否扩展到更多语言和平台。若延迟进一步降低,可能改变跨语言沟通的工作流程。