谷歌发布实时语音互译模型 Gemini 3.5 Live Translate:可识别 70 余种语言,谷歌翻译 App 就能用
谷歌发布Gemini 3.5 Live Translate实时语音互译模型,支持70+语言,保留说话者语调,谷歌翻译App即可使用,跨语言交流更流畅!
6 月 9 日消息,北京时间 9 日(今天)晚间,谷歌正式发布最新的实时语音互译音频模型 Gemini 3.5 Live Translate,迈出实时翻译的下一步。
Gemini 3.5 Live Translate 可自动识别 70 多种语言,并生成流畅、自然的翻译语音,同时保留说话者的语调、语速和音高。

根据介绍,传统轮流式系统通常要等说话者说完后才开始翻译,Gemini 3.5 Live Translate 则会连续生成语音,在“等待更多上下文以提升翻译质量”和“即时翻译以跟上说话者节奏”之间取得平衡。整个会话过程中,翻译音频可以保持流畅,避免尴尬停顿,并始终只比说话者慢几秒。
Gemini 3.5 Live Translate 今起陆续登陆谷歌产品:
开发者可通过 Gemini Live API 和 Google AI Studio 使用公开预览版
企业客户可从本月起在 Google Meet 中使用私有预览版
普通用户可通过 Android 和 iOS 版谷歌翻译使用
Gemini 3.5 Live Translate 会在语音流式传输过程中同步处理内容,让跨语言交流更加顺畅。模型可以自动处理多语言输入,无需手动调整设置,抗噪能力也能帮助应用适应嘈杂、复杂和不可预测的环境。开发者可以把 Gemini 3.5 Live Translate 用于多语言通话、会议、课程、直播和广播等场景,提供实时口译体验。
据了解,Gemini 3.5 Live Translate 将登陆全球 Android 和 iOS 版谷歌翻译应用。用户使用实时翻译功能时,只需连接任意耳机,就可以在 70 多种语言中获得更顺畅的翻译,并让译文语音更接近说话者的语气。
Android 用户还将陆续获得基于 3.5 Live Translate 的全新“聆听模式”。用户可以像接电话一样把手机贴到耳边,直接通过手机听筒收听翻译音频。在没有耳机、又不希望旁人听见翻译内容时,这种模式会更方便。
- 1重磅炸弹!曝《星际争霸》全新3A新作,或将马上亮相
- 2娱美德推进《夜鸦》在中国大陆的上线 IP新作年内上线
- 3《魔兽世界》倒计时一周!全新12.0.7版本“真相之幕”即将上线
- 4《泡泡堂》韩服宣布停运,盛趣回应:独立运营不受影响
- 5拳头离职大佬创业!新作虽说是“缝合怪”,但好评率仍高达81%
- 6遣返回国!日本“国宝级”美少女福田悠亚新西兰旅游被审讯6小时
- 7Steam新品节前瞻,推荐七款值得关注的多人联机/网游!
- 8绷不住了!电竞含片?智商税已经离谱到这个地步了?
- 9魔兽世界:时光服P4最新DPS排行,唯一三系登顶职业出现,雷火又开始造新神了
- 10正惊GIF:六大美女聚餐!桌上有说有笑,青春艳丽模样让无数人心动

