商城首页欢迎来到中国正版软件门户

您的位置: 首页 > 文章列表 > 硬件相关 > 重大更新!Google翻译接入Gemini 3.5 LT,我们实测了一波

重大更新!Google翻译接入Gemini 3.5 LT,我们实测了一波

  发布于2026-06-13 阅读(0)

扫一扫,手机访问

在刚刚结束的 Google I/O 上,Google 正式发布了新一代 Gemini 3.5 模型,同时剧透了未来将把 Gemini 的能力融入到更多产品生态中。不过,有趣的是,第一个吃螃蟹的 Google 生态应用,竟然不是搜索、YouTube 或地图这些顶流,而是存在感日益稀薄的 Google 翻译——昨天,它悄无声息地更新了,嵌入了最新的音频模型 Gemini 3.5 Live Translate(简称 Gemini 3.5 LT)。

图片来源:Google 那么,在 Gemini 3.5 LT 的驱动下,Google 翻译的实时语音翻译功能究竟表现如何? ### 错词漏词依旧存在,单向翻译模式存硬伤 打开 Google 翻译的实时翻译功能,选择「实时听」模式,就能进入 Gemini 3.5 LT 驱动的全新界面。不过,有点奇怪的是,这个模式居然要求必须连接外置耳机才能激活。考虑到实时听模式并不像时空壶同传那样支持双向同时工作,这个“必须接耳机”的设计确实让人摸不着头脑。 好在操作还算简单:开启实时听模式,把手机靠近对方,耳机里就能“实时”听到翻译后的音频。

图片来源:雷科技 和 Google 翻译之前那个“按住才能说话、松手才翻译”的对话模式相比,实时听模式会在对方完成一个短句后立刻开始翻译,时效性明显提升。不过,实际体验中仍然有明显的延迟。以中译英的古诗翻译为例,得念到第三句时,耳机里才传来第一句的翻译,和专业同传耳机那种几乎“同步启动”的效果还是有不小差距。 #### 测试:经典游戏台词翻译 为了测试准确度,我们安排了几个经典的游戏对话“原声大碟”进行实测,同时拉上苹果翻译和有道翻译作为对比。先来看原文,相信玩过《GTA: SA》的玩家对这段点餐录音都不陌生: > I'll ha ve 2 number 9s, a number 9 large, a number 6 with extra dip, a number 7, 2 number 45s, one with cheese and a large soda. 以下是 Google 翻译“听”到的英文原文: > Now, I ha ve two number nines, but number nine Lord, number six with extra dip, a number seven, two number 45s, one with cheese and a large soda. Okay. Okay. 可以看到,即使在 Gemini 3.5 LT 加持下,Google 翻译在一些细节处依然会出错: - “I'll ha ve”变成了“I ha ve”(连读遗漏) - “a number 9 large”变成了“but number nine Lord”(识别错误) - 开头和结尾多了“Now”和“Okay. Okay.”(识别幻觉) 不过在翻译效果上,Google 翻译倒是准确地把这个错误的原文译出来了。

图片来源:雷科技 在语音渲染方面,Google 翻译输出的语音比单纯的 TTS 更有节奏感,更像真人说话,但依然能听出是 AI 合成音。 相比之下,Apple 翻译的问题就大得多了:识别出现大量错误,翻译几乎不可用。

图片来源:雷科技 而有道的同传效果反而更稳定,只出现了一处连读遗漏(“I'll ha ve”变成“I ha ve”)和一处识别错误(“Soda”变成“Soup”),翻译质量和速度也同样过关。

图片来源:雷科技 #### 硬伤:翻译记录无法保存 另外,实时听模式还有一个让人无语的设定:它不会保存任何翻译记录。其他模式如“对话”或“文本”在翻译结束后都能在历史记录里看到原文和译文,但实时听模式的翻译记录在退出模式(包括耳机断开导致的强制退出)后全部消失。如果你打算用它做采访记录,劝你还是趁早放弃这个念头。

图片来源:雷科技 整体来看,实时听模式依然存在错译和主语混乱的问题。但从好的方面想,就连真人翻译也难免出错、漏译,而翻译软件可以通过快速迭代查漏补缺。更重要的是,作为全球通用翻译赛道的代表,Google 翻译拥抱 AI,必然会推动整个赛道加速向 AI 翻译转型。 ### 翻译成了最值得关注的 AI 落地场景之一 如果单独看这次更新,它更像是一次“AI 功能补课”——别人都在接大模型,Google 翻译当然也要跟。但把视角放到 2026 年的整个 AI 硬件市场,翻译反而可能是今年最值得关注的落地场景之一。 理由很直接:和许多还在“炫技”阶段的 AI 功能不同,翻译的需求足够明确,也足够高频。品牌不需要费尽心思解释“加 AI 能干什么”,用户也不会质疑“为什么要用 AI”。比如时空壶此前推出的 X1 Meeting AI 会议同传设备,利用 AI 模型能力解决了同传中断句点识别、语义推测、上下文纠错等传统短板。在翻译之外,时空壶还用 AI 打造了骨声纹识别功能,让翻译耳机准确判断每一句话是谁说的,为后续同传打下基础。

图片来源:雷科技 讯飞刚发布的 AI 眼镜则是另一条路线。主流智能眼镜一直围绕“拍摄”来打造产品,但讯飞 AI 眼镜反其道而行,将“全场景翻译”作为核心。以翻译替代拍摄,不仅用更高频的场景解决了智能眼镜“吃灰”的问题,也充分发挥了讯飞在翻译领域多年的技术积累,快速在智能眼镜赛道立足。

图片来源:雷科技 从本质上看,无论是时空壶同传耳机还是讯飞 AI 眼镜,都在试图让翻译从一个 App 功能,变成一种可以“移植”到不同硬件中的能力,从而覆盖更多场景。以 Google 翻译为例,虽然现阶段还面临延迟、漏译、记录缺失等问题,但长远来看,Gemini 3.5 LT 的实时音频能力完全可以接入耳机、眼镜、会议设备,甚至汽车座舱。 对时空壶、讯飞这类专业翻译硬件厂商来说,Gemini 3.5 LT 的出现既是压力,也是机会。压力很好理解:Google 这样的玩家一旦下场,必然会抬高免费翻译工具的预期——去年各手机品牌先后为 TWS 耳机加入 AI 翻译功能,直接挤压了入门翻译耳机的市场空间,拉高了翻译耳机能力的“及格线”。

图片来源:京东 但换个角度看,通用翻译也有天然的短板:商务会议需要多人识别,采访需要留备份,跨境展会需要长时间续航,嘈杂环境需要更强大的收音——这些都不是单靠一个模型更新就能解决的。也正因如此,Google 翻译变强并不意味着翻译耳机、翻译眼镜的故事就此结束。 通用翻译 App 和采用通用模型的产品,只能解决“从无到有”的问题。而未来的高端翻译耳机,必将把专用 AI 能力当作产品迭代的核心驱动力,用更快、更强的专用模型拉开体验差距。只有这样,才能在 AirPods 等“AI 翻译耳机”的冲击下守住核心用户群,并在更细分、更高价值的市场中延续优势。 随着免费 App 把基础翻译门槛越拉越低,专业设备必须在专业场景中证明自己的价值。可以肯定的是,随着 AI 技术在翻译赛道的普及,翻译硬件将迎来新一轮的洗牌。技术革新、产品优胜劣汰、消费者体验升级——这才是 AI 技术推动行业发展的真正意义。
本文转载于:https://www.163.com/dy/article/KV65I28F051100B9.html 如有侵犯,请联系zhengruancom@outlook.com删除。
免责声明:正软商城发布此文仅为传递信息,不代表正软商城认同其观点或证实其描述。

热门关注