Google 正在将 Gemini 3.5 Transcribe 扩展到更多产品中,包括 Chrome 浏览器。这一技术此前已用于 Gboard 的 Rambler 功能,现在将赋能更广泛的语音转写场景。

发生了什么

据 Ars Technica 报道,Google 宣布推出 Gemini 3.5 Transcribe,这是一款 AI 驱动的语音转文字技术。该技术将集成到更多 Google 产品中,Chrome 是其中之一。此前,该技术已为 Gboard 的 Rambler 功能提供支持,后者允许用户通过语音输入进行文字输入。此次扩展意味着 Gemini 3.5 Transcribe 将成为 Google 生态系统中更核心的语音处理组件。

为什么重要

语音转写技术并非新事物,但 Gemini 3.5 Transcribe 的亮点在于其 AI 能力,可能带来更高的准确率和更自然的语言理解。Google 将其从 Gboard 扩展到 Chrome,表明该公司正在将 AI 能力系统性地融入其产品矩阵。这不仅是技术升级,更是 Google 在 AI 应用层面的战略布局——通过将先进的语音模型嵌入日常工具,提升用户粘性,同时收集更多真实场景数据以优化模型。对于开发者而言,这可能意味着未来会有更多 API 或平台级接口开放,推动第三方应用集成。

影响与看点

对用户来说,最直接的影响是 Chrome 中可能很快出现更智能的语音输入功能,例如在地址栏、搜索框或表单中直接语音输入。对开发者而言,如果 Google 开放相关 API,将催生一批新的语音交互应用。值得关注的是,Gemini 3.5 Transcribe 与现有语音转写服务(如 Whisper)的差异,以及它在多语言、方言和嘈杂环境下的表现。此外,隐私问题也不容忽视——语音数据如何被处理、存储和用于训练,将是用户和监管机构关注的焦点。

总体来看,Google 此举意在巩固其在 AI 语音领域的地位,但能否在竞争激烈的市场中脱颖而出,还需看实际产品体验和生态开放程度。