谷歌发布Gemini 3.5 Transcribe 攻克多场景语音转写精度瓶颈

2026年8月27日,谷歌正式推出Gemini系列全新语音转文字模型Gemini 3.5 Transcribe,定位为该系列迄今识别精度最高的语音识别产品,针对嘈杂环境噪声、专业领域术语、自然口语表达等长期存在的行业痛点做了专项优化,目前已率先落地谷歌旗下C端应用,同时面向开发者、企业及普通用户全面开放。

配图

从谷歌公开的测试结果来看,Gemini 3.5 Transcribe在60分贝的嘈杂公共场所场景下,识别准确率相比上一代同类型产品提升了37%,即便是多人同时交谈的混杂场景,也能精准锁定目标声源的语音内容,大幅降低了后期人工校正的时间成本。

免责声明:本网站AI资讯内容仅供学习参考,不构成任何建议,不对信息准确性与完整性负责。