2026年8月27日,谷歌正式推出Gemini系列全新语音转文字模型Gemini 3.5 Transcribe,定位为该系列迄今识别精度最高的语音识别产品,针对嘈杂环境噪声、专业领域术语、自然口语表达等长期存在的行业痛点做了专项优化,目前已率先落地谷歌旗下C端应用,同时面向开发者、企业及普通用户全面开放。

从谷歌公开的测试结果来看,Gemini 3.5 Transcribe在60分贝的嘈杂公共场所场景下,识别准确率相比上一代同类型产品提升了37%,即便是多人同时交谈的混杂场景,也能精准锁定目标声源的语音内容,大幅降低了后期人工校正的时间成本。
登录后解锁全文,体验收藏、点赞、评论等完整功能
立即登录