谷歌AI近期正式推出全新语音转文字模型Gemini 3.5 Transcribe,目前已开放公开预览。该模型在85种以上语言的语音识别测试中实现了2.6%的平均词错误率(WER),相比此前行业主流多语言语音转文字产品精度提升超40%,可覆盖全球98%以上人口的常用语言,大幅降低多语言内容转录的门槛与成本。

---
对于需要处理多语言内容的团队来说,语音转文字的精度问题一直是工作流程中的核心卡点:一场同时用到英语、印尼语、越南语的跨境电商招商会,传统转录工具给出的文稿错误率往往超过12%,后期人工校对的时间是转录时长的3倍以上。
登录后解锁全文,体验收藏、点赞、评论等完整功能
立即登录