
2026年8月4日,腾讯混元正式发布新一代语音识别模型Hy ASR3.0preview,首次将旗下Hy3大语言模型的语义理解能力深度融入识别全链路。该模型在开源评测集中文普通话、英语、粤语词错误率分别低至3.34%、2.62%、3.12%,整体约3%,实现了从逐字转写到语境理解的技术跨越,多场景识别精度处于行业领先水平。

对于经常使用语音转写工具的用户来说,同音字混淆、专业术语识别错误、嘈杂环境下转写准确率暴跌的问题并不少见——传统语音识别技术长期聚焦声学特征的单点优化,缺乏对上下文语义的理解能力,导致转写结果往往需要大量人工校对才能投入使用。
登录后解锁全文,体验收藏、点赞、评论等完整功能
立即登录