登录体验完整功能(收藏、点赞、评论等) — 已累计有 13359 人加入

腾讯混元发布Hy ASR3.0预览版 3%方言错率实现听清到听懂跨越

详情页推荐

2026年8月5日腾讯正式发布混元新一代语音识别模型Hy ASR3.0预览版,该模型基于腾讯混元大语言模型Hy3打造,融合高精度识别与深度语义理解能力,覆盖10大方言片区及20余个二级小片区,整体词错率控制在3%左右,其中普通话3.34%、英语2.62%、粤语3.12%,实现语音识别从逐字转写到语境理解的质变。

配图

日常使用语音转写时遇到的方言识别不准、长音频上下文混乱、同音词无法区分等痛点,如今有望得到系统性解决。腾讯混元此次推出的语音识别新模型,瞄准的正是行业多年未突破的“听懂”而非仅“听清”的核心需求。

长久以来,语音识别技术的落地始终受限于“逐字转写”的底层逻辑:用户需要尽量使用标准普通话,遇到方言、口音、同音词、长文本上下文指代的场景,识别准确率往往大幅跳水。此前行业公开数据显示,主流语音识别产品的方言平均词错率普遍在8%以上,长音频场景的累计误差甚至可达15%,远无法满足专业场景的使用需求。

免责声明:本网站AI资讯内容仅供学习参考,不构成任何建议,不对信息准确性与完整性负责。