登录体验完整功能(收藏、点赞、评论等) — 已累计有 13265 人加入

阿里通义千问发布ASR新模型 破解专业场景语音识别痛点

详情页推荐

2026年7月31日,阿里通义千问正式发布语音识别大模型Qwen-Audio-3.0-ASR-Flash,主打长音频不丢词、行业词免配置两大核心优势,医疗场景专业词召回率达95.36%、IT编程场景达91.87%,目前该模型已在阿里云百炼平台开放调用,将大幅降低各行业语音转写落地的时间与人力成本。

配图

长期以来,专业场景的语音转写始终是ASR(自动语音识别)技术落地的老大难问题:几小时的跨部门会议转写人名前后不统一、医疗问诊录音里的专业术语识别错误率高达20%以上、企业要维护动辄上万个专属热词才能保证识别准确率,额外的人工校正成本甚至超过了转写本身的价值。

免责声明:本网站AI资讯内容仅供学习参考,不构成任何建议,不对信息准确性与完整性负责。