国家安全部近日发布安全提示,解析AI语音克隆技术潜藏的三类安全风险。该技术当前仅需3-5秒音频样本即可精准复刻人声,普通人对伪造语音的识别成功率不足50%,加上市面大量在线平台推出“一键克隆”功能大幅降低滥用门槛,其引发的诈骗、侵权、公共秩序扰乱等问题已对个人财产与社会治理构成新挑战。
你有没有接到过声称是亲友的来电,开口就说遇到急事需要转账,声音明明和记忆里完全一致,转完钱才发现落入了骗局?随着语音深度合成技术的快速普及,这种过去仅出现在反诈宣传中的极端案例,正在越来越多普通人的生活中真实上演。
过去语音克隆需要数小时甚至更长时间的高质量采样素材,还要专业技术人员调试模型才能实现,而当前主流的AI语音克隆技术,仅需要3到5秒的短音频即可完成训练,哪怕是朋友圈发布的语音条、短视频里的背景人声,都能作为采样素材生成和原主音色、语气几乎没有差别的合成语音。
根据相关测试结果,普通人在无防备状态下识别AI伪造语音的成功率不足50%,相当于每两个人中就有一人无法通过声音分辨真假。更值得警惕的是,目前不少第三方在线平台直接推出“一键克隆”功能,用户上传音频后最快1分钟就能生成可自由使用的合成语音包,全程没有身份核验、使用场景限制等约束,技术滥用的门槛被压到了最低。
登录后解锁全文,体验收藏、点赞、评论等完整功能
立即登录