国家安全部警示AI语音克隆:3至5秒样本即可仿冒,普通人识别准确率不足50%

PromptTree|阅读 0
2026/07/22 08:33
语音克隆国家安全深度合成监管诈骗
7月22日国家安全部提示,主流平台语音克隆最短样本已压缩至3至5秒,普通人识别高质量合成语音准确率不足50%。冒充亲友诈骗、克隆明星声纹引流、伪造公职人员言论成三大滥用场景,平台须落实备案、实名与溯源标识。

“耳听为实”正在失效——几秒语音消息,就可能被克隆成任意内容的仿冒人声。

7月22日,国家安全部发布提示称,当前AI语音克隆技术滥用已严重扰乱社会秩序、侵害人民群众财产安全。主流商业平台所需最短训练样本,已从几十分钟压缩到3至5秒:一条随手发出的语音消息、短视频里的人声片段、一通电话的简短应答,都可能被用来合成仿冒语音。合成结果在自然度、情感还原和口音相似度上,已达到让人难以分辨的水平;研究显示,在没有任何提示的情况下,普通人识别高质量合成语音的准确率不足50%。

三大滥用场景尤为突出:一是冒充亲友实施诈骗,合成“车祸、疾病”等紧急事由语音;二是克隆明星、专家声纹,用于商业广告或自媒体引流;三是伪造公职人员或公众人物语音,拼接编造不实言论后经社交媒体批量传播。

法律层面,《民法典》对自然人声音的保护参照适用肖像权规定;《生成式人工智能服务管理暂行办法》《互联网信息服务深度合成管理规定》明确要求深度合成语音服务提供者落实平台备案、用户实名、授权核验、溯源标识等合规要求,严禁无约束声纹克隆。监管信号很明确:技术越方便,门槛越不能松。