国内刊号:32-1772/TN
国际刊号:1673-5439
发布日期:
作者:孙知信,赵杰,王恩良,刘晨磊,范连成,刘畅
单位:南京邮电大学 江苏省邮政大数据技术与应用工程研究中心,江苏 南京 210003;南京邮电大学 国家邮政局邮政行业技术研发中心(物联网技术),江苏 南京 210003;南京邮电大学 宽带无线通信与传感网技术教育部重点实验室,江苏 南京 210003南京邮电大学 江苏省邮政大数据技术与应用工程研究中心,江苏 南京 210003;南京邮电大学 国家邮政局邮政行业技术研发中心(物联网技术),江苏 南京 210003;南京邮电大学 宽带无线通信与传感网技术教育部重点实验室,江苏 南京 210003南京邮电大学 江苏省邮政大数据技术与应用工程研究中心,江苏 南京 210003;南京邮电大学 国家邮政局邮政行业技术研发中心(物联网技术),江苏 南京 210003;南京邮电大学 宽带无线通信与传感网技术教育部重点实验室,江苏 南京 210003南京邮电大学 江苏省邮政大数据技术与应用工程研究中心,江苏 南京 210003;南京邮电大学 国家邮政局邮政行业技术研发中心(物联网技术),江苏 南京 210003;南京邮电大学 宽带无线通信与传感网技术教育部重点实验室,江苏 南京 210003安徽南陵县邮政业发展中心,安徽 芜湖 241399安徽南陵县邮政业发展中心,安徽 芜湖 241399
关键词:说话人音频;音频伪造;音频鉴伪;音频数据集;深度学习
基金:国家自然科学基金(61972208,62272239)资助项目
文中概括了说话人音频攻击与对抗技术的最新进展。由于说话人音频攻击已经成为语音应用安全的严重威胁,以WaveNet、Transformer和GAN三种模型在音频攻击技术中的应用作为节点,分别介绍以其为基础的音频攻击技术。音频对抗技术则以涵盖的攻击技术分为3类,分别是基础音频攻击、重放攻击和深度伪造攻击。系统地阐述了音频攻击与对抗技术的最新研究成果,并分析比较了各算法在不同条件下的优劣,同时还介绍了音频技术常用的数据集。最后结合该领域目前的研究现状,提出了说话人音频攻防对抗技术研究中亟待关注与研究的问题。
来源:2024年第04期
《南京邮电大学学报(自然科学版)》期刊编辑部