arrow
返回

Multi-Scale Self-Supervised Learning for Efficient Audio Deepfake Detection

delete2025-12-19
delete0
PRE
AI
T
Taiba Majid Wani
I
Irene Amerini
DOI:10.1109/LSP.2025.3634032delete
delete原文链接
delete原文求助
delete分享
delete收藏
摘要

摘要

En 中文
神经声码器能够生成高度逼真的合成语音,对多媒体认证构成挑战;然而,现有的检测方法在应对未见过的合成方法时鲁棒性有限,且部署准备不足。我们提出MASD(多尺度人工痕迹感知自监督深度伪造检测器),结合多尺度SSL与手工特征。MASD将频谱图分解为三个频带,通过使用掩码重建、对比预测编码和对抗声码器分类进行预训练的编码器进行处理。特征通过交叉注意力与相位一致性、频谱通量和高频能量融合,并由温度缩放的SVM进行分类。在ASVspoof 2019 LA上的评估展示了最先进的表现。消融研究证实对抗增强是鲁棒性的主要驱动因素,将EER从1.52%提升至0.39%,而零样本跨数据集评估验证了泛化有效性,确立了MASD为实用解决方案。
Keyword:
Audio deepfake detection
adversarial augmen- tation
confidence calibration
self-supervised learning

期刊

I
IEEE Signal Processing Letters
IF:
3.9
论文数:
630
被引数:
0

机构

S
Sapienza University of Rome
学者数:
3.0K
论文数: 1.2K
被引数: 4.5W
引用论文

引用论文

ASVspoof 2019: A large-scale public database of synthesized, converted and replayed speech
err2020-11-01
err0
errOAAI
errXin Wang; Junichi Yamagishi; Massimiliano Todisco; Héctor Delgado; Andreas Nautsch; Nicholas Evans; Md Sahidullah; Ville Vestman; Tomi Kinnunen; Kong Aik Lee; Lauri Juvela; Paavo Alku; Yu-Huai Peng; Hsin-Te Hwang; Yu Tsao; Hsin-Min Wang; Sébastien Le Maguer; Markus Becker; Fergus Henderson; Rob Clark; Yu Zhang; Quan Wang; Ye Jia; Kai Onuma; Koji Mushika; Takashi Kaneda; Yuan Jiang; Li-Juan Liu; Yi-Chiao Wu; Wen-Chin Huang; Tomoki Toda; Kou Tanaka; Hirokazu Kameoka; Ingmar Steiner; Driss Matrouf; Jean-François Bonastre; Avashna Govender; Srikanth Ronanki; Jing-Xuan Zhang; Zhen-Hua Ling
err分享
err收藏
ASVspoof 2021: Towards Spoofed and Deepfake Speech Detection in the Wild
err2023-01-01
err42
errOAAI
errLiu, Xuechen; Wang, Xin; Sahidullah, Md; Patino, Jose; Delgado, Hector; Kinnunen, Tomi; Todisco, Massimiliano; Yamagishi, Junichi; Evans, Nicholas; Nautsch, Andreas; Lee, Kong Aik
err分享
err收藏
End-to-End anti-spoofing with RawNet2
err2021-06-06
err0
errOAAI
errHemlata Tak; Jose Patino; Massimiliano Todisco; Andreas Nautsch; Nicholas Evans; Anthony Larcher
err分享
err收藏
AASIST: Audio Anti-Spoofing Using Integrated Spectro-Temporal Graph Attention Networks
err2022-05-23
err0
errOAAI
errJee-weon Jung; Hee-Soo Heo; Hemlata Tak; Hye-jin Shim; Joon Son Chung; Bong-Jin Lee; Ha-Jin Yu; Nicholas Evans
err分享
err收藏
ASVspoof 2021: accelerating progress in spoofed and deepfake speech detection
err2021-09-16
err0
errOAAI
errJunichi Yamagishi; Xin Wang; Massimiliano Todisco; Md Sahidullah; Jose Patino; Andreas Nautsch; Xuechen Liu; Kong Aik Lee; Tomi Kinnunen; Nicholas Evans; Héctor Delgado
err分享
err收藏
学者 查看更多内容