26.1.13.7 Speech Deepfakes, Audio Deepfakes

Chapter Contents (Back)
Speech. Audio. Deepfakes.
See also Audio-Visual Deep Fake, Generation, Detection.

Dong, S.H.[Shi-Hang], Chen, B.J.[Bei-Jing], Ma, K.J.[Kai-Jie], Zhao, G.Y.[Guo-Ying],
Active Defense Against Voice Conversion Through Generative Adversarial Network,
SPLetters(31), 2024, pp. 706-710.
IEEE DOI 2403
Perturbation methods, Generators, Training, Deepfakes, Vocoders, Generative adversarial networks, Closed box, Active defense, voice conversion BibRef

Bisogni, C.[Carmen], Loia, V.[Vincenzo], Nappi, M.[Michele], Pero, C.[Chiara],
Acoustic features analysis for explainable machine learning-based audio spoofing detection,
CVIU(249), 2024, pp. 104145.
Elsevier DOI 2412
Deepfake audio, Deepfake detection, Audio spoofing, Explainable AI, Acoustic features BibRef

Li, M.[Menglu], Ahmadiadli, Y.[Yasaman], Zhang, X.P.[Xiao-Ping],
A Survey on Speech Deepfake Detection,
Surveys(57), No. 7, February 2025, pp. xx-yy.
DOI Link 2503
Deepfake, speech synthesis, speech Deepfake detection, spoofing countermeasures, ASV BibRef

Li, M.[Menglu], Zhang, X.P.[Xiao-Ping], Zhao, L.[Lian],
Frame-Level Temporal Difference Learning for Partial Deepfake Speech Detection,
SPLetters(32), 2025, pp. 3052-3056.
IEEE DOI 2509
Deepfakes, Feature extraction, Training, Vectors, Convolution, Annotations, Adaptation models, Voice activity detection, anti-spoofing BibRef

Yuan, C.S.[Cheng-Sheng], Chen, Y.F.[Yi-Fei], Zhou, Z.[Zhili], Xia, Z.H.[Zhi-Hua], Huang, Y.F.[Yong-Feng],
Compressed Domain Invariant Adversarial Representation Learning for Robust Audio Deepfake Detection,
SPLetters(32), 2025, pp. 1111-1115.
IEEE DOI 2503
Charge coupled devices, Feature extraction, Codecs, Deepfakes, Adaptation models, Training, Forgery, Robustness, domain adversarial learning BibRef

Unoki, M.[Masashi], Li, K.[Kai], Chaiwongyen, A.[Anuwat], Nguyen, Q.H.[Quoc-Huy], Zaman, K.[Khalid],
Deepfake Speech Detection: Approaches from Acoustic Features to Deep Neural Networks,
IEICE(E108-D), No. 4, April 2025, pp. 300-310.
WWW Link. 2504
BibRef

Shah, A.J.[Arth J.], Pandey, A.[Aniket], Patil, H.A.[Hemant A.],
WINning Against Audio Deepfakes,
SPLetters(33), 2026, pp. 2240-2244.
IEEE DOI 2606
Modeling, Fans, Speech, Deepfakes, Signal detection, Frequency, Timing, Transformers, Wavelets, FAN, transformers, ADD BibRef

Salvi, D.[Davide], Castelli, F.[Francesco], Negroni, V.[Viola], Bestagini, P.[Paolo], Tubaro, S.[Stefano],
Splicing detection and localization for speech deepfakes using audio novelty,
CVIU(271), 2026, pp. 104888.
Elsevier DOI 2609
Splicing detection, Splicing localization, Audio forensics, Speech deepfake, Metric learning, Audio novelty BibRef

Sharma, S.[Shubham], Selwal, A.[Arvind],
NSF-PINN: Physics-informed source-filter decomposition with sharpness-aware minimization for generalizable audio deepfake detection,
CVIU(271), 2026, pp. 104875.
Elsevier DOI 2609
Audio deepfake detection, Sharpness-aware minimization, Source-filter theory, Physics-informed neural networks, Deep learning BibRef

Müller, N.M.[Nicolas M.], Debus, P.[Pascal],
The Watermark Shortcut: How Provenance Marking Sabotages Audio Deepfake Detection,
SPLetters(33), 2026, pp. 3476-3480.
IEEE DOI 2609
Detectors, Watermarking, Training, Speech, Cleaning, Modeling, Cloning, Glass box, Labeling, Deepfakes, Audio deepfake detection, shortcut learning BibRef

Chen, C.[Chen], Mai, K.J.[Kai-Jun], Feng, Y.X.[Yuhong-Xu], Zhao, B.[Bo], Li, A.[Ao],
Bicentric One-Class Learning With Directed Attention Fusion for Generalizable Speech Spoofing Detection,
SPLetters(33), 2026, pp. 3666-3670.
IEEE DOI 2609
Speech, Modeling, Signal detection, Deepfakes, Bit error rate, Optimization, Acoustics, Signal processing, directed attention fusion BibRef


Gajewska, J.[Joanna], Martinek, A.[Alicja], Trokielewicz, E.B.[Ewelina Bartuzi],
Audio Deepfake Detectors vs. Real Fraud - the Fall of Benchmarks,
SAForensics26(251-260)
IEEE DOI 2609
Deepfakes, Modeling, Training, Signal detection, Printing, Recording, Speech, Tuning, Cloning, deepfake detection, audio deepfakes, biometry BibRef

Yadav, A.K.S.[Amit Kumar Singh], Bhagtani, K.[Kratika], Salvi, D.[Davide], Bestagini, P.[Paolo], Delp, E.J.[Edward J.],
FairSSD: Understanding Bias in Synthetic Speech Detectors,
WMF24(4418-4428)
IEEE DOI Code:
WWW Link. 2410
Source coding, Noise, Detectors, Fraud, Deepfake Detection, AntiSpoofing, Media Forensics, Fairness, Synthetic Speech Detectors BibRef

Wani, T.M.[Taiba Majid], Amerini, I.[Irene],
Deepfakes Audio Detection Leveraging Audio Spectrogram and Convolutional Neural Networks,
CIAP23(II:156-167).
Springer DOI 2312
BibRef

Chapter on New Unsorted Entries, and Other Miscellaneous Papers continues in
Grammar Based Analysis, Language Issues, Natural Language .


Last update:Sep 30, 2026 at 11:45:00