Towards Attention-based Contrastive Learning for Audio Spoof Detection
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Goel, Chirag, Koppisetti, Surya, Colman, Ben, Shahriyari, Ali, Bharaj, Gaurav |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SLIM: Style-Linguistics Mismatch Model for Generalized Audio Deepfake Detection
par: Zhu, Yi, et autres
Publié: (2024)
par: Zhu, Yi, et autres
Publié: (2024)
AVFF: Audio-Visual Feature Fusion for Video Deepfake Detection
par: Oorloff, Trevine, et autres
Publié: (2024)
par: Oorloff, Trevine, et autres
Publié: (2024)
What Does an Audio Deepfake Detector Focus on? A Study in the Time Domain
par: Grinberg, Petr, et autres
Publié: (2025)
par: Grinberg, Petr, et autres
Publié: (2025)
Augmentation through Laundering Attacks for Audio Spoof Detection
par: Ali, Hashim, et autres
Publié: (2024)
par: Ali, Hashim, et autres
Publié: (2024)
A Data-Driven Diffusion-based Approach for Audio Deepfake Explanations
par: Grinberg, Petr, et autres
Publié: (2025)
par: Grinberg, Petr, et autres
Publié: (2025)
LJ-Spoof: A Generatively Varied Corpus for Audio Anti-Spoofing and Synthesis Source Tracing
par: Subramani, Surya, et autres
Publié: (2026)
par: Subramani, Surya, et autres
Publié: (2026)
Learn from Real: Reality Defender's Submission to ASVspoof5 Challenge
par: Zhu, Yi, et autres
Publié: (2024)
par: Zhu, Yi, et autres
Publié: (2024)
How Do Neural Spoofing Countermeasures Detect Partially Spoofed Audio?
par: Liu, Tianchi, et autres
Publié: (2024)
par: Liu, Tianchi, et autres
Publié: (2024)
ICLAD: In-Context Learning with Comparison-Guidance for Audio Deepfake Detection
par: Chou, Benjamin, et autres
Publié: (2026)
par: Chou, Benjamin, et autres
Publié: (2026)
Enhancing Partially Spoofed Audio Localization with Boundary-aware Attention Mechanism
par: Zhong, Jiafeng, et autres
Publié: (2024)
par: Zhong, Jiafeng, et autres
Publié: (2024)
Toward Improving Synthetic Audio Spoofing Detection Robustness via Meta-Learning and Disentangled Training With Adversarial Examples
par: Wang, Zhenyu, et autres
Publié: (2024)
par: Wang, Zhenyu, et autres
Publié: (2024)
Generalizable Audio Spoofing Detection using Non-Semantic Representations
par: Das, Arnab, et autres
Publié: (2025)
par: Das, Arnab, et autres
Publié: (2025)
HierCon: Hierarchical Contrastive Attention for Audio Deepfake Detection
par: Liang, Zhili Nicholas, et autres
Publié: (2026)
par: Liang, Zhili Nicholas, et autres
Publié: (2026)
Content and Style Aware Audio-Driven Facial Animation
par: Liu, Qingju, et autres
Publié: (2024)
par: Liu, Qingju, et autres
Publié: (2024)
Beyond Silence: Bias Analysis through Loss and Asymmetric Approach in Audio Anti-Spoofing
par: Shim, Hye-jin, et autres
Publié: (2024)
par: Shim, Hye-jin, et autres
Publié: (2024)
Robust Audio Anti-Spoofing with Fusion-Reconstruction Learning on Multi-Order Spectrograms
par: Wen, Penghui, et autres
Publié: (2023)
par: Wen, Penghui, et autres
Publié: (2023)
Towards Leveraging Contrastively Pretrained Neural Audio Embeddings for Recommender Tasks
par: Grötschla, Florian, et autres
Publié: (2024)
par: Grötschla, Florian, et autres
Publié: (2024)
SpoofCeleb: Speech Deepfake Detection and SASV In The Wild
par: Jung, Jee-weon, et autres
Publié: (2024)
par: Jung, Jee-weon, et autres
Publié: (2024)
Gibberish is All You Need for Membership Inference Detection in Contrastive Language-Audio Pretraining
par: Cheng, Ruoxi, et autres
Publié: (2024)
par: Cheng, Ruoxi, et autres
Publié: (2024)
Does Current Deepfake Audio Detection Model Effectively Detect ALM-based Deepfake Audio?
par: Xie, Yuankun, et autres
Publié: (2024)
par: Xie, Yuankun, et autres
Publié: (2024)
Deepfake Audio Detection Using Spectrogram-based Feature and Ensemble of Deep Learning Models
par: Pham, Lam, et autres
Publié: (2024)
par: Pham, Lam, et autres
Publié: (2024)
Prototype based Masked Audio Model for Self-Supervised Learning of Sound Event Detection
par: Cai, Pengfei, et autres
Publié: (2024)
par: Cai, Pengfei, et autres
Publié: (2024)
Codecfake: An Initial Dataset for Detecting LLM-based Deepfake Audio
par: Lu, Yi, et autres
Publié: (2024)
par: Lu, Yi, et autres
Publié: (2024)
ALDAS: Audio-Linguistic Data Augmentation for Spoofed Audio Detection
par: Khanjani, Zahra, et autres
Publié: (2024)
par: Khanjani, Zahra, et autres
Publié: (2024)
MLCA-AVSR: Multi-Layer Cross Attention Fusion based Audio-Visual Speech Recognition
par: Wang, He, et autres
Publié: (2024)
par: Wang, He, et autres
Publié: (2024)
Region-Based Optimization in Continual Learning for Audio Deepfake Detection
par: Chen, Yujie, et autres
Publié: (2024)
par: Chen, Yujie, et autres
Publié: (2024)
Towards Controllable Audio Texture Morphing
par: Gupta, Chitralekha, et autres
Publié: (2023)
par: Gupta, Chitralekha, et autres
Publié: (2023)
Contrastive Learning with Spectrum Information Augmentation in Abnormal Sound Detection
par: Meng, Xinxin, et autres
Publié: (2025)
par: Meng, Xinxin, et autres
Publié: (2025)
Retrieval-Augmented Audio Deepfake Detection
par: Kang, Zuheng, et autres
Publié: (2024)
par: Kang, Zuheng, et autres
Publié: (2024)
Toward Efficient Speech Emotion Recognition via Spectral Learning and Attention
par: Lee, HyeYoung, et autres
Publié: (2025)
par: Lee, HyeYoung, et autres
Publié: (2025)
Audio Contrastive-based Fine-tuning: Decoupling Representation Learning and Classification
par: Wang, Yang, et autres
Publié: (2023)
par: Wang, Yang, et autres
Publié: (2023)
FusionAudio-1.2M: Towards Fine-grained Audio Captioning with Multimodal Contextual Fusion
par: Chen, Shunian, et autres
Publié: (2025)
par: Chen, Shunian, et autres
Publié: (2025)
CoLLAP: Contrastive Long-form Language-Audio Pretraining with Musical Temporal Structure Augmentation
par: Wu, Junda, et autres
Publié: (2024)
par: Wu, Junda, et autres
Publié: (2024)
Replay Attacks Against Audio Deepfake Detection
par: Müller, Nicolas, et autres
Publié: (2025)
par: Müller, Nicolas, et autres
Publié: (2025)
Audio Mamba: Bidirectional State Space Model for Audio Representation Learning
par: Erol, Mehmet Hamza, et autres
Publié: (2024)
par: Erol, Mehmet Hamza, et autres
Publié: (2024)
Contrastive Learning-based Chaining-Cluster for Multilingual Voice-Face Association
par: Chen, Wuyang, et autres
Publié: (2024)
par: Chen, Wuyang, et autres
Publié: (2024)
Plug-and-Play Co-Occurring Face Attention for Robust Audio-Visual Speaker Extraction
par: Pan, Zexu, et autres
Publié: (2025)
par: Pan, Zexu, et autres
Publié: (2025)
Generalizable Audio-Visual Navigation via Binaural Difference Attention and Action Transition Prediction
par: Li, Jia, et autres
Publié: (2026)
par: Li, Jia, et autres
Publié: (2026)
Towards Effective and Efficient Non-autoregressive Decoding Using Block-based Attention Mask
par: Wang, Tianzi, et autres
Publié: (2024)
par: Wang, Tianzi, et autres
Publié: (2024)
TTMBA: Towards Text To Multiple Sources Binaural Audio Generation
par: He, Yuxuan, et autres
Publié: (2025)
par: He, Yuxuan, et autres
Publié: (2025)
Documents similaires
-
SLIM: Style-Linguistics Mismatch Model for Generalized Audio Deepfake Detection
par: Zhu, Yi, et autres
Publié: (2024) -
AVFF: Audio-Visual Feature Fusion for Video Deepfake Detection
par: Oorloff, Trevine, et autres
Publié: (2024) -
What Does an Audio Deepfake Detector Focus on? A Study in the Time Domain
par: Grinberg, Petr, et autres
Publié: (2025) -
Augmentation through Laundering Attacks for Audio Spoof Detection
par: Ali, Hashim, et autres
Publié: (2024) -
A Data-Driven Diffusion-based Approach for Audio Deepfake Explanations
par: Grinberg, Petr, et autres
Publié: (2025)