A Data-Driven Diffusion-based Approach for Audio Deepfake Explanations
Fuente:
arXiv
Salvato in:
| Autori principali: | Grinberg, Petr, Kumar, Ankur, Koppisetti, Surya, Bharaj, Gaurav |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
What Does an Audio Deepfake Detector Focus on? A Study in the Time Domain
di: Grinberg, Petr, et al.
Pubblicazione: (2025)
di: Grinberg, Petr, et al.
Pubblicazione: (2025)
SLIM: Style-Linguistics Mismatch Model for Generalized Audio Deepfake Detection
di: Zhu, Yi, et al.
Pubblicazione: (2024)
di: Zhu, Yi, et al.
Pubblicazione: (2024)
Towards Attention-based Contrastive Learning for Audio Spoof Detection
di: Goel, Chirag, et al.
Pubblicazione: (2024)
di: Goel, Chirag, et al.
Pubblicazione: (2024)
Learn from Real: Reality Defender's Submission to ASVspoof5 Challenge
di: Zhu, Yi, et al.
Pubblicazione: (2024)
di: Zhu, Yi, et al.
Pubblicazione: (2024)
A SUPERB-Style Benchmark of Self-Supervised Speech Models for Audio Deepfake Detection
di: Ali, Hashim, et al.
Pubblicazione: (2026)
di: Ali, Hashim, et al.
Pubblicazione: (2026)
AVFF: Audio-Visual Feature Fusion for Video Deepfake Detection
di: Oorloff, Trevine, et al.
Pubblicazione: (2024)
di: Oorloff, Trevine, et al.
Pubblicazione: (2024)
ICLAD: In-Context Learning with Comparison-Guidance for Audio Deepfake Detection
di: Chou, Benjamin, et al.
Pubblicazione: (2026)
di: Chou, Benjamin, et al.
Pubblicazione: (2026)
Similarity Choice and Negative Scaling in Supervised Contrastive Learning for Deepfake Audio Detection
di: Sudan, Jaskirat, et al.
Pubblicazione: (2026)
di: Sudan, Jaskirat, et al.
Pubblicazione: (2026)
A Knowledge-Driven Approach to Music Segmentation, Music Source Separation and Cinematic Audio Source Separation
di: Ho, Chun-wei, et al.
Pubblicazione: (2026)
di: Ho, Chun-wei, et al.
Pubblicazione: (2026)
Lightweight Joint Audio-Visual Deepfake Detection via Single-Stream Multi-Modal Learning Framework
di: Zhang, Kuiyuan, et al.
Pubblicazione: (2025)
di: Zhang, Kuiyuan, et al.
Pubblicazione: (2025)
Content and Style Aware Audio-Driven Facial Animation
di: Liu, Qingju, et al.
Pubblicazione: (2024)
di: Liu, Qingju, et al.
Pubblicazione: (2024)
LMAC-TD: Producing Time Domain Explanations for Audio Classifiers
di: Mancini, Eleonora, et al.
Pubblicazione: (2024)
di: Mancini, Eleonora, et al.
Pubblicazione: (2024)
Multilingual Dataset Integration Strategies for Robust Audio Deepfake Detection: A SAFE Challenge System
di: Ali, Hashim, et al.
Pubblicazione: (2025)
di: Ali, Hashim, et al.
Pubblicazione: (2025)
Rehearsal with Auxiliary-Informed Sampling for Audio Deepfake Detection
di: Febrinanto, Falih Gozi, et al.
Pubblicazione: (2025)
di: Febrinanto, Falih Gozi, et al.
Pubblicazione: (2025)
Diffused Responsibility: Analyzing the Energy Consumption of Generative Text-to-Audio Diffusion Models
di: Passoni, Riccardo, et al.
Pubblicazione: (2025)
di: Passoni, Riccardo, et al.
Pubblicazione: (2025)
Does Current Deepfake Audio Detection Model Effectively Detect ALM-based Deepfake Audio?
di: Xie, Yuankun, et al.
Pubblicazione: (2024)
di: Xie, Yuankun, et al.
Pubblicazione: (2024)
Distilling Conversations: Abstract Compression of Conversational Audio Context for LLM-based ASR
di: Kumar, Shashi, et al.
Pubblicazione: (2026)
di: Kumar, Shashi, et al.
Pubblicazione: (2026)
Prompt-guided Precise Audio Editing with Diffusion Models
di: Xu, Manjie, et al.
Pubblicazione: (2024)
di: Xu, Manjie, et al.
Pubblicazione: (2024)
XMAD-Bench: Cross-Domain Multilingual Audio Deepfake Benchmark
di: Ciobanu, Ioan-Paul, et al.
Pubblicazione: (2025)
di: Ciobanu, Ioan-Paul, et al.
Pubblicazione: (2025)
LongAudio-RAG: Event-Grounded Question Answering over Multi-Hour Long Audio
di: Vakada, Naveen, et al.
Pubblicazione: (2026)
di: Vakada, Naveen, et al.
Pubblicazione: (2026)
Leveraging Whisper Embeddings for Audio-based Lyrics Matching
di: Mancini, Eleonora, et al.
Pubblicazione: (2025)
di: Mancini, Eleonora, et al.
Pubblicazione: (2025)
IndieFake Dataset: A Benchmark Dataset for Audio Deepfake Detection
di: Kumar, Abhay, et al.
Pubblicazione: (2025)
di: Kumar, Abhay, et al.
Pubblicazione: (2025)
Targeted Augmented Data for Audio Deepfake Detection
di: Astrid, Marcella, et al.
Pubblicazione: (2024)
di: Astrid, Marcella, et al.
Pubblicazione: (2024)
Multimodal Audio-based Disease Prediction with Transformer-based Hierarchical Fusion Network
di: Cai, Jinjin, et al.
Pubblicazione: (2024)
di: Cai, Jinjin, et al.
Pubblicazione: (2024)
Open-Amp: Synthetic Data Framework for Audio Effect Foundation Models
di: Wright, Alec, et al.
Pubblicazione: (2024)
di: Wright, Alec, et al.
Pubblicazione: (2024)
Tuning In: Analysis of Audio Classifier Performance in Clinical Settings with Limited Data
di: Mahdi, Hamza, et al.
Pubblicazione: (2024)
di: Mahdi, Hamza, et al.
Pubblicazione: (2024)
Unbiased Sliced Wasserstein Kernels for High-Quality Audio Captioning
di: Luong, Manh, et al.
Pubblicazione: (2025)
di: Luong, Manh, et al.
Pubblicazione: (2025)
Guiding Audio Editing with Audio Language Model
di: Lan, Zitong, et al.
Pubblicazione: (2025)
di: Lan, Zitong, et al.
Pubblicazione: (2025)
Efficient Parallel Audio Generation using Group Masked Language Modeling
di: Jeong, Myeonghun, et al.
Pubblicazione: (2024)
di: Jeong, Myeonghun, et al.
Pubblicazione: (2024)
Alethia: A Foundational Encoder for Voice Deepfakes
di: Zhu, Yi, et al.
Pubblicazione: (2026)
di: Zhu, Yi, et al.
Pubblicazione: (2026)
AudioGenX: Explainability on Text-to-Audio Generative Models
di: Kang, Hyunju, et al.
Pubblicazione: (2025)
di: Kang, Hyunju, et al.
Pubblicazione: (2025)
Codecfake: An Initial Dataset for Detecting LLM-based Deepfake Audio
di: Lu, Yi, et al.
Pubblicazione: (2024)
di: Lu, Yi, et al.
Pubblicazione: (2024)
PoDAR: Power-Disentangled Audio Representation for Generative Modeling
di: Luebs, Alejandro, et al.
Pubblicazione: (2026)
di: Luebs, Alejandro, et al.
Pubblicazione: (2026)
JSQA: Speech Quality Assessment with Perceptually-Inspired Contrastive Pretraining Based on JND Audio Pairs
di: Fan, Junyi, et al.
Pubblicazione: (2025)
di: Fan, Junyi, et al.
Pubblicazione: (2025)
Multi-Microphone Speech Emotion Recognition using the Hierarchical Token-semantic Audio Transformer Architecture
di: Cohen, Ohad, et al.
Pubblicazione: (2024)
di: Cohen, Ohad, et al.
Pubblicazione: (2024)
Retrieval-Augmented Audio Deepfake Detection
di: Kang, Zuheng, et al.
Pubblicazione: (2024)
di: Kang, Zuheng, et al.
Pubblicazione: (2024)
$\texttt{AVROBUSTBENCH}$: Benchmarking the Robustness of Audio-Visual Recognition Models at Test-Time
di: Maharana, Sarthak Kumar, et al.
Pubblicazione: (2025)
di: Maharana, Sarthak Kumar, et al.
Pubblicazione: (2025)
SoundBreak: A Systematic Study of Audio-Only Adversarial Attacks on Trimodal Models
di: Hussain, Aafiya, et al.
Pubblicazione: (2026)
di: Hussain, Aafiya, et al.
Pubblicazione: (2026)
Prompt Tuning for Audio Deepfake Detection: Computationally Efficient Test-time Domain Adaptation with Limited Target Dataset
di: Oiso, Hideyuki, et al.
Pubblicazione: (2024)
di: Oiso, Hideyuki, et al.
Pubblicazione: (2024)
A Survey of Deep Learning Audio Generation Methods
di: Božić, Matej, et al.
Pubblicazione: (2024)
di: Božić, Matej, et al.
Pubblicazione: (2024)
Documenti analoghi
-
What Does an Audio Deepfake Detector Focus on? A Study in the Time Domain
di: Grinberg, Petr, et al.
Pubblicazione: (2025) -
SLIM: Style-Linguistics Mismatch Model for Generalized Audio Deepfake Detection
di: Zhu, Yi, et al.
Pubblicazione: (2024) -
Towards Attention-based Contrastive Learning for Audio Spoof Detection
di: Goel, Chirag, et al.
Pubblicazione: (2024) -
Learn from Real: Reality Defender's Submission to ASVspoof5 Challenge
di: Zhu, Yi, et al.
Pubblicazione: (2024) -
A SUPERB-Style Benchmark of Self-Supervised Speech Models for Audio Deepfake Detection
di: Ali, Hashim, et al.
Pubblicazione: (2026)