Guardado en:
| Autores principales: | Grinberg, Petr, Kumar, Ankur, Koppisetti, Surya, Bharaj, Gaurav |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2506.03425 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
What Does an Audio Deepfake Detector Focus on? A Study in the Time Domain
por: Grinberg, Petr, et al.
Publicado: (2025)
por: Grinberg, Petr, et al.
Publicado: (2025)
SLIM: Style-Linguistics Mismatch Model for Generalized Audio Deepfake Detection
por: Zhu, Yi, et al.
Publicado: (2024)
por: Zhu, Yi, et al.
Publicado: (2024)
Towards Attention-based Contrastive Learning for Audio Spoof Detection
por: Goel, Chirag, et al.
Publicado: (2024)
por: Goel, Chirag, et al.
Publicado: (2024)
Learn from Real: Reality Defender's Submission to ASVspoof5 Challenge
por: Zhu, Yi, et al.
Publicado: (2024)
por: Zhu, Yi, et al.
Publicado: (2024)
A SUPERB-Style Benchmark of Self-Supervised Speech Models for Audio Deepfake Detection
por: Ali, Hashim, et al.
Publicado: (2026)
por: Ali, Hashim, et al.
Publicado: (2026)
AVFF: Audio-Visual Feature Fusion for Video Deepfake Detection
por: Oorloff, Trevine, et al.
Publicado: (2024)
por: Oorloff, Trevine, et al.
Publicado: (2024)
ICLAD: In-Context Learning with Comparison-Guidance for Audio Deepfake Detection
por: Chou, Benjamin, et al.
Publicado: (2026)
por: Chou, Benjamin, et al.
Publicado: (2026)
Similarity Choice and Negative Scaling in Supervised Contrastive Learning for Deepfake Audio Detection
por: Sudan, Jaskirat, et al.
Publicado: (2026)
por: Sudan, Jaskirat, et al.
Publicado: (2026)
Content and Style Aware Audio-Driven Facial Animation
por: Liu, Qingju, et al.
Publicado: (2024)
por: Liu, Qingju, et al.
Publicado: (2024)
A Knowledge-Driven Approach to Music Segmentation, Music Source Separation and Cinematic Audio Source Separation
por: Ho, Chun-wei, et al.
Publicado: (2026)
por: Ho, Chun-wei, et al.
Publicado: (2026)
Lightweight Joint Audio-Visual Deepfake Detection via Single-Stream Multi-Modal Learning Framework
por: Zhang, Kuiyuan, et al.
Publicado: (2025)
por: Zhang, Kuiyuan, et al.
Publicado: (2025)
LMAC-TD: Producing Time Domain Explanations for Audio Classifiers
por: Mancini, Eleonora, et al.
Publicado: (2024)
por: Mancini, Eleonora, et al.
Publicado: (2024)
Rehearsal with Auxiliary-Informed Sampling for Audio Deepfake Detection
por: Febrinanto, Falih Gozi, et al.
Publicado: (2025)
por: Febrinanto, Falih Gozi, et al.
Publicado: (2025)
Distilling Conversations: Abstract Compression of Conversational Audio Context for LLM-based ASR
por: Kumar, Shashi, et al.
Publicado: (2026)
por: Kumar, Shashi, et al.
Publicado: (2026)
XMAD-Bench: Cross-Domain Multilingual Audio Deepfake Benchmark
por: Ciobanu, Ioan-Paul, et al.
Publicado: (2025)
por: Ciobanu, Ioan-Paul, et al.
Publicado: (2025)
Multilingual Dataset Integration Strategies for Robust Audio Deepfake Detection: A SAFE Challenge System
por: Ali, Hashim, et al.
Publicado: (2025)
por: Ali, Hashim, et al.
Publicado: (2025)
Diffused Responsibility: Analyzing the Energy Consumption of Generative Text-to-Audio Diffusion Models
por: Passoni, Riccardo, et al.
Publicado: (2025)
por: Passoni, Riccardo, et al.
Publicado: (2025)
Prompt-guided Precise Audio Editing with Diffusion Models
por: Xu, Manjie, et al.
Publicado: (2024)
por: Xu, Manjie, et al.
Publicado: (2024)
Does Current Deepfake Audio Detection Model Effectively Detect ALM-based Deepfake Audio?
por: Xie, Yuankun, et al.
Publicado: (2024)
por: Xie, Yuankun, et al.
Publicado: (2024)
LongAudio-RAG: Event-Grounded Question Answering over Multi-Hour Long Audio
por: Vakada, Naveen, et al.
Publicado: (2026)
por: Vakada, Naveen, et al.
Publicado: (2026)
Alethia: A Foundational Encoder for Voice Deepfakes
por: Zhu, Yi, et al.
Publicado: (2026)
por: Zhu, Yi, et al.
Publicado: (2026)
Leveraging Whisper Embeddings for Audio-based Lyrics Matching
por: Mancini, Eleonora, et al.
Publicado: (2025)
por: Mancini, Eleonora, et al.
Publicado: (2025)
Multimodal Audio-based Disease Prediction with Transformer-based Hierarchical Fusion Network
por: Cai, Jinjin, et al.
Publicado: (2024)
por: Cai, Jinjin, et al.
Publicado: (2024)
SoundBreak: A Systematic Study of Audio-Only Adversarial Attacks on Trimodal Models
por: Hussain, Aafiya, et al.
Publicado: (2026)
por: Hussain, Aafiya, et al.
Publicado: (2026)
Guiding Audio Editing with Audio Language Model
por: Lan, Zitong, et al.
Publicado: (2025)
por: Lan, Zitong, et al.
Publicado: (2025)
Open-Amp: Synthetic Data Framework for Audio Effect Foundation Models
por: Wright, Alec, et al.
Publicado: (2024)
por: Wright, Alec, et al.
Publicado: (2024)
Tuning In: Analysis of Audio Classifier Performance in Clinical Settings with Limited Data
por: Mahdi, Hamza, et al.
Publicado: (2024)
por: Mahdi, Hamza, et al.
Publicado: (2024)
Unbiased Sliced Wasserstein Kernels for High-Quality Audio Captioning
por: Luong, Manh, et al.
Publicado: (2025)
por: Luong, Manh, et al.
Publicado: (2025)
IndieFake Dataset: A Benchmark Dataset for Audio Deepfake Detection
por: Kumar, Abhay, et al.
Publicado: (2025)
por: Kumar, Abhay, et al.
Publicado: (2025)
PoDAR: Power-Disentangled Audio Representation for Generative Modeling
por: Luebs, Alejandro, et al.
Publicado: (2026)
por: Luebs, Alejandro, et al.
Publicado: (2026)
AudioGenX: Explainability on Text-to-Audio Generative Models
por: Kang, Hyunju, et al.
Publicado: (2025)
por: Kang, Hyunju, et al.
Publicado: (2025)
Efficient Parallel Audio Generation using Group Masked Language Modeling
por: Jeong, Myeonghun, et al.
Publicado: (2024)
por: Jeong, Myeonghun, et al.
Publicado: (2024)
Prompt Tuning for Audio Deepfake Detection: Computationally Efficient Test-time Domain Adaptation with Limited Target Dataset
por: Oiso, Hideyuki, et al.
Publicado: (2024)
por: Oiso, Hideyuki, et al.
Publicado: (2024)
Targeted Augmented Data for Audio Deepfake Detection
por: Astrid, Marcella, et al.
Publicado: (2024)
por: Astrid, Marcella, et al.
Publicado: (2024)
$\texttt{AVROBUSTBENCH}$: Benchmarking the Robustness of Audio-Visual Recognition Models at Test-Time
por: Maharana, Sarthak Kumar, et al.
Publicado: (2025)
por: Maharana, Sarthak Kumar, et al.
Publicado: (2025)
JSQA: Speech Quality Assessment with Perceptually-Inspired Contrastive Pretraining Based on JND Audio Pairs
por: Fan, Junyi, et al.
Publicado: (2025)
por: Fan, Junyi, et al.
Publicado: (2025)
Multi-Microphone Speech Emotion Recognition using the Hierarchical Token-semantic Audio Transformer Architecture
por: Cohen, Ohad, et al.
Publicado: (2024)
por: Cohen, Ohad, et al.
Publicado: (2024)
A Survey of Deep Learning Audio Generation Methods
por: Božić, Matej, et al.
Publicado: (2024)
por: Božić, Matej, et al.
Publicado: (2024)
Codecfake: An Initial Dataset for Detecting LLM-based Deepfake Audio
por: Lu, Yi, et al.
Publicado: (2024)
por: Lu, Yi, et al.
Publicado: (2024)
What Counts as Real? Speech Restoration and Voice Quality Conversion Pose New Challenges to Deepfake Detection
por: Satish, Shree Harsha Bokkahalli, et al.
Publicado: (2026)
por: Satish, Shree Harsha Bokkahalli, et al.
Publicado: (2026)
Ejemplares similares
-
What Does an Audio Deepfake Detector Focus on? A Study in the Time Domain
por: Grinberg, Petr, et al.
Publicado: (2025) -
SLIM: Style-Linguistics Mismatch Model for Generalized Audio Deepfake Detection
por: Zhu, Yi, et al.
Publicado: (2024) -
Towards Attention-based Contrastive Learning for Audio Spoof Detection
por: Goel, Chirag, et al.
Publicado: (2024) -
Learn from Real: Reality Defender's Submission to ASVspoof5 Challenge
por: Zhu, Yi, et al.
Publicado: (2024) -
A SUPERB-Style Benchmark of Self-Supervised Speech Models for Audio Deepfake Detection
por: Ali, Hashim, et al.
Publicado: (2026)