HCFD: A Benchmark for Audio Deepfake Detection in Healthcare
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Akhtar, Mohd Mujtaba, Girish, Singh, Muskaan |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Curved Worlds, Clear Boundaries: Generalizing Speech Deepfake Detection using Hyperbolic and Spherical Geometry Spaces
par: Sheth, Farhan, et autres
Publié: (2025)
par: Sheth, Farhan, et autres
Publié: (2025)
Prosody as Supervision: Bridging the Non-Verbal--Verbal for Multilingual Speech Emotion Recognition
par: Girish, et autres
Publié: (2026)
par: Girish, et autres
Publié: (2026)
DIVINE: Coordinating Multimodal Disentangled Representations for Oro-Facial Neurological Disorder Assessment
par: Akhtar, Mohd Mujtaba, et autres
Publié: (2026)
par: Akhtar, Mohd Mujtaba, et autres
Publié: (2026)
Bridging Attribution and Open-Set Detection using Graph-Augmented Instance Learning in Synthetic Speech
par: Akhtar, Mohd Mujtaba, et autres
Publié: (2026)
par: Akhtar, Mohd Mujtaba, et autres
Publié: (2026)
NeuRO: An Application for Code-Switched Autism Detection in Children
par: Akhtar, Mohd Mujtaba, et autres
Publié: (2024)
par: Akhtar, Mohd Mujtaba, et autres
Publié: (2024)
Towards Attribution of Generators and Emotional Manipulation in Cross-Lingual Synthetic Speech using Geometric Learning
par: Girish, et autres
Publié: (2025)
par: Girish, et autres
Publié: (2025)
Indic-CodecFake meets SATYAM: Towards Detecting Neural Audio Codec Synthesized Speech Deepfakes in Indic Languages
par: Girish, et autres
Publié: (2026)
par: Girish, et autres
Publié: (2026)
Enhancing In-Domain and Out-Domain EmoFake Detection via Cooperative Multilingual Speech Foundation Models
par: Phukan, Orchid Chetia, et autres
Publié: (2025)
par: Phukan, Orchid Chetia, et autres
Publié: (2025)
Towards Neural Audio Codec Source Parsing
par: Phukan, Orchid Chetia, et autres
Publié: (2025)
par: Phukan, Orchid Chetia, et autres
Publié: (2025)
Towards Machine Unlearning for Paralinguistic Speech Processing
par: Phukan, Orchid Chetia, et autres
Publié: (2025)
par: Phukan, Orchid Chetia, et autres
Publié: (2025)
Rethinking Cross-Corpus Speech Emotion Recognition Benchmarking: Are Paralinguistic Pre-Trained Representations Sufficient?
par: Phukan, Orchid Chetia, et autres
Publié: (2025)
par: Phukan, Orchid Chetia, et autres
Publié: (2025)
Towards Source Attribution of Singing Voice Deepfake with Multimodal Foundation Models
par: Phukan, Orchid Chetia, et autres
Publié: (2025)
par: Phukan, Orchid Chetia, et autres
Publié: (2025)
Towards Fusion of Neural Audio Codec-based Representations with Spectral for Heart Murmur Classification via Bandit-based Cross-Attention Mechanism
par: Phukan, Orchid Chetia, et autres
Publié: (2025)
par: Phukan, Orchid Chetia, et autres
Publié: (2025)
Are Mamba-based Audio Foundation Models the Best Fit for Non-Verbal Emotion Recognition?
par: Akhtar, Mohd Mujtaba, et autres
Publié: (2025)
par: Akhtar, Mohd Mujtaba, et autres
Publié: (2025)
Are Multimodal Foundation Models All That Is Needed for Emofake Detection?
par: Akhtar, Mohd Mujtaba, et autres
Publié: (2025)
par: Akhtar, Mohd Mujtaba, et autres
Publié: (2025)
HYFuse: Aligning Heterogeneous Speech Pre-Trained Representations in Hyperbolic Space for Speech Emotion Recognition
par: Phukan, Orchid Chetia, et autres
Publié: (2025)
par: Phukan, Orchid Chetia, et autres
Publié: (2025)
Benchmarking Audio Deepfake Detection Robustness in Real-world Communication Scenarios
par: Shi, Haohan, et autres
Publié: (2025)
par: Shi, Haohan, et autres
Publié: (2025)
Audio Deepfake Detection at the First Greeting: "Hi!"
par: Shi, Haohan, et autres
Publié: (2026)
par: Shi, Haohan, et autres
Publié: (2026)
Source Tracing of Synthetic Speech Systems Through Paralinguistic Pre-Trained Representations
par: Girish, et autres
Publié: (2025)
par: Girish, et autres
Publié: (2025)
Generalizable Detection of Audio Deepfakes
par: Lopez, Jose A., et autres
Publié: (2025)
par: Lopez, Jose A., et autres
Publié: (2025)
Detection of Deepfake Environmental Audio
par: Ouajdi, Hafsa, et autres
Publié: (2024)
par: Ouajdi, Hafsa, et autres
Publié: (2024)
Towards Robust Audio Deepfake Detection: A Evolving Benchmark for Continual Learning
par: Zhang, Xiaohui, et autres
Publié: (2024)
par: Zhang, Xiaohui, et autres
Publié: (2024)
SynHate: Detecting Hate Speech in Synthetic Deepfake Audio
par: Ranjan, Rishabh, et autres
Publié: (2025)
par: Ranjan, Rishabh, et autres
Publié: (2025)
Investigating the Reasonable Effectiveness of Speaker Pre-Trained Models and their Synergistic Power for SingMOS Prediction
par: Phukan, Orchid Chetia, et autres
Publié: (2025)
par: Phukan, Orchid Chetia, et autres
Publié: (2025)
Audio Deepfake Verification
par: Wang, Li, et autres
Publié: (2025)
par: Wang, Li, et autres
Publié: (2025)
PARROT: Synergizing Mamba and Attention-based SSL Pre-Trained Models via Parallel Branch Hadamard Optimal Transport for Speech Emotion Recognition
par: Phukan, Orchid Chetia, et autres
Publié: (2025)
par: Phukan, Orchid Chetia, et autres
Publié: (2025)
Transferable Adversarial Attacks on Audio Deepfake Detection
par: Farooq, Muhammad Umar, et autres
Publié: (2025)
par: Farooq, Muhammad Umar, et autres
Publié: (2025)
AUDDT: Audio Unified Deepfake Detection Benchmark Toolkit
par: Zhu, Yi, et autres
Publié: (2025)
par: Zhu, Yi, et autres
Publié: (2025)
TADA: Training-free Attribution and Out-of-Domain Detection of Audio Deepfakes
par: Stan, Adriana, et autres
Publié: (2025)
par: Stan, Adriana, et autres
Publié: (2025)
Representation Loss Minimization with Randomized Selection Strategy for Efficient Environmental Fake Audio Detection
par: Phukan, Orchid Chetia, et autres
Publié: (2024)
par: Phukan, Orchid Chetia, et autres
Publié: (2024)
Continuous Learning of Transformer-based Audio Deepfake Detection
par: Le, Tuan Duy Nguyen, et autres
Publié: (2024)
par: Le, Tuan Duy Nguyen, et autres
Publié: (2024)
Classical Machine Learning Baselines for Deepfake Audio Detection on the Fake-or-Real Dataset
par: Ahmad, Faheem, et autres
Publié: (2026)
par: Ahmad, Faheem, et autres
Publié: (2026)
IndieFake Dataset: A Benchmark Dataset for Audio Deepfake Detection
par: Kumar, Abhay, et autres
Publié: (2025)
par: Kumar, Abhay, et autres
Publié: (2025)
Enhancing Generalization in Audio Deepfake Detection: A Neural Collapse based Sampling and Training Approach
par: Yousif, Mohammed, et autres
Publié: (2024)
par: Yousif, Mohammed, et autres
Publié: (2024)
Investigating Polyglot Speech Foundation Models for Learning Collective Emotion from Crowds
par: Phukan, Orchid Chetia, et autres
Publié: (2025)
par: Phukan, Orchid Chetia, et autres
Publié: (2025)
XLSR-MamBo: Scaling the Hybrid Mamba-Attention Backbone for Audio Deepfake Detection
par: Ng, Kwok-Ho, et autres
Publié: (2026)
par: Ng, Kwok-Ho, et autres
Publié: (2026)
Audio Deepfake Detection with Self-Supervised WavLM and Multi-Fusion Attentive Classifier
par: Guo, Yinlin, et autres
Publié: (2023)
par: Guo, Yinlin, et autres
Publié: (2023)
ADD 2023: Towards Audio Deepfake Detection and Analysis in the Wild
par: Yi, Jiangyan, et autres
Publié: (2024)
par: Yi, Jiangyan, et autres
Publié: (2024)
From Audio Deepfake Detection to AI-Generated Music Detection -- A Pathway and Overview
par: Li, Yupei, et autres
Publié: (2024)
par: Li, Yupei, et autres
Publié: (2024)
StreamMark: A Deep Learning-Based Semi-Fragile Audio Watermarking for Proactive Deepfake Detection
par: Liu, Zhentao, et autres
Publié: (2026)
par: Liu, Zhentao, et autres
Publié: (2026)
Documents similaires
-
Curved Worlds, Clear Boundaries: Generalizing Speech Deepfake Detection using Hyperbolic and Spherical Geometry Spaces
par: Sheth, Farhan, et autres
Publié: (2025) -
Prosody as Supervision: Bridging the Non-Verbal--Verbal for Multilingual Speech Emotion Recognition
par: Girish, et autres
Publié: (2026) -
DIVINE: Coordinating Multimodal Disentangled Representations for Oro-Facial Neurological Disorder Assessment
par: Akhtar, Mohd Mujtaba, et autres
Publié: (2026) -
Bridging Attribution and Open-Set Detection using Graph-Augmented Instance Learning in Synthetic Speech
par: Akhtar, Mohd Mujtaba, et autres
Publié: (2026) -
NeuRO: An Application for Code-Switched Autism Detection in Children
par: Akhtar, Mohd Mujtaba, et autres
Publié: (2024)