Audio Deepfake Verification
Fuente:
arXiv
Guardado en:
| Autores principales: | Wang, Li, Ao, Junyi, Gan, Linyong, Wang, Yuancheng, Zhang, Xueyao, Wu, Zhizheng |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Advancing Zero-shot Text-to-Speech Intelligibility across Diverse Domains via Preference Alignment
por: Zhang, Xueyao, et al.
Publicado: (2025)
por: Zhang, Xueyao, et al.
Publicado: (2025)
TaDiCodec: Text-aware Diffusion Speech Tokenizer for Speech Language Modeling
por: Wang, Yuancheng, et al.
Publicado: (2025)
por: Wang, Yuancheng, et al.
Publicado: (2025)
Overview of the Amphion Toolkit (v0.2)
por: Li, Jiaqi, et al.
Publicado: (2025)
por: Li, Jiaqi, et al.
Publicado: (2025)
DualCodec: A Low-Frame-Rate, Semantically-Enhanced Neural Audio Codec for Speech Generation
por: Li, Jiaqi, et al.
Publicado: (2025)
por: Li, Jiaqi, et al.
Publicado: (2025)
Multi-Metric Preference Alignment for Generative Speech Restoration
por: Zhang, Junan, et al.
Publicado: (2025)
por: Zhang, Junan, et al.
Publicado: (2025)
Metis: A Foundation Speech Generation Model with Masked Generative Pre-training
por: Wang, Yuancheng, et al.
Publicado: (2025)
por: Wang, Yuancheng, et al.
Publicado: (2025)
Leveraging Diverse Semantic-based Audio Pretrained Models for Singing Voice Conversion
por: Zhang, Xueyao, et al.
Publicado: (2023)
por: Zhang, Xueyao, et al.
Publicado: (2023)
SD-Eval: A Benchmark Dataset for Spoken Dialogue Understanding Beyond Words
por: Ao, Junyi, et al.
Publicado: (2024)
por: Ao, Junyi, et al.
Publicado: (2024)
Debatts: Zero-Shot Debating Text-to-Speech Synthesis
por: Huang, Yiqiao, et al.
Publicado: (2024)
por: Huang, Yiqiao, et al.
Publicado: (2024)
Amphion: An Open-Source Audio, Music and Speech Generation Toolkit
por: Zhang, Xueyao, et al.
Publicado: (2023)
por: Zhang, Xueyao, et al.
Publicado: (2023)
An Investigation of Time-Frequency Representation Discriminators for High-Fidelity Vocoder
por: Gu, Yicheng, et al.
Publicado: (2024)
por: Gu, Yicheng, et al.
Publicado: (2024)
Noro: Noise-Robust One-shot Voice Conversion with Hidden Speaker Representation Learning
por: He, Haorui, et al.
Publicado: (2024)
por: He, Haorui, et al.
Publicado: (2024)
An Initial Investigation of Neural Replay Simulator for Over-the-Air Adversarial Perturbations to Automatic Speaker Verification
por: Li, Jiaqi, et al.
Publicado: (2023)
por: Li, Jiaqi, et al.
Publicado: (2023)
SingNet: Towards a Large-Scale, Diverse, and In-the-Wild Singing Voice Dataset
por: Gu, Yicheng, et al.
Publicado: (2025)
por: Gu, Yicheng, et al.
Publicado: (2025)
VoxPrivacy: A Benchmark for Evaluating Interactional Privacy of Speech Language Models
por: Wang, Yuxiang, et al.
Publicado: (2026)
por: Wang, Yuxiang, et al.
Publicado: (2026)
Aliasing-Free Neural Audio Synthesis
por: Gu, Yicheng, et al.
Publicado: (2025)
por: Gu, Yicheng, et al.
Publicado: (2025)
Anatomy of the Modality Gap: Dissecting the Internal States of End-to-End Speech LLMs
por: Hsu, Ming-Hao, et al.
Publicado: (2026)
por: Hsu, Ming-Hao, et al.
Publicado: (2026)
Audio Deepfake Detection at the First Greeting: "Hi!"
por: Shi, Haohan, et al.
Publicado: (2026)
por: Shi, Haohan, et al.
Publicado: (2026)
BUT Systems for Environmental Sound Deepfake Detection in the ESDD 2026 Challenge
por: Peng, Junyi, et al.
Publicado: (2025)
por: Peng, Junyi, et al.
Publicado: (2025)
Source Verification for Speech Deepfakes
por: Negroni, Viola, et al.
Publicado: (2025)
por: Negroni, Viola, et al.
Publicado: (2025)
Advancing Continual Learning for Robust Deepfake Audio Classification
por: Dong, Feiyi, et al.
Publicado: (2024)
por: Dong, Feiyi, et al.
Publicado: (2024)
Generalizable Detection of Audio Deepfakes
por: Lopez, Jose A., et al.
Publicado: (2025)
por: Lopez, Jose A., et al.
Publicado: (2025)
Detection of Deepfake Environmental Audio
por: Ouajdi, Hafsa, et al.
Publicado: (2024)
por: Ouajdi, Hafsa, et al.
Publicado: (2024)
SingVisio: Visual Analytics of Diffusion Model for Singing Voice Conversion
por: Xue, Liumeng, et al.
Publicado: (2024)
por: Xue, Liumeng, et al.
Publicado: (2024)
Closing the Modality Reasoning Gap for Speech Large Language Models
por: Wang, Chaoren, et al.
Publicado: (2026)
por: Wang, Chaoren, et al.
Publicado: (2026)
RPRA-ADD: Forgery Trace Enhancement-Driven Audio Deepfake Detection
por: Fu, Ruibo, et al.
Publicado: (2025)
por: Fu, Ruibo, et al.
Publicado: (2025)
HCFD: A Benchmark for Audio Deepfake Detection in Healthcare
por: Akhtar, Mohd Mujtaba, et al.
Publicado: (2026)
por: Akhtar, Mohd Mujtaba, et al.
Publicado: (2026)
Audio Deepfake Detection with Self-Supervised WavLM and Multi-Fusion Attentive Classifier
por: Guo, Yinlin, et al.
Publicado: (2023)
por: Guo, Yinlin, et al.
Publicado: (2023)
AdvSV: An Over-the-Air Adversarial Attack Dataset for Speaker Verification
por: Wang, Li, et al.
Publicado: (2023)
por: Wang, Li, et al.
Publicado: (2023)
ADD 2023: Towards Audio Deepfake Detection and Analysis in the Wild
por: Yi, Jiangyan, et al.
Publicado: (2024)
por: Yi, Jiangyan, et al.
Publicado: (2024)
An Extensive Analysis of the Singing Voice Conversion Challenge 2025 Evaluation Results
por: Violeta, Lester Phillip, et al.
Publicado: (2025)
por: Violeta, Lester Phillip, et al.
Publicado: (2025)
XLSR-MamBo: Scaling the Hybrid Mamba-Attention Backbone for Audio Deepfake Detection
por: Ng, Kwok-Ho, et al.
Publicado: (2026)
por: Ng, Kwok-Ho, et al.
Publicado: (2026)
Source Tracing of Audio Deepfake Systems
por: Klein, Nicholas, et al.
Publicado: (2024)
por: Klein, Nicholas, et al.
Publicado: (2024)
Does Current Deepfake Audio Detection Model Effectively Detect ALM-based Deepfake Audio?
por: Xie, Yuankun, et al.
Publicado: (2024)
por: Xie, Yuankun, et al.
Publicado: (2024)
Generalizable Audio Deepfake Detection via Hierarchical Structure Learning and Feature Whitening in Poincaré sphere
por: Yang, Mingru, et al.
Publicado: (2025)
por: Yang, Mingru, et al.
Publicado: (2025)
Generalizable Audio Deepfake Detection via Latent Space Refinement and Augmentation
por: Huang, Wen, et al.
Publicado: (2025)
por: Huang, Wen, et al.
Publicado: (2025)
TADA: Training-free Attribution and Out-of-Domain Detection of Audio Deepfakes
por: Stan, Adriana, et al.
Publicado: (2025)
por: Stan, Adriana, et al.
Publicado: (2025)
MaskGCT: Zero-Shot Text-to-Speech with Masked Generative Codec Transformer
por: Wang, Yuancheng, et al.
Publicado: (2024)
por: Wang, Yuancheng, et al.
Publicado: (2024)
Transferable Adversarial Attacks on Audio Deepfake Detection
por: Farooq, Muhammad Umar, et al.
Publicado: (2025)
por: Farooq, Muhammad Umar, et al.
Publicado: (2025)
Over-the-Air Adversarial Attack Detection: from Datasets to Defenses
por: Wang, Li, et al.
Publicado: (2025)
por: Wang, Li, et al.
Publicado: (2025)
Ejemplares similares
-
Advancing Zero-shot Text-to-Speech Intelligibility across Diverse Domains via Preference Alignment
por: Zhang, Xueyao, et al.
Publicado: (2025) -
TaDiCodec: Text-aware Diffusion Speech Tokenizer for Speech Language Modeling
por: Wang, Yuancheng, et al.
Publicado: (2025) -
Overview of the Amphion Toolkit (v0.2)
por: Li, Jiaqi, et al.
Publicado: (2025) -
DualCodec: A Low-Frame-Rate, Semantically-Enhanced Neural Audio Codec for Speech Generation
por: Li, Jiaqi, et al.
Publicado: (2025) -
Multi-Metric Preference Alignment for Generative Speech Restoration
por: Zhang, Junan, et al.
Publicado: (2025)