Beyond Silence: Bias Analysis through Loss and Asymmetric Approach in Audio Anti-Spoofing
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Shim, Hye-jin, Sahidullah, Md, Jung, Jee-weon, Watanabe, Shinji, Kinnunen, Tomi |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
ChildAugment: Data Augmentation Methods for Zero-Resource Children's Speaker Verification
par: Singh, Vishwanath Pratap, et autres
Publié: (2024)
par: Singh, Vishwanath Pratap, et autres
Publié: (2024)
An Explainable Probabilistic Attribute Embedding Approach for Spoofed Speech Characterization
par: Chhibber, Manasi, et autres
Publié: (2024)
par: Chhibber, Manasi, et autres
Publié: (2024)
Generalizing Speaker Verification for Spoof Awareness in the Embedding Space
par: Liu, Xuechen, et autres
Publié: (2024)
par: Liu, Xuechen, et autres
Publié: (2024)
Explaining Speaker and Spoof Embeddings via Probing
par: Liu, Xuechen, et autres
Publié: (2024)
par: Liu, Xuechen, et autres
Publié: (2024)
ASVspoof 5: Crowdsourced Speech Data, Deepfakes, and Adversarial Attacks at Scale
par: Wang, Xin, et autres
Publié: (2024)
par: Wang, Xin, et autres
Publié: (2024)
Causal Structure Discovery for Error Diagnostics of Children's ASR
par: Singh, Vishwanath Pratap, et autres
Publié: (2025)
par: Singh, Vishwanath Pratap, et autres
Publié: (2025)
Improving Design of Input Condition Invariant Speech Enhancement
par: Zhang, Wangyou, et autres
Publié: (2024)
par: Zhang, Wangyou, et autres
Publié: (2024)
Beyond Performance Plateaus: A Comprehensive Study on Scalability in Speech Enhancement
par: Zhang, Wangyou, et autres
Publié: (2024)
par: Zhang, Wangyou, et autres
Publié: (2024)
SpoofCeleb: Speech Deepfake Detection and SASV In The Wild
par: Jung, Jee-weon, et autres
Publié: (2024)
par: Jung, Jee-weon, et autres
Publié: (2024)
Towards Explainable Spoofed Speech Attribution and Detection:a Probabilistic Approach for Characterizing Speech Synthesizer Components
par: Mishra, Jagabandhu, et autres
Publié: (2025)
par: Mishra, Jagabandhu, et autres
Publié: (2025)
The CMU-AIST submission for the ICME 2025 Audio Encoder Challenge
par: Bharadwaj, Shikhar, et autres
Publié: (2026)
par: Bharadwaj, Shikhar, et autres
Publié: (2026)
OpenBEATs: A Fully Open-Source General-Purpose Audio Encoder
par: Bharadwaj, Shikhar, et autres
Publié: (2025)
par: Bharadwaj, Shikhar, et autres
Publié: (2025)
Improving Audio Captioning Models with Fine-grained Audio Features, Text Embedding Supervision, and LLM Mix-up Augmentation
par: Wu, Shih-Lun, et autres
Publié: (2023)
par: Wu, Shih-Lun, et autres
Publié: (2023)
a-DCF: an architecture agnostic metric with application to spoofing-robust speaker verification
par: Shim, Hye-jin, et autres
Publié: (2024)
par: Shim, Hye-jin, et autres
Publié: (2024)
Token-based Attractors and Cross-attention in Spoof Diarization
par: Koo, Kyo-Won, et autres
Publié: (2025)
par: Koo, Kyo-Won, et autres
Publié: (2025)
Uni-VERSA: Versatile Speech Assessment with a Unified Network
par: Shi, Jiatong, et autres
Publié: (2025)
par: Shi, Jiatong, et autres
Publié: (2025)
Revisiting and Improving Scoring Fusion for Spoofing-aware Speaker Verification Using Compositional Data Analysis
par: Wang, Xin, et autres
Publié: (2024)
par: Wang, Xin, et autres
Publié: (2024)
Voxtlm: unified decoder-only models for consolidating speech recognition/synthesis and speech/text continuation tasks
par: Maiti, Soumi, et autres
Publié: (2023)
par: Maiti, Soumi, et autres
Publié: (2023)
Cyclostationarity Analysis as a Complement to Self-Supervised Representations for Speech Deepfake Detection
par: Hanilçi, Cemal, et autres
Publié: (2026)
par: Hanilçi, Cemal, et autres
Publié: (2026)
MLAAD: The Multi-Language Audio Anti-Spoofing Dataset
par: Müller, Nicolas M., et autres
Publié: (2024)
par: Müller, Nicolas M., et autres
Publié: (2024)
Can you Remove the Downstream Model for Speaker Recognition with Self-Supervised Speech Features?
par: Aldeneh, Zakaria, et autres
Publié: (2024)
par: Aldeneh, Zakaria, et autres
Publié: (2024)
Causal Analysis of ASR Errors for Children: Quantifying the Impact of Physiological, Cognitive, and Extrinsic Factors
par: Singh, Vishwanath Pratap, et autres
Publié: (2025)
par: Singh, Vishwanath Pratap, et autres
Publié: (2025)
Speaker-IPL: Unsupervised Learning of Speaker Characteristics with i-Vector based Pseudo-Labels
par: Aldeneh, Zakaria, et autres
Publié: (2024)
par: Aldeneh, Zakaria, et autres
Publié: (2024)
Disentangled Representation Learning for Environment-agnostic Speaker Recognition
par: Nam, KiHyun, et autres
Publié: (2024)
par: Nam, KiHyun, et autres
Publié: (2024)
Chain-of-Thought Training for Open E2E Spoken Dialogue Systems
par: Arora, Siddhant, et autres
Publié: (2025)
par: Arora, Siddhant, et autres
Publié: (2025)
Meta-Learning Approaches for Improving Detection of Unseen Speech Deepfakes
par: Kukanov, Ivan, et autres
Publié: (2024)
par: Kukanov, Ivan, et autres
Publié: (2024)
LALM-as-a-Judge: Benchmarking Large Audio-Language Models for Safety Evaluation in Multi-Turn Spoken Dialogues
par: Ivry, Amir, et autres
Publié: (2026)
par: Ivry, Amir, et autres
Publié: (2026)
IITKGP-ABSP Submission to LRE22: Language Recognition in Low-Resource Settings
par: Dey, Spandan, et autres
Publié: (2025)
par: Dey, Spandan, et autres
Publié: (2025)
ARECHO: Autoregressive Evaluation via Chain-Based Hypothesis Optimization for Speech Multi-Metric Estimation
par: Shi, Jiatong, et autres
Publié: (2025)
par: Shi, Jiatong, et autres
Publié: (2025)
ESPnet-SPK: full pipeline speaker embedding toolkit with reproducible recipes, self-supervised front-ends, and off-the-shelf models
par: Jung, Jee-weon, et autres
Publié: (2024)
par: Jung, Jee-weon, et autres
Publié: (2024)
UniverSLU: Universal Spoken Language Understanding for Diverse Tasks with Natural Language Instructions
par: Arora, Siddhant, et autres
Publié: (2023)
par: Arora, Siddhant, et autres
Publié: (2023)
ESPnet-Codec: Comprehensive Training and Evaluation of Neural Codecs for Audio, Music, and Speech
par: Shi, Jiatong, et autres
Publié: (2024)
par: Shi, Jiatong, et autres
Publié: (2024)
ALDAS: Audio-Linguistic Data Augmentation for Spoofed Audio Detection
par: Khanjani, Zahra, et autres
Publié: (2024)
par: Khanjani, Zahra, et autres
Publié: (2024)
CompSpoof: A Dataset and Joint Learning Framework for Component-Level Audio Anti-spoofing Countermeasures
par: Zhang, Xueping, et autres
Publié: (2025)
par: Zhang, Xueping, et autres
Publié: (2025)
LJ-Spoof: A Generatively Varied Corpus for Audio Anti-Spoofing and Synthesis Source Tracing
par: Subramani, Surya, et autres
Publié: (2026)
par: Subramani, Surya, et autres
Publié: (2026)
VERSA: A Versatile Evaluation Toolkit for Speech, Audio, and Music
par: Shi, Jiatong, et autres
Publié: (2024)
par: Shi, Jiatong, et autres
Publié: (2024)
Spoof Diarization: "What Spoofed When" in Partially Spoofed Audio
par: Zhang, Lin, et autres
Publié: (2024)
par: Zhang, Lin, et autres
Publié: (2024)
CodecFake: Enhancing Anti-Spoofing Models Against Deepfake Audios from Codec-Based Speech Synthesis Systems
par: Wu, Haibin, et autres
Publié: (2024)
par: Wu, Haibin, et autres
Publié: (2024)
Streaming Endpointer for Spoken Dialogue using Neural Audio Codecs and Label-Delayed Training
par: Udupa, Sathvik, et autres
Publié: (2025)
par: Udupa, Sathvik, et autres
Publié: (2025)
Improving Short Utterance Anti-Spoofing with AASIST2
par: Zhang, Yuxiang, et autres
Publié: (2023)
par: Zhang, Yuxiang, et autres
Publié: (2023)
Documents similaires
-
ChildAugment: Data Augmentation Methods for Zero-Resource Children's Speaker Verification
par: Singh, Vishwanath Pratap, et autres
Publié: (2024) -
An Explainable Probabilistic Attribute Embedding Approach for Spoofed Speech Characterization
par: Chhibber, Manasi, et autres
Publié: (2024) -
Generalizing Speaker Verification for Spoof Awareness in the Embedding Space
par: Liu, Xuechen, et autres
Publié: (2024) -
Explaining Speaker and Spoof Embeddings via Probing
par: Liu, Xuechen, et autres
Publié: (2024) -
ASVspoof 5: Crowdsourced Speech Data, Deepfakes, and Adversarial Attacks at Scale
par: Wang, Xin, et autres
Publié: (2024)