Toward Fairness in Speech Recognition: Discovery and mitigation of performance disparities
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Dheram, Pranav, Ramakrishnan, Murugesan, Raju, Anirudh, Chen, I-Fan, King, Brian, Powell, Katherine, Saboowala, Melissa, Shetty, Karan, Stolcke, Andreas |
|---|---|
| Format: | Preprint |
| Publié: |
2022
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Reducing Geographic Disparities in Automatic Speech Recognition via Elastic Weight Consolidation
par: Trinh, Viet Anh, et autres
Publié: (2022)
par: Trinh, Viet Anh, et autres
Publié: (2022)
Turn-taking and Backchannel Prediction with Acoustic and Large Language Model Fusion
par: Wang, Jinhan, et autres
Publié: (2024)
par: Wang, Jinhan, et autres
Publié: (2024)
Two-pass Endpoint Detection for Speech Recognition
par: Raju, Anirudh, et autres
Publié: (2024)
par: Raju, Anirudh, et autres
Publié: (2024)
Automatic Speech Recognition for Hindi
par: Saha, Anish, et autres
Publié: (2024)
par: Saha, Anish, et autres
Publié: (2024)
Testing Correctness, Fairness, and Robustness of Speech Emotion Recognition Models
par: Derington, Anna, et autres
Publié: (2023)
par: Derington, Anna, et autres
Publié: (2023)
Adversarial Reweighting for Speaker Verification Fairness
par: Jin, Minho, et autres
Publié: (2022)
par: Jin, Minho, et autres
Publié: (2022)
Retrieval Augmented Correction of Named Entity Speech Recognition Errors
par: Pusateri, Ernest, et autres
Publié: (2024)
par: Pusateri, Ernest, et autres
Publié: (2024)
Toward Fair Speech Technologies: A Comprehensive Survey of Bias and Fairness in Speech AI
par: Lin, Yi-Cheng, et autres
Publié: (2026)
par: Lin, Yi-Cheng, et autres
Publié: (2026)
Clustering and Mining Accented Speech for Inclusive and Fair Speech Recognition
par: Kim, Jaeyoung, et autres
Publié: (2024)
par: Kim, Jaeyoung, et autres
Publié: (2024)
In-Materia Speech Recognition
par: Zolfagharinejad, Mohamadreza, et autres
Publié: (2024)
par: Zolfagharinejad, Mohamadreza, et autres
Publié: (2024)
Robust Speech Recognition with Schrödinger Bridge-Based Speech Enhancement
par: Nasretdinov, Rauf, et autres
Publié: (2025)
par: Nasretdinov, Rauf, et autres
Publié: (2025)
Speech Emotion Recognition with ASR Integration
par: Li, Yuanchao
Publié: (2026)
par: Li, Yuanchao
Publié: (2026)
Zero-Shot Recognition of Dysarthric Speech Using Commercial Automatic Speech Recognition and Multimodal Large Language Models
par: Alsayegh, Ali, et autres
Publié: (2025)
par: Alsayegh, Ali, et autres
Publié: (2025)
The RoyalFlush Automatic Speech Diarization and Recognition System for In-Car Multi-Channel Automatic Speech Recognition Challenge
par: Tian, Jingguang, et autres
Publié: (2024)
par: Tian, Jingguang, et autres
Publié: (2024)
DITTO: Data-efficient and Fair Targeted Subset Selection for ASR Accent Adaptation
par: Kothawade, Suraj, et autres
Publié: (2021)
par: Kothawade, Suraj, et autres
Publié: (2021)
Efficient Long-Form Speech Recognition for General Speech In-Context Learning
par: Yen, Hao, et autres
Publié: (2024)
par: Yen, Hao, et autres
Publié: (2024)
An approach to measuring the performance of Automatic Speech Recognition (ASR) models in the context of Large Language Model (LLM) powered applications
par: Pulikodan, Sujith, et autres
Publié: (2025)
par: Pulikodan, Sujith, et autres
Publié: (2025)
Data-Driven Mispronunciation Pattern Discovery for Robust Speech Recognition
par: Choi, Anna Seo Gyeong, et autres
Publié: (2025)
par: Choi, Anna Seo Gyeong, et autres
Publié: (2025)
Zero Shot Text to Speech Augmentation for Automatic Speech Recognition on Low-Resource Accented Speech Corpora
par: Nespoli, Francesco, et autres
Publié: (2024)
par: Nespoli, Francesco, et autres
Publié: (2024)
Continual Test-time Adaptation for End-to-end Speech Recognition on Noisy Speech
par: Lin, Guan-Ting, et autres
Publié: (2024)
par: Lin, Guan-Ting, et autres
Publié: (2024)
Mamba-based Decoder-Only Approach with Bidirectional Speech Modeling for Speech Recognition
par: Masuyama, Yoshiki, et autres
Publié: (2024)
par: Masuyama, Yoshiki, et autres
Publié: (2024)
Speech-Mamba: Long-Context Speech Recognition with Selective State Spaces Models
par: Gao, Xiaoxue, et autres
Publié: (2024)
par: Gao, Xiaoxue, et autres
Publié: (2024)
Seed-ASR: Understanding Diverse Speech and Contexts with LLM-based Speech Recognition
par: Bai, Ye, et autres
Publié: (2024)
par: Bai, Ye, et autres
Publié: (2024)
Speech Recognition for Analysis of Police Radio Communication
par: Srivastava, Tejes, et autres
Publié: (2024)
par: Srivastava, Tejes, et autres
Publié: (2024)
Edge-ASR: Towards Low-Bit Quantization of Automatic Speech Recognition Models
par: Feng, Chen, et autres
Publié: (2025)
par: Feng, Chen, et autres
Publié: (2025)
Multimodal Attention Merging for Improved Speech Recognition and Audio Event Classification
par: Sundar, Anirudh S., et autres
Publié: (2023)
par: Sundar, Anirudh S., et autres
Publié: (2023)
Training Data Augmentation for Dysarthric Automatic Speech Recognition by Text-to-Dysarthric-Speech Synthesis
par: Leung, Wing-Zin, et autres
Publié: (2024)
par: Leung, Wing-Zin, et autres
Publié: (2024)
Rethinking Processing Distortions: Disentangling the Impact of Speech Enhancement Errors on Speech Recognition Performance
par: Ochiai, Tsubasa, et autres
Publié: (2024)
par: Ochiai, Tsubasa, et autres
Publié: (2024)
Post-Training Embedding Alignment for Decoupling Enrollment and Runtime Speaker Recognition Models
par: Gao, Chenyang, et autres
Publié: (2024)
par: Gao, Chenyang, et autres
Publié: (2024)
Uncovering the Visual Contribution in Audio-Visual Speech Recognition
par: Lin, Zhaofeng, et autres
Publié: (2024)
par: Lin, Zhaofeng, et autres
Publié: (2024)
Attention-Guided Adaptation for Code-Switching Speech Recognition
par: Aditya, Bobbi, et autres
Publié: (2023)
par: Aditya, Bobbi, et autres
Publié: (2023)
EMO-SUPERB: An In-depth Look at Speech Emotion Recognition
par: Wu, Haibin, et autres
Publié: (2024)
par: Wu, Haibin, et autres
Publié: (2024)
Dataset-Distillation Generative Model for Speech Emotion Recognition
par: Ritter-Gutierrez, Fabian, et autres
Publié: (2024)
par: Ritter-Gutierrez, Fabian, et autres
Publié: (2024)
THAI Speech Emotion Recognition (THAI-SER) corpus
par: Wongpithayadisai, Jilamika, et autres
Publié: (2025)
par: Wongpithayadisai, Jilamika, et autres
Publié: (2025)
Iterative Prototype Refinement for Ambiguous Speech Emotion Recognition
par: Sun, Haoqin, et autres
Publié: (2024)
par: Sun, Haoqin, et autres
Publié: (2024)
Examining the Interplay Between Privacy and Fairness for Speech Processing: A Review and Perspective
par: Leschanowsky, Anna, et autres
Publié: (2024)
par: Leschanowsky, Anna, et autres
Publié: (2024)
Learning When to Trust Which Teacher for Weakly Supervised ASR
par: Agrawal, Aakriti, et autres
Publié: (2023)
par: Agrawal, Aakriti, et autres
Publié: (2023)
Streaming Decoder-Only Automatic Speech Recognition with Discrete Speech Units: A Pilot Study
par: Chen, Peikun, et autres
Publié: (2024)
par: Chen, Peikun, et autres
Publié: (2024)
USM-Lite: Quantization and Sparsity Aware Fine-tuning for Speech Recognition with Universal Speech Models
par: Ding, Shaojin, et autres
Publié: (2023)
par: Ding, Shaojin, et autres
Publié: (2023)
Personalized Fine-Tuning with Controllable Synthetic Speech from LLM-Generated Transcripts for Dysarthric Speech Recognition
par: Wagner, Dominik, et autres
Publié: (2025)
par: Wagner, Dominik, et autres
Publié: (2025)
Documents similaires
-
Reducing Geographic Disparities in Automatic Speech Recognition via Elastic Weight Consolidation
par: Trinh, Viet Anh, et autres
Publié: (2022) -
Turn-taking and Backchannel Prediction with Acoustic and Large Language Model Fusion
par: Wang, Jinhan, et autres
Publié: (2024) -
Two-pass Endpoint Detection for Speech Recognition
par: Raju, Anirudh, et autres
Publié: (2024) -
Automatic Speech Recognition for Hindi
par: Saha, Anish, et autres
Publié: (2024) -
Testing Correctness, Fairness, and Robustness of Speech Emotion Recognition Models
par: Derington, Anna, et autres
Publié: (2023)