A Sociophonetic Analysis of Racial Bias in Commercial ASR Systems Using the Pacific Northwest English Corpus
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Scott, Michael, Liang, Siyu, Wassink, Alicia, Levow, Gina-Anne |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
"This Wasn't Made for Me": Recentering User Experience and Emotional Impact in the Evaluation of ASR Bias
par: Liang, Siyu, et autres
Publié: (2026)
par: Liang, Siyu, et autres
Publié: (2026)
Breaking the Transcription Bottleneck: Fine-tuning ASR Models for Extremely Low-Resource Fieldwork Languages
par: Liang, Siyu, et autres
Publié: (2025)
par: Liang, Siyu, et autres
Publié: (2025)
The Limits of Data Scaling: Sub-token Utilization and Acoustic Saturation in Multilingual ASR
par: Liang, Siyu, et autres
Publié: (2025)
par: Liang, Siyu, et autres
Publié: (2025)
Hybrid Neural-LLM Pipeline for Morphological Glossing in Endangered Language Documentation: A Case Study of Jungar Tuvan
par: Liang, Siyu, et autres
Publié: (2026)
par: Liang, Siyu, et autres
Publié: (2026)
Beyond WER: Probing Whisper's Sub-token Decoder Across Diverse Language Resource Levels
par: Liang, Siyu, et autres
Publié: (2025)
par: Liang, Siyu, et autres
Publié: (2025)
TEII: Think, Explain, Interact and Iterate with Large Language Models to Solve Cross-lingual Emotion Detection
par: Cheng, Long, et autres
Publié: (2024)
par: Cheng, Long, et autres
Publié: (2024)
Benchmarking Commercial ASR Systems on Code-Switching Speech: Arabic, Persian, and German
par: Abdoli, Sajjad, et autres
Publié: (2026)
par: Abdoli, Sajjad, et autres
Publié: (2026)
Distinguishing Repetition Disfluency from Morphological Reduplication in Bangla ASR Transcripts: A Novel Corpus and Benchmarking Analysis
par: Arpa, Zaara Zabeen, et autres
Publié: (2025)
par: Arpa, Zaara Zabeen, et autres
Publié: (2025)
Ramsa: A Large Sociolinguistically Rich Emirati Arabic Speech Corpus for ASR and TTS
par: Al-Sabbagh, Rania
Publié: (2026)
par: Al-Sabbagh, Rania
Publié: (2026)
Developing an English-Efik Corpus and Machine Translation System for Digitization Inclusion
par: Edet, Offiong Bassey, et autres
Publié: (2026)
par: Edet, Offiong Bassey, et autres
Publié: (2026)
The Pilot Corpus of the English Semantic Sketches
par: Petrova, Maria, et autres
Publié: (2025)
par: Petrova, Maria, et autres
Publié: (2025)
Vedavani: A Benchmark Corpus for ASR on Vedic Sanskrit Poetry
par: Kumar, Sujeet, et autres
Publié: (2025)
par: Kumar, Sujeet, et autres
Publié: (2025)
Speak & Improve Corpus 2025: an L2 English Speech Corpus for Language Assessment and Feedback
par: Knill, Kate, et autres
Publié: (2024)
par: Knill, Kate, et autres
Publié: (2024)
Introducing MELI: the Mandarin-English Language Interview Corpus
par: Liu, Suyuan, et autres
Publié: (2026)
par: Liu, Suyuan, et autres
Publié: (2026)
PEACH: A sentence-aligned Parallel English-Arabic Corpus for Healthcare
par: Al-Sabbagh, Rania
Publié: (2025)
par: Al-Sabbagh, Rania
Publié: (2025)
ZAEBUC-Spoken: A Multilingual Multidialectal Arabic-English Speech Corpus
par: Hamed, Injy, et autres
Publié: (2024)
par: Hamed, Injy, et autres
Publié: (2024)
A Corpus for Sentence-level Subjectivity Detection on English News Articles
par: Antici, Francesco, et autres
Publié: (2023)
par: Antici, Francesco, et autres
Publié: (2023)
A Longitudinal Analysis of Racial and Gender Bias in New York Times and Fox News Images and Articles
par: Ibrahim, Hazem, et autres
Publié: (2024)
par: Ibrahim, Hazem, et autres
Publié: (2024)
Toward Responsible ASR for African American English Speakers: A Scoping Review of Bias and Equity in Speech Technology
par: Cunningham, Jay L., et autres
Publié: (2025)
par: Cunningham, Jay L., et autres
Publié: (2025)
Towards Better Inclusivity: A Diverse Tweet Corpus of English Varieties
par: Pham, Nhi, et autres
Publié: (2024)
par: Pham, Nhi, et autres
Publié: (2024)
Unmasking and Quantifying Racial Bias of Large Language Models in Medical Report Generation
par: Yang, Yifan, et autres
Publié: (2024)
par: Yang, Yifan, et autres
Publié: (2024)
The TTS-STT Flywheel: Synthetic Entity-Dense Audio Closes the Indic ASR Gap Where Commercial and Open-Source Systems Fail
par: Menta, Venkata Pushpak Teja
Publié: (2026)
par: Menta, Venkata Pushpak Teja
Publié: (2026)
Quantification of stylistic differences in human- and ASR-produced transcripts of African American English
par: Heuser, Annika, et autres
Publié: (2024)
par: Heuser, Annika, et autres
Publié: (2024)
Building English ASR model with regional language support
par: Agrawal, Purvi, et autres
Publié: (2025)
par: Agrawal, Purvi, et autres
Publié: (2025)
Nwāchā Munā: A Devanagari Speech Corpus and Proximal Transfer Benchmark for Nepal Bhasha ASR
par: Sharma, Rishikesh Kumar, et autres
Publié: (2026)
par: Sharma, Rishikesh Kumar, et autres
Publié: (2026)
Leveraging the Cross-Domain & Cross-Linguistic Corpus for Low Resource NMT: A Case Study On Bhili-Hindi-English Parallel Corpus
par: Singh, Pooja, et autres
Publié: (2025)
par: Singh, Pooja, et autres
Publié: (2025)
NAIST-SIC-Aligned: an Aligned English-Japanese Simultaneous Interpretation Corpus
par: Zhao, Jinming, et autres
Publié: (2023)
par: Zhao, Jinming, et autres
Publié: (2023)
FAIRE: Assessing Racial and Gender Bias in AI-Driven Resume Evaluations
par: Wen, Athena, et autres
Publié: (2025)
par: Wen, Athena, et autres
Publié: (2025)
Examining Gender and Racial Bias in Large Vision-Language Models Using a Novel Dataset of Parallel Images
par: Fraser, Kathleen C., et autres
Publié: (2024)
par: Fraser, Kathleen C., et autres
Publié: (2024)
Impacts of Racial Bias in Historical Training Data for News AI
par: Bhargava, Rahul, et autres
Publié: (2025)
par: Bhargava, Rahul, et autres
Publié: (2025)
MixSarc: A Bangla-English Code-Mixed Corpus for Implicit Meaning Identification
par: Alam, Kazi Samin Yasar, et autres
Publié: (2026)
par: Alam, Kazi Samin Yasar, et autres
Publié: (2026)
A Multi-way Parallel Named Entity Annotated Corpus for English, Tamil and Sinhala
par: Ranathunga, Surangika, et autres
Publié: (2024)
par: Ranathunga, Surangika, et autres
Publié: (2024)
AppTek Call-Center Dialogues: A Multi-Accent Long-Form Benchmark for English ASR
par: Beck, Eugen, et autres
Publié: (2026)
par: Beck, Eugen, et autres
Publié: (2026)
Analyzing Language Bias Between French and English in Conventional Multilingual Sentiment Analysis Models
par: Wong, Ethan Parker, et autres
Publié: (2024)
par: Wong, Ethan Parker, et autres
Publié: (2024)
Gender Bias in English-to-Greek Machine Translation
par: Gkovedarou, Eleni, et autres
Publié: (2025)
par: Gkovedarou, Eleni, et autres
Publié: (2025)
The InviTE Corpus: Annotating Invectives in Tudor English Texts for Computational Modeling
par: Spliethoff, Sophie, et autres
Publié: (2025)
par: Spliethoff, Sophie, et autres
Publié: (2025)
English to Central Kurdish Speech Translation: Corpus Creation, Evaluation, and Orthographic Standardization
par: Mohammadamini, Mohammad, et autres
Publié: (2026)
par: Mohammadamini, Mohammad, et autres
Publié: (2026)
Benchmarking terminology building capabilities of ChatGPT on an English-Russian Fashion Corpus
par: Bezobrazova, Anastasiia, et autres
Publié: (2024)
par: Bezobrazova, Anastasiia, et autres
Publié: (2024)
JaParaPat: A Large-Scale Japanese-English Parallel Patent Application Corpus
par: Nagata, Masaaki, et autres
Publié: (2025)
par: Nagata, Masaaki, et autres
Publié: (2025)
DATASHI: A Parallel English-Tashlhiyt Corpus for Orthography Normalization and Low-Resource Language Processing
par: Monir, Nasser-Eddine, et autres
Publié: (2026)
par: Monir, Nasser-Eddine, et autres
Publié: (2026)
Documents similaires
-
"This Wasn't Made for Me": Recentering User Experience and Emotional Impact in the Evaluation of ASR Bias
par: Liang, Siyu, et autres
Publié: (2026) -
Breaking the Transcription Bottleneck: Fine-tuning ASR Models for Extremely Low-Resource Fieldwork Languages
par: Liang, Siyu, et autres
Publié: (2025) -
The Limits of Data Scaling: Sub-token Utilization and Acoustic Saturation in Multilingual ASR
par: Liang, Siyu, et autres
Publié: (2025) -
Hybrid Neural-LLM Pipeline for Morphological Glossing in Endangered Language Documentation: A Case Study of Jungar Tuvan
par: Liang, Siyu, et autres
Publié: (2026) -
Beyond WER: Probing Whisper's Sub-token Decoder Across Diverse Language Resource Levels
par: Liang, Siyu, et autres
Publié: (2025)