Aligning Stuttered-Speech Research with End-User Needs: Scoping Review, Survey, and Guidelines
Fuente:
arXiv
Guardado en:
| Autores principales: | Toyin, Hawau Olamide, Apampa, Mutiah, Aremu, Toluwani, Alblooshi, Humaid, Valente, Ana Rita, Leal, Gonçalo, Yue, Zhengjun, Talat, Zeerak, Aldarmaki, Hanan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis
por: Toyin, Hawau Olamide, et al.
Publicado: (2025)
por: Toyin, Hawau Olamide, et al.
Publicado: (2025)
STTATTS: Unified Speech-To-Text And Text-To-Speech Model
por: Toyin, Hawau Olamide, et al.
Publicado: (2024)
por: Toyin, Hawau Olamide, et al.
Publicado: (2024)
Clinical Annotations for Automatic Stuttering Severity Assessment
por: Valente, Ana Rita, et al.
Publicado: (2025)
por: Valente, Ana Rita, et al.
Publicado: (2025)
Are LLMs Good Text Diacritizers? An Arabic and Yoruba Case Study
por: Toyin, Hawau Olamide, et al.
Publicado: (2025)
por: Toyin, Hawau Olamide, et al.
Publicado: (2025)
Dialectal Coverage And Generalization in Arabic Speech Recognition
por: Djanibekov, Amirbek, et al.
Publicado: (2024)
por: Djanibekov, Amirbek, et al.
Publicado: (2024)
Code-Switching in End-to-End Automatic Speech Recognition: A Systematic Literature Review
por: Agro, Maha Tufail, et al.
Publicado: (2025)
por: Agro, Maha Tufail, et al.
Publicado: (2025)
Unrequited Emotions: Investigating the Gaps in Motivation and Practice in Speech Emotion Recognition Research
por: Wong, Taryn, et al.
Publicado: (2026)
por: Wong, Taryn, et al.
Publicado: (2026)
Exploring the Limitations of Detecting Machine-Generated Text
por: Doughman, Jad, et al.
Publicado: (2024)
por: Doughman, Jad, et al.
Publicado: (2024)
Voice of a Continent: Mapping Africa's Speech Technology Frontier
por: Elmadany, AbdelRahim, et al.
Publicado: (2025)
por: Elmadany, AbdelRahim, et al.
Publicado: (2025)
Personal Attribute Leakage in Federated Speech Models
por: Al-Ali, Hamdan, et al.
Publicado: (2025)
por: Al-Ali, Hamdan, et al.
Publicado: (2025)
NADI 2025: The First Multidialectal Arabic Speech Processing Shared Task
por: Talafha, Bashar, et al.
Publicado: (2025)
por: Talafha, Bashar, et al.
Publicado: (2025)
SparQLe: Speech Queries to Text Translation Through LLMs
por: Djanibekov, Amirbek, et al.
Publicado: (2025)
por: Djanibekov, Amirbek, et al.
Publicado: (2025)
RelUNet: Relative Channel Fusion U-Net for Multichannel Speech Enhancement
por: Aldarmaki, Ibrahim, et al.
Publicado: (2024)
por: Aldarmaki, Ibrahim, et al.
Publicado: (2024)
Infant Cry Detection Using Causal Temporal Representation
por: Fu, Minghao, et al.
Publicado: (2025)
por: Fu, Minghao, et al.
Publicado: (2025)
StutterZero and StutterFormer: End-to-End Speech Conversion for Stuttering Transcription and Correction
por: Xu, Qianheng
Publicado: (2025)
por: Xu, Qianheng
Publicado: (2025)
Mixat: A Data Set of Bilingual Emirati-English Speech
por: Ali, Maryam Al, et al.
Publicado: (2024)
por: Ali, Maryam Al, et al.
Publicado: (2024)
Spoken Word2Vec: Learning Skipgram Embeddings from Speech
por: Sayeed, Mohammad Amaan, et al.
Publicado: (2023)
por: Sayeed, Mohammad Amaan, et al.
Publicado: (2023)
Optimizing Adaptive Attacks against Watermarks for Language Models
por: Diaa, Abdulrahman, et al.
Publicado: (2024)
por: Diaa, Abdulrahman, et al.
Publicado: (2024)
Watermarking Should Be Treated as a Monitoring Primitive
por: Aremu, Toluwani, et al.
Publicado: (2026)
por: Aremu, Toluwani, et al.
Publicado: (2026)
Automatic Restoration of Diacritics for Speech Data Sets
por: Shatnawi, Sara, et al.
Publicado: (2023)
por: Shatnawi, Sara, et al.
Publicado: (2023)
Where Are We? Evaluating LLM Performance on African Languages
por: Adebara, Ife, et al.
Publicado: (2025)
por: Adebara, Ife, et al.
Publicado: (2025)
A Capabilities Approach to Studying Bias and Harm in Language Technologies
por: Nigatu, Hellina Hailu, et al.
Publicado: (2024)
por: Nigatu, Hellina Hailu, et al.
Publicado: (2024)
Exploitation All the Way Down: Calling out the Root Cause of Bad Online Experiences for Users of the "Majority World"
por: Nigatu, Hellina Hailu, et al.
Publicado: (2024)
por: Nigatu, Hellina Hailu, et al.
Publicado: (2024)
Online Learning Defense against Iterative Jailbreak Attacks via Prompt Optimization
por: Kaneko, Masahiro, et al.
Publicado: (2025)
por: Kaneko, Masahiro, et al.
Publicado: (2025)
Robust Safety Monitoring of Language Models via Activation Watermarking
por: Aremu, Toluwani, et al.
Publicado: (2026)
por: Aremu, Toluwani, et al.
Publicado: (2026)
Disability-First AI Dataset Annotation: Co-designing Stuttered Speech Annotation Guidelines with People Who Stutter
por: Tang, Xinru, et al.
Publicado: (2026)
por: Tang, Xinru, et al.
Publicado: (2026)
Subjective $\textit{Isms}$? On the Danger of Conflating Hate and Offence in Abusive Language Detection
por: Curry, Amanda Cercas, et al.
Publicado: (2024)
por: Curry, Amanda Cercas, et al.
Publicado: (2024)
Impoverished Language Technology: The Lack of (Social) Class in NLP
por: Curry, Amanda Cercas, et al.
Publicado: (2024)
por: Curry, Amanda Cercas, et al.
Publicado: (2024)
SPIRIT: Patching Speech Language Models against Jailbreak Attacks
por: Djanibekov, Amirbek, et al.
Publicado: (2025)
por: Djanibekov, Amirbek, et al.
Publicado: (2025)
Redefining Contributions: Shapley-Driven Federated Learning
por: Tastan, Nurbek, et al.
Publicado: (2024)
por: Tastan, Nurbek, et al.
Publicado: (2024)
Understanding "Democratization" in NLP and ML Research
por: Subramonian, Arjun, et al.
Publicado: (2024)
por: Subramonian, Arjun, et al.
Publicado: (2024)
YOLO-Stutter: End-to-end Region-Wise Speech Dysfluency Detection
por: Zhou, Xuanru, et al.
Publicado: (2024)
por: Zhou, Xuanru, et al.
Publicado: (2024)
Classist Tools: Social Class Correlates with Performance in NLP
por: Curry, Amanda Cercas, et al.
Publicado: (2024)
por: Curry, Amanda Cercas, et al.
Publicado: (2024)
The Perspectivist Paradigm Shift: Assumptions and Challenges of Capturing Human Labels
por: Fleisig, Eve, et al.
Publicado: (2024)
por: Fleisig, Eve, et al.
Publicado: (2024)
FedMental: Evaluating Federated Learning for Mental Health Detection from Social Media Data
por: Abdelkadir, Nuredin Ali, et al.
Publicado: (2026)
por: Abdelkadir, Nuredin Ali, et al.
Publicado: (2026)
Zero-shot Sentiment Analysis in Low-Resource Languages Using a Multilingual Sentiment Lexicon
por: Koto, Fajri, et al.
Publicado: (2024)
por: Koto, Fajri, et al.
Publicado: (2024)
An End-To-End Stuttering Detection Method Based On Conformer And BILSTM
por: Liu, Xiaokang, et al.
Publicado: (2024)
por: Liu, Xiaokang, et al.
Publicado: (2024)
Morphemes Without Borders: Evaluating Root-Pattern Morphology in Arabic Tokenizers and LLMs
por: Alakeel, Yara, et al.
Publicado: (2026)
por: Alakeel, Yara, et al.
Publicado: (2026)
On the Reliability of Large Language Models to Misinformed and Demographically-Informed Prompts
por: Aremu, Toluwani, et al.
Publicado: (2024)
por: Aremu, Toluwani, et al.
Publicado: (2024)
Linear Semantic Segmentation for Low-Resource Spoken Dialects
por: Chirkunov, Kirill, et al.
Publicado: (2026)
por: Chirkunov, Kirill, et al.
Publicado: (2026)
Ejemplares similares
-
ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis
por: Toyin, Hawau Olamide, et al.
Publicado: (2025) -
STTATTS: Unified Speech-To-Text And Text-To-Speech Model
por: Toyin, Hawau Olamide, et al.
Publicado: (2024) -
Clinical Annotations for Automatic Stuttering Severity Assessment
por: Valente, Ana Rita, et al.
Publicado: (2025) -
Are LLMs Good Text Diacritizers? An Arabic and Yoruba Case Study
por: Toyin, Hawau Olamide, et al.
Publicado: (2025) -
Dialectal Coverage And Generalization in Arabic Speech Recognition
por: Djanibekov, Amirbek, et al.
Publicado: (2024)