Guardado en:
| Autores principales: | Bartley, Christopher, Ragni, Anton |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2510.04832 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
How Much Context Does My Attention-Based ASR System Need?
por: Flynn, Robert, et al.
Publicado: (2023)
por: Flynn, Robert, et al.
Publicado: (2023)
VisualSpeech: Enhancing Prosody Modeling in TTS Using Video
por: Que, Shumin, et al.
Publicado: (2025)
por: Que, Shumin, et al.
Publicado: (2025)
Self-Train Before You Transcribe
por: Flynn, Robert, et al.
Publicado: (2024)
por: Flynn, Robert, et al.
Publicado: (2024)
DAG: Dictionary-Augmented Generation for Disambiguation of Sentences in Endangered Uralic Languages using ChatGPT
por: Hämäläinen, Mika
Publicado: (2024)
por: Hämäläinen, Mika
Publicado: (2024)
Interventional Speech Noise Injection for ASR Generalizable Spoken Language Understanding
por: Jung, Yeonjoon, et al.
Publicado: (2024)
por: Jung, Yeonjoon, et al.
Publicado: (2024)
Emphasis Sensitivity in Speech Representations
por: Cassini, Shaun, et al.
Publicado: (2025)
por: Cassini, Shaun, et al.
Publicado: (2025)
FormalASR: End-to-End Spoken Chinese to Formal Text
por: Ning, Wanyi, et al.
Publicado: (2026)
por: Ning, Wanyi, et al.
Publicado: (2026)
Recording for Eyes, Not Echoing to Ears: Contextualized Spoken-to-Written Conversion of ASR Transcripts
por: Liu, Jiaqing, et al.
Publicado: (2024)
por: Liu, Jiaqing, et al.
Publicado: (2024)
Hard to Be Heard: Phoneme-Level ASR Analysis of Phonologically Complex, Low-Resource Endangered Languages
por: Akavarapu, V. S. D. S. Mahesh, et al.
Publicado: (2026)
por: Akavarapu, V. S. D. S. Mahesh, et al.
Publicado: (2026)
Towards ASR Robust Spoken Language Understanding Through In-Context Learning With Word Confusion Networks
por: Everson, Kevin, et al.
Publicado: (2024)
por: Everson, Kevin, et al.
Publicado: (2024)
NoLoR: An ASR-Based Framework for Expedited Endangered Language Documentation with Neo-Aramaic as a Case Study
por: Nazari, Matthew
Publicado: (2024)
por: Nazari, Matthew
Publicado: (2024)
Analyzing Error Propagation in Korean Spoken QA with ASR-LLM Cascades
por: Jung, Donghyuk, et al.
Publicado: (2026)
por: Jung, Donghyuk, et al.
Publicado: (2026)
Who Spoke What When? Evaluating Spoken Language Models for Conversational ASR with Semantic and Overlap-Aware Metrics
por: Tawara, Naohiro, et al.
Publicado: (2026)
por: Tawara, Naohiro, et al.
Publicado: (2026)
JSPG: Dynamic Dictionary Filtering via Joint Semantic-Pinyin-Glyph Retrieval for Chinese Contextual ASR
por: Zhou, Shilin, et al.
Publicado: (2026)
por: Zhou, Shilin, et al.
Publicado: (2026)
Just ASR + LLM? A Study on Speech Large Language Models' Ability to Identify and Understand Speaker in Spoken Dialogue
por: Wu, Junkai, et al.
Publicado: (2024)
por: Wu, Junkai, et al.
Publicado: (2024)
Bridging Dictionary: AI-Generated Dictionary of Partisan Language Use
por: Jiang, Hang, et al.
Publicado: (2024)
por: Jiang, Hang, et al.
Publicado: (2024)
Transcribe, Translate, or Transliterate: An Investigation of Intermediate Representations in Spoken Language Models
por: Ògúnrèmí, Tolúlopé, et al.
Publicado: (2025)
por: Ògúnrèmí, Tolúlopé, et al.
Publicado: (2025)
What Do Humans Hear When Interacting? Experiments on Selective Listening for Evaluating ASR of Spoken Dialogue Systems
por: Mori, Kiyotada, et al.
Publicado: (2025)
por: Mori, Kiyotada, et al.
Publicado: (2025)
Keyboards for the Endangered Idu Mishmi Language
por: Ramarao, Akhilesh Kakolu
Publicado: (2026)
por: Ramarao, Akhilesh Kakolu
Publicado: (2026)
How Do Lexical Senses Correspond Between Spoken German and German Sign Language?
por: Çelikkol, Melis, et al.
Publicado: (2026)
por: Çelikkol, Melis, et al.
Publicado: (2026)
MedSpeak: A Knowledge Graph-Aided ASR Error Correction Framework for Spoken Medical QA
por: Song, Yutong, et al.
Publicado: (2026)
por: Song, Yutong, et al.
Publicado: (2026)
Semi-Supervised Spoken Language Glossification
por: Yao, Huijie, et al.
Publicado: (2024)
por: Yao, Huijie, et al.
Publicado: (2024)
Is It Navajo? Accurate Language Detection in Endangered Athabaskan Languages
por: Yang, Ivory, et al.
Publicado: (2025)
por: Yang, Ivory, et al.
Publicado: (2025)
In-context Language Learning for Endangered Languages in Speech Recognition
por: Li, Zhaolin, et al.
Publicado: (2025)
por: Li, Zhaolin, et al.
Publicado: (2025)
Hire a Linguist!: Learning Endangered Languages with In-Context Linguistic Descriptions
por: Zhang, Kexun, et al.
Publicado: (2024)
por: Zhang, Kexun, et al.
Publicado: (2024)
Geolocation-Aware Robust Spoken Language Identification
por: Wang, Qingzheng, et al.
Publicado: (2025)
por: Wang, Qingzheng, et al.
Publicado: (2025)
GmSLM : Generative Marmoset Spoken Language Modeling
por: Sternberg, Talia, et al.
Publicado: (2025)
por: Sternberg, Talia, et al.
Publicado: (2025)
Large Language Models for Expansion of Spoken Language Understanding Systems to New Languages
por: Hoscilowicz, Jakub, et al.
Publicado: (2024)
por: Hoscilowicz, Jakub, et al.
Publicado: (2024)
Canary-1B-v2 & Parakeet-TDT-0.6B-v3: Efficient and High-Performance Models for Multilingual ASR and AST
por: Sekoyan, Monica, et al.
Publicado: (2025)
por: Sekoyan, Monica, et al.
Publicado: (2025)
Dictionaries to the Rescue: Cross-Lingual Vocabulary Transfer for Low-Resource Languages Using Bilingual Dictionaries
por: Sakajo, Haruki, et al.
Publicado: (2025)
por: Sakajo, Haruki, et al.
Publicado: (2025)
SpokenUS: A Spoken User Simulator for Task-Oriented Dialogue
por: Lee, Jonggeun, et al.
Publicado: (2026)
por: Lee, Jonggeun, et al.
Publicado: (2026)
AFD-SLU: Adaptive Feature Distillation for Spoken Language Understanding
por: Xie, Yan, et al.
Publicado: (2025)
por: Xie, Yan, et al.
Publicado: (2025)
SLURP-TN : Resource for Tunisian Dialect Spoken Language Understanding
por: Elleuch, Haroun, et al.
Publicado: (2026)
por: Elleuch, Haroun, et al.
Publicado: (2026)
Punctuation Restoration for Singaporean Spoken Languages: English, Malay, and Mandarin
por: Rao, Abhinav, et al.
Publicado: (2022)
por: Rao, Abhinav, et al.
Publicado: (2022)
NushuRescue: Revitalization of the Endangered Nushu Language with AI
por: Yang, Ivory, et al.
Publicado: (2024)
por: Yang, Ivory, et al.
Publicado: (2024)
Do What I Say: A Spoken Prompt Dataset for Instruction-Following
por: Züfle, Maike, et al.
Publicado: (2026)
por: Züfle, Maike, et al.
Publicado: (2026)
Towards Automated Lexicography: Generating and Evaluating Definitions for Learner's Dictionaries
por: Ide, Yusuke, et al.
Publicado: (2026)
por: Ide, Yusuke, et al.
Publicado: (2026)
Chain-of-Dictionary Prompting Elicits Translation in Large Language Models
por: Lu, Hongyuan, et al.
Publicado: (2023)
por: Lu, Hongyuan, et al.
Publicado: (2023)
Towards Hierarchical Spoken Language Dysfluency Modeling
por: Lian, Jiachen, et al.
Publicado: (2024)
por: Lian, Jiachen, et al.
Publicado: (2024)
ChakmaNMT: Machine Translation for a Low-Resource and Endangered Language via Transliteration
por: Chakma, Aunabil, et al.
Publicado: (2024)
por: Chakma, Aunabil, et al.
Publicado: (2024)
Ejemplares similares
-
How Much Context Does My Attention-Based ASR System Need?
por: Flynn, Robert, et al.
Publicado: (2023) -
VisualSpeech: Enhancing Prosody Modeling in TTS Using Video
por: Que, Shumin, et al.
Publicado: (2025) -
Self-Train Before You Transcribe
por: Flynn, Robert, et al.
Publicado: (2024) -
DAG: Dictionary-Augmented Generation for Disambiguation of Sentences in Endangered Uralic Languages using ChatGPT
por: Hämäläinen, Mika
Publicado: (2024) -
Interventional Speech Noise Injection for ASR Generalizable Spoken Language Understanding
por: Jung, Yeonjoon, et al.
Publicado: (2024)