LAMA-UT: Language Agnostic Multilingual ASR through Orthography Unification and Language-Specific Transliteration
Fuente:
arXiv
Salvato in:
| Autori principali: | Lee, Sangmin, Chung, Woo-Jin, Kang, Hong-Goo |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
UniCoM: A Universal Code-Switching Speech Generator
di: Lee, Sangmin, et al.
Pubblicazione: (2025)
di: Lee, Sangmin, et al.
Pubblicazione: (2025)
A Language-Agnostic Hierarchical LoRA-MoE Architecture for CTC-based Multilingual ASR
di: Zheng, Yuang, et al.
Pubblicazione: (2026)
di: Zheng, Yuang, et al.
Pubblicazione: (2026)
Efficient Multilingual ASR Finetuning via LoRA Language Experts
di: Li, Jiahong, et al.
Pubblicazione: (2025)
di: Li, Jiahong, et al.
Pubblicazione: (2025)
Speaker-Independent Acoustic-to-Articulatory Inversion through Multi-Channel Attention Discriminator
di: Chung, Woo-Jin, et al.
Pubblicazione: (2024)
di: Chung, Woo-Jin, et al.
Pubblicazione: (2024)
Romanization Encoding For Multilingual ASR
di: Ding, Wen, et al.
Pubblicazione: (2024)
di: Ding, Wen, et al.
Pubblicazione: (2024)
Multilingual and Fully Non-Autoregressive ASR with Large Language Model Fusion: A Comprehensive Study
di: Huang, W. Ronny, et al.
Pubblicazione: (2024)
di: Huang, W. Ronny, et al.
Pubblicazione: (2024)
MSA-ASR: Efficient Multilingual Speaker Attribution with frozen ASR Models
di: Nguyen, Thai-Binh, et al.
Pubblicazione: (2024)
di: Nguyen, Thai-Binh, et al.
Pubblicazione: (2024)
Exploring SSL Discrete Tokens for Multilingual ASR
di: Cui, Mingyu, et al.
Pubblicazione: (2024)
di: Cui, Mingyu, et al.
Pubblicazione: (2024)
Configurable Multilingual ASR with Speech Summary Representations
di: Zhu, Harrison, et al.
Pubblicazione: (2024)
di: Zhu, Harrison, et al.
Pubblicazione: (2024)
Interventional Speech Noise Injection for ASR Generalizable Spoken Language Understanding
di: Jung, Yeonjoon, et al.
Pubblicazione: (2024)
di: Jung, Yeonjoon, et al.
Pubblicazione: (2024)
BLR-MoE: Boosted Language-Routing Mixture of Experts for Domain-Robust Multilingual E2E ASR
di: Ma, Guodong, et al.
Pubblicazione: (2025)
di: Ma, Guodong, et al.
Pubblicazione: (2025)
Advocating Character Error Rate for Multilingual ASR Evaluation
di: K, Thennal D, et al.
Pubblicazione: (2024)
di: K, Thennal D, et al.
Pubblicazione: (2024)
Exploring the Impact of Data Quantity on ASR in Extremely Low-resource Languages
di: Cheng, Yao-Fei, et al.
Pubblicazione: (2024)
di: Cheng, Yao-Fei, et al.
Pubblicazione: (2024)
ASR-EC Benchmark: Evaluating Large Language Models on Chinese ASR Error Correction
di: Wei, Victor Junqiu, et al.
Pubblicazione: (2024)
di: Wei, Victor Junqiu, et al.
Pubblicazione: (2024)
ManWav: The First Manchu ASR Model
di: Seo, Jean, et al.
Pubblicazione: (2024)
di: Seo, Jean, et al.
Pubblicazione: (2024)
Efficient Adapter Finetuning for Tail Languages in Streaming Multilingual ASR
di: Bai, Junwen, et al.
Pubblicazione: (2024)
di: Bai, Junwen, et al.
Pubblicazione: (2024)
Language-Aware Prompt Tuning for Parameter-Efficient Seamless Language Expansion in Multilingual ASR
di: Yang, Hongli, et al.
Pubblicazione: (2025)
di: Yang, Hongli, et al.
Pubblicazione: (2025)
Continual Learning Optimizations for Auto-regressive Decoder of Multilingual ASR systems
di: Kwok, Chin Yuen, et al.
Pubblicazione: (2024)
di: Kwok, Chin Yuen, et al.
Pubblicazione: (2024)
ASR Error Correction using Large Language Models
di: Ma, Rao, et al.
Pubblicazione: (2024)
di: Ma, Rao, et al.
Pubblicazione: (2024)
PromptASR for contextualized ASR with controllable style
di: Yang, Xiaoyu, et al.
Pubblicazione: (2023)
di: Yang, Xiaoyu, et al.
Pubblicazione: (2023)
Multilingual DistilWhisper: Efficient Distillation of Multi-task Speech Models via Language-Specific Experts
di: Ferraz, Thomas Palmeira, et al.
Pubblicazione: (2023)
di: Ferraz, Thomas Palmeira, et al.
Pubblicazione: (2023)
Multilingual Dysarthric Speech Assessment Using Universal Phone Recognition and Language-Specific Phonemic Contrast Modeling
di: Yeo, Eunjung, et al.
Pubblicazione: (2026)
di: Yeo, Eunjung, et al.
Pubblicazione: (2026)
Transliterated Zero-Shot Domain Adaptation for Automatic Speech Recognition
di: Zhu, Han, et al.
Pubblicazione: (2024)
di: Zhu, Han, et al.
Pubblicazione: (2024)
Improving Multilingual ASR in the Wild Using Simple N-best Re-ranking
di: Yan, Brian, et al.
Pubblicazione: (2024)
di: Yan, Brian, et al.
Pubblicazione: (2024)
Soft Language Identification for Language-Agnostic Many-to-One End-to-End Speech Translation
di: Wang, Peidong, et al.
Pubblicazione: (2024)
di: Wang, Peidong, et al.
Pubblicazione: (2024)
Towards Rehearsal-Free Multilingual ASR: A LoRA-based Case Study on Whisper
di: Xu, Tianyi, et al.
Pubblicazione: (2024)
di: Xu, Tianyi, et al.
Pubblicazione: (2024)
The Sound of Healthcare: Improving Medical Transcription ASR Accuracy with Large Language Models
di: Adedeji, Ayo, et al.
Pubblicazione: (2024)
di: Adedeji, Ayo, et al.
Pubblicazione: (2024)
Empowering Low-Resource Language ASR via Large-Scale Pseudo Labeling
di: Bhogale, Kaushal Santosh, et al.
Pubblicazione: (2024)
di: Bhogale, Kaushal Santosh, et al.
Pubblicazione: (2024)
Large Language Model Should Understand Pinyin for Chinese ASR Error Correction
di: Li, Yuang, et al.
Pubblicazione: (2024)
di: Li, Yuang, et al.
Pubblicazione: (2024)
Language-Universal Speech Attributes Modeling for Zero-Shot Multilingual Spoken Keyword Recognition
di: Yen, Hao, et al.
Pubblicazione: (2024)
di: Yen, Hao, et al.
Pubblicazione: (2024)
Advancing Hearing Assessment: An ASR-Based Frequency-Specific Speech Test for Diagnosing Presbycusis
di: Bleeck, Stefan
Pubblicazione: (2025)
di: Bleeck, Stefan
Pubblicazione: (2025)
ASR Under the Stethoscope: Evaluating Biases in Clinical Speech Recognition across Indian Languages
di: Kumar, Subham, et al.
Pubblicazione: (2025)
di: Kumar, Subham, et al.
Pubblicazione: (2025)
MTP-S2UT: Enhancing Speech-to-Speech Translation Quality with Multi-token Prediction
di: Wang, Jianjin, et al.
Pubblicazione: (2025)
di: Wang, Jianjin, et al.
Pubblicazione: (2025)
Spelling Correction through Rewriting of Non-Autoregressive ASR Lattices
di: Velikovich, Leonid, et al.
Pubblicazione: (2024)
di: Velikovich, Leonid, et al.
Pubblicazione: (2024)
Breaking the Transcription Bottleneck: Fine-tuning ASR Models for Extremely Low-Resource Fieldwork Languages
di: Liang, Siyu, et al.
Pubblicazione: (2025)
di: Liang, Siyu, et al.
Pubblicazione: (2025)
Towards Inclusive ASR: Investigating Voice Conversion for Dysarthric Speech Recognition in Low-Resource Languages
di: Li, Chin-Jou, et al.
Pubblicazione: (2025)
di: Li, Chin-Jou, et al.
Pubblicazione: (2025)
Anatomy of Industrial Scale Multilingual ASR
di: Ramirez, Francis McCann, et al.
Pubblicazione: (2024)
di: Ramirez, Francis McCann, et al.
Pubblicazione: (2024)
Teaching a Multilingual Large Language Model to Understand Multilingual Speech via Multi-Instructional Training
di: Denisov, Pavel, et al.
Pubblicazione: (2024)
di: Denisov, Pavel, et al.
Pubblicazione: (2024)
XLS-R Deep Learning Model for Multilingual ASR on Low- Resource Languages: Indonesian, Javanese, and Sundanese
di: Arisaputra, Panji, et al.
Pubblicazione: (2024)
di: Arisaputra, Panji, et al.
Pubblicazione: (2024)
Generalized Multilingual Text-to-Speech Generation with Language-Aware Style Adaptation
di: Lou, Haowei, et al.
Pubblicazione: (2025)
di: Lou, Haowei, et al.
Pubblicazione: (2025)
Documenti analoghi
-
UniCoM: A Universal Code-Switching Speech Generator
di: Lee, Sangmin, et al.
Pubblicazione: (2025) -
A Language-Agnostic Hierarchical LoRA-MoE Architecture for CTC-based Multilingual ASR
di: Zheng, Yuang, et al.
Pubblicazione: (2026) -
Efficient Multilingual ASR Finetuning via LoRA Language Experts
di: Li, Jiahong, et al.
Pubblicazione: (2025) -
Speaker-Independent Acoustic-to-Articulatory Inversion through Multi-Channel Attention Discriminator
di: Chung, Woo-Jin, et al.
Pubblicazione: (2024) -
Romanization Encoding For Multilingual ASR
di: Ding, Wen, et al.
Pubblicazione: (2024)