Efficient Adaptation of Multilingual Models for Japanese ASR
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Bajo, Mark, Fukukawa, Haruka, Morita, Ryuji, Ogasawara, Yuma |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Language-Aware Prompt Tuning for Parameter-Efficient Seamless Language Expansion in Multilingual ASR
von: Yang, Hongli, et al.
Veröffentlicht: (2025)
von: Yang, Hongli, et al.
Veröffentlicht: (2025)
Dynamic ASR Pathways: An Adaptive Masking Approach Towards Efficient Pruning of A Multilingual ASR Model
von: Xie, Jiamin, et al.
Veröffentlicht: (2023)
von: Xie, Jiamin, et al.
Veröffentlicht: (2023)
SUTA-LM: Bridging Test-Time Adaptation and Language Model Rescoring for Robust ASR
von: Huang, Wei-Ping, et al.
Veröffentlicht: (2025)
von: Huang, Wei-Ping, et al.
Veröffentlicht: (2025)
MSA-ASR: Efficient Multilingual Speaker Attribution with frozen ASR Models
von: Nguyen, Thai-Binh, et al.
Veröffentlicht: (2024)
von: Nguyen, Thai-Binh, et al.
Veröffentlicht: (2024)
Open ASR Leaderboard: Towards Reproducible and Transparent Multilingual and Long-Form Speech Recognition Evaluation
von: Srivastav, Vaibhav, et al.
Veröffentlicht: (2025)
von: Srivastav, Vaibhav, et al.
Veröffentlicht: (2025)
FLEURS-R: A Restored Multilingual Speech Corpus for Generation Tasks
von: Ma, Min, et al.
Veröffentlicht: (2024)
von: Ma, Min, et al.
Veröffentlicht: (2024)
Efficient Compression of Multitask Multilingual Speech Models
von: Ferraz, Thomas Palmeira
Veröffentlicht: (2024)
von: Ferraz, Thomas Palmeira
Veröffentlicht: (2024)
Fun-ASR Technical Report
von: An, Keyu, et al.
Veröffentlicht: (2025)
von: An, Keyu, et al.
Veröffentlicht: (2025)
Articulation-Informed ASR: Integrating Articulatory Features into ASR via Auxiliary Speech Inversion and Cross-Attention Fusion
von: Attia, Ahmed Adel, et al.
Veröffentlicht: (2025)
von: Attia, Ahmed Adel, et al.
Veröffentlicht: (2025)
CMT-LLM: Contextual Multi-Talker ASR Utilizing Large Language Models
von: He, Jiajun, et al.
Veröffentlicht: (2025)
von: He, Jiajun, et al.
Veröffentlicht: (2025)
VietASR: Achieving Industry-level Vietnamese ASR with 50-hour labeled data and Large-Scale Speech Pretraining
von: Zhuo, Jianheng, et al.
Veröffentlicht: (2025)
von: Zhuo, Jianheng, et al.
Veröffentlicht: (2025)
Romanization Encoding For Multilingual ASR
von: Ding, Wen, et al.
Veröffentlicht: (2024)
von: Ding, Wen, et al.
Veröffentlicht: (2024)
Samba-ASR: State-Of-The-Art Speech Recognition Leveraging Structured State-Space Models
von: Shakhadri, Syed Abdul Gaffar, et al.
Veröffentlicht: (2025)
von: Shakhadri, Syed Abdul Gaffar, et al.
Veröffentlicht: (2025)
Weak Supervision Techniques towards Enhanced ASR Models in Industry-level CRM Systems
von: Wang, Zhongsheng, et al.
Veröffentlicht: (2025)
von: Wang, Zhongsheng, et al.
Veröffentlicht: (2025)
Probing the Hidden Talent of ASR Foundation Models for L2 English Oral Assessment
von: Chao, Fu-An, et al.
Veröffentlicht: (2025)
von: Chao, Fu-An, et al.
Veröffentlicht: (2025)
Efficient Multilingual ASR Finetuning via LoRA Language Experts
von: Li, Jiahong, et al.
Veröffentlicht: (2025)
von: Li, Jiahong, et al.
Veröffentlicht: (2025)
PSRB: A Comprehensive Benchmark for Evaluating Persian ASR Systems
von: Sedghiyeh, Nima, et al.
Veröffentlicht: (2025)
von: Sedghiyeh, Nima, et al.
Veröffentlicht: (2025)
AdaCS: Adaptive Normalization for Enhanced Code-Switching ASR
von: Chu, The Chuong, et al.
Veröffentlicht: (2025)
von: Chu, The Chuong, et al.
Veröffentlicht: (2025)
Performance evaluation of SLAM-ASR: The Good, the Bad, the Ugly, and the Way Forward
von: Kumar, Shashi, et al.
Veröffentlicht: (2024)
von: Kumar, Shashi, et al.
Veröffentlicht: (2024)
FlanEC: Exploring Flan-T5 for Post-ASR Error Correction
von: La Quatra, Moreno, et al.
Veröffentlicht: (2025)
von: La Quatra, Moreno, et al.
Veröffentlicht: (2025)
Improving endpoint detection in end-to-end streaming ASR for conversational speech
von: C, Anandh, et al.
Veröffentlicht: (2025)
von: C, Anandh, et al.
Veröffentlicht: (2025)
Decoder-only Conformer with Modality-aware Sparse Mixtures of Experts for ASR
von: Lee, Jaeyoung, et al.
Veröffentlicht: (2026)
von: Lee, Jaeyoung, et al.
Veröffentlicht: (2026)
Adaptability of ASR Models on Low-Resource Language: A Comparative Study of Whisper and Wav2Vec-BERT on Bangla
von: Ridoy, Md Sazzadul Islam, et al.
Veröffentlicht: (2025)
von: Ridoy, Md Sazzadul Islam, et al.
Veröffentlicht: (2025)
A Self-Refining Framework for Enhancing ASR Using TTS-Synthesized Data
von: Chou, Cheng-Kang, et al.
Veröffentlicht: (2025)
von: Chou, Cheng-Kang, et al.
Veröffentlicht: (2025)
Exploring SSL Discrete Tokens for Multilingual ASR
von: Cui, Mingyu, et al.
Veröffentlicht: (2024)
von: Cui, Mingyu, et al.
Veröffentlicht: (2024)
Configurable Multilingual ASR with Speech Summary Representations
von: Zhu, Harrison, et al.
Veröffentlicht: (2024)
von: Zhu, Harrison, et al.
Veröffentlicht: (2024)
Temporal Order Preserved Optimal Transport-based Cross-modal Knowledge Transfer Learning for ASR
von: Lu, Xugang, et al.
Veröffentlicht: (2024)
von: Lu, Xugang, et al.
Veröffentlicht: (2024)
A Comparative Study of LLM-based ASR and Whisper in Low Resource and Code Switching Scenario
von: Song, Zheshu, et al.
Veröffentlicht: (2024)
von: Song, Zheshu, et al.
Veröffentlicht: (2024)
TurboBias: Universal ASR Context-Biasing powered by GPU-accelerated Phrase-Boosting Tree
von: Andrusenko, Andrei, et al.
Veröffentlicht: (2025)
von: Andrusenko, Andrei, et al.
Veröffentlicht: (2025)
Exploring ASR-Based Wav2Vec2 for Automated Speech Disorder Assessment: Insights and Analysis
von: Nguyen, Tuan, et al.
Veröffentlicht: (2024)
von: Nguyen, Tuan, et al.
Veröffentlicht: (2024)
Advocating Character Error Rate for Multilingual ASR Evaluation
von: K, Thennal D, et al.
Veröffentlicht: (2024)
von: K, Thennal D, et al.
Veröffentlicht: (2024)
Toward Responsible ASR for African American English Speakers: A Scoping Review of Bias and Equity in Speech Technology
von: Cunningham, Jay L., et al.
Veröffentlicht: (2025)
von: Cunningham, Jay L., et al.
Veröffentlicht: (2025)
TG-ASR: Translation-Guided Learning with Parallel Gated Cross Attention for Low-Resource Automatic Speech Recognition
von: Yang, Cheng-Yeh, et al.
Veröffentlicht: (2026)
von: Yang, Cheng-Yeh, et al.
Veröffentlicht: (2026)
PMF-CEC: Phoneme-augmented Multimodal Fusion for Context-aware ASR Error Correction with Error-specific Selective Decoding
von: He, Jiajun, et al.
Veröffentlicht: (2025)
von: He, Jiajun, et al.
Veröffentlicht: (2025)
Make It Hard to Hear, Easy to Learn: Long-Form Bengali ASR and Speaker Diarization via Extreme Augmentation and Perfect Alignment
von: Hasan, Sanjid, et al.
Veröffentlicht: (2026)
von: Hasan, Sanjid, et al.
Veröffentlicht: (2026)
Can we train ASR systems on Code-switch without real code-switch data? Case study for Singapore's languages
von: Nguyen, Tuan, et al.
Veröffentlicht: (2025)
von: Nguyen, Tuan, et al.
Veröffentlicht: (2025)
A Unified Speech LLM for Diarization and Speech Recognition in Multilingual Conversations
von: Saengthong, Phurich, et al.
Veröffentlicht: (2025)
von: Saengthong, Phurich, et al.
Veröffentlicht: (2025)
An Embarrassingly Simple Approach for LLM with Strong ASR Capacity
von: Ma, Ziyang, et al.
Veröffentlicht: (2024)
von: Ma, Ziyang, et al.
Veröffentlicht: (2024)
Efficient Data Selection for Domain Adaptation of ASR Using Pseudo-Labels and Multi-Stage Filtering
von: Rangappa, Pradeep, et al.
Veröffentlicht: (2025)
von: Rangappa, Pradeep, et al.
Veröffentlicht: (2025)
Continual Learning Optimizations for Auto-regressive Decoder of Multilingual ASR systems
von: Kwok, Chin Yuen, et al.
Veröffentlicht: (2024)
von: Kwok, Chin Yuen, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Language-Aware Prompt Tuning for Parameter-Efficient Seamless Language Expansion in Multilingual ASR
von: Yang, Hongli, et al.
Veröffentlicht: (2025) -
Dynamic ASR Pathways: An Adaptive Masking Approach Towards Efficient Pruning of A Multilingual ASR Model
von: Xie, Jiamin, et al.
Veröffentlicht: (2023) -
SUTA-LM: Bridging Test-Time Adaptation and Language Model Rescoring for Robust ASR
von: Huang, Wei-Ping, et al.
Veröffentlicht: (2025) -
MSA-ASR: Efficient Multilingual Speaker Attribution with frozen ASR Models
von: Nguyen, Thai-Binh, et al.
Veröffentlicht: (2024) -
Open ASR Leaderboard: Towards Reproducible and Transparent Multilingual and Long-Form Speech Recognition Evaluation
von: Srivastav, Vaibhav, et al.
Veröffentlicht: (2025)