SHNU Multilingual Conversational Speech Recognition System for INTERSPEECH 2025 MLC-SLM Challenge
Fuente:
arXiv
Salvato in:
| Autori principali: | Mei, Yuxiang, Zheng, Yuang, Xu, Dongxing, Long, Yanhua |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Triple X: A LLM-Based Multilingual Speech Recognition System for the INTERSPEECH2025 MLC-SLM Challenge
di: Gao, Miaomiao, et al.
Pubblicazione: (2025)
di: Gao, Miaomiao, et al.
Pubblicazione: (2025)
Transsion Multilingual Speech Recognition System for MLC-SLM 2025 Challenge
di: Li, Xiaoxiao, et al.
Pubblicazione: (2025)
di: Li, Xiaoxiao, et al.
Pubblicazione: (2025)
A Language-Agnostic Hierarchical LoRA-MoE Architecture for CTC-based Multilingual ASR
di: Zheng, Yuang, et al.
Pubblicazione: (2026)
di: Zheng, Yuang, et al.
Pubblicazione: (2026)
NTU Speechlab LLM-Based Multilingual ASR System for Interspeech MLC-SLM Challenge 2025
di: Peng, Yizhou, et al.
Pubblicazione: (2025)
di: Peng, Yizhou, et al.
Pubblicazione: (2025)
The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge
di: Xue, Hongfei, et al.
Pubblicazione: (2025)
di: Xue, Hongfei, et al.
Pubblicazione: (2025)
Bridging the gap: A comparative exploration of Speech-LLM and end-to-end architecture for multilingual conversational ASR
di: Mei, Yuxiang, et al.
Pubblicazione: (2026)
di: Mei, Yuxiang, et al.
Pubblicazione: (2026)
BUT System for the MLC-SLM Challenge
di: Polok, Alexander, et al.
Pubblicazione: (2025)
di: Polok, Alexander, et al.
Pubblicazione: (2025)
The DKU System for Multi-Speaker Automatic Speech Recognition in MLC-SLM Challenge
di: Lin, Yuke, et al.
Pubblicazione: (2025)
di: Lin, Yuke, et al.
Pubblicazione: (2025)
The Eloquence team submission for task 1 of MLC-SLM challenge
di: Concina, Lorenzo, et al.
Pubblicazione: (2025)
di: Concina, Lorenzo, et al.
Pubblicazione: (2025)
Seewo's Submission to MLC-SLM: Lessons learned from Speech Reasoning Language Models
di: Li, Bo, et al.
Pubblicazione: (2025)
di: Li, Bo, et al.
Pubblicazione: (2025)
Noisy Disentanglement with Tri-stage Training for Noise-Robust Speech Recognition
di: Chen, Shuangyuan, et al.
Pubblicazione: (2025)
di: Chen, Shuangyuan, et al.
Pubblicazione: (2025)
A Unified Speech LLM for Diarization and Speech Recognition in Multilingual Conversations
di: Saengthong, Phurich, et al.
Pubblicazione: (2025)
di: Saengthong, Phurich, et al.
Pubblicazione: (2025)
LegoSLM: Connecting LLM with Speech Encoder using CTC Posteriors
di: Ma, Rao, et al.
Pubblicazione: (2025)
di: Ma, Rao, et al.
Pubblicazione: (2025)
Bi-directional Context-Enhanced Speech Large Language Models for Multilingual Conversational ASR
di: Peng, Yizhou, et al.
Pubblicazione: (2025)
di: Peng, Yizhou, et al.
Pubblicazione: (2025)
Enhancing Indonesian Automatic Speech Recognition: Evaluating Multilingual Models with Diverse Speech Variabilities
di: Adila, Aulia, et al.
Pubblicazione: (2024)
di: Adila, Aulia, et al.
Pubblicazione: (2024)
Speaker-Aware Simulation Improves Conversational Speech Recognition
di: Gedeon, Máté, et al.
Pubblicazione: (2026)
di: Gedeon, Máté, et al.
Pubblicazione: (2026)
DQ-Data2vec: Decoupling Quantization for Multilingual Speech Recognition
di: Shao, Qijie, et al.
Pubblicazione: (2025)
di: Shao, Qijie, et al.
Pubblicazione: (2025)
DQ-Whisper: Joint Distillation and Quantization for Efficient Multilingual Speech Recognition
di: Shao, Hang, et al.
Pubblicazione: (2023)
di: Shao, Hang, et al.
Pubblicazione: (2023)
Weighted Cross-entropy for Low-Resource Languages in Multilingual Speech Recognition
di: Piñeiro-Martín, Andrés, et al.
Pubblicazione: (2024)
di: Piñeiro-Martín, Andrés, et al.
Pubblicazione: (2024)
Generating Data with Text-to-Speech and Large-Language Models for Conversational Speech Recognition
di: Cornell, Samuele, et al.
Pubblicazione: (2024)
di: Cornell, Samuele, et al.
Pubblicazione: (2024)
Recent Trends in Distant Conversational Speech Recognition: A Review of CHiME-7 and 8 DASR Challenges
di: Cornell, Samuele, et al.
Pubblicazione: (2025)
di: Cornell, Samuele, et al.
Pubblicazione: (2025)
Qwen vs. Gemma Integration with Whisper: A Comparative Study in Multilingual SpeechLLM Systems
di: Nguyen, Tuan, et al.
Pubblicazione: (2025)
di: Nguyen, Tuan, et al.
Pubblicazione: (2025)
Multi-Teacher Language-Aware Knowledge Distillation for Multilingual Speech Emotion Recognition
di: Bijoy, Mehedi Hasan, et al.
Pubblicazione: (2025)
di: Bijoy, Mehedi Hasan, et al.
Pubblicazione: (2025)
MultiMed: Multilingual Medical Speech Recognition via Attention Encoder Decoder
di: Le-Duc, Khai, et al.
Pubblicazione: (2024)
di: Le-Duc, Khai, et al.
Pubblicazione: (2024)
SSHR: Leveraging Self-supervised Hierarchical Representations for Multilingual Automatic Speech Recognition
di: Xue, Hongfei, et al.
Pubblicazione: (2023)
di: Xue, Hongfei, et al.
Pubblicazione: (2023)
Retrieval-Augmented Speech Recognition Approach for Domain Challenges
di: Shen, Peng, et al.
Pubblicazione: (2025)
di: Shen, Peng, et al.
Pubblicazione: (2025)
Emilia: An Extensive, Multilingual, and Diverse Speech Dataset for Large-Scale Speech Generation
di: He, Haorui, et al.
Pubblicazione: (2024)
di: He, Haorui, et al.
Pubblicazione: (2024)
Cross-lingual Embedding Clustering for Hierarchical Softmax in Low-Resource Multilingual Speech Recognition
di: Yang, Zhengdong, et al.
Pubblicazione: (2025)
di: Yang, Zhengdong, et al.
Pubblicazione: (2025)
Language-Universal Speech Attributes Modeling for Zero-Shot Multilingual Spoken Keyword Recognition
di: Yen, Hao, et al.
Pubblicazione: (2024)
di: Yen, Hao, et al.
Pubblicazione: (2024)
Whistle: Data-Efficient Multilingual and Crosslingual Speech Recognition via Weakly Phonetic Supervision
di: Yusuyin, Saierdaer, et al.
Pubblicazione: (2024)
di: Yusuyin, Saierdaer, et al.
Pubblicazione: (2024)
Streaming Speech-to-Confusion Network Speech Recognition
di: Filimonov, Denis, et al.
Pubblicazione: (2023)
di: Filimonov, Denis, et al.
Pubblicazione: (2023)
Multitask Learning for Grapheme-to-Phoneme Conversion of Anglicisms in German Speech Recognition
di: Pritzen, Julia, et al.
Pubblicazione: (2021)
di: Pritzen, Julia, et al.
Pubblicazione: (2021)
Unveiling Biases while Embracing Sustainability: Assessing the Dual Challenges of Automatic Speech Recognition Systems
di: Kulkarni, Ajinkya, et al.
Pubblicazione: (2025)
di: Kulkarni, Ajinkya, et al.
Pubblicazione: (2025)
DisfluencySpeech -- Single-Speaker Conversational Speech Dataset with Paralanguage
di: Wang, Kyra, et al.
Pubblicazione: (2024)
di: Wang, Kyra, et al.
Pubblicazione: (2024)
SpeechTaxi: On Multilingual Semantic Speech Classification
di: Keller, Lennart, et al.
Pubblicazione: (2024)
di: Keller, Lennart, et al.
Pubblicazione: (2024)
Low-Resourced Speech Recognition for Iu Mien Language via Weakly-Supervised Phoneme-based Multilingual Pre-training
di: Dong, Lukuan, et al.
Pubblicazione: (2024)
di: Dong, Lukuan, et al.
Pubblicazione: (2024)
Dual-Pipeline with Low-Rank Adaptation for New Language Integration in Multilingual ASR
di: Khassanov, Yerbolat, et al.
Pubblicazione: (2024)
di: Khassanov, Yerbolat, et al.
Pubblicazione: (2024)
Multilingual Zero Resource Speech Recognition Base on Self-Supervise Pre-Trained Acoustic Models
di: Wang, Haoyu, et al.
Pubblicazione: (2022)
di: Wang, Haoyu, et al.
Pubblicazione: (2022)
Rapid Language Adaptation for Multilingual E2E Speech Recognition Using Encoder Prompting
di: Kashiwagi, Yosuke, et al.
Pubblicazione: (2024)
di: Kashiwagi, Yosuke, et al.
Pubblicazione: (2024)
JELLY: Joint Emotion Recognition and Context Reasoning with LLMs for Conversational Speech Synthesis
di: Cha, Jun-Hyeok, et al.
Pubblicazione: (2025)
di: Cha, Jun-Hyeok, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Triple X: A LLM-Based Multilingual Speech Recognition System for the INTERSPEECH2025 MLC-SLM Challenge
di: Gao, Miaomiao, et al.
Pubblicazione: (2025) -
Transsion Multilingual Speech Recognition System for MLC-SLM 2025 Challenge
di: Li, Xiaoxiao, et al.
Pubblicazione: (2025) -
A Language-Agnostic Hierarchical LoRA-MoE Architecture for CTC-based Multilingual ASR
di: Zheng, Yuang, et al.
Pubblicazione: (2026) -
NTU Speechlab LLM-Based Multilingual ASR System for Interspeech MLC-SLM Challenge 2025
di: Peng, Yizhou, et al.
Pubblicazione: (2025) -
The TEA-ASLP System for Multilingual Conversational Speech Recognition and Speech Diarization in MLC-SLM 2025 Challenge
di: Xue, Hongfei, et al.
Pubblicazione: (2025)