Multi-task Pretraining for Enhancing Interpretable L2 Pronunciation Assessment
Fuente:
arXiv
Guardado en:
| Autores principales: | Li, Jiun-Ting, Yan, Bi-Cheng, Wang, Yi-Cheng, Chen, Berlin |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Automated Speaking Assessment of Conversation Tests with Novel Graph-based Modeling on Spoken Response Coherence
por: Li, Jiun-Ting, et al.
Publicado: (2024)
por: Li, Jiun-Ting, et al.
Publicado: (2024)
Probing the Hidden Talent of ASR Foundation Models for L2 English Oral Assessment
por: Chao, Fu-An, et al.
Publicado: (2025)
por: Chao, Fu-An, et al.
Publicado: (2025)
ConPCO: Preserving Phoneme Characteristics for Automatic Pronunciation Assessment Leveraging Contrastive Ordinal Regularization
por: Yan, Bi-Cheng, et al.
Publicado: (2024)
por: Yan, Bi-Cheng, et al.
Publicado: (2024)
DANCER: Entity Description Augmented Named Entity Corrector for Automatic Speech Recognition
por: Wang, Yi-Cheng, et al.
Publicado: (2024)
por: Wang, Yi-Cheng, et al.
Publicado: (2024)
MultiPA: A Multi-task Speech Pronunciation Assessment Model for Open Response Scenarios
por: Chen, Yu-Wen, et al.
Publicado: (2023)
por: Chen, Yu-Wen, et al.
Publicado: (2023)
Towards Efficient and Multifaceted Computer-assisted Pronunciation Training Leveraging Hierarchical Selective State Space Model and Decoupled Cross-entropy Loss
por: Chao, Fu-An, et al.
Publicado: (2025)
por: Chao, Fu-An, et al.
Publicado: (2025)
An Effective Context-Balanced Adaptation Approach for Long-Tailed Speech Recognition
por: Wang, Yi-Cheng, et al.
Publicado: (2024)
por: Wang, Yi-Cheng, et al.
Publicado: (2024)
Enhancing Code-Switching ASR Leveraging Non-Peaky CTC Loss and Deep Language Posterior Injection
por: Yang, Tzu-Ting, et al.
Publicado: (2024)
por: Yang, Tzu-Ting, et al.
Publicado: (2024)
Mitigating Data Imbalance in Automated Speaking Assessment
por: Tsai, Fong-Chun, et al.
Publicado: (2025)
por: Tsai, Fong-Chun, et al.
Publicado: (2025)
Automatic Text Pronunciation Correlation Generation and Application for Contextual Biasing
por: Cheng, Gaofeng, et al.
Publicado: (2025)
por: Cheng, Gaofeng, et al.
Publicado: (2025)
MuFFIN: Multifaceted Pronunciation Feedback Model with Interactive Hierarchical Neural Modeling
por: Yan, Bi-Cheng, et al.
Publicado: (2025)
por: Yan, Bi-Cheng, et al.
Publicado: (2025)
Multi-granularity Interactive Attention Framework for Residual Hierarchical Pronunciation Assessment
por: Han, Hong, et al.
Publicado: (2026)
por: Han, Hong, et al.
Publicado: (2026)
Pronunciation Assessment with Multi-modal Large Language Models
por: Fu, Kaiqi, et al.
Publicado: (2024)
por: Fu, Kaiqi, et al.
Publicado: (2024)
Acquiring Pronunciation Knowledge from Transcribed Speech Audio via Multi-task Learning
por: Sun, Siqi, et al.
Publicado: (2024)
por: Sun, Siqi, et al.
Publicado: (2024)
Fine-Tuning Large Multimodal Models for Automatic Pronunciation Assessment
por: Wang, Ke, et al.
Publicado: (2025)
por: Wang, Ke, et al.
Publicado: (2025)
Exploring the Potential of Large Multimodal Models as Effective Alternatives for Pronunciation Assessment
por: Wang, Ke, et al.
Publicado: (2025)
por: Wang, Ke, et al.
Publicado: (2025)
Acoustic Feature Mixup for Balanced Multi-aspect Pronunciation Assessment
por: Do, Heejin, et al.
Publicado: (2024)
por: Do, Heejin, et al.
Publicado: (2024)
HiPPO: Exploring A Novel Hierarchical Pronunciation Assessment Approach for Spoken Languages
por: Yan, Bi-Cheng, et al.
Publicado: (2025)
por: Yan, Bi-Cheng, et al.
Publicado: (2025)
An Effective Mixture-Of-Experts Approach For Code-Switching Speech Recognition Leveraging Encoder Disentanglement
por: Yang, Tzu-Ting, et al.
Publicado: (2024)
por: Yang, Tzu-Ting, et al.
Publicado: (2024)
Beyond Modality Limitations: A Unified MLLM Approach to Automated Speaking Assessment with Effective Curriculum Learning
por: Fang, Yu-Hsuan, et al.
Publicado: (2025)
por: Fang, Yu-Hsuan, et al.
Publicado: (2025)
Second Language Pronunciation Assessment
Publicado: (2026)
Publicado: (2026)
Session-Level Spoken Language Assessment with a Multimodal Foundation Model via Multi-Target Learning
por: Lin, Hong-Yun, et al.
Publicado: (2025)
por: Lin, Hong-Yun, et al.
Publicado: (2025)
Lost in Pronunciation: Detecting Chinese Offensive Language Disguised by Phonetic Cloaking Replacement
por: Guo, Haotan, et al.
Publicado: (2025)
por: Guo, Haotan, et al.
Publicado: (2025)
Optimizing Automatic Speech Assessment: W-RankSim Regularization and Hybrid Feature Fusion Strategies
por: Wu, Chung-Wen, et al.
Publicado: (2024)
por: Wu, Chung-Wen, et al.
Publicado: (2024)
Enhancing Distractor Generation for Multiple-Choice Questions with Retrieval Augmented Pretraining and Knowledge Graph Integration
por: Yu, Han-Cheng, et al.
Publicado: (2024)
por: Yu, Han-Cheng, et al.
Publicado: (2024)
MMMOS: Multi-domain Multi-axis Audio Quality Assessment
por: Lin, Yi-Cheng, et al.
Publicado: (2025)
por: Lin, Yi-Cheng, et al.
Publicado: (2025)
BAMBINO-LM: (Bilingual-)Human-Inspired Continual Pretraining of BabyLM
por: Shen, Zhewen, et al.
Publicado: (2024)
por: Shen, Zhewen, et al.
Publicado: (2024)
Enhancing Cross-task Transfer of Large Language Models via Activation Steering
por: Tang, Xinyu, et al.
Publicado: (2025)
por: Tang, Xinyu, et al.
Publicado: (2025)
Compositional Phoneme Approximation for L1-Grounded L2 Pronunciation Training
por: Park, Jisang, et al.
Publicado: (2024)
por: Park, Jisang, et al.
Publicado: (2024)
MAGI: Multi-Agent Guided Interview for Psychiatric Assessment
por: Bi, Guanqun, et al.
Publicado: (2025)
por: Bi, Guanqun, et al.
Publicado: (2025)
Towards Fully Exploiting LLM Internal States to Enhance Knowledge Boundary Perception
por: Ni, Shiyu, et al.
Publicado: (2025)
por: Ni, Shiyu, et al.
Publicado: (2025)
How Knowledge Popularity Influences and Enhances LLM Knowledge Boundary Perception
por: Ni, Shiyu, et al.
Publicado: (2025)
por: Ni, Shiyu, et al.
Publicado: (2025)
UnifiedMLLM: Enabling Unified Representation for Multi-modal Multi-tasks With Large Language Model
por: Li, Zhaowei, et al.
Publicado: (2024)
por: Li, Zhaowei, et al.
Publicado: (2024)
Enhancing Entity Aware Machine Translation with Multi-task Learning
por: Trieu, An, et al.
Publicado: (2025)
por: Trieu, An, et al.
Publicado: (2025)
MORE: Multi-mOdal REtrieval Augmented Generative Commonsense Reasoning
por: Cui, Wanqing, et al.
Publicado: (2024)
por: Cui, Wanqing, et al.
Publicado: (2024)
MuCPT: Music-related Natural Language Model Continued Pretraining
por: Tian, Kai, et al.
Publicado: (2025)
por: Tian, Kai, et al.
Publicado: (2025)
Leveraging Allophony in Self-Supervised Speech Models for Atypical Pronunciation Assessment
por: Choi, Kwanghee, et al.
Publicado: (2025)
por: Choi, Kwanghee, et al.
Publicado: (2025)
Deep Prompt Multi-task Network for Abuse Language Detection
por: Zhu, Jian, et al.
Publicado: (2024)
por: Zhu, Jian, et al.
Publicado: (2024)
Decoding by Contrasting Knowledge: Enhancing LLMs' Confidence on Edited Facts
por: Bi, Baolong, et al.
Publicado: (2024)
por: Bi, Baolong, et al.
Publicado: (2024)
Segmentation-free Goodness of Pronunciation
por: Cao, Xinwei, et al.
Publicado: (2025)
por: Cao, Xinwei, et al.
Publicado: (2025)
Ejemplares similares
-
Automated Speaking Assessment of Conversation Tests with Novel Graph-based Modeling on Spoken Response Coherence
por: Li, Jiun-Ting, et al.
Publicado: (2024) -
Probing the Hidden Talent of ASR Foundation Models for L2 English Oral Assessment
por: Chao, Fu-An, et al.
Publicado: (2025) -
ConPCO: Preserving Phoneme Characteristics for Automatic Pronunciation Assessment Leveraging Contrastive Ordinal Regularization
por: Yan, Bi-Cheng, et al.
Publicado: (2024) -
DANCER: Entity Description Augmented Named Entity Corrector for Automatic Speech Recognition
por: Wang, Yi-Cheng, et al.
Publicado: (2024) -
MultiPA: A Multi-task Speech Pronunciation Assessment Model for Open Response Scenarios
por: Chen, Yu-Wen, et al.
Publicado: (2023)