Multi-task Pretraining for Enhancing Interpretable L2 Pronunciation Assessment
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Jiun-Ting, Yan, Bi-Cheng, Wang, Yi-Cheng, Chen, Berlin |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Automated Speaking Assessment of Conversation Tests with Novel Graph-based Modeling on Spoken Response Coherence
par: Li, Jiun-Ting, et autres
Publié: (2024)
par: Li, Jiun-Ting, et autres
Publié: (2024)
Probing the Hidden Talent of ASR Foundation Models for L2 English Oral Assessment
par: Chao, Fu-An, et autres
Publié: (2025)
par: Chao, Fu-An, et autres
Publié: (2025)
ConPCO: Preserving Phoneme Characteristics for Automatic Pronunciation Assessment Leveraging Contrastive Ordinal Regularization
par: Yan, Bi-Cheng, et autres
Publié: (2024)
par: Yan, Bi-Cheng, et autres
Publié: (2024)
DANCER: Entity Description Augmented Named Entity Corrector for Automatic Speech Recognition
par: Wang, Yi-Cheng, et autres
Publié: (2024)
par: Wang, Yi-Cheng, et autres
Publié: (2024)
MultiPA: A Multi-task Speech Pronunciation Assessment Model for Open Response Scenarios
par: Chen, Yu-Wen, et autres
Publié: (2023)
par: Chen, Yu-Wen, et autres
Publié: (2023)
Towards Efficient and Multifaceted Computer-assisted Pronunciation Training Leveraging Hierarchical Selective State Space Model and Decoupled Cross-entropy Loss
par: Chao, Fu-An, et autres
Publié: (2025)
par: Chao, Fu-An, et autres
Publié: (2025)
An Effective Context-Balanced Adaptation Approach for Long-Tailed Speech Recognition
par: Wang, Yi-Cheng, et autres
Publié: (2024)
par: Wang, Yi-Cheng, et autres
Publié: (2024)
Enhancing Code-Switching ASR Leveraging Non-Peaky CTC Loss and Deep Language Posterior Injection
par: Yang, Tzu-Ting, et autres
Publié: (2024)
par: Yang, Tzu-Ting, et autres
Publié: (2024)
Mitigating Data Imbalance in Automated Speaking Assessment
par: Tsai, Fong-Chun, et autres
Publié: (2025)
par: Tsai, Fong-Chun, et autres
Publié: (2025)
Automatic Text Pronunciation Correlation Generation and Application for Contextual Biasing
par: Cheng, Gaofeng, et autres
Publié: (2025)
par: Cheng, Gaofeng, et autres
Publié: (2025)
MuFFIN: Multifaceted Pronunciation Feedback Model with Interactive Hierarchical Neural Modeling
par: Yan, Bi-Cheng, et autres
Publié: (2025)
par: Yan, Bi-Cheng, et autres
Publié: (2025)
Multi-granularity Interactive Attention Framework for Residual Hierarchical Pronunciation Assessment
par: Han, Hong, et autres
Publié: (2026)
par: Han, Hong, et autres
Publié: (2026)
Pronunciation Assessment with Multi-modal Large Language Models
par: Fu, Kaiqi, et autres
Publié: (2024)
par: Fu, Kaiqi, et autres
Publié: (2024)
Acquiring Pronunciation Knowledge from Transcribed Speech Audio via Multi-task Learning
par: Sun, Siqi, et autres
Publié: (2024)
par: Sun, Siqi, et autres
Publié: (2024)
Fine-Tuning Large Multimodal Models for Automatic Pronunciation Assessment
par: Wang, Ke, et autres
Publié: (2025)
par: Wang, Ke, et autres
Publié: (2025)
Exploring the Potential of Large Multimodal Models as Effective Alternatives for Pronunciation Assessment
par: Wang, Ke, et autres
Publié: (2025)
par: Wang, Ke, et autres
Publié: (2025)
Acoustic Feature Mixup for Balanced Multi-aspect Pronunciation Assessment
par: Do, Heejin, et autres
Publié: (2024)
par: Do, Heejin, et autres
Publié: (2024)
HiPPO: Exploring A Novel Hierarchical Pronunciation Assessment Approach for Spoken Languages
par: Yan, Bi-Cheng, et autres
Publié: (2025)
par: Yan, Bi-Cheng, et autres
Publié: (2025)
An Effective Mixture-Of-Experts Approach For Code-Switching Speech Recognition Leveraging Encoder Disentanglement
par: Yang, Tzu-Ting, et autres
Publié: (2024)
par: Yang, Tzu-Ting, et autres
Publié: (2024)
Beyond Modality Limitations: A Unified MLLM Approach to Automated Speaking Assessment with Effective Curriculum Learning
par: Fang, Yu-Hsuan, et autres
Publié: (2025)
par: Fang, Yu-Hsuan, et autres
Publié: (2025)
Second Language Pronunciation Assessment
Publié: (2026)
Publié: (2026)
Session-Level Spoken Language Assessment with a Multimodal Foundation Model via Multi-Target Learning
par: Lin, Hong-Yun, et autres
Publié: (2025)
par: Lin, Hong-Yun, et autres
Publié: (2025)
Lost in Pronunciation: Detecting Chinese Offensive Language Disguised by Phonetic Cloaking Replacement
par: Guo, Haotan, et autres
Publié: (2025)
par: Guo, Haotan, et autres
Publié: (2025)
Optimizing Automatic Speech Assessment: W-RankSim Regularization and Hybrid Feature Fusion Strategies
par: Wu, Chung-Wen, et autres
Publié: (2024)
par: Wu, Chung-Wen, et autres
Publié: (2024)
Enhancing Distractor Generation for Multiple-Choice Questions with Retrieval Augmented Pretraining and Knowledge Graph Integration
par: Yu, Han-Cheng, et autres
Publié: (2024)
par: Yu, Han-Cheng, et autres
Publié: (2024)
MMMOS: Multi-domain Multi-axis Audio Quality Assessment
par: Lin, Yi-Cheng, et autres
Publié: (2025)
par: Lin, Yi-Cheng, et autres
Publié: (2025)
BAMBINO-LM: (Bilingual-)Human-Inspired Continual Pretraining of BabyLM
par: Shen, Zhewen, et autres
Publié: (2024)
par: Shen, Zhewen, et autres
Publié: (2024)
Enhancing Cross-task Transfer of Large Language Models via Activation Steering
par: Tang, Xinyu, et autres
Publié: (2025)
par: Tang, Xinyu, et autres
Publié: (2025)
Compositional Phoneme Approximation for L1-Grounded L2 Pronunciation Training
par: Park, Jisang, et autres
Publié: (2024)
par: Park, Jisang, et autres
Publié: (2024)
MAGI: Multi-Agent Guided Interview for Psychiatric Assessment
par: Bi, Guanqun, et autres
Publié: (2025)
par: Bi, Guanqun, et autres
Publié: (2025)
Towards Fully Exploiting LLM Internal States to Enhance Knowledge Boundary Perception
par: Ni, Shiyu, et autres
Publié: (2025)
par: Ni, Shiyu, et autres
Publié: (2025)
How Knowledge Popularity Influences and Enhances LLM Knowledge Boundary Perception
par: Ni, Shiyu, et autres
Publié: (2025)
par: Ni, Shiyu, et autres
Publié: (2025)
UnifiedMLLM: Enabling Unified Representation for Multi-modal Multi-tasks With Large Language Model
par: Li, Zhaowei, et autres
Publié: (2024)
par: Li, Zhaowei, et autres
Publié: (2024)
Enhancing Entity Aware Machine Translation with Multi-task Learning
par: Trieu, An, et autres
Publié: (2025)
par: Trieu, An, et autres
Publié: (2025)
MORE: Multi-mOdal REtrieval Augmented Generative Commonsense Reasoning
par: Cui, Wanqing, et autres
Publié: (2024)
par: Cui, Wanqing, et autres
Publié: (2024)
MuCPT: Music-related Natural Language Model Continued Pretraining
par: Tian, Kai, et autres
Publié: (2025)
par: Tian, Kai, et autres
Publié: (2025)
Leveraging Allophony in Self-Supervised Speech Models for Atypical Pronunciation Assessment
par: Choi, Kwanghee, et autres
Publié: (2025)
par: Choi, Kwanghee, et autres
Publié: (2025)
Deep Prompt Multi-task Network for Abuse Language Detection
par: Zhu, Jian, et autres
Publié: (2024)
par: Zhu, Jian, et autres
Publié: (2024)
Decoding by Contrasting Knowledge: Enhancing LLMs' Confidence on Edited Facts
par: Bi, Baolong, et autres
Publié: (2024)
par: Bi, Baolong, et autres
Publié: (2024)
Segmentation-free Goodness of Pronunciation
par: Cao, Xinwei, et autres
Publié: (2025)
par: Cao, Xinwei, et autres
Publié: (2025)
Documents similaires
-
Automated Speaking Assessment of Conversation Tests with Novel Graph-based Modeling on Spoken Response Coherence
par: Li, Jiun-Ting, et autres
Publié: (2024) -
Probing the Hidden Talent of ASR Foundation Models for L2 English Oral Assessment
par: Chao, Fu-An, et autres
Publié: (2025) -
ConPCO: Preserving Phoneme Characteristics for Automatic Pronunciation Assessment Leveraging Contrastive Ordinal Regularization
par: Yan, Bi-Cheng, et autres
Publié: (2024) -
DANCER: Entity Description Augmented Named Entity Corrector for Automatic Speech Recognition
par: Wang, Yi-Cheng, et autres
Publié: (2024) -
MultiPA: A Multi-task Speech Pronunciation Assessment Model for Open Response Scenarios
par: Chen, Yu-Wen, et autres
Publié: (2023)