Federated Heterogeneous Language Model Optimization for Hybrid Automatic Speech Recognition
Fuente:
arXiv
Guardado en:
| Autores principales: | Hong, Mengze, Gu, Yi, Jiang, Di, Gu, Hanlin, Zhang, Chen Jason, Wang, Lu, Su, Zhiyang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Orchestration-Free Customer Service Automation: A Privacy-Preserving and Flowchart-Guided Framework
por: Hong, Mengze, et al.
Publicado: (2026)
por: Hong, Mengze, et al.
Publicado: (2026)
Contextualized Token Discrimination for Speech Search Query Correction
por: Lu, Junyu, et al.
Publicado: (2025)
por: Lu, Junyu, et al.
Publicado: (2025)
Semantic-Augmented Latent Topic Modeling with LLM-in-the-Loop
por: Hong, Mengze, et al.
Publicado: (2025)
por: Hong, Mengze, et al.
Publicado: (2025)
Augmenting Compliance-Guaranteed Customer Service Chatbots: Context-Aware Knowledge Expansion with Large Language Models
por: Hong, Mengze, et al.
Publicado: (2024)
por: Hong, Mengze, et al.
Publicado: (2024)
Dialogue Language Model with Large-Scale Persona Data Engineering
por: Hong, Mengze, et al.
Publicado: (2024)
por: Hong, Mengze, et al.
Publicado: (2024)
QualBench: Benchmarking Chinese LLMs with Localized Professional Qualifications for Vertical Domain Evaluation
por: Hong, Mengze, et al.
Publicado: (2025)
por: Hong, Mengze, et al.
Publicado: (2025)
RAL2M: Retrieval Augmented Learning-To-Match Against Hallucination in Compliance-Guaranteed Service Systems
por: Hong, Mengze, et al.
Publicado: (2026)
por: Hong, Mengze, et al.
Publicado: (2026)
CiteLLM: An Agentic Platform for Trustworthy Scientific Reference Discovery
por: Hong, Mengze, et al.
Publicado: (2026)
por: Hong, Mengze, et al.
Publicado: (2026)
Federating Dynamic Models using Early-Exit Architectures for Automatic Speech Recognition on Heterogeneous Clients
por: Ali, Mohamed Nabih, et al.
Publicado: (2024)
por: Ali, Mohamed Nabih, et al.
Publicado: (2024)
Neural-Bayesian Program Learning for Few-shot Dialogue Intent Parsing
por: Hong, Mengze, et al.
Publicado: (2024)
por: Hong, Mengze, et al.
Publicado: (2024)
Dial-In LLM: Human-Aligned LLM-in-the-loop Intent Clustering for Customer Service Dialogues
por: Hong, Mengze, et al.
Publicado: (2024)
por: Hong, Mengze, et al.
Publicado: (2024)
Automatic Speech Recognition for the Ika Language
por: Nzenwata, Uchenna, et al.
Publicado: (2024)
por: Nzenwata, Uchenna, et al.
Publicado: (2024)
Qualitative Evaluation of Language Model Rescoring in Automatic Speech Recognition
por: Bañeras-Roux, Thibault, et al.
Publicado: (2026)
por: Bañeras-Roux, Thibault, et al.
Publicado: (2026)
Auto-Demo Prompting: Leveraging Generated Outputs as Demonstrations for Enhanced Batch Prompting
por: Feng, Longyu, et al.
Publicado: (2024)
por: Feng, Longyu, et al.
Publicado: (2024)
Speech-Aware Long Context Pruning and Integration for Contextualized Automatic Speech Recognition
por: Rong, Yiming, et al.
Publicado: (2025)
por: Rong, Yiming, et al.
Publicado: (2025)
Evaluation of Automatic Speech Recognition Using Generative Large Language Models
por: Bañeras-Roux, Thibault, et al.
Publicado: (2026)
por: Bañeras-Roux, Thibault, et al.
Publicado: (2026)
Joint Unsupervised and Supervised Training for Automatic Speech Recognition via Bilevel Optimization
por: Saif, A F M, et al.
Publicado: (2024)
por: Saif, A F M, et al.
Publicado: (2024)
Stuttering-Aware Automatic Speech Recognition for Indonesian Language
por: Muhammad, Fadhil, et al.
Publicado: (2026)
por: Muhammad, Fadhil, et al.
Publicado: (2026)
Automatic Speech Recognition Advancements for Indigenous Languages of the Americas
por: Romero, Monica, et al.
Publicado: (2024)
por: Romero, Monica, et al.
Publicado: (2024)
Where Are We At with Automatic Speech Recognition for the Bambara Language?
por: Diallo, Seydou, et al.
Publicado: (2026)
por: Diallo, Seydou, et al.
Publicado: (2026)
Bilevel Joint Unsupervised and Supervised Training for Automatic Speech Recognition
por: Cui, Xiaodong, et al.
Publicado: (2024)
por: Cui, Xiaodong, et al.
Publicado: (2024)
DANCER: Entity Description Augmented Named Entity Corrector for Automatic Speech Recognition
por: Wang, Yi-Cheng, et al.
Publicado: (2024)
por: Wang, Yi-Cheng, et al.
Publicado: (2024)
Benchmarking Automatic Speech Recognition Models for African Languages
por: Nahabwe, Alvin, et al.
Publicado: (2025)
por: Nahabwe, Alvin, et al.
Publicado: (2025)
Exploring Effective Distillation of Self-Supervised Speech Models for Automatic Speech Recognition
por: Wang, Yujin, et al.
Publicado: (2022)
por: Wang, Yujin, et al.
Publicado: (2022)
FedCoT: Federated Chain-of-Thought Distillation for Large Language Models
por: Fan, Tao, et al.
Publicado: (2024)
por: Fan, Tao, et al.
Publicado: (2024)
LoASR-Bench: Evaluating Large Speech Language Models on Low-Resource Automatic Speech Recognition Across Language Families
por: Chen, Jianan, et al.
Publicado: (2026)
por: Chen, Jianan, et al.
Publicado: (2026)
Dolphin: A Large-Scale Automatic Speech Recognition Model for Eastern Languages
por: Meng, Yangyang, et al.
Publicado: (2025)
por: Meng, Yangyang, et al.
Publicado: (2025)
FedMKT: Federated Mutual Knowledge Transfer for Large and Small Language Models
por: Fan, Tao, et al.
Publicado: (2024)
por: Fan, Tao, et al.
Publicado: (2024)
Multimodal Peer Review Simulation with Actionable To-Do Recommendations for Community-Aware Manuscript Revisions
por: Hong, Mengze, et al.
Publicado: (2025)
por: Hong, Mengze, et al.
Publicado: (2025)
PAC: Pronunciation-Aware Contextualized Large Language Model-based Automatic Speech Recognition
por: Fu, Li, et al.
Publicado: (2025)
por: Fu, Li, et al.
Publicado: (2025)
Speech Recognition Rescoring with Large Speech-Text Foundation Models
por: Shivakumar, Prashanth Gurunath, et al.
Publicado: (2024)
por: Shivakumar, Prashanth Gurunath, et al.
Publicado: (2024)
End-to-end Automatic Speech Recognition and Speech Translation: Integration of Speech Foundational Models and LLMs
por: Luu, Nam, et al.
Publicado: (2025)
por: Luu, Nam, et al.
Publicado: (2025)
Automatic Screening for Children with Speech Disorder using Automatic Speech Recognition: Opportunities and Challenges
por: Liu, Dancheng, et al.
Publicado: (2024)
por: Liu, Dancheng, et al.
Publicado: (2024)
Enabling Auditory Large Language Models for Automatic Speech Quality Evaluation
por: Wang, Siyin, et al.
Publicado: (2024)
por: Wang, Siyin, et al.
Publicado: (2024)
Exploring the Integration of Large Language Models into Automatic Speech Recognition Systems: An Empirical Study
por: Min, Zeping, et al.
Publicado: (2023)
por: Min, Zeping, et al.
Publicado: (2023)
Responsible Benchmarking of Fairness for Automatic Speech Recognition
por: Herron, Felix, et al.
Publicado: (2026)
por: Herron, Felix, et al.
Publicado: (2026)
Vietnamese Automatic Speech Recognition: A Revisit
por: Vu, Thi, et al.
Publicado: (2026)
por: Vu, Thi, et al.
Publicado: (2026)
A Deep Learning Automatic Speech Recognition Model for Shona Language
por: Sirora, Leslie Wellington, et al.
Publicado: (2025)
por: Sirora, Leslie Wellington, et al.
Publicado: (2025)
Huntington Disease Automatic Speech Recognition with Biomarker Supervision
por: Wang, Charles L., et al.
Publicado: (2026)
por: Wang, Charles L., et al.
Publicado: (2026)
Augmenting Automatic Speech Recognition Models with Disfluency Detection
por: Amann, Robin, et al.
Publicado: (2024)
por: Amann, Robin, et al.
Publicado: (2024)
Ejemplares similares
-
Orchestration-Free Customer Service Automation: A Privacy-Preserving and Flowchart-Guided Framework
por: Hong, Mengze, et al.
Publicado: (2026) -
Contextualized Token Discrimination for Speech Search Query Correction
por: Lu, Junyu, et al.
Publicado: (2025) -
Semantic-Augmented Latent Topic Modeling with LLM-in-the-Loop
por: Hong, Mengze, et al.
Publicado: (2025) -
Augmenting Compliance-Guaranteed Customer Service Chatbots: Context-Aware Knowledge Expansion with Large Language Models
por: Hong, Mengze, et al.
Publicado: (2024) -
Dialogue Language Model with Large-Scale Persona Data Engineering
por: Hong, Mengze, et al.
Publicado: (2024)