Enhancing Multilingual Capabilities of Large Language Models through Self-Distillation from Resource-Rich Languages
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Yuanchi, Wang, Yile, Liu, Zijun, Wang, Shuo, Wang, Xiaolong, Li, Peng, Sun, Maosong, Liu, Yang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Reasoning in Conversation: Solving Subjective Tasks through Dialogue Simulation for Large Language Models
di: Wang, Xiaolong, et al.
Pubblicazione: (2024)
di: Wang, Xiaolong, et al.
Pubblicazione: (2024)
Perspective Transition of Large Language Models for Solving Subjective Tasks
di: Wang, Xiaolong, et al.
Pubblicazione: (2025)
di: Wang, Xiaolong, et al.
Pubblicazione: (2025)
OMGEval: An Open Multilingual Generative Evaluation Benchmark for Large Language Models
di: Liu, Yang, et al.
Pubblicazione: (2024)
di: Liu, Yang, et al.
Pubblicazione: (2024)
MUCAR: Benchmarking Multilingual Cross-Modal Ambiguity Resolution for Multimodal Large Language Models
di: Wang, Xiaolong, et al.
Pubblicazione: (2025)
di: Wang, Xiaolong, et al.
Pubblicazione: (2025)
Ranked Voting based Self-Consistency of Large Language Models
di: Wang, Weiqin, et al.
Pubblicazione: (2025)
di: Wang, Weiqin, et al.
Pubblicazione: (2025)
Speak It Out: Solving Symbol-Related Problems with Symbol-to-Language Conversion for Language Models
di: Wang, Yile, et al.
Pubblicazione: (2024)
di: Wang, Yile, et al.
Pubblicazione: (2024)
Exploring Large Language Models for Communication Games: An Empirical Study on Werewolf
di: Xu, Yuzhuang, et al.
Pubblicazione: (2023)
di: Xu, Yuzhuang, et al.
Pubblicazione: (2023)
DEEM: Dynamic Experienced Expert Modeling for Stance Detection
di: Wang, Xiaolong, et al.
Pubblicazione: (2024)
di: Wang, Xiaolong, et al.
Pubblicazione: (2024)
WorkflowLLM: Enhancing Workflow Orchestration Capability of Large Language Models
di: Fan, Shengda, et al.
Pubblicazione: (2024)
di: Fan, Shengda, et al.
Pubblicazione: (2024)
TritonBench: Benchmarking Large Language Model Capabilities for Generating Triton Operators
di: Li, Jianling, et al.
Pubblicazione: (2025)
di: Li, Jianling, et al.
Pubblicazione: (2025)
Language-Specific Neurons: The Key to Multilingual Capabilities in Large Language Models
di: Tang, Tianyi, et al.
Pubblicazione: (2024)
di: Tang, Tianyi, et al.
Pubblicazione: (2024)
LoRA-Flow: Dynamic LoRA Fusion for Large Language Models in Generative Tasks
di: Wang, Hanqing, et al.
Pubblicazione: (2024)
di: Wang, Hanqing, et al.
Pubblicazione: (2024)
Self-Evolutionary Large Language Models through Uncertainty-Enhanced Preference Optimization
di: Wang, Jianing, et al.
Pubblicazione: (2024)
di: Wang, Jianing, et al.
Pubblicazione: (2024)
DeCoVec: Building Decoding Space based Task Vector for Large Language Models via In-Context Learning
di: Li, Feiyang, et al.
Pubblicazione: (2026)
di: Li, Feiyang, et al.
Pubblicazione: (2026)
A Survey on Large Language Models with Multilingualism: Recent Advances and New Frontiers
di: Huang, Kaiyu, et al.
Pubblicazione: (2024)
di: Huang, Kaiyu, et al.
Pubblicazione: (2024)
MuBench: Assessment of Multilingual Capabilities of Large Language Models Across 61 Languages
di: Han, Wenhan, et al.
Pubblicazione: (2025)
di: Han, Wenhan, et al.
Pubblicazione: (2025)
Marco-Bench-MIF: On Multilingual Instruction-Following Capability of Large Language Models
di: Zeng, Bo, et al.
Pubblicazione: (2025)
di: Zeng, Bo, et al.
Pubblicazione: (2025)
DCAD-2000: A Multilingual Dataset across 2000+ Languages with Data Cleaning as Anomaly Detection
di: Shen, Yingli, et al.
Pubblicazione: (2025)
di: Shen, Yingli, et al.
Pubblicazione: (2025)
Mixture-of-Agents Enhances Large Language Model Capabilities
di: Wang, Junlin, et al.
Pubblicazione: (2024)
di: Wang, Junlin, et al.
Pubblicazione: (2024)
Distilling Mathematical Reasoning Capabilities into Small Language Models
di: Zhu, Xunyu, et al.
Pubblicazione: (2024)
di: Zhu, Xunyu, et al.
Pubblicazione: (2024)
Enhancing Long-Chain Reasoning Distillation through Error-Aware Self-Reflection
di: Wu, Zhuoyang, et al.
Pubblicazione: (2025)
di: Wu, Zhuoyang, et al.
Pubblicazione: (2025)
Mind's Mirror: Distilling Self-Evaluation Capability and Comprehensive Thinking from Large Language Models
di: Liu, Weize, et al.
Pubblicazione: (2023)
di: Liu, Weize, et al.
Pubblicazione: (2023)
StableToolBench: Towards Stable Large-Scale Benchmarking on Tool Learning of Large Language Models
di: Guo, Zhicheng, et al.
Pubblicazione: (2024)
di: Guo, Zhicheng, et al.
Pubblicazione: (2024)
UltraLink: An Open-Source Knowledge-Enhanced Multilingual Supervised Fine-tuning Dataset
di: Wang, Haoyu, et al.
Pubblicazione: (2024)
di: Wang, Haoyu, et al.
Pubblicazione: (2024)
Assessment of Generative Named Entity Recognition in the Era of Large Language Models
di: Zhan, Qi, et al.
Pubblicazione: (2026)
di: Zhan, Qi, et al.
Pubblicazione: (2026)
CODIS: Benchmarking Context-Dependent Visual Comprehension for Multimodal Large Language Models
di: Luo, Fuwen, et al.
Pubblicazione: (2024)
di: Luo, Fuwen, et al.
Pubblicazione: (2024)
Resource Consumption Threats in Large Language Models
di: Zhang, Yuanhe, et al.
Pubblicazione: (2026)
di: Zhang, Yuanhe, et al.
Pubblicazione: (2026)
Enhancing Knowledge Distillation of Large Language Models through Efficient Multi-Modal Distribution Alignment
di: Peng, Tianyu, et al.
Pubblicazione: (2024)
di: Peng, Tianyu, et al.
Pubblicazione: (2024)
SemPA: Improving Sentence Embeddings of Large Language Models through Semantic Preference Alignment
di: Chen, Ziyang, et al.
Pubblicazione: (2026)
di: Chen, Ziyang, et al.
Pubblicazione: (2026)
DebugBench: Evaluating Debugging Capability of Large Language Models
di: Tian, Runchu, et al.
Pubblicazione: (2024)
di: Tian, Runchu, et al.
Pubblicazione: (2024)
IFEval-Audio: Benchmarking Instruction-Following Capability in Audio-based Large Language Models
di: Gao, Yiming, et al.
Pubblicazione: (2025)
di: Gao, Yiming, et al.
Pubblicazione: (2025)
ShifCon: Enhancing Non-Dominant Language Capabilities with a Shift-based Multilingual Contrastive Framework
di: Zhang, Hengyuan, et al.
Pubblicazione: (2024)
di: Zhang, Hengyuan, et al.
Pubblicazione: (2024)
Large Multilingual Models Pivot Zero-Shot Multimodal Learning across Languages
di: Hu, Jinyi, et al.
Pubblicazione: (2023)
di: Hu, Jinyi, et al.
Pubblicazione: (2023)
Delta-CoMe: Training-Free Delta-Compression with Mixed-Precision for Large Language Models
di: Ping, Bowen, et al.
Pubblicazione: (2024)
di: Ping, Bowen, et al.
Pubblicazione: (2024)
Judge as A Judge: Improving the Evaluation of Retrieval-Augmented Generation through the Judge-Consistency of Large Language Models
di: Liu, Shuliang, et al.
Pubblicazione: (2025)
di: Liu, Shuliang, et al.
Pubblicazione: (2025)
Enhancing the Capability and Robustness of Large Language Models through Reinforcement Learning-Driven Query Refinement
di: Wang, Xiaohua, et al.
Pubblicazione: (2024)
di: Wang, Xiaohua, et al.
Pubblicazione: (2024)
Model Composition for Multimodal Large Language Models
di: Chen, Chi, et al.
Pubblicazione: (2024)
di: Chen, Chi, et al.
Pubblicazione: (2024)
DySem: Uncovering Dynamic Semantic Components of Large Language Models for Calculating Semantic Textual Similarity
di: Zheng, Kaijie, et al.
Pubblicazione: (2026)
di: Zheng, Kaijie, et al.
Pubblicazione: (2026)
Pre-training Distillation for Large Language Models: A Design Space Exploration
di: Peng, Hao, et al.
Pubblicazione: (2024)
di: Peng, Hao, et al.
Pubblicazione: (2024)
Crosslingual Capabilities and Knowledge Barriers in Multilingual Large Language Models
di: Chua, Lynn, et al.
Pubblicazione: (2024)
di: Chua, Lynn, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Reasoning in Conversation: Solving Subjective Tasks through Dialogue Simulation for Large Language Models
di: Wang, Xiaolong, et al.
Pubblicazione: (2024) -
Perspective Transition of Large Language Models for Solving Subjective Tasks
di: Wang, Xiaolong, et al.
Pubblicazione: (2025) -
OMGEval: An Open Multilingual Generative Evaluation Benchmark for Large Language Models
di: Liu, Yang, et al.
Pubblicazione: (2024) -
MUCAR: Benchmarking Multilingual Cross-Modal Ambiguity Resolution for Multimodal Large Language Models
di: Wang, Xiaolong, et al.
Pubblicazione: (2025) -
Ranked Voting based Self-Consistency of Large Language Models
di: Wang, Weiqin, et al.
Pubblicazione: (2025)