Multilingual Large Language Models: A Systematic Survey
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhu, Shaolin, Supryadi, Xu, Shaoyang, Sun, Haoran, Pan, Leiyu, Cui, Menglong, Du, Jiangcun, Jin, Renren, Branco, António, Xiong, Deyi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
FuxiTranyu: A Multilingual Large Language Model Trained with Balanced Data
di: Sun, Haoran, et al.
Pubblicazione: (2024)
di: Sun, Haoran, et al.
Pubblicazione: (2024)
Efficiently Exploring Large Language Models for Document-Level Machine Translation with In-context Learning
di: Cui, Menglong, et al.
Pubblicazione: (2024)
di: Cui, Menglong, et al.
Pubblicazione: (2024)
An Empirical Study on the Robustness of Massively Multilingual Neural Machine Translation
di: Supryadi, et al.
Pubblicazione: (2024)
di: Supryadi, et al.
Pubblicazione: (2024)
LANDeRMT: Detecting and Routing Language-Aware Neurons for Selectively Finetuning LLMs to Machine Translation
di: Zhu, Shaolin, et al.
Pubblicazione: (2024)
di: Zhu, Shaolin, et al.
Pubblicazione: (2024)
A Comprehensive Evaluation of Quantization Strategies for Large Language Models
di: Jin, Renren, et al.
Pubblicazione: (2024)
di: Jin, Renren, et al.
Pubblicazione: (2024)
Data Mixing for Large Language Models Pretraining: A Survey and Outlook
di: Chen, Zhuo, et al.
Pubblicazione: (2026)
di: Chen, Zhuo, et al.
Pubblicazione: (2026)
ConTrans: Weak-to-Strong Alignment Engineering via Concept Transplantation
di: Dong, Weilong, et al.
Pubblicazione: (2024)
di: Dong, Weilong, et al.
Pubblicazione: (2024)
FuxiMT: Sparsifying Large Language Models for Chinese-Centric Multilingual Machine Translation
di: Zhu, Shaolin, et al.
Pubblicazione: (2025)
di: Zhu, Shaolin, et al.
Pubblicazione: (2025)
DCIS: Efficient Length Extrapolation of LLMs via Divide-and-Conquer Scaling Factor Search
di: Yang, Lei, et al.
Pubblicazione: (2024)
di: Yang, Lei, et al.
Pubblicazione: (2024)
Mix-MoE: Improving Multilingual Machine Translation of Large Language Models through Mixed MoEs
di: Li, Bo, et al.
Pubblicazione: (2026)
di: Li, Bo, et al.
Pubblicazione: (2026)
Do Large Language Models Mirror Cognitive Language Processing?
di: Ren, Yuqi, et al.
Pubblicazione: (2024)
di: Ren, Yuqi, et al.
Pubblicazione: (2024)
LHMKE: A Large-scale Holistic Multi-subject Knowledge Evaluation Benchmark for Chinese Large Language Models
di: Liu, Chuang, et al.
Pubblicazione: (2024)
di: Liu, Chuang, et al.
Pubblicazione: (2024)
Exploring Multilingual Concepts of Human Value in Large Language Models: Is Value Alignment Consistent, Transferable and Controllable across Languages?
di: Xu, Shaoyang, et al.
Pubblicazione: (2024)
di: Xu, Shaoyang, et al.
Pubblicazione: (2024)
SOUP: Token-level Single-sample Mix-policy Reinforcement Learning for Large Language Models
di: Yang, Lei, et al.
Pubblicazione: (2026)
di: Yang, Lei, et al.
Pubblicazione: (2026)
Self-Pluralising Culture Alignment for Large Language Models
di: Xu, Shaoyang, et al.
Pubblicazione: (2024)
di: Xu, Shaoyang, et al.
Pubblicazione: (2024)
FineMath: A Fine-Grained Mathematical Evaluation Benchmark for Chinese Large Language Models
di: Liu, Yan, et al.
Pubblicazione: (2024)
di: Liu, Yan, et al.
Pubblicazione: (2024)
ProBench: Benchmarking Large Language Models in Competitive Programming
di: Yang, Lei, et al.
Pubblicazione: (2025)
di: Yang, Lei, et al.
Pubblicazione: (2025)
Joint Training And Decoding for Multilingual End-to-End Simultaneous Speech Translation
di: Huang, Wuwei, et al.
Pubblicazione: (2025)
di: Huang, Wuwei, et al.
Pubblicazione: (2025)
Why Does Reinforcement Learning Generalize? A Feature-Level Mechanistic Study of Post-Training in Large Language Models
di: Shi, Dan, et al.
Pubblicazione: (2026)
di: Shi, Dan, et al.
Pubblicazione: (2026)
From Curated Data to Scalable Models: Continual Pre-training of Dense and MoE Large Language Models for Tibetan
di: Yang, Lei, et al.
Pubblicazione: (2025)
di: Yang, Lei, et al.
Pubblicazione: (2025)
Large Language Model Safety: A Holistic Survey
di: Shi, Dan, et al.
Pubblicazione: (2024)
di: Shi, Dan, et al.
Pubblicazione: (2024)
Multilingual Machine Translation with Open Large Language Models at Practical Scale: An Empirical Study
di: Cui, Menglong, et al.
Pubblicazione: (2025)
di: Cui, Menglong, et al.
Pubblicazione: (2025)
IRCAN: Mitigating Knowledge Conflicts in LLM Generation via Identifying and Reweighting Context-Aware Neurons
di: Shi, Dan, et al.
Pubblicazione: (2024)
di: Shi, Dan, et al.
Pubblicazione: (2024)
Language of Thought Shapes Output Diversity in Large Language Models
di: Xu, Shaoyang, et al.
Pubblicazione: (2026)
di: Xu, Shaoyang, et al.
Pubblicazione: (2026)
CRiskEval: A Chinese Multi-Level Risk Evaluation Benchmark Dataset for Large Language Models
di: Shi, Ling, et al.
Pubblicazione: (2024)
di: Shi, Ling, et al.
Pubblicazione: (2024)
RoleEval: A Bilingual Role Evaluation Benchmark for Large Language Models
di: Shen, Tianhao, et al.
Pubblicazione: (2023)
di: Shen, Tianhao, et al.
Pubblicazione: (2023)
Revisiting Entropy in Reinforcement Learning for Large Reasoning Models
di: Jin, Renren, et al.
Pubblicazione: (2025)
di: Jin, Renren, et al.
Pubblicazione: (2025)
LFED: A Literary Fiction Evaluation Dataset for Large Language Models
di: Yu, Linhao, et al.
Pubblicazione: (2024)
di: Yu, Linhao, et al.
Pubblicazione: (2024)
TaP: A Taxonomy-Guided Framework for Automated and Scalable Preference Data Generation
di: Jin, Renren, et al.
Pubblicazione: (2025)
di: Jin, Renren, et al.
Pubblicazione: (2025)
Enhancing Aspect-based Sentiment Analysis in Tourism Using Large Language Models and Positional Information
di: Xu, Chun, et al.
Pubblicazione: (2024)
di: Xu, Chun, et al.
Pubblicazione: (2024)
Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning
di: Zhou, Hang, et al.
Pubblicazione: (2024)
di: Zhou, Hang, et al.
Pubblicazione: (2024)
Evaluating and Improving Graph to Text Generation with Large Language Models
di: He, Jie, et al.
Pubblicazione: (2025)
di: He, Jie, et al.
Pubblicazione: (2025)
Evaluating Discourse Cohesion in Pre-trained Language Models
di: He, Jie, et al.
Pubblicazione: (2025)
di: He, Jie, et al.
Pubblicazione: (2025)
Multilingual Collaborative Defense for Large Language Models
di: Li, Hongliang, et al.
Pubblicazione: (2025)
di: Li, Hongliang, et al.
Pubblicazione: (2025)
OpenEval: Benchmarking Chinese LLMs across Capability, Alignment and Safety
di: Liu, Chuang, et al.
Pubblicazione: (2024)
di: Liu, Chuang, et al.
Pubblicazione: (2024)
A Survey on Multilingual Large Language Models: Corpora, Alignment, and Bias
di: Xu, Yuemei, et al.
Pubblicazione: (2024)
di: Xu, Yuemei, et al.
Pubblicazione: (2024)
Finedeep: Mitigating Sparse Activation in Dense LLMs via Multi-Layer Fine-Grained Experts
di: Pan, Leiyu, et al.
Pubblicazione: (2025)
di: Pan, Leiyu, et al.
Pubblicazione: (2025)
Multilingual Jailbreak Challenges in Large Language Models
di: Deng, Yue, et al.
Pubblicazione: (2023)
di: Deng, Yue, et al.
Pubblicazione: (2023)
Large Language Models for Multilingual Code Intelligence: A Survey
di: Jiang, Chao, et al.
Pubblicazione: (2026)
di: Jiang, Chao, et al.
Pubblicazione: (2026)
Towards Understanding Multi-Task Learning (Generalization) of LLMs via Detecting and Exploring Task-Specific Neurons
di: Leng, Yongqi, et al.
Pubblicazione: (2024)
di: Leng, Yongqi, et al.
Pubblicazione: (2024)
Documenti analoghi
-
FuxiTranyu: A Multilingual Large Language Model Trained with Balanced Data
di: Sun, Haoran, et al.
Pubblicazione: (2024) -
Efficiently Exploring Large Language Models for Document-Level Machine Translation with In-context Learning
di: Cui, Menglong, et al.
Pubblicazione: (2024) -
An Empirical Study on the Robustness of Massively Multilingual Neural Machine Translation
di: Supryadi, et al.
Pubblicazione: (2024) -
LANDeRMT: Detecting and Routing Language-Aware Neurons for Selectively Finetuning LLMs to Machine Translation
di: Zhu, Shaolin, et al.
Pubblicazione: (2024) -
A Comprehensive Evaluation of Quantization Strategies for Large Language Models
di: Jin, Renren, et al.
Pubblicazione: (2024)