LLaMAX2: Your Translation-Enhanced Model also Performs Well in Reasoning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Gao, Changjiang, Huang, Zixian, Gong, Jingyang, Huang, Shujian, Li, Lei, Yuan, Fei |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
LLaMAX: Scaling Linguistic Horizons of LLM by Enhancing Translation Capabilities Beyond 100 Languages
par: Lu, Yinquan, et autres
Publié: (2024)
par: Lu, Yinquan, et autres
Publié: (2024)
Could Thinking Multilingually Empower LLM Reasoning?
par: Gao, Changjiang, et autres
Publié: (2025)
par: Gao, Changjiang, et autres
Publié: (2025)
ExpLang: Improved Exploration and Exploitation in LLM Reasoning with On-Policy Thinking Language Selection
par: Gao, Changjiang, et autres
Publié: (2026)
par: Gao, Changjiang, et autres
Publié: (2026)
TAPO: Translation Augmented Policy Optimization for Multilingual Mathematical Reasoning
par: Huang, Xu, et autres
Publié: (2026)
par: Huang, Xu, et autres
Publié: (2026)
BenchMAX: A Comprehensive Multilingual Evaluation Suite for Large Language Models
par: Huang, Xu, et autres
Publié: (2025)
par: Huang, Xu, et autres
Publié: (2025)
Large Language Models are Limited in Out-of-Context Knowledge Reasoning
par: Hu, Peng, et autres
Publié: (2024)
par: Hu, Peng, et autres
Publié: (2024)
MindMerger: Efficient Boosting LLM Reasoning in non-English Languages
par: Huang, Zixian, et autres
Publié: (2024)
par: Huang, Zixian, et autres
Publié: (2024)
Measuring Meaning Composition in the Human Brain with Composition Scores from Large Language Models
par: Gao, Changjiang, et autres
Publié: (2024)
par: Gao, Changjiang, et autres
Publié: (2024)
Question Translation Training for Better Multilingual Reasoning
par: Zhu, Wenhao, et autres
Publié: (2024)
par: Zhu, Wenhao, et autres
Publié: (2024)
Large Language Models Are Cross-Lingual Knowledge-Free Reasoners
par: Hu, Peng, et autres
Publié: (2024)
par: Hu, Peng, et autres
Publié: (2024)
The Power of Question Translation Training in Multilingual Reasoning: Broadened Scope and Deepened Insights
par: Zhu, Wenhao, et autres
Publié: (2024)
par: Zhu, Wenhao, et autres
Publié: (2024)
Multilingual Pretraining and Instruction Tuning Improve Cross-Lingual Knowledge Alignment, But Only Shallowly
par: Gao, Changjiang, et autres
Publié: (2024)
par: Gao, Changjiang, et autres
Publié: (2024)
Eliciting the Translation Ability of Large Language Models via Multilingual Finetuning with Translation Instructions
par: Li, Jiahuan, et autres
Publié: (2023)
par: Li, Jiahuan, et autres
Publié: (2023)
Understanding New-Knowledge-Induced Factual Hallucinations in LLMs: Analysis and Interpretation
par: Dang, Renfei, et autres
Publié: (2025)
par: Dang, Renfei, et autres
Publié: (2025)
MT-PATCHER: Selective and Extendable Knowledge Distillation from Large Language Models for Machine Translation
par: Li, Jiahuan, et autres
Publié: (2024)
par: Li, Jiahuan, et autres
Publié: (2024)
Self-Improving Multilingual Long Reasoning via Translation-Reasoning Integrated Training
par: Liu, Junxiao, et autres
Publié: (2026)
par: Liu, Junxiao, et autres
Publié: (2026)
How Vocabulary Sharing Facilitates Multilingualism in LLaMA?
par: Yuan, Fei, et autres
Publié: (2023)
par: Yuan, Fei, et autres
Publié: (2023)
Extroversion or Introversion? Controlling The Personality of Your Large Language Models
par: Chen, Yanquan, et autres
Publié: (2024)
par: Chen, Yanquan, et autres
Publié: (2024)
Extend Adversarial Policy Against Neural Machine Translation via Unknown Token
par: Zou, Wei, et autres
Publié: (2025)
par: Zou, Wei, et autres
Publié: (2025)
Reasoning Models Reason Well, Until They Don't
par: Rameshkumar, Revanth, et autres
Publié: (2025)
par: Rameshkumar, Revanth, et autres
Publié: (2025)
Getting More from Less: Large Language Models are Good Spontaneous Multilingual Learners
par: Zhang, Shimao, et autres
Publié: (2024)
par: Zhang, Shimao, et autres
Publié: (2024)
GRRM: Group Relative Reward Modeling for Machine Translation
par: Yang, Sen, et autres
Publié: (2026)
par: Yang, Sen, et autres
Publié: (2026)
Understanding LLMs' Cross-Lingual Context Retrieval: How Good It Is And Where It Comes From
par: Gao, Changjiang, et autres
Publié: (2025)
par: Gao, Changjiang, et autres
Publié: (2025)
How Well Do Large Reasoning Models Translate? A Comprehensive Evaluation for Multi-Domain Machine Translation
par: Ye, Yongshi, et autres
Publié: (2025)
par: Ye, Yongshi, et autres
Publié: (2025)
Multilingual Machine Translation with Large Language Models: Empirical Results and Analysis
par: Zhu, Wenhao, et autres
Publié: (2023)
par: Zhu, Wenhao, et autres
Publié: (2023)
Self-Evolution Knowledge Distillation for LLM-based Machine Translation
par: Song, Yuncheng, et autres
Publié: (2024)
par: Song, Yuncheng, et autres
Publié: (2024)
R-PRM: Reasoning-Driven Process Reward Modeling
par: She, Shuaijie, et autres
Publié: (2025)
par: She, Shuaijie, et autres
Publié: (2025)
PEGRL: Improving Machine Translation by Post-Editing Guided Reinforcement Learning
par: Shen, Yunzhi, et autres
Publié: (2026)
par: Shen, Yunzhi, et autres
Publié: (2026)
Lost in the Source Language: How Large Language Models Evaluate the Quality of Machine Translation
par: Huang, Xu, et autres
Publié: (2024)
par: Huang, Xu, et autres
Publié: (2024)
Alleviating Distribution Shift in Synthetic Data for Machine Translation Quality Estimation
par: Geng, Xiang, et autres
Publié: (2025)
par: Geng, Xiang, et autres
Publié: (2025)
EnAnchored-X2X: English-Anchored Optimization for Many-to-Many Translation
par: Yang, Sen, et autres
Publié: (2025)
par: Yang, Sen, et autres
Publié: (2025)
Unlocking Fine-Grained Translation Quality Estimation in LRMs through Synergistically Evolving Implicit and Explicit Reasoning
par: Dang, Renfei, et autres
Publié: (2026)
par: Dang, Renfei, et autres
Publié: (2026)
Trans-Zero: Self-Play Incentivizes Large Language Models for Multilingual Translation Without Parallel Data
par: Zou, Wei, et autres
Publié: (2025)
par: Zou, Wei, et autres
Publié: (2025)
EDT: Improving Large Language Models' Generation by Entropy-based Dynamic Temperature Sampling
par: Zhang, Shimao, et autres
Publié: (2024)
par: Zhang, Shimao, et autres
Publié: (2024)
Align to the Pivot: Dual Alignment with Self-Feedback for Multilingual Math Reasoning
par: Zhao, Chunxu, et autres
Publié: (2026)
par: Zhao, Chunxu, et autres
Publié: (2026)
Formality is Favored: Unraveling the Learning Preferences of Large Language Models on Data with Conflicting Knowledge
par: Li, Jiahuan, et autres
Publié: (2024)
par: Li, Jiahuan, et autres
Publié: (2024)
Is Your Model Really A Good Math Reasoner? Evaluating Mathematical Reasoning with Checklist
par: Zhou, Zihao, et autres
Publié: (2024)
par: Zhou, Zihao, et autres
Publié: (2024)
Are Large Reasoning Models Good Translation Evaluators? Analysis and Performance Boost
par: Zhan, Runzhe, et autres
Publié: (2025)
par: Zhan, Runzhe, et autres
Publié: (2025)
Shorten After You're Right: Lazy Length Penalties for Reasoning RL
par: Yuan, Danlong, et autres
Publié: (2025)
par: Yuan, Danlong, et autres
Publié: (2025)
LLaMA-Berry: Pairwise Optimization for O1-like Olympiad-Level Mathematical Reasoning
par: Zhang, Di, et autres
Publié: (2024)
par: Zhang, Di, et autres
Publié: (2024)
Documents similaires
-
LLaMAX: Scaling Linguistic Horizons of LLM by Enhancing Translation Capabilities Beyond 100 Languages
par: Lu, Yinquan, et autres
Publié: (2024) -
Could Thinking Multilingually Empower LLM Reasoning?
par: Gao, Changjiang, et autres
Publié: (2025) -
ExpLang: Improved Exploration and Exploitation in LLM Reasoning with On-Policy Thinking Language Selection
par: Gao, Changjiang, et autres
Publié: (2026) -
TAPO: Translation Augmented Policy Optimization for Multilingual Mathematical Reasoning
par: Huang, Xu, et autres
Publié: (2026) -
BenchMAX: A Comprehensive Multilingual Evaluation Suite for Large Language Models
par: Huang, Xu, et autres
Publié: (2025)