Think Natively: Unlocking Multilingual Reasoning with Consistency-Enhanced Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Xue, Liang, Yunlong, Meng, Fandong, Zhang, Songming, Huang, Kaiyu, Chen, Yufeng, Xu, Jinan, Zhou, Jie |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
CM-Align: Consistency-based Multilingual Alignment for Large Language Models
di: Zhang, Xue, et al.
Pubblicazione: (2025)
di: Zhang, Xue, et al.
Pubblicazione: (2025)
Multilingual Knowledge Editing with Language-Agnostic Factual Neurons
di: Zhang, Xue, et al.
Pubblicazione: (2024)
di: Zhang, Xue, et al.
Pubblicazione: (2024)
Less, but Better: Efficient Multilingual Expansion for LLMs via Layer-wise Mixture-of-Experts
di: Zhang, Xue, et al.
Pubblicazione: (2025)
di: Zhang, Xue, et al.
Pubblicazione: (2025)
A Dual-Space Framework for General Knowledge Distillation of Large Language Models
di: Zhang, Xue, et al.
Pubblicazione: (2025)
di: Zhang, Xue, et al.
Pubblicazione: (2025)
ExTrans: Multilingual Deep Reasoning Translation via Exemplar-Enhanced Reinforcement Learning
di: Wang, Jiaan, et al.
Pubblicazione: (2025)
di: Wang, Jiaan, et al.
Pubblicazione: (2025)
Language-Coupled Reinforcement Learning for Multilingual Retrieval-Augmented Generation
di: Qi, Rui, et al.
Pubblicazione: (2026)
di: Qi, Rui, et al.
Pubblicazione: (2026)
Enhancing Cross-Tokenizer Knowledge Distillation with Contextual Dynamical Mapping
di: Chen, Yijie, et al.
Pubblicazione: (2025)
di: Chen, Yijie, et al.
Pubblicazione: (2025)
SoT: Structured-of-Thought Prompting Guides Multilingual Reasoning in Large Language Models
di: Qi, Rui, et al.
Pubblicazione: (2025)
di: Qi, Rui, et al.
Pubblicazione: (2025)
Dual-Space Knowledge Distillation for Large Language Models
di: Zhang, Songming, et al.
Pubblicazione: (2024)
di: Zhang, Songming, et al.
Pubblicazione: (2024)
Towards Understanding and Improving Knowledge Distillation for Neural Machine Translation
di: Zhang, Songming, et al.
Pubblicazione: (2023)
di: Zhang, Songming, et al.
Pubblicazione: (2023)
Outdated Issue Aware Decoding for Reasoning Questions on Edited Knowledge
di: Sun, Zengkui, et al.
Pubblicazione: (2024)
di: Sun, Zengkui, et al.
Pubblicazione: (2024)
Beyond Binary Gender: Evaluating Gender-Inclusive Machine Translation with Ambiguous Attitude Words
di: Chen, Yijie, et al.
Pubblicazione: (2024)
di: Chen, Yijie, et al.
Pubblicazione: (2024)
Comments as Natural Logic Pivots: Improve Code Generation via Comment Perspective
di: Chen, Yijie, et al.
Pubblicazione: (2024)
di: Chen, Yijie, et al.
Pubblicazione: (2024)
Warmup-Distill: Bridge the Distribution Mismatch between Teacher and Student before Knowledge Distillation
di: Sun, Zengkui, et al.
Pubblicazione: (2025)
di: Sun, Zengkui, et al.
Pubblicazione: (2025)
THOR-MoE: Hierarchical Task-Guided and Context-Responsive Routing for Neural Machine Translation
di: Liang, Yunlong, et al.
Pubblicazione: (2025)
di: Liang, Yunlong, et al.
Pubblicazione: (2025)
AlignDistil: Token-Level Language Model Alignment as Adaptive Policy Distillation
di: Zhang, Songming, et al.
Pubblicazione: (2025)
di: Zhang, Songming, et al.
Pubblicazione: (2025)
KDFlow: A User-Friendly and Efficient Knowledge Distillation Framework for Large Language Models
di: Zhang, Songming, et al.
Pubblicazione: (2026)
di: Zhang, Songming, et al.
Pubblicazione: (2026)
DRT: Deep Reasoning Translation via Long Chain-of-Thought
di: Wang, Jiaan, et al.
Pubblicazione: (2024)
di: Wang, Jiaan, et al.
Pubblicazione: (2024)
LCS: A Language Converter Strategy for Zero-Shot Neural Machine Translation
di: Sun, Zengkui, et al.
Pubblicazione: (2024)
di: Sun, Zengkui, et al.
Pubblicazione: (2024)
DeepTrans: Deep Reasoning Translation via Reinforcement Learning
di: Wang, Jiaan, et al.
Pubblicazione: (2025)
di: Wang, Jiaan, et al.
Pubblicazione: (2025)
Think in Safety: Unveiling and Mitigating Safety Alignment Collapse in Multimodal Large Reasoning Model
di: Lou, Xinyue, et al.
Pubblicazione: (2025)
di: Lou, Xinyue, et al.
Pubblicazione: (2025)
Towards Faster k-Nearest-Neighbor Machine Translation
di: Shi, Xiangyu, et al.
Pubblicazione: (2023)
di: Shi, Xiangyu, et al.
Pubblicazione: (2023)
SlangDIT: Benchmarking LLMs in Interpretative Slang Translation
di: Liang, Yunlong, et al.
Pubblicazione: (2025)
di: Liang, Yunlong, et al.
Pubblicazione: (2025)
D2C: Unlocking the Potential of Continuous Autoregressive Image Generation with Discrete Tokens
di: Wang, Panpan, et al.
Pubblicazione: (2025)
di: Wang, Panpan, et al.
Pubblicazione: (2025)
CSCD-NS: a Chinese Spelling Check Dataset for Native Speakers
di: Hu, Yong, et al.
Pubblicazione: (2022)
di: Hu, Yong, et al.
Pubblicazione: (2022)
Figure It Out: Improve the Frontier of Reasoning with Executable Visual States
di: Chen, Meiqi, et al.
Pubblicazione: (2025)
di: Chen, Meiqi, et al.
Pubblicazione: (2025)
Multilingual Collaborative Defense for Large Language Models
di: Li, Hongliang, et al.
Pubblicazione: (2025)
di: Li, Hongliang, et al.
Pubblicazione: (2025)
CRAT: A Multi-Agent Framework for Causality-Enhanced Reflective and Retrieval-Augmented Translation with Large Language Models
di: Chen, Meiqi, et al.
Pubblicazione: (2024)
di: Chen, Meiqi, et al.
Pubblicazione: (2024)
LongDPO: Unlock Better Long-form Generation Abilities for LLMs via Critique-augmented Stepwise Information
di: Ping, Bowen, et al.
Pubblicazione: (2025)
di: Ping, Bowen, et al.
Pubblicazione: (2025)
Imagination Helps Visual Reasoning, But Not Yet in Latent Space
di: Li, You, et al.
Pubblicazione: (2026)
di: Li, You, et al.
Pubblicazione: (2026)
Could Thinking Multilingually Empower LLM Reasoning?
di: Gao, Changjiang, et al.
Pubblicazione: (2025)
di: Gao, Changjiang, et al.
Pubblicazione: (2025)
DoRA: Enhancing Parameter-Efficient Fine-Tuning with Dynamic Rank Distribution
di: Mao, Yulong, et al.
Pubblicazione: (2024)
di: Mao, Yulong, et al.
Pubblicazione: (2024)
Textualized Agent-Style Reasoning for Complex Tasks by Multiple Round LLM Generation
di: Liang, Chen, et al.
Pubblicazione: (2024)
di: Liang, Chen, et al.
Pubblicazione: (2024)
C-LLM: Learn to Check Chinese Spelling Errors Character by Character
di: Li, Kunting, et al.
Pubblicazione: (2024)
di: Li, Kunting, et al.
Pubblicazione: (2024)
Accelerating Inference in Large Language Models with a Unified Layer Skipping Strategy
di: Liu, Yijin, et al.
Pubblicazione: (2024)
di: Liu, Yijin, et al.
Pubblicazione: (2024)
Multi-Aspect Knowledge Distillation for Language Model with Low-rank Factorization
di: Liu, Zihe, et al.
Pubblicazione: (2026)
di: Liu, Zihe, et al.
Pubblicazione: (2026)
Retrieval-Augmented Machine Translation with Unstructured Knowledge
di: Wang, Jiaan, et al.
Pubblicazione: (2024)
di: Wang, Jiaan, et al.
Pubblicazione: (2024)
TEAL: Tokenize and Embed ALL for Multi-modal Large Language Models
di: Yang, Zhen, et al.
Pubblicazione: (2023)
di: Yang, Zhen, et al.
Pubblicazione: (2023)
An Empirical Study of Many-to-Many Summarization with Large Language Models
di: Wang, Jiaan, et al.
Pubblicazione: (2025)
di: Wang, Jiaan, et al.
Pubblicazione: (2025)
Tagging the Thought: Unlocking Personalization Reasoning via Reinforcement Learning
di: Jin, Song, et al.
Pubblicazione: (2025)
di: Jin, Song, et al.
Pubblicazione: (2025)
Documenti analoghi
-
CM-Align: Consistency-based Multilingual Alignment for Large Language Models
di: Zhang, Xue, et al.
Pubblicazione: (2025) -
Multilingual Knowledge Editing with Language-Agnostic Factual Neurons
di: Zhang, Xue, et al.
Pubblicazione: (2024) -
Less, but Better: Efficient Multilingual Expansion for LLMs via Layer-wise Mixture-of-Experts
di: Zhang, Xue, et al.
Pubblicazione: (2025) -
A Dual-Space Framework for General Knowledge Distillation of Large Language Models
di: Zhang, Xue, et al.
Pubblicazione: (2025) -
ExTrans: Multilingual Deep Reasoning Translation via Exemplar-Enhanced Reinforcement Learning
di: Wang, Jiaan, et al.
Pubblicazione: (2025)