Multilingual Contrastive Decoding via Language-Agnostic Layers Skipping
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhu, Wenhao, Liu, Sizhe, Huang, Shujian, She, Shuaijie, Wendler, Chris, Chen, Jiajun |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Question Translation Training for Better Multilingual Reasoning
par: Zhu, Wenhao, et autres
Publié: (2024)
par: Zhu, Wenhao, et autres
Publié: (2024)
MAPO: Advancing Multilingual Reasoning through Multilingual Alignment-as-Preference Optimization
par: She, Shuaijie, et autres
Publié: (2024)
par: She, Shuaijie, et autres
Publié: (2024)
Exploring the Factual Consistency in Dialogue Comprehension of Large Language Models
par: She, Shuaijie, et autres
Publié: (2023)
par: She, Shuaijie, et autres
Publié: (2023)
How Does Alignment Enhance LLMs' Multilingual Capabilities? A Language Neurons Perspective
par: Zhang, Shimao, et autres
Publié: (2025)
par: Zhang, Shimao, et autres
Publié: (2025)
R-PRM: Reasoning-Driven Process Reward Modeling
par: She, Shuaijie, et autres
Publié: (2025)
par: She, Shuaijie, et autres
Publié: (2025)
A Data-Efficient Path to Multilingual LLMs: Language Expansion via Post-training PARAM$Δ$ Integration into Upcycled MoE
par: Zhou, Hao, et autres
Publié: (2026)
par: Zhou, Hao, et autres
Publié: (2026)
The Power of Question Translation Training in Multilingual Reasoning: Broadened Scope and Deepened Insights
par: Zhu, Wenhao, et autres
Publié: (2024)
par: Zhu, Wenhao, et autres
Publié: (2024)
Multilingual Machine Translation with Large Language Models: Empirical Results and Analysis
par: Zhu, Wenhao, et autres
Publié: (2023)
par: Zhu, Wenhao, et autres
Publié: (2023)
Eliciting the Translation Ability of Large Language Models via Multilingual Finetuning with Translation Instructions
par: Li, Jiahuan, et autres
Publié: (2023)
par: Li, Jiahuan, et autres
Publié: (2023)
Getting More from Less: Large Language Models are Good Spontaneous Multilingual Learners
par: Zhang, Shimao, et autres
Publié: (2024)
par: Zhang, Shimao, et autres
Publié: (2024)
Multi-Candidate Speculative Decoding
par: Yang, Sen, et autres
Publié: (2024)
par: Yang, Sen, et autres
Publié: (2024)
TAPO: Translation Augmented Policy Optimization for Multilingual Mathematical Reasoning
par: Huang, Xu, et autres
Publié: (2026)
par: Huang, Xu, et autres
Publié: (2026)
BenchMAX: A Comprehensive Multilingual Evaluation Suite for Large Language Models
par: Huang, Xu, et autres
Publié: (2025)
par: Huang, Xu, et autres
Publié: (2025)
Could Thinking Multilingually Empower LLM Reasoning?
par: Gao, Changjiang, et autres
Publié: (2025)
par: Gao, Changjiang, et autres
Publié: (2025)
DuPO: Enabling Reliable LLM Self-Verification via Dual Preference Optimization
par: She, Shuaijie, et autres
Publié: (2025)
par: She, Shuaijie, et autres
Publié: (2025)
Do Llamas Work in English? On the Latent Language of Multilingual Transformers
par: Wendler, Chris, et autres
Publié: (2024)
par: Wendler, Chris, et autres
Publié: (2024)
Extend Adversarial Policy Against Neural Machine Translation via Unknown Token
par: Zou, Wei, et autres
Publié: (2025)
par: Zou, Wei, et autres
Publié: (2025)
Trans-Zero: Self-Play Incentivizes Large Language Models for Multilingual Translation Without Parallel Data
par: Zou, Wei, et autres
Publié: (2025)
par: Zou, Wei, et autres
Publié: (2025)
PreAlign: Boosting Cross-Lingual Transfer by Early Establishment of Multilingual Alignment
par: Li, Jiahuan, et autres
Publié: (2024)
par: Li, Jiahuan, et autres
Publié: (2024)
CLaSp: In-Context Layer Skip for Self-Speculative Decoding
par: Chen, Longze, et autres
Publié: (2025)
par: Chen, Longze, et autres
Publié: (2025)
Multilingual Pretraining and Instruction Tuning Improve Cross-Lingual Knowledge Alignment, But Only Shallowly
par: Gao, Changjiang, et autres
Publié: (2024)
par: Gao, Changjiang, et autres
Publié: (2024)
MoE-LPR: Multilingual Extension of Large Language Models through Mixture-of-Experts with Language Priors Routing
par: Zhou, Hao, et autres
Publié: (2024)
par: Zhou, Hao, et autres
Publié: (2024)
Formality is Favored: Unraveling the Learning Preferences of Large Language Models on Data with Conflicting Knowledge
par: Li, Jiahuan, et autres
Publié: (2024)
par: Li, Jiahuan, et autres
Publié: (2024)
MT-PATCHER: Selective and Extendable Knowledge Distillation from Large Language Models for Machine Translation
par: Li, Jiahuan, et autres
Publié: (2024)
par: Li, Jiahuan, et autres
Publié: (2024)
Separating Tongue from Thought: Activation Patching Reveals Language-Agnostic Concept Representations in Transformers
par: Dumas, Clément, et autres
Publié: (2024)
par: Dumas, Clément, et autres
Publié: (2024)
Sketch-Guided Constrained Decoding for Boosting Blackbox Large Language Models without Logit Access
par: Geng, Saibo, et autres
Publié: (2024)
par: Geng, Saibo, et autres
Publié: (2024)
Measuring Meaning Composition in the Human Brain with Composition Scores from Large Language Models
par: Gao, Changjiang, et autres
Publié: (2024)
par: Gao, Changjiang, et autres
Publié: (2024)
ConfLayers: Adaptive Confidence-based Layer Skipping for Self-Speculative Decoding
par: Amer, Walaa, et autres
Publié: (2026)
par: Amer, Walaa, et autres
Publié: (2026)
Large Language Models are Limited in Out-of-Context Knowledge Reasoning
par: Hu, Peng, et autres
Publié: (2024)
par: Hu, Peng, et autres
Publié: (2024)
Generalizing From Short to Long: Effective Data Synthesis for Long-Context Instruction Tuning
par: Zhu, Wenhao, et autres
Publié: (2025)
par: Zhu, Wenhao, et autres
Publié: (2025)
Improved Paraphrase Generation via Controllable Latent Diffusion
par: Zou, Wei, et autres
Publié: (2024)
par: Zou, Wei, et autres
Publié: (2024)
Why Not Transform Chat Large Language Models to Non-English?
par: Geng, Xiang, et autres
Publié: (2024)
par: Geng, Xiang, et autres
Publié: (2024)
SLAM: Towards Efficient Multilingual Reasoning via Selective Language Alignment
par: Fan, Yuchun, et autres
Publié: (2025)
par: Fan, Yuchun, et autres
Publié: (2025)
Large Language Models Are Cross-Lingual Knowledge-Free Reasoners
par: Hu, Peng, et autres
Publié: (2024)
par: Hu, Peng, et autres
Publié: (2024)
LayerSkip: Enabling Early Exit Inference and Self-Speculative Decoding
par: Elhoushi, Mostafa, et autres
Publié: (2024)
par: Elhoushi, Mostafa, et autres
Publié: (2024)
Multilingual Knowledge Editing with Language-Agnostic Factual Neurons
par: Zhang, Xue, et autres
Publié: (2024)
par: Zhang, Xue, et autres
Publié: (2024)
ExpLang: Improved Exploration and Exploitation in LLM Reasoning with On-Policy Thinking Language Selection
par: Gao, Changjiang, et autres
Publié: (2026)
par: Gao, Changjiang, et autres
Publié: (2026)
FFN-SkipLLM: A Hidden Gem for Autoregressive Decoding with Adaptive Feed Forward Skipping
par: Jaiswal, Ajay, et autres
Publié: (2024)
par: Jaiswal, Ajay, et autres
Publié: (2024)
Lost in the Source Language: How Large Language Models Evaluate the Quality of Machine Translation
par: Huang, Xu, et autres
Publié: (2024)
par: Huang, Xu, et autres
Publié: (2024)
Accelerating Inference in Large Language Models with a Unified Layer Skipping Strategy
par: Liu, Yijin, et autres
Publié: (2024)
par: Liu, Yijin, et autres
Publié: (2024)
Documents similaires
-
Question Translation Training for Better Multilingual Reasoning
par: Zhu, Wenhao, et autres
Publié: (2024) -
MAPO: Advancing Multilingual Reasoning through Multilingual Alignment-as-Preference Optimization
par: She, Shuaijie, et autres
Publié: (2024) -
Exploring the Factual Consistency in Dialogue Comprehension of Large Language Models
par: She, Shuaijie, et autres
Publié: (2023) -
How Does Alignment Enhance LLMs' Multilingual Capabilities? A Language Neurons Perspective
par: Zhang, Shimao, et autres
Publié: (2025) -
R-PRM: Reasoning-Driven Process Reward Modeling
par: She, Shuaijie, et autres
Publié: (2025)