Crosslingual On-Policy Self-Distillation for Multilingual Reasoning
Fuente:
arXiv
Salvato in:
| Autori principali: | Liu, Yihong, Zhao, Raoyuan, Hedderich, Michael A., Schütze, Hinrich |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Large Reasoning Models Are (Not Yet) Multilingual Latent Reasoners
di: Liu, Yihong, et al.
Pubblicazione: (2026)
di: Liu, Yihong, et al.
Pubblicazione: (2026)
A Comprehensive Evaluation of Multilingual Chain-of-Thought Reasoning: Performance, Consistency, and Faithfulness Across Languages
di: Zhao, Raoyuan, et al.
Pubblicazione: (2025)
di: Zhao, Raoyuan, et al.
Pubblicazione: (2025)
Evaluating Robustness of Large Language Models Against Multilingual Typographical Errors
di: Zhao, Raoyuan, et al.
Pubblicazione: (2025)
di: Zhao, Raoyuan, et al.
Pubblicazione: (2025)
ReverseMath: Answer Inversion for Scalable and Verifiable Mathematical Problem Generation
di: Zhao, Raoyuan, et al.
Pubblicazione: (2026)
di: Zhao, Raoyuan, et al.
Pubblicazione: (2026)
Beyond Input Understanding: Diagnosing Multilingual Mathematical Reasoning with Directed Acyclic Trace Graphs
di: Zhang, Jiaqiao, et al.
Pubblicazione: (2026)
di: Zhang, Jiaqiao, et al.
Pubblicazione: (2026)
On the Entity-Level Alignment in Crosslingual Consistency
di: Liu, Yihong, et al.
Pubblicazione: (2025)
di: Liu, Yihong, et al.
Pubblicazione: (2025)
Do We Know What LLMs Don't Know? A Study of Consistency in Knowledge Probing
di: Zhao, Raoyuan, et al.
Pubblicazione: (2025)
di: Zhao, Raoyuan, et al.
Pubblicazione: (2025)
MoSECroT: Model Stitching with Static Word Embeddings for Crosslingual Zero-shot Transfer
di: Ye, Haotian, et al.
Pubblicazione: (2024)
di: Ye, Haotian, et al.
Pubblicazione: (2024)
MAKIEval: A Multilingual Automatic WiKidata-based Framework for Cultural Awareness Evaluation for LLMs
di: Zhao, Raoyuan, et al.
Pubblicazione: (2025)
di: Zhao, Raoyuan, et al.
Pubblicazione: (2025)
Evaluating Contextually Mediated Factual Recall in Multilingual Large Language Models
di: Liu, Yihong, et al.
Pubblicazione: (2026)
di: Liu, Yihong, et al.
Pubblicazione: (2026)
SYNTHEVAL: Hybrid Behavioral Testing of NLP Models with Synthetic CheckLists
di: Zhao, Raoyuan, et al.
Pubblicazione: (2024)
di: Zhao, Raoyuan, et al.
Pubblicazione: (2024)
Breaking the Script Barrier in Multilingual Pre-Trained Language Models with Transliteration-Based Post-Training Alignment
di: Xhelili, Orgest, et al.
Pubblicazione: (2024)
di: Xhelili, Orgest, et al.
Pubblicazione: (2024)
How Transliterations Improve Crosslingual Alignment
di: Liu, Yihong, et al.
Pubblicazione: (2024)
di: Liu, Yihong, et al.
Pubblicazione: (2024)
TransliCo: A Contrastive Learning Framework to Address the Script Barrier in Multilingual Pretrained Language Models
di: Liu, Yihong, et al.
Pubblicazione: (2024)
di: Liu, Yihong, et al.
Pubblicazione: (2024)
OFA: A Framework of Initializing Unseen Subword Embeddings for Efficient Large-scale Multilingual Continued Pretraining
di: Liu, Yihong, et al.
Pubblicazione: (2023)
di: Liu, Yihong, et al.
Pubblicazione: (2023)
TransMI: A Framework to Create Strong Baselines from Multilingual Pretrained Language Models for Transliterated Data
di: Liu, Yihong, et al.
Pubblicazione: (2024)
di: Liu, Yihong, et al.
Pubblicazione: (2024)
LangSAMP: Language-Script Aware Multilingual Pretraining
di: Liu, Yihong, et al.
Pubblicazione: (2024)
di: Liu, Yihong, et al.
Pubblicazione: (2024)
Why Better Cross-Lingual Alignment Fails for Better Cross-Lingual Transfer: Case of Encoders
di: Veitsman, Yana, et al.
Pubblicazione: (2026)
di: Veitsman, Yana, et al.
Pubblicazione: (2026)
Human Uncertainty-Aware Data Selection and Automatic Labeling in Visual Question Answering
di: Lan, Jian, et al.
Pubblicazione: (2025)
di: Lan, Jian, et al.
Pubblicazione: (2025)
Relational Linearity is a Predictor of Hallucinations
di: Lu, Yuetian, et al.
Pubblicazione: (2026)
di: Lu, Yuetian, et al.
Pubblicazione: (2026)
Your Pretrained Model Tells the Difficulty Itself: A Self-Adaptive Curriculum Learning Paradigm for Natural Language Understanding
di: Feng, Qi, et al.
Pubblicazione: (2025)
di: Feng, Qi, et al.
Pubblicazione: (2025)
HYPEROFA: Expanding LLM Vocabulary to New Languages via Hypernetwork-Based Embedding Initialization
di: Özeren, Enes, et al.
Pubblicazione: (2025)
di: Özeren, Enes, et al.
Pubblicazione: (2025)
Left, Right, or Center? Evaluating LLM Framing in News Classification and Generation
di: Kennedy, Molly, et al.
Pubblicazione: (2026)
di: Kennedy, Molly, et al.
Pubblicazione: (2026)
Lost in Multilinguality: Dissecting Cross-lingual Factual Inconsistency in Transformer Language Models
di: Wang, Mingyang, et al.
Pubblicazione: (2025)
di: Wang, Mingyang, et al.
Pubblicazione: (2025)
Exploring the Role of Transliteration in In-Context Learning for Low-resource Languages Written in Non-Latin Scripts
di: Ma, Chunlan, et al.
Pubblicazione: (2024)
di: Ma, Chunlan, et al.
Pubblicazione: (2024)
How Programming Concepts and Neurons Are Shared in Code Language Models
di: Kargaran, Amir Hossein, et al.
Pubblicazione: (2025)
di: Kargaran, Amir Hossein, et al.
Pubblicazione: (2025)
Tracing Multilingual Factual Knowledge Acquisition in Pretraining
di: Liu, Yihong, et al.
Pubblicazione: (2025)
di: Liu, Yihong, et al.
Pubblicazione: (2025)
A Recipe of Parallel Corpora Exploitation for Multilingual Large Language Models
di: Lin, Peiqin, et al.
Pubblicazione: (2024)
di: Lin, Peiqin, et al.
Pubblicazione: (2024)
What's the Difference? Supporting Users in Identifying the Effects of Prompt and Model Changes Through Token Patterns
di: Hedderich, Michael A., et al.
Pubblicazione: (2025)
di: Hedderich, Michael A., et al.
Pubblicazione: (2025)
Understanding In-Context Machine Translation for Low-Resource Languages: A Case Study on Manchu
di: Pei, Renhao, et al.
Pubblicazione: (2025)
di: Pei, Renhao, et al.
Pubblicazione: (2025)
Refusal Direction is Universal Across Safety-Aligned Languages
di: Wang, Xinpeng, et al.
Pubblicazione: (2025)
di: Wang, Xinpeng, et al.
Pubblicazione: (2025)
Enhancing Robustness of Autoregressive Language Models against Orthographic Attacks via Pixel-based Approach
di: Yang, Han, et al.
Pubblicazione: (2025)
di: Yang, Han, et al.
Pubblicazione: (2025)
GKnow: Measuring the Entanglement of Gender Bias and Factual Gender
di: Veloso, Leonor, et al.
Pubblicazione: (2026)
di: Veloso, Leonor, et al.
Pubblicazione: (2026)
Calibration Is Not Enough: Evaluating Confidence Estimation Under Language Variations
di: Xia, Yuxi, et al.
Pubblicazione: (2026)
di: Xia, Yuxi, et al.
Pubblicazione: (2026)
Distilling Monolingual and Crosslingual Word-in-Context Representations
di: Arase, Yuki, et al.
Pubblicazione: (2024)
di: Arase, Yuki, et al.
Pubblicazione: (2024)
Probing LLMs for Multilingual Discourse Generalization Through a Unified Label Set
di: Eichin, Florian, et al.
Pubblicazione: (2025)
di: Eichin, Florian, et al.
Pubblicazione: (2025)
Self-Distilled Reasoner: On-Policy Self-Distillation for Large Language Models
di: Zhao, Siyan, et al.
Pubblicazione: (2026)
di: Zhao, Siyan, et al.
Pubblicazione: (2026)
GLUScope: A Tool for Analyzing GLU Neurons in Transformer Language Models
di: Gerstner, Sebastian, et al.
Pubblicazione: (2026)
di: Gerstner, Sebastian, et al.
Pubblicazione: (2026)
Understanding Gated Neurons in Transformers from Their Input-Output Functionality
di: Gerstner, Sebastian, et al.
Pubblicazione: (2025)
di: Gerstner, Sebastian, et al.
Pubblicazione: (2025)
Parallel Universes, Parallel Languages: A Comprehensive Study on LLM-based Multilingual Counterfactual Example Generation
di: Wang, Qianli, et al.
Pubblicazione: (2026)
di: Wang, Qianli, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Large Reasoning Models Are (Not Yet) Multilingual Latent Reasoners
di: Liu, Yihong, et al.
Pubblicazione: (2026) -
A Comprehensive Evaluation of Multilingual Chain-of-Thought Reasoning: Performance, Consistency, and Faithfulness Across Languages
di: Zhao, Raoyuan, et al.
Pubblicazione: (2025) -
Evaluating Robustness of Large Language Models Against Multilingual Typographical Errors
di: Zhao, Raoyuan, et al.
Pubblicazione: (2025) -
ReverseMath: Answer Inversion for Scalable and Verifiable Mathematical Problem Generation
di: Zhao, Raoyuan, et al.
Pubblicazione: (2026) -
Beyond Input Understanding: Diagnosing Multilingual Mathematical Reasoning with Directed Acyclic Trace Graphs
di: Zhang, Jiaqiao, et al.
Pubblicazione: (2026)