Post-Training Language Models for Crosslingual Consistency
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Liu, Tianyu, Qi, Jirui, Sachan, Mrinmaya, Cotterell, Ryan, Fernández, Raquel, Bisazza, Arianna |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Pointwise Mutual Information as a Performance Gauge for Retrieval-Augmented Generation
par: Liu, Tianyu, et autres
Publié: (2024)
par: Liu, Tianyu, et autres
Publié: (2024)
Cross-Lingual Consistency of Factual Knowledge in Multilingual Language Models
par: Qi, Jirui, et autres
Publié: (2023)
par: Qi, Jirui, et autres
Publié: (2023)
On the Consistency of Multilingual Context Utilization in Retrieval-Augmented Generation
par: Qi, Jirui, et autres
Publié: (2025)
par: Qi, Jirui, et autres
Publié: (2025)
Model Internals-based Answer Attribution for Trustworthy Retrieval-Augmented Generation
par: Qi, Jirui, et autres
Publié: (2024)
par: Qi, Jirui, et autres
Publié: (2024)
Learning to Reason Efficiently with A* Post-Training
par: Opedal, Andreas, et autres
Publié: (2026)
par: Opedal, Andreas, et autres
Publié: (2026)
Efficiently Computing Susceptibility to Context in Language Models
par: Liu, Tianyu, et autres
Publié: (2024)
par: Liu, Tianyu, et autres
Publié: (2024)
Probing for Arithmetic Errors in Language Models
par: Sun, Yucheng, et autres
Publié: (2025)
par: Sun, Yucheng, et autres
Publié: (2025)
Do Language Models Exhibit the Same Cognitive Biases in Problem Solving as Human Learners?
par: Opedal, Andreas, et autres
Publié: (2024)
par: Opedal, Andreas, et autres
Publié: (2024)
Are Language Models Efficient Reasoners? A Perspective from Logic Programming
par: Opedal, Andreas, et autres
Publié: (2025)
par: Opedal, Andreas, et autres
Publié: (2025)
When Models Reason in Your Language: Controlling Thinking Language Comes at the Cost of Accuracy
par: Qi, Jirui, et autres
Publié: (2025)
par: Qi, Jirui, et autres
Publié: (2025)
Non Verbis, Sed Rebus: Large Language Models are Weak Solvers of Italian Rebuses
par: Sarti, Gabriele, et autres
Publié: (2024)
par: Sarti, Gabriele, et autres
Publié: (2024)
Improving Large Language Model Safety with Contrastive Representation Learning
par: Simko, Samuel, et autres
Publié: (2025)
par: Simko, Samuel, et autres
Publié: (2025)
What Do Language Models Learn in Context? The Structured Task Hypothesis
par: Li, Jiaoda, et autres
Publié: (2024)
par: Li, Jiaoda, et autres
Publié: (2024)
A Unified Assessment of the Poverty of the Stimulus Argument for Neural Language Models
par: Yang, Xiulin, et autres
Publié: (2026)
par: Yang, Xiulin, et autres
Publié: (2026)
Multilingual Performance Biases of Large Language Models in Education
par: Gupta, Vansh, et autres
Publié: (2025)
par: Gupta, Vansh, et autres
Publié: (2025)
Towards Aligning Language Models with Textual Feedback
par: Lloret, Saüc Abadal, et autres
Publié: (2024)
par: Lloret, Saüc Abadal, et autres
Publié: (2024)
Can Vision-Language Models Solve Visual Math Equations?
par: Choudhury, Monjoy Narayan, et autres
Publié: (2025)
par: Choudhury, Monjoy Narayan, et autres
Publié: (2025)
How to Engage Your Readers? Generating Guiding Questions to Promote Active Reading
par: Cui, Peng, et autres
Publié: (2024)
par: Cui, Peng, et autres
Publié: (2024)
Stepwise Verification and Remediation of Student Reasoning Errors with Large Language Model Tutors
par: Daheim, Nico, et autres
Publié: (2024)
par: Daheim, Nico, et autres
Publié: (2024)
Simulating Students or Sycophantic Problem Solving? On Misconception Faithfulness of LLM Simulators
par: Do, Heejin, et autres
Publié: (2026)
par: Do, Heejin, et autres
Publié: (2026)
A Distributional Perspective on Word Learning in Neural Language Models
par: Ficarra, Filippo, et autres
Publié: (2025)
par: Ficarra, Filippo, et autres
Publié: (2025)
Corrupted by Reasoning: Reasoning Language Models Become Free-Riders in Public Goods Games
par: Piedrahita, David Guzman, et autres
Publié: (2025)
par: Piedrahita, David Guzman, et autres
Publié: (2025)
Steering Large Language Models for Machine Translation Personalization
par: Scalena, Daniel, et autres
Publié: (2025)
par: Scalena, Daniel, et autres
Publié: (2025)
Towards Explainability in Legal Outcome Prediction Models
par: Valvoda, Josef, et autres
Publié: (2024)
par: Valvoda, Josef, et autres
Publié: (2024)
Chimera: Diagnosing Shortcut Learning in Visual-Language Understanding
par: Chi, Ziheng, et autres
Publié: (2025)
par: Chi, Ziheng, et autres
Publié: (2025)
Transformers Can Represent $n$-gram Language Models
par: Svete, Anej, et autres
Publié: (2024)
par: Svete, Anej, et autres
Publié: (2024)
PATS: Personality-Aware Teaching Strategies with Large Language Model Tutors
par: Rooein, Donya, et autres
Publié: (2026)
par: Rooein, Donya, et autres
Publié: (2026)
Generating Pedagogically Meaningful Visuals for Math Word Problems: A New Benchmark and Analysis of Text-to-Image Models
par: Wang, Junling, et autres
Publié: (2025)
par: Wang, Junling, et autres
Publié: (2025)
Compose and Fuse: Revisiting the Foundational Bottlenecks in Multimodal Reasoning
par: Wang, Yucheng, et autres
Publié: (2025)
par: Wang, Yucheng, et autres
Publié: (2025)
Confidence Regulation Neurons in Language Models
par: Stolfo, Alessandro, et autres
Publié: (2024)
par: Stolfo, Alessandro, et autres
Publié: (2024)
Exploring the Jungle of Bias: Political Bias Attribution in Language Models via Dependency Analysis
par: Jenny, David F., et autres
Publié: (2023)
par: Jenny, David F., et autres
Publié: (2023)
Better Estimation of the Kullback--Leibler Divergence Between Language Models
par: Amini, Afra, et autres
Publié: (2025)
par: Amini, Afra, et autres
Publié: (2025)
A Transformer with Stack Attention
par: Li, Jiaoda, et autres
Publié: (2024)
par: Li, Jiaoda, et autres
Publié: (2024)
Unsupervised Word-level Quality Estimation for Machine Translation Through the Lens of Annotators (Dis)agreement
par: Sarti, Gabriele, et autres
Publié: (2025)
par: Sarti, Gabriele, et autres
Publié: (2025)
Can Large Language Models Infer Causation from Correlation?
par: Jin, Zhijing, et autres
Publié: (2023)
par: Jin, Zhijing, et autres
Publié: (2023)
Implicit Personalization in Language Models: A Systematic Study
par: Jin, Zhijing, et autres
Publié: (2024)
par: Jin, Zhijing, et autres
Publié: (2024)
Can Reasoning Help Large Language Models Capture Human Annotator Disagreement?
par: Ni, Jingwei, et autres
Publié: (2025)
par: Ni, Jingwei, et autres
Publié: (2025)
On the Emergence of Induction Heads for In-Context Learning
par: Musat, Tiberiu, et autres
Publié: (2025)
par: Musat, Tiberiu, et autres
Publié: (2025)
AFaCTA: Assisting the Annotation of Factual Claim Detection with Reliable LLM Annotators
par: Ni, Jingwei, et autres
Publié: (2024)
par: Ni, Jingwei, et autres
Publié: (2024)
Gumbel Counterfactual Generation From Language Models
par: Ravfogel, Shauli, et autres
Publié: (2024)
par: Ravfogel, Shauli, et autres
Publié: (2024)
Documents similaires
-
Pointwise Mutual Information as a Performance Gauge for Retrieval-Augmented Generation
par: Liu, Tianyu, et autres
Publié: (2024) -
Cross-Lingual Consistency of Factual Knowledge in Multilingual Language Models
par: Qi, Jirui, et autres
Publié: (2023) -
On the Consistency of Multilingual Context Utilization in Retrieval-Augmented Generation
par: Qi, Jirui, et autres
Publié: (2025) -
Model Internals-based Answer Attribution for Trustworthy Retrieval-Augmented Generation
par: Qi, Jirui, et autres
Publié: (2024) -
Learning to Reason Efficiently with A* Post-Training
par: Opedal, Andreas, et autres
Publié: (2026)