What Makes Good Multilingual Reasoning? Disentangling Reasoning Traces with Measurable Features
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ki, Dayeon, Duh, Kevin, Carpuat, Marine |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Should I Share this Translation? Evaluating Quality Feedback for User Reliance on Machine Translation
par: Ki, Dayeon, et autres
Publié: (2025)
par: Ki, Dayeon, et autres
Publié: (2025)
Guiding Large Language Models to Post-Edit Machine Translation with Error Annotations
par: Ki, Dayeon, et autres
Publié: (2024)
par: Ki, Dayeon, et autres
Publié: (2024)
Automatic Input Rewriting Improves Translation with Large Language Models
par: Ki, Dayeon, et autres
Publié: (2025)
par: Ki, Dayeon, et autres
Publié: (2025)
AskQE: Question Answering as Automatic Evaluation for Machine Translation
par: Ki, Dayeon, et autres
Publié: (2025)
par: Ki, Dayeon, et autres
Publié: (2025)
Multiple LLM Agents Debate for Equitable Cultural Alignment
par: Ki, Dayeon, et autres
Publié: (2025)
par: Ki, Dayeon, et autres
Publié: (2025)
Pragmatics Meets Culture: Culturally-adapted Artwork Description Generation and Evaluation
par: Zhao, Lingjun, et autres
Publié: (2026)
par: Zhao, Lingjun, et autres
Publié: (2026)
Should We be Pedantic About Reasoning Errors in Machine Translation?
par: Bao, Calvin, et autres
Publié: (2026)
par: Bao, Calvin, et autres
Publié: (2026)
GraphicBench: A Planning Benchmark for Graphic Design with Language Agents
par: Ki, Dayeon, et autres
Publié: (2025)
par: Ki, Dayeon, et autres
Publié: (2025)
Linguistic Nepotism: Trading-off Quality for Language Preference in Multilingual RAG
par: Ki, Dayeon, et autres
Publié: (2025)
par: Ki, Dayeon, et autres
Publié: (2025)
Reheat Nachos for Dinner? Evaluating AI Support for Cross-Cultural Communication of Neologisms
par: Ki, Dayeon, et autres
Publié: (2026)
par: Ki, Dayeon, et autres
Publié: (2026)
Keep It Private: Unsupervised Privatization of Online Text
par: Bao, Calvin, et autres
Publié: (2024)
par: Bao, Calvin, et autres
Publié: (2024)
Plausibly Problematic Questions in Multiple-Choice Benchmarks for Commonsense Reasoning
par: Palta, Shramay, et autres
Publié: (2024)
par: Palta, Shramay, et autres
Publié: (2024)
SpeechQE: Estimating the Quality of Direct Speech Translation
par: Han, HyoJung, et autres
Publié: (2024)
par: Han, HyoJung, et autres
Publié: (2024)
What Makes a Good Query? Measuring the Impact of Human-Confusing Linguistic Features on LLM Performance
par: Watson, William, et autres
Publié: (2026)
par: Watson, William, et autres
Publié: (2026)
Mitigating Semantic Leakage in Cross-lingual Embeddings via Orthogonality Constraint
par: Ki, Dayeon, et autres
Publié: (2024)
par: Ki, Dayeon, et autres
Publié: (2024)
Can They Dixit? Yes they Can! Dixit as a Playground for Multimodal Language Model Capabilities
par: Balepur, Nishant, et autres
Publié: (2025)
par: Balepur, Nishant, et autres
Publié: (2025)
What Defines Good Reasoning in LLMs? Dissecting Reasoning Steps with Multi-Aspect Evaluation
par: Do, Heejin, et autres
Publié: (2025)
par: Do, Heejin, et autres
Publié: (2025)
Cross-lingual QA: A Key to Unlocking In-context Cross-lingual Performance
par: Kim, Sunkyoung, et autres
Publié: (2023)
par: Kim, Sunkyoung, et autres
Publié: (2023)
Where does In-context Translation Happen in Large Language Models
par: Sia, Suzanna, et autres
Publié: (2024)
par: Sia, Suzanna, et autres
Publié: (2024)
Disentangling Reasoning and Knowledge in Medical Large Language Models
par: Thapa, Rahul, et autres
Publié: (2025)
par: Thapa, Rahul, et autres
Publié: (2025)
ReasonOps: Operator Segmentation for LLM Reasoning Traces
par: Lee, Daniel, et autres
Publié: (2026)
par: Lee, Daniel, et autres
Publié: (2026)
Words as Bridges: Exploring Computational Support for Cross-Disciplinary Translation Work
par: Bao, Calvin, et autres
Publié: (2025)
par: Bao, Calvin, et autres
Publié: (2025)
ReasoningShield: Safety Detection over Reasoning Traces of Large Reasoning Models
par: Li, Changyi, et autres
Publié: (2025)
par: Li, Changyi, et autres
Publié: (2025)
Learning When to Translate for Multilingual Reasoning
par: Kang, Deokhyung, et autres
Publié: (2026)
par: Kang, Deokhyung, et autres
Publié: (2026)
What Makes In-context Learning Effective for Mathematical Reasoning: A Theoretical Analysis
par: Liu, Jiayu, et autres
Publié: (2024)
par: Liu, Jiayu, et autres
Publié: (2024)
Anti-LM Decoding for Zero-shot In-context Machine Translation
par: Sia, Suzanna, et autres
Publié: (2023)
par: Sia, Suzanna, et autres
Publié: (2023)
Corrupted by Reasoning: Reasoning Language Models Become Free-Riders in Public Goods Games
par: Piedrahita, David Guzman, et autres
Publié: (2025)
par: Piedrahita, David Guzman, et autres
Publié: (2025)
How Multilingual Are Large Language Models Fine-Tuned for Translation?
par: Richburg, Aquia, et autres
Publié: (2024)
par: Richburg, Aquia, et autres
Publié: (2024)
What Makes a Good Response? An Empirical Analysis of Quality in Qualitative Interviews
par: Ivey, Jonathan, et autres
Publié: (2026)
par: Ivey, Jonathan, et autres
Publié: (2026)
Revisiting the UID Hypothesis in LLM Reasoning Traces
par: Gwak, Minju, et autres
Publié: (2025)
par: Gwak, Minju, et autres
Publié: (2025)
TRAIL: Trace Reasoning and Agentic Issue Localization
par: Deshpande, Darshan, et autres
Publié: (2025)
par: Deshpande, Darshan, et autres
Publié: (2025)
Measuring Reasoning Trace Legibility: Can Those Who Understand Teach?
par: Roytburg, Dani, et autres
Publié: (2026)
par: Roytburg, Dani, et autres
Publié: (2026)
Filtered Reasoning Score: Evaluating Reasoning Quality on a Model's Most-Confident Traces
par: Pathak, Manas, et autres
Publié: (2026)
par: Pathak, Manas, et autres
Publié: (2026)
What makes Reasoning Models Different? Follow the Reasoning Leader for Efficient Decoding
par: Li, Ming, et autres
Publié: (2025)
par: Li, Ming, et autres
Publié: (2025)
MultiZebraLogic: A Multilingual Logical Reasoning Benchmark
par: Bruun, Sofie Helene, et autres
Publié: (2025)
par: Bruun, Sofie Helene, et autres
Publié: (2025)
Multilingual Medical Reasoning for Question Answering with Large Language Models
par: Ferrazzi, Pietro, et autres
Publié: (2025)
par: Ferrazzi, Pietro, et autres
Publié: (2025)
Breaking Language Barriers in Multilingual Mathematical Reasoning: Insights and Observations
par: Chen, Nuo, et autres
Publié: (2023)
par: Chen, Nuo, et autres
Publié: (2023)
Why Do Multilingual Reasoning Gaps Emerge in Reasoning Language Models?
par: Kang, Deokhyung, et autres
Publié: (2025)
par: Kang, Deokhyung, et autres
Publié: (2025)
LINGOLY-TOO: Disentangling Reasoning from Knowledge with Templatised Orthographic Obfuscation
par: Khouja, Jude, et autres
Publié: (2025)
par: Khouja, Jude, et autres
Publié: (2025)
Are Large Reasoning Models Good Translation Evaluators? Analysis and Performance Boost
par: Zhan, Runzhe, et autres
Publié: (2025)
par: Zhan, Runzhe, et autres
Publié: (2025)
Documents similaires
-
Should I Share this Translation? Evaluating Quality Feedback for User Reliance on Machine Translation
par: Ki, Dayeon, et autres
Publié: (2025) -
Guiding Large Language Models to Post-Edit Machine Translation with Error Annotations
par: Ki, Dayeon, et autres
Publié: (2024) -
Automatic Input Rewriting Improves Translation with Large Language Models
par: Ki, Dayeon, et autres
Publié: (2025) -
AskQE: Question Answering as Automatic Evaluation for Machine Translation
par: Ki, Dayeon, et autres
Publié: (2025) -
Multiple LLM Agents Debate for Equitable Cultural Alignment
par: Ki, Dayeon, et autres
Publié: (2025)