When Models Reason in Your Language: Controlling Thinking Language Comes at the Cost of Accuracy
Fuente:
arXiv
Salvato in:
| Autori principali: | Qi, Jirui, Chen, Shan, Xiong, Zidi, Fernández, Raquel, Bitterman, Danielle S., Bisazza, Arianna |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Cross-Lingual Consistency of Factual Knowledge in Multilingual Language Models
di: Qi, Jirui, et al.
Pubblicazione: (2023)
di: Qi, Jirui, et al.
Pubblicazione: (2023)
On the Consistency of Multilingual Context Utilization in Retrieval-Augmented Generation
di: Qi, Jirui, et al.
Pubblicazione: (2025)
di: Qi, Jirui, et al.
Pubblicazione: (2025)
Model Internals-based Answer Attribution for Trustworthy Retrieval-Augmented Generation
di: Qi, Jirui, et al.
Pubblicazione: (2024)
di: Qi, Jirui, et al.
Pubblicazione: (2024)
Post-Training Language Models for Crosslingual Consistency
di: Liu, Tianyu, et al.
Pubblicazione: (2026)
di: Liu, Tianyu, et al.
Pubblicazione: (2026)
The SIFo Benchmark: Investigating the Sequential Instruction Following Ability of Large Language Models
di: Chen, Xinyi, et al.
Pubblicazione: (2024)
di: Chen, Xinyi, et al.
Pubblicazione: (2024)
Reading Between the Prompts: How Stereotypes Shape LLM's Implicit Personalization
di: Neplenbroek, Vera, et al.
Pubblicazione: (2025)
di: Neplenbroek, Vera, et al.
Pubblicazione: (2025)
MBBQ: A Dataset for Cross-Lingual Comparison of Stereotypes in Generative LLMs
di: Neplenbroek, Vera, et al.
Pubblicazione: (2024)
di: Neplenbroek, Vera, et al.
Pubblicazione: (2024)
Cross-Lingual Transfer of Debiasing and Detoxification in Multilingual LLMs: An Extensive Investigation
di: Neplenbroek, Vera, et al.
Pubblicazione: (2024)
di: Neplenbroek, Vera, et al.
Pubblicazione: (2024)
Proof of Time: A Benchmark for Evaluating Scientific Idea Judgments
di: Ye, Bingyang, et al.
Pubblicazione: (2026)
di: Ye, Bingyang, et al.
Pubblicazione: (2026)
Assessing the Impact of Typological Features on Multilingual Machine Translation in the Age of Large Language Models
di: Hirak, Vitalii, et al.
Pubblicazione: (2026)
di: Hirak, Vitalii, et al.
Pubblicazione: (2026)
Child-Directed Language Does Not Consistently Boost Syntax Learning in Language Models
di: Padovani, Francesca, et al.
Pubblicazione: (2025)
di: Padovani, Francesca, et al.
Pubblicazione: (2025)
debiaSAE: Benchmarking and Mitigating Vision-Language Model Bias
di: Sasse, Kuleen, et al.
Pubblicazione: (2024)
di: Sasse, Kuleen, et al.
Pubblicazione: (2024)
NeLLCom-X: A Comprehensive Neural-Agent Framework to Simulate Language Learning and Group Communication
di: Lian, Yuchen, et al.
Pubblicazione: (2024)
di: Lian, Yuchen, et al.
Pubblicazione: (2024)
Pointwise Mutual Information as a Performance Gauge for Retrieval-Augmented Generation
di: Liu, Tianyu, et al.
Pubblicazione: (2024)
di: Liu, Tianyu, et al.
Pubblicazione: (2024)
A Primer on the Inner Workings of Transformer-based Language Models
di: Ferrando, Javier, et al.
Pubblicazione: (2024)
di: Ferrando, Javier, et al.
Pubblicazione: (2024)
Non Verbis, Sed Rebus: Large Language Models are Weak Solvers of Italian Rebuses
di: Sarti, Gabriele, et al.
Pubblicazione: (2024)
di: Sarti, Gabriele, et al.
Pubblicazione: (2024)
A Unified Assessment of the Poverty of the Stimulus Argument for Neural Language Models
di: Yang, Xiulin, et al.
Pubblicazione: (2026)
di: Yang, Xiulin, et al.
Pubblicazione: (2026)
Is Child-Directed Language Optimized for Word Learning? A Computational Study of Verb Meaning Acquisition
di: Padovani, Francesca, et al.
Pubblicazione: (2026)
di: Padovani, Francesca, et al.
Pubblicazione: (2026)
BabyLM Challenge: Exploring the Effect of Variation Sets on Language Model Training Efficiency
di: Haga, Akari, et al.
Pubblicazione: (2024)
di: Haga, Akari, et al.
Pubblicazione: (2024)
Can Language Models Identify Side Effects of Breast Cancer Radiation Treatments?
di: Seah, Natalie, et al.
Pubblicazione: (2026)
di: Seah, Natalie, et al.
Pubblicazione: (2026)
KScope: A Framework for Characterizing the Knowledge Status of Language Models
di: Xiao, Yuxin, et al.
Pubblicazione: (2025)
di: Xiao, Yuxin, et al.
Pubblicazione: (2025)
Steering Large Language Models for Machine Translation Personalization
di: Scalena, Daniel, et al.
Pubblicazione: (2025)
di: Scalena, Daniel, et al.
Pubblicazione: (2025)
When Raw Data Prevails: Are Large Language Model Embeddings Effective in Numerical Data Representation for Medical Machine Learning Applications?
di: Gao, Yanjun, et al.
Pubblicazione: (2024)
di: Gao, Yanjun, et al.
Pubblicazione: (2024)
Improving Clinical NLP Performance through Language Model-Generated Synthetic Clinical Data
di: Chen, Shan, et al.
Pubblicazione: (2024)
di: Chen, Shan, et al.
Pubblicazione: (2024)
NeLLCom-Lex: A Neural-agent Framework to Study the Interplay between Lexical Systems and Language Use
di: Zhang, Yuqing, et al.
Pubblicazione: (2025)
di: Zhang, Yuqing, et al.
Pubblicazione: (2025)
Simulating the Emergence of Differential Case Marking with Communicating Neural-Network Agents
di: Lian, Yuchen, et al.
Pubblicazione: (2025)
di: Lian, Yuchen, et al.
Pubblicazione: (2025)
Wait, but Tylenol is Acetaminophen... Investigating and Improving Language Models' Ability to Resist Requests for Misinformation
di: Chen, Shan, et al.
Pubblicazione: (2024)
di: Chen, Shan, et al.
Pubblicazione: (2024)
Evaluation of ChatGPT Family of Models for Biomedical Reasoning and Classification
di: Chen, Shan, et al.
Pubblicazione: (2023)
di: Chen, Shan, et al.
Pubblicazione: (2023)
Language Models are Surprisingly Fragile to Drug Names in Biomedical Benchmarks
di: Gallifant, Jack, et al.
Pubblicazione: (2024)
di: Gallifant, Jack, et al.
Pubblicazione: (2024)
Measuring the Faithfulness of Thinking Drafts in Large Reasoning Models
di: Xiong, Zidi, et al.
Pubblicazione: (2025)
di: Xiong, Zidi, et al.
Pubblicazione: (2025)
ThinkDial: An Open Recipe for Controlling Reasoning Effort in Large Language Models
di: He, Qianyu, et al.
Pubblicazione: (2025)
di: He, Qianyu, et al.
Pubblicazione: (2025)
Your Language Model May Think Too Rigidly: Achieving Reasoning Consistency with Symmetry-Enhanced Training
di: Yao, Yihang, et al.
Pubblicazione: (2025)
di: Yao, Yihang, et al.
Pubblicazione: (2025)
TurBLiMP: A Turkish Benchmark of Linguistic Minimal Pairs
di: Başar, Ezgi, et al.
Pubblicazione: (2025)
di: Başar, Ezgi, et al.
Pubblicazione: (2025)
MultiBLiMP 1.0: A Massively Multilingual Benchmark of Linguistic Minimal Pairs
di: Jumelet, Jaap, et al.
Pubblicazione: (2025)
di: Jumelet, Jaap, et al.
Pubblicazione: (2025)
Modeling Human-Like Color Naming Behavior in Context
di: Zhang, Yuqing, et al.
Pubblicazione: (2026)
di: Zhang, Yuqing, et al.
Pubblicazione: (2026)
Cognitive Decision Routing in Large Language Models: When to Think Fast, When to Think Slow
di: Du, Y., et al.
Pubblicazione: (2025)
di: Du, Y., et al.
Pubblicazione: (2025)
Latent Thinking Optimization: Your Latent Reasoning Language Model Secretly Encodes Reward Signals in Its Latent Thoughts
di: Du, Hanwen, et al.
Pubblicazione: (2025)
di: Du, Hanwen, et al.
Pubblicazione: (2025)
When Thinking Backfires: Mechanistic Insights Into Reasoning-Induced Misalignment
di: Yan, Hanqi, et al.
Pubblicazione: (2025)
di: Yan, Hanqi, et al.
Pubblicazione: (2025)
AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control
di: Li, Ruosen, et al.
Pubblicazione: (2025)
di: Li, Ruosen, et al.
Pubblicazione: (2025)
Position Paper On Diagnostic Uncertainty Estimation from Large Language Models: Next-Word Probability Is Not Pre-test Probability
di: Gao, Yanjun, et al.
Pubblicazione: (2024)
di: Gao, Yanjun, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Cross-Lingual Consistency of Factual Knowledge in Multilingual Language Models
di: Qi, Jirui, et al.
Pubblicazione: (2023) -
On the Consistency of Multilingual Context Utilization in Retrieval-Augmented Generation
di: Qi, Jirui, et al.
Pubblicazione: (2025) -
Model Internals-based Answer Attribution for Trustworthy Retrieval-Augmented Generation
di: Qi, Jirui, et al.
Pubblicazione: (2024) -
Post-Training Language Models for Crosslingual Consistency
di: Liu, Tianyu, et al.
Pubblicazione: (2026) -
The SIFo Benchmark: Investigating the Sequential Instruction Following Ability of Large Language Models
di: Chen, Xinyi, et al.
Pubblicazione: (2024)