Multilingual LLMs Are Not Multilingual Thinkers: Evidence from Hindi Analogy Evaluation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Gupta, Ashray, Joseph, Rohan, Rai, Sunny |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Multilingual Mathematical Reasoning: Advancing Open-Source LLMs in Hindi and English
par: Anand, Avinash, et autres
Publié: (2024)
par: Anand, Avinash, et autres
Publié: (2024)
Multilingual != Multicultural: Evaluating Gaps Between Multilingual Capabilities and Cultural Alignment in LLMs
par: Rystrøm, Jonathan, et autres
Publié: (2025)
par: Rystrøm, Jonathan, et autres
Publié: (2025)
CricBench: A Multilingual Benchmark for Evaluating LLMs in Cricket Analytics
par: Agarwal, Parth, et autres
Publié: (2025)
par: Agarwal, Parth, et autres
Publié: (2025)
Bias Beyond Borders: Political Ideology Evaluation and Steering in Multilingual LLMs
par: Nadeem, Afrozah, et autres
Publié: (2026)
par: Nadeem, Afrozah, et autres
Publié: (2026)
Code-Mixer Ya Nahi: Novel Approaches to Measuring Multilingual LLMs' Code-Mixing Capabilities
par: Gupta, Ayushman, et autres
Publié: (2024)
par: Gupta, Ayushman, et autres
Publié: (2024)
Multilingual Controlled Generation And Gold-Standard-Agnostic Evaluation of Code-Mixed Sentences
par: Gupta, Ayushman, et autres
Publié: (2024)
par: Gupta, Ayushman, et autres
Publié: (2024)
A Framework to Assess Multilingual Vulnerabilities of LLMs
par: Tang, Likai, et autres
Publié: (2025)
par: Tang, Likai, et autres
Publié: (2025)
MultiNRC: A Challenging and Native Multilingual Reasoning Evaluation Benchmark for LLMs
par: Fabbri, Alexander R., et autres
Publié: (2025)
par: Fabbri, Alexander R., et autres
Publié: (2025)
MEXA: Multilingual Evaluation of English-Centric LLMs via Cross-Lingual Alignment
par: Kargaran, Amir Hossein, et autres
Publié: (2024)
par: Kargaran, Amir Hossein, et autres
Publié: (2024)
EMCEE: Improving Multilingual Capability of LLMs via Bridging Knowledge and Reasoning with Extracted Synthetic Multilingual Context
par: Koo, Hamin, et autres
Publié: (2025)
par: Koo, Hamin, et autres
Publié: (2025)
MELA: Multilingual Evaluation of Linguistic Acceptability
par: Zhang, Ziyin, et autres
Publié: (2023)
par: Zhang, Ziyin, et autres
Publié: (2023)
LiveCLKTBench: Towards Reliable Evaluation of Cross-Lingual Knowledge Transfer in Multilingual LLMs
par: Guo, Pei-Fu, et autres
Publié: (2025)
par: Guo, Pei-Fu, et autres
Publié: (2025)
The Riddle of Reflection: Evaluating Reasoning and Self-Awareness in Multilingual LLMs using Indian Riddles
par: M, Abhinav P, et autres
Publié: (2025)
par: M, Abhinav P, et autres
Publié: (2025)
Evaluating Multilingual and Code-Switched Alignment in LLMs via Synthetic Natural Language Inference
par: Abdaljalil, Samir, et autres
Publié: (2025)
par: Abdaljalil, Samir, et autres
Publié: (2025)
Is It Good Data for Multilingual Instruction Tuning or Just Bad Multilingual Evaluation for Large Language Models?
par: Chen, Pinzhen, et autres
Publié: (2024)
par: Chen, Pinzhen, et autres
Publié: (2024)
Tower+: Bridging Generality and Translation Specialization in Multilingual LLMs
par: Rei, Ricardo, et autres
Publié: (2025)
par: Rei, Ricardo, et autres
Publié: (2025)
CorefInst: Leveraging LLMs for Multilingual Coreference Resolution
par: Arslan, Tuğba Pamay, et autres
Publié: (2025)
par: Arslan, Tuğba Pamay, et autres
Publié: (2025)
DEPART: DEcomposing PARiTy across Multilingual LLMs
par: Uppadhyay, Manan, et autres
Publié: (2026)
par: Uppadhyay, Manan, et autres
Publié: (2026)
Do Multilingual LLMs Think In English?
par: Schut, Lisa, et autres
Publié: (2025)
par: Schut, Lisa, et autres
Publié: (2025)
Eliciting Better Multilingual Structured Reasoning from LLMs through Code
par: Li, Bryan, et autres
Publié: (2024)
par: Li, Bryan, et autres
Publié: (2024)
M-IFEval: Multilingual Instruction-Following Evaluation
par: Dussolle, Antoine, et autres
Publié: (2025)
par: Dussolle, Antoine, et autres
Publié: (2025)
The Roles of English in Evaluating Multilingual Language Models
par: Poelman, Wessel, et autres
Publié: (2024)
par: Poelman, Wessel, et autres
Publié: (2024)
Translation as a Scalable Proxy for Multilingual Evaluation
par: Issaka, Sheriff, et autres
Publié: (2026)
par: Issaka, Sheriff, et autres
Publié: (2026)
Evaluation of Multilingual LLMs Personalized Text Generation Capabilities Targeting Groups and Social-Media Platforms
par: Macko, Dominik
Publié: (2026)
par: Macko, Dominik
Publié: (2026)
Lessons Without Borders? Evaluating Cultural Alignment of LLMs Using Multilingual Story Moral Generation
par: Wu, Sophie, et autres
Publié: (2026)
par: Wu, Sophie, et autres
Publié: (2026)
Do Large Language Models Have an English Accent? Evaluating and Improving the Naturalness of Multilingual LLMs
par: Guo, Yanzhu, et autres
Publié: (2024)
par: Guo, Yanzhu, et autres
Publié: (2024)
Framing Political Bias in Multilingual LLMs Across Pakistani Languages
par: Nadeem, Afrozah, et autres
Publié: (2025)
par: Nadeem, Afrozah, et autres
Publié: (2025)
Toward Robust Multilingual Adaptation of LLMs for Low-Resource Languages
par: Li, Haolin, et autres
Publié: (2025)
par: Li, Haolin, et autres
Publié: (2025)
M-Wanda: Improving One-Shot Pruning for Multilingual LLMs
par: Choenni, Rochelle, et autres
Publié: (2025)
par: Choenni, Rochelle, et autres
Publié: (2025)
Ground Truth Generation for Multilingual Historical NLP using LLMs
par: Gladstone, Clovis, et autres
Publié: (2025)
par: Gladstone, Clovis, et autres
Publié: (2025)
The Language Barrier: Dissecting Safety Challenges of LLMs in Multilingual Contexts
par: Shen, Lingfeng, et autres
Publié: (2024)
par: Shen, Lingfeng, et autres
Publié: (2024)
HindiLLM: Large Language Model for Hindi
par: Chouhan, Sanjay, et autres
Publié: (2024)
par: Chouhan, Sanjay, et autres
Publié: (2024)
E-ARMOR: Edge case Assessment and Review of Multilingual Optical Character Recognition
par: Gupta, Aryan, et autres
Publié: (2025)
par: Gupta, Aryan, et autres
Publié: (2025)
Multilingual Arbitrage: Optimizing Data Pools to Accelerate Multilingual Progress
par: Odumakinde, Ayomide, et autres
Publié: (2024)
par: Odumakinde, Ayomide, et autres
Publié: (2024)
Multilingual Performance Biases of Large Language Models in Education
par: Gupta, Vansh, et autres
Publié: (2025)
par: Gupta, Vansh, et autres
Publié: (2025)
'Since Lawyers are Males..': Examining Implicit Gender Bias in Hindi Language Generation by LLMs
par: Joshi, Ishika, et autres
Publié: (2024)
par: Joshi, Ishika, et autres
Publié: (2024)
Are LLMs Truly Multilingual? Exploring Zero-Shot Multilingual Capability of LLMs for Information Retrieval: An Italian Healthcare Use Case
par: Kembu, Vignesh Kumar, et autres
Publié: (2025)
par: Kembu, Vignesh Kumar, et autres
Publié: (2025)
MORPHOGEN: A Multilingual Benchmark for Evaluating Gender-Aware Morphological Generation
par: Agarwal, Mehul, et autres
Publié: (2026)
par: Agarwal, Mehul, et autres
Publié: (2026)
Multilingual Training and Evaluation Resources for Vision-Language Models
par: Baiamonte, Daniela, et autres
Publié: (2026)
par: Baiamonte, Daniela, et autres
Publié: (2026)
LLMs Are Not Intelligent Thinkers: Introducing Mathematical Topic Tree Benchmark for Comprehensive Evaluation of LLMs
par: Davoodi, Arash Gholami, et autres
Publié: (2024)
par: Davoodi, Arash Gholami, et autres
Publié: (2024)
Documents similaires
-
Multilingual Mathematical Reasoning: Advancing Open-Source LLMs in Hindi and English
par: Anand, Avinash, et autres
Publié: (2024) -
Multilingual != Multicultural: Evaluating Gaps Between Multilingual Capabilities and Cultural Alignment in LLMs
par: Rystrøm, Jonathan, et autres
Publié: (2025) -
CricBench: A Multilingual Benchmark for Evaluating LLMs in Cricket Analytics
par: Agarwal, Parth, et autres
Publié: (2025) -
Bias Beyond Borders: Political Ideology Evaluation and Steering in Multilingual LLMs
par: Nadeem, Afrozah, et autres
Publié: (2026) -
Code-Mixer Ya Nahi: Novel Approaches to Measuring Multilingual LLMs' Code-Mixing Capabilities
par: Gupta, Ayushman, et autres
Publié: (2024)