Disentangling Language and Culture for Evaluating Multilingual Large Language Models
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Ying, Jiahao, Tang, Wei, Zhao, Yiran, Cao, Yixin, Rong, Yu, Zhang, Wenxuan |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
The Rise of Parameter Specialization for Knowledge Storage in Large Language Models
von: Hong, Yihuai, et al.
Veröffentlicht: (2025)
von: Hong, Yihuai, et al.
Veröffentlicht: (2025)
Babel: Open Multilingual Large Language Models Serving Over 90% of Global Speakers
von: Zhao, Yiran, et al.
Veröffentlicht: (2025)
von: Zhao, Yiran, et al.
Veröffentlicht: (2025)
How do Large Language Models Handle Multilingualism?
von: Zhao, Yiran, et al.
Veröffentlicht: (2024)
von: Zhao, Yiran, et al.
Veröffentlicht: (2024)
Is Translation All You Need? A Study on Solving Multilingual Tasks with Large Language Models
von: Liu, Chaoqun, et al.
Veröffentlicht: (2024)
von: Liu, Chaoqun, et al.
Veröffentlicht: (2024)
Automating Dataset Updates Towards Reliable and Timely Evaluation of Large Language Models
von: Ying, Jiahao, et al.
Veröffentlicht: (2024)
von: Ying, Jiahao, et al.
Veröffentlicht: (2024)
Language-Specific Neurons: The Key to Multilingual Capabilities in Large Language Models
von: Tang, Tianyi, et al.
Veröffentlicht: (2024)
von: Tang, Tianyi, et al.
Veröffentlicht: (2024)
Multilingual Jailbreak Challenges in Large Language Models
von: Deng, Yue, et al.
Veröffentlicht: (2023)
von: Deng, Yue, et al.
Veröffentlicht: (2023)
SeaLLMs 3: Open Foundation and Chat Multilingual Large Language Models for Southeast Asian Languages
von: Zhang, Wenxuan, et al.
Veröffentlicht: (2024)
von: Zhang, Wenxuan, et al.
Veröffentlicht: (2024)
When Less Language is More: Language-Reasoning Disentanglement Makes LLMs Better Multilingual Reasoners
von: Zhao, Weixiang, et al.
Veröffentlicht: (2025)
von: Zhao, Weixiang, et al.
Veröffentlicht: (2025)
XIFBench: Evaluating Large Language Models on Multilingual Instruction Following
von: Li, Zhenyu, et al.
Veröffentlicht: (2025)
von: Li, Zhenyu, et al.
Veröffentlicht: (2025)
Isolating Culture Neurons in Multilingual Large Language Models
von: Namazifard, Danial, et al.
Veröffentlicht: (2025)
von: Namazifard, Danial, et al.
Veröffentlicht: (2025)
AdaMergeX: Cross-Lingual Transfer with Large Language Models via Adaptive Adapter Merging
von: Zhao, Yiran, et al.
Veröffentlicht: (2024)
von: Zhao, Yiran, et al.
Veröffentlicht: (2024)
All Languages Matter: On the Multilingual Safety of Large Language Models
von: Wang, Wenxuan, et al.
Veröffentlicht: (2023)
von: Wang, Wenxuan, et al.
Veröffentlicht: (2023)
Language of Thought Shapes Output Diversity in Large Language Models
von: Xu, Shaoyang, et al.
Veröffentlicht: (2026)
von: Xu, Shaoyang, et al.
Veröffentlicht: (2026)
The Role of Mixed-Language Documents for Multilingual Large Language Model Pretraining
von: Shao, Jiandong, et al.
Veröffentlicht: (2026)
von: Shao, Jiandong, et al.
Veröffentlicht: (2026)
EffiEval: Efficient and Generalizable Model Evaluation via Capability Coverage Maximization
von: Wang, Yaoning, et al.
Veröffentlicht: (2025)
von: Wang, Yaoning, et al.
Veröffentlicht: (2025)
Evaluating Robustness of Large Language Models Against Multilingual Typographical Errors
von: Zhao, Raoyuan, et al.
Veröffentlicht: (2025)
von: Zhao, Raoyuan, et al.
Veröffentlicht: (2025)
Pardon? Evaluating Conversational Repair in Large Audio-Language Models
von: Huang, Shuanghong, et al.
Veröffentlicht: (2026)
von: Huang, Shuanghong, et al.
Veröffentlicht: (2026)
The Emergence of Abstract Thought in Large Language Models Beyond Any Language
von: Chen, Yuxin, et al.
Veröffentlicht: (2025)
von: Chen, Yuxin, et al.
Veröffentlicht: (2025)
Disentangling Memory and Reasoning Ability in Large Language Models
von: Jin, Mingyu, et al.
Veröffentlicht: (2024)
von: Jin, Mingyu, et al.
Veröffentlicht: (2024)
Testing and Evaluation of Large Language Models: Correctness, Non-Toxicity, and Fairness
von: Wang, Wenxuan
Veröffentlicht: (2024)
von: Wang, Wenxuan
Veröffentlicht: (2024)
Multilingual Large Language Models and Curse of Multilinguality
von: Gurgurov, Daniil, et al.
Veröffentlicht: (2024)
von: Gurgurov, Daniil, et al.
Veröffentlicht: (2024)
Large Language Model as Token Compressor and Decompressor
von: Li, Wenbing, et al.
Veröffentlicht: (2026)
von: Li, Wenbing, et al.
Veröffentlicht: (2026)
EthioLLM: Multilingual Large Language Models for Ethiopian Languages with Task Evaluation
von: Tonja, Atnafu Lambebo, et al.
Veröffentlicht: (2024)
von: Tonja, Atnafu Lambebo, et al.
Veröffentlicht: (2024)
MlingConf: A Comprehensive Study of Multilingual Confidence Estimation on Large Language Models
von: Xue, Boyang, et al.
Veröffentlicht: (2024)
von: Xue, Boyang, et al.
Veröffentlicht: (2024)
Language Surgery in Multilingual Large Language Models
von: Lopo, Joanito Agili, et al.
Veröffentlicht: (2025)
von: Lopo, Joanito Agili, et al.
Veröffentlicht: (2025)
Disentangling Language Roles in Multilingual LLM Task Execution
von: Zhan, Qishi, et al.
Veröffentlicht: (2026)
von: Zhan, Qishi, et al.
Veröffentlicht: (2026)
Large Language Models for Mental Health: A Multilingual Evaluation
von: Raihan, Nishat, et al.
Veröffentlicht: (2026)
von: Raihan, Nishat, et al.
Veröffentlicht: (2026)
Mitigating Multilingual Hallucination in Large Vision-Language Models
von: Qu, Xiaoye, et al.
Veröffentlicht: (2024)
von: Qu, Xiaoye, et al.
Veröffentlicht: (2024)
Evaluating the Feasibility and Accuracy of Large Language Models for Medical History-Taking in Obstetrics and Gynecology
von: Liu, Dou, et al.
Veröffentlicht: (2025)
von: Liu, Dou, et al.
Veröffentlicht: (2025)
Is It Good Data for Multilingual Instruction Tuning or Just Bad Multilingual Evaluation for Large Language Models?
von: Chen, Pinzhen, et al.
Veröffentlicht: (2024)
von: Chen, Pinzhen, et al.
Veröffentlicht: (2024)
POLYCHARTQA: Benchmarking Large Vision-Language Models with Multilingual Chart Question Answering
von: Xu, Yichen, et al.
Veröffentlicht: (2025)
von: Xu, Yichen, et al.
Veröffentlicht: (2025)
CLEAN-EVAL: Clean Evaluation on Contaminated Large Language Models
von: Zhu, Wenhong, et al.
Veröffentlicht: (2023)
von: Zhu, Wenhong, et al.
Veröffentlicht: (2023)
Pruning Multilingual Large Language Models for Multilingual Inference
von: Kim, Hwichan, et al.
Veröffentlicht: (2024)
von: Kim, Hwichan, et al.
Veröffentlicht: (2024)
ICLEval: Evaluating In-Context Learning Ability of Large Language Models
von: Chen, Wentong, et al.
Veröffentlicht: (2024)
von: Chen, Wentong, et al.
Veröffentlicht: (2024)
Rethinking the Evaluation for Conversational Recommendation in the Era of Large Language Models
von: Wang, Xiaolei, et al.
Veröffentlicht: (2023)
von: Wang, Xiaolei, et al.
Veröffentlicht: (2023)
BAMBOO: A Comprehensive Benchmark for Evaluating Long Text Modeling Capacities of Large Language Models
von: Dong, Zican, et al.
Veröffentlicht: (2023)
von: Dong, Zican, et al.
Veröffentlicht: (2023)
Lens: Rethinking Multilingual Enhancement for Large Language Models
von: Zhao, Weixiang, et al.
Veröffentlicht: (2024)
von: Zhao, Weixiang, et al.
Veröffentlicht: (2024)
Language over Content: Tracing Cultural Understanding in Multilingual Large Language Models
von: Cho, Seungho, et al.
Veröffentlicht: (2025)
von: Cho, Seungho, et al.
Veröffentlicht: (2025)
Are Large Language Model-based Evaluators the Solution to Scaling Up Multilingual Evaluation?
von: Hada, Rishav, et al.
Veröffentlicht: (2023)
von: Hada, Rishav, et al.
Veröffentlicht: (2023)
Ähnliche Einträge
-
The Rise of Parameter Specialization for Knowledge Storage in Large Language Models
von: Hong, Yihuai, et al.
Veröffentlicht: (2025) -
Babel: Open Multilingual Large Language Models Serving Over 90% of Global Speakers
von: Zhao, Yiran, et al.
Veröffentlicht: (2025) -
How do Large Language Models Handle Multilingualism?
von: Zhao, Yiran, et al.
Veröffentlicht: (2024) -
Is Translation All You Need? A Study on Solving Multilingual Tasks with Large Language Models
von: Liu, Chaoqun, et al.
Veröffentlicht: (2024) -
Automating Dataset Updates Towards Reliable and Timely Evaluation of Large Language Models
von: Ying, Jiahao, et al.
Veröffentlicht: (2024)