Eka-Eval: An Evaluation Framework for Low-Resource Multilingual Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Sinha, Samridhi Raj, Sheth, Rajvee, Upperwal, Abhishek, Singh, Mayank |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Beyond Monolingual Assumptions: A Survey of Code-Switched NLP in the Era of Large Language Models across Modalities
par: Sheth, Rajvee, et autres
Publié: (2025)
par: Sheth, Rajvee, et autres
Publié: (2025)
COMI-LINGUA: Expert Annotated Large-Scale Dataset for Multitask NLP in Hindi-English Code-Mixing
par: Sheth, Rajvee, et autres
Publié: (2025)
par: Sheth, Rajvee, et autres
Publié: (2025)
COMMENTATOR: A Code-mixed Multilingual Text Annotation Framework
par: Sheth, Rajvee, et autres
Publié: (2024)
par: Sheth, Rajvee, et autres
Publié: (2024)
When LLMs Stop Following Steps: A Diagnostic Study of Procedural Execution in Language Models
par: Panda, Sailesh, et autres
Publié: (2026)
par: Panda, Sailesh, et autres
Publié: (2026)
Task--Specificity Score: Measuring How Much Instructions Really Matter for Supervision
par: Kadasi, Pritam, et autres
Publié: (2026)
par: Kadasi, Pritam, et autres
Publié: (2026)
ADAPT: Learning Task Mixtures for Budget-Constrained Instruction Tuning
par: Kadasi, Pritam, et autres
Publié: (2025)
par: Kadasi, Pritam, et autres
Publié: (2025)
MultiPragEval: Multilingual Pragmatic Evaluation of Large Language Models
par: Park, Dojun, et autres
Publié: (2024)
par: Park, Dojun, et autres
Publié: (2024)
GlotEval: A Test Suite for Massively Multilingual Evaluation of Large Language Models
par: Luo, Hengyu, et autres
Publié: (2025)
par: Luo, Hengyu, et autres
Publié: (2025)
Cross-lingual Editing in Multilingual Language Models
par: Beniwal, Himanshu, et autres
Publié: (2024)
par: Beniwal, Himanshu, et autres
Publié: (2024)
mHumanEval -- A Multilingual Benchmark to Evaluate Large Language Models for Code Generation
par: Raihan, Nishat, et autres
Publié: (2024)
par: Raihan, Nishat, et autres
Publié: (2024)
Utilizing Multilingual Encoders to Improve Large Language Models for Low-Resource Languages
par: Puranegedara, Imalsha, et autres
Publié: (2025)
par: Puranegedara, Imalsha, et autres
Publié: (2025)
MTQ-Eval: Multilingual Text Quality Evaluation for Language Models
par: Pokharel, Rhitabrat, et autres
Publié: (2025)
par: Pokharel, Rhitabrat, et autres
Publié: (2025)
On Multilingual Encoder Language Model Compression for Low-Resource Languages
par: Gurgurov, Daniil, et autres
Publié: (2025)
par: Gurgurov, Daniil, et autres
Publié: (2025)
ArxEval: Evaluating Retrieval and Generation in Language Models for Scientific Literature
par: Sinha, Aarush, et autres
Publié: (2025)
par: Sinha, Aarush, et autres
Publié: (2025)
MUG-Eval: A Proxy Evaluation Framework for Multilingual Generation Capabilities in Any Language
par: Song, Seyoung, et autres
Publié: (2025)
par: Song, Seyoung, et autres
Publié: (2025)
How Good is Zero-Shot MT Evaluation for Low Resource Indian Languages?
par: Singh, Anushka, et autres
Publié: (2024)
par: Singh, Anushka, et autres
Publié: (2024)
NLNDE at SemEval-2023 Task 12: Adaptive Pretraining and Source Language Selection for Low-Resource Multilingual Sentiment Analysis
par: Wang, Mingyang, et autres
Publié: (2023)
par: Wang, Mingyang, et autres
Publié: (2023)
One Instruction Does Not Fit All: How Well Do Embeddings Align Personas and Instructions in Low-Resource Indian Languages?
par: Shah, Arya, et autres
Publié: (2026)
par: Shah, Arya, et autres
Publié: (2026)
SocialEval: Evaluating Social Intelligence of Large Language Models
par: Zhou, Jinfeng, et autres
Publié: (2025)
par: Zhou, Jinfeng, et autres
Publié: (2025)
Challenges in Adapting Multilingual LLMs to Low-Resource Languages using LoRA PEFT Tuning
par: Khade, Omkar, et autres
Publié: (2024)
par: Khade, Omkar, et autres
Publié: (2024)
CriticEval: Evaluating Large Language Model as Critic
par: Lan, Tian, et autres
Publié: (2024)
par: Lan, Tian, et autres
Publié: (2024)
Massively Multilingual Text Translation For Low-Resource Languages
par: Zhou, Zhong
Publié: (2024)
par: Zhou, Zhong
Publié: (2024)
Evaluating and Adapting Large Language Models to Represent Folktales in Low-Resource Languages
par: Meaney, JA, et autres
Publié: (2024)
par: Meaney, JA, et autres
Publié: (2024)
An Evaluation of Estimative Uncertainty in Large Language Models
par: Tang, Zhisheng, et autres
Publié: (2024)
par: Tang, Zhisheng, et autres
Publié: (2024)
FreeEval: A Modular Framework for Trustworthy and Efficient Evaluation of Large Language Models
par: Yu, Zhuohao, et autres
Publié: (2024)
par: Yu, Zhuohao, et autres
Publié: (2024)
IndicEval: A Bilingual Indian Educational Evaluation Framework for Large Language Models
par: Bharti, Saurabh, et autres
Publié: (2026)
par: Bharti, Saurabh, et autres
Publié: (2026)
FinEval-KR: A Financial Domain Evaluation Framework for Large Language Models' Knowledge and Reasoning
par: Dou, Shaoyu, et autres
Publié: (2025)
par: Dou, Shaoyu, et autres
Publié: (2025)
Multilingual Training and Evaluation Resources for Vision-Language Models
par: Baiamonte, Daniela, et autres
Publié: (2026)
par: Baiamonte, Daniela, et autres
Publié: (2026)
OpenHuEval: Evaluating Large Language Model on Hungarian Specifics
par: Yang, Haote, et autres
Publié: (2025)
par: Yang, Haote, et autres
Publié: (2025)
ESC-Eval: Evaluating Emotion Support Conversations in Large Language Models
par: Zhao, Haiquan, et autres
Publié: (2024)
par: Zhao, Haiquan, et autres
Publié: (2024)
Multi-Hypothesis Distillation of Multilingual Neural Translation Models for Low-Resource Languages
par: Galiano-Jiménez, Aarón, et autres
Publié: (2025)
par: Galiano-Jiménez, Aarón, et autres
Publié: (2025)
Disentangling Language and Culture for Evaluating Multilingual Large Language Models
par: Ying, Jiahao, et autres
Publié: (2025)
par: Ying, Jiahao, et autres
Publié: (2025)
TriLex: A Framework for Multilingual Sentiment Analysis in Low-Resource South African Languages
par: Nkongolo, Mike, et autres
Publié: (2025)
par: Nkongolo, Mike, et autres
Publié: (2025)
Multilingual Large Language Model: A Survey of Resources, Taxonomy and Frontiers
par: Qin, Libo, et autres
Publié: (2024)
par: Qin, Libo, et autres
Publié: (2024)
Multilingual MFA: Forced Alignment on Low-Resource Related Languages
par: Tosolini, Alessio, et autres
Publié: (2025)
par: Tosolini, Alessio, et autres
Publié: (2025)
SelfCheck-Eval: A Multi-Module Framework for Zero-Resource Hallucination Detection in Large Language Models
par: Muhammed, Diyana, et autres
Publié: (2025)
par: Muhammed, Diyana, et autres
Publié: (2025)
Generalizable and Stable Finetuning of Pretrained Language Models on Low-Resource Texts
par: Somayajula, Sai Ashish, et autres
Publié: (2024)
par: Somayajula, Sai Ashish, et autres
Publié: (2024)
PerHalluEval: Persian Hallucination Evaluation Benchmark for Large Language Models
par: Hosseini, Mohammad, et autres
Publié: (2025)
par: Hosseini, Mohammad, et autres
Publié: (2025)
AttackEval: How to Evaluate the Effectiveness of Jailbreak Attacking on Large Language Models
par: Shu, Dong, et autres
Publié: (2024)
par: Shu, Dong, et autres
Publié: (2024)
AdaptEval: Evaluating Large Language Models on Domain Adaptation for Text Summarization
par: Afzal, Anum, et autres
Publié: (2024)
par: Afzal, Anum, et autres
Publié: (2024)
Documents similaires
-
Beyond Monolingual Assumptions: A Survey of Code-Switched NLP in the Era of Large Language Models across Modalities
par: Sheth, Rajvee, et autres
Publié: (2025) -
COMI-LINGUA: Expert Annotated Large-Scale Dataset for Multitask NLP in Hindi-English Code-Mixing
par: Sheth, Rajvee, et autres
Publié: (2025) -
COMMENTATOR: A Code-mixed Multilingual Text Annotation Framework
par: Sheth, Rajvee, et autres
Publié: (2024) -
When LLMs Stop Following Steps: A Diagnostic Study of Procedural Execution in Language Models
par: Panda, Sailesh, et autres
Publié: (2026) -
Task--Specificity Score: Measuring How Much Instructions Really Matter for Supervision
par: Kadasi, Pritam, et autres
Publié: (2026)