Better To Ask in English? Evaluating Factual Accuracy of Multilingual LLMs in English and Low-Resource Languages
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Rohera, Pritika, Ginimav, Chaitrali, Sawant, Gayatri, Joshi, Raviraj |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
L3Cube-IndicQuest: A Benchmark Question Answering Dataset for Evaluating Knowledge of LLMs in Indic Context
par: Rohera, Pritika, et autres
Publié: (2024)
par: Rohera, Pritika, et autres
Publié: (2024)
Challenges in Adapting Multilingual LLMs to Low-Resource Languages using LoRA PEFT Tuning
par: Khade, Omkar, et autres
Publié: (2024)
par: Khade, Omkar, et autres
Publié: (2024)
Adapting Multilingual LLMs to Low-Resource Languages using Continued Pre-training and Synthetic Corpus
par: Joshi, Raviraj, et autres
Publié: (2024)
par: Joshi, Raviraj, et autres
Publié: (2024)
Chain-of-Translation Prompting (CoTR): A Novel Prompting Technique for Low Resource Languages
par: Deshpande, Tejas, et autres
Publié: (2024)
par: Deshpande, Tejas, et autres
Publié: (2024)
On Limitations of LLM as Annotator for Low Resource Languages
par: Jadhav, Suramya, et autres
Publié: (2024)
par: Jadhav, Suramya, et autres
Publié: (2024)
On Importance of Layer Pruning for Smaller BERT Models and Low Resource Languages
par: Shirke, Mayur, et autres
Publié: (2025)
par: Shirke, Mayur, et autres
Publié: (2025)
L3Cube-IndicHeadline-ID: A Dataset for Headline Identification and Semantic Evaluation in Low-Resource Indian Languages
par: Tanksale, Nishant, et autres
Publié: (2025)
par: Tanksale, Nishant, et autres
Publié: (2025)
A Data Selection Approach for Enhancing Low Resource Machine Translation Using Cross-Lingual Sentence Representations
par: Kowtal, Nidhi, et autres
Publié: (2024)
par: Kowtal, Nidhi, et autres
Publié: (2024)
Multilingual Evaluation of Semantic Textual Relatedness
par: Endait, Sharvi, et autres
Publié: (2024)
par: Endait, Sharvi, et autres
Publié: (2024)
IndicSQuAD: A Comprehensive Multilingual Question Answering Dataset for Indic Languages
par: Endait, Sharvi, et autres
Publié: (2025)
par: Endait, Sharvi, et autres
Publié: (2025)
Do Multilingual LLMs Think In English?
par: Schut, Lisa, et autres
Publié: (2025)
par: Schut, Lisa, et autres
Publié: (2025)
L3Cube-MahaEmotions: A Marathi Emotion Recognition Dataset with Synthetic Annotations using CoTR prompting and Large Language Models
par: Kowtal, Nidhi, et autres
Publié: (2025)
par: Kowtal, Nidhi, et autres
Publié: (2025)
On Importance of Pruning and Distillation for Efficient Low Resource NLP
par: Mirashi, Aishwarya, et autres
Publié: (2024)
par: Mirashi, Aishwarya, et autres
Publié: (2024)
Leveraging Parameter Efficient Training Methods for Low Resource Text Classification: A Case Study in Marathi
par: Deshmukh, Pranita, et autres
Publié: (2024)
par: Deshmukh, Pranita, et autres
Publié: (2024)
Aligning Large Language Models to Low-Resource Languages through LLM-Based Selective Translation: A Systematic Study
par: Paul, Rakesh, et autres
Publié: (2025)
par: Paul, Rakesh, et autres
Publié: (2025)
Better to Ask in English: Evaluation of Large Language Models on English, Low-resource and Cross-Lingual Settings
par: Dey, Krishno, et autres
Publié: (2024)
par: Dey, Krishno, et autres
Publié: (2024)
Topic Modeling in Marathi
par: Shinde, Sanket, et autres
Publié: (2025)
par: Shinde, Sanket, et autres
Publié: (2025)
L3Cube-MahaSTS: A Marathi Sentence Similarity Dataset and Models
par: Mirashi, Aishwarya, et autres
Publié: (2025)
par: Mirashi, Aishwarya, et autres
Publié: (2025)
Factual Consistency of Multilingual Pretrained Language Models
par: Fierro, Constanza, et autres
Publié: (2022)
par: Fierro, Constanza, et autres
Publié: (2022)
Better as Generators Than Classifiers: Leveraging LLMs and Synthetic Data for Low-Resource Multilingual Classification
par: Pecher, Branislav, et autres
Publié: (2026)
par: Pecher, Branislav, et autres
Publié: (2026)
Towards Building Efficient Sentence BERT Models using Layer Pruning
par: Shelke, Anushka, et autres
Publié: (2024)
par: Shelke, Anushka, et autres
Publié: (2024)
Generative Data Refinement: Just Ask for Better Data
par: Jiang, Minqi, et autres
Publié: (2025)
par: Jiang, Minqi, et autres
Publié: (2025)
Comparative Study of Pre-Trained BERT and Large Language Models for Code-Mixed Named Entity Recognition
par: Shirke, Mayur, et autres
Publié: (2025)
par: Shirke, Mayur, et autres
Publié: (2025)
L3Cube-IndicNews: News-based Short Text and Long Document Classification Datasets in Indic Languages
par: Mirashi, Aishwarya, et autres
Publié: (2024)
par: Mirashi, Aishwarya, et autres
Publié: (2024)
Harnessing Test-time Adaptation for NLU tasks Involving Dialects of English
par: Nguyen, Duke, et autres
Publié: (2025)
par: Nguyen, Duke, et autres
Publié: (2025)
Improving the Efficiency of Long Document Classification using Sentence Ranking Approach
par: Kokate, Prathamesh, et autres
Publié: (2025)
par: Kokate, Prathamesh, et autres
Publié: (2025)
Curating Stopwords in Marathi: A TF-IDF Approach for Improved Text Analysis and Information Retrieval
par: Chavan, Rohan, et autres
Publié: (2024)
par: Chavan, Rohan, et autres
Publié: (2024)
CodeMixBench: Evaluating Large Language Models on Code Generation with Code-Mixed Prompts
par: Sheokand, Manik, et autres
Publié: (2025)
par: Sheokand, Manik, et autres
Publié: (2025)
Rephrase and Respond: Let Large Language Models Ask Better Questions for Themselves
par: Deng, Yihe, et autres
Publié: (2023)
par: Deng, Yihe, et autres
Publié: (2023)
Benchmarking Hindi LLMs: A New Suite of Datasets and a Comparative Analysis
par: Kamath, Anusha, et autres
Publié: (2025)
par: Kamath, Anusha, et autres
Publié: (2025)
MahaParaphrase: A Marathi Paraphrase Detection Corpus and BERT-based Models
par: Jadhav, Suramya, et autres
Publié: (2025)
par: Jadhav, Suramya, et autres
Publié: (2025)
Universal Cross-Lingual Text Classification
par: Savant, Riya, et autres
Publié: (2024)
par: Savant, Riya, et autres
Publié: (2024)
The Saturation Point of Backtranslation in High Quality Low Resource English Gujarati Machine Translation
par: Arif, Arwa
Publié: (2025)
par: Arif, Arwa
Publié: (2025)
Cross-Lingual Consistency of Factual Knowledge in Multilingual Language Models
par: Qi, Jirui, et autres
Publié: (2023)
par: Qi, Jirui, et autres
Publié: (2023)
Evaluating Machine Translation Models for English-Hindi Language Pairs: A Comparative Analysis
par: Shetty, Ahan Prasannakumar
Publié: (2025)
par: Shetty, Ahan Prasannakumar
Publié: (2025)
CultureGuard: Towards Culturally-Aware Dataset and Guard Model for Multilingual Safety Applications
par: Joshi, Raviraj, et autres
Publié: (2025)
par: Joshi, Raviraj, et autres
Publié: (2025)
Multilingual LLMs Inherently Reward In-Language Time-Sensitive Semantic Alignment for Low-Resource Languages
par: Bajpai, Ashutosh, et autres
Publié: (2024)
par: Bajpai, Ashutosh, et autres
Publié: (2024)
Efficient Zero-Shot Long Document Classification by Reducing Context Through Sentence Ranking
par: Kokate, Prathamesh, et autres
Publié: (2025)
par: Kokate, Prathamesh, et autres
Publié: (2025)
On Importance of Code-Mixed Embeddings for Hate Speech Identification
par: Jagdale, Shruti, et autres
Publié: (2024)
par: Jagdale, Shruti, et autres
Publié: (2024)
Non-Contextual BERT or FastText? A Comparative Analysis
par: Shanbhag, Abhay, et autres
Publié: (2024)
par: Shanbhag, Abhay, et autres
Publié: (2024)
Documents similaires
-
L3Cube-IndicQuest: A Benchmark Question Answering Dataset for Evaluating Knowledge of LLMs in Indic Context
par: Rohera, Pritika, et autres
Publié: (2024) -
Challenges in Adapting Multilingual LLMs to Low-Resource Languages using LoRA PEFT Tuning
par: Khade, Omkar, et autres
Publié: (2024) -
Adapting Multilingual LLMs to Low-Resource Languages using Continued Pre-training and Synthetic Corpus
par: Joshi, Raviraj, et autres
Publié: (2024) -
Chain-of-Translation Prompting (CoTR): A Novel Prompting Technique for Low Resource Languages
par: Deshpande, Tejas, et autres
Publié: (2024) -
On Limitations of LLM as Annotator for Low Resource Languages
par: Jadhav, Suramya, et autres
Publié: (2024)