Benchmarking Hindi LLMs: A New Suite of Datasets and a Comparative Analysis
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kamath, Anusha, Singla, Kanishk, Paul, Rakesh, Joshi, Raviraj, Vaidya, Utkarsh, Chauhan, Sanjay Singh, Wartikar, Niranjan |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Aligning Large Language Models to Low-Resource Languages through LLM-Based Selective Translation: A Systematic Study
par: Paul, Rakesh, et autres
Publié: (2025)
par: Paul, Rakesh, et autres
Publié: (2025)
Adapting Multilingual LLMs to Low-Resource Languages using Continued Pre-training and Synthetic Corpus
par: Joshi, Raviraj, et autres
Publié: (2024)
par: Joshi, Raviraj, et autres
Publié: (2024)
CultureGuard: Towards Culturally-Aware Dataset and Guard Model for Multilingual Safety Applications
par: Joshi, Raviraj, et autres
Publié: (2025)
par: Joshi, Raviraj, et autres
Publié: (2025)
L3Cube-IndicQuest: A Benchmark Question Answering Dataset for Evaluating Knowledge of LLMs in Indic Context
par: Rohera, Pritika, et autres
Publié: (2024)
par: Rohera, Pritika, et autres
Publié: (2024)
L3Cube-MahaSTS: A Marathi Sentence Similarity Dataset and Models
par: Mirashi, Aishwarya, et autres
Publié: (2025)
par: Mirashi, Aishwarya, et autres
Publié: (2025)
L3Cube-MahaEmotions: A Marathi Emotion Recognition Dataset with Synthetic Annotations using CoTR prompting and Large Language Models
par: Kowtal, Nidhi, et autres
Publié: (2025)
par: Kowtal, Nidhi, et autres
Publié: (2025)
L3Cube-MahaNews: News-based Short Text and Long Document Classification Datasets in Marathi
par: Mittal, Saloni, et autres
Publié: (2024)
par: Mittal, Saloni, et autres
Publié: (2024)
L3Cube-IndicNews: News-based Short Text and Long Document Classification Datasets in Indic Languages
par: Mirashi, Aishwarya, et autres
Publié: (2024)
par: Mirashi, Aishwarya, et autres
Publié: (2024)
Non-Contextual BERT or FastText? A Comparative Analysis
par: Shanbhag, Abhay, et autres
Publié: (2024)
par: Shanbhag, Abhay, et autres
Publié: (2024)
Topic Modeling in Marathi
par: Shinde, Sanket, et autres
Publié: (2025)
par: Shinde, Sanket, et autres
Publié: (2025)
Better To Ask in English? Evaluating Factual Accuracy of Multilingual LLMs in English and Low-Resource Languages
par: Rohera, Pritika, et autres
Publié: (2025)
par: Rohera, Pritika, et autres
Publié: (2025)
IndicSQuAD: A Comprehensive Multilingual Question Answering Dataset for Indic Languages
par: Endait, Sharvi, et autres
Publié: (2025)
par: Endait, Sharvi, et autres
Publié: (2025)
Curating Stopwords in Marathi: A TF-IDF Approach for Improved Text Analysis and Information Retrieval
par: Chavan, Rohan, et autres
Publié: (2024)
par: Chavan, Rohan, et autres
Publié: (2024)
Uncertainty Quantification for Language Models: A Suite of Black-Box, White-Box, LLM Judge, and Ensemble Scorers
par: Bouchard, Dylan, et autres
Publié: (2025)
par: Bouchard, Dylan, et autres
Publié: (2025)
Challenges in Adapting Multilingual LLMs to Low-Resource Languages using LoRA PEFT Tuning
par: Khade, Omkar, et autres
Publié: (2024)
par: Khade, Omkar, et autres
Publié: (2024)
Chain-of-Translation Prompting (CoTR): A Novel Prompting Technique for Low Resource Languages
par: Deshpande, Tejas, et autres
Publié: (2024)
par: Deshpande, Tejas, et autres
Publié: (2024)
A Data Selection Approach for Enhancing Low Resource Machine Translation Using Cross-Lingual Sentence Representations
par: Kowtal, Nidhi, et autres
Publié: (2024)
par: Kowtal, Nidhi, et autres
Publié: (2024)
Towards Building Efficient Sentence BERT Models using Layer Pruning
par: Shelke, Anushka, et autres
Publié: (2024)
par: Shelke, Anushka, et autres
Publié: (2024)
L3Cube-MahaSum: A Comprehensive Dataset and BART Models for Abstractive Text Summarization in Marathi
par: Deshmukh, Pranita, et autres
Publié: (2024)
par: Deshmukh, Pranita, et autres
Publié: (2024)
Comparative Study of Pre-Trained BERT and Large Language Models for Code-Mixed Named Entity Recognition
par: Shirke, Mayur, et autres
Publié: (2025)
par: Shirke, Mayur, et autres
Publié: (2025)
L3Cube-MahaSocialNER: A Social Media based Marathi NER Dataset and BERT models
par: Chaudhari, Harsh, et autres
Publié: (2023)
par: Chaudhari, Harsh, et autres
Publié: (2023)
L3Cube-IndicHeadline-ID: A Dataset for Headline Identification and Semantic Evaluation in Low-Resource Indian Languages
par: Tanksale, Nishant, et autres
Publié: (2025)
par: Tanksale, Nishant, et autres
Publié: (2025)
Bifocal Attention: Harmonizing Geometric and Spectral Positional Embeddings for Algorithmic Generalization
par: Awadhiya, Kanishk
Publié: (2026)
par: Awadhiya, Kanishk
Publié: (2026)
Evaluating Machine Translation Models for English-Hindi Language Pairs: A Comparative Analysis
par: Shetty, Ahan Prasannakumar
Publié: (2025)
par: Shetty, Ahan Prasannakumar
Publié: (2025)
AnesSuite: A Comprehensive Benchmark and Dataset Suite for Anesthesiology Reasoning in LLMs
par: Feng, Xiang, et autres
Publié: (2025)
par: Feng, Xiang, et autres
Publié: (2025)
Improving the Efficiency of Long Document Classification using Sentence Ranking Approach
par: Kokate, Prathamesh, et autres
Publié: (2025)
par: Kokate, Prathamesh, et autres
Publié: (2025)
Samasāmayik: A Parallel Dataset for Hindi-Sanskrit Machine Translation
par: Karthika, N J, et autres
Publié: (2026)
par: Karthika, N J, et autres
Publié: (2026)
A Benchmark Suite of Reddit-Derived Datasets for Mental Health Detection
par: Hasan, Khalid, et autres
Publié: (2026)
par: Hasan, Khalid, et autres
Publié: (2026)
HindiLLM: Large Language Model for Hindi
par: Chouhan, Sanjay, et autres
Publié: (2024)
par: Chouhan, Sanjay, et autres
Publié: (2024)
FiMI: A Domain-Specific Language Model for Indian Finance Ecosystem
par: Kathar, Aboli, et autres
Publié: (2026)
par: Kathar, Aboli, et autres
Publié: (2026)
MahaParaphrase: A Marathi Paraphrase Detection Corpus and BERT-based Models
par: Jadhav, Suramya, et autres
Publié: (2025)
par: Jadhav, Suramya, et autres
Publié: (2025)
Universal Cross-Lingual Text Classification
par: Savant, Riya, et autres
Publié: (2024)
par: Savant, Riya, et autres
Publié: (2024)
On Importance of Code-Mixed Embeddings for Hate Speech Identification
par: Jagdale, Shruti, et autres
Publié: (2024)
par: Jagdale, Shruti, et autres
Publié: (2024)
Leveraging Parameter Efficient Training Methods for Low Resource Text Classification: A Case Study in Marathi
par: Deshmukh, Pranita, et autres
Publié: (2024)
par: Deshmukh, Pranita, et autres
Publié: (2024)
On Limitations of LLM as Annotator for Low Resource Languages
par: Jadhav, Suramya, et autres
Publié: (2024)
par: Jadhav, Suramya, et autres
Publié: (2024)
On Importance of Layer Pruning for Smaller BERT Models and Low Resource Languages
par: Shirke, Mayur, et autres
Publié: (2025)
par: Shirke, Mayur, et autres
Publié: (2025)
Efficient Zero-Shot Long Document Classification by Reducing Context Through Sentence Ranking
par: Kokate, Prathamesh, et autres
Publié: (2025)
par: Kokate, Prathamesh, et autres
Publié: (2025)
MahaSQuAD: Bridging Linguistic Divides in Marathi Question-Answering
par: Ghatage, Ruturaj, et autres
Publié: (2024)
par: Ghatage, Ruturaj, et autres
Publié: (2024)
AMNESIA: A Large Scale Medical Unlearning Benchmark Suite with Disease-Informed Analysis
par: Davoudi, Saeedeh, et autres
Publié: (2026)
par: Davoudi, Saeedeh, et autres
Publié: (2026)
HinTel-AlignBench: A Framework and Benchmark for Hindi-Telugu with English-Aligned Samples
par: Chigrupaatii, Rishikant, et autres
Publié: (2025)
par: Chigrupaatii, Rishikant, et autres
Publié: (2025)
Documents similaires
-
Aligning Large Language Models to Low-Resource Languages through LLM-Based Selective Translation: A Systematic Study
par: Paul, Rakesh, et autres
Publié: (2025) -
Adapting Multilingual LLMs to Low-Resource Languages using Continued Pre-training and Synthetic Corpus
par: Joshi, Raviraj, et autres
Publié: (2024) -
CultureGuard: Towards Culturally-Aware Dataset and Guard Model for Multilingual Safety Applications
par: Joshi, Raviraj, et autres
Publié: (2025) -
L3Cube-IndicQuest: A Benchmark Question Answering Dataset for Evaluating Knowledge of LLMs in Indic Context
par: Rohera, Pritika, et autres
Publié: (2024) -
L3Cube-MahaSTS: A Marathi Sentence Similarity Dataset and Models
par: Mirashi, Aishwarya, et autres
Publié: (2025)