AdiBhashaa: A Community-Curated Benchmark for Machine Translation into Indian Tribal Languages
Fuente:
arXiv
Saved in:
| Main Authors: | Singh, Pooja, Kumar, Sandeep |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Leveraging the Cross-Domain & Cross-Linguistic Corpus for Low Resource NMT: A Case Study On Bhili-Hindi-English Parallel Corpus
by: Singh, Pooja, et al.
Published: (2025)
by: Singh, Pooja, et al.
Published: (2025)
INDIC DIALECT: A Multi Task Benchmark to Evaluate and Translate in Indian Language Dialects
by: Sharma, Tarun, et al.
Published: (2026)
by: Sharma, Tarun, et al.
Published: (2026)
CorIL: Towards Enriching Indian Language to Indian Language Parallel Corpora and Machine Translation Systems
by: Bhattacharjee, Soham, et al.
Published: (2025)
by: Bhattacharjee, Soham, et al.
Published: (2025)
Enhancing Entertainment Translation for Indian Languages using Adaptive Context, Style and LLMs
by: Singh, Pratik Rakesh, et al.
Published: (2024)
by: Singh, Pratik Rakesh, et al.
Published: (2024)
Sāmayik: A Benchmark and Dataset for English-Sanskrit Translation
by: Maheshwari, Ayush, et al.
Published: (2023)
by: Maheshwari, Ayush, et al.
Published: (2023)
Statistical Machine Translation for Indic Languages
by: Das, Sudhansu Bala, et al.
Published: (2023)
by: Das, Sudhansu Bala, et al.
Published: (2023)
Machine Translation Advancements of Low-Resource Indian Languages by Transfer Learning
by: Wei, Bin, et al.
Published: (2024)
by: Wei, Bin, et al.
Published: (2024)
Revisiting Metric Reliability for Fine-grained Evaluation of Machine Translation and Summarization in Indian Languages
by: Yari, Amir Hossein, et al.
Published: (2025)
by: Yari, Amir Hossein, et al.
Published: (2025)
Culture-Aware Machine Translation in Large Language Models: Benchmarking and Investigation
by: Yuan, Zekun, et al.
Published: (2026)
by: Yuan, Zekun, et al.
Published: (2026)
MILPaC: A Novel Benchmark for Evaluating Translation of Legal Text to Indian Languages
by: Mahapatra, Sayan, et al.
Published: (2023)
by: Mahapatra, Sayan, et al.
Published: (2023)
Benchmarking Machine Translation with Cultural Awareness
by: Yao, Binwei, et al.
Published: (2023)
by: Yao, Binwei, et al.
Published: (2023)
Improving Multilingual Neural Machine Translation System for Indic Languages
by: Das, Sudhansu Bala, et al.
Published: (2022)
by: Das, Sudhansu Bala, et al.
Published: (2022)
SANSKRITI: A Comprehensive Benchmark for Evaluating Language Models' Knowledge of Indian Culture
by: Maji, Arijit, et al.
Published: (2025)
by: Maji, Arijit, et al.
Published: (2025)
Curated Datasets and Neural Models for Machine Translation of Informal Registers between Mayan and Spanish Vernaculars
by: Lou, Andrés, et al.
Published: (2024)
by: Lou, Andrés, et al.
Published: (2024)
Crosslingual Optimized Metric for Translation Assessment of Indian Languages
by: Ahsan, Arafat, et al.
Published: (2025)
by: Ahsan, Arafat, et al.
Published: (2025)
CODET: A Benchmark for Contrastive Dialectal Evaluation of Machine Translation
by: Alam, Md Mahfuz Ibn, et al.
Published: (2023)
by: Alam, Md Mahfuz Ibn, et al.
Published: (2023)
Pragyaan: Designing and Curating High-Quality Cultural Post-Training Datasets for Indian Languages
by: Rachamalla, Neel Prabhanjan, et al.
Published: (2025)
by: Rachamalla, Neel Prabhanjan, et al.
Published: (2025)
Benchmarking Machine Translation on Chinese Social Media Texts
by: Zhao, Kaiyan, et al.
Published: (2026)
by: Zhao, Kaiyan, et al.
Published: (2026)
PBBQ: A Persian Bias Benchmark Dataset Curated with Human-AI Collaboration for Large Language Models
by: Farsi, Farhan, et al.
Published: (2025)
by: Farsi, Farhan, et al.
Published: (2025)
Machine Translation for Ge'ez Language
by: Wassie, Aman Kassahun
Published: (2023)
by: Wassie, Aman Kassahun
Published: (2023)
CRAB: A Benchmark for Evaluating Curation of Retrieval-Augmented LLMs in Biomedicine
by: Zhong, Hanmeng, et al.
Published: (2025)
by: Zhong, Hanmeng, et al.
Published: (2025)
CaMMT: Benchmarking Culturally Aware Multimodal Machine Translation
by: Villa-Cueva, Emilio, et al.
Published: (2025)
by: Villa-Cueva, Emilio, et al.
Published: (2025)
TransBench: Benchmarking Machine Translation for Industrial-Scale Applications
by: Li, Haijun, et al.
Published: (2025)
by: Li, Haijun, et al.
Published: (2025)
Machine Translation Evaluation Benchmark for Wu Chinese: Workflow and Analysis
by: Yu, Hongjian, et al.
Published: (2024)
by: Yu, Hongjian, et al.
Published: (2024)
Enhanced Sign Language Translation between American Sign Language (ASL) and Indian Sign Language (ISL) Using LLMs
by: Kumar, Malay, et al.
Published: (2024)
by: Kumar, Malay, et al.
Published: (2024)
Leveraging Machine Learning to Detect Data Curation Activities
by: Lafia, Sara, et al.
Published: (2021)
by: Lafia, Sara, et al.
Published: (2021)
Bridging the Linguistic Divide: A Survey on Leveraging Large Language Models for Machine Translation
by: Gain, Baban, et al.
Published: (2025)
by: Gain, Baban, et al.
Published: (2025)
Languages Still Left Behind: Toward a Better Multilingual Machine Translation Benchmark
by: Taguchi, Chihiro, et al.
Published: (2025)
by: Taguchi, Chihiro, et al.
Published: (2025)
DRISHTIKON: A Multimodal Multilingual Benchmark for Testing Language Models' Understanding on Indian Culture
by: Maji, Arijit, et al.
Published: (2025)
by: Maji, Arijit, et al.
Published: (2025)
SynCED-EnDe 2025: A Synthetic and Curated English - German Dataset for Critical Error Detection in Machine Translation
by: Chopra, Muskaan, et al.
Published: (2025)
by: Chopra, Muskaan, et al.
Published: (2025)
Machine-Assisted Script Curation
by: Ciosici, Manuel R., et al.
Published: (2021)
by: Ciosici, Manuel R., et al.
Published: (2021)
BhashaVerse : Translation Ecosystem for Indian Subcontinent Languages
by: Mujadia, Vandan, et al.
Published: (2024)
by: Mujadia, Vandan, et al.
Published: (2024)
A Paradigm Shift in Machine Translation: Boosting Translation Performance of Large Language Models
by: Xu, Haoran, et al.
Published: (2023)
by: Xu, Haoran, et al.
Published: (2023)
Benchmarking Automatic Speech Recognition for Indian Languages in Agricultural Contexts
by: S, Chandrashekar M, et al.
Published: (2026)
by: S, Chandrashekar M, et al.
Published: (2026)
IndicDB -- Benchmarking Multilingual Text-to-SQL Capabilities in Indian Languages
by: Dawar, Aviral, et al.
Published: (2026)
by: Dawar, Aviral, et al.
Published: (2026)
Simultaneous Machine Translation with Large Language Models
by: Wang, Minghan, et al.
Published: (2023)
by: Wang, Minghan, et al.
Published: (2023)
"Be My Cheese?": Cultural Nuance Benchmarking for Machine Translation in Multilingual LLMs
by: Van Doren, Madison, et al.
Published: (2026)
by: Van Doren, Madison, et al.
Published: (2026)
From Hallucinations to Facts: Enhancing Language Models with Curated Knowledge Graphs
by: Joshi, Ratnesh Kumar, et al.
Published: (2024)
by: Joshi, Ratnesh Kumar, et al.
Published: (2024)
Curation of a Palaeohispanic Dataset for Machine Learning
by: Martínez-Fernández, Gonzalo, et al.
Published: (2026)
by: Martínez-Fernández, Gonzalo, et al.
Published: (2026)
SciCode: A Research Coding Benchmark Curated by Scientists
by: Tian, Minyang, et al.
Published: (2024)
by: Tian, Minyang, et al.
Published: (2024)
Similar Items
-
Leveraging the Cross-Domain & Cross-Linguistic Corpus for Low Resource NMT: A Case Study On Bhili-Hindi-English Parallel Corpus
by: Singh, Pooja, et al.
Published: (2025) -
INDIC DIALECT: A Multi Task Benchmark to Evaluate and Translate in Indian Language Dialects
by: Sharma, Tarun, et al.
Published: (2026) -
CorIL: Towards Enriching Indian Language to Indian Language Parallel Corpora and Machine Translation Systems
by: Bhattacharjee, Soham, et al.
Published: (2025) -
Enhancing Entertainment Translation for Indian Languages using Adaptive Context, Style and LLMs
by: Singh, Pratik Rakesh, et al.
Published: (2024) -
Sāmayik: A Benchmark and Dataset for English-Sanskrit Translation
by: Maheshwari, Ayush, et al.
Published: (2023)