Guardado en:
| Autores principales: | Singh, Pooja, Kumar, Sandeep |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2512.04765 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Leveraging the Cross-Domain & Cross-Linguistic Corpus for Low Resource NMT: A Case Study On Bhili-Hindi-English Parallel Corpus
por: Singh, Pooja, et al.
Publicado: (2025)
por: Singh, Pooja, et al.
Publicado: (2025)
INDIC DIALECT: A Multi Task Benchmark to Evaluate and Translate in Indian Language Dialects
por: Sharma, Tarun, et al.
Publicado: (2026)
por: Sharma, Tarun, et al.
Publicado: (2026)
CorIL: Towards Enriching Indian Language to Indian Language Parallel Corpora and Machine Translation Systems
por: Bhattacharjee, Soham, et al.
Publicado: (2025)
por: Bhattacharjee, Soham, et al.
Publicado: (2025)
Sāmayik: A Benchmark and Dataset for English-Sanskrit Translation
por: Maheshwari, Ayush, et al.
Publicado: (2023)
por: Maheshwari, Ayush, et al.
Publicado: (2023)
Enhancing Entertainment Translation for Indian Languages using Adaptive Context, Style and LLMs
por: Singh, Pratik Rakesh, et al.
Publicado: (2024)
por: Singh, Pratik Rakesh, et al.
Publicado: (2024)
Statistical Machine Translation for Indic Languages
por: Das, Sudhansu Bala, et al.
Publicado: (2023)
por: Das, Sudhansu Bala, et al.
Publicado: (2023)
Machine Translation Advancements of Low-Resource Indian Languages by Transfer Learning
por: Wei, Bin, et al.
Publicado: (2024)
por: Wei, Bin, et al.
Publicado: (2024)
MILPaC: A Novel Benchmark for Evaluating Translation of Legal Text to Indian Languages
por: Mahapatra, Sayan, et al.
Publicado: (2023)
por: Mahapatra, Sayan, et al.
Publicado: (2023)
Revisiting Metric Reliability for Fine-grained Evaluation of Machine Translation and Summarization in Indian Languages
por: Yari, Amir Hossein, et al.
Publicado: (2025)
por: Yari, Amir Hossein, et al.
Publicado: (2025)
Culture-Aware Machine Translation in Large Language Models: Benchmarking and Investigation
por: Yuan, Zekun, et al.
Publicado: (2026)
por: Yuan, Zekun, et al.
Publicado: (2026)
Improving Multilingual Neural Machine Translation System for Indic Languages
por: Das, Sudhansu Bala, et al.
Publicado: (2022)
por: Das, Sudhansu Bala, et al.
Publicado: (2022)
Benchmarking Machine Translation with Cultural Awareness
por: Yao, Binwei, et al.
Publicado: (2023)
por: Yao, Binwei, et al.
Publicado: (2023)
SANSKRITI: A Comprehensive Benchmark for Evaluating Language Models' Knowledge of Indian Culture
por: Maji, Arijit, et al.
Publicado: (2025)
por: Maji, Arijit, et al.
Publicado: (2025)
Curated Datasets and Neural Models for Machine Translation of Informal Registers between Mayan and Spanish Vernaculars
por: Lou, Andrés, et al.
Publicado: (2024)
por: Lou, Andrés, et al.
Publicado: (2024)
Pragyaan: Designing and Curating High-Quality Cultural Post-Training Datasets for Indian Languages
por: Rachamalla, Neel Prabhanjan, et al.
Publicado: (2025)
por: Rachamalla, Neel Prabhanjan, et al.
Publicado: (2025)
Crosslingual Optimized Metric for Translation Assessment of Indian Languages
por: Ahsan, Arafat, et al.
Publicado: (2025)
por: Ahsan, Arafat, et al.
Publicado: (2025)
CODET: A Benchmark for Contrastive Dialectal Evaluation of Machine Translation
por: Alam, Md Mahfuz Ibn, et al.
Publicado: (2023)
por: Alam, Md Mahfuz Ibn, et al.
Publicado: (2023)
Benchmarking Machine Translation on Chinese Social Media Texts
por: Zhao, Kaiyan, et al.
Publicado: (2026)
por: Zhao, Kaiyan, et al.
Publicado: (2026)
CrossMed: A Multimodal Cross-Task Benchmark for Compositional Generalization in Medical Imaging
por: Singh, Pooja, et al.
Publicado: (2025)
por: Singh, Pooja, et al.
Publicado: (2025)
PBBQ: A Persian Bias Benchmark Dataset Curated with Human-AI Collaboration for Large Language Models
por: Farsi, Farhan, et al.
Publicado: (2025)
por: Farsi, Farhan, et al.
Publicado: (2025)
Benchmarking Automatic Speech Recognition for Indian Languages in Agricultural Contexts
por: S, Chandrashekar M, et al.
Publicado: (2026)
por: S, Chandrashekar M, et al.
Publicado: (2026)
Enhanced Sign Language Translation between American Sign Language (ASL) and Indian Sign Language (ISL) Using LLMs
por: Kumar, Malay, et al.
Publicado: (2024)
por: Kumar, Malay, et al.
Publicado: (2024)
Machine-Assisted Script Curation
por: Ciosici, Manuel R., et al.
Publicado: (2021)
por: Ciosici, Manuel R., et al.
Publicado: (2021)
Bridging the Linguistic Divide: A Survey on Leveraging Large Language Models for Machine Translation
por: Gain, Baban, et al.
Publicado: (2025)
por: Gain, Baban, et al.
Publicado: (2025)
Machine Translation for Ge'ez Language
por: Wassie, Aman Kassahun
Publicado: (2023)
por: Wassie, Aman Kassahun
Publicado: (2023)
Leveraging Machine Learning to Detect Data Curation Activities
por: Lafia, Sara, et al.
Publicado: (2021)
por: Lafia, Sara, et al.
Publicado: (2021)
CRAB: A Benchmark for Evaluating Curation of Retrieval-Augmented LLMs in Biomedicine
por: Zhong, Hanmeng, et al.
Publicado: (2025)
por: Zhong, Hanmeng, et al.
Publicado: (2025)
CaMMT: Benchmarking Culturally Aware Multimodal Machine Translation
por: Villa-Cueva, Emilio, et al.
Publicado: (2025)
por: Villa-Cueva, Emilio, et al.
Publicado: (2025)
TransBench: Benchmarking Machine Translation for Industrial-Scale Applications
por: Li, Haijun, et al.
Publicado: (2025)
por: Li, Haijun, et al.
Publicado: (2025)
Machine Translation Evaluation Benchmark for Wu Chinese: Workflow and Analysis
por: Yu, Hongjian, et al.
Publicado: (2024)
por: Yu, Hongjian, et al.
Publicado: (2024)
SynCED-EnDe 2025: A Synthetic and Curated English - German Dataset for Critical Error Detection in Machine Translation
por: Chopra, Muskaan, et al.
Publicado: (2025)
por: Chopra, Muskaan, et al.
Publicado: (2025)
IndicDB -- Benchmarking Multilingual Text-to-SQL Capabilities in Indian Languages
por: Dawar, Aviral, et al.
Publicado: (2026)
por: Dawar, Aviral, et al.
Publicado: (2026)
BhashaVerse : Translation Ecosystem for Indian Subcontinent Languages
por: Mujadia, Vandan, et al.
Publicado: (2024)
por: Mujadia, Vandan, et al.
Publicado: (2024)
Languages Still Left Behind: Toward a Better Multilingual Machine Translation Benchmark
por: Taguchi, Chihiro, et al.
Publicado: (2025)
por: Taguchi, Chihiro, et al.
Publicado: (2025)
DRISHTIKON: A Multimodal Multilingual Benchmark for Testing Language Models' Understanding on Indian Culture
por: Maji, Arijit, et al.
Publicado: (2025)
por: Maji, Arijit, et al.
Publicado: (2025)
From Hallucinations to Facts: Enhancing Language Models with Curated Knowledge Graphs
por: Joshi, Ratnesh Kumar, et al.
Publicado: (2024)
por: Joshi, Ratnesh Kumar, et al.
Publicado: (2024)
Curation of a Palaeohispanic Dataset for Machine Learning
por: Martínez-Fernández, Gonzalo, et al.
Publicado: (2026)
por: Martínez-Fernández, Gonzalo, et al.
Publicado: (2026)
SciCode: A Research Coding Benchmark Curated by Scientists
por: Tian, Minyang, et al.
Publicado: (2024)
por: Tian, Minyang, et al.
Publicado: (2024)
A Paradigm Shift in Machine Translation: Boosting Translation Performance of Large Language Models
por: Xu, Haoran, et al.
Publicado: (2023)
por: Xu, Haoran, et al.
Publicado: (2023)
Simultaneous Machine Translation with Large Language Models
por: Wang, Minghan, et al.
Publicado: (2023)
por: Wang, Minghan, et al.
Publicado: (2023)
Ejemplares similares
-
Leveraging the Cross-Domain & Cross-Linguistic Corpus for Low Resource NMT: A Case Study On Bhili-Hindi-English Parallel Corpus
por: Singh, Pooja, et al.
Publicado: (2025) -
INDIC DIALECT: A Multi Task Benchmark to Evaluate and Translate in Indian Language Dialects
por: Sharma, Tarun, et al.
Publicado: (2026) -
CorIL: Towards Enriching Indian Language to Indian Language Parallel Corpora and Machine Translation Systems
por: Bhattacharjee, Soham, et al.
Publicado: (2025) -
Sāmayik: A Benchmark and Dataset for English-Sanskrit Translation
por: Maheshwari, Ayush, et al.
Publicado: (2023) -
Enhancing Entertainment Translation for Indian Languages using Adaptive Context, Style and LLMs
por: Singh, Pratik Rakesh, et al.
Publicado: (2024)