BhashaVerse : Translation Ecosystem for Indian Subcontinent Languages
Fuente:
arXiv
Saved in:
| Main Authors: | Mujadia, Vandan, Sharma, Dipti Misra |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Towards Large Language Model driven Reference-less Translation Evaluation for English and Indian Languages
by: Mujadia, Vandan, et al.
Published: (2024)
by: Mujadia, Vandan, et al.
Published: (2024)
Crosslingual Optimized Metric for Translation Assessment of Indian Languages
by: Ahsan, Arafat, et al.
Published: (2025)
by: Ahsan, Arafat, et al.
Published: (2025)
CorIL: Towards Enriching Indian Language to Indian Language Parallel Corpora and Machine Translation Systems
by: Bhattacharjee, Soham, et al.
Published: (2025)
by: Bhattacharjee, Soham, et al.
Published: (2025)
Rethinking Tokenization for Rich Morphology: The Dominance of Unigram over BPE and Morphological Alignment
by: Vemula, Saketh Reddy, et al.
Published: (2025)
by: Vemula, Saketh Reddy, et al.
Published: (2025)
BhashaKritika: Building Synthetic Pretraining Data at Scale for Indic Languages
by: Manoj, Guduru, et al.
Published: (2025)
by: Manoj, Guduru, et al.
Published: (2025)
Nwāchā Munā: A Devanagari Speech Corpus and Proximal Transfer Benchmark for Nepal Bhasha ASR
by: Sharma, Rishikesh Kumar, et al.
Published: (2026)
by: Sharma, Rishikesh Kumar, et al.
Published: (2026)
BhashaBench V1: A Comprehensive Benchmark for the Quadrant of Indic Domains
by: Devane, Vijay, et al.
Published: (2025)
by: Devane, Vijay, et al.
Published: (2025)
BhashaSetu: Cross-Lingual Knowledge Transfer from High-Resource to Extreme Low-Resource Languages
by: Maji, Subhadip, et al.
Published: (2026)
by: Maji, Subhadip, et al.
Published: (2026)
Machine Translation Advancements of Low-Resource Indian Languages by Transfer Learning
by: Wei, Bin, et al.
Published: (2024)
by: Wei, Bin, et al.
Published: (2024)
Shiksha: A Technical Domain focused Translation Dataset and Model for Indian Languages
by: Joglekar, Advait, et al.
Published: (2024)
by: Joglekar, Advait, et al.
Published: (2024)
MILPaC: A Novel Benchmark for Evaluating Translation of Legal Text to Indian Languages
by: Mahapatra, Sayan, et al.
Published: (2023)
by: Mahapatra, Sayan, et al.
Published: (2023)
Enhanced Sign Language Translation between American Sign Language (ASL) and Indian Sign Language (ISL) Using LLMs
by: Kumar, Malay, et al.
Published: (2024)
by: Kumar, Malay, et al.
Published: (2024)
Hey, wait a minute: on at-issue sensitivity in Language Models
by: Kim, Sanghee J., et al.
Published: (2025)
by: Kim, Sanghee J., et al.
Published: (2025)
FiMI: A Domain-Specific Language Model for Indian Finance Ecosystem
by: Kathar, Aboli, et al.
Published: (2026)
by: Kathar, Aboli, et al.
Published: (2026)
Lightweight Domain Adaptation of a Large Language Model for Legal Assistance in the Indian Context
by: Gupta, Jatin, et al.
Published: (2025)
by: Gupta, Jatin, et al.
Published: (2025)
HalluVerse25: Fine-grained Multilingual Benchmark Dataset for LLM Hallucinations
by: Abdaljalil, Samir, et al.
Published: (2025)
by: Abdaljalil, Samir, et al.
Published: (2025)
Experimental Contexts Can Facilitate Robust Semantic Property Inference in Language Models, but Inconsistently
by: Misra, Kanishka, et al.
Published: (2024)
by: Misra, Kanishka, et al.
Published: (2024)
Translate-and-Revise: Boosting Large Language Models for Constrained Translation
by: Huang, Pengcheng, et al.
Published: (2024)
by: Huang, Pengcheng, et al.
Published: (2024)
Everyday Speech in the Indian Subcontinent
by: P, Utkarsh
Published: (2024)
by: P, Utkarsh
Published: (2024)
Fine-tuning Pre-trained Named Entity Recognition Models For Indian Languages
by: Bahad, Sankalp, et al.
Published: (2024)
by: Bahad, Sankalp, et al.
Published: (2024)
An evaluation of LLMs and Google Translate for translation of selected Indian languages via sentiment and semantic analyses
by: Chandra, Rohitash, et al.
Published: (2025)
by: Chandra, Rohitash, et al.
Published: (2025)
A systematic framework for generating novel experimental hypotheses from language models
by: Misra, Kanishka, et al.
Published: (2024)
by: Misra, Kanishka, et al.
Published: (2024)
CellVerse: Do Large Language Models Really Understand Cell Biology?
by: Zhang, Fan, et al.
Published: (2025)
by: Zhang, Fan, et al.
Published: (2025)
Cross-Modal Taxonomic Generalization in (Vision-) Language Models
by: Xu, Tianyang, et al.
Published: (2026)
by: Xu, Tianyang, et al.
Published: (2026)
Language Models Learn Constructional Semantics, Not To Mention Syntax: Investigating LM Understanding of Paired-Focus Constructions
by: Scivetti, Wesley, et al.
Published: (2026)
by: Scivetti, Wesley, et al.
Published: (2026)
Beyond Specialization: Benchmarking LLMs for Transliteration of Indian Languages
by: Azam, Gulfarogh, et al.
Published: (2025)
by: Azam, Gulfarogh, et al.
Published: (2025)
Building Robust and Scalable Multilingual ASR for Indian Languages
by: Gangwar, Arjun, et al.
Published: (2025)
by: Gangwar, Arjun, et al.
Published: (2025)
Task Arithmetic for Language Expansion in Speech Translation
by: Cheng, Yao-Fei, et al.
Published: (2024)
by: Cheng, Yao-Fei, et al.
Published: (2024)
SignVerse-2M: A Two-Million-Clip Pose-Native Universe of 55+ Sign Languages
by: Fang, Sen, et al.
Published: (2026)
by: Fang, Sen, et al.
Published: (2026)
LLM-Supported Natural Language to Bash Translation
by: Westenfelder, Finnian, et al.
Published: (2025)
by: Westenfelder, Finnian, et al.
Published: (2025)
Iterative Translation Refinement with Large Language Models
by: Chen, Pinzhen, et al.
Published: (2023)
by: Chen, Pinzhen, et al.
Published: (2023)
Evaluating Tokenizer Performance of Large Language Models Across Official Indian Languages
by: Tamang, S., et al.
Published: (2024)
by: Tamang, S., et al.
Published: (2024)
Task-Lens: Cross-Task Utility Based Speech Dataset Profiling for Low-Resource Indian Languages
by: Sharma, Swati, et al.
Published: (2026)
by: Sharma, Swati, et al.
Published: (2026)
Transcending Language Boundaries: Harnessing LLMs for Low-Resource Language Translation
by: Shu, Peng, et al.
Published: (2024)
by: Shu, Peng, et al.
Published: (2024)
Indic-TunedLens: Interpreting Multilingual Models in Indian Languages
by: Panchal, Mihir, et al.
Published: (2026)
by: Panchal, Mihir, et al.
Published: (2026)
Using Language Models to Disambiguate Lexical Choices in Translation
by: Barua, Josh, et al.
Published: (2024)
by: Barua, Josh, et al.
Published: (2024)
Improving Symbolic Translation of Language Models for Logical Reasoning
by: Thatikonda, Ramya Keerthy, et al.
Published: (2026)
by: Thatikonda, Ramya Keerthy, et al.
Published: (2026)
Target-Side Paraphrase Augmentation for Sign Language Translation with Large Language Models
by: Bianco, Pedro Dal, et al.
Published: (2026)
by: Bianco, Pedro Dal, et al.
Published: (2026)
Vision-and-Language Training Helps Deploy Taxonomic Knowledge but Does Not Fundamentally Alter It
by: Qin, Yulu, et al.
Published: (2025)
by: Qin, Yulu, et al.
Published: (2025)
Paramanu: Compact and Competitive Monolingual Language Models for Low-Resource Morphologically Rich Indian Languages
by: Niyogi, Mitodru, et al.
Published: (2024)
by: Niyogi, Mitodru, et al.
Published: (2024)
Similar Items
-
Towards Large Language Model driven Reference-less Translation Evaluation for English and Indian Languages
by: Mujadia, Vandan, et al.
Published: (2024) -
Crosslingual Optimized Metric for Translation Assessment of Indian Languages
by: Ahsan, Arafat, et al.
Published: (2025) -
CorIL: Towards Enriching Indian Language to Indian Language Parallel Corpora and Machine Translation Systems
by: Bhattacharjee, Soham, et al.
Published: (2025) -
Rethinking Tokenization for Rich Morphology: The Dominance of Unigram over BPE and Morphological Alignment
by: Vemula, Saketh Reddy, et al.
Published: (2025) -
BhashaKritika: Building Synthetic Pretraining Data at Scale for Indic Languages
by: Manoj, Guduru, et al.
Published: (2025)