Saved in:
| Main Authors: | Nehrdich, Sebastian, Allport, David, Sellmer, Sven, Sandhan, Jivnesh, Jagadeeshan, Manoj Balaji, Goyal, Pawan, Kumar, Sujeet, Keutzer, Kurt |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | https://arxiv.org/abs/2601.07314 |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
MITRA: A Large-Scale Parallel Corpus and Multilingual Pretrained Language Model for Machine Translation and Semantic Retrieval for Pāli, Sanskrit, Buddhist Chinese, and Tibetan
by: Nehrdich, Sebastian, et al.
Published: (2026)
by: Nehrdich, Sebastian, et al.
Published: (2026)
Anveshana: A New Benchmark Dataset for Cross-Lingual Information Retrieval On English Queries and Sanskrit Documents
by: Jagadeeshan, Manoj Balaji, et al.
Published: (2025)
by: Jagadeeshan, Manoj Balaji, et al.
Published: (2025)
Mahānāma: A Unique Testbed for Literary Entity Discovery and Linking
by: Sarkar, Sujoy, et al.
Published: (2025)
by: Sarkar, Sujoy, et al.
Published: (2025)
Still Not There: Can LLMs Outperform Smaller Task-Specific Seq2Seq Models on the Poetry-to-Prose Conversion Task?
by: Das, Kunal Kingkar, et al.
Published: (2025)
by: Das, Kunal Kingkar, et al.
Published: (2025)
Vedavani: A Benchmark Corpus for ASR on Vedic Sanskrit Poetry
by: Kumar, Sujeet, et al.
Published: (2025)
by: Kumar, Sujeet, et al.
Published: (2025)
One Model is All You Need: ByT5-Sanskrit, a Unified Model for Sanskrit NLP Tasks
by: Nehrdich, Sebastian, et al.
Published: (2024)
by: Nehrdich, Sebastian, et al.
Published: (2024)
PINGALA: Prosody-Aware Decoding for Sanskrit Poetry Generation
by: Jagadeeshan, Manoj Balaji, et al.
Published: (2026)
by: Jagadeeshan, Manoj Balaji, et al.
Published: (2026)
CSSL: Contrastive Self-Supervised Learning for Dependency Parsing on Relatively Free Word Ordered and Morphologically Rich Low Resource Languages
by: Ray, Pretam, et al.
Published: (2024)
by: Ray, Pretam, et al.
Published: (2024)
Chandomitra: Towards Generating Structured Sanskrit Poetry from Natural Language Inputs
by: Jagadeeshan, Manoj Balaji, et al.
Published: (2025)
by: Jagadeeshan, Manoj Balaji, et al.
Published: (2025)
CAPE: Context-Aware Personality Evaluation Framework for Large Language Models
by: Sandhan, Jivnesh, et al.
Published: (2025)
by: Sandhan, Jivnesh, et al.
Published: (2025)
Persona Jailbreaking in Large Language Models
by: Sandhan, Jivnesh, et al.
Published: (2026)
by: Sandhan, Jivnesh, et al.
Published: (2026)
Can We Trust LLM Detectors?
by: Sandhan, Jivnesh, et al.
Published: (2026)
by: Sandhan, Jivnesh, et al.
Published: (2026)
Samasāmayik: A Parallel Dataset for Hindi-Sanskrit Machine Translation
by: Karthika, N J, et al.
Published: (2026)
by: Karthika, N J, et al.
Published: (2026)
Sāmayik: A Benchmark and Dataset for English-Sanskrit Translation
by: Maheshwari, Ayush, et al.
Published: (2023)
by: Maheshwari, Ayush, et al.
Published: (2023)
Simple and Effective Input Reformulations for Translation
by: Yu, Brian, et al.
Published: (2023)
by: Yu, Brian, et al.
Published: (2023)
Breaking Token Into Concepts: Exploring Extreme Compression in Token Representation Via Compositional Shared Semantics
by: R V, Kavin, et al.
Published: (2025)
by: R V, Kavin, et al.
Published: (2025)
Neural Compound-Word (Sandhi) Generation and Splitting in Sanskrit Language
by: Dave, Sushant, et al.
Published: (2020)
by: Dave, Sushant, et al.
Published: (2020)
How Robust are the Tabular QA Models for Scientific Tables? A Study using Customized Dataset
by: Ghosh, Akash, et al.
Published: (2024)
by: Ghosh, Akash, et al.
Published: (2024)
A Benchmark Corpus and Neural Approach for Sanskrit Derivative Nouns Analysis
by: Singh, Arun Kumar, et al.
Published: (2020)
by: Singh, Arun Kumar, et al.
Published: (2020)
Error-Aware Curriculum Learning for Biomedical Relation Classification
by: Chakraborty, Sinchani, et al.
Published: (2025)
by: Chakraborty, Sinchani, et al.
Published: (2025)
Intent Detection and Entity Extraction from BioMedical Literature
by: Mullick, Ankan, et al.
Published: (2024)
by: Mullick, Ankan, et al.
Published: (2024)
Accent Placement Models for Rigvedic Sanskrit Text
by: P, Akhil Rajeev, et al.
Published: (2025)
by: P, Akhil Rajeev, et al.
Published: (2025)
YesBut: A High-Quality Annotated Multimodal Dataset for evaluating Satire Comprehension capability of Vision-Language Models
by: Nandy, Abhilash, et al.
Published: (2024)
by: Nandy, Abhilash, et al.
Published: (2024)
Automatic Speech Recognition for Sanskrit with Transfer Learning
by: Sadhukhan, Bidit, et al.
Published: (2025)
by: Sadhukhan, Bidit, et al.
Published: (2025)
Is Sanskrit the most token-efficient language? A quantitative study using GPT, Gemini, and SentencePiece
by: Kumar, Anshul
Published: (2026)
by: Kumar, Anshul
Published: (2026)
Transformer-Enabled Diachronic Analysis of Vedic Sanskrit: Neural Methods for Quantifying Types of Language Change
by: Hariharan, Ananth, et al.
Published: (2025)
by: Hariharan, Ananth, et al.
Published: (2025)
Sanskrit Knowledge-based Systems: Annotation and Computational Tools
by: Terdalkar, Hrishikesh
Published: (2024)
by: Terdalkar, Hrishikesh
Published: (2024)
Reviving Sanskrit: NEP's Role in India's Heritage
by: Pralay Sankar Adhikari
Published: (2025)
by: Pralay Sankar Adhikari
Published: (2025)
Data Augmentation for Maltese NLP using Transliterated and Machine Translated Arabic Data
by: Micallef, Kurt, et al.
Published: (2025)
by: Micallef, Kurt, et al.
Published: (2025)
ILSIC: Corpora for Identifying Indian Legal Statutes from Queries by Laypeople
by: Paul, Shounak, et al.
Published: (2026)
by: Paul, Shounak, et al.
Published: (2026)
EduVidQA: Generating and Evaluating Long-form Answers to Student Questions based on Lecture Videos
by: Ray, Sourjyadip, et al.
Published: (2025)
by: Ray, Sourjyadip, et al.
Published: (2025)
Order-Based Pre-training Strategies for Procedural Text Understanding
by: Nandy, Abhilash, et al.
Published: (2024)
by: Nandy, Abhilash, et al.
Published: (2024)
Text Takes Over: A Study of Modality Bias in Multimodal Intent Detection
by: Mullick, Ankan, et al.
Published: (2025)
by: Mullick, Ankan, et al.
Published: (2025)
Study of Example Based English to Sanskrit Machine Translation
by: Vimal Mishra
Published: (2008)
by: Vimal Mishra
Published: (2008)
ERVQA: A Dataset to Benchmark the Readiness of Large Vision Language Models in Hospital Environments
by: Ray, Sourjyadip, et al.
Published: (2024)
by: Ray, Sourjyadip, et al.
Published: (2024)
Abstractive Text Summarization for Contemporary Sanskrit Prose: Issues and Challenges
by: Sinha, Shagun
Published: (2025)
by: Sinha, Shagun
Published: (2025)
Characterizing Prompt Compression Methods for Long Context Inference
by: Jha, Siddharth, et al.
Published: (2024)
by: Jha, Siddharth, et al.
Published: (2024)
Instruct Large Language Models to Drive like Humans
by: Zhang, Ruijun, et al.
Published: (2024)
by: Zhang, Ruijun, et al.
Published: (2024)
Pragya: An AI-Based Semantic Recommendation System for Sanskrit Subhasitas
by: Raorane, Tanisha, et al.
Published: (2026)
by: Raorane, Tanisha, et al.
Published: (2026)
Salute the Classic: Revisiting Challenges of Machine Translation in the Age of Large Language Models
by: Pang, Jianhui, et al.
Published: (2024)
by: Pang, Jianhui, et al.
Published: (2024)
Similar Items
-
MITRA: A Large-Scale Parallel Corpus and Multilingual Pretrained Language Model for Machine Translation and Semantic Retrieval for Pāli, Sanskrit, Buddhist Chinese, and Tibetan
by: Nehrdich, Sebastian, et al.
Published: (2026) -
Anveshana: A New Benchmark Dataset for Cross-Lingual Information Retrieval On English Queries and Sanskrit Documents
by: Jagadeeshan, Manoj Balaji, et al.
Published: (2025) -
Mahānāma: A Unique Testbed for Literary Entity Discovery and Linking
by: Sarkar, Sujoy, et al.
Published: (2025) -
Still Not There: Can LLMs Outperform Smaller Task-Specific Seq2Seq Models on the Poetry-to-Prose Conversion Task?
by: Das, Kunal Kingkar, et al.
Published: (2025) -
Vedavani: A Benchmark Corpus for ASR on Vedic Sanskrit Poetry
by: Kumar, Sujeet, et al.
Published: (2025)