ILID: Native Script Language Identification for Indian Languages
Fuente:
arXiv
Saved in:
| Main Authors: | Ingle, Yash, Mishra, Pruthwik |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Crosslingual Optimized Metric for Translation Assessment of Indian Languages
by: Ahsan, Arafat, et al.
Published: (2025)
by: Ahsan, Arafat, et al.
Published: (2025)
Towards Large Language Model driven Reference-less Translation Evaluation for English and Indian Languages
by: Mujadia, Vandan, et al.
Published: (2024)
by: Mujadia, Vandan, et al.
Published: (2024)
Fine-tuning Pre-trained Named Entity Recognition Models For Indian Languages
by: Bahad, Sankalp, et al.
Published: (2024)
by: Bahad, Sankalp, et al.
Published: (2024)
Script-Agnostic Language Identification
by: Agarwal, Milind, et al.
Published: (2024)
by: Agarwal, Milind, et al.
Published: (2024)
Script Gap: Evaluating LLM Triage on Indian Languages in Native vs Romanized Scripts in a Real World Setting
by: Khullar, Manurag, et al.
Published: (2025)
by: Khullar, Manurag, et al.
Published: (2025)
Text2TimeSeries: Enhancing Financial Forecasting through Time Series Prediction Updates with Event-Driven Insights from Large Language Models
by: Kurisinkel, Litton Jose, et al.
Published: (2024)
by: Kurisinkel, Litton Jose, et al.
Published: (2024)
"AGI" team at SHROOM-CAP: Data-Centric Approach to Multilingual Hallucination Detection using XLM-RoBERTa
by: Rathva, Harsh, et al.
Published: (2025)
by: Rathva, Harsh, et al.
Published: (2025)
No LLM is Free From Bias: A Comprehensive Study of Bias Evaluation in Large Language Models
by: Kumar, Charaka Vinayak, et al.
Published: (2025)
by: Kumar, Charaka Vinayak, et al.
Published: (2025)
IITR-CIOL@NLU of Devanagari Script Languages 2025: Multilingual Hate Speech Detection and Target Identification in Devanagari-Scripted Languages
by: Gupta, Siddhant, et al.
Published: (2024)
by: Gupta, Siddhant, et al.
Published: (2024)
Controllable Text Summarization: Unraveling Challenges, Approaches, and Prospects -- A Survey
by: Urlana, Ashok, et al.
Published: (2023)
by: Urlana, Ashok, et al.
Published: (2023)
Turkish Native Language Identification V2
by: Uluslu, Ahmet Yavuz, et al.
Published: (2023)
by: Uluslu, Ahmet Yavuz, et al.
Published: (2023)
CorIL: Towards Enriching Indian Language to Indian Language Parallel Corpora and Machine Translation Systems
by: Bhattacharjee, Soham, et al.
Published: (2025)
by: Bhattacharjee, Soham, et al.
Published: (2025)
Leveraging Open-Source Large Language Models for Native Language Identification
by: Ng, Yee Man, et al.
Published: (2024)
by: Ng, Yee Man, et al.
Published: (2024)
Robust Native Language Identification through Agentic Decomposition
by: Uluslu, Ahmet Yavuz, et al.
Published: (2025)
by: Uluslu, Ahmet Yavuz, et al.
Published: (2025)
One Language, Two Scripts: Probing Script-Invariance in LLM Concept Representations
by: Karne, Sripad
Published: (2026)
by: Karne, Sripad
Published: (2026)
Konkani LLM: Multi-Script Instruction Tuning and Evaluation for a Low-Resource Indian Language
by: Fernandes, Reuben Chagas, et al.
Published: (2026)
by: Fernandes, Reuben Chagas, et al.
Published: (2026)
Romanized to Native Malayalam Script Transliteration Using an Encoder-Decoder Framework
by: Baiju, Bajiyo, et al.
Published: (2024)
by: Baiju, Bajiyo, et al.
Published: (2024)
Script Sensitivity: Benchmarking Language Models on Unicode, Romanized and Mixed-Script Sinhala
by: Rajapakse, Minuri, et al.
Published: (2026)
by: Rajapakse, Minuri, et al.
Published: (2026)
MIXAR: Scaling Autoregressive Pixel-based Language Models to Multiple Languages and Scripts
by: Hu, Chen, et al.
Published: (2026)
by: Hu, Chen, et al.
Published: (2026)
LangSAMP: Language-Script Aware Multilingual Pretraining
by: Liu, Yihong, et al.
Published: (2024)
by: Liu, Yihong, et al.
Published: (2024)
I can tell whether you are a Native Hawlêri Speaker! How ANN, CNN, and RNN perform in NLI-Native Language Identification
by: Garari, Hardi, et al.
Published: (2026)
by: Garari, Hardi, et al.
Published: (2026)
LLMsAgainstHate @ NLU of Devanagari Script Languages 2025: Hate Speech Detection and Target Identification in Devanagari Languages via Parameter Efficient Fine-Tuning of LLMs
by: Sidibomma, Rushendra, et al.
Published: (2024)
by: Sidibomma, Rushendra, et al.
Published: (2024)
The Latin Substrate: How Language Models Represent and Mediate Script Choice
by: Gurgurov, Daniil, et al.
Published: (2026)
by: Gurgurov, Daniil, et al.
Published: (2026)
One Script Instead of Hundreds? On Pretraining Romanized Encoder Language Models
by: Ebing, Benedikt, et al.
Published: (2026)
by: Ebing, Benedikt, et al.
Published: (2026)
Native Design Bias: Studying the Impact of English Nativeness on Language Model Performance
by: Reusens, Manon, et al.
Published: (2024)
by: Reusens, Manon, et al.
Published: (2024)
Are Language Models Sensitive to Morally Irrelevant Distractors?
by: Shaw, Andrew, et al.
Published: (2026)
by: Shaw, Andrew, et al.
Published: (2026)
Estonian Native Large Language Model Benchmark
by: Lillepalu, Helena Grete, et al.
Published: (2025)
by: Lillepalu, Helena Grete, et al.
Published: (2025)
Simple Additions, Substantial Gains: Expanding Scripts, Languages, and Lineage Coverage in URIEL+
by: Shipton, Mason, et al.
Published: (2025)
by: Shipton, Mason, et al.
Published: (2025)
Multilingual Language Models Encode Script Over Linguistic Structure
by: Verma, Aastha A K, et al.
Published: (2026)
by: Verma, Aastha A K, et al.
Published: (2026)
Compute Where it Counts: Self Optimizing Language Models
by: Akhauri, Yash, et al.
Published: (2026)
by: Akhauri, Yash, et al.
Published: (2026)
Machine-Assisted Script Curation
by: Ciosici, Manuel R., et al.
Published: (2021)
by: Ciosici, Manuel R., et al.
Published: (2021)
Industrial Language-Image Dataset (ILID): Adapting Vision Foundation Models for Industrial Settings
by: Moenck, Keno, et al.
Published: (2024)
by: Moenck, Keno, et al.
Published: (2024)
The Impact of Editorial Intervention on Detecting Native Language Traces
by: Uluslu, Ahmet Yavuz, et al.
Published: (2026)
by: Uluslu, Ahmet Yavuz, et al.
Published: (2026)
GlotScript: A Resource and Tool for Low Resource Writing System Identification
by: Kargaran, Amir Hossein, et al.
Published: (2023)
by: Kargaran, Amir Hossein, et al.
Published: (2023)
The Role of Orthographic Consistency in Multilingual Embedding Models for Text Classification in Arabic-Script Languages
by: Abdullah, Abdulhady Abas, et al.
Published: (2025)
by: Abdullah, Abdulhady Abas, et al.
Published: (2025)
TUMLU: A Unified and Native Language Understanding Benchmark for Turkic Languages
by: Isbarov, Jafar, et al.
Published: (2025)
by: Isbarov, Jafar, et al.
Published: (2025)
DRISHTIKON: A Multimodal Multilingual Benchmark for Testing Language Models' Understanding on Indian Culture
by: Maji, Arijit, et al.
Published: (2025)
by: Maji, Arijit, et al.
Published: (2025)
Unknown Script: Impact of Script on Cross-Lingual Transfer
by: Tufa, Wondimagegnhue Tsegaye, et al.
Published: (2024)
by: Tufa, Wondimagegnhue Tsegaye, et al.
Published: (2024)
Evaluating Temporal Consistency in Multi-Turn Language Models
by: Atri, Yash Kumar, et al.
Published: (2026)
by: Atri, Yash Kumar, et al.
Published: (2026)
Diffusion Language Models Are Natively Length-Aware
by: Rossi, Vittorio, et al.
Published: (2026)
by: Rossi, Vittorio, et al.
Published: (2026)
Similar Items
-
Crosslingual Optimized Metric for Translation Assessment of Indian Languages
by: Ahsan, Arafat, et al.
Published: (2025) -
Towards Large Language Model driven Reference-less Translation Evaluation for English and Indian Languages
by: Mujadia, Vandan, et al.
Published: (2024) -
Fine-tuning Pre-trained Named Entity Recognition Models For Indian Languages
by: Bahad, Sankalp, et al.
Published: (2024) -
Script-Agnostic Language Identification
by: Agarwal, Milind, et al.
Published: (2024) -
Script Gap: Evaluating LLM Triage on Indian Languages in Native vs Romanized Scripts in a Real World Setting
by: Khullar, Manurag, et al.
Published: (2025)