Multilingual Language Models Encode Script Over Linguistic Structure
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Verma, Aastha A K, Chatterjee, Anwoy, Gupta, Mehak, Chakraborty, Tanmoy |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
POSIX: A Prompt Sensitivity Index For Large Language Models
par: Chatterjee, Anwoy, et autres
Publié: (2024)
par: Chatterjee, Anwoy, et autres
Publié: (2024)
HIDE and Seek: Detecting Hallucinations in Language Models via Decoupled Representations
par: Chatterjee, Anwoy, et autres
Publié: (2025)
par: Chatterjee, Anwoy, et autres
Publié: (2025)
On the Effect of Instruction Tuning Loss on Generalization
par: Chatterjee, Anwoy, et autres
Publié: (2025)
par: Chatterjee, Anwoy, et autres
Publié: (2025)
Robust and Efficient Fine-tuning of LLMs with Bayesian Reparameterization of Low-Rank Adaptation
par: Sengupta, Ayan, et autres
Publié: (2024)
par: Sengupta, Ayan, et autres
Publié: (2024)
Multilingual Needle in a Haystack: Investigating Long-Context Behavior of Multilingual Large Language Models
par: Hengle, Amey, et autres
Publié: (2024)
par: Hengle, Amey, et autres
Publié: (2024)
Language Models can Exploit Cross-Task In-context Learning for Data-Scarce Novel Tasks
par: Chatterjee, Anwoy, et autres
Publié: (2024)
par: Chatterjee, Anwoy, et autres
Publié: (2024)
Do You Know About My Nation? Investigating Multilingual Language Models' Cultural Literacy Through Factual Knowledge
par: Tanwar, Eshaan, et autres
Publié: (2025)
par: Tanwar, Eshaan, et autres
Publié: (2025)
Multilingual LLMs Inherently Reward In-Language Time-Sensitive Semantic Alignment for Low-Resource Languages
par: Bajpai, Ashutosh, et autres
Publié: (2024)
par: Bajpai, Ashutosh, et autres
Publié: (2024)
Persona-aware Generative Model for Code-mixed Language
par: Sengupta, Ayan, et autres
Publié: (2023)
par: Sengupta, Ayan, et autres
Publié: (2023)
Temporally Consistent Factuality Probing for Large Language Models
par: Bajpai, Ashutosh, et autres
Publié: (2024)
par: Bajpai, Ashutosh, et autres
Publié: (2024)
Personality Prediction from Life Stories using Language Models
par: Hussain, Rasiq, et autres
Publié: (2025)
par: Hussain, Rasiq, et autres
Publié: (2025)
Self-Evolved Preference Optimization for Enhancing Mathematical Reasoning in Small Language Models
par: Singh, Joykirat, et autres
Publié: (2025)
par: Singh, Joykirat, et autres
Publié: (2025)
IndicSentEval: How Effectively do Multilingual Transformer Models encode Linguistic Properties for Indic Languages?
par: Aravapalli, Akhilesh, et autres
Publié: (2024)
par: Aravapalli, Akhilesh, et autres
Publié: (2024)
Prompting with Phonemes: Enhancing LLMs' Multilinguality for Non-Latin Script Languages
par: Nguyen, Hoang H, et autres
Publié: (2024)
par: Nguyen, Hoang H, et autres
Publié: (2024)
Diversity Augmentation of Dynamic User Preference Data for Boosting Personalized Text Summarizers
par: Chatterjee, Parthiv, et autres
Publié: (2025)
par: Chatterjee, Parthiv, et autres
Publié: (2025)
On the Quantization Robustness of Diffusion Language Models in Coding Benchmarks
par: Gupta, Aarav, et autres
Publié: (2026)
par: Gupta, Aarav, et autres
Publié: (2026)
How to Upscale Neural Networks with Scaling Law? A Survey and Practical Guidelines
par: Sengupta, Ayan, et autres
Publié: (2025)
par: Sengupta, Ayan, et autres
Publié: (2025)
SABER: Uncovering Vulnerabilities in Safety Alignment via Cross-Layer Residual Connection
par: Joshi, Maithili, et autres
Publié: (2025)
par: Joshi, Maithili, et autres
Publié: (2025)
MYTE: Morphology-Driven Byte Encoding for Better and Fairer Multilingual Language Modeling
par: Limisiewicz, Tomasz, et autres
Publié: (2024)
par: Limisiewicz, Tomasz, et autres
Publié: (2024)
Latent Performance Profiling of Large Language Models
par: Chakraborty, Tanmoy, et autres
Publié: (2026)
par: Chakraborty, Tanmoy, et autres
Publié: (2026)
Equitable Electronic Health Record Prediction with FAME: Fairness-Aware Multimodal Embedding
par: Hooman, Nikkie, et autres
Publié: (2025)
par: Hooman, Nikkie, et autres
Publié: (2025)
MultiScript30k: Leveraging Multilingual Embeddings to Extend Cross Script Parallel Data
par: Driggers-Ellis, Christopher, et autres
Publié: (2025)
par: Driggers-Ellis, Christopher, et autres
Publié: (2025)
Linguistic properties and model scale in brain encoding: from small to compressed language models
par: Oota, Subba Reddy, et autres
Publié: (2026)
par: Oota, Subba Reddy, et autres
Publié: (2026)
URIEL+: Enhancing Linguistic Inclusion and Usability in a Typological and Multilingual Knowledge Base
par: Khan, Aditya, et autres
Publié: (2024)
par: Khan, Aditya, et autres
Publié: (2024)
How to think step-by-step: A mechanistic understanding of chain-of-thought reasoning
par: Dutta, Subhabrata, et autres
Publié: (2024)
par: Dutta, Subhabrata, et autres
Publié: (2024)
Linguistically-Informed Multilingual Instruction Tuning: Is There an Optimal Set of Languages to Tune?
par: Soykan, Gürkan, et autres
Publié: (2024)
par: Soykan, Gürkan, et autres
Publié: (2024)
NusaAksara: A Multimodal and Multilingual Benchmark for Preserving Indonesian Indigenous Scripts
par: Adilazuarda, Muhammad Farid, et autres
Publié: (2025)
par: Adilazuarda, Muhammad Farid, et autres
Publié: (2025)
Scaling Laws for Multilingual Language Models
par: He, Yifei, et autres
Publié: (2024)
par: He, Yifei, et autres
Publié: (2024)
Script Gap: Evaluating LLM Triage on Indian Languages in Native vs Romanized Scripts in a Real World Setting
par: Khullar, Manurag, et autres
Publié: (2025)
par: Khullar, Manurag, et autres
Publié: (2025)
Finetuning Language Models to Emit Linguistic Expressions of Uncertainty
par: Chaudhry, Arslan, et autres
Publié: (2024)
par: Chaudhry, Arslan, et autres
Publié: (2024)
Multilinguality of Large Language Models From a Structural Perspective
par: Sakajo, Haruki, et autres
Publié: (2026)
par: Sakajo, Haruki, et autres
Publié: (2026)
PerSEval: Assessing Personalization in Text Summarizers
par: Dasgupta, Sourish, et autres
Publié: (2024)
par: Dasgupta, Sourish, et autres
Publié: (2024)
Factual Consistency of Multilingual Pretrained Language Models
par: Fierro, Constanza, et autres
Publié: (2022)
par: Fierro, Constanza, et autres
Publié: (2022)
Are Large Language Models In-Context Personalized Summarizers? Get an iCOPERNICUS Test Done!
par: Patel, Divya, et autres
Publié: (2024)
par: Patel, Divya, et autres
Publié: (2024)
Task Structure Reverses Layerwise State Encoding in Sequence Models
par: Jiang, Yuhang
Publié: (2026)
par: Jiang, Yuhang
Publié: (2026)
Towards Linguistically-Aware and Language-Independent Tokenization for Large Language Models (LLMs)
par: Rahman, Abrar, et autres
Publié: (2024)
par: Rahman, Abrar, et autres
Publié: (2024)
Nile-Chat: Egyptian Language Models for Arabic and Latin Scripts
par: Shang, Guokan, et autres
Publié: (2025)
par: Shang, Guokan, et autres
Publié: (2025)
Synthetic Data Generation and Joint Learning for Robust Code-Mixed Translation
par: Kartik, Kartik, et autres
Publié: (2024)
par: Kartik, Kartik, et autres
Publié: (2024)
Improving Multilingual Instruction Finetuning via Linguistically Natural and Diverse Datasets
par: Indurthi, Sathish Reddy, et autres
Publié: (2024)
par: Indurthi, Sathish Reddy, et autres
Publié: (2024)
Investigating the Multilingual Calibration Effects of Language Model Instruction-Tuning
par: Huang, Jerry, et autres
Publié: (2026)
par: Huang, Jerry, et autres
Publié: (2026)
Documents similaires
-
POSIX: A Prompt Sensitivity Index For Large Language Models
par: Chatterjee, Anwoy, et autres
Publié: (2024) -
HIDE and Seek: Detecting Hallucinations in Language Models via Decoupled Representations
par: Chatterjee, Anwoy, et autres
Publié: (2025) -
On the Effect of Instruction Tuning Loss on Generalization
par: Chatterjee, Anwoy, et autres
Publié: (2025) -
Robust and Efficient Fine-tuning of LLMs with Bayesian Reparameterization of Low-Rank Adaptation
par: Sengupta, Ayan, et autres
Publié: (2024) -
Multilingual Needle in a Haystack: Investigating Long-Context Behavior of Multilingual Large Language Models
par: Hengle, Amey, et autres
Publié: (2024)