Multilingual Language Models Encode Script Over Linguistic Structure
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Verma, Aastha A K, Chatterjee, Anwoy, Gupta, Mehak, Chakraborty, Tanmoy |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
POSIX: A Prompt Sensitivity Index For Large Language Models
von: Chatterjee, Anwoy, et al.
Veröffentlicht: (2024)
von: Chatterjee, Anwoy, et al.
Veröffentlicht: (2024)
HIDE and Seek: Detecting Hallucinations in Language Models via Decoupled Representations
von: Chatterjee, Anwoy, et al.
Veröffentlicht: (2025)
von: Chatterjee, Anwoy, et al.
Veröffentlicht: (2025)
On the Effect of Instruction Tuning Loss on Generalization
von: Chatterjee, Anwoy, et al.
Veröffentlicht: (2025)
von: Chatterjee, Anwoy, et al.
Veröffentlicht: (2025)
Robust and Efficient Fine-tuning of LLMs with Bayesian Reparameterization of Low-Rank Adaptation
von: Sengupta, Ayan, et al.
Veröffentlicht: (2024)
von: Sengupta, Ayan, et al.
Veröffentlicht: (2024)
Multilingual Needle in a Haystack: Investigating Long-Context Behavior of Multilingual Large Language Models
von: Hengle, Amey, et al.
Veröffentlicht: (2024)
von: Hengle, Amey, et al.
Veröffentlicht: (2024)
Language Models can Exploit Cross-Task In-context Learning for Data-Scarce Novel Tasks
von: Chatterjee, Anwoy, et al.
Veröffentlicht: (2024)
von: Chatterjee, Anwoy, et al.
Veröffentlicht: (2024)
Do You Know About My Nation? Investigating Multilingual Language Models' Cultural Literacy Through Factual Knowledge
von: Tanwar, Eshaan, et al.
Veröffentlicht: (2025)
von: Tanwar, Eshaan, et al.
Veröffentlicht: (2025)
Multilingual LLMs Inherently Reward In-Language Time-Sensitive Semantic Alignment for Low-Resource Languages
von: Bajpai, Ashutosh, et al.
Veröffentlicht: (2024)
von: Bajpai, Ashutosh, et al.
Veröffentlicht: (2024)
Persona-aware Generative Model for Code-mixed Language
von: Sengupta, Ayan, et al.
Veröffentlicht: (2023)
von: Sengupta, Ayan, et al.
Veröffentlicht: (2023)
Temporally Consistent Factuality Probing for Large Language Models
von: Bajpai, Ashutosh, et al.
Veröffentlicht: (2024)
von: Bajpai, Ashutosh, et al.
Veröffentlicht: (2024)
Personality Prediction from Life Stories using Language Models
von: Hussain, Rasiq, et al.
Veröffentlicht: (2025)
von: Hussain, Rasiq, et al.
Veröffentlicht: (2025)
Self-Evolved Preference Optimization for Enhancing Mathematical Reasoning in Small Language Models
von: Singh, Joykirat, et al.
Veröffentlicht: (2025)
von: Singh, Joykirat, et al.
Veröffentlicht: (2025)
IndicSentEval: How Effectively do Multilingual Transformer Models encode Linguistic Properties for Indic Languages?
von: Aravapalli, Akhilesh, et al.
Veröffentlicht: (2024)
von: Aravapalli, Akhilesh, et al.
Veröffentlicht: (2024)
Diversity Augmentation of Dynamic User Preference Data for Boosting Personalized Text Summarizers
von: Chatterjee, Parthiv, et al.
Veröffentlicht: (2025)
von: Chatterjee, Parthiv, et al.
Veröffentlicht: (2025)
Prompting with Phonemes: Enhancing LLMs' Multilinguality for Non-Latin Script Languages
von: Nguyen, Hoang H, et al.
Veröffentlicht: (2024)
von: Nguyen, Hoang H, et al.
Veröffentlicht: (2024)
On the Quantization Robustness of Diffusion Language Models in Coding Benchmarks
von: Gupta, Aarav, et al.
Veröffentlicht: (2026)
von: Gupta, Aarav, et al.
Veröffentlicht: (2026)
How to Upscale Neural Networks with Scaling Law? A Survey and Practical Guidelines
von: Sengupta, Ayan, et al.
Veröffentlicht: (2025)
von: Sengupta, Ayan, et al.
Veröffentlicht: (2025)
SABER: Uncovering Vulnerabilities in Safety Alignment via Cross-Layer Residual Connection
von: Joshi, Maithili, et al.
Veröffentlicht: (2025)
von: Joshi, Maithili, et al.
Veröffentlicht: (2025)
MYTE: Morphology-Driven Byte Encoding for Better and Fairer Multilingual Language Modeling
von: Limisiewicz, Tomasz, et al.
Veröffentlicht: (2024)
von: Limisiewicz, Tomasz, et al.
Veröffentlicht: (2024)
Latent Performance Profiling of Large Language Models
von: Chakraborty, Tanmoy, et al.
Veröffentlicht: (2026)
von: Chakraborty, Tanmoy, et al.
Veröffentlicht: (2026)
Equitable Electronic Health Record Prediction with FAME: Fairness-Aware Multimodal Embedding
von: Hooman, Nikkie, et al.
Veröffentlicht: (2025)
von: Hooman, Nikkie, et al.
Veröffentlicht: (2025)
MultiScript30k: Leveraging Multilingual Embeddings to Extend Cross Script Parallel Data
von: Driggers-Ellis, Christopher, et al.
Veröffentlicht: (2025)
von: Driggers-Ellis, Christopher, et al.
Veröffentlicht: (2025)
Linguistic properties and model scale in brain encoding: from small to compressed language models
von: Oota, Subba Reddy, et al.
Veröffentlicht: (2026)
von: Oota, Subba Reddy, et al.
Veröffentlicht: (2026)
URIEL+: Enhancing Linguistic Inclusion and Usability in a Typological and Multilingual Knowledge Base
von: Khan, Aditya, et al.
Veröffentlicht: (2024)
von: Khan, Aditya, et al.
Veröffentlicht: (2024)
How to think step-by-step: A mechanistic understanding of chain-of-thought reasoning
von: Dutta, Subhabrata, et al.
Veröffentlicht: (2024)
von: Dutta, Subhabrata, et al.
Veröffentlicht: (2024)
Linguistically-Informed Multilingual Instruction Tuning: Is There an Optimal Set of Languages to Tune?
von: Soykan, Gürkan, et al.
Veröffentlicht: (2024)
von: Soykan, Gürkan, et al.
Veröffentlicht: (2024)
NusaAksara: A Multimodal and Multilingual Benchmark for Preserving Indonesian Indigenous Scripts
von: Adilazuarda, Muhammad Farid, et al.
Veröffentlicht: (2025)
von: Adilazuarda, Muhammad Farid, et al.
Veröffentlicht: (2025)
Scaling Laws for Multilingual Language Models
von: He, Yifei, et al.
Veröffentlicht: (2024)
von: He, Yifei, et al.
Veröffentlicht: (2024)
Script Gap: Evaluating LLM Triage on Indian Languages in Native vs Romanized Scripts in a Real World Setting
von: Khullar, Manurag, et al.
Veröffentlicht: (2025)
von: Khullar, Manurag, et al.
Veröffentlicht: (2025)
Finetuning Language Models to Emit Linguistic Expressions of Uncertainty
von: Chaudhry, Arslan, et al.
Veröffentlicht: (2024)
von: Chaudhry, Arslan, et al.
Veröffentlicht: (2024)
Multilinguality of Large Language Models From a Structural Perspective
von: Sakajo, Haruki, et al.
Veröffentlicht: (2026)
von: Sakajo, Haruki, et al.
Veröffentlicht: (2026)
PerSEval: Assessing Personalization in Text Summarizers
von: Dasgupta, Sourish, et al.
Veröffentlicht: (2024)
von: Dasgupta, Sourish, et al.
Veröffentlicht: (2024)
Factual Consistency of Multilingual Pretrained Language Models
von: Fierro, Constanza, et al.
Veröffentlicht: (2022)
von: Fierro, Constanza, et al.
Veröffentlicht: (2022)
Are Large Language Models In-Context Personalized Summarizers? Get an iCOPERNICUS Test Done!
von: Patel, Divya, et al.
Veröffentlicht: (2024)
von: Patel, Divya, et al.
Veröffentlicht: (2024)
Task Structure Reverses Layerwise State Encoding in Sequence Models
von: Jiang, Yuhang
Veröffentlicht: (2026)
von: Jiang, Yuhang
Veröffentlicht: (2026)
Towards Linguistically-Aware and Language-Independent Tokenization for Large Language Models (LLMs)
von: Rahman, Abrar, et al.
Veröffentlicht: (2024)
von: Rahman, Abrar, et al.
Veröffentlicht: (2024)
Nile-Chat: Egyptian Language Models for Arabic and Latin Scripts
von: Shang, Guokan, et al.
Veröffentlicht: (2025)
von: Shang, Guokan, et al.
Veröffentlicht: (2025)
Synthetic Data Generation and Joint Learning for Robust Code-Mixed Translation
von: Kartik, Kartik, et al.
Veröffentlicht: (2024)
von: Kartik, Kartik, et al.
Veröffentlicht: (2024)
Improving Multilingual Instruction Finetuning via Linguistically Natural and Diverse Datasets
von: Indurthi, Sathish Reddy, et al.
Veröffentlicht: (2024)
von: Indurthi, Sathish Reddy, et al.
Veröffentlicht: (2024)
Investigating the Multilingual Calibration Effects of Language Model Instruction-Tuning
von: Huang, Jerry, et al.
Veröffentlicht: (2026)
von: Huang, Jerry, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
POSIX: A Prompt Sensitivity Index For Large Language Models
von: Chatterjee, Anwoy, et al.
Veröffentlicht: (2024) -
HIDE and Seek: Detecting Hallucinations in Language Models via Decoupled Representations
von: Chatterjee, Anwoy, et al.
Veröffentlicht: (2025) -
On the Effect of Instruction Tuning Loss on Generalization
von: Chatterjee, Anwoy, et al.
Veröffentlicht: (2025) -
Robust and Efficient Fine-tuning of LLMs with Bayesian Reparameterization of Low-Rank Adaptation
von: Sengupta, Ayan, et al.
Veröffentlicht: (2024) -
Multilingual Needle in a Haystack: Investigating Long-Context Behavior of Multilingual Large Language Models
von: Hengle, Amey, et al.
Veröffentlicht: (2024)