MIXAR: Scaling Autoregressive Pixel-based Language Models to Multiple Languages and Scripts
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Hu, Chen, Tai, Yintao, Vergari, Antonio, Keller, Frank, Suglia, Alessandro |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
PIXAR: Auto-Regressive Language Modeling in Pixel Space
par: Tai, Yintao, et autres
Publié: (2024)
par: Tai, Yintao, et autres
Publié: (2024)
Repairs in a Block World: A New Benchmark for Handling User Corrections with Multi-Modal Language Models
par: Chiyah-Garcia, Javier, et autres
Publié: (2024)
par: Chiyah-Garcia, Javier, et autres
Publié: (2024)
One Script Instead of Hundreds? On Pretraining Romanized Encoder Language Models
par: Ebing, Benedikt, et autres
Publié: (2026)
par: Ebing, Benedikt, et autres
Publié: (2026)
Select and Summarize: Scene Saliency for Movie Script Summarization
par: Saxena, Rohit, et autres
Publié: (2024)
par: Saxena, Rohit, et autres
Publié: (2024)
FOSSIL: Harnessing Feedback on Suboptimal Samples for Data-Efficient Generalisation with Imitation Learning for Embodied Vision-and-Language Tasks
par: McCallum, Sabrina, et autres
Publié: (2025)
par: McCallum, Sabrina, et autres
Publié: (2025)
Towards Logically Consistent Language Models via Probabilistic Reasoning
par: Calanzone, Diego, et autres
Publié: (2024)
par: Calanzone, Diego, et autres
Publié: (2024)
CROPE: Evaluating In-Context Adaptation of Vision and Language Models to Culture-Specific Concepts
par: Nikandrou, Malvina, et autres
Publié: (2024)
par: Nikandrou, Malvina, et autres
Publié: (2024)
Logically Consistent Language Models via Neuro-Symbolic Integration
par: Calanzone, Diego, et autres
Publié: (2024)
par: Calanzone, Diego, et autres
Publié: (2024)
Enhancing Robustness of Autoregressive Language Models against Orthographic Attacks via Pixel-based Approach
par: Yang, Han, et autres
Publié: (2025)
par: Yang, Han, et autres
Publié: (2025)
Scaling Diffusion Language Models via Adaptation from Autoregressive Models
par: Gong, Shansan, et autres
Publié: (2024)
par: Gong, Shansan, et autres
Publié: (2024)
Does Visual Rendering Bypass Tokenization? Investigating Script-Tokenizer Misalignment in Pixel-Based Language Models
par: Susanto, Lucky, et autres
Publié: (2026)
par: Susanto, Lucky, et autres
Publié: (2026)
What can Large Language Models Capture about Code Functional Equivalence?
par: Maveli, Nickil, et autres
Publié: (2024)
par: Maveli, Nickil, et autres
Publié: (2024)
Script-Agnostic Language Identification
par: Agarwal, Milind, et autres
Publié: (2024)
par: Agarwal, Milind, et autres
Publié: (2024)
Causal Autoregressive Diffusion Language Model
par: Ruan, Junhao, et autres
Publié: (2026)
par: Ruan, Junhao, et autres
Publié: (2026)
Script Sensitivity: Benchmarking Language Models on Unicode, Romanized and Mixed-Script Sinhala
par: Rajapakse, Minuri, et autres
Publié: (2026)
par: Rajapakse, Minuri, et autres
Publié: (2026)
ILID: Native Script Language Identification for Indian Languages
par: Ingle, Yash, et autres
Publié: (2025)
par: Ingle, Yash, et autres
Publié: (2025)
Context Dependence and Reliability in Autoregressive Language Models
par: Sengupta, Poushali, et autres
Publié: (2026)
par: Sengupta, Poushali, et autres
Publié: (2026)
Pixology: Probing the Linguistic and Visual Capabilities of Pixel-based Language Models
par: Tatariya, Kushal, et autres
Publié: (2024)
par: Tatariya, Kushal, et autres
Publié: (2024)
Reversal Invariance in Autoregressive Language Models
par: Sahasrabudhe, Mihir
Publié: (2025)
par: Sahasrabudhe, Mihir
Publié: (2025)
One Language, Two Scripts: Probing Script-Invariance in LLM Concept Representations
par: Karne, Sripad
Publié: (2026)
par: Karne, Sripad
Publié: (2026)
AR-MAP: Are Autoregressive Large Language Models Implicit Teachers for Diffusion Large Language Models?
par: Lin, Liang, et autres
Publié: (2026)
par: Lin, Liang, et autres
Publié: (2026)
Autoregressive Pre-Training on Pixels and Texts
par: Chai, Yekun, et autres
Publié: (2024)
par: Chai, Yekun, et autres
Publié: (2024)
From Bytes to Ideas: Language Modeling with Autoregressive U-Nets
par: Videau, Mathurin, et autres
Publié: (2025)
par: Videau, Mathurin, et autres
Publié: (2025)
Learning To See But Forgetting To Follow: Visual Instruction Tuning Makes LLMs More Prone To Jailbreak Attacks
par: Pantazopoulos, Georgios, et autres
Publié: (2024)
par: Pantazopoulos, Georgios, et autres
Publié: (2024)
DPad: Efficient Diffusion Language Models with Suffix Dropout
par: Chen, Xinhua, et autres
Publié: (2025)
par: Chen, Xinhua, et autres
Publié: (2025)
Flexible Language Modeling in Continuous Space with Transformer-based Autoregressive Flows
par: Zhang, Ruixiang, et autres
Publié: (2025)
par: Zhang, Ruixiang, et autres
Publié: (2025)
Bidirectional Awareness Induction in Autoregressive Seq2Seq Models
par: Hu, Jia Cheng, et autres
Publié: (2024)
par: Hu, Jia Cheng, et autres
Publié: (2024)
IITR-CIOL@NLU of Devanagari Script Languages 2025: Multilingual Hate Speech Detection and Target Identification in Devanagari-Scripted Languages
par: Gupta, Siddhant, et autres
Publié: (2024)
par: Gupta, Siddhant, et autres
Publié: (2024)
Revisiting Knowledge Distillation for Autoregressive Language Models
par: Zhong, Qihuang, et autres
Publié: (2024)
par: Zhong, Qihuang, et autres
Publié: (2024)
Autoregressive Large Language Models are Computationally Universal
par: Schuurmans, Dale, et autres
Publié: (2024)
par: Schuurmans, Dale, et autres
Publié: (2024)
The Latin Substrate: How Language Models Represent and Mediate Script Choice
par: Gurgurov, Daniil, et autres
Publié: (2026)
par: Gurgurov, Daniil, et autres
Publié: (2026)
Multilingual Pretraining for Pixel Language Models
par: Kesen, Ilker, et autres
Publié: (2025)
par: Kesen, Ilker, et autres
Publié: (2025)
Simulated Annealing Enhances Theory-of-Mind Reasoning in Autoregressive Language Models
par: Hu, Xucong, et autres
Publié: (2026)
par: Hu, Xucong, et autres
Publié: (2026)
Investigating the Role of Instruction Variety and Task Difficulty in Robotic Manipulation Tasks
par: Parekh, Amit, et autres
Publié: (2024)
par: Parekh, Amit, et autres
Publié: (2024)
LangSAMP: Language-Script Aware Multilingual Pretraining
par: Liu, Yihong, et autres
Publié: (2024)
par: Liu, Yihong, et autres
Publié: (2024)
Multilingual Language Models Encode Script Over Linguistic Structure
par: Verma, Aastha A K, et autres
Publié: (2026)
par: Verma, Aastha A K, et autres
Publié: (2026)
Combining Autoregressive and Autoencoder Language Models for Text Classification
par: Gonçalves, João
Publié: (2024)
par: Gonçalves, João
Publié: (2024)
Continuous Autoregressive Language Models
par: Shao, Chenze, et autres
Publié: (2025)
par: Shao, Chenze, et autres
Publié: (2025)
Diffusion vs. Autoregressive Language Models: A Text Embedding Perspective
par: Zhang, Siyue, et autres
Publié: (2025)
par: Zhang, Siyue, et autres
Publié: (2025)
Differences in Text Generated by Diffusion and Autoregressive Language Models
par: Zhang, Zeyang, et autres
Publié: (2026)
par: Zhang, Zeyang, et autres
Publié: (2026)
Documents similaires
-
PIXAR: Auto-Regressive Language Modeling in Pixel Space
par: Tai, Yintao, et autres
Publié: (2024) -
Repairs in a Block World: A New Benchmark for Handling User Corrections with Multi-Modal Language Models
par: Chiyah-Garcia, Javier, et autres
Publié: (2024) -
One Script Instead of Hundreds? On Pretraining Romanized Encoder Language Models
par: Ebing, Benedikt, et autres
Publié: (2026) -
Select and Summarize: Scene Saliency for Movie Script Summarization
par: Saxena, Rohit, et autres
Publié: (2024) -
FOSSIL: Harnessing Feedback on Suboptimal Samples for Data-Efficient Generalisation with Imitation Learning for Embodied Vision-and-Language Tasks
par: McCallum, Sabrina, et autres
Publié: (2025)