LinguDistill: Recovering Linguistic Ability in Vision-Language Models via Selective Cross-Modal Distillation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Irawan, Patrick Amadeus, Fuadi, Erland Hilman, Kumar, Shanu, Aji, Alham Fikri, Kementchedjhieva, Yova |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Predicting the Order of Upcoming Tokens Improves Language Modeling
par: Zuhri, Zayd M. K., et autres
Publié: (2025)
par: Zuhri, Zayd M. K., et autres
Publié: (2025)
COPAL-ID: Indonesian Language Reasoning with Local Culture and Nuances
par: Wibowo, Haryo Akbarianto, et autres
Publié: (2023)
par: Wibowo, Haryo Akbarianto, et autres
Publié: (2023)
Softpick: No Attention Sink, No Massive Activations with Rectified Softmax
par: Zuhri, Zayd M. K., et autres
Publié: (2025)
par: Zuhri, Zayd M. K., et autres
Publié: (2025)
COPUS: Co-adaptive Parallelism and Batch Size Selection in Large Language Model Training
par: Sakip, Akhmed, et autres
Publié: (2026)
par: Sakip, Akhmed, et autres
Publié: (2026)
Vision Language Models are Confused Tourists
par: Irawan, Patrick Amadeus, et autres
Publié: (2025)
par: Irawan, Patrick Amadeus, et autres
Publié: (2025)
Extracting General-use Transformers for Low-resource Languages via Knowledge Distillation
par: Cruz, Jan Christian Blaise, et autres
Publié: (2025)
par: Cruz, Jan Christian Blaise, et autres
Publié: (2025)
LinguAlchemy: Fusing Typological and Geographical Elements for Unseen Language Generalization
par: Adilazuarda, Muhammad Farid, et autres
Publié: (2024)
par: Adilazuarda, Muhammad Farid, et autres
Publié: (2024)
Data Laundering: Artificially Boosting Benchmark Results through Knowledge Distillation
par: Mansurov, Jonibek, et autres
Publié: (2024)
par: Mansurov, Jonibek, et autres
Publié: (2024)
The Privileged Students: On the Value of Initialization in Multilingual Knowledge Distillation
par: Wibowo, Haryo Akbarianto, et autres
Publié: (2024)
par: Wibowo, Haryo Akbarianto, et autres
Publié: (2024)
LoraxBench: A Multitask, Multilingual Benchmark Suite for 20 Indonesian Languages
par: Aji, Alham Fikri, et autres
Publié: (2025)
par: Aji, Alham Fikri, et autres
Publié: (2025)
Language-Specific Latent Process Hinders Cross-Lingual Performance
par: Lim, Zheng Wei, et autres
Publié: (2025)
par: Lim, Zheng Wei, et autres
Publié: (2025)
The Devil is in the EOS: Sequence Training for Detailed Image Captioning
par: Mohamed, Abdelrahman, et autres
Publié: (2025)
par: Mohamed, Abdelrahman, et autres
Publié: (2025)
Entropy2Vec: Crosslingual Language Modeling Entropy as End-to-End Learnable Language Representations
par: Irawan, Patrick Amadeus, et autres
Publié: (2025)
par: Irawan, Patrick Amadeus, et autres
Publié: (2025)
Improving Low-Resource Machine Translation via Round-Trip Reinforcement Learning
par: Attia, Ahmed, et autres
Publié: (2026)
par: Attia, Ahmed, et autres
Publié: (2026)
Beyond Probabilities: Unveiling the Misalignment in Evaluating Large Language Models
par: Lyu, Chenyang, et autres
Publié: (2024)
par: Lyu, Chenyang, et autres
Publié: (2024)
Balanced Multi-Factor In-Context Learning for Multilingual Large Language Models
par: Kaneko, Masahiro, et autres
Publié: (2025)
par: Kaneko, Masahiro, et autres
Publié: (2025)
Daisy-TTS: Simulating Wider Spectrum of Emotions via Prosody Embedding Decomposition
par: Chevi, Rendi, et autres
Publié: (2024)
par: Chevi, Rendi, et autres
Publié: (2024)
LaMini-LM: A Diverse Herd of Distilled Models from Large-Scale Instructions
par: Wu, Minghao, et autres
Publié: (2023)
par: Wu, Minghao, et autres
Publié: (2023)
A Simple Data Augmentation Strategy for Text-in-Image Scientific VQA
par: Shoer, Belal, et autres
Publié: (2025)
par: Shoer, Belal, et autres
Publié: (2025)
EFSA: Episodic Few-Shot Adaptation for Text-to-Image Retrieval
par: Huzaifa, Muhammad, et autres
Publié: (2024)
par: Huzaifa, Muhammad, et autres
Publié: (2024)
Do Vision and Language Models Share Concepts? A Vector Space Alignment Study
par: Li, Jiaang, et autres
Publié: (2023)
par: Li, Jiaang, et autres
Publié: (2023)
SPECS: Specificity-Enhanced CLIP-Score for Long Image Caption Evaluation
par: Chen, Xiaofu, et autres
Publié: (2025)
par: Chen, Xiaofu, et autres
Publié: (2025)
Sense Representations Are Inducible Interfaces
par: Cruz, Jan Christian Blaise, et autres
Publié: (2026)
par: Cruz, Jan Christian Blaise, et autres
Publié: (2026)
LLM Olympiad: Why Model Evaluation Needs a Sealed Exam
par: Cruz, Jan Christian Blaise, et autres
Publié: (2026)
par: Cruz, Jan Christian Blaise, et autres
Publié: (2026)
Can Multimodal LLMs do Visual Temporal Understanding and Reasoning? The answer is No!
par: Imam, Mohamed Fazli, et autres
Publié: (2025)
par: Imam, Mohamed Fazli, et autres
Publié: (2025)
Towards Efficient and Robust VQA-NLE Data Generation with Large Vision-Language Models
par: Irawan, Patrick Amadeus, et autres
Publié: (2024)
par: Irawan, Patrick Amadeus, et autres
Publié: (2024)
CONCAP: Seeing Beyond English with Concepts Retrieval-Augmented Captioning
par: Ibrahim, George, et autres
Publié: (2025)
par: Ibrahim, George, et autres
Publié: (2025)
Answerability in Retrieval-Augmented Open-Domain Question Answering
par: Abdumalikov, Rustam, et autres
Publié: (2024)
par: Abdumalikov, Rustam, et autres
Publié: (2024)
How Individual Traits and Language Styles Shape Preferences In Open-ended User-LLM Interaction: A Preliminary Study
par: Chevi, Rendi, et autres
Publié: (2025)
par: Chevi, Rendi, et autres
Publié: (2025)
Long Story Short: Disentangling Compositionality and Long-Caption Understanding in Contrastive VLMs
par: Salazar, Israfel, et autres
Publié: (2025)
par: Salazar, Israfel, et autres
Publié: (2025)
Multimodal Large Language Models to Support Real-World Fact-Checking
par: Geng, Jiahui, et autres
Publié: (2024)
par: Geng, Jiahui, et autres
Publié: (2024)
Efficient and Interpretable Grammatical Error Correction with Mixture of Experts
par: Qorib, Muhammad Reza, et autres
Publié: (2024)
par: Qorib, Muhammad Reza, et autres
Publié: (2024)
Enabling Natural Zero-Shot Prompting on Encoder Models via Statement-Tuning
par: Elshabrawy, Ahmed, et autres
Publié: (2024)
par: Elshabrawy, Ahmed, et autres
Publié: (2024)
TextGames: Learning to Self-Play Text-Based Puzzle Games via Language Model Reasoning
par: Hudi, Frederikus, et autres
Publié: (2025)
par: Hudi, Frederikus, et autres
Publié: (2025)
Noise is an Efficient Learner for Zero-Shot Vision-Language Models
par: Imam, Raza, et autres
Publié: (2025)
par: Imam, Raza, et autres
Publié: (2025)
MuLan: A Study of Fact Mutability in Language Models
par: Fierro, Constanza, et autres
Publié: (2024)
par: Fierro, Constanza, et autres
Publié: (2024)
SEA-SafeguardBench: Evaluating AI Safety in SEA Languages and Cultures
par: Tasawong, Panuthep, et autres
Publié: (2025)
par: Tasawong, Panuthep, et autres
Publié: (2025)
Multilinguality as Sense Adaptation
par: Cruz, Jan Christian Blaise, et autres
Publié: (2026)
par: Cruz, Jan Christian Blaise, et autres
Publié: (2026)
QLESS: A Quantized Approach for Data Valuation and Selection in Large Language Model Fine-Tuning
par: Ananta, Moses, et autres
Publié: (2025)
par: Ananta, Moses, et autres
Publié: (2025)
A Discriminative Latent-Variable Model for Bilingual Lexicon Induction
par: Ruder, Sebastian, et autres
Publié: (2018)
par: Ruder, Sebastian, et autres
Publié: (2018)
Documents similaires
-
Predicting the Order of Upcoming Tokens Improves Language Modeling
par: Zuhri, Zayd M. K., et autres
Publié: (2025) -
COPAL-ID: Indonesian Language Reasoning with Local Culture and Nuances
par: Wibowo, Haryo Akbarianto, et autres
Publié: (2023) -
Softpick: No Attention Sink, No Massive Activations with Rectified Softmax
par: Zuhri, Zayd M. K., et autres
Publié: (2025) -
COPUS: Co-adaptive Parallelism and Batch Size Selection in Large Language Model Training
par: Sakip, Akhmed, et autres
Publié: (2026) -
Vision Language Models are Confused Tourists
par: Irawan, Patrick Amadeus, et autres
Publié: (2025)