Multilingual Training and Evaluation Resources for Vision-Language Models
Fuente:
arXiv
Saved in:
| Main Authors: | Baiamonte, Daniela, Fano, Elena, Gabburo, Matteo, Simonazzi, Stefano, Rigutini, Leonardo, Zugarini, Andrea |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Fast Vocabulary Transfer for Language Model Compression
by: Gee, Leonidas, et al.
Published: (2024)
by: Gee, Leonidas, et al.
Published: (2024)
An energy-based comparative analysis of common approaches to text classification in the Legal domain
by: Gultekin, Sinan, et al.
Published: (2023)
by: Gultekin, Sinan, et al.
Published: (2023)
Clue-Instruct: Text-Based Clue Generation for Educational Crossword Puzzles
by: Zugarini, Andrea, et al.
Published: (2024)
by: Zugarini, Andrea, et al.
Published: (2024)
SLIMER-IT: Zero-Shot NER on Italian Language
by: Zamai, Andrew, et al.
Published: (2024)
by: Zamai, Andrew, et al.
Published: (2024)
Measuring Retrieval Complexity in Question Answering Systems
by: Gabburo, Matteo, et al.
Published: (2024)
by: Gabburo, Matteo, et al.
Published: (2024)
Protoknowledge Shapes Behaviour of LLMs in Downstream Tasks: Memorization and Generalization with Knowledge Graphs
by: Ranaldi, Federico, et al.
Published: (2025)
by: Ranaldi, Federico, et al.
Published: (2025)
Multi-word Tokenization for Sequence Compression
by: Gee, Leonidas, et al.
Published: (2024)
by: Gee, Leonidas, et al.
Published: (2024)
BUSTER: a "BUSiness Transaction Entity Recognition" dataset
by: Zugarini, Andrea, et al.
Published: (2024)
by: Zugarini, Andrea, et al.
Published: (2024)
Datasets for Multilingual Answer Sentence Selection
by: Gabburo, Matteo, et al.
Published: (2024)
by: Gabburo, Matteo, et al.
Published: (2024)
Dynamic Few-Shot Learning for Knowledge Graph Question Answering
by: D'Abramo, Jacopo, et al.
Published: (2024)
by: D'Abramo, Jacopo, et al.
Published: (2024)
Neural paraphrasing by automatically crawled and aligned sentence pairs
by: Globo, Achille, et al.
Published: (2024)
by: Globo, Achille, et al.
Published: (2024)
Show Less, Instruct More: Enriching Prompts with Definitions and Guidelines for Zero-Shot NER
by: Zamai, Andrew, et al.
Published: (2024)
by: Zamai, Andrew, et al.
Published: (2024)
M3Kang: Evaluating Multilingual Multimodal Mathematical Reasoning in Vision-Language Models
by: Torres-Camps, Aleix, et al.
Published: (2026)
by: Torres-Camps, Aleix, et al.
Published: (2026)
Enhancing Modern Supervised Word Sense Disambiguation Models by Semantic Lexical Resources
by: Melacci, Stefano, et al.
Published: (2024)
by: Melacci, Stefano, et al.
Published: (2024)
A Shared Geometry of Difficulty in Multilingual Language Models
by: Civelli, Stefano, et al.
Published: (2026)
by: Civelli, Stefano, et al.
Published: (2026)
The Roles of English in Evaluating Multilingual Language Models
by: Poelman, Wessel, et al.
Published: (2024)
by: Poelman, Wessel, et al.
Published: (2024)
Exploring Vision Language Models for Multimodal and Multilingual Stance Detection
by: Vasilakes, Jake, et al.
Published: (2025)
by: Vasilakes, Jake, et al.
Published: (2025)
Evaluation of Language Models in the Medical Context Under Resource-Constrained Settings
by: Posada, Andrea, et al.
Published: (2024)
by: Posada, Andrea, et al.
Published: (2024)
Is It Good Data for Multilingual Instruction Tuning or Just Bad Multilingual Evaluation for Large Language Models?
by: Chen, Pinzhen, et al.
Published: (2024)
by: Chen, Pinzhen, et al.
Published: (2024)
FIBER: A Multilingual Evaluation Resource for Factual Inference Bias
by: Munis, Evren Ayberk, et al.
Published: (2025)
by: Munis, Evren Ayberk, et al.
Published: (2025)
MTQ-Eval: Multilingual Text Quality Evaluation for Language Models
by: Pokharel, Rhitabrat, et al.
Published: (2025)
by: Pokharel, Rhitabrat, et al.
Published: (2025)
adaptMLLM: Fine-Tuning Multilingual Language Models on Low-Resource Languages with Integrated LLM Playgrounds
by: Lankford, Séamus, et al.
Published: (2024)
by: Lankford, Séamus, et al.
Published: (2024)
GhanaNLP Parallel Corpora: Comprehensive Multilingual Resources for Low-Resource Ghanaian Languages
by: Gyamfi, Lawrence Adu, et al.
Published: (2026)
by: Gyamfi, Lawrence Adu, et al.
Published: (2026)
Multilingual Transfer and Domain Adaptation for Low-Resource Languages of Spain
by: Luo, Yuanchang, et al.
Published: (2024)
by: Luo, Yuanchang, et al.
Published: (2024)
Toward Robust Multilingual Adaptation of LLMs for Low-Resource Languages
by: Li, Haolin, et al.
Published: (2025)
by: Li, Haolin, et al.
Published: (2025)
Evaluation Methodology for Large Language Models for Multilingual Document Question and Answer
by: Kahana, Adar, et al.
Published: (2024)
by: Kahana, Adar, et al.
Published: (2024)
Evaluating the Elementary Multilingual Capabilities of Large Language Models with MultiQ
by: Holtermann, Carolin, et al.
Published: (2024)
by: Holtermann, Carolin, et al.
Published: (2024)
Mitigating Multilingual Hallucination in Large Vision-Language Models
by: Qu, Xiaoye, et al.
Published: (2024)
by: Qu, Xiaoye, et al.
Published: (2024)
M-IFEval: Multilingual Instruction-Following Evaluation
by: Dussolle, Antoine, et al.
Published: (2025)
by: Dussolle, Antoine, et al.
Published: (2025)
Multilingual Idioms in Sentences and Conversations Across High-, Medium-, and Low-Resource Languages
by: Almheiri, Saeed, et al.
Published: (2026)
by: Almheiri, Saeed, et al.
Published: (2026)
Adapting Multilingual LLMs to Low-Resource Languages with Knowledge Graphs via Adapters
by: Gurgurov, Daniil, et al.
Published: (2024)
by: Gurgurov, Daniil, et al.
Published: (2024)
Rethinking what Matters: Effective and Robust Multilingual Realignment for Low-Resource Languages
by: Nguyen, Quang Phuoc, et al.
Published: (2025)
by: Nguyen, Quang Phuoc, et al.
Published: (2025)
Multilingual Pretraining for Pixel Language Models
by: Kesen, Ilker, et al.
Published: (2025)
by: Kesen, Ilker, et al.
Published: (2025)
MoZIP: A Multilingual Benchmark to Evaluate Large Language Models in Intellectual Property
by: Ni, Shiwen, et al.
Published: (2024)
by: Ni, Shiwen, et al.
Published: (2024)
The Heap: A Contamination-Free Multilingual Code Dataset for Evaluating Large Language Models
by: Katzy, Jonathan, et al.
Published: (2025)
by: Katzy, Jonathan, et al.
Published: (2025)
Accelerating Multilingual Language Model for Excessively Tokenized Languages
by: Hong, Jimin, et al.
Published: (2024)
by: Hong, Jimin, et al.
Published: (2024)
EuropeMedQA Study Protocol: A Multilingual, Multimodal Medical Examination Dataset for Language Model Evaluation
by: Causio, Francesco Andrea, et al.
Published: (2026)
by: Causio, Francesco Andrea, et al.
Published: (2026)
Evaluating Monolingual and Multilingual Large Language Models for Greek Question Answering: The DemosQA Benchmark
by: Mastrokostas, Charalampos, et al.
Published: (2026)
by: Mastrokostas, Charalampos, et al.
Published: (2026)
Do Large Language Models Have an English Accent? Evaluating and Improving the Naturalness of Multilingual LLMs
by: Guo, Yanzhu, et al.
Published: (2024)
by: Guo, Yanzhu, et al.
Published: (2024)
Neural Machine Translation of Clinical Text: An Empirical Investigation into Multilingual Pre-Trained Language Models and Transfer-Learning
by: Han, Lifeng, et al.
Published: (2023)
by: Han, Lifeng, et al.
Published: (2023)
Similar Items
-
Fast Vocabulary Transfer for Language Model Compression
by: Gee, Leonidas, et al.
Published: (2024) -
An energy-based comparative analysis of common approaches to text classification in the Legal domain
by: Gultekin, Sinan, et al.
Published: (2023) -
Clue-Instruct: Text-Based Clue Generation for Educational Crossword Puzzles
by: Zugarini, Andrea, et al.
Published: (2024) -
SLIMER-IT: Zero-Shot NER on Italian Language
by: Zamai, Andrew, et al.
Published: (2024) -
Measuring Retrieval Complexity in Question Answering Systems
by: Gabburo, Matteo, et al.
Published: (2024)