MVL-SIB: A Massively Multilingual Vision-Language Benchmark for Cross-Modal Topical Matching
Fuente:
arXiv
Salvato in:
| Autori principali: | Schmidt, Fabian David, Schneider, Florian, Biemann, Chris, Glavaš, Goran |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Fleurs-SLU: A Massively Multilingual Benchmark for Spoken Language Understanding
di: Schmidt, Fabian David, et al.
Pubblicazione: (2025)
di: Schmidt, Fabian David, et al.
Pubblicazione: (2025)
Centurio: On Drivers of Multilingual Ability of Large Vision-Language Model
di: Geigle, Gregor, et al.
Pubblicazione: (2025)
di: Geigle, Gregor, et al.
Pubblicazione: (2025)
Babel-ImageNet: Massively Multilingual Evaluation of Vision-and-Language Representations
di: Geigle, Gregor, et al.
Pubblicazione: (2023)
di: Geigle, Gregor, et al.
Pubblicazione: (2023)
Self-Distillation for Model Stacking Unlocks Cross-Lingual NLU in 200+ Languages
di: Schmidt, Fabian David, et al.
Pubblicazione: (2024)
di: Schmidt, Fabian David, et al.
Pubblicazione: (2024)
News Without Borders: Domain Adaptation of Multilingual Sentence Embeddings for Cross-lingual News Recommendation
di: Iana, Andreea, et al.
Pubblicazione: (2024)
di: Iana, Andreea, et al.
Pubblicazione: (2024)
ReCoVeR the Target Language: Language Steering without Sacrificing Task Performance
di: Sterz, Hannah, et al.
Pubblicazione: (2025)
di: Sterz, Hannah, et al.
Pubblicazione: (2025)
To Translate or Not to Translate: A Systematic Investigation of Translation-Based Cross-Lingual Transfer to Low-Resource Languages
di: Ebing, Benedikt, et al.
Pubblicazione: (2023)
di: Ebing, Benedikt, et al.
Pubblicazione: (2023)
IRCoder: Intermediate Representations Make Language Models Robust Multilingual Code Generators
di: Paul, Indraneil, et al.
Pubblicazione: (2024)
di: Paul, Indraneil, et al.
Pubblicazione: (2024)
African or European Swallow? Benchmarking Large Vision-Language Models for Fine-Grained Object Classification
di: Geigle, Gregor, et al.
Pubblicazione: (2024)
di: Geigle, Gregor, et al.
Pubblicazione: (2024)
SpeechTaxi: On Multilingual Semantic Speech Classification
di: Keller, Lennart, et al.
Pubblicazione: (2024)
di: Keller, Lennart, et al.
Pubblicazione: (2024)
mBLIP: Efficient Bootstrapping of Multilingual Vision-LLMs
di: Geigle, Gregor, et al.
Pubblicazione: (2023)
di: Geigle, Gregor, et al.
Pubblicazione: (2023)
GIMMICK -- Globally Inclusive Multimodal Multitask Cultural Knowledge Benchmarking
di: Schneider, Florian, et al.
Pubblicazione: (2025)
di: Schneider, Florian, et al.
Pubblicazione: (2025)
The Devil Is in the Word Alignment Details: On Translation-Based Cross-Lingual Transfer for Token Classification Tasks
di: Ebing, Benedikt, et al.
Pubblicazione: (2025)
di: Ebing, Benedikt, et al.
Pubblicazione: (2025)
Does Object Grounding Really Reduce Hallucination of Large Vision-Language Models?
di: Geigle, Gregor, et al.
Pubblicazione: (2024)
di: Geigle, Gregor, et al.
Pubblicazione: (2024)
How Much Do LLMs Hallucinate across Languages? On Realistic Multilingual Estimation of LLM Hallucination
di: Islam, Saad Obaid ul, et al.
Pubblicazione: (2025)
di: Islam, Saad Obaid ul, et al.
Pubblicazione: (2025)
Evaluating the Ability of LLMs to Solve Semantics-Aware Process Mining Tasks
di: Rebmann, Adrian, et al.
Pubblicazione: (2024)
di: Rebmann, Adrian, et al.
Pubblicazione: (2024)
Modular Sentence Encoders: Separating Language Specialization from Cross-Lingual Alignment
di: Huang, Yongxin, et al.
Pubblicazione: (2024)
di: Huang, Yongxin, et al.
Pubblicazione: (2024)
Knowledge Distillation vs. Pretraining from Scratch under a Fixed (Computation) Budget
di: Bui, Minh Duc, et al.
Pubblicazione: (2024)
di: Bui, Minh Duc, et al.
Pubblicazione: (2024)
M5 -- A Diverse Benchmark to Assess the Performance of Large Multimodal Models Across Multilingual and Multicultural Vision-Language Tasks
di: Schneider, Florian, et al.
Pubblicazione: (2024)
di: Schneider, Florian, et al.
Pubblicazione: (2024)
One Script Instead of Hundreds? On Pretraining Romanized Encoder Language Models
di: Ebing, Benedikt, et al.
Pubblicazione: (2026)
di: Ebing, Benedikt, et al.
Pubblicazione: (2026)
ANHALTEN: Cross-Lingual Transfer for German Token-Level Reference-Free Hallucination Detection
di: Herrlein, Janek, et al.
Pubblicazione: (2024)
di: Herrlein, Janek, et al.
Pubblicazione: (2024)
Supervised In-Context Fine-Tuning for Generative Sequence Labeling
di: Dukić, David, et al.
Pubblicazione: (2025)
di: Dukić, David, et al.
Pubblicazione: (2025)
SIB-200: A Simple, Inclusive, and Big Evaluation Dataset for Topic Classification in 200+ Languages and Dialects
di: Adelani, David Ifeoluwa, et al.
Pubblicazione: (2023)
di: Adelani, David Ifeoluwa, et al.
Pubblicazione: (2023)
TransAlign: Machine Translation Encoders are Strong Word Aligners, Too
di: Ebing, Benedikt, et al.
Pubblicazione: (2025)
di: Ebing, Benedikt, et al.
Pubblicazione: (2025)
Rethinking Multilingual Vision-Language Translation: Dataset, Evaluation, and Adaptation
di: Wang, Xintong, et al.
Pubblicazione: (2025)
di: Wang, Xintong, et al.
Pubblicazione: (2025)
On Generalization across Measurement Systems: LLMs Entail More Test-Time Compute for Underrepresented Cultures
di: Bui, Minh Duc, et al.
Pubblicazione: (2025)
di: Bui, Minh Duc, et al.
Pubblicazione: (2025)
Perspectives - Interactive Document Clustering in the Discourse Analysis Tool Suite
di: Fischer, Tim, et al.
Pubblicazione: (2026)
di: Fischer, Tim, et al.
Pubblicazione: (2026)
Mitigating Hallucinations in Large Vision-Language Models with Instruction Contrastive Decoding
di: Wang, Xintong, et al.
Pubblicazione: (2024)
di: Wang, Xintong, et al.
Pubblicazione: (2024)
Omnilingual SONAR: Cross-Lingual and Cross-Modal Sentence Embeddings Bridging Massively Multilingual Text and Speech
di: Omnilingual SONAR Team, et al.
Pubblicazione: (2026)
di: Omnilingual SONAR Team, et al.
Pubblicazione: (2026)
Self-Taught Self-Correction for Small Language Models
di: Moskvoretskii, Viktor, et al.
Pubblicazione: (2025)
di: Moskvoretskii, Viktor, et al.
Pubblicazione: (2025)
Leveraging Open Information Extraction for More Robust Domain Transfer of Event Trigger Detection
di: Dukić, David, et al.
Pubblicazione: (2023)
di: Dukić, David, et al.
Pubblicazione: (2023)
LEMUR: A Corpus for Robust Fine-Tuning of Multilingual Law Embedding Models for Retrieval
di: Ahmadi, Narges Baba, et al.
Pubblicazione: (2026)
di: Ahmadi, Narges Baba, et al.
Pubblicazione: (2026)
Probing Large Language Models from A Human Behavioral Perspective
di: Wang, Xintong, et al.
Pubblicazione: (2023)
di: Wang, Xintong, et al.
Pubblicazione: (2023)
Geographic Adaptation of Pretrained Language Models
di: Hofmann, Valentin, et al.
Pubblicazione: (2022)
di: Hofmann, Valentin, et al.
Pubblicazione: (2022)
Dataset of Quotation Attribution in German News Articles
di: Petersen-Frey, Fynn, et al.
Pubblicazione: (2024)
di: Petersen-Frey, Fynn, et al.
Pubblicazione: (2024)
SQATIN: Supervised Instruction Tuning Meets Question Answering for Improved Dialogue NLU
di: Razumovskaia, Evgeniia, et al.
Pubblicazione: (2023)
di: Razumovskaia, Evgeniia, et al.
Pubblicazione: (2023)
MUCAR: Benchmarking Multilingual Cross-Modal Ambiguity Resolution for Multimodal Large Language Models
di: Wang, Xiaolong, et al.
Pubblicazione: (2025)
di: Wang, Xiaolong, et al.
Pubblicazione: (2025)
The Curious Case of Factual (Mis)Alignment between LLMs' Short- and Long-Form Answers
di: Islam, Saad Obaid ul, et al.
Pubblicazione: (2025)
di: Islam, Saad Obaid ul, et al.
Pubblicazione: (2025)
Large Language Models are Miscalibrated In-Context Learners
di: Li, Chengzu, et al.
Pubblicazione: (2023)
di: Li, Chengzu, et al.
Pubblicazione: (2023)
Large Language Models Are Overparameterized Text Encoders
di: K, Thennal D, et al.
Pubblicazione: (2024)
di: K, Thennal D, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Fleurs-SLU: A Massively Multilingual Benchmark for Spoken Language Understanding
di: Schmidt, Fabian David, et al.
Pubblicazione: (2025) -
Centurio: On Drivers of Multilingual Ability of Large Vision-Language Model
di: Geigle, Gregor, et al.
Pubblicazione: (2025) -
Babel-ImageNet: Massively Multilingual Evaluation of Vision-and-Language Representations
di: Geigle, Gregor, et al.
Pubblicazione: (2023) -
Self-Distillation for Model Stacking Unlocks Cross-Lingual NLU in 200+ Languages
di: Schmidt, Fabian David, et al.
Pubblicazione: (2024) -
News Without Borders: Domain Adaptation of Multilingual Sentence Embeddings for Cross-lingual News Recommendation
di: Iana, Andreea, et al.
Pubblicazione: (2024)