$\left|\,\circlearrowright\,\boxed{\text{BUS}}\,\right|$: A Large and Diverse Multimodal Benchmark for evaluating the ability of Vision-Language Models to understand Rebus Puzzles
Fuente:
arXiv
Salvato in:
| Autori principali: | Das, Trishanu, Nandy, Abhilash, Bajaj, Khush, S, Deepiha |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
YesBut: A High-Quality Annotated Multimodal Dataset for evaluating Satire Comprehension capability of Vision-Language Models
di: Nandy, Abhilash, et al.
Pubblicazione: (2024)
di: Nandy, Abhilash, et al.
Pubblicazione: (2024)
Known Intents, New Combinations: Clause-Factorized Decoding for Compositional Multi-Intent Detection
di: Nandy, Abhilash
Pubblicazione: (2026)
di: Nandy, Abhilash
Pubblicazione: (2026)
Non Verbis, Sed Rebus: Large Language Models are Weak Solvers of Italian Rebuses
di: Sarti, Gabriele, et al.
Pubblicazione: (2024)
di: Sarti, Gabriele, et al.
Pubblicazione: (2024)
Leveraging Large Language Models for Predictive Analysis of Human Misery
di: Seal, Bishanka, et al.
Pubblicazione: (2025)
di: Seal, Bishanka, et al.
Pubblicazione: (2025)
Leveraging Self-Attention for Input-Dependent Soft Prompting in LLMs
di: Muppidi, Ananth, et al.
Pubblicazione: (2025)
di: Muppidi, Ananth, et al.
Pubblicazione: (2025)
Graph Fusion Across Languages using Large Language Models
di: Kyaw, Kaung Myat, et al.
Pubblicazione: (2026)
di: Kyaw, Kaung Myat, et al.
Pubblicazione: (2026)
VGRP-Bench: Visual Grid Reasoning Puzzle Benchmark for Large Vision-Language Models
di: Ren, Yufan, et al.
Pubblicazione: (2025)
di: Ren, Yufan, et al.
Pubblicazione: (2025)
SERPENT-VLM : Self-Refining Radiology Report Generation Using Vision Language Models
di: Kapadnis, Manav Nitin, et al.
Pubblicazione: (2024)
di: Kapadnis, Manav Nitin, et al.
Pubblicazione: (2024)
Order-Based Pre-training Strategies for Procedural Text Understanding
di: Nandy, Abhilash, et al.
Pubblicazione: (2024)
di: Nandy, Abhilash, et al.
Pubblicazione: (2024)
REFINE-AF: A Task-Agnostic Framework to Align Language Models via Self-Generated Instructions using Reinforcement Learning from Automated Feedback
di: Roy, Aniruddha, et al.
Pubblicazione: (2025)
di: Roy, Aniruddha, et al.
Pubblicazione: (2025)
White-box Multimodal Jailbreaks Against Large Vision-Language Models
di: Wang, Ruofan, et al.
Pubblicazione: (2024)
di: Wang, Ruofan, et al.
Pubblicazione: (2024)
TangramPuzzle: Evaluating Multimodal Large Language Models with Compositional Spatial Reasoning
di: Liu, Daixian, et al.
Pubblicazione: (2026)
di: Liu, Daixian, et al.
Pubblicazione: (2026)
Puzzled by Puzzles: When Vision-Language Models Can't Take a Hint
di: Lee, Heekyung, et al.
Pubblicazione: (2025)
di: Lee, Heekyung, et al.
Pubblicazione: (2025)
Creating a Lens of Chinese Culture: A Multimodal Dataset for Chinese Pun Rebus Art Understanding
di: Zhang, Tuo, et al.
Pubblicazione: (2024)
di: Zhang, Tuo, et al.
Pubblicazione: (2024)
MFC-Bench: Benchmarking Multimodal Fact-Checking with Large Vision-Language Models
di: Wang, Shengkang, et al.
Pubblicazione: (2024)
di: Wang, Shengkang, et al.
Pubblicazione: (2024)
PuzzleWorld: A Benchmark for Multimodal, Open-Ended Reasoning in Puzzlehunts
di: Li, Hengzhi, et al.
Pubblicazione: (2025)
di: Li, Hengzhi, et al.
Pubblicazione: (2025)
M5 -- A Diverse Benchmark to Assess the Performance of Large Multimodal Models Across Multilingual and Multicultural Vision-Language Tasks
di: Schneider, Florian, et al.
Pubblicazione: (2024)
di: Schneider, Florian, et al.
Pubblicazione: (2024)
MMIE: Massive Multimodal Interleaved Comprehension Benchmark for Large Vision-Language Models
di: Xia, Peng, et al.
Pubblicazione: (2024)
di: Xia, Peng, et al.
Pubblicazione: (2024)
Reasoning or Pattern Matching? Probing Large Vision-Language Models with Visual Puzzles
di: Lymperaiou, Maria, et al.
Pubblicazione: (2026)
di: Lymperaiou, Maria, et al.
Pubblicazione: (2026)
Hidden Meanings in Plain Sight: RebusBench for Evaluating Cognitive Visual Reasoning
di: Kasaei, Seyed Amir, et al.
Pubblicazione: (2026)
di: Kasaei, Seyed Amir, et al.
Pubblicazione: (2026)
A conceptual framework for ideology beyond the left and right
di: Joseph, Kenneth, et al.
Pubblicazione: (2026)
di: Joseph, Kenneth, et al.
Pubblicazione: (2026)
EXAMS-V: A Multi-Discipline Multilingual Multimodal Exam Benchmark for Evaluating Vision Language Models
di: Das, Rocktim Jyoti, et al.
Pubblicazione: (2024)
di: Das, Rocktim Jyoti, et al.
Pubblicazione: (2024)
BUS:Efficient and Effective Vision-language Pre-training with Bottom-Up Patch Summarization
di: Jiang, Chaoya, et al.
Pubblicazione: (2023)
di: Jiang, Chaoya, et al.
Pubblicazione: (2023)
LMOD: A Large Multimodal Ophthalmology Dataset and Benchmark for Large Vision-Language Models
di: Qin, Zhenyue, et al.
Pubblicazione: (2024)
di: Qin, Zhenyue, et al.
Pubblicazione: (2024)
Benchmarking Linguistic Diversity of Large Language Models
di: Guo, Yanzhu, et al.
Pubblicazione: (2024)
di: Guo, Yanzhu, et al.
Pubblicazione: (2024)
Are Language Models Puzzle Prodigies? Algorithmic Puzzles Unveil Serious Challenges in Multimodal Reasoning
di: Ghosal, Deepanway, et al.
Pubblicazione: (2024)
di: Ghosal, Deepanway, et al.
Pubblicazione: (2024)
The Invalsi Benchmarks: measuring Linguistic and Mathematical understanding of Large Language Models in Italian
di: Puccetti, Giovanni, et al.
Pubblicazione: (2024)
di: Puccetti, Giovanni, et al.
Pubblicazione: (2024)
A Pointer Network-based Approach for Joint Extraction and Detection of Multi-Label Multi-Class Intents
di: Mullick, Ankan, et al.
Pubblicazione: (2024)
di: Mullick, Ankan, et al.
Pubblicazione: (2024)
MAGIC: Multimodal Alignment & Grounding-aware Instruction Coreset for Vision-Language Models
di: Biswas, Shristi Das, et al.
Pubblicazione: (2026)
di: Biswas, Shristi Das, et al.
Pubblicazione: (2026)
PuzzleBench: A Fully Dynamic Evaluation Framework for Large Multimodal Models on Puzzle Solving
di: Zhang, Zeyu, et al.
Pubblicazione: (2025)
di: Zhang, Zeyu, et al.
Pubblicazione: (2025)
PuzzlePlex: Benchmarking Foundation Models on Reasoning and Planning with Puzzles
di: Long, Yitao, et al.
Pubblicazione: (2025)
di: Long, Yitao, et al.
Pubblicazione: (2025)
Language Modeling with Learned Meta-Tokens
di: Shah, Alok N., et al.
Pubblicazione: (2025)
di: Shah, Alok N., et al.
Pubblicazione: (2025)
ArtGPT-4: Towards Artistic-understanding Large Vision-Language Models with Enhanced Adapter
di: Yuan, Zhengqing, et al.
Pubblicazione: (2023)
di: Yuan, Zhengqing, et al.
Pubblicazione: (2023)
Vision-DeepResearch Benchmark: Rethinking Visual and Textual Search for Multimodal Large Language Models
di: Zeng, Yu, et al.
Pubblicazione: (2026)
di: Zeng, Yu, et al.
Pubblicazione: (2026)
MemLens: Benchmarking Multimodal Long-Term Memory in Large Vision-Language Models
di: Ren, Xiyu, et al.
Pubblicazione: (2026)
di: Ren, Xiyu, et al.
Pubblicazione: (2026)
ROSA: Addressing text understanding challenges in photographs via ROtated SAmpling
di: Maina, Hernán, et al.
Pubblicazione: (2025)
di: Maina, Hernán, et al.
Pubblicazione: (2025)
Benchmarking Content-Based Puzzle Solvers on Corrupted Jigsaw Puzzles
di: Dirauf, Richard, et al.
Pubblicazione: (2025)
di: Dirauf, Richard, et al.
Pubblicazione: (2025)
Out of the box age estimation through facial imagery: A Comprehensive Benchmark of Vision-Language Models vs. out-of-the-box Traditional Architectures
di: Ren, Simiao, et al.
Pubblicazione: (2026)
di: Ren, Simiao, et al.
Pubblicazione: (2026)
Benchmarking Multimodal Large Language Models for Face Recognition
di: Shahreza, Hatef Otroshi, et al.
Pubblicazione: (2025)
di: Shahreza, Hatef Otroshi, et al.
Pubblicazione: (2025)
A Survey on Benchmarks of Multimodal Large Language Models
di: Li, Jian, et al.
Pubblicazione: (2024)
di: Li, Jian, et al.
Pubblicazione: (2024)
Documenti analoghi
-
YesBut: A High-Quality Annotated Multimodal Dataset for evaluating Satire Comprehension capability of Vision-Language Models
di: Nandy, Abhilash, et al.
Pubblicazione: (2024) -
Known Intents, New Combinations: Clause-Factorized Decoding for Compositional Multi-Intent Detection
di: Nandy, Abhilash
Pubblicazione: (2026) -
Non Verbis, Sed Rebus: Large Language Models are Weak Solvers of Italian Rebuses
di: Sarti, Gabriele, et al.
Pubblicazione: (2024) -
Leveraging Large Language Models for Predictive Analysis of Human Misery
di: Seal, Bishanka, et al.
Pubblicazione: (2025) -
Leveraging Self-Attention for Input-Dependent Soft Prompting in LLMs
di: Muppidi, Ananth, et al.
Pubblicazione: (2025)