IllusionVQA: A Challenging Optical Illusion Dataset for Vision Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Shahgir, Haz Sameen, Sayeed, Khondker Salman, Bhattacharjee, Abhik, Ahmad, Wasi Uddin, Dong, Yue, Shahriyar, Rifat |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Too Late to Train, Too Early To Use? A Study on Necessity and Viability of Low-Resource Bengali LLMs
di: Mahfuz, Tamzeed, et al.
Pubblicazione: (2024)
di: Mahfuz, Tamzeed, et al.
Pubblicazione: (2024)
Connecting the Dots: Leveraging Spatio-Temporal Graph Neural Networks for Accurate Bangla Sign Language Recognition
di: Shahgir, Haz Sameen, et al.
Pubblicazione: (2024)
di: Shahgir, Haz Sameen, et al.
Pubblicazione: (2024)
Harnessing the Unseen: The Hidden Influence of Intrinsic Knowledge in Long-Context Language Models
di: Fu, Yu, et al.
Pubblicazione: (2025)
di: Fu, Yu, et al.
Pubblicazione: (2025)
VLMs Need Words: Vision Language Models Ignore Visual Detail In Favor of Semantic Anchors
di: Shahgir, Haz Sameen, et al.
Pubblicazione: (2026)
di: Shahgir, Haz Sameen, et al.
Pubblicazione: (2026)
ExpertGenQA: Open-ended QA generation in Specialized Domains
di: Shahgir, Haz Sameen, et al.
Pubblicazione: (2025)
di: Shahgir, Haz Sameen, et al.
Pubblicazione: (2025)
An Empirical Study on the Characteristics of Bias upon Context Length Variation for Bangla
di: Sadhu, Jayanta, et al.
Pubblicazione: (2024)
di: Sadhu, Jayanta, et al.
Pubblicazione: (2024)
The Illusion-Illusion: Vision Language Models See Illusions Where There are None
di: Ullman, Tomer
Pubblicazione: (2024)
di: Ullman, Tomer
Pubblicazione: (2024)
Do Reasoning LLMs Refuse What They Infer in Long Contexts?
di: Fu, Yu, et al.
Pubblicazione: (2026)
di: Fu, Yu, et al.
Pubblicazione: (2026)
Multi-ToM: Evaluating Multilingual Theory of Mind Capabilities in Large Language Models
di: Sadhu, Jayanta, et al.
Pubblicazione: (2024)
di: Sadhu, Jayanta, et al.
Pubblicazione: (2024)
Leveraging Complementary Attention maps in vision transformers for OCT image analysis
di: Shahgir, Haz Sameen, et al.
Pubblicazione: (2023)
di: Shahgir, Haz Sameen, et al.
Pubblicazione: (2023)
Illusory VQA: Benchmarking and Enhancing Multimodal Models on Visual Illusions
di: Rostamkhani, Mohammadmostafa, et al.
Pubblicazione: (2024)
di: Rostamkhani, Mohammadmostafa, et al.
Pubblicazione: (2024)
An Empirical Study of Gendered Stereotypes in Emotional Attributes for Bangla in Multilingual Large Language Models
di: Sadhu, Jayanta, et al.
Pubblicazione: (2024)
di: Sadhu, Jayanta, et al.
Pubblicazione: (2024)
Social Bias in Large Language Models For Bangla: An Empirical Study on Gender and Religious Bias
di: Sadhu, Jayanta, et al.
Pubblicazione: (2024)
di: Sadhu, Jayanta, et al.
Pubblicazione: (2024)
Inceptive Transformers: Enhancing Contextual Representations through Multi-Scale Feature Learning Across Domains and Languages
di: Shahriar, Asif, et al.
Pubblicazione: (2025)
di: Shahriar, Asif, et al.
Pubblicazione: (2025)
Pre-trained Language Models for Keyphrase Generation: A Thorough Empirical Study
di: Wu, Di, et al.
Pubblicazione: (2022)
di: Wu, Di, et al.
Pubblicazione: (2022)
On Leveraging Encoder-only Pre-trained Language Models for Effective Keyphrase Generation
di: Wu, Di, et al.
Pubblicazione: (2024)
di: Wu, Di, et al.
Pubblicazione: (2024)
The Illusion of Stochasticity in LLMs
di: Gu, Xiangming, et al.
Pubblicazione: (2026)
di: Gu, Xiangming, et al.
Pubblicazione: (2026)
Do Large Vision-Language Models Distinguish between the Actual and Apparent Features of Illusions?
di: Shinozaki, Taiga, et al.
Pubblicazione: (2025)
di: Shinozaki, Taiga, et al.
Pubblicazione: (2025)
The Leaderboard Illusion
di: Singh, Shivalika, et al.
Pubblicazione: (2025)
di: Singh, Shivalika, et al.
Pubblicazione: (2025)
Extreme Miscalibration and the Illusion of Adversarial Robustness
di: Raina, Vyas, et al.
Pubblicazione: (2024)
di: Raina, Vyas, et al.
Pubblicazione: (2024)
The Illusion of State in State-Space Models
di: Merrill, William, et al.
Pubblicazione: (2024)
di: Merrill, William, et al.
Pubblicazione: (2024)
Simulated Students in Tutoring Dialogues: Substance or Illusion?
di: Scarlatos, Alexander, et al.
Pubblicazione: (2026)
di: Scarlatos, Alexander, et al.
Pubblicazione: (2026)
The Illusion of Insight in Reasoning Models
di: d'Aliberti, Liv G., et al.
Pubblicazione: (2026)
di: d'Aliberti, Liv G., et al.
Pubblicazione: (2026)
Speculative Decoding: Performance or Illusion?
di: Liu, Xiaoxuan, et al.
Pubblicazione: (2025)
di: Liu, Xiaoxuan, et al.
Pubblicazione: (2025)
Can Language Models Be Tricked by Language Illusions? Easier with Syntax, Harder with Semantics
di: Zhang, Yuhan, et al.
Pubblicazione: (2023)
di: Zhang, Yuhan, et al.
Pubblicazione: (2023)
HallusionBench: An Advanced Diagnostic Suite for Entangled Language Hallucination and Visual Illusion in Large Vision-Language Models
di: Guan, Tianrui, et al.
Pubblicazione: (2023)
di: Guan, Tianrui, et al.
Pubblicazione: (2023)
From Output to Evaluation: Does Raw Instruction-Tuned Code LLMs Output Suffice for Fill-in-the-Middle Code Generation?
di: Ahmad, Wasi Uddin, et al.
Pubblicazione: (2025)
di: Ahmad, Wasi Uddin, et al.
Pubblicazione: (2025)
BengaliMoralBench: A Benchmark for Auditing Moral Reasoning in Large Language Models within Bengali Language and Culture
di: Ridoy, Shahriyar Zaman, et al.
Pubblicazione: (2025)
di: Ridoy, Shahriyar Zaman, et al.
Pubblicazione: (2025)
ConVerSum: A Contrastive Learning-based Approach for Data-Scarce Solution of Cross-Lingual Summarization Beyond Direct Equivalents
di: Lora, Sanzana Karim, et al.
Pubblicazione: (2024)
di: Lora, Sanzana Karim, et al.
Pubblicazione: (2024)
Interpretability Illusions in the Generalization of Simplified Models
di: Friedman, Dan, et al.
Pubblicazione: (2023)
di: Friedman, Dan, et al.
Pubblicazione: (2023)
Control Illusion: The Failure of Instruction Hierarchies in Large Language Models
di: Geng, Yilin, et al.
Pubblicazione: (2025)
di: Geng, Yilin, et al.
Pubblicazione: (2025)
Loki's Dance of Illusions: A Comprehensive Survey of Hallucination in Large Language Models
di: Li, Chaozhuo, et al.
Pubblicazione: (2025)
di: Li, Chaozhuo, et al.
Pubblicazione: (2025)
The Tool Illusion: Rethinking Tool Use in Web Agents
di: Lou, Renze, et al.
Pubblicazione: (2026)
di: Lou, Renze, et al.
Pubblicazione: (2026)
The Illusion of Readiness in Health AI
di: Gu, Yu, et al.
Pubblicazione: (2025)
di: Gu, Yu, et al.
Pubblicazione: (2025)
Illusion-Aware Visual Preprocessing and Anti-Illusion Prompting for Classic Illusion Understanding in Vision-Language Models
di: Zha, Junli, et al.
Pubblicazione: (2026)
di: Zha, Junli, et al.
Pubblicazione: (2026)
SemVink: Advancing VLMs' Semantic Understanding of Optical Illusions via Visual Global Thinking
di: Li, Sifan, et al.
Pubblicazione: (2025)
di: Li, Sifan, et al.
Pubblicazione: (2025)
Social Simulations with Large Language Model Risk Utopian Illusion
di: Bian, Ning, et al.
Pubblicazione: (2025)
di: Bian, Ning, et al.
Pubblicazione: (2025)
The Illusion of Superposition? A Principled Analysis of Latent Thinking in Language Models
di: Rizvi-Martel, Michael, et al.
Pubblicazione: (2026)
di: Rizvi-Martel, Michael, et al.
Pubblicazione: (2026)
Benchmark Illusion: Disagreement among LLMs and Its Scientific Consequences
di: Yang, Eddie, et al.
Pubblicazione: (2026)
di: Yang, Eddie, et al.
Pubblicazione: (2026)
ChakmaNMT: Machine Translation for a Low-Resource and Endangered Language via Transliteration
di: Chakma, Aunabil, et al.
Pubblicazione: (2024)
di: Chakma, Aunabil, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Too Late to Train, Too Early To Use? A Study on Necessity and Viability of Low-Resource Bengali LLMs
di: Mahfuz, Tamzeed, et al.
Pubblicazione: (2024) -
Connecting the Dots: Leveraging Spatio-Temporal Graph Neural Networks for Accurate Bangla Sign Language Recognition
di: Shahgir, Haz Sameen, et al.
Pubblicazione: (2024) -
Harnessing the Unseen: The Hidden Influence of Intrinsic Knowledge in Long-Context Language Models
di: Fu, Yu, et al.
Pubblicazione: (2025) -
VLMs Need Words: Vision Language Models Ignore Visual Detail In Favor of Semantic Anchors
di: Shahgir, Haz Sameen, et al.
Pubblicazione: (2026) -
ExpertGenQA: Open-ended QA generation in Specialized Domains
di: Shahgir, Haz Sameen, et al.
Pubblicazione: (2025)