A-I-RAVEN and I-RAVEN-Mesh: Two New Benchmarks for Abstract Visual Reasoning
Fuente:
arXiv
Salvato in:
| Autori principali: | Małkiński, Mikołaj, Mańdziuk, Jacek |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
A Unified View of Abstract Visual Reasoning Problems
di: Małkiński, Mikołaj, et al.
Pubblicazione: (2024)
di: Małkiński, Mikołaj, et al.
Pubblicazione: (2024)
Multi-Label Contrastive Learning for Abstract Visual Reasoning
di: Małkiński, Mikołaj, et al.
Pubblicazione: (2020)
di: Małkiński, Mikołaj, et al.
Pubblicazione: (2020)
Advancing Generalization Across a Variety of Abstract Visual Reasoning Tasks
di: Małkiński, Mikołaj, et al.
Pubblicazione: (2025)
di: Małkiński, Mikołaj, et al.
Pubblicazione: (2025)
One Self-Configurable Model to Solve Many Abstract Visual Reasoning Problems
di: Małkiński, Mikołaj, et al.
Pubblicazione: (2023)
di: Małkiński, Mikołaj, et al.
Pubblicazione: (2023)
Deep Learning Methods for Abstract Visual Reasoning: A Survey on Raven's Progressive Matrices
di: Małkiński, Mikołaj, et al.
Pubblicazione: (2022)
di: Małkiński, Mikołaj, et al.
Pubblicazione: (2022)
Reasoning Limitations of Multimodal Large Language Models. A Case Study of Bongard Problems
di: Małkiński, Mikołaj, et al.
Pubblicazione: (2024)
di: Małkiński, Mikołaj, et al.
Pubblicazione: (2024)
Bongard-RWR+: Real-World Representations of Fine-Grained Concepts in Bongard Problems
di: Pawlonka, Szymon, et al.
Pubblicazione: (2025)
di: Pawlonka, Szymon, et al.
Pubblicazione: (2025)
RAVEN: Resilient Aerial Navigation via Open-Set Semantic Memory and Behavior Adaptation
di: Kim, Seungchan, et al.
Pubblicazione: (2025)
di: Kim, Seungchan, et al.
Pubblicazione: (2025)
RAVEN: Multitask Retrieval Augmented Vision-Language Learning
di: Rao, Varun Nagaraj, et al.
Pubblicazione: (2024)
di: Rao, Varun Nagaraj, et al.
Pubblicazione: (2024)
RAVEN: Rethinking Adversarial Video Generation with Efficient Tri-plane Networks
di: Ghosh, Partha, et al.
Pubblicazione: (2024)
di: Ghosh, Partha, et al.
Pubblicazione: (2024)
Learning Differentiable Logic Programs for Abstract Visual Reasoning
di: Shindo, Hikaru, et al.
Pubblicazione: (2023)
di: Shindo, Hikaru, et al.
Pubblicazione: (2023)
Learning Visual Abstract Reasoning through Dual-Stream Networks
di: Zhao, Kai, et al.
Pubblicazione: (2024)
di: Zhao, Kai, et al.
Pubblicazione: (2024)
I-RAVEN-X: Benchmarking Generalization and Robustness of Analogical and Mathematical Reasoning in Large Language and Reasoning Models
di: Camposampiero, Giacomo, et al.
Pubblicazione: (2025)
di: Camposampiero, Giacomo, et al.
Pubblicazione: (2025)
Text-to-Image Cross-Modal Generation: A Systematic Review
di: Żelaszczyk, Maciej, et al.
Pubblicazione: (2024)
di: Żelaszczyk, Maciej, et al.
Pubblicazione: (2024)
MaRVL-QA: A Benchmark for Mathematical Reasoning over Visual Landscapes
di: Pande, Nilay, et al.
Pubblicazione: (2025)
di: Pande, Nilay, et al.
Pubblicazione: (2025)
V-REX: Benchmarking Exploratory Visual Reasoning via Chain-of-Questions
di: Fan, Chenrui, et al.
Pubblicazione: (2025)
di: Fan, Chenrui, et al.
Pubblicazione: (2025)
I-PHYRE: Interactive Physical Reasoning
di: Li, Shiqian, et al.
Pubblicazione: (2023)
di: Li, Shiqian, et al.
Pubblicazione: (2023)
RAVEN: Query-Guided Representation Alignment for Question Answering over Audio, Video, Embedded Sensors, and Natural Language
di: Biswas, Subrata, et al.
Pubblicazione: (2025)
di: Biswas, Subrata, et al.
Pubblicazione: (2025)
T2I-ConBench: Text-to-Image Benchmark for Continual Post-training
di: Huang, Zhehao, et al.
Pubblicazione: (2025)
di: Huang, Zhehao, et al.
Pubblicazione: (2025)
VisAidMath: Benchmarking Visual-Aided Mathematical Reasoning
di: Ma, Jingkun, et al.
Pubblicazione: (2024)
di: Ma, Jingkun, et al.
Pubblicazione: (2024)
Zero-Shot Visual Reasoning by Vision-Language Models: Benchmarking and Analysis
di: Nagar, Aishik, et al.
Pubblicazione: (2024)
di: Nagar, Aishik, et al.
Pubblicazione: (2024)
LogicVista: Multimodal LLM Logical Reasoning Benchmark in Visual Contexts
di: Xiao, Yijia, et al.
Pubblicazione: (2024)
di: Xiao, Yijia, et al.
Pubblicazione: (2024)
Beyond I-Con: Exploring New Dimension of Distance Measures in Representation Learning
di: Shone, Jasmine, et al.
Pubblicazione: (2025)
di: Shone, Jasmine, et al.
Pubblicazione: (2025)
Learning to Reason Iteratively and Parallelly for Complex Visual Reasoning Scenarios
di: Jaiswal, Shantanu, et al.
Pubblicazione: (2024)
di: Jaiswal, Shantanu, et al.
Pubblicazione: (2024)
SPHINX: A Synthetic Environment for Visual Perception and Reasoning
di: Alam, Md Tanvirul, et al.
Pubblicazione: (2025)
di: Alam, Md Tanvirul, et al.
Pubblicazione: (2025)
Orion: A Unified Visual Agent for Multimodal Perception, Advanced Visual Reasoning and Execution
di: Reddy, N Dinesh, et al.
Pubblicazione: (2025)
di: Reddy, N Dinesh, et al.
Pubblicazione: (2025)
SliceVision-F2I: A Synthetic Feature-to-Image Dataset for Visual Pattern Representation on Network Slices
di: Rafi, Md. Abid Hasan, et al.
Pubblicazione: (2025)
di: Rafi, Md. Abid Hasan, et al.
Pubblicazione: (2025)
A Large-scale Medical Visual Task Adaptation Benchmark
di: Mo, Shentong, et al.
Pubblicazione: (2024)
di: Mo, Shentong, et al.
Pubblicazione: (2024)
Visual Structures Helps Visual Reasoning: Addressing the Binding Problem in VLMs
di: Izadi, Amirmohammad, et al.
Pubblicazione: (2025)
di: Izadi, Amirmohammad, et al.
Pubblicazione: (2025)
MMErroR: A Benchmark for Erroneous Reasoning in Vision-Language Models
di: Shi, Yang, et al.
Pubblicazione: (2026)
di: Shi, Yang, et al.
Pubblicazione: (2026)
OMENN: One Matrix to Explain Neural Networks
di: Wróbel, Adam, et al.
Pubblicazione: (2024)
di: Wróbel, Adam, et al.
Pubblicazione: (2024)
VELOCITI: Benchmarking Video-Language Compositional Reasoning with Strict Entailment
di: Saravanan, Darshana, et al.
Pubblicazione: (2024)
di: Saravanan, Darshana, et al.
Pubblicazione: (2024)
PhyGround: Benchmarking Physical Reasoning in Generative World Models
di: Lin, Juyi, et al.
Pubblicazione: (2026)
di: Lin, Juyi, et al.
Pubblicazione: (2026)
Segment Any Vehicle: Semantic and Visual Context Driven SAM and A Benchmark
di: Wang, Xiao, et al.
Pubblicazione: (2025)
di: Wang, Xiao, et al.
Pubblicazione: (2025)
Defeasible Visual Entailment: Benchmark, Evaluator, and Reward-Driven Optimization
di: Zhang, Yue, et al.
Pubblicazione: (2024)
di: Zhang, Yue, et al.
Pubblicazione: (2024)
CycliST: A Video Language Model Benchmark for Reasoning on Cyclical State Transitions
di: Kohaut, Simon, et al.
Pubblicazione: (2025)
di: Kohaut, Simon, et al.
Pubblicazione: (2025)
VisualPredicator: Learning Abstract World Models with Neuro-Symbolic Predicates for Robot Planning
di: Liang, Yichao, et al.
Pubblicazione: (2024)
di: Liang, Yichao, et al.
Pubblicazione: (2024)
Perception Tokens Enhance Visual Reasoning in Multimodal Language Models
di: Bigverdi, Mahtab, et al.
Pubblicazione: (2024)
di: Bigverdi, Mahtab, et al.
Pubblicazione: (2024)
Weakly Supervised Concept Learning for Object-centric Visual Reasoning
di: Tiwari, Sparsh, et al.
Pubblicazione: (2026)
di: Tiwari, Sparsh, et al.
Pubblicazione: (2026)
RECODE: Reasoning Through Code Generation for Visual Question Answering
di: Shen, Junhong, et al.
Pubblicazione: (2025)
di: Shen, Junhong, et al.
Pubblicazione: (2025)
Documenti analoghi
-
A Unified View of Abstract Visual Reasoning Problems
di: Małkiński, Mikołaj, et al.
Pubblicazione: (2024) -
Multi-Label Contrastive Learning for Abstract Visual Reasoning
di: Małkiński, Mikołaj, et al.
Pubblicazione: (2020) -
Advancing Generalization Across a Variety of Abstract Visual Reasoning Tasks
di: Małkiński, Mikołaj, et al.
Pubblicazione: (2025) -
One Self-Configurable Model to Solve Many Abstract Visual Reasoning Problems
di: Małkiński, Mikołaj, et al.
Pubblicazione: (2023) -
Deep Learning Methods for Abstract Visual Reasoning: A Survey on Raven's Progressive Matrices
di: Małkiński, Mikołaj, et al.
Pubblicazione: (2022)