MARVEL: Multidimensional Abstraction and Reasoning through Visual Evaluation and Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Jiang, Yifan, Zhang, Jiarui, Sun, Kexuan, Sourati, Zhivar, Ahrabian, Kian, Ma, Kaixin, Ilievski, Filip, Pujara, Jay |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
The Curious Case of Nonverbal Abstract Reasoning with Multi-Modal Large Language Models
di: Ahrabian, Kian, et al.
Pubblicazione: (2024)
di: Ahrabian, Kian, et al.
Pubblicazione: (2024)
ARN: Analogical Reasoning on Narratives
di: Sourati, Zhivar, et al.
Pubblicazione: (2023)
di: Sourati, Zhivar, et al.
Pubblicazione: (2023)
COLUMBUS: Evaluating COgnitive Lateral Understanding through Multiple-choice reBUSes
di: Kraaijveld, Koen, et al.
Pubblicazione: (2024)
di: Kraaijveld, Koen, et al.
Pubblicazione: (2024)
Contextualizing Argument Quality Assessment with Relevant Knowledge
di: Deshpande, Darshan, et al.
Pubblicazione: (2023)
di: Deshpande, Darshan, et al.
Pubblicazione: (2023)
Towards Perceiving Small Visual Details in Zero-shot Visual Question Answering with Multimodal LLMs
di: Zhang, Jiarui, et al.
Pubblicazione: (2023)
di: Zhang, Jiarui, et al.
Pubblicazione: (2023)
A Study of Commonsense Reasoning over Visual Object Properties
di: Kolari, Abhishek, et al.
Pubblicazione: (2025)
di: Kolari, Abhishek, et al.
Pubblicazione: (2025)
Toward Better Temporal Structures for Geopolitical Events Forecasting
di: Ahrabian, Kian, et al.
Pubblicazione: (2026)
di: Ahrabian, Kian, et al.
Pubblicazione: (2026)
MLLMs Know Where to Look: Training-free Perception of Small Visual Details with Multimodal LLMs
di: Zhang, Jiarui, et al.
Pubblicazione: (2025)
di: Zhang, Jiarui, et al.
Pubblicazione: (2025)
Robust Text Classification: Analyzing Prototype-Based Networks
di: Sourati, Zhivar, et al.
Pubblicazione: (2023)
di: Sourati, Zhivar, et al.
Pubblicazione: (2023)
Commonsense Video Question Answering through Video-Grounded Entailment Tree Reasoning
di: Liu, Huabin, et al.
Pubblicazione: (2025)
di: Liu, Huabin, et al.
Pubblicazione: (2025)
Exploring Perceptual Limitation of Multimodal Large Language Models
di: Zhang, Jiarui, et al.
Pubblicazione: (2024)
di: Zhang, Jiarui, et al.
Pubblicazione: (2024)
SemEval-2024 Task 9: BRAINTEASER: A Novel Task Defying Common Sense
di: Jiang, Yifan, et al.
Pubblicazione: (2024)
di: Jiang, Yifan, et al.
Pubblicazione: (2024)
Knowledge-Powered Recommendation for an Improved Diet Water Footprint
di: Joshi, Saurav, et al.
Pubblicazione: (2024)
di: Joshi, Saurav, et al.
Pubblicazione: (2024)
FIRE: Food Image to REcipe generation
di: Chhikara, Prateek, et al.
Pubblicazione: (2023)
di: Chhikara, Prateek, et al.
Pubblicazione: (2023)
UnAC: Adaptive Visual Prompting with Abstraction and Stepwise Checking for Complex Multimodal Reasoning
di: Wang, Yifan, et al.
Pubblicazione: (2026)
di: Wang, Yifan, et al.
Pubblicazione: (2026)
Surprising Resilience of Science During a Global Pandemic: A Large-Scale Descriptive Analysis
di: Ahrabian, Kian, et al.
Pubblicazione: (2024)
di: Ahrabian, Kian, et al.
Pubblicazione: (2024)
Surprising Resilience of Scientific Publication during a Global Pandemic: A Large‐Scale Bibliometric Analysis
di: Casandra Rusti, et al.
Pubblicazione: (2025)
di: Casandra Rusti, et al.
Pubblicazione: (2025)
A Systematic Analysis of Base Model Choice for Reward Modeling
di: Ahrabian, Kian, et al.
Pubblicazione: (2025)
di: Ahrabian, Kian, et al.
Pubblicazione: (2025)
Structural Abstraction as an Inductive Bias for Non-Stationary Language Model Training
di: Rahmati, Elnaz, et al.
Pubblicazione: (2026)
di: Rahmati, Elnaz, et al.
Pubblicazione: (2026)
Visual Superordinate Abstraction for Robust Concept Learning
di: Zheng, Qi, et al.
Pubblicazione: (2022)
di: Zheng, Qi, et al.
Pubblicazione: (2022)
On The Adaptation of Unlimiformer for Decoder-Only Transformers
di: Ahrabian, Kian, et al.
Pubblicazione: (2024)
di: Ahrabian, Kian, et al.
Pubblicazione: (2024)
Enhancing Structural Mapping with LLM-derived Abstractions for Analogical Reasoning in Narratives
di: Khojasteh, Mohammadhossein, et al.
Pubblicazione: (2026)
di: Khojasteh, Mohammadhossein, et al.
Pubblicazione: (2026)
NarrativeTrack: Evaluating Entity-Centric Reasoning for Narrative Understanding
di: Ha, Hyeonjeong, et al.
Pubblicazione: (2026)
di: Ha, Hyeonjeong, et al.
Pubblicazione: (2026)
MARVEL: Universal Murray's Law-informed Vessel Tree Segmentation and Topology Estimation
di: Zhou, Yi, et al.
Pubblicazione: (2026)
di: Zhou, Yi, et al.
Pubblicazione: (2026)
REVEAL -- Reasoning and Evaluation of Visual Evidence through Aligned Language
di: Praharaj, Ipsita, et al.
Pubblicazione: (2025)
di: Praharaj, Ipsita, et al.
Pubblicazione: (2025)
U-MARVEL: Unveiling Key Factors for Universal Multimodal Retrieval via Embedding Learning with MLLMs
di: Li, Xiaojie, et al.
Pubblicazione: (2025)
di: Li, Xiaojie, et al.
Pubblicazione: (2025)
Visual Reasoning through Tool-supervised Reinforcement Learning
di: Dong, Qihua, et al.
Pubblicazione: (2026)
di: Dong, Qihua, et al.
Pubblicazione: (2026)
The Homogenizing Effect of Large Language Models on Human Expression and Thought
di: Sourati, Zhivar, et al.
Pubblicazione: (2025)
di: Sourati, Zhivar, et al.
Pubblicazione: (2025)
Beyond Perception: Evaluating Abstract Visual Reasoning through Multi-Stage Task
di: Jiang, Yanbei, et al.
Pubblicazione: (2025)
di: Jiang, Yanbei, et al.
Pubblicazione: (2025)
SEA: Evaluating Sketch Abstraction Efficiency via Element-level Commonsense Visual Question Answering
di: Park, Jiho, et al.
Pubblicazione: (2026)
di: Park, Jiho, et al.
Pubblicazione: (2026)
Clue Matters: Leveraging Latent Visual Clues to Empower Video Reasoning
di: zhang, Kaixin, et al.
Pubblicazione: (2026)
di: zhang, Kaixin, et al.
Pubblicazione: (2026)
VERIFY: A Benchmark of Visual Explanation and Reasoning for Investigating Multimodal Reasoning Fidelity
di: Bi, Jing, et al.
Pubblicazione: (2025)
di: Bi, Jing, et al.
Pubblicazione: (2025)
Task-Aware Image Signal Processor for Advanced Visual Perception
di: Chen, Kai, et al.
Pubblicazione: (2025)
di: Chen, Kai, et al.
Pubblicazione: (2025)
MARVEL-40M+: Multi-Level Visual Elaboration for High-Fidelity Text-to-3D Content Creation
di: Sinha, Sankalp, et al.
Pubblicazione: (2024)
di: Sinha, Sankalp, et al.
Pubblicazione: (2024)
The Abstraction Gap in Vision-Language Causal Reasoning
di: Hoang, Chinh, et al.
Pubblicazione: (2026)
di: Hoang, Chinh, et al.
Pubblicazione: (2026)
MOOSS: Mask-Enhanced Temporal Contrastive Learning for Smooth State Evolution in Visual Reinforcement Learning
di: Sun, Jiarui, et al.
Pubblicazione: (2024)
di: Sun, Jiarui, et al.
Pubblicazione: (2024)
A Practical Analysis of Human Alignment with *PO
di: Ahrabian, Kian, et al.
Pubblicazione: (2024)
di: Ahrabian, Kian, et al.
Pubblicazione: (2024)
MoviePuzzle: Visual Narrative Reasoning through Multimodal Order Learning
di: Wang, Jianghui, et al.
Pubblicazione: (2023)
di: Wang, Jianghui, et al.
Pubblicazione: (2023)
Learning Pixel-adaptive Multi-layer Perceptrons for Real-time Image Enhancement
di: Lou, Junyu, et al.
Pubblicazione: (2025)
di: Lou, Junyu, et al.
Pubblicazione: (2025)
Do You See Me : A Multidimensional Benchmark for Evaluating Visual Perception in Multimodal LLMs
di: Kanade, Aditya, et al.
Pubblicazione: (2025)
di: Kanade, Aditya, et al.
Pubblicazione: (2025)
Documenti analoghi
-
The Curious Case of Nonverbal Abstract Reasoning with Multi-Modal Large Language Models
di: Ahrabian, Kian, et al.
Pubblicazione: (2024) -
ARN: Analogical Reasoning on Narratives
di: Sourati, Zhivar, et al.
Pubblicazione: (2023) -
COLUMBUS: Evaluating COgnitive Lateral Understanding through Multiple-choice reBUSes
di: Kraaijveld, Koen, et al.
Pubblicazione: (2024) -
Contextualizing Argument Quality Assessment with Relevant Knowledge
di: Deshpande, Darshan, et al.
Pubblicazione: (2023) -
Towards Perceiving Small Visual Details in Zero-shot Visual Question Answering with Multimodal LLMs
di: Zhang, Jiarui, et al.
Pubblicazione: (2023)