Cognitive Science-Inspired Evaluation of Core Capabilities for Object Understanding in AI
Fuente:
arXiv
Salvato in:
| Autori principali: | Rutar, Danaja, Markelius, Alva, Voudouris, Konstantinos, Hernández-Orallo, José, Cheke, Lucy |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Inferring Capabilities from Task Performance with Bayesian Triangulation
di: Burden, John, et al.
Pubblicazione: (2023)
di: Burden, John, et al.
Pubblicazione: (2023)
Bringing Comparative Cognition To Computers
di: Voudouris, Konstantinos, et al.
Pubblicazione: (2025)
di: Voudouris, Konstantinos, et al.
Pubblicazione: (2025)
CogME: A Cognition-Inspired Multi-Dimensional Evaluation Metric for Story Understanding
di: Shin, Minjung, et al.
Pubblicazione: (2021)
di: Shin, Minjung, et al.
Pubblicazione: (2021)
I Spy With My Model's Eye: Visual Search as a Behavioural Test for MLLMs
di: Burden, John, et al.
Pubblicazione: (2025)
di: Burden, John, et al.
Pubblicazione: (2025)
Symphony: A Cognitively-Inspired Multi-Agent System for Long-Video Understanding
di: Yan, Haiyang, et al.
Pubblicazione: (2026)
di: Yan, Haiyang, et al.
Pubblicazione: (2026)
Understanding Generative AI Capabilities in Everyday Image Editing Tasks
di: Taesiri, Mohammad Reza, et al.
Pubblicazione: (2025)
di: Taesiri, Mohammad Reza, et al.
Pubblicazione: (2025)
Evaluation of Safety Cognition Capability in Vision-Language Models for Autonomous Driving
di: Zhang, Enming, et al.
Pubblicazione: (2025)
di: Zhang, Enming, et al.
Pubblicazione: (2025)
Measuring What AI Systems Might Do: Towards A Measurement Science in AI
di: Voudouris, Konstantinos, et al.
Pubblicazione: (2026)
di: Voudouris, Konstantinos, et al.
Pubblicazione: (2026)
GEO-Bench-2: From Performance to Capability, Rethinking Evaluation in Geospatial AI
di: Simumba, Naomi, et al.
Pubblicazione: (2025)
di: Simumba, Naomi, et al.
Pubblicazione: (2025)
100 instances is all you need: predicting the success of a new LLM on unseen data by testing on a few instances
di: Pacchiardi, Lorenzo, et al.
Pubblicazione: (2024)
di: Pacchiardi, Lorenzo, et al.
Pubblicazione: (2024)
Towards Quantitative Evaluation of Explainable AI Methods for Deepfake Detection
di: Tsigos, Konstantinos, et al.
Pubblicazione: (2024)
di: Tsigos, Konstantinos, et al.
Pubblicazione: (2024)
A Cognitive Process-Inspired Architecture for Subject-Agnostic Brain Visual Decoding
di: Lu, Jingyu, et al.
Pubblicazione: (2025)
di: Lu, Jingyu, et al.
Pubblicazione: (2025)
VidEgoThink: Assessing Egocentric Video Understanding Capabilities for Embodied AI
di: Cheng, Sijie, et al.
Pubblicazione: (2024)
di: Cheng, Sijie, et al.
Pubblicazione: (2024)
Cognition-Inspired Dual-Stream Semantic Enhancement for Vision-Based Dynamic Emotion Modeling
di: Wang, Huanzhen, et al.
Pubblicazione: (2026)
di: Wang, Huanzhen, et al.
Pubblicazione: (2026)
ARMOR: Empowering Multimodal Understanding Model with Interleaved Multimodal Generation Capability
di: Sun, Jianwen, et al.
Pubblicazione: (2025)
di: Sun, Jianwen, et al.
Pubblicazione: (2025)
An Empirical Design Justice Approach to Identifying Ethical Considerations in the Intersection of Large Language Models and Social Robotics
di: Markelius, Alva
Pubblicazione: (2024)
di: Markelius, Alva
Pubblicazione: (2024)
TSOM: Small Object Motion Detection Neural Network Inspired by Avian Visual Circuit
di: Hu, Pignge, et al.
Pubblicazione: (2024)
di: Hu, Pignge, et al.
Pubblicazione: (2024)
Trajectory-Aware Adaptive Inference in Object Detection Models
di: Papanikolaou, Grigorios, et al.
Pubblicazione: (2026)
di: Papanikolaou, Grigorios, et al.
Pubblicazione: (2026)
Attention Mechanism based Cognition-level Scene Understanding
di: Tang, Xuejiao, et al.
Pubblicazione: (2022)
di: Tang, Xuejiao, et al.
Pubblicazione: (2022)
MOSABench: Multi-Object Sentiment Analysis Benchmark for Evaluating Multimodal Large Language Models Understanding of Complex Image
di: Song, Shezheng, et al.
Pubblicazione: (2024)
di: Song, Shezheng, et al.
Pubblicazione: (2024)
FreshMem: Brain-Inspired Frequency-Space Hybrid Memory for Streaming Video Understanding
di: Li, Kangcong, et al.
Pubblicazione: (2026)
di: Li, Kangcong, et al.
Pubblicazione: (2026)
Evaluating the Capability of Video Question Generation for Expert Knowledge Elicitation
di: Zhang, Huaying, et al.
Pubblicazione: (2025)
di: Zhang, Huaying, et al.
Pubblicazione: (2025)
Predictable Artificial Intelligence
di: Zhou, Lexin, et al.
Pubblicazione: (2023)
di: Zhou, Lexin, et al.
Pubblicazione: (2023)
Knowledge Graphs of Driving Scenes to Empower the Emerging Capabilities of Neurosymbolic AI
di: Wickramarachchi, Ruwan, et al.
Pubblicazione: (2024)
di: Wickramarachchi, Ruwan, et al.
Pubblicazione: (2024)
Counterfactual Edits for Generative Evaluation
di: Lymperaiou, Maria, et al.
Pubblicazione: (2023)
di: Lymperaiou, Maria, et al.
Pubblicazione: (2023)
Vision-Aware Text Features in Referring Image Segmentation: From Object Understanding to Context Understanding
di: Nguyen-Truong, Hai, et al.
Pubblicazione: (2024)
di: Nguyen-Truong, Hai, et al.
Pubblicazione: (2024)
Masking Matters: Unlocking the Spatial Reasoning Capabilities of LLMs for 3D Scene-Language Understanding
di: Jeon, Yerim, et al.
Pubblicazione: (2025)
di: Jeon, Yerim, et al.
Pubblicazione: (2025)
The Animal-AI Environment: A Virtual Laboratory For Comparative Cognition and Artificial Intelligence Research
di: Voudouris, Konstantinos, et al.
Pubblicazione: (2023)
di: Voudouris, Konstantinos, et al.
Pubblicazione: (2023)
STATUS Bench: A Rigorous Benchmark for Evaluating Object State Understanding in Vision-Language Models
di: Ukai, Mahiro, et al.
Pubblicazione: (2025)
di: Ukai, Mahiro, et al.
Pubblicazione: (2025)
Leaving the barn door open for Clever Hans: Simple features predict LLM benchmark answers
di: Pacchiardi, Lorenzo, et al.
Pubblicazione: (2024)
di: Pacchiardi, Lorenzo, et al.
Pubblicazione: (2024)
Cognitive Mismatch in Multimodal Large Language Models for Discrete Symbol Understanding
di: Li, Yinghui, et al.
Pubblicazione: (2026)
di: Li, Yinghui, et al.
Pubblicazione: (2026)
DOCTR: Disentangled Object-Centric Transformer for Point Scene Understanding
di: Yu, Xiaoxuan, et al.
Pubblicazione: (2024)
di: Yu, Xiaoxuan, et al.
Pubblicazione: (2024)
Cognitively-Inspired Tokens Overcome Egocentric Bias in Multimodal Models
di: Leonard, Bridget, et al.
Pubblicazione: (2026)
di: Leonard, Bridget, et al.
Pubblicazione: (2026)
NeuroBridge: Bio-Inspired Self-Supervised EEG-to-Image Decoding via Cognitive Priors and Bidirectional Semantic Alignment
di: Zhang, Wenjiang, et al.
Pubblicazione: (2025)
di: Zhang, Wenjiang, et al.
Pubblicazione: (2025)
CURVE: Learning Causality-Inspired Invariant Representations for Robust Scene Understanding via Uncertainty-Guided Regularization
di: Liang, Yue, et al.
Pubblicazione: (2026)
di: Liang, Yue, et al.
Pubblicazione: (2026)
ObjectRelator: Enabling Cross-View Object Relation Understanding Across Ego-Centric and Exo-Centric Perspectives
di: Fu, Yuqian, et al.
Pubblicazione: (2024)
di: Fu, Yuqian, et al.
Pubblicazione: (2024)
CSVQA: A Chinese Multimodal Benchmark for Evaluating STEM Reasoning Capabilities of VLMs
di: Jian, Ai, et al.
Pubblicazione: (2025)
di: Jian, Ai, et al.
Pubblicazione: (2025)
Can Multimodal Large Language Models Truly Understand Small Objects?
di: Han, Fujun, et al.
Pubblicazione: (2026)
di: Han, Fujun, et al.
Pubblicazione: (2026)
Uneven Evolution of Cognition Across Generations of Generative AI Models
di: Galatzer-Levy, Isaac, et al.
Pubblicazione: (2026)
di: Galatzer-Levy, Isaac, et al.
Pubblicazione: (2026)
ObjectCompose: Evaluating Resilience of Vision-Based Models on Object-to-Background Compositional Changes
di: Malik, Hashmat Shadab, et al.
Pubblicazione: (2024)
di: Malik, Hashmat Shadab, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Inferring Capabilities from Task Performance with Bayesian Triangulation
di: Burden, John, et al.
Pubblicazione: (2023) -
Bringing Comparative Cognition To Computers
di: Voudouris, Konstantinos, et al.
Pubblicazione: (2025) -
CogME: A Cognition-Inspired Multi-Dimensional Evaluation Metric for Story Understanding
di: Shin, Minjung, et al.
Pubblicazione: (2021) -
I Spy With My Model's Eye: Visual Search as a Behavioural Test for MLLMs
di: Burden, John, et al.
Pubblicazione: (2025) -
Symphony: A Cognitively-Inspired Multi-Agent System for Long-Video Understanding
di: Yan, Haiyang, et al.
Pubblicazione: (2026)