EvoEmpirBench: Dynamic Spatial Reasoning with Agent-ExpVer
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhao, Pukun, Wang, Longxiang, Wang, Miaowei, Chen, Chen, Zhou, Fanqing, Huang, Haojian |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
STAR: Mitigating Cascading Errors in Spatial Reasoning via Turn-point Alignment and Segment-level DPO
di: Zhao, Pukun, et al.
Pubblicazione: (2026)
di: Zhao, Pukun, et al.
Pubblicazione: (2026)
FineQuest: Adaptive Knowledge-Assisted Sports Video Understanding via Agent-of-Thoughts Reasoning
di: Chen, Haodong, et al.
Pubblicazione: (2025)
di: Chen, Haodong, et al.
Pubblicazione: (2025)
Find, Fix, Reason: Context Repair for Video Reasoning
di: Huang, Haojian, et al.
Pubblicazione: (2026)
di: Huang, Haojian, et al.
Pubblicazione: (2026)
ExpVid: A Benchmark for Experiment Video Understanding & Reasoning
di: Xu, Yicheng, et al.
Pubblicazione: (2025)
di: Xu, Yicheng, et al.
Pubblicazione: (2025)
SPRig: Self-Supervised Pose-Invariant Rigging from Mesh Sequences
di: Wang, Ruipeng, et al.
Pubblicazione: (2026)
di: Wang, Ruipeng, et al.
Pubblicazione: (2026)
DSI-Bench: A Benchmark for Dynamic Spatial Intelligence
di: Zhang, Ziang, et al.
Pubblicazione: (2025)
di: Zhang, Ziang, et al.
Pubblicazione: (2025)
Memory-Anchored Multimodal Reasoning for Explainable Video Forensics
di: Chen, Chen, et al.
Pubblicazione: (2025)
di: Chen, Chen, et al.
Pubblicazione: (2025)
CanFields: Consolidating Diffeomorphic Flows for Non-Rigid 4D Interpolation from Arbitrary-Length Sequences
di: Wang, Miaowei, et al.
Pubblicazione: (2024)
di: Wang, Miaowei, et al.
Pubblicazione: (2024)
Affordance Agent Harness: Verification-Gated Skill Orchestration
di: Huang, Haojian, et al.
Pubblicazione: (2026)
di: Huang, Haojian, et al.
Pubblicazione: (2026)
SIRI-Bench: Challenging VLMs' Spatial Intelligence through Complex Reasoning Tasks
di: Song, Zijian, et al.
Pubblicazione: (2025)
di: Song, Zijian, et al.
Pubblicazione: (2025)
SpatialEvo: Self-Evolving Spatial Intelligence via Deterministic Geometric Environments
di: Li, Dinging, et al.
Pubblicazione: (2026)
di: Li, Dinging, et al.
Pubblicazione: (2026)
Empir3D : A Framework for Multi-Dimensional Point Cloud Assessment
di: Turkar, Yash, et al.
Pubblicazione: (2023)
di: Turkar, Yash, et al.
Pubblicazione: (2023)
InfiniBench: Infinite Benchmarking for Visual Spatial Reasoning with Customizable Scene Complexity
di: Wang, Haoming, et al.
Pubblicazione: (2025)
di: Wang, Haoming, et al.
Pubblicazione: (2025)
EgoMind: Activating Spatial Cognition through Linguistic Reasoning in MLLMs
di: Chen, Zhenghao, et al.
Pubblicazione: (2026)
di: Chen, Zhenghao, et al.
Pubblicazione: (2026)
RoadBench: Benchmarking MLLMs on Fine-Grained Spatial Understanding and Reasoning under Urban Road Scenarios
di: Zhang, Jun, et al.
Pubblicazione: (2025)
di: Zhang, Jun, et al.
Pubblicazione: (2025)
PhyBench: A Physical Commonsense Benchmark for Evaluating Text-to-Image Models
di: Meng, Fanqing, et al.
Pubblicazione: (2024)
di: Meng, Fanqing, et al.
Pubblicazione: (2024)
Learning to Reason in 4D: Dynamic Spatial Understanding for Vision Language Models
di: Zhou, Shengchao, et al.
Pubblicazione: (2025)
di: Zhou, Shengchao, et al.
Pubblicazione: (2025)
RoboStressBench: Benchmarking VLM Robustness to Physical Visual Stress in Embodied Scenes
di: Wu, Leyi, et al.
Pubblicazione: (2026)
di: Wu, Leyi, et al.
Pubblicazione: (2026)
IndustryNav: Exploring Spatial Reasoning of Embodied Agents in Dynamic Industrial Navigation
di: Li, Yifan, et al.
Pubblicazione: (2025)
di: Li, Yifan, et al.
Pubblicazione: (2025)
CausalSpatial: A Benchmark for Object-Centric Causal Spatial Reasoning
di: Ma, Wenxin, et al.
Pubblicazione: (2026)
di: Ma, Wenxin, et al.
Pubblicazione: (2026)
SpatialBench: Is Your Spatial Foundation Model an All-Round Player?
di: Peng, Haosong, et al.
Pubblicazione: (2026)
di: Peng, Haosong, et al.
Pubblicazione: (2026)
Spatial4D-Bench: A Versatile 4D Spatial Intelligence Benchmark
di: Wang, Pan, et al.
Pubblicazione: (2025)
di: Wang, Pan, et al.
Pubblicazione: (2025)
CubeBench: Diagnosing Interactive, Long-Horizon Spatial Reasoning Under Partial Observations
di: Gao, Huan-ang, et al.
Pubblicazione: (2025)
di: Gao, Huan-ang, et al.
Pubblicazione: (2025)
STAIR: Spatial-Temporal Reasoning with Auditable Intermediate Results for Video Question Answering
di: Wang, Yueqian, et al.
Pubblicazione: (2024)
di: Wang, Yueqian, et al.
Pubblicazione: (2024)
EventPrune: Cascaded Event-Assisted Token Pruning for Efficient First-Person Dynamic Spatial Reasoning
di: Ma, Pengtao, et al.
Pubblicazione: (2026)
di: Ma, Pengtao, et al.
Pubblicazione: (2026)
Geometrically-Constrained Agent for Spatial Reasoning
di: Chen, Zeren, et al.
Pubblicazione: (2025)
di: Chen, Zeren, et al.
Pubblicazione: (2025)
GaussianVTON: 3D Human Virtual Try-ON via Multi-Stage Gaussian Splatting Editing with Image Prompting
di: Chen, Haodong, et al.
Pubblicazione: (2024)
di: Chen, Haodong, et al.
Pubblicazione: (2024)
V-ReasonBench: Toward Unified Reasoning Benchmark Suite for Video Generation Models
di: Luo, Yang, et al.
Pubblicazione: (2025)
di: Luo, Yang, et al.
Pubblicazione: (2025)
FineCLIPER: Multi-modal Fine-grained CLIP for Dynamic Facial Expression Recognition with AdaptERs
di: Chen, Haodong, et al.
Pubblicazione: (2024)
di: Chen, Haodong, et al.
Pubblicazione: (2024)
Evo-0: Vision-Language-Action Model with Implicit Spatial Understanding
di: Lin, Tao, et al.
Pubblicazione: (2025)
di: Lin, Tao, et al.
Pubblicazione: (2025)
EarthSpatialBench: Benchmarking Spatial Reasoning Capabilities of Multimodal LLMs on Earth Imagery
di: Xu, Zelin, et al.
Pubblicazione: (2026)
di: Xu, Zelin, et al.
Pubblicazione: (2026)
DR-MMSearchAgent: Deepening Reasoning in Multimodal Search Agents
di: Wang, Shengqin, et al.
Pubblicazione: (2026)
di: Wang, Shengqin, et al.
Pubblicazione: (2026)
Vision-Language Memory for Spatial Reasoning
di: Liu, Zuntao, et al.
Pubblicazione: (2025)
di: Liu, Zuntao, et al.
Pubblicazione: (2025)
Spatial-Conditioned Reasoning in Long-Egocentric Videos
di: Tribble, James, et al.
Pubblicazione: (2026)
di: Tribble, James, et al.
Pubblicazione: (2026)
SpinBench: Perspective and Rotation as a Lens on Spatial Reasoning in VLMs
di: Zhang, Yuyou, et al.
Pubblicazione: (2025)
di: Zhang, Yuyou, et al.
Pubblicazione: (2025)
Hierarchical Fine-grained Preference Optimization for Physically Plausible Video Generation
di: Chen, Harold Haodong, et al.
Pubblicazione: (2025)
di: Chen, Harold Haodong, et al.
Pubblicazione: (2025)
TiViBench: Benchmarking Think-in-Video Reasoning for Video Generative Models
di: Chen, Harold Haodong, et al.
Pubblicazione: (2025)
di: Chen, Harold Haodong, et al.
Pubblicazione: (2025)
Q-GeoMem: Question-Guided Geometric Memory for Video Spatial Reasoning
di: Gao, Xianqiang, et al.
Pubblicazione: (2026)
di: Gao, Xianqiang, et al.
Pubblicazione: (2026)
UniREditBench: A Unified Reasoning-based Image Editing Benchmark
di: Han, Feng, et al.
Pubblicazione: (2025)
di: Han, Feng, et al.
Pubblicazione: (2025)
MSNav: Zero-Shot Vision-and-Language Navigation with Dynamic Memory and LLM Spatial Reasoning
di: Liu, Chenghao, et al.
Pubblicazione: (2025)
di: Liu, Chenghao, et al.
Pubblicazione: (2025)
Documenti analoghi
-
STAR: Mitigating Cascading Errors in Spatial Reasoning via Turn-point Alignment and Segment-level DPO
di: Zhao, Pukun, et al.
Pubblicazione: (2026) -
FineQuest: Adaptive Knowledge-Assisted Sports Video Understanding via Agent-of-Thoughts Reasoning
di: Chen, Haodong, et al.
Pubblicazione: (2025) -
Find, Fix, Reason: Context Repair for Video Reasoning
di: Huang, Haojian, et al.
Pubblicazione: (2026) -
ExpVid: A Benchmark for Experiment Video Understanding & Reasoning
di: Xu, Yicheng, et al.
Pubblicazione: (2025) -
SPRig: Self-Supervised Pose-Invariant Rigging from Mesh Sequences
di: Wang, Ruipeng, et al.
Pubblicazione: (2026)