UR-Bench: A Benchmark for Multi-Hop Reasoning over Ultra-High-Resolution Images
Fuente:
arXiv
Saved in:
| Main Authors: | Li, Siqi, Cai, Xinyu, Mei, Jianbiao, Deng, Nianchen, Cai, Pinlong, Wen, Licheng, Shen, Yufan, Yang, Xuemeng, Shi, Botian, Liu, Yong |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Learning on the Job: An Experience-Driven Self-Evolving Agent for Long-Horizon Tasks
by: Yang, Cheng, et al.
Published: (2025)
by: Yang, Cheng, et al.
Published: (2025)
KG-TRACES: Enhancing Large Language Models with Knowledge Graph-constrained Trajectory Reasoning and Attribution Supervision
by: Wu, Rong, et al.
Published: (2025)
by: Wu, Rong, et al.
Published: (2025)
The Agent's First Day: Benchmarking Learning, Exploration, and Scheduling in the Workplace Scenarios
by: Fu, Daocheng, et al.
Published: (2026)
by: Fu, Daocheng, et al.
Published: (2026)
RE-Searcher: Robust Agentic Search with Goal-oriented Planning and Self-reflection
by: Fu, Daocheng, et al.
Published: (2025)
by: Fu, Daocheng, et al.
Published: (2025)
EvolveR: Self-Evolving LLM Agents through an Experience-Driven Lifecycle
by: Wu, Rong, et al.
Published: (2025)
by: Wu, Rong, et al.
Published: (2025)
GDI-Bench: A Benchmark for General Document Intelligence with Vision and Reasoning Decoupling
by: Li, Siqi, et al.
Published: (2025)
by: Li, Siqi, et al.
Published: (2025)
Vision-Centric 4D Occupancy Forecasting and Planning via Implicit Residual World Models
by: Mei, Jianbiao, et al.
Published: (2025)
by: Mei, Jianbiao, et al.
Published: (2025)
O$^2$-Searcher: A Searching-based Agent Model for Open-Domain Open-Ended Question Answering
by: Mei, Jianbiao, et al.
Published: (2025)
by: Mei, Jianbiao, et al.
Published: (2025)
Continuously Learning, Adapting, and Improving: A Dual-Process Approach to Autonomous Driving
by: Mei, Jianbiao, et al.
Published: (2024)
by: Mei, Jianbiao, et al.
Published: (2024)
TrafficMCTS: A Closed-Loop Traffic Flow Generation Framework with Group-Based Monte Carlo Tree Search
by: Fu, Ze, et al.
Published: (2023)
by: Fu, Ze, et al.
Published: (2023)
DriveArena: A Closed-loop Generative Simulation Platform for Autonomous Driving
by: Yang, Xuemeng, et al.
Published: (2024)
by: Yang, Xuemeng, et al.
Published: (2024)
LeapVAD: A Leap in Autonomous Driving via Cognitive Perception and Dual-Process Thinking
by: Ma, Yukai, et al.
Published: (2025)
by: Ma, Yukai, et al.
Published: (2025)
LiCROcc: Teach Radar for Accurate Semantic Occupancy Prediction using LiDAR and Camera
by: Ma, Yukai, et al.
Published: (2024)
by: Ma, Yukai, et al.
Published: (2024)
MemVerse: Multimodal Memory for Lifelong Learning Agents
by: Liu, Junming, et al.
Published: (2025)
by: Liu, Junming, et al.
Published: (2025)
OASim: an Open and Adaptive Simulator based on Neural Rendering for Autonomous Driving
by: Yan, Guohang, et al.
Published: (2024)
by: Yan, Guohang, et al.
Published: (2024)
DreamForge: Motion-Aware Autoregressive Video Generation for Multi-View Driving Scenes
by: Mei, Jianbiao, et al.
Published: (2024)
by: Mei, Jianbiao, et al.
Published: (2024)
DiLu: A Knowledge-Driven Approach to Autonomous Driving with Large Language Models
by: Wen, Licheng, et al.
Published: (2023)
by: Wen, Licheng, et al.
Published: (2023)
LimSim Series: An Autonomous Driving Simulation Platform for Validation and Enhancement
by: Fu, Daocheng, et al.
Published: (2025)
by: Fu, Daocheng, et al.
Published: (2025)
LimSim++: A Closed-Loop Platform for Deploying Multimodal LLMs in Autonomous Driving
by: Fu, Daocheng, et al.
Published: (2024)
by: Fu, Daocheng, et al.
Published: (2024)
IWR-Bench: Can LVLMs reconstruct interactive webpage from a user interaction video?
by: Chen, Yang, et al.
Published: (2025)
by: Chen, Yang, et al.
Published: (2025)
Learning Only with Images: Visual Reinforcement Learning with Reasoning, Rendering, and Visual Feedback
by: Chen, Yang, et al.
Published: (2025)
by: Chen, Yang, et al.
Published: (2025)
DeepWriter: A Fact-Grounded Multimodal Writing Assistant Based On Offline Knowledge Base
by: Mao, Song, et al.
Published: (2025)
by: Mao, Song, et al.
Published: (2025)
SPIRAL: Self-Evolving Action-Conditioned Video Generation via Reflective Planning Agents
by: Yang, Yu, et al.
Published: (2026)
by: Yang, Yu, et al.
Published: (2026)
HetaRAG: Hybrid Deep Retrieval-Augmented Generation across Heterogeneous Data Stores
by: Yan, Guohang, et al.
Published: (2025)
by: Yan, Guohang, et al.
Published: (2025)
Investigating Redundancy in Multimodal Large Language Models with Multiple Vision Encoders
by: Wang, Yizhou, et al.
Published: (2025)
by: Wang, Yizhou, et al.
Published: (2025)
Aligning Vision to Language: Annotation-Free Multimodal Knowledge Graph Construction for Enhanced LLMs Reasoning
by: Liu, Junming, et al.
Published: (2025)
by: Liu, Junming, et al.
Published: (2025)
TraceAV-Bench: Benchmarking Multi-Hop Trajectory Reasoning over Long Audio-Visual Videos
by: Feng, Hengyi, et al.
Published: (2026)
by: Feng, Hengyi, et al.
Published: (2026)
SymDrive: Realistic and Controllable Driving Simulator via Symmetric Auto-regressive Online Restoration
by: Liu, Zhiyuan, et al.
Published: (2025)
by: Liu, Zhiyuan, et al.
Published: (2025)
From Ranking to Selection: A Simple but Efficient Dynamic Passage Selector for Retrieval Augmented Generation
by: Meng, Siyuan, et al.
Published: (2025)
by: Meng, Siyuan, et al.
Published: (2025)
RAKG:Document-level Retrieval Augmented Knowledge Graph Construction
by: Zhang, Hairong, et al.
Published: (2025)
by: Zhang, Hairong, et al.
Published: (2025)
LeanRAG: Knowledge-Graph-Based Generation with Semantic Aggregation and Hierarchical Retrieval
by: Zhang, Yaoze, et al.
Published: (2025)
by: Zhang, Yaoze, et al.
Published: (2025)
GIR-Bench: Versatile Benchmark for Generating Images with Reasoning
by: Li, Hongxiang, et al.
Published: (2025)
by: Li, Hongxiang, et al.
Published: (2025)
Adapting Knowledge Prompt Tuning for Enhanced Automated Program Repair
by: Cai, Xuemeng, et al.
Published: (2025)
by: Cai, Xuemeng, et al.
Published: (2025)
KoMA: Knowledge-driven Multi-agent Framework for Autonomous Driving with Large Language Models
by: Jiang, Kemou, et al.
Published: (2024)
by: Jiang, Kemou, et al.
Published: (2024)
CUARewardBench: A Benchmark for Evaluating Reward Models on Computer-using Agent
by: Lin, Haojia, et al.
Published: (2025)
by: Lin, Haojia, et al.
Published: (2025)
CompareBench: A Benchmark for Visual Comparison Reasoning in Vision-Language Models
by: Cai, Jie, et al.
Published: (2025)
by: Cai, Jie, et al.
Published: (2025)
DeonticBench: A Benchmark for Reasoning over Rules
by: Dou, Guangyao, et al.
Published: (2026)
by: Dou, Guangyao, et al.
Published: (2026)
FLUX-Reason-6M & PRISM-Bench: A Million-Scale Text-to-Image Reasoning Dataset and Comprehensive Benchmark
by: Fang, Rongyao, et al.
Published: (2025)
by: Fang, Rongyao, et al.
Published: (2025)
UniEditBench: A Unified and Cost-Effective Benchmark for Image and Video Editing via Distilled MLLMs
by: Jiang, Lifan, et al.
Published: (2026)
by: Jiang, Lifan, et al.
Published: (2026)
FaithCoT-Bench: Benchmarking Instance-Level Faithfulness of Chain-of-Thought Reasoning
by: Shen, Xu, et al.
Published: (2025)
by: Shen, Xu, et al.
Published: (2025)
Similar Items
-
Learning on the Job: An Experience-Driven Self-Evolving Agent for Long-Horizon Tasks
by: Yang, Cheng, et al.
Published: (2025) -
KG-TRACES: Enhancing Large Language Models with Knowledge Graph-constrained Trajectory Reasoning and Attribution Supervision
by: Wu, Rong, et al.
Published: (2025) -
The Agent's First Day: Benchmarking Learning, Exploration, and Scheduling in the Workplace Scenarios
by: Fu, Daocheng, et al.
Published: (2026) -
RE-Searcher: Robust Agentic Search with Goal-oriented Planning and Self-reflection
by: Fu, Daocheng, et al.
Published: (2025) -
EvolveR: Self-Evolving LLM Agents through an Experience-Driven Lifecycle
by: Wu, Rong, et al.
Published: (2025)