RefBench-PRO: Perceptual and Reasoning Oriented Benchmark for Referring Expression Comprehension
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Gao, Tianyi, Li, Hao, Fang, Han, Wei, Xin, Dong, Xiaodong, Sun, Hongbo, Yuan, Ye, He, Zhongjiang, Xu, Jinglin, Xin, Jingmin, Sun, Hao |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
RefDrone: A Challenging Benchmark for Referring Expression Comprehension in Drone Scenes
von: Sun, Zhichao, et al.
Veröffentlicht: (2025)
von: Sun, Zhichao, et al.
Veröffentlicht: (2025)
RefAerial: A Benchmark and Approach for Referring Detection in Aerial Images
von: Hu, Guyue, et al.
Veröffentlicht: (2026)
von: Hu, Guyue, et al.
Veröffentlicht: (2026)
Ref-Adv: Exploring MLLM Visual Reasoning in Referring Expression Tasks
von: Dong, Qihua, et al.
Veröffentlicht: (2026)
von: Dong, Qihua, et al.
Veröffentlicht: (2026)
WAT: Online Video Understanding Needs Watching Before Thinking
von: Han, Zifan, et al.
Veröffentlicht: (2026)
von: Han, Zifan, et al.
Veröffentlicht: (2026)
RefTok: Reference-Based Tokenization for Video Generation
von: Fan, Xiang, et al.
Veröffentlicht: (2025)
von: Fan, Xiang, et al.
Veröffentlicht: (2025)
Agent-ValueBench: A Comprehensive Benchmark for Evaluating Agent Values
von: Dong, Haonan, et al.
Veröffentlicht: (2026)
von: Dong, Haonan, et al.
Veröffentlicht: (2026)
TSPO: Temporal Sampling Policy Optimization for Long-form Video Language Understanding
von: Tang, Canhui, et al.
Veröffentlicht: (2025)
von: Tang, Canhui, et al.
Veröffentlicht: (2025)
OneRef: Unified One-tower Expression Grounding and Segmentation with Mask Referring Modeling
von: Xiao, Linhui, et al.
Veröffentlicht: (2024)
von: Xiao, Linhui, et al.
Veröffentlicht: (2024)
FineCops-Ref: A new Dataset and Task for Fine-Grained Compositional Referring Expression Comprehension
von: Liu, Junzhuo, et al.
Veröffentlicht: (2024)
von: Liu, Junzhuo, et al.
Veröffentlicht: (2024)
IGL-Bench: Establishing the Comprehensive Benchmark for Imbalanced Graph Learning
von: Qin, Jiawen, et al.
Veröffentlicht: (2024)
von: Qin, Jiawen, et al.
Veröffentlicht: (2024)
PALM-Bench: A Comprehensive Benchmark for Personalized Audio-Language Models
von: Wang, Yuwen, et al.
Veröffentlicht: (2026)
von: Wang, Yuwen, et al.
Veröffentlicht: (2026)
RefEdit: A Benchmark and Method for Improving Instruction-based Image Editing Model on Referring Expressions
von: Pathiraja, Bimsara, et al.
Veröffentlicht: (2025)
von: Pathiraja, Bimsara, et al.
Veröffentlicht: (2025)
PunchBench: Benchmarking MLLMs in Multimodal Punchline Comprehension
von: Ouyang, Kun, et al.
Veröffentlicht: (2024)
von: Ouyang, Kun, et al.
Veröffentlicht: (2024)
LastingBench: Defend Benchmarks Against Knowledge Leakage
von: Fang, Yixiong, et al.
Veröffentlicht: (2025)
von: Fang, Yixiong, et al.
Veröffentlicht: (2025)
CompareBench: A Benchmark for Visual Comparison Reasoning in Vision-Language Models
von: Cai, Jie, et al.
Veröffentlicht: (2025)
von: Cai, Jie, et al.
Veröffentlicht: (2025)
RefAlign: Representation Alignment for Reference-to-Video Generation
von: Wang, Lei, et al.
Veröffentlicht: (2026)
von: Wang, Lei, et al.
Veröffentlicht: (2026)
Segment-Aligned Policy Optimization for Multi-Modal Reasoning
von: Gao, Lei, et al.
Veröffentlicht: (2026)
von: Gao, Lei, et al.
Veröffentlicht: (2026)
OmniEduBench: A Comprehensive Chinese Benchmark for Evaluating Large Language Models in Education
von: Zhang, Min, et al.
Veröffentlicht: (2025)
von: Zhang, Min, et al.
Veröffentlicht: (2025)
T2I-ReasonBench: Benchmarking Reasoning-Informed Text-to-Image Generation
von: Sun, Kaiyue, et al.
Veröffentlicht: (2025)
von: Sun, Kaiyue, et al.
Veröffentlicht: (2025)
CCrepairBench: A High-Fidelity Benchmark and Reinforcement Learning Framework for C++ Compilation Repair
von: Sun, Weixuan, et al.
Veröffentlicht: (2025)
von: Sun, Weixuan, et al.
Veröffentlicht: (2025)
Ref-AVS: Refer and Segment Objects in Audio-Visual Scenes
von: Wang, Yaoting, et al.
Veröffentlicht: (2024)
von: Wang, Yaoting, et al.
Veröffentlicht: (2024)
RefTool: Reference-Guided Tool Creation for Knowledge-Intensive Reasoning
von: Liu, Xiao, et al.
Veröffentlicht: (2025)
von: Liu, Xiao, et al.
Veröffentlicht: (2025)
Benchmarking Semantic Segmentation Models via Appearance and Geometry Attribute Editing
von: Yin, Zijin, et al.
Veröffentlicht: (2026)
von: Yin, Zijin, et al.
Veröffentlicht: (2026)
Training Large Reasoning Models Efficiently via Progressive Thought Encoding
von: Zhang, Zeliang, et al.
Veröffentlicht: (2026)
von: Zhang, Zeliang, et al.
Veröffentlicht: (2026)
ValueBench: Towards Comprehensively Evaluating Value Orientations and Understanding of Large Language Models
von: Ren, Yuanyi, et al.
Veröffentlicht: (2024)
von: Ren, Yuanyi, et al.
Veröffentlicht: (2024)
Introducing Visual Scenes and Reasoning: A More Realistic Benchmark for Spoken Language Understanding
von: Wu, Di, et al.
Veröffentlicht: (2025)
von: Wu, Di, et al.
Veröffentlicht: (2025)
AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation
von: Wang, Lu, et al.
Veröffentlicht: (2025)
von: Wang, Lu, et al.
Veröffentlicht: (2025)
A two-component dark matter model with $Z_2 \times Z_4$ symmetry
von: Qi, XinXin, et al.
Veröffentlicht: (2025)
von: Qi, XinXin, et al.
Veröffentlicht: (2025)
Dark matter, leptogenesis and Z' in the B-L model
von: Qi, XinXin, et al.
Veröffentlicht: (2024)
von: Qi, XinXin, et al.
Veröffentlicht: (2024)
Z_5 two-component dark matter in the Type-II seesaw mechanism
von: Qi, XinXin, et al.
Veröffentlicht: (2024)
von: Qi, XinXin, et al.
Veröffentlicht: (2024)
FIMPs in a two-component dark matter model with $Z_2 \times Z_4$ symmetry
von: Qi, XinXin, et al.
Veröffentlicht: (2026)
von: Qi, XinXin, et al.
Veröffentlicht: (2026)
Copositive criteria for a two-component dark matter model
von: Qi, Xin-Xin, et al.
Veröffentlicht: (2024)
von: Qi, Xin-Xin, et al.
Veröffentlicht: (2024)
Mixed WIMP-FIMP scenario in a two-component dark matter model
von: Qi, XinXin, et al.
Veröffentlicht: (2025)
von: Qi, XinXin, et al.
Veröffentlicht: (2025)
FED-Bench: A Cross-Granular Benchmark for Disentangled Evaluation of Facial Expression Editing
von: Xue, Fengjian, et al.
Veröffentlicht: (2026)
von: Xue, Fengjian, et al.
Veröffentlicht: (2026)
VisChainBench: A Benchmark for Multi-Turn, Multi-Image Visual Reasoning Beyond Language Priors
von: Lyu, Wenbo, et al.
Veröffentlicht: (2025)
von: Lyu, Wenbo, et al.
Veröffentlicht: (2025)
DecompileBench: A Comprehensive Benchmark for Evaluating Decompilers in Real-World Scenarios
von: Gao, Zeyu, et al.
Veröffentlicht: (2025)
von: Gao, Zeyu, et al.
Veröffentlicht: (2025)
BioProBench: Comprehensive Dataset and Benchmark in Biological Protocol Understanding and Reasoning
von: Liu, Yuyang, et al.
Veröffentlicht: (2025)
von: Liu, Yuyang, et al.
Veröffentlicht: (2025)
GuideBench: Benchmarking Domain-Oriented Guideline Following for LLM Agents
von: Diao, Lingxiao, et al.
Veröffentlicht: (2025)
von: Diao, Lingxiao, et al.
Veröffentlicht: (2025)
ReMeREC: Relation-aware and Multi-entity Referring Expression Comprehension
von: Hu, Yizhi, et al.
Veröffentlicht: (2025)
von: Hu, Yizhi, et al.
Veröffentlicht: (2025)
CoCo-Bench: A Comprehensive Code Benchmark For Multi-task Large Language Model Evaluation
von: Yin, Wenjing, et al.
Veröffentlicht: (2025)
von: Yin, Wenjing, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
RefDrone: A Challenging Benchmark for Referring Expression Comprehension in Drone Scenes
von: Sun, Zhichao, et al.
Veröffentlicht: (2025) -
RefAerial: A Benchmark and Approach for Referring Detection in Aerial Images
von: Hu, Guyue, et al.
Veröffentlicht: (2026) -
Ref-Adv: Exploring MLLM Visual Reasoning in Referring Expression Tasks
von: Dong, Qihua, et al.
Veröffentlicht: (2026) -
WAT: Online Video Understanding Needs Watching Before Thinking
von: Han, Zifan, et al.
Veröffentlicht: (2026) -
RefTok: Reference-Based Tokenization for Video Generation
von: Fan, Xiang, et al.
Veröffentlicht: (2025)