PRM-as-a-Judge: A Dense Evaluation Paradigm for Fine-Grained Robotic Auditing
Fuente:
arXiv
Salvato in:
| Autori principali: | Ji, Yuheng, Liu, Yuyang, Tan, Huajie, Huang, Xuchuan, Huang, Fanding, Xu, Yijie, Chi, Cheng, Zhao, Yuting, Lyu, Huaihai, Co, Peterson, Cao, Mingyu, Zhang, Qiongyu, Li, Zhe, Zhou, Enshen, Wang, Pengwei, Wang, Zhongyuan, Zhang, Shanghang, Zheng, Xiaolong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MathSticks: A Benchmark for Visual Symbolic Compositional Reasoning with Matchstick Puzzles
di: Ji, Yuheng, et al.
Pubblicazione: (2025)
di: Ji, Yuheng, et al.
Pubblicazione: (2025)
Action-Sketcher: From Reasoning to Action via Visual Sketches for Long-Horizon Robotic Manipulation
di: Tan, Huajie, et al.
Pubblicazione: (2026)
di: Tan, Huajie, et al.
Pubblicazione: (2026)
Reason-RFT: Reinforcement Fine-Tuning for Visual Reasoning of Vision Language Models
di: Tan, Huajie, et al.
Pubblicazione: (2025)
di: Tan, Huajie, et al.
Pubblicazione: (2025)
Robo-Dopamine: General Process Reward Modeling for High-Precision Robotic Manipulation
di: Tan, Huajie, et al.
Pubblicazione: (2025)
di: Tan, Huajie, et al.
Pubblicazione: (2025)
TIGeR: Tool-Integrated Geometric Reasoning in Vision-Language Models for Robotics
di: Han, Yi, et al.
Pubblicazione: (2025)
di: Han, Yi, et al.
Pubblicazione: (2025)
RoboBrain: A Unified Brain Model for Robotic Manipulation from Abstract to Concrete
di: Ji, Yuheng, et al.
Pubblicazione: (2025)
di: Ji, Yuheng, et al.
Pubblicazione: (2025)
RoboRefer: Towards Spatial Referring with Reasoning in Vision-Language Models for Robotics
di: Zhou, Enshen, et al.
Pubblicazione: (2025)
di: Zhou, Enshen, et al.
Pubblicazione: (2025)
SaPaVe: Towards Active Perception and Manipulation in Vision-Language-Action Models for Robotics
di: Liu, Mengzhen, et al.
Pubblicazione: (2026)
di: Liu, Mengzhen, et al.
Pubblicazione: (2026)
VisualTrans: A Benchmark for Real-World Visual Transformation Reasoning
di: Ji, Yuheng, et al.
Pubblicazione: (2025)
di: Ji, Yuheng, et al.
Pubblicazione: (2025)
RoboTracer: Mastering Spatial Trace with Reasoning in Vision-Language Models for Robotics
di: Zhou, Enshen, et al.
Pubblicazione: (2025)
di: Zhou, Enshen, et al.
Pubblicazione: (2025)
OmniSAT: Compact Action Token, Faster Auto Regression
di: Lyu, Huaihai, et al.
Pubblicazione: (2025)
di: Lyu, Huaihai, et al.
Pubblicazione: (2025)
RoboOS-NeXT: A Unified Memory-based Framework for Lifelong, Scalable, and Robust Multi-Robot Collaboration
di: Tan, Huajie, et al.
Pubblicazione: (2025)
di: Tan, Huajie, et al.
Pubblicazione: (2025)
General Covariant Action Modeling: Constructing Generalized Manifolds via Spatio-Temporal Decoupling
di: Lyu, Huaihai, et al.
Pubblicazione: (2026)
di: Lyu, Huaihai, et al.
Pubblicazione: (2026)
AffordGrasp: In-Context Affordance Reasoning for Open-Vocabulary Task-Oriented Grasping in Clutter
di: Tang, Yingbo, et al.
Pubblicazione: (2025)
di: Tang, Yingbo, et al.
Pubblicazione: (2025)
DW-A-PRM: A Dynamic Weighted Planner
di: Wang, Siyuan, et al.
Pubblicazione: (2025)
di: Wang, Siyuan, et al.
Pubblicazione: (2025)
Video-CoT: A Comprehensive Dataset for Spatiotemporal Understanding of Videos Based on Chain-of-Thought
di: Zhang, Shuyi, et al.
Pubblicazione: (2025)
di: Zhang, Shuyi, et al.
Pubblicazione: (2025)
RoboBrain 2.5: Depth in Sight, Time in Mind
di: Tan, Huajie, et al.
Pubblicazione: (2026)
di: Tan, Huajie, et al.
Pubblicazione: (2026)
METIS: Multi-Source Egocentric Training for Integrated Dexterous Vision-Language-Action Model
di: Fu, Yankai, et al.
Pubblicazione: (2025)
di: Fu, Yankai, et al.
Pubblicazione: (2025)
Code-as-Monitor: Constraint-aware Visual Programming for Reactive and Proactive Robotic Failure Detection
di: Zhou, Enshen, et al.
Pubblicazione: (2024)
di: Zhou, Enshen, et al.
Pubblicazione: (2024)
Towards Cross-View Point Correspondence in Vision-Language Models
di: Wang, Yipu, et al.
Pubblicazione: (2025)
di: Wang, Yipu, et al.
Pubblicazione: (2025)
From Language to Locomotion: Retargeting-free Humanoid Control via Motion Latent Guidance
di: Li, Zhe, et al.
Pubblicazione: (2025)
di: Li, Zhe, et al.
Pubblicazione: (2025)
$NavA^3$: Understanding Any Instruction, Navigating Anywhere, Finding Anything
di: Zhang, Lingfeng, et al.
Pubblicazione: (2025)
di: Zhang, Lingfeng, et al.
Pubblicazione: (2025)
EgoPrompt: Prompt Learning for Egocentric Action Recognition
di: Lyu, Huaihai, et al.
Pubblicazione: (2025)
di: Lyu, Huaihai, et al.
Pubblicazione: (2025)
MapNav: A Novel Memory Representation via Annotated Semantic Maps for Vision-and-Language Navigation
di: Zhang, Lingfeng, et al.
Pubblicazione: (2025)
di: Zhang, Lingfeng, et al.
Pubblicazione: (2025)
Nonstationary Characteristics of Structural Response and Fatigue Life Calculation Under Base Stationary Excitation
di: Jie Wang, et al.
Pubblicazione: (2024)
di: Jie Wang, et al.
Pubblicazione: (2024)
PIGEON: VLM-Driven Object Navigation via Points of Interest Selection
di: Peng, Cheng, et al.
Pubblicazione: (2025)
di: Peng, Cheng, et al.
Pubblicazione: (2025)
RoboMirror: Understand Before You Imitate for Video to Humanoid Locomotion
di: Li, Zhe, et al.
Pubblicazione: (2025)
di: Li, Zhe, et al.
Pubblicazione: (2025)
RoboOS: A Hierarchical Embodied Framework for Cross-Embodiment and Multi-Agent Collaboration
di: Tan, Huajie, et al.
Pubblicazione: (2025)
di: Tan, Huajie, et al.
Pubblicazione: (2025)
Coarse Graining Holographic Black Holes in Higher Curvature Gravity
di: Qi, Qiongyu
Pubblicazione: (2026)
di: Qi, Qiongyu
Pubblicazione: (2026)
DTBS: Dual-Teacher Bi-directional Self-training for Domain Adaptation in Nighttime Semantic Segmentation
di: Huang, Fanding, et al.
Pubblicazione: (2024)
di: Huang, Fanding, et al.
Pubblicazione: (2024)
Lift3D Foundation Policy: Lifting 2D Large-Scale Pretrained Models for Robust 3D Robotic Manipulation
di: Jia, Yueru, et al.
Pubblicazione: (2024)
di: Jia, Yueru, et al.
Pubblicazione: (2024)
TIM-PRM: Verifying multimodal reasoning with Tool-Integrated PRM
di: Kuang, Peng, et al.
Pubblicazione: (2025)
di: Kuang, Peng, et al.
Pubblicazione: (2025)
Do You Have Freestyle? Expressive Humanoid Locomotion via Audio Control
di: Li, Zhe, et al.
Pubblicazione: (2025)
di: Li, Zhe, et al.
Pubblicazione: (2025)
Reshaping Action Error Distributions for Reliable Vision-Language-Action Models
di: Bai, Shuanghao, et al.
Pubblicazione: (2026)
di: Bai, Shuanghao, et al.
Pubblicazione: (2026)
City‐scale buildings damage estimation based on broadband physics‐based ground motion simulation of 2021 M s 6.4 Yangbi, China, earthquake
di: Fangbo Wang, et al.
Pubblicazione: (2024)
di: Fangbo Wang, et al.
Pubblicazione: (2024)
R-PRM: Reasoning-Driven Process Reward Modeling
di: She, Shuaijie, et al.
Pubblicazione: (2025)
di: She, Shuaijie, et al.
Pubblicazione: (2025)
ProJudge: A Multi-Modal Multi-Discipline Benchmark and Instruction-Tuning Dataset for MLLM-based Process Judges
di: Ai, Jiaxin, et al.
Pubblicazione: (2025)
di: Ai, Jiaxin, et al.
Pubblicazione: (2025)
PRM-BAS: Enhancing Multimodal Reasoning through PRM-guided Beam Annealing Search
di: Hu, Pengfei, et al.
Pubblicazione: (2025)
di: Hu, Pengfei, et al.
Pubblicazione: (2025)
Is PRM Necessary? Problem-Solving RL Implicitly Induces PRM Capability in LLMs
di: Feng, Zhangying, et al.
Pubblicazione: (2025)
di: Feng, Zhangying, et al.
Pubblicazione: (2025)
AC-DiT: Adaptive Coordination Diffusion Transformer for Mobile Manipulation
di: Chen, Sixiang, et al.
Pubblicazione: (2025)
di: Chen, Sixiang, et al.
Pubblicazione: (2025)
Documenti analoghi
-
MathSticks: A Benchmark for Visual Symbolic Compositional Reasoning with Matchstick Puzzles
di: Ji, Yuheng, et al.
Pubblicazione: (2025) -
Action-Sketcher: From Reasoning to Action via Visual Sketches for Long-Horizon Robotic Manipulation
di: Tan, Huajie, et al.
Pubblicazione: (2026) -
Reason-RFT: Reinforcement Fine-Tuning for Visual Reasoning of Vision Language Models
di: Tan, Huajie, et al.
Pubblicazione: (2025) -
Robo-Dopamine: General Process Reward Modeling for High-Precision Robotic Manipulation
di: Tan, Huajie, et al.
Pubblicazione: (2025) -
TIGeR: Tool-Integrated Geometric Reasoning in Vision-Language Models for Robotics
di: Han, Yi, et al.
Pubblicazione: (2025)