Self-Refining Vision Language Model for Robotic Failure Detection and Reasoning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Qi, Carl, Wang, Xiaojie, Yong, Silong, Sheng, Stephen, Mao, Huitan, Srinivasan, Sriram, Nambi, Manikantan, Zhang, Amy, Dattatreya, Yesh |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Generalizable Dense Reward for Long-Horizon Robotic Tasks
par: Yong, Silong, et autres
Publié: (2026)
par: Yong, Silong, et autres
Publié: (2026)
AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation
par: Duan, Jiafei, et autres
Publié: (2024)
par: Duan, Jiafei, et autres
Publié: (2024)
I-FailSense: Towards General Robotic Failure Detection with Vision-Language Models
par: Grislain, Clemence, et autres
Publié: (2025)
par: Grislain, Clemence, et autres
Publié: (2025)
HydroShear: Hydroelastic Shear Simulation for Tactile Sim-to-Real Reinforcement Learning
par: Dang, An, et autres
Publié: (2026)
par: Dang, An, et autres
Publié: (2026)
Scaling Cross-Environment Failure Reasoning Data for Vision-Language Robotic Manipulation
par: Pacaud, Paul, et autres
Publié: (2025)
par: Pacaud, Paul, et autres
Publié: (2025)
Automating Robot Failure Recovery Using Vision-Language Models With Optimized Prompts
par: Chen, Hongyi, et autres
Publié: (2024)
par: Chen, Hongyi, et autres
Publié: (2024)
FailSafe: Reasoning and Recovery from Failures in Vision-Language-Action Models
par: Lin, Zijun, et autres
Publié: (2025)
par: Lin, Zijun, et autres
Publié: (2025)
Addressing Failures in Robotics using Vision-Based Language Models (VLMs) and Behavior Trees (BT)
par: Ahmad, Faseeh, et autres
Publié: (2024)
par: Ahmad, Faseeh, et autres
Publié: (2024)
SAFE: Multitask Failure Detection for Vision-Language-Action Models
par: Gu, Qiao, et autres
Publié: (2025)
par: Gu, Qiao, et autres
Publié: (2025)
Large Language Models Enable Automated Formative Feedback in Human-Robot Interaction Tasks
par: Jensen, Emily, et autres
Publié: (2024)
par: Jensen, Emily, et autres
Publié: (2024)
Vision-Language Model-based Physical Reasoning for Robot Liquid Perception
par: Lai, Wenqiang, et autres
Publié: (2024)
par: Lai, Wenqiang, et autres
Publié: (2024)
VLMPC: Vision-Language Model Predictive Control for Robotic Manipulation
par: Zhao, Wentao, et autres
Publié: (2024)
par: Zhao, Wentao, et autres
Publié: (2024)
Large Reward Models: Generalizable Online Robot Reward Generation with Vision-Language Models
par: Wu, Yanru, et autres
Publié: (2026)
par: Wu, Yanru, et autres
Publié: (2026)
Commonsense Reasoning for Legged Robot Adaptation with Vision-Language Models
par: Chen, Annie S., et autres
Publié: (2024)
par: Chen, Annie S., et autres
Publié: (2024)
Generalizable Vision-Language Few-Shot Adaptation with Predictive Prompts and Negative Learning
par: Mandalika, Sriram
Publié: (2025)
par: Mandalika, Sriram
Publié: (2025)
ReconVLA: An Uncertainty-Guided and Failure-Aware Vision-Language-Action Framework for Robotic Control
par: Chen, Lingling, et autres
Publié: (2026)
par: Chen, Lingling, et autres
Publié: (2026)
RoboTracer: Mastering Spatial Trace with Reasoning in Vision-Language Models for Robotics
par: Zhou, Enshen, et autres
Publié: (2025)
par: Zhou, Enshen, et autres
Publié: (2025)
RoboStream: Weaving Spatio-Temporal Reasoning with Memory in Vision-Language Models for Robotics
par: Huang, Yuzhi, et autres
Publié: (2026)
par: Huang, Yuzhi, et autres
Publié: (2026)
Graph-Fused Vision-Language-Action for Policy Reasoning in Multi-Arm Robotic Manipulation
par: Li, Shunlei, et autres
Publié: (2025)
par: Li, Shunlei, et autres
Publié: (2025)
Counterfactual VLA: Self-Reflective Vision-Language-Action Model with Adaptive Reasoning
par: Peng, Zhenghao "Mark", et autres
Publié: (2025)
par: Peng, Zhenghao "Mark", et autres
Publié: (2025)
TIGeR: Tool-Integrated Geometric Reasoning in Vision-Language Models for Robotics
par: Han, Yi, et autres
Publié: (2025)
par: Han, Yi, et autres
Publié: (2025)
DyNaVLM: Zero-Shot Vision-Language Navigation System with Dynamic Viewpoints and Self-Refining Graph Memory
par: Ji, Zihe, et autres
Publié: (2025)
par: Ji, Zihe, et autres
Publié: (2025)
RoboRefer: Towards Spatial Referring with Reasoning in Vision-Language Models for Robotics
par: Zhou, Enshen, et autres
Publié: (2025)
par: Zhou, Enshen, et autres
Publié: (2025)
Latent Space Reinforcement Learning for Multi-Robot Exploration
par: Rajasekar, Sriram, et autres
Publié: (2026)
par: Rajasekar, Sriram, et autres
Publié: (2026)
Multi-Robot Object SLAM Using Distributed Variational Inference
par: Cao, Hanwen, et autres
Publié: (2024)
par: Cao, Hanwen, et autres
Publié: (2024)
Experiences from Benchmarking Vision-Language-Action Models for Robotic Manipulation
par: Zhang, Yihao, et autres
Publié: (2025)
par: Zhang, Yihao, et autres
Publié: (2025)
Code-as-Monitor: Constraint-aware Visual Programming for Reactive and Proactive Robotic Failure Detection
par: Zhou, Enshen, et autres
Publié: (2024)
par: Zhou, Enshen, et autres
Publié: (2024)
MERGE: Guided Vision-Language Models for Multi-Actor Event Reasoning and Grounding in Human-Robot Interaction
par: Deigmoeller, Joerg, et autres
Publié: (2026)
par: Deigmoeller, Joerg, et autres
Publié: (2026)
Decentralized LLM-Driven Coordination of Acoustic Robots for Contactless Object Manipulation
par: Wang, Yingying, et autres
Publié: (2026)
par: Wang, Yingying, et autres
Publié: (2026)
SARO: Space-Aware Robot System for Terrain Crossing via Vision-Language Model
par: Zhu, Shaoting, et autres
Publié: (2024)
par: Zhu, Shaoting, et autres
Publié: (2024)
Vision-Based Reasoning with Topology-Encoded Graphs for Anatomical Path Disambiguation in Robot-Assisted Endovascular Navigation
par: Zhao, Jiyuan, et autres
Publié: (2026)
par: Zhao, Jiyuan, et autres
Publié: (2026)
ViLAM: Distilling Vision-Language Reasoning into Attention Maps for Social Robot Navigation
par: Elnoor, Mohamed, et autres
Publié: (2025)
par: Elnoor, Mohamed, et autres
Publié: (2025)
Generalized Robot 3D Vision-Language Model with Fast Rendering and Pre-Training Vision-Language Alignment
par: Liu, Kangcheng, et autres
Publié: (2023)
par: Liu, Kangcheng, et autres
Publié: (2023)
Empathetic Motion Generation for Humanoid Educational Robots via Reasoning-Guided Vision--Language--Motion Diffusion Architecture
par: Sun, Fuze, et autres
Publié: (2026)
par: Sun, Fuze, et autres
Publié: (2026)
AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation
par: Guo, Wenxuan, et autres
Publié: (2026)
par: Guo, Wenxuan, et autres
Publié: (2026)
MoTVLA: A Vision-Language-Action Model with Unified Fast-Slow Reasoning
par: Huang, Wenhui, et autres
Publié: (2025)
par: Huang, Wenhui, et autres
Publié: (2025)
Failing Forward: Adaptive Failure-Informed Learning for Vision-Language-Action Models
par: Zheng, Meng, et autres
Publié: (2026)
par: Zheng, Meng, et autres
Publié: (2026)
ERR@HRI 2024 Challenge: Multimodal Detection of Errors and Failures in Human-Robot Interactions
par: Spitale, Micol, et autres
Publié: (2024)
par: Spitale, Micol, et autres
Publié: (2024)
Beyond Success: Refining Elegant Robot Manipulation from Mixed-Quality Data via Just-in-Time Intervention
par: Mao, Yanbo, et autres
Publié: (2025)
par: Mao, Yanbo, et autres
Publié: (2025)
LACY: A Vision-Language Model-based Language-Action Cycle for Self-Improving Robotic Manipulation
par: Hong, Youngjin, et autres
Publié: (2025)
par: Hong, Youngjin, et autres
Publié: (2025)
Documents similaires
-
Generalizable Dense Reward for Long-Horizon Robotic Tasks
par: Yong, Silong, et autres
Publié: (2026) -
AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation
par: Duan, Jiafei, et autres
Publié: (2024) -
I-FailSense: Towards General Robotic Failure Detection with Vision-Language Models
par: Grislain, Clemence, et autres
Publié: (2025) -
HydroShear: Hydroelastic Shear Simulation for Tactile Sim-to-Real Reinforcement Learning
par: Dang, An, et autres
Publié: (2026) -
Scaling Cross-Environment Failure Reasoning Data for Vision-Language Robotic Manipulation
par: Pacaud, Paul, et autres
Publié: (2025)