SkiP: When to Skip and When to Refine for Efficient Robot Manipulation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Dai, Mingtong, Peng, Guanqi, Bai, Yongjie, Yan, Feng, Chen, Chunjie, Liu, Lingbo, Lin, Liang, Wu, Xinyu |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
RoVer: Robot Reward Model as Test-Time Verifier for Vision-Language-Action Model
par: Dai, Mingtong, et autres
Publié: (2025)
par: Dai, Mingtong, et autres
Publié: (2025)
Learning to See and Act: Task-Aware Virtual View Exploration for Robotic Manipulation
par: Bai, Yongjie, et autres
Publié: (2025)
par: Bai, Yongjie, et autres
Publié: (2025)
GraspView: Active Perception Scoring and Best-View Optimization for Robotic Grasping in Cluttered Environments
par: Wang, Shenglin, et autres
Publié: (2025)
par: Wang, Shenglin, et autres
Publié: (2025)
RoboPearls: Editable Video Simulation for Robot Manipulation
par: Tang, Tao, et autres
Publié: (2025)
par: Tang, Tao, et autres
Publié: (2025)
Learning Environment-Aware Affordance for 3D Articulated Object Manipulation under Occlusions
par: Wu, Ruihai, et autres
Publié: (2023)
par: Wu, Ruihai, et autres
Publié: (2023)
When would Vision-Proprioception Policies Fail in Robotic Manipulation?
par: Lu, Jingxian, et autres
Publié: (2026)
par: Lu, Jingxian, et autres
Publié: (2026)
Towards Generalizable Robotic Manipulation in Dynamic Environments
par: Fang, Heng, et autres
Publié: (2026)
par: Fang, Heng, et autres
Publié: (2026)
VERM: Leveraging Foundation Models to Create a Virtual Eye for Efficient 3D Robotic Manipulation
par: Chen, Yixiang, et autres
Publié: (2025)
par: Chen, Yixiang, et autres
Publié: (2025)
TinyVLA: Towards Fast, Data-Efficient Vision-Language-Action Models for Robotic Manipulation
par: Wen, Junjie, et autres
Publié: (2024)
par: Wen, Junjie, et autres
Publié: (2024)
ST-$π$: Structured SpatioTemporal VLA for Robotic Manipulation
par: Ma, Chuanhao, et autres
Publié: (2026)
par: Ma, Chuanhao, et autres
Publié: (2026)
KUDA: Keypoints to Unify Dynamics Learning and Visual Prompting for Open-Vocabulary Robotic Manipulation
par: Liu, Zixian, et autres
Publié: (2025)
par: Liu, Zixian, et autres
Publié: (2025)
Device-Conditioned Neural Architecture Search for Efficient Robotic Manipulation
par: Wu, Yiming, et autres
Publié: (2026)
par: Wu, Yiming, et autres
Publié: (2026)
DFM-VLA: Iterative Action Refinement for Robot Manipulation via Discrete Flow Matching
par: Chen, Jiayi, et autres
Publié: (2026)
par: Chen, Jiayi, et autres
Publié: (2026)
Mitigating the Human-Robot Domain Discrepancy in Visual Pre-training for Robotic Manipulation
par: Zhou, Jiaming, et autres
Publié: (2024)
par: Zhou, Jiaming, et autres
Publié: (2024)
RoBridge: A Hierarchical Architecture Bridging Cognition and Execution for General Robotic Manipulation
par: Zhang, Kaidong, et autres
Publié: (2025)
par: Zhang, Kaidong, et autres
Publié: (2025)
RoboUniView: Visual-Language Model with Unified View Representation for Robotic Manipulation
par: Liu, Fanfan, et autres
Publié: (2024)
par: Liu, Fanfan, et autres
Publié: (2024)
On-Device Diffusion Transformer Policy for Efficient Robot Manipulation
par: Wu, Yiming, et autres
Publié: (2025)
par: Wu, Yiming, et autres
Publié: (2025)
Learning When to See and When to Feel: Adaptive Vision-Torque Fusion for Contact-Aware Manipulation
par: Lei, Jiuzhou, et autres
Publié: (2026)
par: Lei, Jiuzhou, et autres
Publié: (2026)
Object-Centric Instruction Augmentation for Robotic Manipulation
par: Wen, Junjie, et autres
Publié: (2024)
par: Wen, Junjie, et autres
Publié: (2024)
Language-Conditioned Robotic Manipulation with Fast and Slow Thinking
par: Zhu, Minjie, et autres
Publié: (2024)
par: Zhu, Minjie, et autres
Publié: (2024)
H-RDT: Human Manipulation Enhanced Bimanual Robotic Manipulation
par: Bi, Hongzhe, et autres
Publié: (2025)
par: Bi, Hongzhe, et autres
Publié: (2025)
Autonomous Embodied Agents: When Robotics Meets Deep Learning Reasoning
par: Bigazzi, Roberto
Publié: (2025)
par: Bigazzi, Roberto
Publié: (2025)
Semantically Structured Mixture-of-Experts for Compositional Robotic Manipulation
par: Deng, Chengyu, et autres
Publié: (2026)
par: Deng, Chengyu, et autres
Publié: (2026)
Don't Let Your Robot be Harmful: Responsible Robotic Manipulation via Safety-as-Policy
par: Ni, Minheng, et autres
Publié: (2024)
par: Ni, Minheng, et autres
Publié: (2024)
PseudoTouch: Efficiently Imaging the Surface Feel of Objects for Robotic Manipulation
par: Röfer, Adrian, et autres
Publié: (2024)
par: Röfer, Adrian, et autres
Publié: (2024)
SemanticVLA: Semantic-Aligned Sparsification and Enhancement for Efficient Robotic Manipulation
par: Li, Wei, et autres
Publié: (2025)
par: Li, Wei, et autres
Publié: (2025)
A Dual Process VLA: Efficient Robotic Manipulation Leveraging VLM
par: Han, ByungOk, et autres
Publié: (2024)
par: Han, ByungOk, et autres
Publié: (2024)
ClearDepth: Enhanced Stereo Perception of Transparent Objects for Robotic Manipulation
par: Bai, Kaixin, et autres
Publié: (2024)
par: Bai, Kaixin, et autres
Publié: (2024)
When Vision Overrides Language: Evaluating and Mitigating Counterfactual Failures in VLAs
par: Fang, Yu, et autres
Publié: (2026)
par: Fang, Yu, et autres
Publié: (2026)
VidMan: Exploiting Implicit Dynamics from Video Diffusion Model for Effective Robot Manipulation
par: Wen, Youpeng, et autres
Publié: (2024)
par: Wen, Youpeng, et autres
Publié: (2024)
STORM: Search-Guided Generative World Models for Robotic Manipulation
par: Lin, Wenjun, et autres
Publié: (2025)
par: Lin, Wenjun, et autres
Publié: (2025)
Demystifying Action Space Design for Robotic Manipulation Policies
par: Feng, Yuchun, et autres
Publié: (2026)
par: Feng, Yuchun, et autres
Publié: (2026)
ManipArena: Comprehensive Real-world Evaluation of Reasoning-Oriented Generalist Robot Manipulation
par: Sun, Yu, et autres
Publié: (2026)
par: Sun, Yu, et autres
Publié: (2026)
ActiveUMI: Robotic Manipulation with Active Perception from Robot-Free Human Demonstrations
par: Zeng, Qiyuan, et autres
Publié: (2025)
par: Zeng, Qiyuan, et autres
Publié: (2025)
VideoVLA: Video Generators Can Be Generalizable Robot Manipulators
par: Shen, Yichao, et autres
Publié: (2025)
par: Shen, Yichao, et autres
Publié: (2025)
Contrastive Imitation Learning for Language-guided Multi-Task Robotic Manipulation
par: Ma, Teli, et autres
Publié: (2024)
par: Ma, Teli, et autres
Publié: (2024)
MAP-VLA: Memory-Augmented Prompting for Vision-Language-Action Model in Robotic Manipulation
par: Li, Runhao, et autres
Publié: (2025)
par: Li, Runhao, et autres
Publié: (2025)
When Robots Should Say "I Don't Know": Benchmarking Abstention in Embodied Question Answering
par: Wu, Tao, et autres
Publié: (2025)
par: Wu, Tao, et autres
Publié: (2025)
TwinAligner: Visual-Dynamic Alignment Empowers Physics-aware Real2Sim2Real for Robotic Manipulation
par: Fan, Hongwei, et autres
Publié: (2025)
par: Fan, Hongwei, et autres
Publié: (2025)
Manipulation as in Simulation: Enabling Accurate Geometry Perception in Robots
par: Liu, Minghuan, et autres
Publié: (2025)
par: Liu, Minghuan, et autres
Publié: (2025)
Documents similaires
-
RoVer: Robot Reward Model as Test-Time Verifier for Vision-Language-Action Model
par: Dai, Mingtong, et autres
Publié: (2025) -
Learning to See and Act: Task-Aware Virtual View Exploration for Robotic Manipulation
par: Bai, Yongjie, et autres
Publié: (2025) -
GraspView: Active Perception Scoring and Best-View Optimization for Robotic Grasping in Cluttered Environments
par: Wang, Shenglin, et autres
Publié: (2025) -
RoboPearls: Editable Video Simulation for Robot Manipulation
par: Tang, Tao, et autres
Publié: (2025) -
Learning Environment-Aware Affordance for 3D Articulated Object Manipulation under Occlusions
par: Wu, Ruihai, et autres
Publié: (2023)