RoDiF: Robust Direct Fine-Tuning of Diffusion Policies with Corrupted Human Feedback
Fuente:
arXiv
Salvato in:
| Autori principali: | Vatsa, Amitesh, Xie, Zhixian, Jin, Wanxin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Safe MPC Alignment with Human Directional Feedback
di: Xie, Zhixian, et al.
Pubblicazione: (2024)
di: Xie, Zhixian, et al.
Pubblicazione: (2024)
FDPP: Fine-tune Diffusion Policy with Human Preference
di: Chen, Yuxin, et al.
Pubblicazione: (2025)
di: Chen, Yuxin, et al.
Pubblicazione: (2025)
Robust Reward Alignment via Hypothesis Space Batch Cutting
di: Xie, Zhixian, et al.
Pubblicazione: (2025)
di: Xie, Zhixian, et al.
Pubblicazione: (2025)
Active Fine-Tuning of Multi-Task Policies
di: Bagatella, Marco, et al.
Pubblicazione: (2024)
di: Bagatella, Marco, et al.
Pubblicazione: (2024)
CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies
di: Chen, Keyu, et al.
Pubblicazione: (2026)
di: Chen, Keyu, et al.
Pubblicazione: (2026)
VT-Refine: Learning Bimanual Assembly with Visuo-Tactile Feedback via Simulation Fine-Tuning
di: Huang, Binghao, et al.
Pubblicazione: (2025)
di: Huang, Binghao, et al.
Pubblicazione: (2025)
Rapidly Adapting Policies to the Real World via Simulation-Guided Fine-Tuning
di: Yin, Patrick, et al.
Pubblicazione: (2025)
di: Yin, Patrick, et al.
Pubblicazione: (2025)
Reinforcement Fine-Tuning of Flow-Matching Policies for Vision-Language-Action Models
di: Lyu, Mingyang, et al.
Pubblicazione: (2025)
di: Lyu, Mingyang, et al.
Pubblicazione: (2025)
DiWA: Diffusion Policy Adaptation with World Models
di: Chandra, Akshay L, et al.
Pubblicazione: (2025)
di: Chandra, Akshay L, et al.
Pubblicazione: (2025)
Where to Touch, How to Contact: Hierarchical RL-MPC Framework for Geometry-Aware Long-Horizon Dexterous Manipulation
di: Xie, Zhixian, et al.
Pubblicazione: (2026)
di: Xie, Zhixian, et al.
Pubblicazione: (2026)
Uncertainty Comes for Free: Human-in-the-Loop Policies with Diffusion Models
di: He, Zhanpeng, et al.
Pubblicazione: (2025)
di: He, Zhanpeng, et al.
Pubblicazione: (2025)
DemoDiffusion: One-Shot Human Imitation using pre-trained Diffusion Policy
di: Park, Sungjae, et al.
Pubblicazione: (2025)
di: Park, Sungjae, et al.
Pubblicazione: (2025)
Modality-Augmented Fine-Tuning of Foundation Robot Policies for Cross-Embodiment Manipulation on GR1 and G1
di: Park, Junsung, et al.
Pubblicazione: (2025)
di: Park, Junsung, et al.
Pubblicazione: (2025)
Contractive Diffusion Policies: Robust Action Diffusion via Contractive Score-Based Sampling with Differential Equations
di: Abyaneh, Amin, et al.
Pubblicazione: (2026)
di: Abyaneh, Amin, et al.
Pubblicazione: (2026)
Distributed Differentiable Dynamic Game for Multi-robot Coordination
di: Zhou, Yizhi, et al.
Pubblicazione: (2022)
di: Zhou, Yizhi, et al.
Pubblicazione: (2022)
SERNF: Sample-Efficient Real-World Dexterous Policy Fine-Tuning via Action-Chunked Critics and Normalizing Flows
di: Yang, Chenyu, et al.
Pubblicazione: (2026)
di: Yang, Chenyu, et al.
Pubblicazione: (2026)
Language-Model-Assisted Bi-Level Programming for Reward Learning from Internet Videos
di: Mahesheka, Harsh, et al.
Pubblicazione: (2024)
di: Mahesheka, Harsh, et al.
Pubblicazione: (2024)
Efficient Online RL Fine Tuning with Offline Pre-trained Policy Only
di: Xiao, Wei, et al.
Pubblicazione: (2025)
di: Xiao, Wei, et al.
Pubblicazione: (2025)
ComFree-Sim: A GPU-Parallelized Analytical Contact Physics Engine for Scalable Contact-Rich Robotics Simulation and Control
di: Borse, Chetan, et al.
Pubblicazione: (2026)
di: Borse, Chetan, et al.
Pubblicazione: (2026)
Diffusion Policy Policy Optimization
di: Ren, Allen Z., et al.
Pubblicazione: (2024)
di: Ren, Allen Z., et al.
Pubblicazione: (2024)
Per-Group Error, Not Total MSE: Fine-Tuning Vision-Language-Action Models for 11-DoF Mobile Manipulation
di: Bofi, Pau Montagut, et al.
Pubblicazione: (2026)
di: Bofi, Pau Montagut, et al.
Pubblicazione: (2026)
Sparse Diffusion Policy: A Sparse, Reusable, and Flexible Policy for Robot Learning
di: Wang, Yixiao, et al.
Pubblicazione: (2024)
di: Wang, Yixiao, et al.
Pubblicazione: (2024)
DiAReL: Reinforcement Learning with Disturbance Awareness for Robust Sim2Real Policy Transfer in Robot Control
di: Malmir, Mohammadhossein, et al.
Pubblicazione: (2023)
di: Malmir, Mohammadhossein, et al.
Pubblicazione: (2023)
Robust Policy Learning via Offline Skill Diffusion
di: Kim, Woo Kyung, et al.
Pubblicazione: (2024)
di: Kim, Woo Kyung, et al.
Pubblicazione: (2024)
Equivariant Diffusion Policy
di: Wang, Dian, et al.
Pubblicazione: (2024)
di: Wang, Dian, et al.
Pubblicazione: (2024)
One-Step Diffusion Policy: Fast Visuomotor Policies via Diffusion Distillation
di: Wang, Zhendong, et al.
Pubblicazione: (2024)
di: Wang, Zhendong, et al.
Pubblicazione: (2024)
Diffusion Policy through Conditional Proximal Policy Optimization
di: Liu, Ben, et al.
Pubblicazione: (2026)
di: Liu, Ben, et al.
Pubblicazione: (2026)
Effective Tuning Strategies for Generalist Robot Manipulation Policies
di: Zhang, Wenbo, et al.
Pubblicazione: (2024)
di: Zhang, Wenbo, et al.
Pubblicazione: (2024)
RoVerFly: Robust and Versatile Implicit Hybrid Control of Quadrotor-Payload Systems
di: Kim, Mintae, et al.
Pubblicazione: (2025)
di: Kim, Mintae, et al.
Pubblicazione: (2025)
Dichotomous Diffusion Policy Optimization
di: Liang, Ruiming, et al.
Pubblicazione: (2025)
di: Liang, Ruiming, et al.
Pubblicazione: (2025)
Behavioral Mode Discovery for Fine-tuning Multimodal Generative Policies
di: Longhini, Alberta, et al.
Pubblicazione: (2026)
di: Longhini, Alberta, et al.
Pubblicazione: (2026)
DADP: Domain Adaptive Diffusion Policy
di: Wang, Pengcheng, et al.
Pubblicazione: (2026)
di: Wang, Pengcheng, et al.
Pubblicazione: (2026)
Unpacking the Individual Components of Diffusion Policy
di: Yuan, Xiu
Pubblicazione: (2024)
di: Yuan, Xiu
Pubblicazione: (2024)
RIFT: Group-Relative RL Fine-Tuning for Realistic and Controllable Traffic Simulation
di: Chen, Keyu, et al.
Pubblicazione: (2025)
di: Chen, Keyu, et al.
Pubblicazione: (2025)
Coarse-to-Fine Compositional Diffusion for Long-Horizon Planning
di: Park, Byoungwoo, et al.
Pubblicazione: (2026)
di: Park, Byoungwoo, et al.
Pubblicazione: (2026)
REFINE-DP: Diffusion Policy Fine-tuning for Humanoid Loco-manipulation via Reinforcement Learning
di: Gu, Zhaoyuan, et al.
Pubblicazione: (2026)
di: Gu, Zhaoyuan, et al.
Pubblicazione: (2026)
Policy Learning from Large Vision-Language Model Feedback without Reward Modeling
di: Luu, Tung M., et al.
Pubblicazione: (2025)
di: Luu, Tung M., et al.
Pubblicazione: (2025)
FOSP: Fine-tuning Offline Safe Policy through World Models
di: Cao, Chenyang, et al.
Pubblicazione: (2024)
di: Cao, Chenyang, et al.
Pubblicazione: (2024)
Progressive-Resolution Policy Distillation: Leveraging Coarse-Resolution Simulations for Time-Efficient Fine-Resolution Policy Learning
di: Kadokawa, Yuki, et al.
Pubblicazione: (2024)
di: Kadokawa, Yuki, et al.
Pubblicazione: (2024)
ReinFlow: Fine-tuning Flow Matching Policy with Online Reinforcement Learning
di: Zhang, Tonghe, et al.
Pubblicazione: (2025)
di: Zhang, Tonghe, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Safe MPC Alignment with Human Directional Feedback
di: Xie, Zhixian, et al.
Pubblicazione: (2024) -
FDPP: Fine-tune Diffusion Policy with Human Preference
di: Chen, Yuxin, et al.
Pubblicazione: (2025) -
Robust Reward Alignment via Hypothesis Space Batch Cutting
di: Xie, Zhixian, et al.
Pubblicazione: (2025) -
Active Fine-Tuning of Multi-Task Policies
di: Bagatella, Marco, et al.
Pubblicazione: (2024) -
CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies
di: Chen, Keyu, et al.
Pubblicazione: (2026)