RoDiF: Robust Direct Fine-Tuning of Diffusion Policies with Corrupted Human Feedback
Fuente:
arXiv
Guardado en:
| Autores principales: | Vatsa, Amitesh, Xie, Zhixian, Jin, Wanxin |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Safe MPC Alignment with Human Directional Feedback
por: Xie, Zhixian, et al.
Publicado: (2024)
por: Xie, Zhixian, et al.
Publicado: (2024)
FDPP: Fine-tune Diffusion Policy with Human Preference
por: Chen, Yuxin, et al.
Publicado: (2025)
por: Chen, Yuxin, et al.
Publicado: (2025)
Robust Reward Alignment via Hypothesis Space Batch Cutting
por: Xie, Zhixian, et al.
Publicado: (2025)
por: Xie, Zhixian, et al.
Publicado: (2025)
Active Fine-Tuning of Multi-Task Policies
por: Bagatella, Marco, et al.
Publicado: (2024)
por: Bagatella, Marco, et al.
Publicado: (2024)
CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies
por: Chen, Keyu, et al.
Publicado: (2026)
por: Chen, Keyu, et al.
Publicado: (2026)
VT-Refine: Learning Bimanual Assembly with Visuo-Tactile Feedback via Simulation Fine-Tuning
por: Huang, Binghao, et al.
Publicado: (2025)
por: Huang, Binghao, et al.
Publicado: (2025)
Rapidly Adapting Policies to the Real World via Simulation-Guided Fine-Tuning
por: Yin, Patrick, et al.
Publicado: (2025)
por: Yin, Patrick, et al.
Publicado: (2025)
Reinforcement Fine-Tuning of Flow-Matching Policies for Vision-Language-Action Models
por: Lyu, Mingyang, et al.
Publicado: (2025)
por: Lyu, Mingyang, et al.
Publicado: (2025)
DiWA: Diffusion Policy Adaptation with World Models
por: Chandra, Akshay L, et al.
Publicado: (2025)
por: Chandra, Akshay L, et al.
Publicado: (2025)
Where to Touch, How to Contact: Hierarchical RL-MPC Framework for Geometry-Aware Long-Horizon Dexterous Manipulation
por: Xie, Zhixian, et al.
Publicado: (2026)
por: Xie, Zhixian, et al.
Publicado: (2026)
Uncertainty Comes for Free: Human-in-the-Loop Policies with Diffusion Models
por: He, Zhanpeng, et al.
Publicado: (2025)
por: He, Zhanpeng, et al.
Publicado: (2025)
DemoDiffusion: One-Shot Human Imitation using pre-trained Diffusion Policy
por: Park, Sungjae, et al.
Publicado: (2025)
por: Park, Sungjae, et al.
Publicado: (2025)
Modality-Augmented Fine-Tuning of Foundation Robot Policies for Cross-Embodiment Manipulation on GR1 and G1
por: Park, Junsung, et al.
Publicado: (2025)
por: Park, Junsung, et al.
Publicado: (2025)
Contractive Diffusion Policies: Robust Action Diffusion via Contractive Score-Based Sampling with Differential Equations
por: Abyaneh, Amin, et al.
Publicado: (2026)
por: Abyaneh, Amin, et al.
Publicado: (2026)
Distributed Differentiable Dynamic Game for Multi-robot Coordination
por: Zhou, Yizhi, et al.
Publicado: (2022)
por: Zhou, Yizhi, et al.
Publicado: (2022)
SERNF: Sample-Efficient Real-World Dexterous Policy Fine-Tuning via Action-Chunked Critics and Normalizing Flows
por: Yang, Chenyu, et al.
Publicado: (2026)
por: Yang, Chenyu, et al.
Publicado: (2026)
Language-Model-Assisted Bi-Level Programming for Reward Learning from Internet Videos
por: Mahesheka, Harsh, et al.
Publicado: (2024)
por: Mahesheka, Harsh, et al.
Publicado: (2024)
Efficient Online RL Fine Tuning with Offline Pre-trained Policy Only
por: Xiao, Wei, et al.
Publicado: (2025)
por: Xiao, Wei, et al.
Publicado: (2025)
ComFree-Sim: A GPU-Parallelized Analytical Contact Physics Engine for Scalable Contact-Rich Robotics Simulation and Control
por: Borse, Chetan, et al.
Publicado: (2026)
por: Borse, Chetan, et al.
Publicado: (2026)
Diffusion Policy Policy Optimization
por: Ren, Allen Z., et al.
Publicado: (2024)
por: Ren, Allen Z., et al.
Publicado: (2024)
Per-Group Error, Not Total MSE: Fine-Tuning Vision-Language-Action Models for 11-DoF Mobile Manipulation
por: Bofi, Pau Montagut, et al.
Publicado: (2026)
por: Bofi, Pau Montagut, et al.
Publicado: (2026)
Sparse Diffusion Policy: A Sparse, Reusable, and Flexible Policy for Robot Learning
por: Wang, Yixiao, et al.
Publicado: (2024)
por: Wang, Yixiao, et al.
Publicado: (2024)
DiAReL: Reinforcement Learning with Disturbance Awareness for Robust Sim2Real Policy Transfer in Robot Control
por: Malmir, Mohammadhossein, et al.
Publicado: (2023)
por: Malmir, Mohammadhossein, et al.
Publicado: (2023)
Robust Policy Learning via Offline Skill Diffusion
por: Kim, Woo Kyung, et al.
Publicado: (2024)
por: Kim, Woo Kyung, et al.
Publicado: (2024)
Equivariant Diffusion Policy
por: Wang, Dian, et al.
Publicado: (2024)
por: Wang, Dian, et al.
Publicado: (2024)
One-Step Diffusion Policy: Fast Visuomotor Policies via Diffusion Distillation
por: Wang, Zhendong, et al.
Publicado: (2024)
por: Wang, Zhendong, et al.
Publicado: (2024)
Diffusion Policy through Conditional Proximal Policy Optimization
por: Liu, Ben, et al.
Publicado: (2026)
por: Liu, Ben, et al.
Publicado: (2026)
Effective Tuning Strategies for Generalist Robot Manipulation Policies
por: Zhang, Wenbo, et al.
Publicado: (2024)
por: Zhang, Wenbo, et al.
Publicado: (2024)
RoVerFly: Robust and Versatile Implicit Hybrid Control of Quadrotor-Payload Systems
por: Kim, Mintae, et al.
Publicado: (2025)
por: Kim, Mintae, et al.
Publicado: (2025)
Dichotomous Diffusion Policy Optimization
por: Liang, Ruiming, et al.
Publicado: (2025)
por: Liang, Ruiming, et al.
Publicado: (2025)
Behavioral Mode Discovery for Fine-tuning Multimodal Generative Policies
por: Longhini, Alberta, et al.
Publicado: (2026)
por: Longhini, Alberta, et al.
Publicado: (2026)
DADP: Domain Adaptive Diffusion Policy
por: Wang, Pengcheng, et al.
Publicado: (2026)
por: Wang, Pengcheng, et al.
Publicado: (2026)
Unpacking the Individual Components of Diffusion Policy
por: Yuan, Xiu
Publicado: (2024)
por: Yuan, Xiu
Publicado: (2024)
RIFT: Group-Relative RL Fine-Tuning for Realistic and Controllable Traffic Simulation
por: Chen, Keyu, et al.
Publicado: (2025)
por: Chen, Keyu, et al.
Publicado: (2025)
Coarse-to-Fine Compositional Diffusion for Long-Horizon Planning
por: Park, Byoungwoo, et al.
Publicado: (2026)
por: Park, Byoungwoo, et al.
Publicado: (2026)
REFINE-DP: Diffusion Policy Fine-tuning for Humanoid Loco-manipulation via Reinforcement Learning
por: Gu, Zhaoyuan, et al.
Publicado: (2026)
por: Gu, Zhaoyuan, et al.
Publicado: (2026)
Policy Learning from Large Vision-Language Model Feedback without Reward Modeling
por: Luu, Tung M., et al.
Publicado: (2025)
por: Luu, Tung M., et al.
Publicado: (2025)
FOSP: Fine-tuning Offline Safe Policy through World Models
por: Cao, Chenyang, et al.
Publicado: (2024)
por: Cao, Chenyang, et al.
Publicado: (2024)
Progressive-Resolution Policy Distillation: Leveraging Coarse-Resolution Simulations for Time-Efficient Fine-Resolution Policy Learning
por: Kadokawa, Yuki, et al.
Publicado: (2024)
por: Kadokawa, Yuki, et al.
Publicado: (2024)
ReinFlow: Fine-tuning Flow Matching Policy with Online Reinforcement Learning
por: Zhang, Tonghe, et al.
Publicado: (2025)
por: Zhang, Tonghe, et al.
Publicado: (2025)
Ejemplares similares
-
Safe MPC Alignment with Human Directional Feedback
por: Xie, Zhixian, et al.
Publicado: (2024) -
FDPP: Fine-tune Diffusion Policy with Human Preference
por: Chen, Yuxin, et al.
Publicado: (2025) -
Robust Reward Alignment via Hypothesis Space Batch Cutting
por: Xie, Zhixian, et al.
Publicado: (2025) -
Active Fine-Tuning of Multi-Task Policies
por: Bagatella, Marco, et al.
Publicado: (2024) -
CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies
por: Chen, Keyu, et al.
Publicado: (2026)