Recovering Hidden Reward in Diffusion-Based Policies
Fuente:
arXiv
Salvato in:
| Autori principali: | Ji, Yanbiao, Li, Qiuchang, Hu, Yuting, Wu, Shaokai, Xie, Wenyuan, Zhang, Guodong, He, Qicheng, Ji, Deyi, Ding, Yue, Lu, Hongtao |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Dejavu: Towards Experience Feedback Learning for Embodied Intelligence
di: Wu, Shaokai, et al.
Pubblicazione: (2025)
di: Wu, Shaokai, et al.
Pubblicazione: (2025)
Generating Negative Samples for Multi-Modal Recommendation
di: Ji, Yanbiao, et al.
Pubblicazione: (2025)
di: Ji, Yanbiao, et al.
Pubblicazione: (2025)
Sparse Diffusion Policy: A Sparse, Reusable, and Flexible Policy for Robot Learning
di: Wang, Yixiao, et al.
Pubblicazione: (2024)
di: Wang, Yixiao, et al.
Pubblicazione: (2024)
MORE: Multi-Organ Medical Image REconstruction Dataset
di: Wu, Shaokai, et al.
Pubblicazione: (2025)
di: Wu, Shaokai, et al.
Pubblicazione: (2025)
GNN-DIP: Neural Corridor Selection for Decomposition-Based Motion Planning
di: Xie, Peng, et al.
Pubblicazione: (2026)
di: Xie, Peng, et al.
Pubblicazione: (2026)
Enhancing Diffusion Policy with Classifier-Free Guidance for Temporal Robotic Tasks
di: Lu, Yuang, et al.
Pubblicazione: (2025)
di: Lu, Yuang, et al.
Pubblicazione: (2025)
Diffusion-Based mmWave Radar Point Cloud Enhancement Driven by Range Images
di: Wu, Ruixin, et al.
Pubblicazione: (2025)
di: Wu, Ruixin, et al.
Pubblicazione: (2025)
Policy Contrastive Decoding for Robotic Foundation Models
di: Wu, Shihan, et al.
Pubblicazione: (2025)
di: Wu, Shihan, et al.
Pubblicazione: (2025)
Discretized Gaussian Representation for Tomographic Reconstruction
di: Wu, Shaokai, et al.
Pubblicazione: (2024)
di: Wu, Shaokai, et al.
Pubblicazione: (2024)
Beyond Policy Optimization: A Data Curation Flywheel for Sparse-Reward Long-Horizon Planning
di: Wang, Yutong, et al.
Pubblicazione: (2025)
di: Wang, Yutong, et al.
Pubblicazione: (2025)
3D-CovDiffusion: 3D-Aware Diffusion Policy for Coverage Path Planning
di: Chen, Chenyuan, et al.
Pubblicazione: (2025)
di: Chen, Chenyuan, et al.
Pubblicazione: (2025)
TopoCut: Learning Multi-Step Cutting with Spectral Rewards and Discrete Diffusion Policies
di: Wang, Liquan, et al.
Pubblicazione: (2025)
di: Wang, Liquan, et al.
Pubblicazione: (2025)
ForeDiffusion: Foresight-Conditioned Diffusion Policy via Future View Construction for Robot Manipulation
di: Xie, Weize, et al.
Pubblicazione: (2026)
di: Xie, Weize, et al.
Pubblicazione: (2026)
FALCON: Actively Decoupled Visuomotor Policies for Loco-Manipulation with Foundation-Model-Based Coordination
di: He, Chengyang, et al.
Pubblicazione: (2025)
di: He, Chengyang, et al.
Pubblicazione: (2025)
Human-assisted Robotic Policy Refinement via Action Preference Optimization
di: Xia, Wenke, et al.
Pubblicazione: (2025)
di: Xia, Wenke, et al.
Pubblicazione: (2025)
PDP: Physics-Based Character Animation via Diffusion Policy
di: Truong, Takara E., et al.
Pubblicazione: (2024)
di: Truong, Takara E., et al.
Pubblicazione: (2024)
Learning to Recover: Dynamic Reward Shaping with Wheel-Leg Coordination for Fallen Robots
di: Deng, Boyuan, et al.
Pubblicazione: (2025)
di: Deng, Boyuan, et al.
Pubblicazione: (2025)
Gen-Drive: Enhancing Diffusion Generative Driving Policies with Reward Modeling and Reinforcement Learning Fine-tuning
di: Huang, Zhiyu, et al.
Pubblicazione: (2024)
di: Huang, Zhiyu, et al.
Pubblicazione: (2024)
Model-Based Policy Adaptation for Closed-Loop End-to-End Autonomous Driving
di: Lin, Haohong, et al.
Pubblicazione: (2025)
di: Lin, Haohong, et al.
Pubblicazione: (2025)
Driving Beyond Privilege: Distilling Dense-Reward Knowledge into Sparse-Reward Policies
di: Khanzada, Feeza Khan, et al.
Pubblicazione: (2025)
di: Khanzada, Feeza Khan, et al.
Pubblicazione: (2025)
Exploring Adversarial Robustness of LiDAR-Camera Fusion Model in Autonomous Driving
di: Yang, Bo, et al.
Pubblicazione: (2023)
di: Yang, Bo, et al.
Pubblicazione: (2023)
TacDiffusion: Force-domain Diffusion Policy for Precise Tactile Manipulation
di: Wu, Yansong, et al.
Pubblicazione: (2024)
di: Wu, Yansong, et al.
Pubblicazione: (2024)
Block-wise Adaptive Caching for Accelerating Diffusion Policy
di: Ji, Kangye, et al.
Pubblicazione: (2025)
di: Ji, Kangye, et al.
Pubblicazione: (2025)
Robot Policy Learning with Temporal Optimal Transport Reward
di: Fu, Yuwei, et al.
Pubblicazione: (2024)
di: Fu, Yuwei, et al.
Pubblicazione: (2024)
MTDP: A Modulated Transformer based Diffusion Policy Model
di: Wang, Qianhao, et al.
Pubblicazione: (2025)
di: Wang, Qianhao, et al.
Pubblicazione: (2025)
Team Xiaomi EV-AD VLA: Caption-Guided Retrieval System for Cross-Modal Drone Navigation -- Technical Report for IROS 2025 RoboSense Challenge Track 4
di: Zhang, Lingfeng, et al.
Pubblicazione: (2025)
di: Zhang, Lingfeng, et al.
Pubblicazione: (2025)
AdvDiffuser: Generating Adversarial Safety-Critical Driving Scenarios via Guided Diffusion
di: Xie, Yuting, et al.
Pubblicazione: (2024)
di: Xie, Yuting, et al.
Pubblicazione: (2024)
When would Vision-Proprioception Policies Fail in Robotic Manipulation?
di: Lu, Jingxian, et al.
Pubblicazione: (2026)
di: Lu, Jingxian, et al.
Pubblicazione: (2026)
POEX: Towards Policy Executable Jailbreak Attacks Against the LLM-based Robots
di: Lu, Xuancun, et al.
Pubblicazione: (2024)
di: Lu, Xuancun, et al.
Pubblicazione: (2024)
MetricNet: Recovering Metric Scale in Generative Navigation Policies
di: Nayak, Abhijeet, et al.
Pubblicazione: (2025)
di: Nayak, Abhijeet, et al.
Pubblicazione: (2025)
DockAnywhere: Data-Efficient Visuomotor Policy Learning for Mobile Manipulation via Novel Demonstration Generation
di: Shan, Ziyu, et al.
Pubblicazione: (2026)
di: Shan, Ziyu, et al.
Pubblicazione: (2026)
Research on Navigation Methods Based on LLMs
di: Zhang, Anlong, et al.
Pubblicazione: (2025)
di: Zhang, Anlong, et al.
Pubblicazione: (2025)
Neural-Network-Driven Reward Prediction as a Heuristic: Advancing Q-Learning for Mobile Robot Path Planning
di: Ji, Yiming, et al.
Pubblicazione: (2024)
di: Ji, Yiming, et al.
Pubblicazione: (2024)
In-between Motion Generation Based Multi-Style Quadruped Robot Locomotion
di: Chen, Yuanhao, et al.
Pubblicazione: (2025)
di: Chen, Yuanhao, et al.
Pubblicazione: (2025)
ORSO: Accelerating Reward Design via Online Reward Selection and Policy Optimization
di: Zhang, Chen Bo Calvin, et al.
Pubblicazione: (2024)
di: Zhang, Chen Bo Calvin, et al.
Pubblicazione: (2024)
Adversarial Constrained Policy Optimization: Improving Constrained Reinforcement Learning by Adapting Budgets
di: Ma, Jianmina, et al.
Pubblicazione: (2024)
di: Ma, Jianmina, et al.
Pubblicazione: (2024)
STDArm: Transferring Visuomotor Policies From Static Data Training to Dynamic Robot Manipulation
di: Duan, Yifan, et al.
Pubblicazione: (2025)
di: Duan, Yifan, et al.
Pubblicazione: (2025)
Explicit-Implicit Subgoal Planning for Long-Horizon Tasks with Sparse Reward
di: Wang, Fangyuan, et al.
Pubblicazione: (2023)
di: Wang, Fangyuan, et al.
Pubblicazione: (2023)
ISS Policy : Scalable Diffusion Policy with Implicit Scene Supervision
di: Xia, Wenlong, et al.
Pubblicazione: (2025)
di: Xia, Wenlong, et al.
Pubblicazione: (2025)
Catching Spinning Table Tennis Balls in Simulation with End-to-End Curriculum Reinforcement Learning
di: Hu, Xiaoyi, et al.
Pubblicazione: (2025)
di: Hu, Xiaoyi, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Dejavu: Towards Experience Feedback Learning for Embodied Intelligence
di: Wu, Shaokai, et al.
Pubblicazione: (2025) -
Generating Negative Samples for Multi-Modal Recommendation
di: Ji, Yanbiao, et al.
Pubblicazione: (2025) -
Sparse Diffusion Policy: A Sparse, Reusable, and Flexible Policy for Robot Learning
di: Wang, Yixiao, et al.
Pubblicazione: (2024) -
MORE: Multi-Organ Medical Image REconstruction Dataset
di: Wu, Shaokai, et al.
Pubblicazione: (2025) -
GNN-DIP: Neural Corridor Selection for Decomposition-Based Motion Planning
di: Xie, Peng, et al.
Pubblicazione: (2026)