Flattening Hierarchies with Policy Bootstrapping
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Zhou, John L., Kao, Jonathan C. |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Bootstrapped Model Predictive Control
von: Wang, Yuhang, et al.
Veröffentlicht: (2025)
von: Wang, Yuhang, et al.
Veröffentlicht: (2025)
Bootstrapping Reinforcement Learning with Sub-optimal Policies for Autonomous Driving
von: Zhang, Zhihao, et al.
Veröffentlicht: (2025)
von: Zhang, Zhihao, et al.
Veröffentlicht: (2025)
Bootstrap Off-policy with World Model
von: Zhan, Guojian, et al.
Veröffentlicht: (2025)
von: Zhan, Guojian, et al.
Veröffentlicht: (2025)
Shared Autonomy with IDA: Interventional Diffusion Assistance
von: McMahan, Brandon J., et al.
Veröffentlicht: (2024)
von: McMahan, Brandon J., et al.
Veröffentlicht: (2024)
BLAZER: Bootstrapping LLM-based Manipulation Agents with Zero-Shot Data Generation
von: Das, Rocktim Jyoti, et al.
Veröffentlicht: (2025)
von: Das, Rocktim Jyoti, et al.
Veröffentlicht: (2025)
Safe Deep Policy Adaptation
von: Xiao, Wenli, et al.
Veröffentlicht: (2023)
von: Xiao, Wenli, et al.
Veröffentlicht: (2023)
Tube-NeRF: Efficient Imitation Learning of Visuomotor Policies from MPC using Tube-Guided Data Augmentation and NeRFs
von: Tagliabue, Andrea, et al.
Veröffentlicht: (2023)
von: Tagliabue, Andrea, et al.
Veröffentlicht: (2023)
DISC: Decoupling Instruction from State-Conditioned Control via Policy Generation
von: Ren, Hanxiang, et al.
Veröffentlicht: (2026)
von: Ren, Hanxiang, et al.
Veröffentlicht: (2026)
Variational Distillation of Diffusion Policies into Mixture of Experts
von: Zhou, Hongyi, et al.
Veröffentlicht: (2024)
von: Zhou, Hongyi, et al.
Veröffentlicht: (2024)
A Comprehensive Survey of Cross-Domain Policy Transfer for Embodied Agents
von: Niu, Haoyi, et al.
Veröffentlicht: (2024)
von: Niu, Haoyi, et al.
Veröffentlicht: (2024)
Multi-Agent Reinforcement Learning for Unmanned Aerial Vehicle Coordination by Multi-Critic Policy Gradient Optimization
von: Alon, Yoav, et al.
Veröffentlicht: (2020)
von: Alon, Yoav, et al.
Veröffentlicht: (2020)
ReinforceGen: Hybrid Skill Policies with Automated Data Generation and Reinforcement Learning
von: Zhou, Zihan, et al.
Veröffentlicht: (2025)
von: Zhou, Zihan, et al.
Veröffentlicht: (2025)
Learning Hybrid-Control Policies for High-Precision In-Contact Manipulation Under Uncertainty
von: Brown, Hunter L., et al.
Veröffentlicht: (2026)
von: Brown, Hunter L., et al.
Veröffentlicht: (2026)
RoboPocket: Improve Robot Policies Instantly with Your Phone
von: Fang, Junjie, et al.
Veröffentlicht: (2026)
von: Fang, Junjie, et al.
Veröffentlicht: (2026)
Policy Decorator: Model-Agnostic Online Refinement for Large Policy Model
von: Yuan, Xiu, et al.
Veröffentlicht: (2024)
von: Yuan, Xiu, et al.
Veröffentlicht: (2024)
Evolutionary Policy Optimization
von: Wang, Jianren, et al.
Veröffentlicht: (2025)
von: Wang, Jianren, et al.
Veröffentlicht: (2025)
Policy-Guided Diffusion
von: Jackson, Matthew Thomas, et al.
Veröffentlicht: (2024)
von: Jackson, Matthew Thomas, et al.
Veröffentlicht: (2024)
Absolute Policy Optimization
von: Zhao, Weiye, et al.
Veröffentlicht: (2023)
von: Zhao, Weiye, et al.
Veröffentlicht: (2023)
Rethinking Policy Diversity in Ensemble Policy Gradient in Large-Scale Reinforcement Learning
von: Shitanda, Naoki, et al.
Veröffentlicht: (2026)
von: Shitanda, Naoki, et al.
Veröffentlicht: (2026)
Imagination Policy: Using Generative Point Cloud Models for Learning Manipulation Policies
von: Huang, Haojie, et al.
Veröffentlicht: (2024)
von: Huang, Haojie, et al.
Veröffentlicht: (2024)
Confidence-Controlled Exploration: Efficient Sparse-Reward Policy Learning for Robot Navigation
von: Patel, Bhrij, et al.
Veröffentlicht: (2023)
von: Patel, Bhrij, et al.
Veröffentlicht: (2023)
ImaginationPolicy: Towards Generalizable, Precise and Reliable End-to-End Policy for Robotic Manipulation
von: Lu, Dekun, et al.
Veröffentlicht: (2025)
von: Lu, Dekun, et al.
Veröffentlicht: (2025)
Foundation Policies with Hilbert Representations
von: Park, Seohong, et al.
Veröffentlicht: (2024)
von: Park, Seohong, et al.
Veröffentlicht: (2024)
Reactive Diffusion Policy: Slow-Fast Visual-Tactile Policy Learning for Contact-Rich Manipulation
von: Xue, Han, et al.
Veröffentlicht: (2025)
von: Xue, Han, et al.
Veröffentlicht: (2025)
Drifting Field Policy: A One-Step Generative Policy via Wasserstein Gradient Flow
von: Koo, Juil, et al.
Veröffentlicht: (2026)
von: Koo, Juil, et al.
Veröffentlicht: (2026)
Does "Do Differentiable Simulators Give Better Policy Gradients?'' Give Better Policy Gradients?
von: Onoda, Ku, et al.
Veröffentlicht: (2026)
von: Onoda, Ku, et al.
Veröffentlicht: (2026)
ImplicitRDP: An End-to-End Visual-Force Diffusion Policy with Structural Slow-Fast Learning
von: Chen, Wendi, et al.
Veröffentlicht: (2025)
von: Chen, Wendi, et al.
Veröffentlicht: (2025)
IMLE Policy: Fast and Sample Efficient Visuomotor Policy Learning via Implicit Maximum Likelihood Estimation
von: Rana, Krishan, et al.
Veröffentlicht: (2025)
von: Rana, Krishan, et al.
Veröffentlicht: (2025)
Coordinated Humanoid Manipulation with Choice Policies
von: Qi, Haozhi, et al.
Veröffentlicht: (2025)
von: Qi, Haozhi, et al.
Veröffentlicht: (2025)
Safe Exploration via Policy Priors
von: Wendl, Manuel, et al.
Veröffentlicht: (2026)
von: Wendl, Manuel, et al.
Veröffentlicht: (2026)
Mollification Effects of Policy Gradient Methods
von: Wang, Tao, et al.
Veröffentlicht: (2024)
von: Wang, Tao, et al.
Veröffentlicht: (2024)
Off-Policy Actor-Critic for Adversarial Observation Robustness: Virtual Alternative Training via Symmetric Policy Evaluation
von: Nakanishi, Kosuke, et al.
Veröffentlicht: (2025)
von: Nakanishi, Kosuke, et al.
Veröffentlicht: (2025)
RAPTOR: A Foundation Policy for Quadrotor Control
von: Eschmann, Jonas, et al.
Veröffentlicht: (2025)
von: Eschmann, Jonas, et al.
Veröffentlicht: (2025)
Adaptive Diffusion Policy Optimization for Robotic Manipulation
von: Jiang, Huiyun, et al.
Veröffentlicht: (2025)
von: Jiang, Huiyun, et al.
Veröffentlicht: (2025)
Guided Policy Optimization under Partial Observability
von: Li, Yueheng, et al.
Veröffentlicht: (2025)
von: Li, Yueheng, et al.
Veröffentlicht: (2025)
Discrete Variational Autoencoding via Policy Search
von: Drolet, Michael, et al.
Veröffentlicht: (2025)
von: Drolet, Michael, et al.
Veröffentlicht: (2025)
Fast Convergence of Softmax Policy Mirror Ascent
von: Asad, Reza, et al.
Veröffentlicht: (2024)
von: Asad, Reza, et al.
Veröffentlicht: (2024)
Harnessing Bounded-Support Evolution Strategies for Policy Refinement
von: Hirschowitz, Ethan, et al.
Veröffentlicht: (2025)
von: Hirschowitz, Ethan, et al.
Veröffentlicht: (2025)
A Taxonomy for Evaluating Generalist Robot Manipulation Policies
von: Gao, Jensen, et al.
Veröffentlicht: (2025)
von: Gao, Jensen, et al.
Veröffentlicht: (2025)
Real-Time Execution of Action Chunking Flow Policies
von: Black, Kevin, et al.
Veröffentlicht: (2025)
von: Black, Kevin, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Bootstrapped Model Predictive Control
von: Wang, Yuhang, et al.
Veröffentlicht: (2025) -
Bootstrapping Reinforcement Learning with Sub-optimal Policies for Autonomous Driving
von: Zhang, Zhihao, et al.
Veröffentlicht: (2025) -
Bootstrap Off-policy with World Model
von: Zhan, Guojian, et al.
Veröffentlicht: (2025) -
Shared Autonomy with IDA: Interventional Diffusion Assistance
von: McMahan, Brandon J., et al.
Veröffentlicht: (2024) -
BLAZER: Bootstrapping LLM-based Manipulation Agents with Zero-Shot Data Generation
von: Das, Rocktim Jyoti, et al.
Veröffentlicht: (2025)