Enhancing Sample Efficiency and Exploration in Reinforcement Learning through the Integration of Diffusion Models and Proximal Policy Optimization
Fuente:
arXiv
Guardado en:
| Autores principales: | Gao, Tianci, Neusypin, Konstantin A., Dmitriev, Dmitry D., Yang, Bo, Rao, Shengren |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Diffusion Policy through Conditional Proximal Policy Optimization
por: Liu, Ben, et al.
Publicado: (2026)
por: Liu, Ben, et al.
Publicado: (2026)
Enhancing Robotic Adaptability: Integrating Unsupervised Trajectory Segmentation and Conditional ProMPs for Dynamic Learning Environments
por: Gao, Tianci
Publicado: (2024)
por: Gao, Tianci
Publicado: (2024)
Transformer-XL for Long Sequence Tasks in Robotic Learning from Demonstration
por: Tianci, Gao
Publicado: (2024)
por: Tianci, Gao
Publicado: (2024)
Where-to-Learn: Analytical Policy Gradient Directed Exploration for On-Policy Robotic Reinforcement Learning
por: Chang, Leixin, et al.
Publicado: (2026)
por: Chang, Leixin, et al.
Publicado: (2026)
Integrated Intention Prediction and Decision-Making with Spectrum Attention Net and Proximal Policy Optimization
por: Zhou, Xiao, et al.
Publicado: (2024)
por: Zhou, Xiao, et al.
Publicado: (2024)
Enhancing Exploration with Diffusion Policies in Hybrid Off-Policy RL: Application to Non-Prehensile Manipulation
por: Le, Huy, et al.
Publicado: (2024)
por: Le, Huy, et al.
Publicado: (2024)
Gen-Drive: Enhancing Diffusion Generative Driving Policies with Reward Modeling and Reinforcement Learning Fine-tuning
por: Huang, Zhiyu, et al.
Publicado: (2024)
por: Huang, Zhiyu, et al.
Publicado: (2024)
Safe Policy Exploration Improvement via Subgoals
por: Angulo, Brian, et al.
Publicado: (2024)
por: Angulo, Brian, et al.
Publicado: (2024)
D3P: Dynamic Denoising Diffusion Policy via Reinforcement Learning
por: Yu, Shu-Ang, et al.
Publicado: (2025)
por: Yu, Shu-Ang, et al.
Publicado: (2025)
Optimizing Efficiency of Mixed Traffic through Reinforcement Learning: A Topology-Independent Approach and Benchmark
por: Xiao, Chuyang, et al.
Publicado: (2025)
por: Xiao, Chuyang, et al.
Publicado: (2025)
Diffusion Policies with Value-Conditional Optimization for Offline Reinforcement Learning
por: Ma, Yunchang, et al.
Publicado: (2025)
por: Ma, Yunchang, et al.
Publicado: (2025)
PolicyFlow: Policy Optimization with Continuous Normalizing Flow in Reinforcement Learning
por: Yang, Shunpeng, et al.
Publicado: (2026)
por: Yang, Shunpeng, et al.
Publicado: (2026)
DARE: Diffusion Policy for Autonomous Robot Exploration
por: Cao, Yuhong, et al.
Publicado: (2024)
por: Cao, Yuhong, et al.
Publicado: (2024)
Off-Policy Safe Reinforcement Learning with Constrained Optimistic Exploration
por: Li, Guopeng, et al.
Publicado: (2026)
por: Li, Guopeng, et al.
Publicado: (2026)
Reducing Risk for Assistive Reinforcement Learning Policies with Diffusion Models
por: Tytarenko, Andrii
Publicado: (2024)
por: Tytarenko, Andrii
Publicado: (2024)
Enhancing Efficiency and Propulsion in Bio-mimetic Robotic Fish through End-to-End Deep Reinforcement Learning
por: Cui, Xinyu, et al.
Publicado: (2025)
por: Cui, Xinyu, et al.
Publicado: (2025)
ERPPO: Entropy Regularization-based Proximal Policy Optimization
por: Lee, Changha, et al.
Publicado: (2026)
por: Lee, Changha, et al.
Publicado: (2026)
PlannerRFT: Reinforcing Diffusion Planners through Closed-Loop and Sample-Efficient Fine-Tuning
por: Li, Hongchen, et al.
Publicado: (2026)
por: Li, Hongchen, et al.
Publicado: (2026)
Coordinated Humanoid Robot Locomotion with Symmetry Equivariant Reinforcement Learning Policy
por: Nie, Buqing, et al.
Publicado: (2025)
por: Nie, Buqing, et al.
Publicado: (2025)
Enhancing Exploration Efficiency using Uncertainty-Aware Information Prediction
por: Kim, Seunghwan, et al.
Publicado: (2024)
por: Kim, Seunghwan, et al.
Publicado: (2024)
Set-Supervised Diffusion Policy: Learning Action-Chunking Diffusion through Corrections
por: Li, Zhaoting, et al.
Publicado: (2026)
por: Li, Zhaoting, et al.
Publicado: (2026)
ZSL-RPPO: Zero-Shot Learning for Quadrupedal Locomotion in Challenging Terrains using Recurrent Proximal Policy Optimization
por: Zhao, Yao, et al.
Publicado: (2024)
por: Zhao, Yao, et al.
Publicado: (2024)
Differentiable Information Enhanced Model-Based Reinforcement Learning
por: Zhang, Xiaoyuan, et al.
Publicado: (2025)
por: Zhang, Xiaoyuan, et al.
Publicado: (2025)
Integrating Diffusion-based Multi-task Learning with Online Reinforcement Learning for Robust Quadruped Robot Control
por: Qin, Xinyao, et al.
Publicado: (2025)
por: Qin, Xinyao, et al.
Publicado: (2025)
CAPE: Context-Aware Diffusion Policy Via Proximal Mode Expansion for Collision Avoidance
por: Yang, Rui Heng, et al.
Publicado: (2025)
por: Yang, Rui Heng, et al.
Publicado: (2025)
Uni-O4: Unifying Online and Offline Deep Reinforcement Learning with Multi-Step On-Policy Optimization
por: Lei, Kun, et al.
Publicado: (2023)
por: Lei, Kun, et al.
Publicado: (2023)
Posterior Optimization with Clipped Objective for Bridging Efficiency and Stability in Generative Policy Learning
por: Chen, Yuhui, et al.
Publicado: (2026)
por: Chen, Yuhui, et al.
Publicado: (2026)
Enhanced Importance Sampling through Latent Space Exploration in Normalizing Flows
por: Kruse, Liam A., et al.
Publicado: (2025)
por: Kruse, Liam A., et al.
Publicado: (2025)
Diffusion Policy Policy Optimization
por: Ren, Allen Z., et al.
Publicado: (2024)
por: Ren, Allen Z., et al.
Publicado: (2024)
On the Fly Adaptation of Behavior Tree-Based Policies through Reinforcement Learning
por: Iannotta, Marco, et al.
Publicado: (2025)
por: Iannotta, Marco, et al.
Publicado: (2025)
ClothPPO: A Proximal Policy Optimization Enhancing Framework for Robotic Cloth Manipulation with Observation-Aligned Action Spaces
por: Yang, Libing, et al.
Publicado: (2024)
por: Yang, Libing, et al.
Publicado: (2024)
Beyond Imitation: Reinforcement Learning Fine-Tuning for Adaptive Diffusion Navigation Policies
por: Sheng, Junhe, et al.
Publicado: (2026)
por: Sheng, Junhe, et al.
Publicado: (2026)
M3PO: Massively Multi-Task Model-Based Policy Optimization
por: Narendra, Aditya, et al.
Publicado: (2025)
por: Narendra, Aditya, et al.
Publicado: (2025)
ExploRLLM: Guiding Exploration in Reinforcement Learning with Large Language Models
por: Ma, Runyu, et al.
Publicado: (2024)
por: Ma, Runyu, et al.
Publicado: (2024)
Steering Your Diffusion Policy with Latent Space Reinforcement Learning
por: Wagenmaker, Andrew, et al.
Publicado: (2025)
por: Wagenmaker, Andrew, et al.
Publicado: (2025)
Sample-Efficient Diffusion-based Reinforcement Learning with Critic Guidance
por: Ding, Shutong, et al.
Publicado: (2026)
por: Ding, Shutong, et al.
Publicado: (2026)
CDE: Concept-Driven Exploration for Reinforcement Learning
por: Mao, Le, et al.
Publicado: (2025)
por: Mao, Le, et al.
Publicado: (2025)
Close-Proximity Satellite Operations through Deep Reinforcement Learning and Terrestrial Testing Environments
por: Lei, Henry, et al.
Publicado: (2025)
por: Lei, Henry, et al.
Publicado: (2025)
Diffusion Policy: Visuomotor Policy Learning via Action Diffusion
por: Chi, Cheng, et al.
Publicado: (2023)
por: Chi, Cheng, et al.
Publicado: (2023)
Reverse Forward Curriculum Learning for Extreme Sample and Demonstration Efficiency in Reinforcement Learning
por: Tao, Stone, et al.
Publicado: (2024)
por: Tao, Stone, et al.
Publicado: (2024)
Ejemplares similares
-
Diffusion Policy through Conditional Proximal Policy Optimization
por: Liu, Ben, et al.
Publicado: (2026) -
Enhancing Robotic Adaptability: Integrating Unsupervised Trajectory Segmentation and Conditional ProMPs for Dynamic Learning Environments
por: Gao, Tianci
Publicado: (2024) -
Transformer-XL for Long Sequence Tasks in Robotic Learning from Demonstration
por: Tianci, Gao
Publicado: (2024) -
Where-to-Learn: Analytical Policy Gradient Directed Exploration for On-Policy Robotic Reinforcement Learning
por: Chang, Leixin, et al.
Publicado: (2026) -
Integrated Intention Prediction and Decision-Making with Spectrum Attention Net and Proximal Policy Optimization
por: Zhou, Xiao, et al.
Publicado: (2024)