Guided Policy Optimization under Partial Observability
Fuente:
arXiv
Guardado en:
| Autores principales: | Li, Yueheng, Xie, Guangming, Lu, Zongqing |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Multi-Agent Guided Policy Optimization
por: Li, Yueheng, et al.
Publicado: (2025)
por: Li, Yueheng, et al.
Publicado: (2025)
Symmetry-aware Reinforcement Learning for Robotic Assembly under Partial Observability with a Soft Wrist
por: Nguyen, Hai, et al.
Publicado: (2024)
por: Nguyen, Hai, et al.
Publicado: (2024)
Observation Adaptation via Annealed Importance Resampling for Partially Observable Markov Decision Processes
por: Zhang, Yunuo, et al.
Publicado: (2025)
por: Zhang, Yunuo, et al.
Publicado: (2025)
Policy-Guided Diffusion
por: Jackson, Matthew Thomas, et al.
Publicado: (2024)
por: Jackson, Matthew Thomas, et al.
Publicado: (2024)
Decision Transformer as a Foundation Model for Partially Observable Continuous Control
por: Zhang, Xiangyuan, et al.
Publicado: (2024)
por: Zhang, Xiangyuan, et al.
Publicado: (2024)
Absolute Policy Optimization
por: Zhao, Weiye, et al.
Publicado: (2023)
por: Zhao, Weiye, et al.
Publicado: (2023)
DiMSam: Diffusion Models as Samplers for Task and Motion Planning under Partial Observability
por: Fang, Xiaolin, et al.
Publicado: (2023)
por: Fang, Xiaolin, et al.
Publicado: (2023)
Assigning Credit with Partial Reward Decoupling in Multi-Agent Proximal Policy Optimization
por: Kapoor, Aditya, et al.
Publicado: (2024)
por: Kapoor, Aditya, et al.
Publicado: (2024)
Evolutionary Policy Optimization
por: Wang, Jianren, et al.
Publicado: (2025)
por: Wang, Jianren, et al.
Publicado: (2025)
Adaptive Advantage-Guided Policy Regularization for Offline Reinforcement Learning
por: Liu, Tenglong, et al.
Publicado: (2024)
por: Liu, Tenglong, et al.
Publicado: (2024)
PEEK: Guiding and Minimal Image Representations for Zero-Shot Generalization of Robot Manipulation Policies
por: Zhang, Jesse, et al.
Publicado: (2025)
por: Zhang, Jesse, et al.
Publicado: (2025)
Versatile Navigation under Partial Observability via Value-guided Diffusion Policy
por: Zhang, Gengyu, et al.
Publicado: (2024)
por: Zhang, Gengyu, et al.
Publicado: (2024)
Adaptive Diffusion Policy Optimization for Robotic Manipulation
por: Jiang, Huiyun, et al.
Publicado: (2025)
por: Jiang, Huiyun, et al.
Publicado: (2025)
FlowQ: Energy-Guided Flow Policies for Offline Reinforcement Learning
por: Alles, Marvin, et al.
Publicado: (2025)
por: Alles, Marvin, et al.
Publicado: (2025)
SIME: Enhancing Policy Self-Improvement with Modal-level Exploration
por: Jin, Yang, et al.
Publicado: (2025)
por: Jin, Yang, et al.
Publicado: (2025)
Robotic World Model: A Neural Network Simulator for Robust Policy Optimization in Robotics
por: Li, Chenhao, et al.
Publicado: (2025)
por: Li, Chenhao, et al.
Publicado: (2025)
ImaginationPolicy: Towards Generalizable, Precise and Reliable End-to-End Policy for Robotic Manipulation
por: Lu, Dekun, et al.
Publicado: (2025)
por: Lu, Dekun, et al.
Publicado: (2025)
Toward Learning POMDPs Beyond Full-Rank Actions and State Observability
por: Shaw, Seiji, et al.
Publicado: (2026)
por: Shaw, Seiji, et al.
Publicado: (2026)
Extremum-Seeking Action Selection for Accelerating Policy Optimization
por: Chang, Ya-Chien, et al.
Publicado: (2024)
por: Chang, Ya-Chien, et al.
Publicado: (2024)
COSBO: Conservative Offline Simulation-Based Policy Optimization
por: Kargar, Eshagh, et al.
Publicado: (2024)
por: Kargar, Eshagh, et al.
Publicado: (2024)
Diffusion Policies with Value-Conditional Optimization for Offline Reinforcement Learning
por: Ma, Yunchang, et al.
Publicado: (2025)
por: Ma, Yunchang, et al.
Publicado: (2025)
Continual Driving Policy Optimization with Closed-Loop Individualized Curricula
por: Niu, Haoyi, et al.
Publicado: (2023)
por: Niu, Haoyi, et al.
Publicado: (2023)
Q-Guided Stein Variational Model Predictive Control via RL-informed Policy Prior
por: Cai, Shizhe, et al.
Publicado: (2025)
por: Cai, Shizhe, et al.
Publicado: (2025)
ABPT: Amended Backpropagation through Time with Partially Differentiable Rewards
por: Li, Fanxing, et al.
Publicado: (2025)
por: Li, Fanxing, et al.
Publicado: (2025)
ORSO: Accelerating Reward Design via Online Reward Selection and Policy Optimization
por: Zhang, Chen Bo Calvin, et al.
Publicado: (2024)
por: Zhang, Chen Bo Calvin, et al.
Publicado: (2024)
Reactive Diffusion Policy: Slow-Fast Visual-Tactile Policy Learning for Contact-Rich Manipulation
por: Xue, Han, et al.
Publicado: (2025)
por: Xue, Han, et al.
Publicado: (2025)
Affordance-Guided Reinforcement Learning via Visual Prompting
por: Lee, Olivia Y., et al.
Publicado: (2024)
por: Lee, Olivia Y., et al.
Publicado: (2024)
Optimal Control-Based Baseline for Guided Exploration in Policy Gradient Methods
por: Lyu, Xubo, et al.
Publicado: (2020)
por: Lyu, Xubo, et al.
Publicado: (2020)
Multi-Agent Reinforcement Learning for Unmanned Aerial Vehicle Coordination by Multi-Critic Policy Gradient Optimization
por: Alon, Yoav, et al.
Publicado: (2020)
por: Alon, Yoav, et al.
Publicado: (2020)
Tube-NeRF: Efficient Imitation Learning of Visuomotor Policies from MPC using Tube-Guided Data Augmentation and NeRFs
por: Tagliabue, Andrea, et al.
Publicado: (2023)
por: Tagliabue, Andrea, et al.
Publicado: (2023)
Bidirectional Decoding: Improving Action Chunking via Guided Test-Time Sampling
por: Liu, Yuejiang, et al.
Publicado: (2024)
por: Liu, Yuejiang, et al.
Publicado: (2024)
SOE: Sample-Efficient Robot Policy Self-Improvement via On-Manifold Exploration
por: Jin, Yang, et al.
Publicado: (2025)
por: Jin, Yang, et al.
Publicado: (2025)
LD-Scene: LLM-Guided Diffusion for Controllable Generation of Adversarial Safety-Critical Driving Scenarios
por: Peng, Mingxing, et al.
Publicado: (2025)
por: Peng, Mingxing, et al.
Publicado: (2025)
Offline Risk-sensitive RL with Partial Observability to Enhance Performance in Human-Robot Teaming
por: Angelotti, Giorgio, et al.
Publicado: (2024)
por: Angelotti, Giorgio, et al.
Publicado: (2024)
RoboPocket: Improve Robot Policies Instantly with Your Phone
por: Fang, Junjie, et al.
Publicado: (2026)
por: Fang, Junjie, et al.
Publicado: (2026)
Variational Distillation of Diffusion Policies into Mixture of Experts
por: Zhou, Hongyi, et al.
Publicado: (2024)
por: Zhou, Hongyi, et al.
Publicado: (2024)
Policy Decorator: Model-Agnostic Online Refinement for Large Policy Model
por: Yuan, Xiu, et al.
Publicado: (2024)
por: Yuan, Xiu, et al.
Publicado: (2024)
RLDG: Robotic Generalist Policy Distillation via Reinforcement Learning
por: Xu, Charles, et al.
Publicado: (2024)
por: Xu, Charles, et al.
Publicado: (2024)
Learning with Language-Guided State Abstractions
por: Peng, Andi, et al.
Publicado: (2024)
por: Peng, Andi, et al.
Publicado: (2024)
Safe Offline Reinforcement Learning with Feasibility-Guided Diffusion Model
por: Zheng, Yinan, et al.
Publicado: (2024)
por: Zheng, Yinan, et al.
Publicado: (2024)
Ejemplares similares
-
Multi-Agent Guided Policy Optimization
por: Li, Yueheng, et al.
Publicado: (2025) -
Symmetry-aware Reinforcement Learning for Robotic Assembly under Partial Observability with a Soft Wrist
por: Nguyen, Hai, et al.
Publicado: (2024) -
Observation Adaptation via Annealed Importance Resampling for Partially Observable Markov Decision Processes
por: Zhang, Yunuo, et al.
Publicado: (2025) -
Policy-Guided Diffusion
por: Jackson, Matthew Thomas, et al.
Publicado: (2024) -
Decision Transformer as a Foundation Model for Partially Observable Continuous Control
por: Zhang, Xiangyuan, et al.
Publicado: (2024)