RN-D: Discretized Categorical Actors with Regularized Networks for On-Policy Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Bian, Yuexin, Feng, Jie, Wang, Tao, Li, Yijiang, Gao, Sicun, Shi, Yuanyuan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Mollification Effects of Policy Gradient Methods
di: Wang, Tao, et al.
Pubblicazione: (2024)
di: Wang, Tao, et al.
Pubblicazione: (2024)
Hamilton-Jacobi Reachability in Reinforcement Learning: A Survey
di: Ganai, Milan, et al.
Pubblicazione: (2024)
di: Ganai, Milan, et al.
Pubblicazione: (2024)
Improving Value Estimation Critically Enhances Vanilla Policy Gradient
di: Wang, Tao, et al.
Pubblicazione: (2025)
di: Wang, Tao, et al.
Pubblicazione: (2025)
Extremum-Seeking Action Selection for Accelerating Policy Optimization
di: Chang, Ya-Chien, et al.
Pubblicazione: (2024)
di: Chang, Ya-Chien, et al.
Pubblicazione: (2024)
Adaptive Advantage-Guided Policy Regularization for Offline Reinforcement Learning
di: Liu, Tenglong, et al.
Pubblicazione: (2024)
di: Liu, Tenglong, et al.
Pubblicazione: (2024)
Certificated Actor-Critic: Hierarchical Reinforcement Learning with Control Barrier Functions for Safe Navigation
di: Xie, Junjun, et al.
Pubblicazione: (2025)
di: Xie, Junjun, et al.
Pubblicazione: (2025)
Pretraining in Actor-Critic Reinforcement Learning for Robot Locomotion
di: Fan, Jiale, et al.
Pubblicazione: (2025)
di: Fan, Jiale, et al.
Pubblicazione: (2025)
Controllable Motion Generation via Diffusion Modal Coupling
di: Wang, Luobin, et al.
Pubblicazione: (2025)
di: Wang, Luobin, et al.
Pubblicazione: (2025)
ReActor: Reinforcement Learning for Physics-Aware Motion Retargeting
di: Müller, David, et al.
Pubblicazione: (2026)
di: Müller, David, et al.
Pubblicazione: (2026)
Offline Reinforcement Learning with Discrete Diffusion Skills
di: Qiao, RuiXi, et al.
Pubblicazione: (2025)
di: Qiao, RuiXi, et al.
Pubblicazione: (2025)
Offline Actor-Critic Reinforcement Learning Scales to Large Models
di: Springenberg, Jost Tobias, et al.
Pubblicazione: (2024)
di: Springenberg, Jost Tobias, et al.
Pubblicazione: (2024)
Activation-Descent Regularization for Input Optimization of ReLU Networks
di: Yu, Hongzhan, et al.
Pubblicazione: (2024)
di: Yu, Hongzhan, et al.
Pubblicazione: (2024)
Q-value Regularized Decision ConvFormer for Offline Reinforcement Learning
di: Yan, Teng, et al.
Pubblicazione: (2024)
di: Yan, Teng, et al.
Pubblicazione: (2024)
Low-Rank Adaptation for Critic Learning in Off-Policy Reinforcement Learning
di: Zhuang, Yuan, et al.
Pubblicazione: (2026)
di: Zhuang, Yuan, et al.
Pubblicazione: (2026)
Efficient Motion Planning for Manipulators with Control Barrier Function-Induced Neural Controller
di: Yu, Mingxin, et al.
Pubblicazione: (2024)
di: Yu, Mingxin, et al.
Pubblicazione: (2024)
Off-Dynamics Reinforcement Learning via Domain Adaptation and Reward Augmented Imitation
di: Guo, Yihong, et al.
Pubblicazione: (2024)
di: Guo, Yihong, et al.
Pubblicazione: (2024)
Optimal Actuator Attacks on Autonomous Vehicles Using Reinforcement Learning
di: Wang, Pengyu, et al.
Pubblicazione: (2025)
di: Wang, Pengyu, et al.
Pubblicazione: (2025)
Frugal Actor-Critic: Sample Efficient Off-Policy Deep Reinforcement Learning Using Unique Experiences
di: Singh, Nikhil Kumar, et al.
Pubblicazione: (2024)
di: Singh, Nikhil Kumar, et al.
Pubblicazione: (2024)
Off-Policy Safe Reinforcement Learning with Constrained Optimistic Exploration
di: Li, Guopeng, et al.
Pubblicazione: (2026)
di: Li, Guopeng, et al.
Pubblicazione: (2026)
Fractal Landscapes in Policy Optimization
di: Wang, Tao, et al.
Pubblicazione: (2023)
di: Wang, Tao, et al.
Pubblicazione: (2023)
PolicyFlow: Policy Optimization with Continuous Normalizing Flow in Reinforcement Learning
di: Yang, Shunpeng, et al.
Pubblicazione: (2026)
di: Yang, Shunpeng, et al.
Pubblicazione: (2026)
Equivariant Ensembles and Regularization for Reinforcement Learning in Map-based Path Planning
di: Theile, Mirco, et al.
Pubblicazione: (2024)
di: Theile, Mirco, et al.
Pubblicazione: (2024)
Safe Human Robot Navigation in Warehouse Scenario
di: Farrell, Seth, et al.
Pubblicazione: (2025)
di: Farrell, Seth, et al.
Pubblicazione: (2025)
TOP-ERL: Transformer-based Off-Policy Episodic Reinforcement Learning
di: Li, Ge, et al.
Pubblicazione: (2024)
di: Li, Ge, et al.
Pubblicazione: (2024)
DiffOP: Reinforcement Learning of Optimization-Based Control Policies via Implicit Policy Gradients
di: Bian, Yuexin, et al.
Pubblicazione: (2024)
di: Bian, Yuexin, et al.
Pubblicazione: (2024)
HOPE: A Reinforcement Learning-based Hybrid Policy Path Planner for Diverse Parking Scenarios
di: Jiang, Mingyang, et al.
Pubblicazione: (2024)
di: Jiang, Mingyang, et al.
Pubblicazione: (2024)
Reinforcement Learning Position Control of a Quadrotor Using Soft Actor-Critic (SAC)
di: Mahran, Youssef, et al.
Pubblicazione: (2025)
di: Mahran, Youssef, et al.
Pubblicazione: (2025)
ReinFlow: Fine-tuning Flow Matching Policy with Online Reinforcement Learning
di: Zhang, Tonghe, et al.
Pubblicazione: (2025)
di: Zhang, Tonghe, et al.
Pubblicazione: (2025)
Enhancing Sample Efficiency and Exploration in Reinforcement Learning through the Integration of Diffusion Models and Proximal Policy Optimization
di: Gao, Tianci, et al.
Pubblicazione: (2024)
di: Gao, Tianci, et al.
Pubblicazione: (2024)
Uni-O4: Unifying Online and Offline Deep Reinforcement Learning with Multi-Step On-Policy Optimization
di: Lei, Kun, et al.
Pubblicazione: (2023)
di: Lei, Kun, et al.
Pubblicazione: (2023)
Hysteresis-Aware Neural Network Modeling and Whole-Body Reinforcement Learning Control of Soft Robots
di: Chen, Zongyuan, et al.
Pubblicazione: (2025)
di: Chen, Zongyuan, et al.
Pubblicazione: (2025)
REBEL: Reward Regularization-Based Approach for Robotic Reinforcement Learning from Human Feedback
di: Chakraborty, Souradip, et al.
Pubblicazione: (2023)
di: Chakraborty, Souradip, et al.
Pubblicazione: (2023)
Steering Your Diffusion Policy with Latent Space Reinforcement Learning
di: Wagenmaker, Andrew, et al.
Pubblicazione: (2025)
di: Wagenmaker, Andrew, et al.
Pubblicazione: (2025)
Oracle-Guided Masked Contrastive Reinforcement Learning for Visuomotor Policies
di: Zhang, Yuhang, et al.
Pubblicazione: (2025)
di: Zhang, Yuhang, et al.
Pubblicazione: (2025)
ACSAC: Adaptive Chunk Size Actor-Critic with Causal Transformer Q-Network
di: Chen, Qian, et al.
Pubblicazione: (2026)
di: Chen, Qian, et al.
Pubblicazione: (2026)
ERPPO: Entropy Regularization-based Proximal Policy Optimization
di: Lee, Changha, et al.
Pubblicazione: (2026)
di: Lee, Changha, et al.
Pubblicazione: (2026)
DRARL: Disengagement-Reason-Augmented Reinforcement Learning for Efficient Improvement of Autonomous Driving Policy
di: Zhou, Weitao, et al.
Pubblicazione: (2025)
di: Zhou, Weitao, et al.
Pubblicazione: (2025)
Exterior Penalty Policy Optimization with Penalty Metric Network under Constraints
di: Gao, Shiqing, et al.
Pubblicazione: (2024)
di: Gao, Shiqing, et al.
Pubblicazione: (2024)
Latent-Conditioned Policy Gradient for Multi-Objective Deep Reinforcement Learning
di: Kanazawa, Takuya, et al.
Pubblicazione: (2023)
di: Kanazawa, Takuya, et al.
Pubblicazione: (2023)
Hierarchical Reinforcement Learning for Safe Mapless Navigation with Congestion Estimation
di: Gao, Jianqi, et al.
Pubblicazione: (2025)
di: Gao, Jianqi, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Mollification Effects of Policy Gradient Methods
di: Wang, Tao, et al.
Pubblicazione: (2024) -
Hamilton-Jacobi Reachability in Reinforcement Learning: A Survey
di: Ganai, Milan, et al.
Pubblicazione: (2024) -
Improving Value Estimation Critically Enhances Vanilla Policy Gradient
di: Wang, Tao, et al.
Pubblicazione: (2025) -
Extremum-Seeking Action Selection for Accelerating Policy Optimization
di: Chang, Ya-Chien, et al.
Pubblicazione: (2024) -
Adaptive Advantage-Guided Policy Regularization for Offline Reinforcement Learning
di: Liu, Tenglong, et al.
Pubblicazione: (2024)