A Pontryagin Method of Model-based Reinforcement Learning via Hamiltonian Actor-Critic
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Gu, Chengyang, Pan, Yuxin, Xiong, Hui, Chen, Yize |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Pontryagin Optimal Control via Neural Networks
par: Gu, Chengyang, et autres
Publié: (2022)
par: Gu, Chengyang, et autres
Publié: (2022)
SEAL: SEmantic-Augmented Imitation Learning via Language Model
par: Gu, Chengyang, et autres
Publié: (2024)
par: Gu, Chengyang, et autres
Publié: (2024)
STO-RL: Offline RL under Sparse Rewards via LLM-Guided Subgoal Temporal Order
par: Gu, Chengyang, et autres
Publié: (2026)
par: Gu, Chengyang, et autres
Publié: (2026)
Learning and Optimization for Price-based Demand Response of Electric Vehicle Charging
par: Gu, Chengyang, et autres
Publié: (2024)
par: Gu, Chengyang, et autres
Publié: (2024)
C-MORL: Multi-Objective Reinforcement Learning through Efficient Discovery of Pareto Front
par: Liu, Ruohong, et autres
Publié: (2024)
par: Liu, Ruohong, et autres
Publié: (2024)
Wasserstein Adaptive Value Estimation for Actor-Critic Reinforcement Learning
par: Baheri, Ali, et autres
Publié: (2025)
par: Baheri, Ali, et autres
Publié: (2025)
Alleviating Community Fear in Disasters via Multi-Agent Actor-Critic Reinforcement Learning
par: Hakke, Yashodhan D., et autres
Publié: (2026)
par: Hakke, Yashodhan D., et autres
Publié: (2026)
Bounded Exploration with World Model Uncertainty in Soft Actor-Critic Reinforcement Learning Algorithm
par: Qiao, Ting, et autres
Publié: (2024)
par: Qiao, Ting, et autres
Publié: (2024)
BEAVER: Building Environments with Assessable Variation for Evaluating Multi-Objective Reinforcement Learning
par: Liu, Ruohong, et autres
Publié: (2025)
par: Liu, Ruohong, et autres
Publié: (2025)
Risk-Sensitive Soft Actor-Critic for Robust Deep Reinforcement Learning under Distribution Shifts
par: Enders, Tobias, et autres
Publié: (2024)
par: Enders, Tobias, et autres
Publié: (2024)
Coordinating Planning and Tracking in Layered Control Policies via Actor-Critic Learning
par: Yang, Fengjun, et autres
Publié: (2024)
par: Yang, Fengjun, et autres
Publié: (2024)
Wasserstein Barycenter Soft Actor-Critic
par: Shahrooei, Zahra, et autres
Publié: (2025)
par: Shahrooei, Zahra, et autres
Publié: (2025)
Physics-Guided Actor-Critic Reinforcement Learning for Swimming in Turbulence
par: Koh, Christopher, et autres
Publié: (2024)
par: Koh, Christopher, et autres
Publié: (2024)
Distributional Soft Actor-Critic with Three Refinements
par: Duan, Jingliang, et autres
Publié: (2023)
par: Duan, Jingliang, et autres
Publié: (2023)
Quasi-Newton Compatible Actor-Critic for Deterministic Policies
par: Kordabad, Arash Bahari, et autres
Publié: (2025)
par: Kordabad, Arash Bahari, et autres
Publié: (2025)
Scaling Laws of Machine Learning for Optimal Power Flow
par: Liu, Xinyi, et autres
Publié: (2026)
par: Liu, Xinyi, et autres
Publié: (2026)
Can an Actor-Critic Optimization Framework Improve Analog Design Optimization?
par: Dutta, Sounak, et autres
Publié: (2026)
par: Dutta, Sounak, et autres
Publié: (2026)
ISAACS: Iterative Soft Adversarial Actor-Critic for Safety
par: Hsu, Kai-Chieh, et autres
Publié: (2022)
par: Hsu, Kai-Chieh, et autres
Publié: (2022)
Actor-Critic Physics-informed Neural Lyapunov Control
par: Wang, Jiarui, et autres
Publié: (2024)
par: Wang, Jiarui, et autres
Publié: (2024)
A Pontryagin Perspective on Reinforcement Learning
par: Eberhard, Onno, et autres
Publié: (2024)
par: Eberhard, Onno, et autres
Publié: (2024)
Frugal Actor-Critic: Sample Efficient Off-Policy Deep Reinforcement Learning Using Unique Experiences
par: Singh, Nikhil Kumar, et autres
Publié: (2024)
par: Singh, Nikhil Kumar, et autres
Publié: (2024)
Stochastic Actor-Critic: Mitigating Overestimation via Temporal Aleatoric Uncertainty
par: Özalp, Uğurcan
Publié: (2026)
par: Özalp, Uğurcan
Publié: (2026)
ACING: Actor-Critic for Instruction Learning in Black-Box LLMs
par: Kharrat, Salma, et autres
Publié: (2024)
par: Kharrat, Salma, et autres
Publié: (2024)
Multi-Agent Soft Actor-Critic with Coordinated Loss for Autonomous Mobility-on-Demand Fleet Control
par: Woywood, Zeno, et autres
Publié: (2024)
par: Woywood, Zeno, et autres
Publié: (2024)
Bootstrapping Reinforcement Learning with Sub-optimal Policies for Autonomous Driving
par: Zhang, Zhihao, et autres
Publié: (2025)
par: Zhang, Zhihao, et autres
Publié: (2025)
Zeroth-Order Actor-Critic: An Evolutionary Framework for Sequential Decision Problems
par: Lei, Yuheng, et autres
Publié: (2022)
par: Lei, Yuheng, et autres
Publié: (2022)
VLMLight: Safety-Critical Traffic Signal Control via Vision-Language Meta-Control and Dual-Branch Reasoning Architecture
par: Wang, Maonan, et autres
Publié: (2025)
par: Wang, Maonan, et autres
Publié: (2025)
Natural Policy Gradient and Actor Critic Methods for Constrained Multi-Task Reinforcement Learning
par: Zeng, Sihan, et autres
Publié: (2024)
par: Zeng, Sihan, et autres
Publié: (2024)
Control in Stochastic Environment with Delays: A Model-based Reinforcement Learning Approach
par: Yao, Zhiyuan, et autres
Publié: (2024)
par: Yao, Zhiyuan, et autres
Publié: (2024)
DiffCharge: Generating EV Charging Scenarios via a Denoising Diffusion Model
par: Li, Siyang, et autres
Publié: (2023)
par: Li, Siyang, et autres
Publié: (2023)
Impact of Computation in Integral Reinforcement Learning for Continuous-Time Control
par: Cao, Wenhan, et autres
Publié: (2024)
par: Cao, Wenhan, et autres
Publié: (2024)
MSACL: Multi-Step Actor-Critic Learning with Lyapunov Certificates for Exponentially Stabilizing Control
par: Zhang, Yongwei, et autres
Publié: (2025)
par: Zhang, Yongwei, et autres
Publié: (2025)
Learning Subsystem Dynamics in Nonlinear Systems via Port-Hamiltonian Neural Networks
par: van Otterdijk, G. J. E., et autres
Publié: (2024)
par: van Otterdijk, G. J. E., et autres
Publié: (2024)
Reinforcement Learning-based Control via Y-wise Affine Neural Networks (YANNs)
par: Braniff, Austin, et autres
Publié: (2025)
par: Braniff, Austin, et autres
Publié: (2025)
Improving Mixed-Criticality Scheduling with Reinforcement Learning
par: El-Mahdy, Muhammad, et autres
Publié: (2025)
par: El-Mahdy, Muhammad, et autres
Publié: (2025)
Robust Koopman Control Barrier Filters for Safe Actor-Critic Reinforcement Learning
par: Kushwaha, Dhruv S., et autres
Publié: (2026)
par: Kushwaha, Dhruv S., et autres
Publié: (2026)
Application of Soft Actor-Critic Algorithms in Optimizing Wastewater Treatment with Time Delays Integration
par: Mohammadi, Esmaeel, et autres
Publié: (2024)
par: Mohammadi, Esmaeel, et autres
Publié: (2024)
Offline Reinforcement Learning via Inverse Optimization
par: Dimanidis, Ioannis, et autres
Publié: (2025)
par: Dimanidis, Ioannis, et autres
Publié: (2025)
UniTSA: A Universal Reinforcement Learning Framework for V2X Traffic Signal Control
par: Wang, Maonan, et autres
Publié: (2023)
par: Wang, Maonan, et autres
Publié: (2023)
Settling the Sample Complexity of Model-Based Offline Reinforcement Learning
par: Li, Gen, et autres
Publié: (2022)
par: Li, Gen, et autres
Publié: (2022)
Documents similaires
-
Pontryagin Optimal Control via Neural Networks
par: Gu, Chengyang, et autres
Publié: (2022) -
SEAL: SEmantic-Augmented Imitation Learning via Language Model
par: Gu, Chengyang, et autres
Publié: (2024) -
STO-RL: Offline RL under Sparse Rewards via LLM-Guided Subgoal Temporal Order
par: Gu, Chengyang, et autres
Publié: (2026) -
Learning and Optimization for Price-based Demand Response of Electric Vehicle Charging
par: Gu, Chengyang, et autres
Publié: (2024) -
C-MORL: Multi-Objective Reinforcement Learning through Efficient Discovery of Pareto Front
par: Liu, Ruohong, et autres
Publié: (2024)