Diffusion Actor-Critic with Entropy Regulator
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Yinuo, Wang, Likun, Jiang, Yuxuan, Zou, Wenjun, Liu, Tong, Song, Xujie, Wang, Wenxuan, Xiao, Liming, Wu, Jiang, Duan, Jingliang, Li, Shengbo Eben |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Distributional Soft Actor-Critic with Diffusion Policy
di: Liu, Tong, et al.
Pubblicazione: (2025)
di: Liu, Tong, et al.
Pubblicazione: (2025)
Enhanced DACER Algorithm with High Diffusion Efficiency
di: Wang, Yinuo, et al.
Pubblicazione: (2025)
di: Wang, Yinuo, et al.
Pubblicazione: (2025)
Off-policy Reinforcement Learning with Model-based Exploration Augmentation
di: Wang, Likun, et al.
Pubblicazione: (2025)
di: Wang, Likun, et al.
Pubblicazione: (2025)
Mind Your Entropy: From Maximum Entropy to Trajectory Entropy-Constrained RL
di: Zhan, Guojian, et al.
Pubblicazione: (2025)
di: Zhan, Guojian, et al.
Pubblicazione: (2025)
Distributional Soft Actor-Critic with Three Refinements
di: Duan, Jingliang, et al.
Pubblicazione: (2023)
di: Duan, Jingliang, et al.
Pubblicazione: (2023)
Distributional Soft Actor-Critic with Harmonic Gradient for Safe and Efficient Autonomous Driving in Multi-lane Scenarios
di: Zhang, Feihong, et al.
Pubblicazione: (2025)
di: Zhang, Feihong, et al.
Pubblicazione: (2025)
STAPO: Stabilizing Reinforcement Learning for LLMs by Silencing Rare Spurious Tokens
di: Liu, Shiqi, et al.
Pubblicazione: (2026)
di: Liu, Shiqi, et al.
Pubblicazione: (2026)
Zeroth-Order Actor-Critic: An Evolutionary Framework for Sequential Decision Problems
di: Lei, Yuheng, et al.
Pubblicazione: (2022)
di: Lei, Yuheng, et al.
Pubblicazione: (2022)
Bootstrap Off-policy with World Model
di: Zhan, Guojian, et al.
Pubblicazione: (2025)
di: Zhan, Guojian, et al.
Pubblicazione: (2025)
Real-Time Generative Policy via Langevin-Guided Flow Matching for Autonomous Driving
di: Zhu, Tianze, et al.
Pubblicazione: (2026)
di: Zhu, Tianze, et al.
Pubblicazione: (2026)
Conformal Symplectic Optimization for Stable Reinforcement Learning
di: Lyu, Yao, et al.
Pubblicazione: (2024)
di: Lyu, Yao, et al.
Pubblicazione: (2024)
Risk-Aware Vehicle Trajectory Prediction Under Safety-Critical Scenarios
di: Wang, Qingfan, et al.
Pubblicazione: (2024)
di: Wang, Qingfan, et al.
Pubblicazione: (2024)
Controllability Test for Nonlinear Datatic Systems
di: Yang, Yujie, et al.
Pubblicazione: (2024)
di: Yang, Yujie, et al.
Pubblicazione: (2024)
Global Optimality of Single-Timescale Actor-Critic under Continuous State-Action Space: A Study on Linear Quadratic Regulator
di: Chen, Xuyang, et al.
Pubblicazione: (2025)
di: Chen, Xuyang, et al.
Pubblicazione: (2025)
HACMan: Learning Hybrid Actor-Critic Maps for 6D Non-Prehensile Manipulation
di: Zhou, Wenxuan, et al.
Pubblicazione: (2023)
di: Zhou, Wenxuan, et al.
Pubblicazione: (2023)
Non-Asymptotic Analysis for Single-Loop (Natural) Actor-Critic with Compatible Function Approximation
di: Wang, Yudan, et al.
Pubblicazione: (2024)
di: Wang, Yudan, et al.
Pubblicazione: (2024)
Canonical Form of Datatic Description in Control Systems
di: Zhan, Guojian, et al.
Pubblicazione: (2024)
di: Zhan, Guojian, et al.
Pubblicazione: (2024)
Maximum Entropy On-Policy Actor-Critic via Entropy Advantage Estimation
di: Choe, Jean Seong Bjorn, et al.
Pubblicazione: (2024)
di: Choe, Jean Seong Bjorn, et al.
Pubblicazione: (2024)
Revisiting Mixture Policies in Entropy-Regularized Actor-Critic
di: He, Jiamin, et al.
Pubblicazione: (2026)
di: He, Jiamin, et al.
Pubblicazione: (2026)
Off-Policy Actor-Critic with Sigmoid-Bounded Entropy for Real-World Robot Learning
di: Wu, Xiefeng, et al.
Pubblicazione: (2026)
di: Wu, Xiefeng, et al.
Pubblicazione: (2026)
Mixed Policy Gradient: off-policy reinforcement learning driven jointly by data and model
di: Guan, Yang, et al.
Pubblicazione: (2021)
di: Guan, Yang, et al.
Pubblicazione: (2021)
Functional Critics Are Essential for Actor-Critic: From Off-Policy Stability to Efficient Exploration
di: Bai, Qinxun, et al.
Pubblicazione: (2025)
di: Bai, Qinxun, et al.
Pubblicazione: (2025)
Policy Bifurcation in Safe Reinforcement Learning
di: Zou, Wenjun, et al.
Pubblicazione: (2024)
di: Zou, Wenjun, et al.
Pubblicazione: (2024)
Hierarchical End-to-End Autonomous Driving: Integrating BEV Perception with Deep Reinforcement Learning
di: Lu, Siyi, et al.
Pubblicazione: (2024)
di: Lu, Siyi, et al.
Pubblicazione: (2024)
Safe Offline Reinforcement Learning with Feasibility-Guided Diffusion Model
di: Zheng, Yinan, et al.
Pubblicazione: (2024)
di: Zheng, Yinan, et al.
Pubblicazione: (2024)
Relative Importance Sampling for off-Policy Actor-Critic in Deep Reinforcement Learning
di: Humayoo, Mahammad, et al.
Pubblicazione: (2018)
di: Humayoo, Mahammad, et al.
Pubblicazione: (2018)
Asymmetric Actor-Critic for Multi-turn LLM Agents
di: Jiang, Shuli, et al.
Pubblicazione: (2026)
di: Jiang, Shuli, et al.
Pubblicazione: (2026)
Multi-Agent Actor-Critics in Autonomous Cyber Defense
di: Wang, Mingjun, et al.
Pubblicazione: (2024)
di: Wang, Mingjun, et al.
Pubblicazione: (2024)
ACE : Off-Policy Actor-Critic with Causality-Aware Entropy Regularization
di: Ji, Tianying, et al.
Pubblicazione: (2024)
di: Ji, Tianying, et al.
Pubblicazione: (2024)
Ask-AC: An Initiative Advisor-in-the-Loop Actor-Critic Framework
di: Liu, Shunyu, et al.
Pubblicazione: (2022)
di: Liu, Shunyu, et al.
Pubblicazione: (2022)
Revisiting Discrete Soft Actor-Critic
di: Zhou, Haibin, et al.
Pubblicazione: (2022)
di: Zhou, Haibin, et al.
Pubblicazione: (2022)
DR-SAC: Distributionally Robust Soft Actor-Critic for Reinforcement Learning under Uncertainty
di: Cui, Mingxuan, et al.
Pubblicazione: (2025)
di: Cui, Mingxuan, et al.
Pubblicazione: (2025)
Enhancing Decision-Making of Large Language Models via Actor-Critic
di: Dong, Heng, et al.
Pubblicazione: (2025)
di: Dong, Heng, et al.
Pubblicazione: (2025)
GTDE: Grouped Training with Decentralized Execution for Multi-agent Actor-Critic
di: Li, Mengxian, et al.
Pubblicazione: (2024)
di: Li, Mengxian, et al.
Pubblicazione: (2024)
A Cognitive-Based Trajectory Prediction Approach for Autonomous Driving
di: Liao, Haicheng, et al.
Pubblicazione: (2024)
di: Liao, Haicheng, et al.
Pubblicazione: (2024)
One Filters All: A Generalist Filter for State Estimation
di: Liu, Shiqi, et al.
Pubblicazione: (2025)
di: Liu, Shiqi, et al.
Pubblicazione: (2025)
Broad Critic Deep Actor Reinforcement Learning for Continuous Control
di: Thalagala, Shiron, et al.
Pubblicazione: (2024)
di: Thalagala, Shiron, et al.
Pubblicazione: (2024)
Enhance Sample Efficiency and Robustness of End-to-end Urban Autonomous Driving via Semantic Masked World Model
di: Gao, Zeyu, et al.
Pubblicazione: (2022)
di: Gao, Zeyu, et al.
Pubblicazione: (2022)
AnchorDrive: LLM Scenario Rollout with Anchor-Guided Diffusion Regeneration for Safety-Critical Scenario Generation
di: Jiang, Zhulin, et al.
Pubblicazione: (2026)
di: Jiang, Zhulin, et al.
Pubblicazione: (2026)
Heavy-Ball Momentum Accelerated Actor-Critic With Function Approximation
di: Dong, Yanjie, et al.
Pubblicazione: (2024)
di: Dong, Yanjie, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Distributional Soft Actor-Critic with Diffusion Policy
di: Liu, Tong, et al.
Pubblicazione: (2025) -
Enhanced DACER Algorithm with High Diffusion Efficiency
di: Wang, Yinuo, et al.
Pubblicazione: (2025) -
Off-policy Reinforcement Learning with Model-based Exploration Augmentation
di: Wang, Likun, et al.
Pubblicazione: (2025) -
Mind Your Entropy: From Maximum Entropy to Trajectory Entropy-Constrained RL
di: Zhan, Guojian, et al.
Pubblicazione: (2025) -
Distributional Soft Actor-Critic with Three Refinements
di: Duan, Jingliang, et al.
Pubblicazione: (2023)