Actor-Critic without Actor
Fuente:
arXiv
Salvato in:
| Autori principali: | Ki, Donghyeon, Ahn, Hee-Jun, Kim, Kyungyoon, Lee, Byung-Jun |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Direct Soft-Policy Sampling via Langevin Dynamics
di: Ki, Donghyeon, et al.
Pubblicazione: (2026)
di: Ki, Donghyeon, et al.
Pubblicazione: (2026)
Score-Based One-step MeanFlow Policy Optimization
di: Kim, Kyungyoon, et al.
Pubblicazione: (2026)
di: Kim, Kyungyoon, et al.
Pubblicazione: (2026)
Prior-Guided Diffusion Planning for Offline Reinforcement Learning
di: Ki, Donghyeon, et al.
Pubblicazione: (2025)
di: Ki, Donghyeon, et al.
Pubblicazione: (2025)
Actor-Critic Reinforcement Learning with Phased Actor
di: Wu, Ruofan, et al.
Pubblicazione: (2024)
di: Wu, Ruofan, et al.
Pubblicazione: (2024)
Adaptive Non-uniform Timestep Sampling for Accelerating Diffusion Model Training
di: Kim, Myunsoo, et al.
Pubblicazione: (2024)
di: Kim, Myunsoo, et al.
Pubblicazione: (2024)
D2 Actor Critic: Diffusion Actor Meets Distributional Critic
di: Zhang, Lunjun, et al.
Pubblicazione: (2025)
di: Zhang, Lunjun, et al.
Pubblicazione: (2025)
Actor-Critic or Critic-Actor? A Tale of Two Time Scales
di: Bhatnagar, Shalabh, et al.
Pubblicazione: (2022)
di: Bhatnagar, Shalabh, et al.
Pubblicazione: (2022)
Generative Actor Critic
di: Qin, Aoyang, et al.
Pubblicazione: (2025)
di: Qin, Aoyang, et al.
Pubblicazione: (2025)
Offline Imitation Learning by Controlling the Effective Planning Horizon
di: Ahn, Hee-Jun, et al.
Pubblicazione: (2024)
di: Ahn, Hee-Jun, et al.
Pubblicazione: (2024)
Finite-Time Analysis of Three-Timescale Constrained Actor-Critic and Constrained Natural Actor-Critic Algorithms
di: Panda, Prashansa, et al.
Pubblicazione: (2023)
di: Panda, Prashansa, et al.
Pubblicazione: (2023)
Stabilizing the Q-Gradient Field for Policy Smoothness in Actor-Critic
di: Lee, Jeong Woon, et al.
Pubblicazione: (2026)
di: Lee, Jeong Woon, et al.
Pubblicazione: (2026)
Adaptive Ensemble Aggregation for Actor-Critics
di: Werge, Nicklas, et al.
Pubblicazione: (2025)
di: Werge, Nicklas, et al.
Pubblicazione: (2025)
Risk-Sensitive Exponential Actor Critic
di: Granados, Alonso, et al.
Pubblicazione: (2026)
di: Granados, Alonso, et al.
Pubblicazione: (2026)
Safe Langevin Soft Actor Critic
di: Keswani, Mahesh, et al.
Pubblicazione: (2026)
di: Keswani, Mahesh, et al.
Pubblicazione: (2026)
On the Convergence of Single-Timescale Actor-Critic
di: Kumar, Navdeep, et al.
Pubblicazione: (2024)
di: Kumar, Navdeep, et al.
Pubblicazione: (2024)
Actor-Critic with Active Importance Sampling
di: Molaei, Majid, et al.
Pubblicazione: (2026)
di: Molaei, Majid, et al.
Pubblicazione: (2026)
Flow Actor-Critic for Offline Reinforcement Learning
di: Chae, Jongseong, et al.
Pubblicazione: (2026)
di: Chae, Jongseong, et al.
Pubblicazione: (2026)
DSAC: Distributional Soft Actor-Critic for Risk-Sensitive Reinforcement Learning
di: Ma, Xiaoteng, et al.
Pubblicazione: (2020)
di: Ma, Xiaoteng, et al.
Pubblicazione: (2020)
Deep Actor-Critics with Tight Risk Certificates
di: Tasdighi, Bahareh, et al.
Pubblicazione: (2025)
di: Tasdighi, Bahareh, et al.
Pubblicazione: (2025)
Compatible Gradient Approximations for Actor-Critic Algorithms
di: Saglam, Baturay, et al.
Pubblicazione: (2024)
di: Saglam, Baturay, et al.
Pubblicazione: (2024)
Refined Analysis of Entropy-Regularized Actor-Critic
di: Labbi, Safwan, et al.
Pubblicazione: (2026)
di: Labbi, Safwan, et al.
Pubblicazione: (2026)
Actor-Critic Pretraining for Proximal Policy Optimization
di: Kernbach, Andreas, et al.
Pubblicazione: (2026)
di: Kernbach, Andreas, et al.
Pubblicazione: (2026)
PAC-Bayesian Soft Actor-Critic Learning
di: Tasdighi, Bahareh, et al.
Pubblicazione: (2023)
di: Tasdighi, Bahareh, et al.
Pubblicazione: (2023)
Average-Reward Soft Actor-Critic
di: Adamczyk, Jacob, et al.
Pubblicazione: (2025)
di: Adamczyk, Jacob, et al.
Pubblicazione: (2025)
Wasserstein Barycenter Soft Actor-Critic
di: Shahrooei, Zahra, et al.
Pubblicazione: (2025)
di: Shahrooei, Zahra, et al.
Pubblicazione: (2025)
Value Improved Actor Critic Algorithms
di: Oren, Yaniv, et al.
Pubblicazione: (2024)
di: Oren, Yaniv, et al.
Pubblicazione: (2024)
Diffusion Actor-Critic with Entropy Regulator
di: Wang, Yinuo, et al.
Pubblicazione: (2024)
di: Wang, Yinuo, et al.
Pubblicazione: (2024)
Revisiting Discrete Soft Actor-Critic
di: Zhou, Haibin, et al.
Pubblicazione: (2022)
di: Zhou, Haibin, et al.
Pubblicazione: (2022)
Relational Object-Centric Actor-Critic
di: Ugadiarov, Leonid, et al.
Pubblicazione: (2023)
di: Ugadiarov, Leonid, et al.
Pubblicazione: (2023)
A Theoretical Justification for Asymmetric Actor-Critic Algorithms
di: Lambrechts, Gaspard, et al.
Pubblicazione: (2025)
di: Lambrechts, Gaspard, et al.
Pubblicazione: (2025)
Actor-Critic Algorithm for Dynamic Expectile and CVaR
di: Luo, Yudong, et al.
Pubblicazione: (2026)
di: Luo, Yudong, et al.
Pubblicazione: (2026)
A Case for Validation Buffer in Pessimistic Actor-Critic
di: Nauman, Michal, et al.
Pubblicazione: (2024)
di: Nauman, Michal, et al.
Pubblicazione: (2024)
Distributional Soft Actor-Critic with Diffusion Policy
di: Liu, Tong, et al.
Pubblicazione: (2025)
di: Liu, Tong, et al.
Pubblicazione: (2025)
Distributional Soft Actor-Critic with Three Refinements
di: Duan, Jingliang, et al.
Pubblicazione: (2023)
di: Duan, Jingliang, et al.
Pubblicazione: (2023)
Generative Actor-Critic with Soft Bridge Policies
di: He, Ke, et al.
Pubblicazione: (2026)
di: He, Ke, et al.
Pubblicazione: (2026)
Maximum Entropy On-Policy Actor-Critic via Entropy Advantage Estimation
di: Choe, Jean Seong Bjorn, et al.
Pubblicazione: (2024)
di: Choe, Jean Seong Bjorn, et al.
Pubblicazione: (2024)
Pretraining in Actor-Critic Reinforcement Learning for Robot Locomotion
di: Fan, Jiale, et al.
Pubblicazione: (2025)
di: Fan, Jiale, et al.
Pubblicazione: (2025)
SHAP-Guided Kernel Actor-Critic for Explainable Reinforcement Learning
di: Li, Na, et al.
Pubblicazione: (2025)
di: Li, Na, et al.
Pubblicazione: (2025)
An Investigation of Batch Normalization in Off-Policy Actor-Critic Algorithms
di: Wang, Li, et al.
Pubblicazione: (2025)
di: Wang, Li, et al.
Pubblicazione: (2025)
Mirror Descent Actor Critic via Bounded Advantage Learning
di: Iwaki, Ryo
Pubblicazione: (2025)
di: Iwaki, Ryo
Pubblicazione: (2025)
Documenti analoghi
-
Direct Soft-Policy Sampling via Langevin Dynamics
di: Ki, Donghyeon, et al.
Pubblicazione: (2026) -
Score-Based One-step MeanFlow Policy Optimization
di: Kim, Kyungyoon, et al.
Pubblicazione: (2026) -
Prior-Guided Diffusion Planning for Offline Reinforcement Learning
di: Ki, Donghyeon, et al.
Pubblicazione: (2025) -
Actor-Critic Reinforcement Learning with Phased Actor
di: Wu, Ruofan, et al.
Pubblicazione: (2024) -
Adaptive Non-uniform Timestep Sampling for Accelerating Diffusion Model Training
di: Kim, Myunsoo, et al.
Pubblicazione: (2024)