Langevin Soft Actor-Critic: Efficient Exploration through Uncertainty-Driven Critic Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ishfaq, Haque, Wang, Guangyuan, Islam, Sami Nur, Precup, Doina |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Provable and Practical: Efficient Exploration in Reinforcement Learning via Langevin Monte Carlo
par: Ishfaq, Haque, et autres
Publié: (2023)
par: Ishfaq, Haque, et autres
Publié: (2023)
Safe Langevin Soft Actor Critic
par: Keswani, Mahesh, et autres
Publié: (2026)
par: Keswani, Mahesh, et autres
Publié: (2026)
Diversity-Enriched Option-Critic
par: Kamat, Anand, et autres
Publié: (2020)
par: Kamat, Anand, et autres
Publié: (2020)
More Efficient Randomized Exploration for Reinforcement Learning via Approximate Sampling
par: Ishfaq, Haque, et autres
Publié: (2024)
par: Ishfaq, Haque, et autres
Publié: (2024)
Code as Reward: Empowering Reinforcement Learning with VLMs
par: Venuto, David, et autres
Publié: (2024)
par: Venuto, David, et autres
Publié: (2024)
Bounded Exploration with World Model Uncertainty in Soft Actor-Critic Reinforcement Learning Algorithm
par: Qiao, Ting, et autres
Publié: (2024)
par: Qiao, Ting, et autres
Publié: (2024)
Offline Multitask Representation Learning for Reinforcement Learning
par: Ishfaq, Haque, et autres
Publié: (2024)
par: Ishfaq, Haque, et autres
Publié: (2024)
Optimistic Actor-Critic with Parametric Policies for Linear Markov Decision Processes
par: Lin, Max Qiushi, et autres
Publié: (2026)
par: Lin, Max Qiushi, et autres
Publié: (2026)
Adaptive Exploration for Data-Efficient General Value Function Evaluations
par: Jain, Arushi, et autres
Publié: (2024)
par: Jain, Arushi, et autres
Publié: (2024)
PAC-Bayesian Soft Actor-Critic Learning
par: Tasdighi, Bahareh, et autres
Publié: (2023)
par: Tasdighi, Bahareh, et autres
Publié: (2023)
Decorrelated Soft Actor-Critic for Efficient Deep Reinforcement Learning
par: Küçükoğlu, Burcu, et autres
Publié: (2025)
par: Küçükoğlu, Burcu, et autres
Publié: (2025)
DR-SAC: Distributionally Robust Soft Actor-Critic for Reinforcement Learning under Uncertainty
par: Cui, Mingxuan, et autres
Publié: (2025)
par: Cui, Mingxuan, et autres
Publié: (2025)
Average-Reward Soft Actor-Critic
par: Adamczyk, Jacob, et autres
Publié: (2025)
par: Adamczyk, Jacob, et autres
Publié: (2025)
Wasserstein Barycenter Soft Actor-Critic
par: Shahrooei, Zahra, et autres
Publié: (2025)
par: Shahrooei, Zahra, et autres
Publié: (2025)
Revisiting Discrete Soft Actor-Critic
par: Zhou, Haibin, et autres
Publié: (2022)
par: Zhou, Haibin, et autres
Publié: (2022)
Distributional Soft Actor-Critic with Diffusion Policy
par: Liu, Tong, et autres
Publié: (2025)
par: Liu, Tong, et autres
Publié: (2025)
Generative Actor-Critic with Soft Bridge Policies
par: He, Ke, et autres
Publié: (2026)
par: He, Ke, et autres
Publié: (2026)
Functional Critics Are Essential for Actor-Critic: From Off-Policy Stability to Efficient Exploration
par: Bai, Qinxun, et autres
Publié: (2025)
par: Bai, Qinxun, et autres
Publié: (2025)
Efficient Exploration in Deep Reinforcement Learning: A Novel Bayesian Actor-Critic Algorithm
par: Rozanov, Nikolai
Publié: (2024)
par: Rozanov, Nikolai
Publié: (2024)
Distributional Soft Actor-Critic with Three Refinements
par: Duan, Jingliang, et autres
Publié: (2023)
par: Duan, Jingliang, et autres
Publié: (2023)
Functional Acceleration for Policy Mirror Descent
par: Chelu, Veronica, et autres
Publié: (2024)
par: Chelu, Veronica, et autres
Publié: (2024)
A Look at Value-Based Decision-Time vs. Background Planning Methods Across Different Settings
par: Alver, Safa, et autres
Publié: (2022)
par: Alver, Safa, et autres
Publié: (2022)
Efficient Soft Actor-Critic with LLM-Based Action-Level Guidance for Continuous Control
par: Ma, Hao, et autres
Publié: (2026)
par: Ma, Hao, et autres
Publié: (2026)
Learning Without Time-Based Embodiment Resets in Soft-Actor Critic
par: Farrahi, Homayoon, et autres
Publié: (2025)
par: Farrahi, Homayoon, et autres
Publié: (2025)
On-policy Actor-Critic Reinforcement Learning for Multi-UAV Exploration
par: Farid, Ali Moltajaei, et autres
Publié: (2024)
par: Farid, Ali Moltajaei, et autres
Publié: (2024)
Actor-Critic Reinforcement Learning with Phased Actor
par: Wu, Ruofan, et autres
Publié: (2024)
par: Wu, Ruofan, et autres
Publié: (2024)
Chunking the Critic: A Transformer-based Soft Actor-Critic with N-Step Returns
par: Tian, Dong, et autres
Publié: (2025)
par: Tian, Dong, et autres
Publié: (2025)
Actor-Critic without Actor
par: Ki, Donghyeon, et autres
Publié: (2025)
par: Ki, Donghyeon, et autres
Publié: (2025)
S$^2$AC: Energy-Based Reinforcement Learning with Stein Soft Actor Critic
par: Messaoud, Safa, et autres
Publié: (2024)
par: Messaoud, Safa, et autres
Publié: (2024)
Bidirectional Soft Actor-Critic: Leveraging Forward and Reverse KL Divergence for Efficient Reinforcement Learning
par: Zhang, Yixian, et autres
Publié: (2025)
par: Zhang, Yixian, et autres
Publié: (2025)
DSAC: Distributional Soft Actor-Critic for Risk-Sensitive Reinforcement Learning
par: Ma, Xiaoteng, et autres
Publié: (2020)
par: Ma, Xiaoteng, et autres
Publié: (2020)
SACn: Soft Actor-Critic with n-step Returns
par: Łyskawa, Jakub, et autres
Publié: (2025)
par: Łyskawa, Jakub, et autres
Publié: (2025)
Generative Actor Critic
par: Qin, Aoyang, et autres
Publié: (2025)
par: Qin, Aoyang, et autres
Publié: (2025)
Causal Policy Learning in Reinforcement Learning: Backdoor-Adjusted Soft Actor-Critic
par: Vo, Thanh Vinh, et autres
Publié: (2025)
par: Vo, Thanh Vinh, et autres
Publié: (2025)
ISAACS: Iterative Soft Adversarial Actor-Critic for Safety
par: Hsu, Kai-Chieh, et autres
Publié: (2022)
par: Hsu, Kai-Chieh, et autres
Publié: (2022)
Balancing Plasticity and Stability with Fast and Slow Successor Features
par: Chua, Raymond, et autres
Publié: (2026)
par: Chua, Raymond, et autres
Publié: (2026)
D2 Actor Critic: Diffusion Actor Meets Distributional Critic
par: Zhang, Lunjun, et autres
Publié: (2025)
par: Zhang, Lunjun, et autres
Publié: (2025)
Actor-Critic or Critic-Actor? A Tale of Two Time Scales
par: Bhatnagar, Shalabh, et autres
Publié: (2022)
par: Bhatnagar, Shalabh, et autres
Publié: (2022)
Dissecting Discrete Soft Actor-Critic: Limitations and Principled Alternatives
par: Asad, Reza, et autres
Publié: (2025)
par: Asad, Reza, et autres
Publié: (2025)
Partial Models for Building Adaptive Model-Based Reinforcement Learning Agents
par: Alver, Safa, et autres
Publié: (2024)
par: Alver, Safa, et autres
Publié: (2024)
Documents similaires
-
Provable and Practical: Efficient Exploration in Reinforcement Learning via Langevin Monte Carlo
par: Ishfaq, Haque, et autres
Publié: (2023) -
Safe Langevin Soft Actor Critic
par: Keswani, Mahesh, et autres
Publié: (2026) -
Diversity-Enriched Option-Critic
par: Kamat, Anand, et autres
Publié: (2020) -
More Efficient Randomized Exploration for Reinforcement Learning via Approximate Sampling
par: Ishfaq, Haque, et autres
Publié: (2024) -
Code as Reward: Empowering Reinforcement Learning with VLMs
par: Venuto, David, et autres
Publié: (2024)