Comparative Analysis of Parameterized Action Actor-Critic Reinforcement Learning Algorithms for Web Search Match Plan Generation
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Bapoo, Ubayd, Nyirenda, Clement N |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Proximal Action Replacement for Behavior Cloning Actor-Critic in Offline Reinforcement Learning
von: Dong, Jinzong, et al.
Veröffentlicht: (2026)
von: Dong, Jinzong, et al.
Veröffentlicht: (2026)
Monte Carlo Beam Search for Actor-Critic Reinforcement Learning in Continuous Control
von: Alzorgan, Hazim, et al.
Veröffentlicht: (2025)
von: Alzorgan, Hazim, et al.
Veröffentlicht: (2025)
Flow Actor-Critic for Offline Reinforcement Learning
von: Chae, Jongseong, et al.
Veröffentlicht: (2026)
von: Chae, Jongseong, et al.
Veröffentlicht: (2026)
Context-Sensitive Abstractions for Reinforcement Learning with Parameterized Actions
von: Nayyar, Rashmeet Kaur, et al.
Veröffentlicht: (2025)
von: Nayyar, Rashmeet Kaur, et al.
Veröffentlicht: (2025)
Model-based Reinforcement Learning for Parameterized Action Spaces
von: Zhang, Renhao, et al.
Veröffentlicht: (2024)
von: Zhang, Renhao, et al.
Veröffentlicht: (2024)
Value Improved Actor Critic Algorithms
von: Oren, Yaniv, et al.
Veröffentlicht: (2024)
von: Oren, Yaniv, et al.
Veröffentlicht: (2024)
Studying the Interplay Between the Actor and Critic Representations in Reinforcement Learning
von: Garcin, Samuel, et al.
Veröffentlicht: (2025)
von: Garcin, Samuel, et al.
Veröffentlicht: (2025)
Decorrelated Soft Actor-Critic for Efficient Deep Reinforcement Learning
von: Küçükoğlu, Burcu, et al.
Veröffentlicht: (2025)
von: Küçükoğlu, Burcu, et al.
Veröffentlicht: (2025)
Broad Critic Deep Actor Reinforcement Learning for Continuous Control
von: Thalagala, Shiron, et al.
Veröffentlicht: (2024)
von: Thalagala, Shiron, et al.
Veröffentlicht: (2024)
Quantum Advantage Actor-Critic for Reinforcement Learning
von: Kölle, Michael, et al.
Veröffentlicht: (2024)
von: Kölle, Michael, et al.
Veröffentlicht: (2024)
Limits of Actor-Critic Algorithms for Decision Tree Policies Learning in IBMDPs
von: Kohler, Hector, et al.
Veröffentlicht: (2023)
von: Kohler, Hector, et al.
Veröffentlicht: (2023)
DSAC: Distributional Soft Actor-Critic for Risk-Sensitive Reinforcement Learning
von: Ma, Xiaoteng, et al.
Veröffentlicht: (2020)
von: Ma, Xiaoteng, et al.
Veröffentlicht: (2020)
Double Actor-Critic with TD Error-Driven Regularization in Reinforcement Learning
von: Chen, Haohui, et al.
Veröffentlicht: (2024)
von: Chen, Haohui, et al.
Veröffentlicht: (2024)
Causal Policy Learning in Reinforcement Learning: Backdoor-Adjusted Soft Actor-Critic
von: Vo, Thanh Vinh, et al.
Veröffentlicht: (2025)
von: Vo, Thanh Vinh, et al.
Veröffentlicht: (2025)
Offline Actor-Critic Reinforcement Learning Scales to Large Models
von: Springenberg, Jost Tobias, et al.
Veröffentlicht: (2024)
von: Springenberg, Jost Tobias, et al.
Veröffentlicht: (2024)
Efficient $Q$-Learning and Actor-Critic Methods for Robust Average Reward Reinforcement Learning
von: Xu, Yang, et al.
Veröffentlicht: (2025)
von: Xu, Yang, et al.
Veröffentlicht: (2025)
Adviser-Actor-Critic: Eliminating Steady-State Error in Reinforcement Learning Control
von: Chen, Donghe, et al.
Veröffentlicht: (2025)
von: Chen, Donghe, et al.
Veröffentlicht: (2025)
Relative Importance Sampling for off-Policy Actor-Critic in Deep Reinforcement Learning
von: Humayoo, Mahammad, et al.
Veröffentlicht: (2018)
von: Humayoo, Mahammad, et al.
Veröffentlicht: (2018)
SMAC: Score-Matched Actor-Critics for Robust Offline-to-Online Transfer
von: de Lara, Nathan Samuel, et al.
Veröffentlicht: (2026)
von: de Lara, Nathan Samuel, et al.
Veröffentlicht: (2026)
Finite Time Analysis of Constrained Natural Critic-Actor Algorithm with Improved Sample Complexity
von: Panda, Prashansa, et al.
Veröffentlicht: (2025)
von: Panda, Prashansa, et al.
Veröffentlicht: (2025)
Sample-Efficient Constrained Reinforcement Learning with General Parameterization
von: Mondal, Washim Uddin, et al.
Veröffentlicht: (2024)
von: Mondal, Washim Uddin, et al.
Veröffentlicht: (2024)
Contraction Actor-Critic: Contraction Metric-Guided Reinforcement Learning for Robust Path Tracking
von: Cho, Minjae, et al.
Veröffentlicht: (2025)
von: Cho, Minjae, et al.
Veröffentlicht: (2025)
Federated Natural Policy Gradient and Actor Critic Methods for Multi-task Reinforcement Learning
von: Yang, Tong, et al.
Veröffentlicht: (2023)
von: Yang, Tong, et al.
Veröffentlicht: (2023)
Human-Readable Programs as Actors of Reinforcement Learning Agents Using Critic-Moderated Evolution
von: Deproost, Senne, et al.
Veröffentlicht: (2024)
von: Deproost, Senne, et al.
Veröffentlicht: (2024)
Visualizing Critic Match Loss Landscapes for Interpretation of Online Reinforcement Learning Control Algorithms
von: Liu, Jingyi, et al.
Veröffentlicht: (2026)
von: Liu, Jingyi, et al.
Veröffentlicht: (2026)
Bidirectional Soft Actor-Critic: Leveraging Forward and Reverse KL Divergence for Efficient Reinforcement Learning
von: Zhang, Yixian, et al.
Veröffentlicht: (2025)
von: Zhang, Yixian, et al.
Veröffentlicht: (2025)
A Finite-Sample Analysis of an Actor-Critic Algorithm for Mean-Variance Optimization in a Discounted MDP
von: Sangadi, Tejaram, et al.
Veröffentlicht: (2024)
von: Sangadi, Tejaram, et al.
Veröffentlicht: (2024)
Re-ENACT: Reinforcement Learning for Emotional Speech Generation using Actor-Critic Strategy
von: Shankar, Ravi, et al.
Veröffentlicht: (2024)
von: Shankar, Ravi, et al.
Veröffentlicht: (2024)
Deep Reinforcement Learning in Parameterized Action Space
von: Hausknecht, Matthew, et al.
Veröffentlicht: (2015)
von: Hausknecht, Matthew, et al.
Veröffentlicht: (2015)
Reinforcement Learning Position Control of a Quadrotor Using Soft Actor-Critic (SAC)
von: Mahran, Youssef, et al.
Veröffentlicht: (2025)
von: Mahran, Youssef, et al.
Veröffentlicht: (2025)
Finite-time Convergence Analysis of Actor-Critic with Evolving Reward
von: Hu, Rui, et al.
Veröffentlicht: (2025)
von: Hu, Rui, et al.
Veröffentlicht: (2025)
Equivariant Action Sampling for Reinforcement Learning and Planning
von: Zhao, Linfeng, et al.
Veröffentlicht: (2024)
von: Zhao, Linfeng, et al.
Veröffentlicht: (2024)
Rethinking Soft Actor-Critic in High-Dimensional Action Spaces: The Cost of Ignoring Distribution Shift
von: Chen, Yanjun, et al.
Veröffentlicht: (2024)
von: Chen, Yanjun, et al.
Veröffentlicht: (2024)
SAC-GLAM: Improving Online RL for LLM agents with Soft Actor-Critic and Hindsight Relabeling
von: Gaven, Loris, et al.
Veröffentlicht: (2024)
von: Gaven, Loris, et al.
Veröffentlicht: (2024)
FlowCritic: Bridging Value Estimation with Flow Matching in Reinforcement Learning
von: Zhong, Shan, et al.
Veröffentlicht: (2025)
von: Zhong, Shan, et al.
Veröffentlicht: (2025)
Global Convergence for Average Reward Constrained MDPs with Primal-Dual Actor Critic Algorithm
von: Xu, Yang, et al.
Veröffentlicht: (2025)
von: Xu, Yang, et al.
Veröffentlicht: (2025)
DR-SAC: Distributionally Robust Soft Actor-Critic for Reinforcement Learning under Uncertainty
von: Cui, Mingxuan, et al.
Veröffentlicht: (2025)
von: Cui, Mingxuan, et al.
Veröffentlicht: (2025)
Average-Reward Soft Actor-Critic
von: Adamczyk, Jacob, et al.
Veröffentlicht: (2025)
von: Adamczyk, Jacob, et al.
Veröffentlicht: (2025)
Diffusion Actor-Critic with Entropy Regulator
von: Wang, Yinuo, et al.
Veröffentlicht: (2024)
von: Wang, Yinuo, et al.
Veröffentlicht: (2024)
Revisiting Discrete Soft Actor-Critic
von: Zhou, Haibin, et al.
Veröffentlicht: (2022)
von: Zhou, Haibin, et al.
Veröffentlicht: (2022)
Ähnliche Einträge
-
Proximal Action Replacement for Behavior Cloning Actor-Critic in Offline Reinforcement Learning
von: Dong, Jinzong, et al.
Veröffentlicht: (2026) -
Monte Carlo Beam Search for Actor-Critic Reinforcement Learning in Continuous Control
von: Alzorgan, Hazim, et al.
Veröffentlicht: (2025) -
Flow Actor-Critic for Offline Reinforcement Learning
von: Chae, Jongseong, et al.
Veröffentlicht: (2026) -
Context-Sensitive Abstractions for Reinforcement Learning with Parameterized Actions
von: Nayyar, Rashmeet Kaur, et al.
Veröffentlicht: (2025) -
Model-based Reinforcement Learning for Parameterized Action Spaces
von: Zhang, Renhao, et al.
Veröffentlicht: (2024)