Enregistré dans:
| Auteurs principaux: | Wu, Andy, Lin, Chun-Cheng, Liaw, Rung-Tzuo, Huang, Yuehua, Kuo, Chihjung, Weng, Chia Tong |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2510.01083 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Constant in an Ever-Changing World
par: Wu, Andy, et autres
Publié: (2025)
par: Wu, Andy, et autres
Publié: (2025)
Federated Natural Policy Gradient and Actor Critic Methods for Multi-task Reinforcement Learning
par: Yang, Tong, et autres
Publié: (2023)
par: Yang, Tong, et autres
Publié: (2023)
Adaptive Ensemble Aggregation for Actor-Critics
par: Werge, Nicklas, et autres
Publié: (2025)
par: Werge, Nicklas, et autres
Publié: (2025)
Actor-Critic Reinforcement Learning with Phased Actor
par: Wu, Ruofan, et autres
Publié: (2024)
par: Wu, Ruofan, et autres
Publié: (2024)
Efficient $Q$-Learning and Actor-Critic Methods for Robust Average Reward Reinforcement Learning
par: Xu, Yang, et autres
Publié: (2025)
par: Xu, Yang, et autres
Publié: (2025)
Cryptocurrency Portfolio Management with Reinforcement Learning: Soft Actor--Critic and Deep Deterministic Policy Gradient Algorithms
par: Paykan, Kamal
Publié: (2025)
par: Paykan, Kamal
Publié: (2025)
FORLER: Federated Offline Reinforcement Learning with Q-Ensemble and Actor Rectification
par: Qiao, Nan, et autres
Publié: (2026)
par: Qiao, Nan, et autres
Publié: (2026)
Natural Policy Gradient and Actor Critic Methods for Constrained Multi-Task Reinforcement Learning
par: Zeng, Sihan, et autres
Publié: (2024)
par: Zeng, Sihan, et autres
Publié: (2024)
Finite-Time Convergence and Sample Complexity of Actor-Critic Multi-Objective Reinforcement Learning
par: Zhou, Tianchen, et autres
Publié: (2024)
par: Zhou, Tianchen, et autres
Publié: (2024)
Finite-Time Global Optimality Convergence in Deep Neural Actor-Critic Methods for Decentralized Multi-Agent Reinforcement Learning
par: Zhang, Zhiyao, et autres
Publié: (2025)
par: Zhang, Zhiyao, et autres
Publié: (2025)
On-policy Actor-Critic Reinforcement Learning for Multi-UAV Exploration
par: Farid, Ali Moltajaei, et autres
Publié: (2024)
par: Farid, Ali Moltajaei, et autres
Publié: (2024)
${\rm E}(3)$-Equivariant Actor-Critic Methods for Cooperative Multi-Agent Reinforcement Learning
par: Chen, Dingyang, et autres
Publié: (2023)
par: Chen, Dingyang, et autres
Publié: (2023)
Surrogate Ensemble in Expensive Multi-Objective Optimization via Deep Q-Learning
par: Wu, Yuxin, et autres
Publié: (2026)
par: Wu, Yuxin, et autres
Publié: (2026)
Efficient Exploration in Deep Reinforcement Learning: A Novel Bayesian Actor-Critic Algorithm
par: Rozanov, Nikolai
Publié: (2024)
par: Rozanov, Nikolai
Publié: (2024)
Quasi-Newton Compatible Actor-Critic for Deterministic Policies
par: Kordabad, Arash Bahari, et autres
Publié: (2025)
par: Kordabad, Arash Bahari, et autres
Publié: (2025)
Generative Actor Critic
par: Qin, Aoyang, et autres
Publié: (2025)
par: Qin, Aoyang, et autres
Publié: (2025)
SALE-Based Offline Reinforcement Learning with Ensemble Q-Networks
par: Chun, Zheng
Publié: (2025)
par: Chun, Zheng
Publié: (2025)
Broad Critic Deep Actor Reinforcement Learning for Continuous Control
par: Thalagala, Shiron, et autres
Publié: (2024)
par: Thalagala, Shiron, et autres
Publié: (2024)
Decorrelated Soft Actor-Critic for Efficient Deep Reinforcement Learning
par: Küçükoğlu, Burcu, et autres
Publié: (2025)
par: Küçükoğlu, Burcu, et autres
Publié: (2025)
Relative Importance Sampling for off-Policy Actor-Critic in Deep Reinforcement Learning
par: Humayoo, Mahammad, et autres
Publié: (2018)
par: Humayoo, Mahammad, et autres
Publié: (2018)
A Single-Loop Deep Actor-Critic Algorithm for Constrained Reinforcement Learning with Provable Convergence
par: Wang, Kexuan, et autres
Publié: (2023)
par: Wang, Kexuan, et autres
Publié: (2023)
Alleviating Community Fear in Disasters via Multi-Agent Actor-Critic Reinforcement Learning
par: Hakke, Yashodhan D., et autres
Publié: (2026)
par: Hakke, Yashodhan D., et autres
Publié: (2026)
Multi-agent Off-policy Actor-Critic Reinforcement Learning for Partially Observable Environments
par: Zhaikhan, Ainur, et autres
Publié: (2024)
par: Zhaikhan, Ainur, et autres
Publié: (2024)
Adviser-Actor-Critic: Eliminating Steady-State Error in Reinforcement Learning Control
par: Chen, Donghe, et autres
Publié: (2025)
par: Chen, Donghe, et autres
Publié: (2025)
Deep Actor-Critics with Tight Risk Certificates
par: Tasdighi, Bahareh, et autres
Publié: (2025)
par: Tasdighi, Bahareh, et autres
Publié: (2025)
Graphon Mean-Field Subsampling for Cooperative Heterogeneous Multi-Agent Reinforcement Learning
par: Anand, Emile, et autres
Publié: (2026)
par: Anand, Emile, et autres
Publié: (2026)
A Multi-stage Error Diagnosis for APB Transaction
par: Tsai, Cheng-Yang, et autres
Publié: (2025)
par: Tsai, Cheng-Yang, et autres
Publié: (2025)
Disentangled Latent Spaces for Reduced Order Models using Deterministic Autoencoders
par: Schwarz, Henning, et autres
Publié: (2025)
par: Schwarz, Henning, et autres
Publié: (2025)
Multi-Agent Actor-Critics in Autonomous Cyber Defense
par: Wang, Mingjun, et autres
Publié: (2024)
par: Wang, Mingjun, et autres
Publié: (2024)
Scalable Neighborhood-Based Multi-Agent Actor-Critic
par: Goppelsroeder, Tim, et autres
Publié: (2026)
par: Goppelsroeder, Tim, et autres
Publié: (2026)
Asymmetric Actor-Critic for Multi-turn LLM Agents
par: Jiang, Shuli, et autres
Publié: (2026)
par: Jiang, Shuli, et autres
Publié: (2026)
MSSEAC: Multi‐State Soft Elastic Actor‐Critic
par: Yuwan Gu, et autres
Publié: (2026)
par: Yuwan Gu, et autres
Publié: (2026)
Revisiting Discrete Soft Actor-Critic
par: Zhou, Haibin, et autres
Publié: (2022)
par: Zhou, Haibin, et autres
Publié: (2022)
Association between ischemic stroke, hemorrhagic stroke, dementia, and rs201118034 among general Taiwanese population
par: Yi‐Chia Liaw, et autres
Publié: (2025)
par: Yi‐Chia Liaw, et autres
Publié: (2025)
Communicating longevity risk : more things to think about / Liaw Huang, Tom Terry
par: Huang, Liaw
par: Huang, Liaw
Exploration from a Primal-Dual Lens: Value-Incentivized Actor-Critic Methods for Sample-Efficient Online RL
par: Yang, Tong, et autres
Publié: (2025)
par: Yang, Tong, et autres
Publié: (2025)
Stabilizing the Q-Gradient Field for Policy Smoothness in Actor-Critic
par: Lee, Jeong Woon, et autres
Publié: (2026)
par: Lee, Jeong Woon, et autres
Publié: (2026)
Letter to the Editor Regarding Determinants of HBeAg Loss During Follow‐Up of a Multiethnic Pediatric Cohort
par: Chia‐Ming Chu, et autres
Publié: (2024)
par: Chia‐Ming Chu, et autres
Publié: (2024)
Quantum Advantage Actor-Critic for Reinforcement Learning
par: Kölle, Michael, et autres
Publié: (2024)
par: Kölle, Michael, et autres
Publié: (2024)
Flow Actor-Critic for Offline Reinforcement Learning
par: Chae, Jongseong, et autres
Publié: (2026)
par: Chae, Jongseong, et autres
Publié: (2026)
Documents similaires
-
Constant in an Ever-Changing World
par: Wu, Andy, et autres
Publié: (2025) -
Federated Natural Policy Gradient and Actor Critic Methods for Multi-task Reinforcement Learning
par: Yang, Tong, et autres
Publié: (2023) -
Adaptive Ensemble Aggregation for Actor-Critics
par: Werge, Nicklas, et autres
Publié: (2025) -
Actor-Critic Reinforcement Learning with Phased Actor
par: Wu, Ruofan, et autres
Publié: (2024) -
Efficient $Q$-Learning and Actor-Critic Methods for Robust Average Reward Reinforcement Learning
par: Xu, Yang, et autres
Publié: (2025)