SMAC: Score-Matched Actor-Critics for Robust Offline-to-Online Transfer
Fuente:
arXiv
Salvato in:
| Autori principali: | de Lara, Nathan Samuel, Shkurti, Florian |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Exploring and Addressing Reward Confusion in Offline Preference Learning
di: Chen, Xin, et al.
Pubblicazione: (2024)
di: Chen, Xin, et al.
Pubblicazione: (2024)
Flow Actor-Critic for Offline Reinforcement Learning
di: Chae, Jongseong, et al.
Pubblicazione: (2026)
di: Chae, Jongseong, et al.
Pubblicazione: (2026)
Offline Actor-Critic Reinforcement Learning Scales to Large Models
di: Springenberg, Jost Tobias, et al.
Pubblicazione: (2024)
di: Springenberg, Jost Tobias, et al.
Pubblicazione: (2024)
Proximal Action Replacement for Behavior Cloning Actor-Critic in Offline Reinforcement Learning
di: Dong, Jinzong, et al.
Pubblicazione: (2026)
di: Dong, Jinzong, et al.
Pubblicazione: (2026)
Generalization in VAE and Diffusion Models: A Unified Information-Theoretic Analysis
di: Chen, Qi, et al.
Pubblicazione: (2025)
di: Chen, Qi, et al.
Pubblicazione: (2025)
Discrete Flow Matching for Offline-to-Online Reinforcement Learning
di: Khan, Fairoz Nower, et al.
Pubblicazione: (2026)
di: Khan, Fairoz Nower, et al.
Pubblicazione: (2026)
Flow Matching with Injected Noise for Offline-to-Online Reinforcement Learning
di: Shin, Yongjae, et al.
Pubblicazione: (2026)
di: Shin, Yongjae, et al.
Pubblicazione: (2026)
Offline-Boosted Actor-Critic: Adaptively Blending Optimal Historical Behaviors in Deep Off-Policy RL
di: Luo, Yu, et al.
Pubblicazione: (2024)
di: Luo, Yu, et al.
Pubblicazione: (2024)
Revisiting Mixture Policies in Entropy-Regularized Actor-Critic
di: He, Jiamin, et al.
Pubblicazione: (2026)
di: He, Jiamin, et al.
Pubblicazione: (2026)
Studying the Interplay Between the Actor and Critic Representations in Reinforcement Learning
di: Garcin, Samuel, et al.
Pubblicazione: (2025)
di: Garcin, Samuel, et al.
Pubblicazione: (2025)
The Role of Deep Learning Regularizations on Actors in Offline RL
di: Tarasov, Denis, et al.
Pubblicazione: (2024)
di: Tarasov, Denis, et al.
Pubblicazione: (2024)
Actor-Critic based Online Data Mixing For Language Model Pre-Training
di: Ma, Jing, et al.
Pubblicazione: (2025)
di: Ma, Jing, et al.
Pubblicazione: (2025)
Simplicial Embeddings Improve Sample Efficiency in Actor-Critic Agents
di: Obando-Ceron, Johan, et al.
Pubblicazione: (2025)
di: Obando-Ceron, Johan, et al.
Pubblicazione: (2025)
Continual Model-Based Reinforcement Learning with Hypernetworks
di: Huang, Yizhou, et al.
Pubblicazione: (2020)
di: Huang, Yizhou, et al.
Pubblicazione: (2020)
SAC-GLAM: Improving Online RL for LLM agents with Soft Actor-Critic and Hindsight Relabeling
di: Gaven, Loris, et al.
Pubblicazione: (2024)
di: Gaven, Loris, et al.
Pubblicazione: (2024)
FORLER: Federated Offline Reinforcement Learning with Q-Ensemble and Actor Rectification
di: Qiao, Nan, et al.
Pubblicazione: (2026)
di: Qiao, Nan, et al.
Pubblicazione: (2026)
Efficient $Q$-Learning and Actor-Critic Methods for Robust Average Reward Reinforcement Learning
di: Xu, Yang, et al.
Pubblicazione: (2025)
di: Xu, Yang, et al.
Pubblicazione: (2025)
Contraction Actor-Critic: Contraction Metric-Guided Reinforcement Learning for Robust Path Tracking
di: Cho, Minjae, et al.
Pubblicazione: (2025)
di: Cho, Minjae, et al.
Pubblicazione: (2025)
Value Improved Actor Critic Algorithms
di: Oren, Yaniv, et al.
Pubblicazione: (2024)
di: Oren, Yaniv, et al.
Pubblicazione: (2024)
Diffusion Actor-Critic with Entropy Regulator
di: Wang, Yinuo, et al.
Pubblicazione: (2024)
di: Wang, Yinuo, et al.
Pubblicazione: (2024)
Revisiting Discrete Soft Actor-Critic
di: Zhou, Haibin, et al.
Pubblicazione: (2022)
di: Zhou, Haibin, et al.
Pubblicazione: (2022)
Average-Reward Soft Actor-Critic
di: Adamczyk, Jacob, et al.
Pubblicazione: (2025)
di: Adamczyk, Jacob, et al.
Pubblicazione: (2025)
Comparative Analysis of Parameterized Action Actor-Critic Reinforcement Learning Algorithms for Web Search Match Plan Generation
di: Bapoo, Ubayd, et al.
Pubblicazione: (2025)
di: Bapoo, Ubayd, et al.
Pubblicazione: (2025)
Robust Policy Expansion for Offline-to-Online RL under Diverse Data Corruption
di: He, Longxiang, et al.
Pubblicazione: (2025)
di: He, Longxiang, et al.
Pubblicazione: (2025)
Distributional Soft Actor-Critic with Diffusion Policy
di: Liu, Tong, et al.
Pubblicazione: (2025)
di: Liu, Tong, et al.
Pubblicazione: (2025)
Relational Object-Centric Actor-Critic
di: Ugadiarov, Leonid, et al.
Pubblicazione: (2023)
di: Ugadiarov, Leonid, et al.
Pubblicazione: (2023)
Scalable Neighborhood-Based Multi-Agent Actor-Critic
di: Goppelsroeder, Tim, et al.
Pubblicazione: (2026)
di: Goppelsroeder, Tim, et al.
Pubblicazione: (2026)
SACn: Soft Actor-Critic with n-step Returns
di: Łyskawa, Jakub, et al.
Pubblicazione: (2025)
di: Łyskawa, Jakub, et al.
Pubblicazione: (2025)
Actor-Critics Can Achieve Optimal Sample Efficiency
di: Tan, Kevin, et al.
Pubblicazione: (2025)
di: Tan, Kevin, et al.
Pubblicazione: (2025)
Informing Acquisition Functions via Foundation Models for Molecular Discovery
di: Chen, Qi, et al.
Pubblicazione: (2025)
di: Chen, Qi, et al.
Pubblicazione: (2025)
Functional Critics Are Essential for Actor-Critic: From Off-Policy Stability to Efficient Exploration
di: Bai, Qinxun, et al.
Pubblicazione: (2025)
di: Bai, Qinxun, et al.
Pubblicazione: (2025)
Stabilizing the Q-Gradient Field for Policy Smoothness in Actor-Critic
di: Lee, Jeong Woon, et al.
Pubblicazione: (2026)
di: Lee, Jeong Woon, et al.
Pubblicazione: (2026)
Dissecting Discrete Soft Actor-Critic: Limitations and Principled Alternatives
di: Asad, Reza, et al.
Pubblicazione: (2025)
di: Asad, Reza, et al.
Pubblicazione: (2025)
Finite-time Convergence Analysis of Actor-Critic with Evolving Reward
di: Hu, Rui, et al.
Pubblicazione: (2025)
di: Hu, Rui, et al.
Pubblicazione: (2025)
Broad Critic Deep Actor Reinforcement Learning for Continuous Control
di: Thalagala, Shiron, et al.
Pubblicazione: (2024)
di: Thalagala, Shiron, et al.
Pubblicazione: (2024)
Ask-AC: An Initiative Advisor-in-the-Loop Actor-Critic Framework
di: Liu, Shunyu, et al.
Pubblicazione: (2022)
di: Liu, Shunyu, et al.
Pubblicazione: (2022)
Decorrelated Soft Actor-Critic for Efficient Deep Reinforcement Learning
di: Küçükoğlu, Burcu, et al.
Pubblicazione: (2025)
di: Küçükoğlu, Burcu, et al.
Pubblicazione: (2025)
Heavy-Ball Momentum Accelerated Actor-Critic With Function Approximation
di: Dong, Yanjie, et al.
Pubblicazione: (2024)
di: Dong, Yanjie, et al.
Pubblicazione: (2024)
Entropy-Regularized Adjoint Matching for Offline Reinforcement Learning
di: Ghanem, Abdelghani, et al.
Pubblicazione: (2026)
di: Ghanem, Abdelghani, et al.
Pubblicazione: (2026)
Novel Actor-Critic Algorithm for Robust Decision Making of CAV under Delays and Loss of V2X Data
di: Kherroubi, Zine el abidine
Pubblicazione: (2024)
di: Kherroubi, Zine el abidine
Pubblicazione: (2024)
Documenti analoghi
-
Exploring and Addressing Reward Confusion in Offline Preference Learning
di: Chen, Xin, et al.
Pubblicazione: (2024) -
Flow Actor-Critic for Offline Reinforcement Learning
di: Chae, Jongseong, et al.
Pubblicazione: (2026) -
Offline Actor-Critic Reinforcement Learning Scales to Large Models
di: Springenberg, Jost Tobias, et al.
Pubblicazione: (2024) -
Proximal Action Replacement for Behavior Cloning Actor-Critic in Offline Reinforcement Learning
di: Dong, Jinzong, et al.
Pubblicazione: (2026) -
Generalization in VAE and Diffusion Models: A Unified Information-Theoretic Analysis
di: Chen, Qi, et al.
Pubblicazione: (2025)