Flow Actor-Critic for Offline Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Chae, Jongseong, Park, Jongeui, Shin, Yongjae, Kim, Gyeongmin, Han, Seungyul, Sung, Youngchul |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Flow Matching with Injected Noise for Offline-to-Online Reinforcement Learning
di: Shin, Yongjae, et al.
Pubblicazione: (2026)
di: Shin, Yongjae, et al.
Pubblicazione: (2026)
Adaptive Action Chunking via Multi-Chunk Q Value Estimation
di: Shin, Yongjae, et al.
Pubblicazione: (2026)
di: Shin, Yongjae, et al.
Pubblicazione: (2026)
Multi-Objective Reinforcement Learning with Max-Min Criterion: A Game-Theoretic Approach
di: Byeon, Woohyeon, et al.
Pubblicazione: (2025)
di: Byeon, Woohyeon, et al.
Pubblicazione: (2025)
Penalizing Infeasible Actions and Reward Scaling in Reinforcement Learning with Offline Data
di: Kim, Jeonghye, et al.
Pubblicazione: (2025)
di: Kim, Jeonghye, et al.
Pubblicazione: (2025)
Bridging Domain Gaps with Target-Aligned Generation for Offline Reinforcement Learning
di: Kim, Minung, et al.
Pubblicazione: (2026)
di: Kim, Minung, et al.
Pubblicazione: (2026)
Online Pre-Training for Offline-to-Online Reinforcement Learning
di: Shin, Yongjae, et al.
Pubblicazione: (2025)
di: Shin, Yongjae, et al.
Pubblicazione: (2025)
Exclusively Penalized Q-learning for Offline Reinforcement Learning
di: Yeom, Junghyuk, et al.
Pubblicazione: (2024)
di: Yeom, Junghyuk, et al.
Pubblicazione: (2024)
Task-Aware Virtual Training: Enhancing Generalization in Meta-Reinforcement Learning for Out-of-Distribution Tasks
di: Kim, Jeongmo, et al.
Pubblicazione: (2025)
di: Kim, Jeongmo, et al.
Pubblicazione: (2025)
Offline Actor-Critic Reinforcement Learning Scales to Large Models
di: Springenberg, Jost Tobias, et al.
Pubblicazione: (2024)
di: Springenberg, Jost Tobias, et al.
Pubblicazione: (2024)
Proximal Action Replacement for Behavior Cloning Actor-Critic in Offline Reinforcement Learning
di: Dong, Jinzong, et al.
Pubblicazione: (2026)
di: Dong, Jinzong, et al.
Pubblicazione: (2026)
Strict Subgoal Execution: Reliable Long-Horizon Planning in Hierarchical Reinforcement Learning
di: Hwang, Jaebak, et al.
Pubblicazione: (2025)
di: Hwang, Jaebak, et al.
Pubblicazione: (2025)
The Max-Min Formulation of Multi-Objective Reinforcement Learning: From Theory to a Model-Free Algorithm
di: Park, Giseung, et al.
Pubblicazione: (2024)
di: Park, Giseung, et al.
Pubblicazione: (2024)
LLM-Guided Communication for Cooperative Multi-Agent Reinforcement Learning
di: Bae, Sangjun, et al.
Pubblicazione: (2026)
di: Bae, Sangjun, et al.
Pubblicazione: (2026)
FORLER: Federated Offline Reinforcement Learning with Q-Ensemble and Actor Rectification
di: Qiao, Nan, et al.
Pubblicazione: (2026)
di: Qiao, Nan, et al.
Pubblicazione: (2026)
Interaction-Breaking Adversarial Learning Framework for Robust Multi-Agent Reinforcement Learning
di: Lee, Sunwoo, et al.
Pubblicazione: (2026)
di: Lee, Sunwoo, et al.
Pubblicazione: (2026)
Adaptive $Q$-Aid for Conditional Supervised Learning in Offline Reinforcement Learning
di: Kim, Jeonghye, et al.
Pubblicazione: (2024)
di: Kim, Jeonghye, et al.
Pubblicazione: (2024)
Adviser-Actor-Critic: Eliminating Steady-State Error in Reinforcement Learning Control
di: Chen, Donghe, et al.
Pubblicazione: (2025)
di: Chen, Donghe, et al.
Pubblicazione: (2025)
SMAC: Score-Matched Actor-Critics for Robust Offline-to-Online Transfer
di: de Lara, Nathan Samuel, et al.
Pubblicazione: (2026)
di: de Lara, Nathan Samuel, et al.
Pubblicazione: (2026)
Graph-Assisted Stitching for Offline Hierarchical Reinforcement Learning
di: Baek, Seungho, et al.
Pubblicazione: (2025)
di: Baek, Seungho, et al.
Pubblicazione: (2025)
Broad Critic Deep Actor Reinforcement Learning for Continuous Control
di: Thalagala, Shiron, et al.
Pubblicazione: (2024)
di: Thalagala, Shiron, et al.
Pubblicazione: (2024)
Studying the Interplay Between the Actor and Critic Representations in Reinforcement Learning
di: Garcin, Samuel, et al.
Pubblicazione: (2025)
di: Garcin, Samuel, et al.
Pubblicazione: (2025)
Decorrelated Soft Actor-Critic for Efficient Deep Reinforcement Learning
di: Küçükoğlu, Burcu, et al.
Pubblicazione: (2025)
di: Küçükoğlu, Burcu, et al.
Pubblicazione: (2025)
Quantum Advantage Actor-Critic for Reinforcement Learning
di: Kölle, Michael, et al.
Pubblicazione: (2024)
di: Kölle, Michael, et al.
Pubblicazione: (2024)
Wolfpack Adversarial Attack for Robust Multi-Agent Reinforcement Learning
di: Lee, Sunwoo, et al.
Pubblicazione: (2025)
di: Lee, Sunwoo, et al.
Pubblicazione: (2025)
The Role of Deep Learning Regularizations on Actors in Offline RL
di: Tarasov, Denis, et al.
Pubblicazione: (2024)
di: Tarasov, Denis, et al.
Pubblicazione: (2024)
DSAC: Distributional Soft Actor-Critic for Risk-Sensitive Reinforcement Learning
di: Ma, Xiaoteng, et al.
Pubblicazione: (2020)
di: Ma, Xiaoteng, et al.
Pubblicazione: (2020)
Double Actor-Critic with TD Error-Driven Regularization in Reinforcement Learning
di: Chen, Haohui, et al.
Pubblicazione: (2024)
di: Chen, Haohui, et al.
Pubblicazione: (2024)
Causal Policy Learning in Reinforcement Learning: Backdoor-Adjusted Soft Actor-Critic
di: Vo, Thanh Vinh, et al.
Pubblicazione: (2025)
di: Vo, Thanh Vinh, et al.
Pubblicazione: (2025)
Discrete Flow Matching for Offline-to-Online Reinforcement Learning
di: Khan, Fairoz Nower, et al.
Pubblicazione: (2026)
di: Khan, Fairoz Nower, et al.
Pubblicazione: (2026)
Reward Dimension Reduction for Scalable Multi-Objective Reinforcement Learning
di: Park, Giseung, et al.
Pubblicazione: (2025)
di: Park, Giseung, et al.
Pubblicazione: (2025)
Efficient $Q$-Learning and Actor-Critic Methods for Robust Average Reward Reinforcement Learning
di: Xu, Yang, et al.
Pubblicazione: (2025)
di: Xu, Yang, et al.
Pubblicazione: (2025)
Monte Carlo Beam Search for Actor-Critic Reinforcement Learning in Continuous Control
di: Alzorgan, Hazim, et al.
Pubblicazione: (2025)
di: Alzorgan, Hazim, et al.
Pubblicazione: (2025)
Relative Importance Sampling for off-Policy Actor-Critic in Deep Reinforcement Learning
di: Humayoo, Mahammad, et al.
Pubblicazione: (2018)
di: Humayoo, Mahammad, et al.
Pubblicazione: (2018)
Model-based Offline Reinforcement Learning with Lower Expectile Q-Learning
di: Park, Kwanyoung, et al.
Pubblicazione: (2024)
di: Park, Kwanyoung, et al.
Pubblicazione: (2024)
Adaptive Replay Buffer for Offline-to-Online Reinforcement Learning
di: Song, Chihyeon, et al.
Pubblicazione: (2025)
di: Song, Chihyeon, et al.
Pubblicazione: (2025)
Treatment Stitching with Schrödinger Bridge for Enhancing Offline Reinforcement Learning in Adaptive Treatment Strategies
di: Shin, Dong-Hee, et al.
Pubblicazione: (2025)
di: Shin, Dong-Hee, et al.
Pubblicazione: (2025)
Lyapunov-Guided Self-Alignment: Test-Time Adaptation for Offline Safe Reinforcement Learning
di: Han, Seungyub, et al.
Pubblicazione: (2026)
di: Han, Seungyub, et al.
Pubblicazione: (2026)
Pretraining a Shared Q-Network for Data-Efficient Offline Reinforcement Learning
di: Park, Jongchan, et al.
Pubblicazione: (2025)
di: Park, Jongchan, et al.
Pubblicazione: (2025)
Federated Natural Policy Gradient and Actor Critic Methods for Multi-task Reinforcement Learning
di: Yang, Tong, et al.
Pubblicazione: (2023)
di: Yang, Tong, et al.
Pubblicazione: (2023)
Human-Readable Programs as Actors of Reinforcement Learning Agents Using Critic-Moderated Evolution
di: Deproost, Senne, et al.
Pubblicazione: (2024)
di: Deproost, Senne, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Flow Matching with Injected Noise for Offline-to-Online Reinforcement Learning
di: Shin, Yongjae, et al.
Pubblicazione: (2026) -
Adaptive Action Chunking via Multi-Chunk Q Value Estimation
di: Shin, Yongjae, et al.
Pubblicazione: (2026) -
Multi-Objective Reinforcement Learning with Max-Min Criterion: A Game-Theoretic Approach
di: Byeon, Woohyeon, et al.
Pubblicazione: (2025) -
Penalizing Infeasible Actions and Reward Scaling in Reinforcement Learning with Offline Data
di: Kim, Jeonghye, et al.
Pubblicazione: (2025) -
Bridging Domain Gaps with Target-Aligned Generation for Offline Reinforcement Learning
di: Kim, Minung, et al.
Pubblicazione: (2026)