BraVE: Offline Reinforcement Learning for Discrete Combinatorial Action Spaces
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Landers, Matthew, Killian, Taylor W., Barnes, Hugo, Hartvigsen, Thomas, Doryab, Afsaneh |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SAINT: Attention-Based Policies for Discrete Combinatorial Action Spaces
par: Landers, Matthew, et autres
Publié: (2025)
par: Landers, Matthew, et autres
Publié: (2025)
Improving and Accelerating Offline RL in Large Discrete Action Spaces with Structured Policy Initialization
par: Landers, Matthew, et autres
Publié: (2026)
par: Landers, Matthew, et autres
Publié: (2026)
Coordination Matters: Evaluation of Cooperative Multi-Agent Reinforcement Learning
par: Cardei, Maria Ana, et autres
Publié: (2026)
par: Cardei, Maria Ana, et autres
Publié: (2026)
Factorized Deep Q-Network for Cooperative Multi-Agent Reinforcement Learning in Victim Tagging
par: Cardei, Maria Ana, et autres
Publié: (2025)
par: Cardei, Maria Ana, et autres
Publié: (2025)
Flow Matching for Offline Reinforcement Learning with Discrete Actions
par: Khan, Fairoz Nower, et autres
Publié: (2026)
par: Khan, Fairoz Nower, et autres
Publié: (2026)
An Investigation of Offline Reinforcement Learning in Factorisable Action Spaces
par: Beeson, Alex, et autres
Publié: (2024)
par: Beeson, Alex, et autres
Publié: (2024)
Offline Reinforcement Learning with Discrete Diffusion Skills
par: Qiao, RuiXi, et autres
Publié: (2025)
par: Qiao, RuiXi, et autres
Publié: (2025)
Discrete Flow Matching for Offline-to-Online Reinforcement Learning
par: Khan, Fairoz Nower, et autres
Publié: (2026)
par: Khan, Fairoz Nower, et autres
Publié: (2026)
Latent Spherical Flow Policy for Reinforcement Learning with Combinatorial Actions
par: Kong, Lingkai, et autres
Publié: (2026)
par: Kong, Lingkai, et autres
Publié: (2026)
Offline Learning for Combinatorial Multi-armed Bandits
par: Liu, Xutong, et autres
Publié: (2025)
par: Liu, Xutong, et autres
Publié: (2025)
Offline Reinforcement Learning with Penalized Action Noise Injection
par: Oh, JunHyeok, et autres
Publié: (2025)
par: Oh, JunHyeok, et autres
Publié: (2025)
Discretizing Continuous Action Space with Unimodal Probability Distributions for On-Policy Reinforcement Learning
par: Zhu, Yuanyang, et autres
Publié: (2024)
par: Zhu, Yuanyang, et autres
Publié: (2024)
Breaking the Grid: Distance-Guided Reinforcement Learning in Large Discrete Action Spaces
par: Hoppe, Heiko, et autres
Publié: (2026)
par: Hoppe, Heiko, et autres
Publié: (2026)
Taming OOD Actions for Offline Reinforcement Learning: An Advantage-Based Approach
par: Chen, Xuyang, et autres
Publié: (2025)
par: Chen, Xuyang, et autres
Publié: (2025)
Constrained Discrete Diffusion
par: Cardei, Michael, et autres
Publié: (2025)
par: Cardei, Michael, et autres
Publié: (2025)
Preferred-Action-Optimized Diffusion Policies for Offline Reinforcement Learning
par: Zhang, Tianle, et autres
Publié: (2024)
par: Zhang, Tianle, et autres
Publié: (2024)
A Clean Slate for Offline Reinforcement Learning
par: Jackson, Matthew Thomas, et autres
Publié: (2025)
par: Jackson, Matthew Thomas, et autres
Publié: (2025)
Safe Deployment of Offline Reinforcement Learning via Input Convex Action Correction
par: Durkin, Alex, et autres
Publié: (2025)
par: Durkin, Alex, et autres
Publié: (2025)
SAMG: Offline-to-Online Reinforcement Learning via State-Action-Conditional Offline Model Guidance
par: Zhang, Liyu, et autres
Publié: (2024)
par: Zhang, Liyu, et autres
Publié: (2024)
Deep Reinforcement Learning in Parameterized Action Space
par: Hausknecht, Matthew, et autres
Publié: (2015)
par: Hausknecht, Matthew, et autres
Publié: (2015)
Federated Offline Reinforcement Learning
par: Zhou, Doudou, et autres
Publié: (2022)
par: Zhou, Doudou, et autres
Publié: (2022)
Goal-conditioned Offline Reinforcement Learning through State Space Partitioning
par: Wang, Mianchu, et autres
Publié: (2023)
par: Wang, Mianchu, et autres
Publié: (2023)
Offline Reinforcement Learning with OOD State Correction and OOD Action Suppression
par: Mao, Yixiu, et autres
Publié: (2024)
par: Mao, Yixiu, et autres
Publié: (2024)
Constrained Latent Action Policies for Model-Based Offline Reinforcement Learning
par: Alles, Marvin, et autres
Publié: (2024)
par: Alles, Marvin, et autres
Publié: (2024)
Two-Step Offline Preference-Based Reinforcement Learning with Constrained Actions
par: Xu, Yinglun, et autres
Publié: (2023)
par: Xu, Yinglun, et autres
Publié: (2023)
Penalizing Infeasible Actions and Reward Scaling in Reinforcement Learning with Offline Data
par: Kim, Jeonghye, et autres
Publié: (2025)
par: Kim, Jeonghye, et autres
Publié: (2025)
Robustness Evaluation of Offline Reinforcement Learning for Robot Control Against Action Perturbations
par: Ayabe, Shingo, et autres
Publié: (2024)
par: Ayabe, Shingo, et autres
Publié: (2024)
DAWM: Diffusion Action World Models for Offline Reinforcement Learning via Action-Inferred Transitions
par: Li, Zongyue, et autres
Publié: (2025)
par: Li, Zongyue, et autres
Publié: (2025)
Offline Reinforcement Learning in Large State Spaces: Algorithms and Guarantees
par: Jiang, Nan, et autres
Publié: (2025)
par: Jiang, Nan, et autres
Publié: (2025)
Guided Flow Policy: Learning from High-Value Actions in Offline Reinforcement Learning
par: Tiofack, Franki Nguimatsia, et autres
Publié: (2025)
par: Tiofack, Franki Nguimatsia, et autres
Publié: (2025)
Proximal Action Replacement for Behavior Cloning Actor-Critic in Offline Reinforcement Learning
par: Dong, Jinzong, et autres
Publié: (2026)
par: Dong, Jinzong, et autres
Publié: (2026)
Beyond Non-Expert Demonstrations: Outcome-Driven Action Constraint for Offline Reinforcement Learning
par: Jiang, Ke, et autres
Publié: (2025)
par: Jiang, Ke, et autres
Publié: (2025)
Offline Trajectory Optimization for Offline Reinforcement Learning
par: Zhao, Ziqi, et autres
Publié: (2024)
par: Zhao, Ziqi, et autres
Publié: (2024)
Active Advantage-Aligned Online Reinforcement Learning with Offline Data
par: Liu, Xuefeng, et autres
Publié: (2025)
par: Liu, Xuefeng, et autres
Publié: (2025)
Combinatorial Reinforcement Learning with Preference Feedback
par: Lee, Joongkyu, et autres
Publié: (2025)
par: Lee, Joongkyu, et autres
Publié: (2025)
Equivariant Offline Reinforcement Learning
par: Tangri, Arsh, et autres
Publié: (2024)
par: Tangri, Arsh, et autres
Publié: (2024)
Epistemic Robust Offline Reinforcement Learning
par: Chenreddy, Abhilash Reddy, et autres
Publié: (2026)
par: Chenreddy, Abhilash Reddy, et autres
Publié: (2026)
In-Context Reinforcement Learning for Variable Action Spaces
par: Sinii, Viacheslav, et autres
Publié: (2023)
par: Sinii, Viacheslav, et autres
Publié: (2023)
Offline Multitask Representation Learning for Reinforcement Learning
par: Ishfaq, Haque, et autres
Publié: (2024)
par: Ishfaq, Haque, et autres
Publié: (2024)
Robust Probabilistic Shielding for Safe Offline Reinforcement Learning
par: Galesloot, Maris F. L., et autres
Publié: (2026)
par: Galesloot, Maris F. L., et autres
Publié: (2026)
Documents similaires
-
SAINT: Attention-Based Policies for Discrete Combinatorial Action Spaces
par: Landers, Matthew, et autres
Publié: (2025) -
Improving and Accelerating Offline RL in Large Discrete Action Spaces with Structured Policy Initialization
par: Landers, Matthew, et autres
Publié: (2026) -
Coordination Matters: Evaluation of Cooperative Multi-Agent Reinforcement Learning
par: Cardei, Maria Ana, et autres
Publié: (2026) -
Factorized Deep Q-Network for Cooperative Multi-Agent Reinforcement Learning in Victim Tagging
par: Cardei, Maria Ana, et autres
Publié: (2025) -
Flow Matching for Offline Reinforcement Learning with Discrete Actions
par: Khan, Fairoz Nower, et autres
Publié: (2026)