Integrating Human Knowledge Through Action Masking in Reinforcement Learning for Operations Research
Fuente:
arXiv
Salvato in:
| Autori principali: | Stappert, Mirko, Lutz, Bernhard, Goby, Niklas, Neumann, Dirk |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Solving the Paint Shop Problem with Flexible Management of Multi-Lane Buffers Using Reinforcement Learning and Action Masking
di: Stappert, Mirko, et al.
Pubblicazione: (2025)
di: Stappert, Mirko, et al.
Pubblicazione: (2025)
Operator World Models for Reinforcement Learning
di: Novelli, Pietro, et al.
Pubblicazione: (2024)
di: Novelli, Pietro, et al.
Pubblicazione: (2024)
Action Gaps and Advantages in Continuous-Time Distributional Reinforcement Learning
di: Wiltzer, Harley, et al.
Pubblicazione: (2024)
di: Wiltzer, Harley, et al.
Pubblicazione: (2024)
Operator Models for Continuous-Time Offline Reinforcement Learning
di: Hoischen, Nicolas, et al.
Pubblicazione: (2025)
di: Hoischen, Nicolas, et al.
Pubblicazione: (2025)
Deep Reinforcement Learning for Dynamic Order Picking in Warehouse Operations
di: Mahmoudinazlou, Sasan, et al.
Pubblicazione: (2024)
di: Mahmoudinazlou, Sasan, et al.
Pubblicazione: (2024)
Sample Efficient Reinforcement Learning with Partial Dynamics Knowledge
di: Alharbi, Meshal, et al.
Pubblicazione: (2023)
di: Alharbi, Meshal, et al.
Pubblicazione: (2023)
Fill-and-Spill: Deep Reinforcement Learning Policy Gradient Methods for Reservoir Operation Decision and Control
di: Tabas, Sadegh Sadeghi, et al.
Pubblicazione: (2024)
di: Tabas, Sadegh Sadeghi, et al.
Pubblicazione: (2024)
Action Dependency Graphs for Globally Optimal Coordinated Reinforcement Learning
di: Ding, Jianglin, et al.
Pubblicazione: (2025)
di: Ding, Jianglin, et al.
Pubblicazione: (2025)
Masked Subspace Clustering Methods
di: Song, Jiebo, et al.
Pubblicazione: (2025)
di: Song, Jiebo, et al.
Pubblicazione: (2025)
Resilient Constrained Reinforcement Learning
di: Ding, Dongsheng, et al.
Pubblicazione: (2023)
di: Ding, Dongsheng, et al.
Pubblicazione: (2023)
Score as Action: Fine-Tuning Diffusion Generative Models by Continuous-time Reinforcement Learning
di: Zhao, Hanyang, et al.
Pubblicazione: (2025)
di: Zhao, Hanyang, et al.
Pubblicazione: (2025)
Residuals-based Offline Reinforcement Learning
di: Zhu, Qing, et al.
Pubblicazione: (2026)
di: Zhu, Qing, et al.
Pubblicazione: (2026)
A Pontryagin Perspective on Reinforcement Learning
di: Eberhard, Onno, et al.
Pubblicazione: (2024)
di: Eberhard, Onno, et al.
Pubblicazione: (2024)
Foundations of Multivariate Distributional Reinforcement Learning
di: Wiltzer, Harley, et al.
Pubblicazione: (2024)
di: Wiltzer, Harley, et al.
Pubblicazione: (2024)
On the Foundation of Distributionally Robust Reinforcement Learning
di: Wang, Shengbo, et al.
Pubblicazione: (2023)
di: Wang, Shengbo, et al.
Pubblicazione: (2023)
Tail Distribution of Regret in Optimistic Reinforcement Learning
di: Khodadadian, Sajad, et al.
Pubblicazione: (2025)
di: Khodadadian, Sajad, et al.
Pubblicazione: (2025)
Structured Reinforcement Learning for Combinatorial Decision-Making
di: Hoppe, Heiko, et al.
Pubblicazione: (2025)
di: Hoppe, Heiko, et al.
Pubblicazione: (2025)
Reinforcement Learning and Regret Bounds for Admission Control
di: Weber, Lucas, et al.
Pubblicazione: (2024)
di: Weber, Lucas, et al.
Pubblicazione: (2024)
Reinforcement Learning applied to Insurance Portfolio Pursuit
di: Young, Edward James, et al.
Pubblicazione: (2024)
di: Young, Edward James, et al.
Pubblicazione: (2024)
Provable Mixed-Noise Learning with Flow-Matching
di: Hagemann, Paul, et al.
Pubblicazione: (2025)
di: Hagemann, Paul, et al.
Pubblicazione: (2025)
Offline Reinforcement Learning via Inverse Optimization
di: Dimanidis, Ioannis, et al.
Pubblicazione: (2025)
di: Dimanidis, Ioannis, et al.
Pubblicazione: (2025)
Extensions of Robbins-Siegmund Theorem with Applications in Reinforcement Learning
di: Liu, Xinyu, et al.
Pubblicazione: (2025)
di: Liu, Xinyu, et al.
Pubblicazione: (2025)
Structure-Informed Deep Reinforcement Learning for Inventory Management
di: Maggiar, Alvaro, et al.
Pubblicazione: (2025)
di: Maggiar, Alvaro, et al.
Pubblicazione: (2025)
Sample-Efficient Reinforcement Learning of Koopman eNMPC
di: Mayfrank, Daniel, et al.
Pubblicazione: (2025)
di: Mayfrank, Daniel, et al.
Pubblicazione: (2025)
Achieve Performatively Optimal Policy for Performative Reinforcement Learning
di: Chen, Ziyi, et al.
Pubblicazione: (2025)
di: Chen, Ziyi, et al.
Pubblicazione: (2025)
Automated Proof of Polynomial Inequalities via Reinforcement Learning
di: Liu, Banglong, et al.
Pubblicazione: (2025)
di: Liu, Banglong, et al.
Pubblicazione: (2025)
Deep Reinforcement Learning: A Convex Optimization Approach
di: Gattami, Ather
Pubblicazione: (2024)
di: Gattami, Ather
Pubblicazione: (2024)
Offline-Online Reinforcement Learning for Linear Mixture MDPs
di: Zhang, Zhongjun, et al.
Pubblicazione: (2026)
di: Zhang, Zhongjun, et al.
Pubblicazione: (2026)
Hybrid Reinforcement Learning Framework for Mixed-Variable Problems
di: Zhai, Haoyan, et al.
Pubblicazione: (2024)
di: Zhai, Haoyan, et al.
Pubblicazione: (2024)
Exploiting Exogenous Structure for Sample-Efficient Reinforcement Learning
di: Wan, Jia, et al.
Pubblicazione: (2024)
di: Wan, Jia, et al.
Pubblicazione: (2024)
Reinforcement Learning with Function Approximation for Non-Markov Processes
di: Kara, Ali Devran
Pubblicazione: (2026)
di: Kara, Ali Devran
Pubblicazione: (2026)
Joint MDPs and Reinforcement Learning in Coupled-Dynamics Environments
di: Kaya, Ege C., et al.
Pubblicazione: (2026)
di: Kaya, Ege C., et al.
Pubblicazione: (2026)
Reward-Relevance-Filtered Linear Offline Reinforcement Learning
di: Zhou, Angela
Pubblicazione: (2024)
di: Zhou, Angela
Pubblicazione: (2024)
Methodology for Interpretable Reinforcement Learning for Optimizing Mechanical Ventilation
di: Lee, Joo Seung, et al.
Pubblicazione: (2024)
di: Lee, Joo Seung, et al.
Pubblicazione: (2024)
Reinforcement Learning Paycheck Optimization for Multivariate Financial Goals
di: Alaluf, Melda, et al.
Pubblicazione: (2024)
di: Alaluf, Melda, et al.
Pubblicazione: (2024)
Accelerating Multi-Block Constrained Optimization Through Learning to Optimize
di: Liang, Ling, et al.
Pubblicazione: (2024)
di: Liang, Ling, et al.
Pubblicazione: (2024)
Quantum Learning and Estimation for Coordinated Operation between Distribution Networks and Energy Communities
di: Zhuang, Yingrui, et al.
Pubblicazione: (2025)
di: Zhuang, Yingrui, et al.
Pubblicazione: (2025)
Optimism as Risk-Seeking in Multi-Agent Reinforcement Learning
di: Zhang, Runyu, et al.
Pubblicazione: (2025)
di: Zhang, Runyu, et al.
Pubblicazione: (2025)
Convergence and stability of Q-learning in Hierarchical Reinforcement Learning
di: Manenti, Massimiliano, et al.
Pubblicazione: (2025)
di: Manenti, Massimiliano, et al.
Pubblicazione: (2025)
Offline Hierarchical Reinforcement Learning via Inverse Optimization
di: Schmidt, Carolin, et al.
Pubblicazione: (2024)
di: Schmidt, Carolin, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Solving the Paint Shop Problem with Flexible Management of Multi-Lane Buffers Using Reinforcement Learning and Action Masking
di: Stappert, Mirko, et al.
Pubblicazione: (2025) -
Operator World Models for Reinforcement Learning
di: Novelli, Pietro, et al.
Pubblicazione: (2024) -
Action Gaps and Advantages in Continuous-Time Distributional Reinforcement Learning
di: Wiltzer, Harley, et al.
Pubblicazione: (2024) -
Operator Models for Continuous-Time Offline Reinforcement Learning
di: Hoischen, Nicolas, et al.
Pubblicazione: (2025) -
Deep Reinforcement Learning for Dynamic Order Picking in Warehouse Operations
di: Mahmoudinazlou, Sasan, et al.
Pubblicazione: (2024)