A Rollout-Based Algorithm and Reward Function for Resource Allocation in Business Processes
Fuente:
arXiv
Salvato in:
| Autori principali: | Middelhuis, Jeroen, Bukhsh, Zaharah, Adan, Ivo, Dijkman, Remco |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Automated decision-making for dynamic task assignment at scale
di: Bianco, Riccardo Lo, et al.
Pubblicazione: (2025)
di: Bianco, Riccardo Lo, et al.
Pubblicazione: (2025)
Unsupervised anomaly detection algorithms on real-world data: how many do we need?
di: Bouman, Roel, et al.
Pubblicazione: (2023)
di: Bouman, Roel, et al.
Pubblicazione: (2023)
Generalizing Beyond Suboptimality: Offline Reinforcement Learning Learns Effective Scheduling through Random Data
di: van Remmerden, Jesse, et al.
Pubblicazione: (2025)
di: van Remmerden, Jesse, et al.
Pubblicazione: (2025)
Offline Reinforcement Learning for Learning to Dispatch for Job Shop Scheduling
di: van Remmerden, Jesse, et al.
Pubblicazione: (2024)
di: van Remmerden, Jesse, et al.
Pubblicazione: (2024)
Online Control of Adaptive Large Neighborhood Search using Deep Reinforcement Learning
di: Reijnen, Robbert, et al.
Pubblicazione: (2022)
di: Reijnen, Robbert, et al.
Pubblicazione: (2022)
Deep Multi-Objective Reinforcement Learning for Utility-Based Infrastructural Maintenance Optimization
di: van Remmerden, Jesse, et al.
Pubblicazione: (2024)
di: van Remmerden, Jesse, et al.
Pubblicazione: (2024)
Adaptive Rollout Allocation for Online Reinforcement Learning with Verifiable Rewards
di: Nguyen, Hieu Trung, et al.
Pubblicazione: (2026)
di: Nguyen, Hieu Trung, et al.
Pubblicazione: (2026)
Job Shop Scheduling Benchmark: Environments and Instances for Learning and Non-learning Methods
di: Reijnen, Robbert, et al.
Pubblicazione: (2023)
di: Reijnen, Robbert, et al.
Pubblicazione: (2023)
Every Rollout Counts: Optimal Resource Allocation for Efficient Test-Time Scaling
di: Wang, Xinglin, et al.
Pubblicazione: (2025)
di: Wang, Xinglin, et al.
Pubblicazione: (2025)
Learning policies for resource allocation in business processes
di: Middelhuis, J., et al.
Pubblicazione: (2023)
di: Middelhuis, J., et al.
Pubblicazione: (2023)
Contextual Rollout Bandits for Reinforcement Learning with Verifiable Rewards
di: Lu, Xiaodong, et al.
Pubblicazione: (2026)
di: Lu, Xiaodong, et al.
Pubblicazione: (2026)
How to Allocate, How to Learn? Dynamic Rollout Allocation and Advantage Modulation for Policy Optimization
di: Fang, Yangyi, et al.
Pubblicazione: (2026)
di: Fang, Yangyi, et al.
Pubblicazione: (2026)
Learning Efficient and Fair Policies for Uncertainty-Aware Collaborative Human-Robot Order Picking
di: Smit, Igor G., et al.
Pubblicazione: (2024)
di: Smit, Igor G., et al.
Pubblicazione: (2024)
Graph Neural Networks for Job Shop Scheduling Problems: A Survey
di: Smit, Igor G., et al.
Pubblicazione: (2024)
di: Smit, Igor G., et al.
Pubblicazione: (2024)
Evaluating LLM-Based Process Explanations under Progressive Behavioral-Input Reduction
di: van Oerle, P., et al.
Pubblicazione: (2025)
di: van Oerle, P., et al.
Pubblicazione: (2025)
Towards Reward Fairness in RLHF: From a Resource Allocation Perspective
di: Ouyang, Sheng, et al.
Pubblicazione: (2025)
di: Ouyang, Sheng, et al.
Pubblicazione: (2025)
Kernel-Based Function Approximation for Average Reward Reinforcement Learning: An Optimist No-Regret Algorithm
di: Vakili, Sattar, et al.
Pubblicazione: (2024)
di: Vakili, Sattar, et al.
Pubblicazione: (2024)
DiffusionRollout: Uncertainty-Aware Rollout Planning in Long-Horizon PDE Solving
di: Yoo, Seungwoo, et al.
Pubblicazione: (2026)
di: Yoo, Seungwoo, et al.
Pubblicazione: (2026)
Graph-Supported Dynamic Algorithm Configuration for Multi-Objective Combinatorial Optimization
di: Reijnen, Robbert, et al.
Pubblicazione: (2025)
di: Reijnen, Robbert, et al.
Pubblicazione: (2025)
Maintenance Strategies for Sewer Pipes with Multi-State Degradation and Deep Reinforcement Learning
di: Jimenez-Roa, Lisandro A., et al.
Pubblicazione: (2024)
di: Jimenez-Roa, Lisandro A., et al.
Pubblicazione: (2024)
GymPN: A Library for Decision-Making in Process Management Systems
di: Bianco, Riccardo Lo, et al.
Pubblicazione: (2025)
di: Bianco, Riccardo Lo, et al.
Pubblicazione: (2025)
Maximum Entropy Exploration Without the Rollouts
di: Adamczyk, Jacob, et al.
Pubblicazione: (2026)
di: Adamczyk, Jacob, et al.
Pubblicazione: (2026)
Fair Resource Allocation for Fleet Intelligence
di: Baser, Oguzhan, et al.
Pubblicazione: (2025)
di: Baser, Oguzhan, et al.
Pubblicazione: (2025)
Not All Rollouts are Useful: Down-Sampling Rollouts in LLM Reinforcement Learning
di: Xu, Yixuan Even, et al.
Pubblicazione: (2025)
di: Xu, Yixuan Even, et al.
Pubblicazione: (2025)
(DEMO) Deep Reinforcement Learning Based Resource Allocation in Distributed IoT Systems
di: Li, Aohan, et al.
Pubblicazione: (2025)
di: Li, Aohan, et al.
Pubblicazione: (2025)
Regret Analysis of Policy Gradient Algorithm for Infinite Horizon Average Reward Markov Decision Processes
di: Bai, Qinbo, et al.
Pubblicazione: (2023)
di: Bai, Qinbo, et al.
Pubblicazione: (2023)
DUET: Optimize Token-Budget Allocation for Reinforcement Learning with Verifiable Rewards
di: Hu, Haoyu, et al.
Pubblicazione: (2026)
di: Hu, Haoyu, et al.
Pubblicazione: (2026)
HBIC: A Biclustering Algorithm for Heterogeneous Datasets
di: José-García, Adán, et al.
Pubblicazione: (2024)
di: José-García, Adán, et al.
Pubblicazione: (2024)
Repairing Reward Functions with Feedback to Mitigate Reward Hacking
di: Hatgis-Kessell, Stephane, et al.
Pubblicazione: (2025)
di: Hatgis-Kessell, Stephane, et al.
Pubblicazione: (2025)
Trust Region Reward Optimization and Proximal Inverse Reward Optimization Algorithm
di: Chen, Yang, et al.
Pubblicazione: (2025)
di: Chen, Yang, et al.
Pubblicazione: (2025)
Memory Allocation in Resource-Constrained Reinforcement Learning
di: Tamborski, Massimiliano, et al.
Pubblicazione: (2025)
di: Tamborski, Massimiliano, et al.
Pubblicazione: (2025)
EchoRL: Reinforcement Learning via Rollout Echoing
di: Bi, Jinhe, et al.
Pubblicazione: (2026)
di: Bi, Jinhe, et al.
Pubblicazione: (2026)
A Survey on Applications of Reinforcement Learning in Spatial Resource Allocation
di: Zhang, Di, et al.
Pubblicazione: (2024)
di: Zhang, Di, et al.
Pubblicazione: (2024)
Train Less, Learn More: Adaptive Efficient Rollout Optimization for Group-Based Reinforcement Learning
di: Zhang, Zhi, et al.
Pubblicazione: (2026)
di: Zhang, Zhi, et al.
Pubblicazione: (2026)
Adversarial Training for Process Reward Models
di: Juneja, Gurusha, et al.
Pubblicazione: (2025)
di: Juneja, Gurusha, et al.
Pubblicazione: (2025)
ARROW: An Adaptive Rollout and Routing Method for Global Weather Forecasting
di: Tian, Jindong, et al.
Pubblicazione: (2025)
di: Tian, Jindong, et al.
Pubblicazione: (2025)
ASTRO: Adaptive Stitching via Dynamics-Guided Trajectory Rollouts
di: Yu, Hang, et al.
Pubblicazione: (2025)
di: Yu, Hang, et al.
Pubblicazione: (2025)
RTMC: Step-Level Credit Assignment via Rollout Trees
di: Wang, Tao, et al.
Pubblicazione: (2026)
di: Wang, Tao, et al.
Pubblicazione: (2026)
Constrained Reinforcement Learning with Average Reward Objective: Model-Based and Model-Free Algorithms
di: Aggarwal, Vaneet, et al.
Pubblicazione: (2024)
di: Aggarwal, Vaneet, et al.
Pubblicazione: (2024)
Quasimetric Value Functions with Dense Rewards
di: Valieva, Khadichabonu, et al.
Pubblicazione: (2024)
di: Valieva, Khadichabonu, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Automated decision-making for dynamic task assignment at scale
di: Bianco, Riccardo Lo, et al.
Pubblicazione: (2025) -
Unsupervised anomaly detection algorithms on real-world data: how many do we need?
di: Bouman, Roel, et al.
Pubblicazione: (2023) -
Generalizing Beyond Suboptimality: Offline Reinforcement Learning Learns Effective Scheduling through Random Data
di: van Remmerden, Jesse, et al.
Pubblicazione: (2025) -
Offline Reinforcement Learning for Learning to Dispatch for Job Shop Scheduling
di: van Remmerden, Jesse, et al.
Pubblicazione: (2024) -
Online Control of Adaptive Large Neighborhood Search using Deep Reinforcement Learning
di: Reijnen, Robbert, et al.
Pubblicazione: (2022)