Generalizing Beyond Suboptimality: Offline Reinforcement Learning Learns Effective Scheduling through Random Data
Fuente:
arXiv
Saved in:
| Main Authors: | van Remmerden, Jesse, Bukhsh, Zaharah, Zhang, Yingqian |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Offline Reinforcement Learning for Learning to Dispatch for Job Shop Scheduling
by: van Remmerden, Jesse, et al.
Published: (2024)
by: van Remmerden, Jesse, et al.
Published: (2024)
Deep Multi-Objective Reinforcement Learning for Utility-Based Infrastructural Maintenance Optimization
by: van Remmerden, Jesse, et al.
Published: (2024)
by: van Remmerden, Jesse, et al.
Published: (2024)
Online Control of Adaptive Large Neighborhood Search using Deep Reinforcement Learning
by: Reijnen, Robbert, et al.
Published: (2022)
by: Reijnen, Robbert, et al.
Published: (2022)
Job Shop Scheduling Benchmark: Environments and Instances for Learning and Non-learning Methods
by: Reijnen, Robbert, et al.
Published: (2023)
by: Reijnen, Robbert, et al.
Published: (2023)
Learning Efficient and Fair Policies for Uncertainty-Aware Collaborative Human-Robot Order Picking
by: Smit, Igor G., et al.
Published: (2024)
by: Smit, Igor G., et al.
Published: (2024)
Graph Neural Networks for Job Shop Scheduling Problems: A Survey
by: Smit, Igor G., et al.
Published: (2024)
by: Smit, Igor G., et al.
Published: (2024)
Unsupervised anomaly detection algorithms on real-world data: how many do we need?
by: Bouman, Roel, et al.
Published: (2023)
by: Bouman, Roel, et al.
Published: (2023)
A Rollout-Based Algorithm and Reward Function for Resource Allocation in Business Processes
by: Middelhuis, Jeroen, et al.
Published: (2025)
by: Middelhuis, Jeroen, et al.
Published: (2025)
Scheduling That Speaks: An Interpretable Programmatic Reinforcement Learning Framework
by: Hu, Chengpeng, et al.
Published: (2026)
by: Hu, Chengpeng, et al.
Published: (2026)
Measurement Scheduling for ICU Patients with Offline Reinforcement Learning
by: Ji, Zongliang, et al.
Published: (2024)
by: Ji, Zongliang, et al.
Published: (2024)
Maintenance Strategies for Sewer Pipes with Multi-State Degradation and Deep Reinforcement Learning
by: Jimenez-Roa, Lisandro A., et al.
Published: (2024)
by: Jimenez-Roa, Lisandro A., et al.
Published: (2024)
Graph-Supported Dynamic Algorithm Configuration for Multi-Objective Combinatorial Optimization
by: Reijnen, Robbert, et al.
Published: (2025)
by: Reijnen, Robbert, et al.
Published: (2025)
On Sample-Efficient Offline Reinforcement Learning: Data Diversity, Posterior Sampling, and Beyond
by: Nguyen-Tang, Thanh, et al.
Published: (2024)
by: Nguyen-Tang, Thanh, et al.
Published: (2024)
The Generalization Gap in Offline Reinforcement Learning
by: Mediratta, Ishita, et al.
Published: (2023)
by: Mediratta, Ishita, et al.
Published: (2023)
Offline Reinforcement Learning with Generative Trajectory Policies
by: Feng, Xinsong, et al.
Published: (2025)
by: Feng, Xinsong, et al.
Published: (2025)
Doubly Mild Generalization for Offline Reinforcement Learning
by: Mao, Yixiu, et al.
Published: (2024)
by: Mao, Yixiu, et al.
Published: (2024)
FOVA: Offline Federated Reinforcement Learning with Mixed-Quality Data
by: Qiao, Nan, et al.
Published: (2025)
by: Qiao, Nan, et al.
Published: (2025)
Towards Robust Offline Reinforcement Learning under Diverse Data Corruption
by: Yang, Rui, et al.
Published: (2023)
by: Yang, Rui, et al.
Published: (2023)
Offline Trajectory Optimization for Offline Reinforcement Learning
by: Zhao, Ziqi, et al.
Published: (2024)
by: Zhao, Ziqi, et al.
Published: (2024)
Using Offline Data to Speed Up Reinforcement Learning in Procedurally Generated Environments
by: Andres, Alain, et al.
Published: (2023)
by: Andres, Alain, et al.
Published: (2023)
Offline-to-Online Reinforcement Learning with Classifier-Free Diffusion Generation
by: Huang, Xiao, et al.
Published: (2025)
by: Huang, Xiao, et al.
Published: (2025)
LLM-Driven Policy Diffusion: Enhancing Generalization in Offline Reinforcement Learning
by: Zhang, Hanping, et al.
Published: (2025)
by: Zhang, Hanping, et al.
Published: (2025)
Provable Zero-Shot Generalization in Offline Reinforcement Learning
by: Wang, Zhiyong, et al.
Published: (2025)
by: Wang, Zhiyong, et al.
Published: (2025)
Contrastive Representation for Data Filtering in Cross-Domain Offline Reinforcement Learning
by: Wen, Xiaoyu, et al.
Published: (2024)
by: Wen, Xiaoyu, et al.
Published: (2024)
Automated Reinforcement Learning: An Overview
by: Afshar, Reza Refaei, et al.
Published: (2022)
by: Afshar, Reza Refaei, et al.
Published: (2022)
Diffusion World Model: Future Modeling Beyond Step-by-Step Rollout for Offline Reinforcement Learning
by: Ding, Zihan, et al.
Published: (2024)
by: Ding, Zihan, et al.
Published: (2024)
Ensemble Successor Representations for Task Generalization in Offline-to-Online Reinforcement Learning
by: Wang, Changhong, et al.
Published: (2024)
by: Wang, Changhong, et al.
Published: (2024)
Model-Based Offline Reinforcement Learning with Adversarial Data Augmentation
by: Cao, Hongye, et al.
Published: (2025)
by: Cao, Hongye, et al.
Published: (2025)
Pre-training with Synthetic Data Helps Offline Reinforcement Learning
by: Wang, Zecheng, et al.
Published: (2023)
by: Wang, Zecheng, et al.
Published: (2023)
Pessimistic Causal Reinforcement Learning with Mediators for Confounded Offline Data
by: Wang, Danyang, et al.
Published: (2024)
by: Wang, Danyang, et al.
Published: (2024)
Offline Reinforcement Learning: Role of State Aggregation and Trajectory Data
by: Jia, Zeyu, et al.
Published: (2024)
by: Jia, Zeyu, et al.
Published: (2024)
Offline Policy Evaluation for Reinforcement Learning with Adaptively Collected Data
by: Madhow, Sunil, et al.
Published: (2023)
by: Madhow, Sunil, et al.
Published: (2023)
Goal-Conditioned Data Augmentation for Offline Reinforcement Learning
by: Huang, Xingshuai, et al.
Published: (2024)
by: Huang, Xingshuai, et al.
Published: (2024)
GTA: Generative Trajectory Augmentation with Guidance for Offline Reinforcement Learning
by: Lee, Jaewoo, et al.
Published: (2024)
by: Lee, Jaewoo, et al.
Published: (2024)
Hindsight Preference Learning for Offline Preference-based Reinforcement Learning
by: Gao, Chen-Xiao, et al.
Published: (2024)
by: Gao, Chen-Xiao, et al.
Published: (2024)
Diverse Randomized Value Functions: A Provably Pessimistic Approach for Offline Reinforcement Learning
by: Yu, Xudong, et al.
Published: (2024)
by: Yu, Xudong, et al.
Published: (2024)
Preference Elicitation for Offline Reinforcement Learning
by: Pace, Alizée, et al.
Published: (2024)
by: Pace, Alizée, et al.
Published: (2024)
Offline Reinforcement Learning with Imbalanced Datasets
by: Jiang, Li, et al.
Published: (2023)
by: Jiang, Li, et al.
Published: (2023)
Simple Ingredients for Offline Reinforcement Learning
by: Cetin, Edoardo, et al.
Published: (2024)
by: Cetin, Edoardo, et al.
Published: (2024)
State-Constrained Offline Reinforcement Learning
by: Hepburn, Charles A., et al.
Published: (2024)
by: Hepburn, Charles A., et al.
Published: (2024)
Similar Items
-
Offline Reinforcement Learning for Learning to Dispatch for Job Shop Scheduling
by: van Remmerden, Jesse, et al.
Published: (2024) -
Deep Multi-Objective Reinforcement Learning for Utility-Based Infrastructural Maintenance Optimization
by: van Remmerden, Jesse, et al.
Published: (2024) -
Online Control of Adaptive Large Neighborhood Search using Deep Reinforcement Learning
by: Reijnen, Robbert, et al.
Published: (2022) -
Job Shop Scheduling Benchmark: Environments and Instances for Learning and Non-learning Methods
by: Reijnen, Robbert, et al.
Published: (2023) -
Learning Efficient and Fair Policies for Uncertainty-Aware Collaborative Human-Robot Order Picking
by: Smit, Igor G., et al.
Published: (2024)