Reinforcement Learning with Curriculum-inspired Adaptive Direct Policy Guidance for Truck Dispatching
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Meng, Shi, Tian, Bin, Zhang, Xiaotong |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Mining--Gym: A Configurable RL Benchmarking Environment for Truck Dispatch Scheduling
von: Banerjee, Chayan, et al.
Veröffentlicht: (2025)
von: Banerjee, Chayan, et al.
Veröffentlicht: (2025)
Offline Reinforcement Learning for Learning to Dispatch for Job Shop Scheduling
von: van Remmerden, Jesse, et al.
Veröffentlicht: (2024)
von: van Remmerden, Jesse, et al.
Veröffentlicht: (2024)
GHPO: Adaptive Guidance for Stable and Efficient LLM Reinforcement Learning
von: Liu, Ziru, et al.
Veröffentlicht: (2025)
von: Liu, Ziru, et al.
Veröffentlicht: (2025)
Decoupled Guidance Diffusion for Adaptive Offline Safe Reinforcement Learning
von: Chen, Rufeng, et al.
Veröffentlicht: (2026)
von: Chen, Rufeng, et al.
Veröffentlicht: (2026)
GARLIC: GPT-Augmented Reinforcement Learning with Intelligent Control for Vehicle Dispatching
von: Han, Xiao, et al.
Veröffentlicht: (2024)
von: Han, Xiao, et al.
Veröffentlicht: (2024)
Reinforcement Learning for Multi-Truck Vehicle Routing Problems
von: Levin, Joshua, et al.
Veröffentlicht: (2022)
von: Levin, Joshua, et al.
Veröffentlicht: (2022)
Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance
von: He, Jinmin, et al.
Veröffentlicht: (2025)
von: He, Jinmin, et al.
Veröffentlicht: (2025)
An End-to-End Reinforcement Learning Based Approach for Micro-View Order-Dispatching in Ride-Hailing
von: Yue, Xinlang, et al.
Veröffentlicht: (2024)
von: Yue, Xinlang, et al.
Veröffentlicht: (2024)
Adaptive Policy Synchronization for Scalable Reinforcement Learning
von: Lafuente-Mercado, Rodney
Veröffentlicht: (2025)
von: Lafuente-Mercado, Rodney
Veröffentlicht: (2025)
Deep Reinforcement Learning for Multi-Truck Vehicle Routing Problems with Multi-Leg Demand Routes
von: Levin, Joshua, et al.
Veröffentlicht: (2024)
von: Levin, Joshua, et al.
Veröffentlicht: (2024)
Adaptive Guidance Accelerates Reinforcement Learning of Reasoning Models
von: Nath, Vaskar, et al.
Veröffentlicht: (2025)
von: Nath, Vaskar, et al.
Veröffentlicht: (2025)
Generative Distribution Prediction: A Unified Approach to Multimodal Learning
von: Tian, Xinyu, et al.
Veröffentlicht: (2025)
von: Tian, Xinyu, et al.
Veröffentlicht: (2025)
Short-term prediction of construction waste transport activities using AI-Truck
von: Xu, Meng, et al.
Veröffentlicht: (2023)
von: Xu, Meng, et al.
Veröffentlicht: (2023)
Less is more -- the Dispatcher/ Executor principle for multi-task Reinforcement Learning
von: Riedmiller, Martin, et al.
Veröffentlicht: (2023)
von: Riedmiller, Martin, et al.
Veröffentlicht: (2023)
Learning Diverse Policies with Soft Self-Generated Guidance
von: Wang, Guojian, et al.
Veröffentlicht: (2024)
von: Wang, Guojian, et al.
Veröffentlicht: (2024)
Multi-Objective Reinforcement Learning for Tactical Decision Making for Trucks in Highway Traffic
von: Pathare, Deepthi, et al.
Veröffentlicht: (2026)
von: Pathare, Deepthi, et al.
Veröffentlicht: (2026)
Offline Policy Evaluation for Reinforcement Learning with Adaptively Collected Data
von: Madhow, Sunil, et al.
Veröffentlicht: (2023)
von: Madhow, Sunil, et al.
Veröffentlicht: (2023)
Constraint-Adaptive Policy Switching for Offline Safe Reinforcement Learning
von: Chemingui, Yassine, et al.
Veröffentlicht: (2024)
von: Chemingui, Yassine, et al.
Veröffentlicht: (2024)
Scalable On-Policy Reinforcement Learning via Adaptive Batch Scaling
von: Park, Jongchan
Veröffentlicht: (2026)
von: Park, Jongchan
Veröffentlicht: (2026)
Diffusion-DICE: In-Sample Diffusion Guidance for Offline Reinforcement Learning
von: Mao, Liyuan, et al.
Veröffentlicht: (2024)
von: Mao, Liyuan, et al.
Veröffentlicht: (2024)
Adaptive Guidance for Local Training in Heterogeneous Federated Learning
von: Zhang, Jianqing, et al.
Veröffentlicht: (2024)
von: Zhang, Jianqing, et al.
Veröffentlicht: (2024)
Bridging the Sim-to-Real Gap in Reinforcement Learning-Based Industrial Dispatching through Execution Semantics
von: Hoss, Jonathan, et al.
Veröffentlicht: (2026)
von: Hoss, Jonathan, et al.
Veröffentlicht: (2026)
AceGRPO: Adaptive Curriculum Enhanced Group Relative Policy Optimization for Autonomous Machine Learning Engineering
von: Cai, Yuzhu, et al.
Veröffentlicht: (2026)
von: Cai, Yuzhu, et al.
Veröffentlicht: (2026)
Reinforcement Learning via Implicit Imitation Guidance
von: Dong, Perry, et al.
Veröffentlicht: (2025)
von: Dong, Perry, et al.
Veröffentlicht: (2025)
Multi-agent Reinforcement Learning for Dynamic Dispatching in Material Handling Systems
von: Lee, Xian Yeow, et al.
Veröffentlicht: (2024)
von: Lee, Xian Yeow, et al.
Veröffentlicht: (2024)
Tactical Decision Making for Autonomous Trucks by Deep Reinforcement Learning with Total Cost of Operation Based Reward
von: Pathare, Deepthi, et al.
Veröffentlicht: (2024)
von: Pathare, Deepthi, et al.
Veröffentlicht: (2024)
Probabilistic Curriculum Learning for Goal-Based Reinforcement Learning
von: Salt, Llewyn, et al.
Veröffentlicht: (2025)
von: Salt, Llewyn, et al.
Veröffentlicht: (2025)
Adaptive Conformal Guidance for Learning under Uncertainty
von: Liu, Rui, et al.
Veröffentlicht: (2025)
von: Liu, Rui, et al.
Veröffentlicht: (2025)
Human-Aware Robot Navigation via Reinforcement Learning with Hindsight Experience Replay and Curriculum Learning
von: Li, Keyu, et al.
Veröffentlicht: (2021)
von: Li, Keyu, et al.
Veröffentlicht: (2021)
TCOD: Exploring Temporal Curriculum in On-Policy Distillation for Multi-turn Autonomous Agents
von: Wang, Jiaqi, et al.
Veröffentlicht: (2026)
von: Wang, Jiaqi, et al.
Veröffentlicht: (2026)
More Than One Teacher: Adaptive Multi-Guidance Policy Optimization for Diverse Exploration
von: Yuan, Xiaoyang, et al.
Veröffentlicht: (2025)
von: Yuan, Xiaoyang, et al.
Veröffentlicht: (2025)
TS-DP: Reinforcement Speculative Decoding For Temporal Adaptive Diffusion Policy Acceleration
von: Li, Ye, et al.
Veröffentlicht: (2025)
von: Li, Ye, et al.
Veröffentlicht: (2025)
Adaptive Policy Selection and Fine-Tuning under Interaction Budgets for Offline-to-Online Reinforcement Learning
von: Bozkurt, Alper Kamil, et al.
Veröffentlicht: (2026)
von: Bozkurt, Alper Kamil, et al.
Veröffentlicht: (2026)
Adaptive Advantage-Guided Policy Regularization for Offline Reinforcement Learning
von: Liu, Tenglong, et al.
Veröffentlicht: (2024)
von: Liu, Tenglong, et al.
Veröffentlicht: (2024)
Proximal Curriculum with Task Correlations for Deep Reinforcement Learning
von: Tzannetos, Georgios, et al.
Veröffentlicht: (2024)
von: Tzannetos, Georgios, et al.
Veröffentlicht: (2024)
Generative Score Inference for Multimodal Data
von: Tian, Xinyu, et al.
Veröffentlicht: (2026)
von: Tian, Xinyu, et al.
Veröffentlicht: (2026)
CuDIP: Enhancing Theorem Proving in LLMs via Curriculum Learning-based Direct Preference Optimization
von: Shi, Shuming, et al.
Veröffentlicht: (2025)
von: Shi, Shuming, et al.
Veröffentlicht: (2025)
Learning to Reason under Off-Policy Guidance
von: Yan, Jianhao, et al.
Veröffentlicht: (2025)
von: Yan, Jianhao, et al.
Veröffentlicht: (2025)
A Curriculum Learning Approach to Reinforcement Learning: Leveraging RAG for Multimodal Question Answering
von: Zhang, Chenliang, et al.
Veröffentlicht: (2025)
von: Zhang, Chenliang, et al.
Veröffentlicht: (2025)
GTA: Generative Trajectory Augmentation with Guidance for Offline Reinforcement Learning
von: Lee, Jaewoo, et al.
Veröffentlicht: (2024)
von: Lee, Jaewoo, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Mining--Gym: A Configurable RL Benchmarking Environment for Truck Dispatch Scheduling
von: Banerjee, Chayan, et al.
Veröffentlicht: (2025) -
Offline Reinforcement Learning for Learning to Dispatch for Job Shop Scheduling
von: van Remmerden, Jesse, et al.
Veröffentlicht: (2024) -
GHPO: Adaptive Guidance for Stable and Efficient LLM Reinforcement Learning
von: Liu, Ziru, et al.
Veröffentlicht: (2025) -
Decoupled Guidance Diffusion for Adaptive Offline Safe Reinforcement Learning
von: Chen, Rufeng, et al.
Veröffentlicht: (2026) -
GARLIC: GPT-Augmented Reinforcement Learning with Intelligent Control for Vehicle Dispatching
von: Han, Xiao, et al.
Veröffentlicht: (2024)