ORPR: An OR-Guided Pretrain-then-Reinforce Learning Model for Inventory Management
Fuente:
arXiv
Saved in:
| Main Authors: | Zhao, Lingjie, Yu, Xue, Qi, Yongzhi, Hu, Hao, Zhang, Jianshen, Ma, Yingzheng, Han, Shuyu, Qi, Wei, Shen, Zuo-Jun Max |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
JD.com Improves Fulfillment Efficiency with Data-driven Integrated Assortment Planning and Inventory Allocation
by: Shen, Zuo-Jun Max, et al.
Published: (2025)
by: Shen, Zuo-Jun Max, et al.
Published: (2025)
Rethinking Supply Chain Planning: A Generative Paradigm
by: Yin, Jiaheng, et al.
Published: (2025)
by: Yin, Jiaheng, et al.
Published: (2025)
TimeHF: Billion-Scale Time Series Models Guided by Human Feedback
by: Qi, Yongzhi, et al.
Published: (2025)
by: Qi, Yongzhi, et al.
Published: (2025)
sTransformer: A Modular Approach for Extracting Inter-Sequential and Temporal Information for Time-Series Forecasting
by: Yin, Jiaheng, et al.
Published: (2024)
by: Yin, Jiaheng, et al.
Published: (2024)
DeepStock: Reinforcement Learning with Policy Regularizations for Inventory Management
by: Xie, Yaqi, et al.
Published: (2026)
by: Xie, Yaqi, et al.
Published: (2026)
Online MDP with Transition Prototypes: A Robust Adaptive Approach
by: Sun, Shuo, et al.
Published: (2024)
by: Sun, Shuo, et al.
Published: (2024)
PEGRL: Improving Machine Translation by Post-Editing Guided Reinforcement Learning
by: Shen, Yunzhi, et al.
Published: (2026)
by: Shen, Yunzhi, et al.
Published: (2026)
Structure-Informed Deep Reinforcement Learning for Inventory Management
by: Maggiar, Alvaro, et al.
Published: (2025)
by: Maggiar, Alvaro, et al.
Published: (2025)
Efficient Reinforcement Learning Through Adaptively Pretrained Visual Encoder
by: Zhang, Yuhan, et al.
Published: (2025)
by: Zhang, Yuhan, et al.
Published: (2025)
Distinct Impacts of Carbon Dioxide Removal and Radiation Management on Regional Monsoons
by: Qi Zuo, et al.
Published: (2026)
by: Qi Zuo, et al.
Published: (2026)
DeltaMem: Towards Agentic Memory Management via Reinforcement Learning
by: Zhang, Qi, et al.
Published: (2026)
by: Zhang, Qi, et al.
Published: (2026)
Autonomous Resource Management in Microservice Systems via Reinforcement Learning
by: Zou, Yujun, et al.
Published: (2025)
by: Zou, Yujun, et al.
Published: (2025)
Symmetry-Guided Multi-Agent Inverse Reinforcement Learning
by: Tian, Yongkai, et al.
Published: (2025)
by: Tian, Yongkai, et al.
Published: (2025)
Decision-Focused Sequential Experimental Design: A Directional Uncertainty-Guided Approach
by: Wan, Beichen, et al.
Published: (2026)
by: Wan, Beichen, et al.
Published: (2026)
Pretrained Reversible Generation as Unsupervised Visual Representation Learning
by: Xue, Rongkun, et al.
Published: (2024)
by: Xue, Rongkun, et al.
Published: (2024)
Algorithm Design for Continual Learning in IoT Networks
by: Hao, Shugang, et al.
Published: (2024)
by: Hao, Shugang, et al.
Published: (2024)
Node Level Graph Autoencoder: Unified Pretraining for Textual Graph Learning
by: Hu, Wenbin, et al.
Published: (2024)
by: Hu, Wenbin, et al.
Published: (2024)
Online Learning from Strategic Human Feedback in LLM Fine-Tuning
by: Hao, Shugang, et al.
Published: (2024)
by: Hao, Shugang, et al.
Published: (2024)
Deep Reinforcement Learning and Auto‐Differential Evolution Co‐Guided Coal Washing
by: Mingcheng Zuo
Published: (2024)
by: Mingcheng Zuo
Published: (2024)
Cross‐scale effects of habitat fragmentation on local biodiversity and ecosystem multifunctionality in a fragmented grassland landscape
by: Yongzhi Yan, et al.
Published: (2025)
by: Yongzhi Yan, et al.
Published: (2025)
Human-in-the-loop Learning Through Decentralized Communication Mechanisms
by: Hu, Yiting, et al.
Published: (2025)
by: Hu, Yiting, et al.
Published: (2025)
To Save Mobile Crowdsourcing from Cheap-talk: A Game Theoretic Learning Approach
by: Hao, Shugang, et al.
Published: (2023)
by: Hao, Shugang, et al.
Published: (2023)
ThinkDrive: Chain-of-Thought Guided Progressive Reinforcement Learning Fine-Tuning for Autonomous Driving
by: Zhao, Chang, et al.
Published: (2026)
by: Zhao, Chang, et al.
Published: (2026)
Boosting Ray Search Procedure of Hard-label Attacks with Transfer-based Priors
by: Ma, Chen, et al.
Published: (2025)
by: Ma, Chen, et al.
Published: (2025)
ADFC ‐ ATP : Attention‐Guided Dual‐View Fusion and Contrastive Pretraining for Robust Aquatic Toxicity Prediction
by: Jixuan Jia, et al.
Published: (2026)
by: Jixuan Jia, et al.
Published: (2026)
Alpha Discovery via Grammar-Guided Learning and Search
by: Yang, Han, et al.
Published: (2026)
by: Yang, Han, et al.
Published: (2026)
A Large Language Model Guided Topic Refinement Mechanism for Short Text Modeling
by: Chang, Shuyu, et al.
Published: (2024)
by: Chang, Shuyu, et al.
Published: (2024)
Deep Reinforcement Learning for Intelligent Supply Chain Inventory Management: A Q-Learning Approach
by: Pramanik, Rudra, et al.
Published: (2025)
by: Pramanik, Rudra, et al.
Published: (2025)
An Efficient Continuous Control Perspective for Reinforcement-Learning-based Sequential Recommendation
by: Wang, Jun, et al.
Published: (2024)
by: Wang, Jun, et al.
Published: (2024)
Goal-Guided Efficient Exploration via Large Language Model in Reinforcement Learning
by: Qi, Yajie, et al.
Published: (2025)
by: Qi, Yajie, et al.
Published: (2025)
Soft Actor-Critic with Backstepping-Pretrained DeepONet for control of PDEs
by: Wang, Chenchen, et al.
Published: (2025)
by: Wang, Chenchen, et al.
Published: (2025)
VisFly-Lab: Unified Differentiable Framework for First-Order Reinforcement Learning of Quadrotor Control
by: Li, Fanxing, et al.
Published: (2026)
by: Li, Fanxing, et al.
Published: (2026)
Enhancing TCR-Peptide Interaction Prediction with Pretrained Language Models and Molecular Representations
by: Qi, Cong, et al.
Published: (2025)
by: Qi, Cong, et al.
Published: (2025)
Synthesizing Programmatic Reinforcement Learning Policies with Large Language Model Guided Search
by: Liu, Max, et al.
Published: (2024)
by: Liu, Max, et al.
Published: (2024)
Joint Deployment and Beamforming Design of Aerial STAR-RIS Aided Networks with Reinforcement Learning
by: Ma, Zhuoyuan, et al.
Published: (2023)
by: Ma, Zhuoyuan, et al.
Published: (2023)
Active Learning For Contextual Linear Optimization: A Margin-Based Approach
by: Liu, Mo, et al.
Published: (2023)
by: Liu, Mo, et al.
Published: (2023)
ScaleNet: Scaling up Pretrained Neural Networks with Incremental Parameters
by: Hao, Zhiwei, et al.
Published: (2025)
by: Hao, Zhiwei, et al.
Published: (2025)
Self-Distilled Agentic Reinforcement Learning
by: Lu, Zhengxi, et al.
Published: (2026)
by: Lu, Zhengxi, et al.
Published: (2026)
Optimizing Urban Electric Vehicle Charging and Battery Swapping Infrastructure: A Location-Inventory-Grid Model
by: Ai, Wenqing, et al.
Published: (2025)
by: Ai, Wenqing, et al.
Published: (2025)
Diffusion-Guided Pretraining for Brain Graph Foundation Models
by: Wei, Xinxu, et al.
Published: (2026)
by: Wei, Xinxu, et al.
Published: (2026)
Similar Items
-
JD.com Improves Fulfillment Efficiency with Data-driven Integrated Assortment Planning and Inventory Allocation
by: Shen, Zuo-Jun Max, et al.
Published: (2025) -
Rethinking Supply Chain Planning: A Generative Paradigm
by: Yin, Jiaheng, et al.
Published: (2025) -
TimeHF: Billion-Scale Time Series Models Guided by Human Feedback
by: Qi, Yongzhi, et al.
Published: (2025) -
sTransformer: A Modular Approach for Extracting Inter-Sequential and Temporal Information for Time-Series Forecasting
by: Yin, Jiaheng, et al.
Published: (2024) -
DeepStock: Reinforcement Learning with Policy Regularizations for Inventory Management
by: Xie, Yaqi, et al.
Published: (2026)