Deep Reinforcement Learning for Solving Management Problems: Towards A Large Management Mode
Fuente:
arXiv
Guardado en:
| Autores principales: | Jiang, Jinyang, Liu, Xiaotian, Ren, Tao, Wang, Qinghao, Zheng, Yi, Du, Yufu, Peng, Yijie, Zhang, Cheng |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Closing the Loop: Coordinating Inventory and Recommendation via Deep Reinforcement Learning on Multiple Timescales
por: Jiang, Jinyang, et al.
Publicado: (2025)
por: Jiang, Jinyang, et al.
Publicado: (2025)
SAMP-HDRL: Segmented Allocation with Momentum-Adjusted Utility for Multi-agent Portfolio Management via Hierarchical Deep Reinforcement Learning
por: Ren, Xiaotian, et al.
Publicado: (2025)
por: Ren, Xiaotian, et al.
Publicado: (2025)
Integrated Offline and Online Learning to Solve a Large Class of Scheduling Problems
por: Liu, Anbang, et al.
Publicado: (2025)
por: Liu, Anbang, et al.
Publicado: (2025)
Adaptive Robust Estimator for Multi-Agent Reinforcement Learning
por: Li, Zhongyi, et al.
Publicado: (2026)
por: Li, Zhongyi, et al.
Publicado: (2026)
FLOPS: Forward Learning with OPtimal Sampling
por: Ren, Tao, et al.
Publicado: (2024)
por: Ren, Tao, et al.
Publicado: (2024)
Reinforcement Learning Problem Solving with Large Language Models
por: Gholamian, Sina, et al.
Publicado: (2024)
por: Gholamian, Sina, et al.
Publicado: (2024)
Memory as Asset: From Agent-centric to Human-centric Memory Management
por: Pan, Yanqi, et al.
Publicado: (2026)
por: Pan, Yanqi, et al.
Publicado: (2026)
RiskPO: Risk-based Policy Optimization via Verifiable Reward for LLM Post-Training
por: Ren, Tao, et al.
Publicado: (2025)
por: Ren, Tao, et al.
Publicado: (2025)
Solving the Pod Repositioning Problem with Deep Reinforced Adaptive Large Neighborhood Search
por: Xie, Lin, et al.
Publicado: (2025)
por: Xie, Lin, et al.
Publicado: (2025)
DeepStock: Reinforcement Learning with Policy Regularizations for Inventory Management
por: Xie, Yaqi, et al.
Publicado: (2026)
por: Xie, Yaqi, et al.
Publicado: (2026)
Deep Reinforcement Learning for Artificial Upwelling Energy Management
por: Zhang, Yiyuan, et al.
Publicado: (2023)
por: Zhang, Yiyuan, et al.
Publicado: (2023)
Logic-of-Thought: Empowering Large Language Models with Logic Programs for Solving Puzzles in Natural Language
por: Li, Naiqi, et al.
Publicado: (2025)
por: Li, Naiqi, et al.
Publicado: (2025)
An End-to-End Deep Reinforcement Learning Approach for Solving the Traveling Salesman Problem with Drones
por: Zeng, Taihelong, et al.
Publicado: (2025)
por: Zeng, Taihelong, et al.
Publicado: (2025)
From Problem-Solving to Teaching Problem-Solving: Aligning LLMs with Pedagogy using Reinforcement Learning
por: Dinucu-Jianu, David, et al.
Publicado: (2025)
por: Dinucu-Jianu, David, et al.
Publicado: (2025)
Approximated Likelihood Ratio: A Forward-Only and Parallel Framework for Boosting Neural Network Training
por: Zhang, Zeliang, et al.
Publicado: (2024)
por: Zhang, Zeliang, et al.
Publicado: (2024)
Incorporating Graph Attention Mechanism into Geometric Problem Solving Based on Deep Reinforcement Learning
por: Zhong, Xiuqin, et al.
Publicado: (2024)
por: Zhong, Xiuqin, et al.
Publicado: (2024)
Deep Reinforcement Learning for Solving the Fleet Size and Mix Vehicle Routing Problem
por: Wan, Pengfu, et al.
Publicado: (2025)
por: Wan, Pengfu, et al.
Publicado: (2025)
Forward Learning for Gradient-based Black-box Saliency Map Generation
por: Zhang, Zeliang, et al.
Publicado: (2024)
por: Zhang, Zeliang, et al.
Publicado: (2024)
NaviFormer: A Deep Reinforcement Learning Transformer-like Model to Holistically Solve the Navigation Problem
por: Fuertes, Daniel, et al.
Publicado: (2026)
por: Fuertes, Daniel, et al.
Publicado: (2026)
Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review
por: Gu, Yan, et al.
Publicado: (2025)
por: Gu, Yan, et al.
Publicado: (2025)
Beyond Words: How Large Language Models Perform in Quantitative Management Problem-Solving
por: Kuzmanko, Jonathan
Publicado: (2025)
por: Kuzmanko, Jonathan
Publicado: (2025)
Reinforcement Learning for Solving Stochastic Vehicle Routing Problem with Time Windows
por: Iklassov, Zangir, et al.
Publicado: (2024)
por: Iklassov, Zangir, et al.
Publicado: (2024)
MTS: A Deep Reinforcement Learning Portfolio Management Framework with Time-Awareness and Short-Selling
por: Gu, Fengchen, et al.
Publicado: (2025)
por: Gu, Fengchen, et al.
Publicado: (2025)
Solving Integrated Process Planning and Scheduling Problem via Graph Neural Network Based Deep Reinforcement Learning
por: Li, Hongpei, et al.
Publicado: (2024)
por: Li, Hongpei, et al.
Publicado: (2024)
Learning to Solve Compositional Geometry Routing Problems
por: Fan, Mingfeng, et al.
Publicado: (2026)
por: Fan, Mingfeng, et al.
Publicado: (2026)
Feature-Guided Metaheuristic with Diversity Management for Solving the Capacitated Vehicle Routing Problem
por: Herdianto, Bachtiar, et al.
Publicado: (2024)
por: Herdianto, Bachtiar, et al.
Publicado: (2024)
Towards Robust LLM Post-Training: Automatic Failure Management for Reinforcement Fine-Tuning
por: Zhang, Lingzhe, et al.
Publicado: (2026)
por: Zhang, Lingzhe, et al.
Publicado: (2026)
Learning Dynamics of Deep Learning -- Force Analysis of Deep Neural Networks
por: Ren, Yi
Publicado: (2025)
por: Ren, Yi
Publicado: (2025)
RL2: Reinforce Large Language Model to Assist Safe Reinforcement Learning for Energy Management of Active Distribution Networks
por: Yang, Xu, et al.
Publicado: (2024)
por: Yang, Xu, et al.
Publicado: (2024)
PeersimGym: An Environment for Solving the Task Offloading Problem with Reinforcement Learning
por: Metelo, Frederico, et al.
Publicado: (2024)
por: Metelo, Frederico, et al.
Publicado: (2024)
Reinforcement Learning-Based Prompt Template Stealing for Text-to-Image Models
por: Zou, Xiaotian
Publicado: (2025)
por: Zou, Xiaotian
Publicado: (2025)
Position Paper: Towards Open Complex Human-AI Agents Collaboration Systems for Problem Solving and Knowledge Management
por: Wu, Ju, et al.
Publicado: (2025)
por: Wu, Ju, et al.
Publicado: (2025)
Deep Learning and Machine Learning, Advancing Big Data Analytics and Management: Tensorflow Pretrained Models
por: Chen, Keyu, et al.
Publicado: (2024)
por: Chen, Keyu, et al.
Publicado: (2024)
SED2AM: Solving Multi-Trip Time-Dependent Vehicle Routing Problem using Deep Reinforcement Learning
por: Mozhdehi, Arash, et al.
Publicado: (2025)
por: Mozhdehi, Arash, et al.
Publicado: (2025)
Tradeoffs When Considering Deep Reinforcement Learning for Contingency Management in Advanced Air Mobility
por: Alvarez, Luis E., et al.
Publicado: (2024)
por: Alvarez, Luis E., et al.
Publicado: (2024)
IntellectSeeker: A Personalized Literature Management System with the Probabilistic Model and Large Language Model
por: Bian, Weizhen, et al.
Publicado: (2024)
por: Bian, Weizhen, et al.
Publicado: (2024)
MathGLM-Vision: Solving Mathematical Problems with Multi-Modal Large Language Model
por: Yang, Zhen, et al.
Publicado: (2024)
por: Yang, Zhen, et al.
Publicado: (2024)
Cross-Problem Learning for Solving Vehicle Routing Problems
por: Lin, Zhuoyi, et al.
Publicado: (2024)
por: Lin, Zhuoyi, et al.
Publicado: (2024)
Learn to Relax with Large Language Models: Solving Constraint Optimization Problems via Bidirectional Coevolution
por: Liu, Beidan, et al.
Publicado: (2025)
por: Liu, Beidan, et al.
Publicado: (2025)
An Automated Reinforcement Learning Reward Design Framework with Large Language Model for Cooperative Platoon Coordination
por: Wei, Dixiao, et al.
Publicado: (2025)
por: Wei, Dixiao, et al.
Publicado: (2025)
Ejemplares similares
-
Closing the Loop: Coordinating Inventory and Recommendation via Deep Reinforcement Learning on Multiple Timescales
por: Jiang, Jinyang, et al.
Publicado: (2025) -
SAMP-HDRL: Segmented Allocation with Momentum-Adjusted Utility for Multi-agent Portfolio Management via Hierarchical Deep Reinforcement Learning
por: Ren, Xiaotian, et al.
Publicado: (2025) -
Integrated Offline and Online Learning to Solve a Large Class of Scheduling Problems
por: Liu, Anbang, et al.
Publicado: (2025) -
Adaptive Robust Estimator for Multi-Agent Reinforcement Learning
por: Li, Zhongyi, et al.
Publicado: (2026) -
FLOPS: Forward Learning with OPtimal Sampling
por: Ren, Tao, et al.
Publicado: (2024)