Designing an efficient and equitable humanitarian supply chain dynamically via reinforcement learning
Fuente:
arXiv
Guardado en:
| Autor principal: | Jin, Weijia |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Not all tokens are needed(NAT): token efficient reinforcement learning
por: Sang, Hejian, et al.
Publicado: (2026)
por: Sang, Hejian, et al.
Publicado: (2026)
An efficient deep reinforcement learning environment for flexible job-shop scheduling
por: Wu, Xinquan, et al.
Publicado: (2025)
por: Wu, Xinquan, et al.
Publicado: (2025)
CHARME: A chain-based reinforcement learning approach for the minor embedding problem
por: Ngo, Hoang M., et al.
Publicado: (2024)
por: Ngo, Hoang M., et al.
Publicado: (2024)
Data-driven simulator of multi-animal behavior with unknown dynamics via offline and online reinforcement learning
por: Fujii, Keisuke, et al.
Publicado: (2025)
por: Fujii, Keisuke, et al.
Publicado: (2025)
Adaptive traffic signal safety and efficiency improvement by multi objective deep reinforcement learning approach
por: Mirbakhsh, Shahin, et al.
Publicado: (2024)
por: Mirbakhsh, Shahin, et al.
Publicado: (2024)
Scilab-RL: A software framework for efficient reinforcement learning and cognitive modeling research
por: Dohmen, Jan, et al.
Publicado: (2024)
por: Dohmen, Jan, et al.
Publicado: (2024)
Applying graph neural network to SupplyGraph for supply chain network
por: Han, Kihwan
Publicado: (2024)
por: Han, Kihwan
Publicado: (2024)
Normalization and effective learning rates in reinforcement learning
por: Lyle, Clare, et al.
Publicado: (2024)
por: Lyle, Clare, et al.
Publicado: (2024)
Designing a double deep reinforcement learning selection tool for resilient demand prediction
por: Benziane, Bilel Abderrahmane, et al.
Publicado: (2026)
por: Benziane, Bilel Abderrahmane, et al.
Publicado: (2026)
Curriculum reinforcement learning with measurable task representation learning
por: Wen, Yongyan, et al.
Publicado: (2026)
por: Wen, Yongyan, et al.
Publicado: (2026)
Explainable deep reinforcement learning reveals energy-efficient control strategies for turbulent drag reduction
por: Tonti, Federica, et al.
Publicado: (2026)
por: Tonti, Federica, et al.
Publicado: (2026)
Bridging the phenotype-target gap for molecular generation via multi-objective reinforcement learning
por: Guo, Haotian, et al.
Publicado: (2025)
por: Guo, Haotian, et al.
Publicado: (2025)
Optimization of geological carbon storage operations with multimodal latent dynamic model and deep reinforcement learning
por: Wang, Zhongzheng, et al.
Publicado: (2024)
por: Wang, Zhongzheng, et al.
Publicado: (2024)
Counterfactual experience augmented off-policy reinforcement learning
por: Lee, Sunbowen, et al.
Publicado: (2025)
por: Lee, Sunbowen, et al.
Publicado: (2025)
Bellman operator convergence enhancements in reinforcement learning algorithms
por: Kadurha, David Krame, et al.
Publicado: (2025)
por: Kadurha, David Krame, et al.
Publicado: (2025)
Causal prompting model-based offline reinforcement learning
por: Yu, Xuehui, et al.
Publicado: (2024)
por: Yu, Xuehui, et al.
Publicado: (2024)
Deep reinforcement learning with time-scale invariant memory
por: Kabir, Md Rysul, et al.
Publicado: (2024)
por: Kabir, Md Rysul, et al.
Publicado: (2024)
Delayed homomorphic reinforcement learning for environments with delayed feedback
por: Lee, Jongsoo, et al.
Publicado: (2026)
por: Lee, Jongsoo, et al.
Publicado: (2026)
Offline reinforcement learning for job-shop scheduling problems
por: Echeverria, Imanol, et al.
Publicado: (2024)
por: Echeverria, Imanol, et al.
Publicado: (2024)
Trust Region Preference Approximation: A simple and stable reinforcement learning algorithm for LLM reasoning
por: Su, Xuerui, et al.
Publicado: (2025)
por: Su, Xuerui, et al.
Publicado: (2025)
Leveraging weights signals -- Predicting and improving generalizability in reinforcement learning
por: Moulin, Olivier, et al.
Publicado: (2025)
por: Moulin, Olivier, et al.
Publicado: (2025)
Dynamic feature selection in medical predictive monitoring by reinforcement learning
por: Chen, Yutong, et al.
Publicado: (2024)
por: Chen, Yutong, et al.
Publicado: (2024)
Economic span selection of bridge based on deep reinforcement learning
por: Zhang, Leye, et al.
Publicado: (2024)
por: Zhang, Leye, et al.
Publicado: (2024)
Emergent temporal abstractions in autoregressive models enable hierarchical reinforcement learning
por: Kobayashi, Seijin, et al.
Publicado: (2025)
por: Kobayashi, Seijin, et al.
Publicado: (2025)
On the consistency of hyper-parameter selection in value-based deep reinforcement learning
por: Obando-Ceron, Johan, et al.
Publicado: (2024)
por: Obando-Ceron, Johan, et al.
Publicado: (2024)
CAREL: Instruction-guided reinforcement learning with cross-modal auxiliary objectives
por: Saghafian, Armin, et al.
Publicado: (2024)
por: Saghafian, Armin, et al.
Publicado: (2024)
Task diversity produces systematic transfer but inhibits continual reinforcement learning
por: Seth, Purab, et al.
Publicado: (2026)
por: Seth, Purab, et al.
Publicado: (2026)
Policy-shaped prediction: avoiding distractions in model-based reinforcement learning
por: Hutson, Miles, et al.
Publicado: (2024)
por: Hutson, Miles, et al.
Publicado: (2024)
Found-RL: foundation model-enhanced reinforcement learning for autonomous driving
por: Qu, Yansong, et al.
Publicado: (2026)
por: Qu, Yansong, et al.
Publicado: (2026)
An advantage based policy transfer algorithm for reinforcement learning with measures of transferability
por: Alam, Md Ferdous, et al.
Publicado: (2023)
por: Alam, Md Ferdous, et al.
Publicado: (2023)
Discovering highly efficient low-weight quantum error-correcting codes with reinforcement learning
por: He, Austin Yubo, et al.
Publicado: (2025)
por: He, Austin Yubo, et al.
Publicado: (2025)
Survey on reinforcement learning for language processing
por: Uc-Cetina, Victor, et al.
Publicado: (2021)
por: Uc-Cetina, Victor, et al.
Publicado: (2021)
Towards efficient representation identification in supervised learning
por: Ahuja, Kartik, et al.
Publicado: (2022)
por: Ahuja, Kartik, et al.
Publicado: (2022)
An approach of deep reinforcement learning for maximizing the net present value of stochastic projects
por: Xu, Wei, et al.
Publicado: (2025)
por: Xu, Wei, et al.
Publicado: (2025)
Learning to summarize user information for personalized reinforcement learning from human feedback
por: Nam, Hyunji, et al.
Publicado: (2025)
por: Nam, Hyunji, et al.
Publicado: (2025)
Complementing reinforcement learning with SFT through logit averaging in the post training of LLMs
por: Gan, Xingwei, et al.
Publicado: (2026)
por: Gan, Xingwei, et al.
Publicado: (2026)
Deep reinforcement learning for irrigation scheduling using high-dimensional sensor feedback
por: Saikai, Yuji, et al.
Publicado: (2023)
por: Saikai, Yuji, et al.
Publicado: (2023)
Convergence of a model-free entropy-regularized inverse reinforcement learning algorithm
por: Renard, Titouan, et al.
Publicado: (2024)
por: Renard, Titouan, et al.
Publicado: (2024)
Maximum diffusion reinforcement learning
por: Berrueta, Thomas A., et al.
Publicado: (2023)
por: Berrueta, Thomas A., et al.
Publicado: (2023)
Meta-Sel: Efficient Demonstration Selection for In-Context Learning via Supervised Meta-Learning
por: Wang, Xubin, et al.
Publicado: (2026)
por: Wang, Xubin, et al.
Publicado: (2026)
Ejemplares similares
-
Not all tokens are needed(NAT): token efficient reinforcement learning
por: Sang, Hejian, et al.
Publicado: (2026) -
An efficient deep reinforcement learning environment for flexible job-shop scheduling
por: Wu, Xinquan, et al.
Publicado: (2025) -
CHARME: A chain-based reinforcement learning approach for the minor embedding problem
por: Ngo, Hoang M., et al.
Publicado: (2024) -
Data-driven simulator of multi-animal behavior with unknown dynamics via offline and online reinforcement learning
por: Fujii, Keisuke, et al.
Publicado: (2025) -
Adaptive traffic signal safety and efficiency improvement by multi objective deep reinforcement learning approach
por: Mirbakhsh, Shahin, et al.
Publicado: (2024)