Solving Truly Massive Budgeted Monotonic POMDPs with Oracle-Guided Meta-Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Vora, Manav, Liang, Jonas, Grussing, Michael N., Ornik, Melkior |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Welfare Maximization Algorithm for Solving Budget-Constrained Multi-Component POMDPs
di: Vora, Manav, et al.
Pubblicazione: (2023)
di: Vora, Manav, et al.
Pubblicazione: (2023)
Capacity-Aware Planning and Scheduling in Budget-Constrained Multi-Agent MDPs: A Meta-RL Approach
di: Vora, Manav, et al.
Pubblicazione: (2024)
di: Vora, Manav, et al.
Pubblicazione: (2024)
InfraLib: Enabling Reinforcement Learning and Decision-Making for Large-Scale Infrastructure Management
di: Thangeda, Pranay, et al.
Pubblicazione: (2024)
di: Thangeda, Pranay, et al.
Pubblicazione: (2024)
ComTraQ-MPC: Meta-Trained DQN-MPC Integration for Trajectory Tracking with Limited Active Localization Updates
di: Puthumanaillam, Gokul, et al.
Pubblicazione: (2024)
di: Puthumanaillam, Gokul, et al.
Pubblicazione: (2024)
Virtual Force-Based Routing of Modular Agents on a Graph
di: Casselman, Adam, et al.
Pubblicazione: (2025)
di: Casselman, Adam, et al.
Pubblicazione: (2025)
Optimizing a Model-Agnostic Measure of Graph Counterdeceptiveness via Reattachment
di: Dey, Anakin, et al.
Pubblicazione: (2023)
di: Dey, Anakin, et al.
Pubblicazione: (2023)
SCoUT: Scalable Communication via Utility-Guided Temporal Grouping in Multi-Agent Reinforcement Learning
di: Vora, Manav, et al.
Pubblicazione: (2026)
di: Vora, Manav, et al.
Pubblicazione: (2026)
A Moral Imperative: The Need for Continual Superalignment of Large Language Models
di: Puthumanaillam, Gokul, et al.
Pubblicazione: (2024)
di: Puthumanaillam, Gokul, et al.
Pubblicazione: (2024)
Ignore Drift, Embrace Simplicity: Constrained Nonlinear Control through Driftless Approximation
di: Padmanabhan, Ram, et al.
Pubblicazione: (2025)
di: Padmanabhan, Ram, et al.
Pubblicazione: (2025)
Energetic Resilience of Linear Driftless Systems
di: Padmanabhan, Ram, et al.
Pubblicazione: (2024)
di: Padmanabhan, Ram, et al.
Pubblicazione: (2024)
Input Matrix Optimization for Desired Reachable Set Warping of Linear Systems
di: Das, Hrishav, et al.
Pubblicazione: (2026)
di: Das, Hrishav, et al.
Pubblicazione: (2026)
Finite-time Reachability for Constrained, Partially Uncontrolled Nonlinear Systems
di: Padmanabhan, Ram, et al.
Pubblicazione: (2026)
di: Padmanabhan, Ram, et al.
Pubblicazione: (2026)
Hierarchical Deep Reinforcement Learning Framework for Multi-Year Asset Management Under Budget Constraints
di: Fard, Amir, et al.
Pubblicazione: (2025)
di: Fard, Amir, et al.
Pubblicazione: (2025)
The Continuous p-Dispersion Problem in Three Dimensions
di: Manoj, Sanjay, et al.
Pubblicazione: (2026)
di: Manoj, Sanjay, et al.
Pubblicazione: (2026)
Approximate Energetic Resilience of Nonlinear Systems under Partial Loss of Control Authority
di: Padmanabhan, Ram, et al.
Pubblicazione: (2025)
di: Padmanabhan, Ram, et al.
Pubblicazione: (2025)
CORL: Reinforcement Learning of MILP Policies Solved via Branch and Bound
di: Anand, Akhil S, et al.
Pubblicazione: (2025)
di: Anand, Akhil S, et al.
Pubblicazione: (2025)
Deep Reinforcement Learning for Solving the Fleet Size and Mix Vehicle Routing Problem
di: Wan, Pengfu, et al.
Pubblicazione: (2025)
di: Wan, Pengfu, et al.
Pubblicazione: (2025)
Solving Integrated Process Planning and Scheduling Problem via Graph Neural Network Based Deep Reinforcement Learning
di: Li, Hongpei, et al.
Pubblicazione: (2024)
di: Li, Hongpei, et al.
Pubblicazione: (2024)
Agentic Transformers Provably Learn to Search via Reinforcement Learning
di: Yang, Tong, et al.
Pubblicazione: (2026)
di: Yang, Tong, et al.
Pubblicazione: (2026)
Budget-aware Auto Optimizer Configurator
di: Liu, Kang, et al.
Pubblicazione: (2026)
di: Liu, Kang, et al.
Pubblicazione: (2026)
Space Exploration Architecture and Design Framework for Commercialization
di: Chen, Hao, et al.
Pubblicazione: (2021)
di: Chen, Hao, et al.
Pubblicazione: (2021)
Combining Reinforcement Learning and Optimal Transport for the Traveling Salesman Problem
di: Goh, Yong Liang, et al.
Pubblicazione: (2022)
di: Goh, Yong Liang, et al.
Pubblicazione: (2022)
CLCR: Contrastive Learning-based Constraint Reordering for Efficient MILP Solving
di: Zeng, Shuli, et al.
Pubblicazione: (2025)
di: Zeng, Shuli, et al.
Pubblicazione: (2025)
Solving Continuous Mean Field Games: Deep Reinforcement Learning for Non-Stationary Dynamics
di: Magnino, Lorenzo, et al.
Pubblicazione: (2025)
di: Magnino, Lorenzo, et al.
Pubblicazione: (2025)
Accelerating Cutting-Plane Algorithms via Reinforcement Learning Surrogates
di: Mana, Kyle, et al.
Pubblicazione: (2023)
di: Mana, Kyle, et al.
Pubblicazione: (2023)
Integrated Offline and Online Learning to Solve a Large Class of Scheduling Problems
di: Liu, Anbang, et al.
Pubblicazione: (2025)
di: Liu, Anbang, et al.
Pubblicazione: (2025)
Conformal Contraction for Robust Nonlinear Control with Distribution-Free Uncertainty Quantification
di: Wei, Sihang, et al.
Pubblicazione: (2025)
di: Wei, Sihang, et al.
Pubblicazione: (2025)
Online Learning and Control Synthesis for Reachable Paths of Unknown Nonlinear Systems
di: Meng, Yiming, et al.
Pubblicazione: (2024)
di: Meng, Yiming, et al.
Pubblicazione: (2024)
Motion Planning and Control with Unknown Nonlinear Dynamics through Predicted Reachability
di: Zhang, Zhiquan, et al.
Pubblicazione: (2025)
di: Zhang, Zhiquan, et al.
Pubblicazione: (2025)
Lion Secretly Solves Constrained Optimization: As Lyapunov Predicts
di: Chen, Lizhang, et al.
Pubblicazione: (2023)
di: Chen, Lizhang, et al.
Pubblicazione: (2023)
R2L: Reliable Reinforcement Learning: Guaranteed Return & Reliable Policies in Reinforcement Learning
di: Farhi, Nadir
Pubblicazione: (2025)
di: Farhi, Nadir
Pubblicazione: (2025)
Contextual Bilevel Reinforcement Learning for Incentive Alignment
di: Thoma, Vinzenz, et al.
Pubblicazione: (2024)
di: Thoma, Vinzenz, et al.
Pubblicazione: (2024)
Deep Reinforcement Learning for Traveling Purchaser Problems
di: Yuan, Haofeng, et al.
Pubblicazione: (2024)
di: Yuan, Haofeng, et al.
Pubblicazione: (2024)
Provable Offline Reinforcement Learning for Structured Cyclic MDPs
di: Lee, Kyungbok, et al.
Pubblicazione: (2026)
di: Lee, Kyungbok, et al.
Pubblicazione: (2026)
Faster Reinforcement Learning by Freezing Slow States
di: Wang, Yijia, et al.
Pubblicazione: (2023)
di: Wang, Yijia, et al.
Pubblicazione: (2023)
Adaptive Primal-Dual Method for Safe Reinforcement Learning
di: Chen, Weiqin, et al.
Pubblicazione: (2024)
di: Chen, Weiqin, et al.
Pubblicazione: (2024)
Performative Policy Gradient: Optimality in Performative Reinforcement Learning
di: Basu, Debabrota, et al.
Pubblicazione: (2025)
di: Basu, Debabrota, et al.
Pubblicazione: (2025)
Reinforcement Learning for Multi-Truck Vehicle Routing Problems
di: Levin, Joshua, et al.
Pubblicazione: (2022)
di: Levin, Joshua, et al.
Pubblicazione: (2022)
Hyperparameter Optimization for Driving Strategies Based on Reinforcement Learning
di: Adde, Nihal Acharya, et al.
Pubblicazione: (2024)
di: Adde, Nihal Acharya, et al.
Pubblicazione: (2024)
Solving Functional Optimization with Deep Networks and Variational Principles
di: Kamtue, Kawisorn, et al.
Pubblicazione: (2024)
di: Kamtue, Kawisorn, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Welfare Maximization Algorithm for Solving Budget-Constrained Multi-Component POMDPs
di: Vora, Manav, et al.
Pubblicazione: (2023) -
Capacity-Aware Planning and Scheduling in Budget-Constrained Multi-Agent MDPs: A Meta-RL Approach
di: Vora, Manav, et al.
Pubblicazione: (2024) -
InfraLib: Enabling Reinforcement Learning and Decision-Making for Large-Scale Infrastructure Management
di: Thangeda, Pranay, et al.
Pubblicazione: (2024) -
ComTraQ-MPC: Meta-Trained DQN-MPC Integration for Trajectory Tracking with Limited Active Localization Updates
di: Puthumanaillam, Gokul, et al.
Pubblicazione: (2024) -
Virtual Force-Based Routing of Modular Agents on a Graph
di: Casselman, Adam, et al.
Pubblicazione: (2025)