Decision Making in Non-Stationary Environments with Policy-Augmented Search
Fuente:
arXiv
Salvato in:
| Autori principali: | Pettet, Ava, Zhang, Yunuo, Luo, Baiting, Wray, Kyle, Baier, Hendrik, Laszka, Aron, Dubey, Abhishek, Mukhopadhyay, Ayan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Scalable Decision-Making in Stochastic Environments through Learned Temporal Abstraction
di: Luo, Baiting, et al.
Pubblicazione: (2025)
di: Luo, Baiting, et al.
Pubblicazione: (2025)
NS-Gym: Open-Source Simulation Environments and Benchmarks for Non-Stationary Markov Decision Processes
di: Keplinger, Nathaniel S., et al.
Pubblicazione: (2025)
di: Keplinger, Nathaniel S., et al.
Pubblicazione: (2025)
Act as You Learn: Adaptive Decision-Making in Non-Stationary Markov Decision Processes
di: Luo, Baiting, et al.
Pubblicazione: (2024)
di: Luo, Baiting, et al.
Pubblicazione: (2024)
Observation Adaptation via Annealed Importance Resampling for Partially Observable Markov Decision Processes
di: Zhang, Yunuo, et al.
Pubblicazione: (2025)
di: Zhang, Yunuo, et al.
Pubblicazione: (2025)
ESCORT: Efficient Stein-variational and Sliced Consistency-Optimized Temporal Belief Representation for POMDPs
di: Zhang, Yunuo, et al.
Pubblicazione: (2025)
di: Zhang, Yunuo, et al.
Pubblicazione: (2025)
Dynamic Vehicle Routing Problem with Prompt Confirmation of Advance Requests
di: Sivagnanam, Amutheezan, et al.
Pubblicazione: (2026)
di: Sivagnanam, Amutheezan, et al.
Pubblicazione: (2026)
Online Decision-Making Under Uncertainty for Vehicle-to-Building Systems
di: Sen, Rishav, et al.
Pubblicazione: (2026)
di: Sen, Rishav, et al.
Pubblicazione: (2026)
Multi-Agent Reinforcement Learning with Hierarchical Coordination for Emergency Responder Stationing
di: Sivagnanam, Amutheezan, et al.
Pubblicazione: (2024)
di: Sivagnanam, Amutheezan, et al.
Pubblicazione: (2024)
In-Context Planning with Latent Temporal Abstractions
di: Luo, Baiting, et al.
Pubblicazione: (2026)
di: Luo, Baiting, et al.
Pubblicazione: (2026)
Enabling MCTS Explainability for Sequential Planning Through Computation Tree Logic
di: An, Ziyan, et al.
Pubblicazione: (2024)
di: An, Ziyan, et al.
Pubblicazione: (2024)
Grid-Aware Charging and Operational Optimization for Mixed-Fleet Public Transit
di: Sen, Rishav, et al.
Pubblicazione: (2026)
di: Sen, Rishav, et al.
Pubblicazione: (2026)
Forecasting and Mitigating Disruptions in Public Bus Transit Services
di: Han, Chaeeun, et al.
Pubblicazione: (2024)
di: Han, Chaeeun, et al.
Pubblicazione: (2024)
Shrinking POMCP: A Framework for Real-Time UAV Search and Rescue
di: Zhang, Yunuo, et al.
Pubblicazione: (2024)
di: Zhang, Yunuo, et al.
Pubblicazione: (2024)
Reinforcement Learning-based Approach for Vehicle-to-Building Charging with Heterogeneous Agents and Long Term Rewards
di: Liu, Fangqi, et al.
Pubblicazione: (2025)
di: Liu, Fangqi, et al.
Pubblicazione: (2025)
Combining LLMs with Logic-Based Framework to Explain MCTS
di: An, Ziyan, et al.
Pubblicazione: (2025)
di: An, Ziyan, et al.
Pubblicazione: (2025)
CONSENT: A Negotiation Framework for Leveraging User Flexibility in Vehicle-to-Building Charging under Uncertainty
di: Sen, Rishav, et al.
Pubblicazione: (2026)
di: Sen, Rishav, et al.
Pubblicazione: (2026)
Column Generation for the Micro-Transit Zoning Problem
di: Hu, Hins, et al.
Pubblicazione: (2026)
di: Hu, Hins, et al.
Pubblicazione: (2026)
Ensemble Prediction of Task Affinity for Efficient Multi-Task Learning
di: Ayman, Afiya, et al.
Pubblicazione: (2026)
di: Ayman, Afiya, et al.
Pubblicazione: (2026)
Adversarial Reinforcement Learning for Detecting False Data Injection Attacks in Vehicular Routing
di: Eghtesad, Taha, et al.
Pubblicazione: (2026)
di: Eghtesad, Taha, et al.
Pubblicazione: (2026)
MoveOD: Synthesizing Origin-Destination Commute Distribution from U.S. Census Data
di: Sen, Rishav, et al.
Pubblicazione: (2025)
di: Sen, Rishav, et al.
Pubblicazione: (2025)
An Online Approach to Solving Public Transit Stationing and Dispatch Problem
di: Talusan, Jose Paolo, et al.
Pubblicazione: (2024)
di: Talusan, Jose Paolo, et al.
Pubblicazione: (2024)
Multi-Agent Reinforcement Learning for Assessing False-Data Injection Attacks on Transportation Networks
di: Eghtesad, Taha, et al.
Pubblicazione: (2023)
di: Eghtesad, Taha, et al.
Pubblicazione: (2023)
DiPRL: Learning Discrete Programmatic Policies via Architecture Entropy Regularization
di: Hu, Chengpeng, et al.
Pubblicazione: (2026)
di: Hu, Chengpeng, et al.
Pubblicazione: (2026)
Optimized Monte Carlo Tree Search for Enhanced Decision Making in the FrozenLake Environment
di: Guerra, Esteban Aldana
Pubblicazione: (2024)
di: Guerra, Esteban Aldana
Pubblicazione: (2024)
Exploration and Adaptation in Non-Stationary Tasks with Diffusion Policies
di: Baveja, Gunbir Singh
Pubblicazione: (2025)
di: Baveja, Gunbir Singh
Pubblicazione: (2025)
Adapting to Non-Stationary Environments: Multi-Armed Bandit Enhanced Retrieval-Augmented Generation on Knowledge Graphs
di: Tang, Xiaqiang, et al.
Pubblicazione: (2024)
di: Tang, Xiaqiang, et al.
Pubblicazione: (2024)
Addressing Moral Uncertainty using Large Language Models for Ethical Decision-Making
di: Dubey, Rohit K., et al.
Pubblicazione: (2025)
di: Dubey, Rohit K., et al.
Pubblicazione: (2025)
Online Reinforcement Learning in Non-Stationary Context-Driven Environments
di: Hamadanian, Pouya, et al.
Pubblicazione: (2023)
di: Hamadanian, Pouya, et al.
Pubblicazione: (2023)
Lipschitz Lifelong Monte Carlo Tree Search for Mastering Non-Stationary Tasks
di: Zhang, Zuyuan, et al.
Pubblicazione: (2025)
di: Zhang, Zuyuan, et al.
Pubblicazione: (2025)
Toward Template-Free Explainability for Monte Carlo Tree Search
di: Lu, Siqi, et al.
Pubblicazione: (2026)
di: Lu, Siqi, et al.
Pubblicazione: (2026)
One-shot Imitation in a Non-Stationary Environment via Multi-Modal Skill
di: Shin, Sangwoo, et al.
Pubblicazione: (2024)
di: Shin, Sangwoo, et al.
Pubblicazione: (2024)
ADESSE: Advice Explanations in Complex Repeated Decision-Making Environments
di: Schleibaum, Sören, et al.
Pubblicazione: (2024)
di: Schleibaum, Sören, et al.
Pubblicazione: (2024)
RASP-Tuner: Retrieval-Augmented Soft Prompts for Context-Aware Black-Box Optimization in Non-Stationary Environments
di: Pan, Enze
Pubblicazione: (2026)
di: Pan, Enze
Pubblicazione: (2026)
MARLINE: Multi-Source Mapping Transfer Learning for Non-Stationary Environments
di: Du, Honghui, et al.
Pubblicazione: (2025)
di: Du, Honghui, et al.
Pubblicazione: (2025)
Quantifying the Accuracy and Cost Impact of Design Decisions in Budget-Constrained Agentic LLM Search
di: McCleary, Kyle, et al.
Pubblicazione: (2026)
di: McCleary, Kyle, et al.
Pubblicazione: (2026)
Multi-Objective Multi-Agent Path Finding with Lexicographic Cost Preferences
di: Rustagi, Pulkit, et al.
Pubblicazione: (2025)
di: Rustagi, Pulkit, et al.
Pubblicazione: (2025)
Scheduling That Speaks: An Interpretable Programmatic Reinforcement Learning Framework
di: Hu, Chengpeng, et al.
Pubblicazione: (2026)
di: Hu, Chengpeng, et al.
Pubblicazione: (2026)
Few-Shot Adaptation to Non-Stationary Environments via Latent Trend Embedding for Robotics
di: Fujii, Yasuyuki, et al.
Pubblicazione: (2026)
di: Fujii, Yasuyuki, et al.
Pubblicazione: (2026)
Detecting Model Drifts in Non-Stationary Environment Using Edit Operation Measures
di: Lee, Chang-Hwan, et al.
Pubblicazione: (2025)
di: Lee, Chang-Hwan, et al.
Pubblicazione: (2025)
A Semi-Decentralized Approach to Multiagent Control
di: Al-Husseini, Mahdi, et al.
Pubblicazione: (2026)
di: Al-Husseini, Mahdi, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Scalable Decision-Making in Stochastic Environments through Learned Temporal Abstraction
di: Luo, Baiting, et al.
Pubblicazione: (2025) -
NS-Gym: Open-Source Simulation Environments and Benchmarks for Non-Stationary Markov Decision Processes
di: Keplinger, Nathaniel S., et al.
Pubblicazione: (2025) -
Act as You Learn: Adaptive Decision-Making in Non-Stationary Markov Decision Processes
di: Luo, Baiting, et al.
Pubblicazione: (2024) -
Observation Adaptation via Annealed Importance Resampling for Partially Observable Markov Decision Processes
di: Zhang, Yunuo, et al.
Pubblicazione: (2025) -
ESCORT: Efficient Stein-variational and Sliced Consistency-Optimized Temporal Belief Representation for POMDPs
di: Zhang, Yunuo, et al.
Pubblicazione: (2025)