Novelty Detection in Reinforcement Learning with World Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zollicoffer, Geigh, Eaton, Kenneth, Balloch, Jonathan, Kim, Julia, Zhou, Wei, Wright, Robert, Riedl, Mark O. |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
The Interpretability of Codebooks in Model-Based Reinforcement Learning is Limited
par: Eaton, Kenneth, et autres
Publié: (2024)
par: Eaton, Kenneth, et autres
Publié: (2024)
Is Exploration All You Need? Effective Exploration Characteristics for Transfer in Reinforcement Learning
par: Balloch, Jonathan C., et autres
Publié: (2024)
par: Balloch, Jonathan C., et autres
Publié: (2024)
World Model Robustness via Surprise Recognition
par: Zollicoffer, Geigh, et autres
Publié: (2025)
par: Zollicoffer, Geigh, et autres
Publié: (2025)
External Model Motivated Agents: Reinforcement Learning for Enhanced Environment Sampling
par: Bhagat, Rishav, et autres
Publié: (2024)
par: Bhagat, Rishav, et autres
Publié: (2024)
MTRE: Multi-Token Reliability Estimation for Hallucination Detection in VLMs
par: Zollicoffer, Geigh, et autres
Publié: (2025)
par: Zollicoffer, Geigh, et autres
Publié: (2025)
Model Predictive Control-Guided Reinforcement Learning for Implicit Balancing
par: Madahi, Seyed Soroush Karimi, et autres
Publié: (2025)
par: Madahi, Seyed Soroush Karimi, et autres
Publié: (2025)
Efficient Adaptation of Reinforcement Learning Agents to Sudden Environmental Change
par: Balloch, Jonathan Clifford
Publié: (2025)
par: Balloch, Jonathan Clifford
Publié: (2025)
Traffic Smoothing Controllers for Autonomous Vehicles Using Deep Reinforcement Learning and Real-World Trajectory Data
par: Lichtlé, Nathan, et autres
Publié: (2024)
par: Lichtlé, Nathan, et autres
Publié: (2024)
Optimistic World Models: Efficient Exploration in Model-Based Deep Reinforcement Learning
par: Mete, Akshay, et autres
Publié: (2026)
par: Mete, Akshay, et autres
Publié: (2026)
AC4MPC: Actor-Critic Reinforcement Learning for Nonlinear Model Predictive Control
par: Reiter, Rudolf, et autres
Publié: (2024)
par: Reiter, Rudolf, et autres
Publié: (2024)
Reinforcement Learning with Model Predictive Control for Highway Ramp Metering
par: Airaldi, Filippo, et autres
Publié: (2023)
par: Airaldi, Filippo, et autres
Publié: (2023)
Sanity Checks for Long-Form Hallucination Detection
par: Zollicoffer, Geigh, et autres
Publié: (2026)
par: Zollicoffer, Geigh, et autres
Publié: (2026)
RL2: Reinforce Large Language Model to Assist Safe Reinforcement Learning for Energy Management of Active Distribution Networks
par: Yang, Xu, et autres
Publié: (2024)
par: Yang, Xu, et autres
Publié: (2024)
The Pump Scheduling Problem: A Real-World Scenario for Reinforcement Learning
par: Donâncio, Henrique, et autres
Publié: (2022)
par: Donâncio, Henrique, et autres
Publié: (2022)
Model Predictive Control and Reinforcement Learning: A Unified Framework Based on Dynamic Programming
par: Bertsekas, Dimitri P.
Publié: (2024)
par: Bertsekas, Dimitri P.
Publié: (2024)
Systematic Analyses of Reinforcement Learning Controllers in Signalized Urban Corridors
par: Song, Xiaofei, et autres
Publié: (2026)
par: Song, Xiaofei, et autres
Publié: (2026)
Model-Free Load Frequency Control of Nonlinear Power Systems Based on Deep Reinforcement Learning
par: Chen, Xiaodi, et autres
Publié: (2024)
par: Chen, Xiaodi, et autres
Publié: (2024)
DeepSafeMPC: Deep Learning-Based Model Predictive Control for Safe Multi-Agent Reinforcement Learning
par: Wang, Xuefeng, et autres
Publié: (2024)
par: Wang, Xuefeng, et autres
Publié: (2024)
Offline Reinforcement Learning for Microgrid Voltage Regulation
par: Yang, Shan, et autres
Publié: (2025)
par: Yang, Shan, et autres
Publié: (2025)
Iterative Learning Control-Informed Reinforcement Learning for Batch Process Control
par: Lin, Runze, et autres
Publié: (2026)
par: Lin, Runze, et autres
Publié: (2026)
Large Artificial Intelligence Model Guided Deep Reinforcement Learning for Resource Allocation in Non Terrestrial Networks
par: Ibrahim, Abdikarim Mohamed, et autres
Publié: (2026)
par: Ibrahim, Abdikarim Mohamed, et autres
Publié: (2026)
Perimeter Control with Heterogeneous Metering Rates for Cordon Signals: A Physics-Regularized Multi-Agent Reinforcement Learning Approach
par: Yu, Jiajie, et autres
Publié: (2023)
par: Yu, Jiajie, et autres
Publié: (2023)
Why Reinforcement Learning in Energy Systems Needs Explanations
par: Butt, Hallah Shahid, et autres
Publié: (2024)
par: Butt, Hallah Shahid, et autres
Publié: (2024)
A Hierarchical Signal Coordination and Control System Using a Hybrid Model-based and Reinforcement Learning Approach
par: Peng, Xianyue, et autres
Publié: (2025)
par: Peng, Xianyue, et autres
Publié: (2025)
ART for Diffusion Sampling: A Reinforcement Learning Approach to Timestep Schedule
par: Huang, Yilie, et autres
Publié: (2026)
par: Huang, Yilie, et autres
Publié: (2026)
Survey and Tutorial of Reinforcement Learning Methods in Process Systems Engineering
par: Bloor, Maximilian, et autres
Publié: (2025)
par: Bloor, Maximilian, et autres
Publié: (2025)
Advancing Humanoid Locomotion: Mastering Challenging Terrains with Denoising World Model Learning
par: Gu, Xinyang, et autres
Publié: (2024)
par: Gu, Xinyang, et autres
Publié: (2024)
Reinforcement Learning with Partial Parametric Model Knowledge
par: Wang, Shuyuan, et autres
Publié: (2023)
par: Wang, Shuyuan, et autres
Publié: (2023)
The Distribution Shift Problem in Transportation Networks using Reinforcement Learning and AI
par: Taschin, Federico, et autres
Publié: (2025)
par: Taschin, Federico, et autres
Publié: (2025)
Dual-Objective Reinforcement Learning with Novel Hamilton-Jacobi-Bellman Formulations
par: Sharpless, William, et autres
Publié: (2025)
par: Sharpless, William, et autres
Publié: (2025)
Neural Network-Assisted Model Predictive Control for Implicit Balancing
par: Madahi, Seyed Soroush Karimi, et autres
Publié: (2026)
par: Madahi, Seyed Soroush Karimi, et autres
Publié: (2026)
Multi-Goal Dexterous Hand Manipulation using Probabilistic Model-based Reinforcement Learning
par: Jiang, Yingzhuo, et autres
Publié: (2025)
par: Jiang, Yingzhuo, et autres
Publié: (2025)
Safe Deep Reinforcement Learning for Building Heating Control and Demand-side Flexibility
par: Jüni, Colin, et autres
Publié: (2026)
par: Jüni, Colin, et autres
Publié: (2026)
2-Level Reinforcement Learning for Ships on Inland Waterways: Path Planning and Following
par: Waltz, Martin, et autres
Publié: (2023)
par: Waltz, Martin, et autres
Publié: (2023)
Deep Reinforcement Learning for Power Grid Multi-Stage Cascading Failure Mitigation
par: Meng, Bo, et autres
Publié: (2025)
par: Meng, Bo, et autres
Publié: (2025)
Sublinear Regret for a Class of Continuous-Time Linear-Quadratic Reinforcement Learning Problems
par: Huang, Yilie, et autres
Publié: (2024)
par: Huang, Yilie, et autres
Publié: (2024)
Approximate Model-Based Shielding for Safe Reinforcement Learning
par: Goodall, Alexander W., et autres
Publié: (2023)
par: Goodall, Alexander W., et autres
Publié: (2023)
Safety-Aware Reinforcement Learning for Electric Vehicle Charging Station Management in Distribution Network
par: Fan, Jiarong, et autres
Publié: (2024)
par: Fan, Jiarong, et autres
Publié: (2024)
Explainable Reinforcement Learning Agents Using World Models
par: Singh, Madhuri, et autres
Publié: (2025)
par: Singh, Madhuri, et autres
Publié: (2025)
Data-Driven Exploration for a Class of Continuous-Time Indefinite Linear--Quadratic Reinforcement Learning Problems
par: Huang, Yilie, et autres
Publié: (2025)
par: Huang, Yilie, et autres
Publié: (2025)
Documents similaires
-
The Interpretability of Codebooks in Model-Based Reinforcement Learning is Limited
par: Eaton, Kenneth, et autres
Publié: (2024) -
Is Exploration All You Need? Effective Exploration Characteristics for Transfer in Reinforcement Learning
par: Balloch, Jonathan C., et autres
Publié: (2024) -
World Model Robustness via Surprise Recognition
par: Zollicoffer, Geigh, et autres
Publié: (2025) -
External Model Motivated Agents: Reinforcement Learning for Enhanced Environment Sampling
par: Bhagat, Rishav, et autres
Publié: (2024) -
MTRE: Multi-Token Reliability Estimation for Hallucination Detection in VLMs
par: Zollicoffer, Geigh, et autres
Publié: (2025)