Reflect-then-Plan: Offline Model-Based Planning through a Doubly Bayesian Lens
Fuente:
arXiv
Salvato in:
| Autori principali: | Jeong, Jihwan, Wang, Xiaoyu, Wang, Jingmin, Sanner, Scott, Poupart, Pascal |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Doubly Mild Generalization for Offline Reinforcement Learning
di: Mao, Yixiu, et al.
Pubblicazione: (2024)
di: Mao, Yixiu, et al.
Pubblicazione: (2024)
GOPlan: Goal-conditioned Offline Reinforcement Learning by Planning with Learned Models
di: Wang, Mianchu, et al.
Pubblicazione: (2023)
di: Wang, Mianchu, et al.
Pubblicazione: (2023)
Why Online Reinforcement Learning is Causal
di: Schulte, Oliver, et al.
Pubblicazione: (2024)
di: Schulte, Oliver, et al.
Pubblicazione: (2024)
TDHook: A Lightweight Framework for Interpretability
di: Poupart, Yoann
Pubblicazione: (2025)
di: Poupart, Yoann
Pubblicazione: (2025)
Consistency Trajectory Planning: High-Quality and Efficient Trajectory Optimization for Offline Model-Based Reinforcement Learning
di: Wang, Guanquan, et al.
Pubblicazione: (2025)
di: Wang, Guanquan, et al.
Pubblicazione: (2025)
Measures of Variability for Risk-averse Policy Gradient
di: Luo, Yudong, et al.
Pubblicazione: (2025)
di: Luo, Yudong, et al.
Pubblicazione: (2025)
Multi-hop Upstream Anticipatory Traffic Signal Control with Deep Reinforcement Learning
di: Li, Xiaocan, et al.
Pubblicazione: (2024)
di: Li, Xiaocan, et al.
Pubblicazione: (2024)
IPD: Boosting Sequential Policy with Imaginary Planning Distillation in Offline Reinforcement Learning
di: Qin, Yihao, et al.
Pubblicazione: (2026)
di: Qin, Yihao, et al.
Pubblicazione: (2026)
Dynamic Obstacle Avoidance through Uncertainty-Based Adaptive Planning with Diffusion
di: Punyamoorty, Vineet, et al.
Pubblicazione: (2024)
di: Punyamoorty, Vineet, et al.
Pubblicazione: (2024)
Diffusion Models as Optimizers for Efficient Planning in Offline RL
di: Huang, Renming, et al.
Pubblicazione: (2024)
di: Huang, Renming, et al.
Pubblicazione: (2024)
Planning Transformer: Long-Horizon Offline Reinforcement Learning with Planning Tokens
di: Clinton, Joseph, et al.
Pubblicazione: (2024)
di: Clinton, Joseph, et al.
Pubblicazione: (2024)
Regularized Offline Policy Optimization with Posterior Hybrid Bayesian Belief
di: Lin, Hongqiang, et al.
Pubblicazione: (2026)
di: Lin, Hongqiang, et al.
Pubblicazione: (2026)
Goal-Space Planning with Subgoal Models
di: Lo, Chunlok, et al.
Pubblicazione: (2022)
di: Lo, Chunlok, et al.
Pubblicazione: (2022)
ConceptLens: from Pixels to Understanding
di: Dalal, Abhilekha, et al.
Pubblicazione: (2024)
di: Dalal, Abhilekha, et al.
Pubblicazione: (2024)
A Minimalist Method for Fine-tuning Text-to-Image Diffusion Models
di: Miao, Yanting, et al.
Pubblicazione: (2025)
di: Miao, Yanting, et al.
Pubblicazione: (2025)
The Reciprocity Gradient
di: Lin, Yue, et al.
Pubblicazione: (2026)
di: Lin, Yue, et al.
Pubblicazione: (2026)
A Comprehensive Survey on Inverse Constrained Reinforcement Learning: Definitions, Progress and Challenges
di: Liu, Guiliang, et al.
Pubblicazione: (2024)
di: Liu, Guiliang, et al.
Pubblicazione: (2024)
Contrastive Sparse Autoencoders for Interpreting Planning of Chess-Playing Agents
di: Poupart, Yoann
Pubblicazione: (2024)
di: Poupart, Yoann
Pubblicazione: (2024)
Spatiotemporal Forecasting as Planning: A Model-Based Reinforcement Learning Approach with Generative World Models
di: Wu, Hao, et al.
Pubblicazione: (2025)
di: Wu, Hao, et al.
Pubblicazione: (2025)
Cut Less, Fold More: Model Compression through the Lens of Projection Geometry
di: Saukh, Olga, et al.
Pubblicazione: (2026)
di: Saukh, Olga, et al.
Pubblicazione: (2026)
Reflective Planning: Vision-Language Models for Multi-Stage Long-Horizon Robotic Manipulation
di: Feng, Yunhai, et al.
Pubblicazione: (2025)
di: Feng, Yunhai, et al.
Pubblicazione: (2025)
PROPEL: Supervised and Reinforcement Learning for Large-Scale Supply Chain Planning
di: Akhlaghi, Vahid Eghbal, et al.
Pubblicazione: (2025)
di: Akhlaghi, Vahid Eghbal, et al.
Pubblicazione: (2025)
Learning to Negotiate via Voluntary Commitment
di: Zhu, Shuhui, et al.
Pubblicazione: (2025)
di: Zhu, Shuhui, et al.
Pubblicazione: (2025)
Budget-Constrained Agentic Large Language Models: Intention-Based Planning for Costly Tool Use
di: Liu, Hanbing, et al.
Pubblicazione: (2026)
di: Liu, Hanbing, et al.
Pubblicazione: (2026)
Distilling Reinforcement Learning Algorithms for In-Context Model-Based Planning
di: Son, Jaehyeon, et al.
Pubblicazione: (2025)
di: Son, Jaehyeon, et al.
Pubblicazione: (2025)
Uncertainty-based Offline Variational Bayesian Reinforcement Learning for Robustness under Diverse Data Corruptions
di: Yang, Rui, et al.
Pubblicazione: (2024)
di: Yang, Rui, et al.
Pubblicazione: (2024)
Model-Based Reinforcement Learning with Multi-Task Offline Pretraining
di: Pan, Minting, et al.
Pubblicazione: (2023)
di: Pan, Minting, et al.
Pubblicazione: (2023)
Contrastive Representation for Data Filtering in Cross-Domain Offline Reinforcement Learning
di: Wen, Xiaoyu, et al.
Pubblicazione: (2024)
di: Wen, Xiaoyu, et al.
Pubblicazione: (2024)
Policy-Based Trajectory Clustering in Offline Reinforcement Learning
di: Hu, Hao, et al.
Pubblicazione: (2025)
di: Hu, Hao, et al.
Pubblicazione: (2025)
Where's the Plan? Locating Latent Planning in Language Models with Lightweight Mechanistic Interventions
di: Ma, Nicole, et al.
Pubblicazione: (2026)
di: Ma, Nicole, et al.
Pubblicazione: (2026)
Analyzing Memorization in Large Language Models through the Lens of Model Attribution
di: Menta, Tarun Ram, et al.
Pubblicazione: (2025)
di: Menta, Tarun Ram, et al.
Pubblicazione: (2025)
CATP-LLM: Empowering Large Language Models for Cost-Aware Tool Planning
di: Wu, Duo, et al.
Pubblicazione: (2024)
di: Wu, Duo, et al.
Pubblicazione: (2024)
Neural ODE and SDE Models for Adaptation and Planning in Model-Based Reinforcement Learning
di: Han, Chao, et al.
Pubblicazione: (2026)
di: Han, Chao, et al.
Pubblicazione: (2026)
When Planning Fails Despite Correct Execution: On Epistemic Calibration for LLM-Based Multi-Agent Systems
di: Wang, Zehao, et al.
Pubblicazione: (2026)
di: Wang, Zehao, et al.
Pubblicazione: (2026)
A New View on Planning in Online Reinforcement Learning
di: Roice, Kevin, et al.
Pubblicazione: (2024)
di: Roice, Kevin, et al.
Pubblicazione: (2024)
SPIRAL: Symbolic LLM Planning via Grounded and Reflective Search
di: Zhang, Yifan, et al.
Pubblicazione: (2025)
di: Zhang, Yifan, et al.
Pubblicazione: (2025)
Reinforced Reasoning for Embodied Planning
di: Wu, Di, et al.
Pubblicazione: (2025)
di: Wu, Di, et al.
Pubblicazione: (2025)
Fast and Stable Diffusion Planning through Variational Adaptive Weighting
di: Qiu, Zhiying, et al.
Pubblicazione: (2025)
di: Qiu, Zhiying, et al.
Pubblicazione: (2025)
Enhancing LLM Planning Capabilities through Intrinsic Self-Critique
di: Bohnet, Bernd, et al.
Pubblicazione: (2025)
di: Bohnet, Bernd, et al.
Pubblicazione: (2025)
Online Incident Response Planning under Model Misspecification through Bayesian Learning and Belief Quantization
di: Hammar, Kim, et al.
Pubblicazione: (2025)
di: Hammar, Kim, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Doubly Mild Generalization for Offline Reinforcement Learning
di: Mao, Yixiu, et al.
Pubblicazione: (2024) -
GOPlan: Goal-conditioned Offline Reinforcement Learning by Planning with Learned Models
di: Wang, Mianchu, et al.
Pubblicazione: (2023) -
Why Online Reinforcement Learning is Causal
di: Schulte, Oliver, et al.
Pubblicazione: (2024) -
TDHook: A Lightweight Framework for Interpretability
di: Poupart, Yoann
Pubblicazione: (2025) -
Consistency Trajectory Planning: High-Quality and Efficient Trajectory Optimization for Offline Model-Based Reinforcement Learning
di: Wang, Guanquan, et al.
Pubblicazione: (2025)