What type of inference is planning?
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Lázaro-Gredilla, Miguel, Ku, Li Yang, Murphy, Kevin P., George, Dileep |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Learning Cognitive Maps from Transformer Representations for Efficient Planning in Partially Observed Environments
par: Dedieu, Antoine, et autres
Publié: (2024)
par: Dedieu, Antoine, et autres
Publié: (2024)
Improving Transformer World Models for Data-Efficient RL
par: Dedieu, Antoine, et autres
Publié: (2025)
par: Dedieu, Antoine, et autres
Publié: (2025)
Diffusion Model Predictive Control
par: Zhou, Guangyao, et autres
Publié: (2024)
par: Zhou, Guangyao, et autres
Publié: (2024)
Reinforcement Learning: An Overview
par: Murphy, Kevin
Publié: (2024)
par: Murphy, Kevin
Publié: (2024)
Dynamic planning in hierarchical active inference
par: Priorelli, Matteo, et autres
Publié: (2024)
par: Priorelli, Matteo, et autres
Publié: (2024)
On Predictive planning and counterfactual learning in active inference
par: Paul, Aswin, et autres
Publié: (2024)
par: Paul, Aswin, et autres
Publié: (2024)
Model Predictive Simulation Using Structured Graphical Models and Transformers
par: Lou, Xinghua, et autres
Publié: (2024)
par: Lou, Xinghua, et autres
Publié: (2024)
AutoHarness: improving LLM agents by automatically synthesizing a code harness
par: Lou, Xinghua, et autres
Publié: (2026)
par: Lou, Xinghua, et autres
Publié: (2026)
Joint Learning of Hierarchical Neural Options and Abstract World Model
par: Piriyakulkij, Wasu Top, et autres
Publié: (2026)
par: Piriyakulkij, Wasu Top, et autres
Publié: (2026)
Federated Ensemble-Directed Offline Reinforcement Learning
par: Rengarajan, Desik, et autres
Publié: (2023)
par: Rengarajan, Desik, et autres
Publié: (2023)
What's the plan? Metrics for implicit planning in LLMs and their application to rhyme generation and question answering
par: Maar, Jim, et autres
Publié: (2026)
par: Maar, Jim, et autres
Publié: (2026)
Diffusion model for relational inference
par: Zheng, Shuhan, et autres
Publié: (2024)
par: Zheng, Shuhan, et autres
Publié: (2024)
Retro-fallback: retrosynthetic planning in an uncertain world
par: Tripp, Austin, et autres
Publié: (2023)
par: Tripp, Austin, et autres
Publié: (2023)
From Generalist to Specialist Representation
par: Zheng, Yujia, et autres
Publié: (2026)
par: Zheng, Yujia, et autres
Publié: (2026)
Dual policy as self-model for planning
par: Yoo, Jaesung, et autres
Publié: (2023)
par: Yoo, Jaesung, et autres
Publié: (2023)
Robust LLM Alignment via Distributionally Robust Direct Preference Optimization
par: Xu, Zaiyan, et autres
Publié: (2025)
par: Xu, Zaiyan, et autres
Publié: (2025)
What makes Reasoning Models Different? Follow the Reasoning Leader for Efficient Decoding
par: Li, Ming, et autres
Publié: (2025)
par: Li, Ming, et autres
Publié: (2025)
All-in-one simulation-based inference
par: Gloeckler, Manuel, et autres
Publié: (2024)
par: Gloeckler, Manuel, et autres
Publié: (2024)
Time-Varying Constraint-Aware Reinforcement Learning for Energy Storage Control
par: Jeong, Jaeik, et autres
Publié: (2024)
par: Jeong, Jaeik, et autres
Publié: (2024)
Conformalized Neural Networks for Federated Uncertainty Quantification under Dual Heterogeneity
par: Nguyen, Quang-Huy, et autres
Publié: (2026)
par: Nguyen, Quang-Huy, et autres
Publié: (2026)
Explainability as statistical inference
par: Senetaire, Hugo Henri Joseph, et autres
Publié: (2022)
par: Senetaire, Hugo Henri Joseph, et autres
Publié: (2022)
Optimistic World Models: Efficient Exploration in Model-Based Deep Reinforcement Learning
par: Mete, Akshay, et autres
Publié: (2026)
par: Mete, Akshay, et autres
Publié: (2026)
Rotated Runtime Smooth: Training-Free Activation Smoother for accurate INT4 inference
par: Yi, Ke, et autres
Publié: (2024)
par: Yi, Ke, et autres
Publié: (2024)
Curiosity-driven RL for symbolic equation solving
par: O'Keeffe, Kevin P.
Publié: (2025)
par: O'Keeffe, Kevin P.
Publié: (2025)
Cross-Entropy Optimization for Hyperparameter Optimization in Stochastic Gradient-based Approaches to Train Deep Neural Networks
par: Li, Kevin, et autres
Publié: (2024)
par: Li, Kevin, et autres
Publié: (2024)
Simulating the Unseen: Crash Prediction Must Learn from What Did Not Happen
par: Li, Zihao, et autres
Publié: (2025)
par: Li, Zihao, et autres
Publié: (2025)
EM Distillation for One-step Diffusion Models
par: Xie, Sirui, et autres
Publié: (2024)
par: Xie, Sirui, et autres
Publié: (2024)
Missing Data Multiple Imputation for Tabular Q-Learning in Online RL
par: Chasalow, Kyla, et autres
Publié: (2025)
par: Chasalow, Kyla, et autres
Publié: (2025)
Delving into Instance-Dependent Label Noise in Graph Data: A Comprehensive Study and Benchmark
par: Kim, Suyeon, et autres
Publié: (2025)
par: Kim, Suyeon, et autres
Publié: (2025)
LLM enhanced graph inference for long-term disease progression modelling
par: He, Tiantian, et autres
Publié: (2025)
par: He, Tiantian, et autres
Publié: (2025)
Diffusion Tree Sampling: Scalable inference-time alignment of diffusion models
par: Jain, Vineet, et autres
Publié: (2025)
par: Jain, Vineet, et autres
Publié: (2025)
Learning to refine domain knowledge for biological network inference
par: Li, Peiwen, et autres
Publié: (2024)
par: Li, Peiwen, et autres
Publié: (2024)
Does "Do Differentiable Simulators Give Better Policy Gradients?'' Give Better Policy Gradients?
par: Onoda, Ku, et autres
Publié: (2026)
par: Onoda, Ku, et autres
Publié: (2026)
Remedying uncertainty representations in visual inference through Explaining-Away Variational Autoencoders
par: Catoni, Josefina, et autres
Publié: (2024)
par: Catoni, Josefina, et autres
Publié: (2024)
Electrostatics-based particle sampling and approximate inference
par: Huang, Yongchao
Publié: (2024)
par: Huang, Yongchao
Publié: (2024)
Post-detection inference for sequential changepoint localization
par: Saha, Aytijhya, et autres
Publié: (2025)
par: Saha, Aytijhya, et autres
Publié: (2025)
Beyond What to Select: A Plug-and-play Oscillatory Data-Volume Scheduling for Efficient Model Training
par: Yang, Suorong, et autres
Publié: (2026)
par: Yang, Suorong, et autres
Publié: (2026)
Using large language models for embodied planning introduces systematic safety risks
par: Zhang, Tao, et autres
Publié: (2026)
par: Zhang, Tao, et autres
Publié: (2026)
What Makes a Good Diffusion Planner for Decision Making?
par: Lu, Haofei, et autres
Publié: (2025)
par: Lu, Haofei, et autres
Publié: (2025)
GeoUni: A Unified Model for Generating Geometry Diagrams, Problems and Problem Solutions
par: Cheng, Jo-Ku, et autres
Publié: (2025)
par: Cheng, Jo-Ku, et autres
Publié: (2025)
Documents similaires
-
Learning Cognitive Maps from Transformer Representations for Efficient Planning in Partially Observed Environments
par: Dedieu, Antoine, et autres
Publié: (2024) -
Improving Transformer World Models for Data-Efficient RL
par: Dedieu, Antoine, et autres
Publié: (2025) -
Diffusion Model Predictive Control
par: Zhou, Guangyao, et autres
Publié: (2024) -
Reinforcement Learning: An Overview
par: Murphy, Kevin
Publié: (2024) -
Dynamic planning in hierarchical active inference
par: Priorelli, Matteo, et autres
Publié: (2024)