In-Context Reinforcement Learning through Bayesian Fusion of Context and Value Prior
Fuente:
arXiv
Salvato in:
| Autori principali: | Berkes, Anaïs, Taboga, Vincent, Vakalis, Donna, Rolnick, David, Bengio, Yoshua |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
HVAC-DPT: A Decision Pretrained Transformer for HVAC Control
di: Berkes, Anaïs
Pubblicazione: (2024)
di: Berkes, Anaïs
Pubblicazione: (2024)
In-Context Parametric Inference: Point or Distribution Estimators?
di: Mittal, Sarthak, et al.
Pubblicazione: (2025)
di: Mittal, Sarthak, et al.
Pubblicazione: (2025)
Assessing SAM for Tree Crown Instance Segmentation from Drone Imagery
di: Teng, Mélisande, et al.
Pubblicazione: (2025)
di: Teng, Mélisande, et al.
Pubblicazione: (2025)
Consciousness-Inspired Spatio-Temporal Abstractions for Better Generalization in Reinforcement Learning
di: Zhao, Mingde, et al.
Pubblicazione: (2023)
di: Zhao, Mingde, et al.
Pubblicazione: (2023)
Shaping Inductive Bias in Diffusion Models through Frequency-Based Noise Control
di: Jiralerspong, Thomas, et al.
Pubblicazione: (2025)
di: Jiralerspong, Thomas, et al.
Pubblicazione: (2025)
GFlowNet Foundations
di: Bengio, Yoshua, et al.
Pubblicazione: (2021)
di: Bengio, Yoshua, et al.
Pubblicazione: (2021)
Discrete, compositional, and symbolic representations through attractor dynamics
di: Nam, Andrew, et al.
Pubblicazione: (2023)
di: Nam, Andrew, et al.
Pubblicazione: (2023)
Monte Carlo Tree Diffusion for System 2 Planning
di: Yoon, Jaesik, et al.
Pubblicazione: (2025)
di: Yoon, Jaesik, et al.
Pubblicazione: (2025)
A Complexity-Based Theory of Compositionality
di: Elmoznino, Eric, et al.
Pubblicazione: (2024)
di: Elmoznino, Eric, et al.
Pubblicazione: (2024)
Towards Climate Variable Prediction with Conditioned Spatio-Temporal Normalizing Flows
di: Winkler, Christina, et al.
Pubblicazione: (2023)
di: Winkler, Christina, et al.
Pubblicazione: (2023)
Diffusion Generative Flow Samplers: Improving learning signals through partial trajectory optimization
di: Zhang, Dinghuai, et al.
Pubblicazione: (2023)
di: Zhang, Dinghuai, et al.
Pubblicazione: (2023)
Were RNNs All We Needed?
di: Feng, Leo, et al.
Pubblicazione: (2024)
di: Feng, Leo, et al.
Pubblicazione: (2024)
FALCON: Few-step Accurate Likelihoods for Continuous Flows
di: Rehman, Danyal, et al.
Pubblicazione: (2025)
di: Rehman, Danyal, et al.
Pubblicazione: (2025)
Mixture-of-Experts Meets In-Context Reinforcement Learning
di: Wu, Wenhao, et al.
Pubblicazione: (2025)
di: Wu, Wenhao, et al.
Pubblicazione: (2025)
Towards Monotonic Improvement in In-Context Reinforcement Learning
di: Zhang, Wenhao, et al.
Pubblicazione: (2025)
di: Zhang, Wenhao, et al.
Pubblicazione: (2025)
In-Context Reinforcement Learning for Variable Action Spaces
di: Sinii, Viacheslav, et al.
Pubblicazione: (2023)
di: Sinii, Viacheslav, et al.
Pubblicazione: (2023)
In-Context Compositional Q-Learning for Offline Reinforcement Learning
di: Xu, Qiushui, et al.
Pubblicazione: (2025)
di: Xu, Qiushui, et al.
Pubblicazione: (2025)
Efficient Causal Graph Discovery Using Large Language Models
di: Jiralerspong, Thomas, et al.
Pubblicazione: (2024)
di: Jiralerspong, Thomas, et al.
Pubblicazione: (2024)
Reward Redistribution for CVaR MDPs using a Bellman Operator on L-infinity
di: Muni, Aneri, et al.
Pubblicazione: (2026)
di: Muni, Aneri, et al.
Pubblicazione: (2026)
Expert-Guided LLM Reasoning for Battery Discovery: From AI-Driven Hypothesis to Synthesis and Characterization
di: Liu, Shengchao, et al.
Pubblicazione: (2025)
di: Liu, Shengchao, et al.
Pubblicazione: (2025)
Active Attacks: Red-teaming LLMs via Adaptive Environments
di: Yun, Taeyoung, et al.
Pubblicazione: (2025)
di: Yun, Taeyoung, et al.
Pubblicazione: (2025)
Context-Sensitive Abstractions for Reinforcement Learning with Parameterized Actions
di: Nayyar, Rashmeet Kaur, et al.
Pubblicazione: (2025)
di: Nayyar, Rashmeet Kaur, et al.
Pubblicazione: (2025)
In-Context Reinforcement Learning via Communicative World Models
di: Martinez-Lopez, Fernando, et al.
Pubblicazione: (2025)
di: Martinez-Lopez, Fernando, et al.
Pubblicazione: (2025)
Statistical Context Detection for Deep Lifelong Reinforcement Learning
di: Dick, Jeffery, et al.
Pubblicazione: (2024)
di: Dick, Jeffery, et al.
Pubblicazione: (2024)
Heuristic Transformer: Belief Augmented In-Context Reinforcement Learning
di: Dippel, Oliver, et al.
Pubblicazione: (2025)
di: Dippel, Oliver, et al.
Pubblicazione: (2025)
Amortized In-Context Bayesian Posterior Estimation
di: Mittal, Sarthak, et al.
Pubblicazione: (2025)
di: Mittal, Sarthak, et al.
Pubblicazione: (2025)
Distributional GFlowNets with Quantile Flows
di: Zhang, Dinghuai, et al.
Pubblicazione: (2023)
di: Zhang, Dinghuai, et al.
Pubblicazione: (2023)
FSP-Laplace: Function-Space Priors for the Laplace Approximation in Bayesian Deep Learning
di: Cinquin, Tristan, et al.
Pubblicazione: (2024)
di: Cinquin, Tristan, et al.
Pubblicazione: (2024)
Learning What Matters: Steering Diffusion via Spectrally Anisotropic Forward Noise
di: Scimeca, Luca, et al.
Pubblicazione: (2025)
di: Scimeca, Luca, et al.
Pubblicazione: (2025)
Relational In-Context Learning via Synthetic Pre-training with Structural Prior
di: Wang, Yanbo, et al.
Pubblicazione: (2026)
di: Wang, Yanbo, et al.
Pubblicazione: (2026)
Structure-Aligned Protein Language Model
di: Chen, Can, et al.
Pubblicazione: (2025)
di: Chen, Can, et al.
Pubblicazione: (2025)
Transformers Provably Implement In-Context Reinforcement Learning with Policy Improvement
di: Liang, Haodong, et al.
Pubblicazione: (2026)
di: Liang, Haodong, et al.
Pubblicazione: (2026)
Distilling Reinforcement Learning Algorithms for In-Context Model-Based Planning
di: Son, Jaehyeon, et al.
Pubblicazione: (2025)
di: Son, Jaehyeon, et al.
Pubblicazione: (2025)
Online Reinforcement Learning in Non-Stationary Context-Driven Environments
di: Hamadanian, Pouya, et al.
Pubblicazione: (2023)
di: Hamadanian, Pouya, et al.
Pubblicazione: (2023)
Generative Diffusion Prior Distillation for Long-Context Knowledge Transfer
di: Udayangani, Nilushika, et al.
Pubblicazione: (2026)
di: Udayangani, Nilushika, et al.
Pubblicazione: (2026)
Action abstractions for amortized sampling
di: Boussif, Oussama, et al.
Pubblicazione: (2024)
di: Boussif, Oussama, et al.
Pubblicazione: (2024)
Can Safety Fine-Tuning Be More Principled? Lessons Learned from Cybersecurity
di: Williams-King, David, et al.
Pubblicazione: (2025)
di: Williams-King, David, et al.
Pubblicazione: (2025)
Solving Bayesian inverse problems with diffusion priors and off-policy RL
di: Scimeca, Luca, et al.
Pubblicazione: (2025)
di: Scimeca, Luca, et al.
Pubblicazione: (2025)
Mitigating Shortcut Learning with Diffusion Counterfactuals and Diverse Ensembles
di: Scimeca, Luca, et al.
Pubblicazione: (2023)
di: Scimeca, Luca, et al.
Pubblicazione: (2023)
Vintix: Action Model via In-Context Reinforcement Learning
di: Polubarov, Andrey, et al.
Pubblicazione: (2025)
di: Polubarov, Andrey, et al.
Pubblicazione: (2025)
Documenti analoghi
-
HVAC-DPT: A Decision Pretrained Transformer for HVAC Control
di: Berkes, Anaïs
Pubblicazione: (2024) -
In-Context Parametric Inference: Point or Distribution Estimators?
di: Mittal, Sarthak, et al.
Pubblicazione: (2025) -
Assessing SAM for Tree Crown Instance Segmentation from Drone Imagery
di: Teng, Mélisande, et al.
Pubblicazione: (2025) -
Consciousness-Inspired Spatio-Temporal Abstractions for Better Generalization in Reinforcement Learning
di: Zhao, Mingde, et al.
Pubblicazione: (2023) -
Shaping Inductive Bias in Diffusion Models through Frequency-Based Noise Control
di: Jiralerspong, Thomas, et al.
Pubblicazione: (2025)