Heuristic Transformer: Belief Augmented In-Context Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Dippel, Oliver, Lisitsa, Alexei, Peng, Bei |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Multi-Robot Path Planning Combining Heuristics and Multi-Agent Reinforcement Learning
di: Peng, Shaoming
Pubblicazione: (2023)
di: Peng, Shaoming
Pubblicazione: (2023)
Conceptual Belief-Informed Reinforcement Learning
di: Gu, Xingrui, et al.
Pubblicazione: (2024)
di: Gu, Xingrui, et al.
Pubblicazione: (2024)
Belief or Circuitry? Causal Evidence for In-Context Graph Learning
di: Kowalyshyn, Katharine, et al.
Pubblicazione: (2026)
di: Kowalyshyn, Katharine, et al.
Pubblicazione: (2026)
Impartial Games: A Challenge for Reinforcement Learning
di: Zhou, Bei, et al.
Pubblicazione: (2022)
di: Zhou, Bei, et al.
Pubblicazione: (2022)
Transformers Provably Implement In-Context Reinforcement Learning with Policy Improvement
di: Liang, Haodong, et al.
Pubblicazione: (2026)
di: Liang, Haodong, et al.
Pubblicazione: (2026)
In-Context Decision Transformer: Reinforcement Learning via Hierarchical Chain-of-Thought
di: Huang, Sili, et al.
Pubblicazione: (2024)
di: Huang, Sili, et al.
Pubblicazione: (2024)
Vanishing Bias Heuristic-guided Reinforcement Learning Algorithm
di: Li, Qinru, et al.
Pubblicazione: (2023)
di: Li, Qinru, et al.
Pubblicazione: (2023)
Reinforcement Learning-based Heuristics to Guide Domain-Independent Dynamic Programming
di: Narita, Minori, et al.
Pubblicazione: (2025)
di: Narita, Minori, et al.
Pubblicazione: (2025)
Deep Reinforcement Learning Guided Improvement Heuristic for Job Shop Scheduling
di: Zhang, Cong, et al.
Pubblicazione: (2022)
di: Zhang, Cong, et al.
Pubblicazione: (2022)
Circuits, Features, and Heuristics in Molecular Transformers
di: Varadi, Kristof, et al.
Pubblicazione: (2025)
di: Varadi, Kristof, et al.
Pubblicazione: (2025)
Learning in Context, Guided by Choice: A Reward-Free Paradigm for Reinforcement Learning with Transformers
di: Dong, Juncheng, et al.
Pubblicazione: (2026)
di: Dong, Juncheng, et al.
Pubblicazione: (2026)
Return Augmented Decision Transformer for Off-Dynamics Reinforcement Learning
di: Wang, Ruhan, et al.
Pubblicazione: (2024)
di: Wang, Ruhan, et al.
Pubblicazione: (2024)
Generative Pre-Trained Transformer for Symbolic Regression Base In-Context Reinforcement Learning
di: Li, Yanjie, et al.
Pubblicazione: (2024)
di: Li, Yanjie, et al.
Pubblicazione: (2024)
Extracting Heuristics from Large Language Models for Reward Shaping in Reinforcement Learning
di: Bhambri, Siddhant, et al.
Pubblicazione: (2024)
di: Bhambri, Siddhant, et al.
Pubblicazione: (2024)
Belief-Based Offline Reinforcement Learning for Delay-Robust Policy Optimization
di: Zhan, Simon Sinong, et al.
Pubblicazione: (2025)
di: Zhan, Simon Sinong, et al.
Pubblicazione: (2025)
FlowCritic: Bridging Value Estimation with Flow Matching in Reinforcement Learning
di: Zhong, Shan, et al.
Pubblicazione: (2025)
di: Zhong, Shan, et al.
Pubblicazione: (2025)
KernelBlaster: Continual Cross-Task CUDA Optimization via Memory-Augmented In-Context Reinforcement Learning
di: Dong, Kris Shengjun, et al.
Pubblicazione: (2026)
di: Dong, Kris Shengjun, et al.
Pubblicazione: (2026)
Belief States for Cooperative Multi-Agent Reinforcement Learning under Partial Observability
di: Pritz, Paul J., et al.
Pubblicazione: (2025)
di: Pritz, Paul J., et al.
Pubblicazione: (2025)
Heuristic Algorithm-based Action Masking Reinforcement Learning (HAAM-RL) with Ensemble Inference Method
di: Choi, Kyuwon, et al.
Pubblicazione: (2024)
di: Choi, Kyuwon, et al.
Pubblicazione: (2024)
Solving Collaborative Dec-POMDPs with Deep Reinforcement Learning Heuristics
di: Soffair, Nitsan
Pubblicazione: (2022)
di: Soffair, Nitsan
Pubblicazione: (2022)
Stories in Space: In-Context Learning Trajectories in Conceptual Belief Space
di: Bigelow, Eric, et al.
Pubblicazione: (2026)
di: Bigelow, Eric, et al.
Pubblicazione: (2026)
The Belief State Transformer
di: Hu, Edward S., et al.
Pubblicazione: (2024)
di: Hu, Edward S., et al.
Pubblicazione: (2024)
The Clever Hans Effect in Unsupervised Learning
di: Kauffmann, Jacob, et al.
Pubblicazione: (2024)
di: Kauffmann, Jacob, et al.
Pubblicazione: (2024)
Learning Memory-Enhanced Improvement Heuristics for Flexible Job Shop Scheduling
di: Wang, Jiaqi, et al.
Pubblicazione: (2026)
di: Wang, Jiaqi, et al.
Pubblicazione: (2026)
Investigation into In-Context Learning Capabilities of Transformers
di: Chandrupatla, Rushil, et al.
Pubblicazione: (2026)
di: Chandrupatla, Rushil, et al.
Pubblicazione: (2026)
In-Context Compositional Q-Learning for Offline Reinforcement Learning
di: Xu, Qiushui, et al.
Pubblicazione: (2025)
di: Xu, Qiushui, et al.
Pubblicazione: (2025)
In-Context Reinforcement Learning through Bayesian Fusion of Context and Value Prior
di: Berkes, Anaïs, et al.
Pubblicazione: (2026)
di: Berkes, Anaïs, et al.
Pubblicazione: (2026)
Heterogeneous Knowledge for Augmented Modular Reinforcement Learning
di: Wolf, Lorenz, et al.
Pubblicazione: (2023)
di: Wolf, Lorenz, et al.
Pubblicazione: (2023)
Mixture-of-Experts Meets In-Context Reinforcement Learning
di: Wu, Wenhao, et al.
Pubblicazione: (2025)
di: Wu, Wenhao, et al.
Pubblicazione: (2025)
Towards Monotonic Improvement in In-Context Reinforcement Learning
di: Zhang, Wenhao, et al.
Pubblicazione: (2025)
di: Zhang, Wenhao, et al.
Pubblicazione: (2025)
In-Context Reinforcement Learning for Variable Action Spaces
di: Sinii, Viacheslav, et al.
Pubblicazione: (2023)
di: Sinii, Viacheslav, et al.
Pubblicazione: (2023)
One for All: A Non-Linear Transformer can Enable Cross-Domain Generalization for In-Context Reinforcement Learning
di: He, Bowen, et al.
Pubblicazione: (2026)
di: He, Bowen, et al.
Pubblicazione: (2026)
Belief Dynamics Reveal the Dual Nature of In-Context Learning and Activation Steering
di: Bigelow, Eric, et al.
Pubblicazione: (2025)
di: Bigelow, Eric, et al.
Pubblicazione: (2025)
HUGO -- Highlighting Unseen Grid Options: Combining Deep Reinforcement Learning with a Heuristic Target Topology Approach
di: Lehna, Malte, et al.
Pubblicazione: (2024)
di: Lehna, Malte, et al.
Pubblicazione: (2024)
Learning Heuristics for Transit Network Design and Improvement with Deep Reinforcement Learning
di: Holliday, Andrew, et al.
Pubblicazione: (2024)
di: Holliday, Andrew, et al.
Pubblicazione: (2024)
Meta-Learning Transformers to Improve In-Context Generalization
di: Braccaioli, Lorenzo, et al.
Pubblicazione: (2025)
di: Braccaioli, Lorenzo, et al.
Pubblicazione: (2025)
Learning Admissible Heuristics for A*: Theory and Practice
di: Futuhi, Ehsan, et al.
Pubblicazione: (2025)
di: Futuhi, Ehsan, et al.
Pubblicazione: (2025)
Demystifying the Recency Heuristic in Temporal-Difference Learning
di: Daley, Brett, et al.
Pubblicazione: (2024)
di: Daley, Brett, et al.
Pubblicazione: (2024)
Context-Sensitive Abstractions for Reinforcement Learning with Parameterized Actions
di: Nayyar, Rashmeet Kaur, et al.
Pubblicazione: (2025)
di: Nayyar, Rashmeet Kaur, et al.
Pubblicazione: (2025)
In-Context Reinforcement Learning via Communicative World Models
di: Martinez-Lopez, Fernando, et al.
Pubblicazione: (2025)
di: Martinez-Lopez, Fernando, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Multi-Robot Path Planning Combining Heuristics and Multi-Agent Reinforcement Learning
di: Peng, Shaoming
Pubblicazione: (2023) -
Conceptual Belief-Informed Reinforcement Learning
di: Gu, Xingrui, et al.
Pubblicazione: (2024) -
Belief or Circuitry? Causal Evidence for In-Context Graph Learning
di: Kowalyshyn, Katharine, et al.
Pubblicazione: (2026) -
Impartial Games: A Challenge for Reinforcement Learning
di: Zhou, Bei, et al.
Pubblicazione: (2022) -
Transformers Provably Implement In-Context Reinforcement Learning with Policy Improvement
di: Liang, Haodong, et al.
Pubblicazione: (2026)