Affordances Enable Partial World Modeling with LLMs
Fuente:
arXiv
Salvato in:
| Autori principali: | Khetarpal, Khimya, Comanici, Gheorghe, Richens, Jonathan, Shar, Jeremy, Xia, Fei, Orseau, Laurent, Faust, Aleksandra, Precup, Doina |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Cracking the Code of Action: a Generative Approach to Affordances for Reinforcement Learning
di: Cherif, Lynn, et al.
Pubblicazione: (2025)
di: Cherif, Lynn, et al.
Pubblicazione: (2025)
Plasticity as the Mirror of Empowerment
di: Abel, David, et al.
Pubblicazione: (2025)
di: Abel, David, et al.
Pubblicazione: (2025)
Partial Models for Building Adaptive Model-Based Reinforcement Learning Agents
di: Alver, Safa, et al.
Pubblicazione: (2024)
di: Alver, Safa, et al.
Pubblicazione: (2024)
Diversity-Enriched Option-Critic
di: Kamat, Anand, et al.
Pubblicazione: (2020)
di: Kamat, Anand, et al.
Pubblicazione: (2020)
Functional Acceleration for Policy Mirror Descent
di: Chelu, Veronica, et al.
Pubblicazione: (2024)
di: Chelu, Veronica, et al.
Pubblicazione: (2024)
A Look at Value-Based Decision-Time vs. Background Planning Methods Across Different Settings
di: Alver, Safa, et al.
Pubblicazione: (2022)
di: Alver, Safa, et al.
Pubblicazione: (2022)
Self-Predictive Representations for Combinatorial Generalization in Behavioral Cloning
di: Lawson, Daniel, et al.
Pubblicazione: (2025)
di: Lawson, Daniel, et al.
Pubblicazione: (2025)
Super-Exponential Regret for UCT, AlphaGo and Variants
di: Orseau, Laurent, et al.
Pubblicazione: (2024)
di: Orseau, Laurent, et al.
Pubblicazione: (2024)
Isotuning With Applications To Scale-Free Online Learning
di: Orseau, Laurent, et al.
Pubblicazione: (2021)
di: Orseau, Laurent, et al.
Pubblicazione: (2021)
Agency Is Frame-Dependent
di: Abel, David, et al.
Pubblicazione: (2025)
di: Abel, David, et al.
Pubblicazione: (2025)
Robust agents learn causal world models
di: Richens, Jonathan, et al.
Pubblicazione: (2024)
di: Richens, Jonathan, et al.
Pubblicazione: (2024)
Finding Increasingly Large Extremal Graphs with AlphaZero and Tabu Search
di: Mehrabian, Abbas, et al.
Pubblicazione: (2023)
di: Mehrabian, Abbas, et al.
Pubblicazione: (2023)
Levin Tree Search with Context Models
di: Orseau, Laurent, et al.
Pubblicazione: (2023)
di: Orseau, Laurent, et al.
Pubblicazione: (2023)
Sparse-Reg: Improving Sample Complexity in Offline Reinforcement Learning using Sparsity
di: Arnob, Samin Yeasar, et al.
Pubblicazione: (2025)
di: Arnob, Samin Yeasar, et al.
Pubblicazione: (2025)
Adaptive Exploration for Data-Efficient General Value Function Evaluations
di: Jain, Arushi, et al.
Pubblicazione: (2024)
di: Jain, Arushi, et al.
Pubblicazione: (2024)
Reinforcement Learning with Pairwise Preferences in Long-Term Decision Problems
di: Carr, Jonathan Colaço, et al.
Pubblicazione: (2026)
di: Carr, Jonathan Colaço, et al.
Pubblicazione: (2026)
Normalization and effective learning rates in reinforcement learning
di: Lyle, Clare, et al.
Pubblicazione: (2024)
di: Lyle, Clare, et al.
Pubblicazione: (2024)
Parseval Regularization for Continual Reinforcement Learning
di: Chung, Wesley, et al.
Pubblicazione: (2024)
di: Chung, Wesley, et al.
Pubblicazione: (2024)
Fluid-Agent Reinforcement Learning
di: Sharma, Shishir, et al.
Pubblicazione: (2026)
di: Sharma, Shishir, et al.
Pubblicazione: (2026)
The Limits of Predicting Agents from Behaviour
di: Bellot, Alexis, et al.
Pubblicazione: (2025)
di: Bellot, Alexis, et al.
Pubblicazione: (2025)
Uncovering a Universal Abstract Algorithm for Modular Addition in Neural Networks
di: McCracken, Gavin, et al.
Pubblicazione: (2025)
di: McCracken, Gavin, et al.
Pubblicazione: (2025)
Incorporating Spatial Information into Goal-Conditioned Hierarchical Reinforcement Learning via Graph Representations
di: Zhang, Shuyuan, et al.
Pubblicazione: (2025)
di: Zhang, Shuyuan, et al.
Pubblicazione: (2025)
Finite time analysis of temporal difference learning with linear function approximation: Tail averaging and regularisation
di: Patil, Gandharv, et al.
Pubblicazione: (2022)
di: Patil, Gandharv, et al.
Pubblicazione: (2022)
Policy Gradient Methods in the Presence of Symmetries and State Abstractions
di: Panangaden, Prakash, et al.
Pubblicazione: (2023)
di: Panangaden, Prakash, et al.
Pubblicazione: (2023)
Understanding Behavioral Metric Learning: A Large-Scale Study on Distracting Reinforcement Learning Environments
di: Luo, Ziyan, et al.
Pubblicazione: (2025)
di: Luo, Ziyan, et al.
Pubblicazione: (2025)
General agents contain world models
di: Richens, Jonathan, et al.
Pubblicazione: (2025)
di: Richens, Jonathan, et al.
Pubblicazione: (2025)
Capacity-Constrained Continual Learning
di: Wen, Zheng, et al.
Pubblicazione: (2025)
di: Wen, Zheng, et al.
Pubblicazione: (2025)
Representation Learning via Non-Contrastive Mutual Information
di: Guo, Zhaohan Daniel, et al.
Pubblicazione: (2025)
di: Guo, Zhaohan Daniel, et al.
Pubblicazione: (2025)
Consciousness-Inspired Spatio-Temporal Abstractions for Better Generalization in Reinforcement Learning
di: Zhao, Mingde, et al.
Pubblicazione: (2023)
di: Zhao, Mingde, et al.
Pubblicazione: (2023)
Rotation-Preserving Supervised Fine-Tuning
di: Jin, Hangzhan, et al.
Pubblicazione: (2026)
di: Jin, Hangzhan, et al.
Pubblicazione: (2026)
A Unifying Framework for Action-Conditional Self-Predictive Reinforcement Learning
di: Khetarpal, Khimya, et al.
Pubblicazione: (2024)
di: Khetarpal, Khimya, et al.
Pubblicazione: (2024)
Optimizing Return Distributions with Distributional Dynamic Programming
di: Pires, Bernardo Ávila, et al.
Pubblicazione: (2025)
di: Pires, Bernardo Ávila, et al.
Pubblicazione: (2025)
Robust Intervention Learning from Emergency Stop Interventions
di: Pronovost, Ethan, et al.
Pubblicazione: (2026)
di: Pronovost, Ethan, et al.
Pubblicazione: (2026)
Exposing Limitations of Language Model Agents in Sequential-Task Compositions on the Web
di: Furuta, Hiroki, et al.
Pubblicazione: (2023)
di: Furuta, Hiroki, et al.
Pubblicazione: (2023)
Effective Protein-Protein Interaction Exploration with PPIretrieval
di: Hua, Chenqing, et al.
Pubblicazione: (2024)
di: Hua, Chenqing, et al.
Pubblicazione: (2024)
PIANIST: Learning Partially Observable World Models with LLMs for Multi-Agent Decision Making
di: Light, Jonathan, et al.
Pubblicazione: (2024)
di: Light, Jonathan, et al.
Pubblicazione: (2024)
RL Fine-Tuning Heals OOD Forgetting in SFT
di: Jin, Hangzhan, et al.
Pubblicazione: (2025)
di: Jin, Hangzhan, et al.
Pubblicazione: (2025)
Understanding Prompt Tuning and In-Context Learning via Meta-Learning
di: Genewein, Tim, et al.
Pubblicazione: (2025)
di: Genewein, Tim, et al.
Pubblicazione: (2025)
More Efficient Randomized Exploration for Reinforcement Learning via Approximate Sampling
di: Ishfaq, Haque, et al.
Pubblicazione: (2024)
di: Ishfaq, Haque, et al.
Pubblicazione: (2024)
Evaluating the Goal-Directedness of Large Language Models
di: Everitt, Tom, et al.
Pubblicazione: (2025)
di: Everitt, Tom, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Cracking the Code of Action: a Generative Approach to Affordances for Reinforcement Learning
di: Cherif, Lynn, et al.
Pubblicazione: (2025) -
Plasticity as the Mirror of Empowerment
di: Abel, David, et al.
Pubblicazione: (2025) -
Partial Models for Building Adaptive Model-Based Reinforcement Learning Agents
di: Alver, Safa, et al.
Pubblicazione: (2024) -
Diversity-Enriched Option-Critic
di: Kamat, Anand, et al.
Pubblicazione: (2020) -
Functional Acceleration for Policy Mirror Descent
di: Chelu, Veronica, et al.
Pubblicazione: (2024)