Foundation Models as World Models: A Foundational Study in Text-Based GridWorlds
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Sasso, Remo, Conserva, Michelangelo, Jeurissen, Dominik, Rauber, Paulo |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Exploration with Foundation Models: Capabilities, Limitations, and Hybrid Approaches
par: Sasso, Remo, et autres
Publié: (2025)
par: Sasso, Remo, et autres
Publié: (2025)
AI Agents: Evolution, Architecture, and Real-World Applications
par: Krishnan, Naveen
Publié: (2025)
par: Krishnan, Naveen
Publié: (2025)
Adaptive Minds: Empowering Agents with LoRA-as-Tools
par: Shekar, Pavan C, et autres
Publié: (2025)
par: Shekar, Pavan C, et autres
Publié: (2025)
Evolving machine learning workflows through interactive AutoML
par: Barbudo, Rafael, et autres
Publié: (2024)
par: Barbudo, Rafael, et autres
Publié: (2024)
SafeRL-Lite: A Lightweight, Explainable, and Constrained Reinforcement Learning Library
par: Mishra, Satyam, et autres
Publié: (2025)
par: Mishra, Satyam, et autres
Publié: (2025)
GoldenStart: Q-Guided Priors and Entropy Control for Distilling Flow Policies
par: Zhang, He, et autres
Publié: (2026)
par: Zhang, He, et autres
Publié: (2026)
XAutoLM: Efficient Fine-Tuning of Language Models via Meta-Learning and AutoML
par: Estevanell-Valladares, Ernesto L., et autres
Publié: (2025)
par: Estevanell-Valladares, Ernesto L., et autres
Publié: (2025)
An Improved Adaptive PID Optimizer with Enhanced Convergence and Stability for Deep Learning
par: Saini, Saurabh, et autres
Publié: (2026)
par: Saini, Saurabh, et autres
Publié: (2026)
Modeling and Controlling Deployment Reliability under Temporal Distribution Shift
par: Rahman, Naimur, et autres
Publié: (2026)
par: Rahman, Naimur, et autres
Publié: (2026)
From Next Token Prediction to (STRIPS) World Models
par: Núñez-Molina, Carlos, et autres
Publié: (2025)
par: Núñez-Molina, Carlos, et autres
Publié: (2025)
Flex: End-to-End Text-Instructed Visual Navigation from Foundation Model Features
par: Chahine, Makram, et autres
Publié: (2024)
par: Chahine, Makram, et autres
Publié: (2024)
AI and Machine Learning Approaches for Predicting Nanoparticles Toxicity The Critical Role of Physiochemical Properties
par: Yousaf, Iqra
Publié: (2024)
par: Yousaf, Iqra
Publié: (2024)
Connectivity-Aware Representations for Constrained Motion Planning via Multi-Scale Contrastive Learning
par: Jeon, Suhyun, et autres
Publié: (2026)
par: Jeon, Suhyun, et autres
Publié: (2026)
Proving Olympiad Algebraic Inequalities without Human Demonstrations
par: Wei, Chenrui, et autres
Publié: (2024)
par: Wei, Chenrui, et autres
Publié: (2024)
STRIDE: A Self-Reflective Agent Framework for Reliable Automatic Equation Discovery
par: Su, Jiarui, et autres
Publié: (2026)
par: Su, Jiarui, et autres
Publié: (2026)
Active Causal Experimentalist (ACE): Learning Intervention Strategies via Direct Preference Optimization
par: Cooper, Patrick, et autres
Publié: (2026)
par: Cooper, Patrick, et autres
Publié: (2026)
The Mirror Loop: Recursive Non-Convergence in Generative Reasoning Systems
par: DeVilling, Bentley
Publié: (2025)
par: DeVilling, Bentley
Publié: (2025)
Safety, Security, and Cognitive Risks in World Models
par: Parmar, Manoj
Publié: (2026)
par: Parmar, Manoj
Publié: (2026)
SALE-Based Offline Reinforcement Learning with Ensemble Q-Networks
par: Chun, Zheng
Publié: (2025)
par: Chun, Zheng
Publié: (2025)
AGWM: Affordance-Grounded World Models for Environments with Compositional Prerequisites
par: Zhang, Qinshi, et autres
Publié: (2026)
par: Zhang, Qinshi, et autres
Publié: (2026)
Emotion-Inspired Learning Signals (EILS): A Homeostatic Framework for Adaptive Autonomous Agents
par: Tiwari, Dhruv
Publié: (2025)
par: Tiwari, Dhruv
Publié: (2025)
SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks
par: Vincze, Mátyás, et autres
Publié: (2024)
par: Vincze, Mátyás, et autres
Publié: (2024)
Foundational Requirements for Artificial General Intelligence: A Falsifiable Framework Based on Signal Prediction
par: Šprogar, Matej
Publié: (2025)
par: Šprogar, Matej
Publié: (2025)
A Comparison Between Decision Transformers and Traditional Offline Reinforcement Learning Algorithms
par: Caunhye, Ali Murtaza, et autres
Publié: (2025)
par: Caunhye, Ali Murtaza, et autres
Publié: (2025)
Streaming Continual Learning for Unified Adaptive Intelligence in Dynamic Environments
par: Giannini, Federico, et autres
Publié: (2026)
par: Giannini, Federico, et autres
Publié: (2026)
Think-at-Hard: Selective Latent Iterations to Improve Reasoning Language Models
par: Fu, Tianyu, et autres
Publié: (2025)
par: Fu, Tianyu, et autres
Publié: (2025)
What Do World Models Learn in RL? Probing Latent Representations in Learned Environment Simulators
par: Zhang, Xinyu
Publié: (2026)
par: Zhang, Xinyu
Publié: (2026)
Diffusion-MPC in Discrete Domains: Feasibility Constraints, Horizon Effects, and Critic Alignment: Case study with Tetris
par: Wang, Haochuan Kevin
Publié: (2026)
par: Wang, Haochuan Kevin
Publié: (2026)
Constrained Auto-Bidding via Generative Response Modeling
par: Yang, Eunseok, et autres
Publié: (2026)
par: Yang, Eunseok, et autres
Publié: (2026)
Task Memory Engine (TME): Enhancing State Awareness for Multi-Step LLM Agent Tasks
par: Ye, Ye
Publié: (2025)
par: Ye, Ye
Publié: (2025)
Can a Bayesian Oracle Prevent Harm from an Agent?
par: Bengio, Yoshua, et autres
Publié: (2024)
par: Bengio, Yoshua, et autres
Publié: (2024)
UWM-JEPA: Predictive World Models That Imagine in Belief Space
par: Radha, Santosh Kumar, et autres
Publié: (2026)
par: Radha, Santosh Kumar, et autres
Publié: (2026)
From Imitation to Interaction: Mastering Game of Schnapsen with Shallow Reinforcement Learning
par: Klačan, Ján, et autres
Publié: (2026)
par: Klačan, Ján, et autres
Publié: (2026)
A Parallel Hybrid Action Space Reinforcement Learning Model for Real-world Adaptive Traffic Signal Control
par: Wang, Yuxuan, et autres
Publié: (2025)
par: Wang, Yuxuan, et autres
Publié: (2025)
On Divergence Measures for Training GFlowNets
par: da Silva, Tiago, et autres
Publié: (2024)
par: da Silva, Tiago, et autres
Publié: (2024)
Improving Hyperparameter Optimization with Checkpointed Model Weights
par: Mehta, Nikhil, et autres
Publié: (2024)
par: Mehta, Nikhil, et autres
Publié: (2024)
Efficient Contextual Preferential Bayesian Optimization with Historical Examples
par: Khan, Farha A., et autres
Publié: (2022)
par: Khan, Farha A., et autres
Publié: (2022)
A New Modeling to Feature Selection Based on the Fuzzy Rough Set Theory in Normal and Optimistic States on Hybrid Information Systems
par: Safarpour, Mohammad Hossein, et autres
Publié: (2026)
par: Safarpour, Mohammad Hossein, et autres
Publié: (2026)
Pioneer Agent: Continual Improvement of Small Language Models in Production
par: Atreja, Dhruv, et autres
Publié: (2026)
par: Atreja, Dhruv, et autres
Publié: (2026)
Vis-CoT: A Human-in-the-Loop Framework for Interactive Visualization and Intervention in LLM Chain-of-Thought Reasoning
par: Pather, Kaviraj, et autres
Publié: (2025)
par: Pather, Kaviraj, et autres
Publié: (2025)
Documents similaires
-
Exploration with Foundation Models: Capabilities, Limitations, and Hybrid Approaches
par: Sasso, Remo, et autres
Publié: (2025) -
AI Agents: Evolution, Architecture, and Real-World Applications
par: Krishnan, Naveen
Publié: (2025) -
Adaptive Minds: Empowering Agents with LoRA-as-Tools
par: Shekar, Pavan C, et autres
Publié: (2025) -
Evolving machine learning workflows through interactive AutoML
par: Barbudo, Rafael, et autres
Publié: (2024) -
SafeRL-Lite: A Lightweight, Explainable, and Constrained Reinforcement Learning Library
par: Mishra, Satyam, et autres
Publié: (2025)