Foundation World Models for Agents that Learn, Verify, and Adapt Reliably Beyond Static Environments
Fuente:
arXiv
Gespeichert in:
| 1. Verfasser: | Delgrange, Florent |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Deep SPI: Safe Policy Improvement via World Models
von: Delgrange, Florent, et al.
Veröffentlicht: (2025)
von: Delgrange, Florent, et al.
Veröffentlicht: (2025)
E-valuator: Reliable Agent Verifiers with Sequential Hypothesis Testing
von: Sadhuka, Shuvom, et al.
Veröffentlicht: (2025)
von: Sadhuka, Shuvom, et al.
Veröffentlicht: (2025)
CUA-Gym: Scaling Verifiable Training Environments and Tasks for Computer-Use Agents
von: Wang, Bowen, et al.
Veröffentlicht: (2026)
von: Wang, Bowen, et al.
Veröffentlicht: (2026)
D3-Gym: Constructing Real-World Verifiable Environments for Data-Driven Discovery
von: Moussa, Hanane Nour, et al.
Veröffentlicht: (2026)
von: Moussa, Hanane Nour, et al.
Veröffentlicht: (2026)
DeLF: Designing Learning Environments with Foundation Models
von: Afshar, Aida, et al.
Veröffentlicht: (2024)
von: Afshar, Aida, et al.
Veröffentlicht: (2024)
Agent World Model: Infinity Synthetic Environments for Agentic Reinforcement Learning
von: Wang, Zhaoyang, et al.
Veröffentlicht: (2026)
von: Wang, Zhaoyang, et al.
Veröffentlicht: (2026)
FutureWorld: A Live Reinforcement Learning Environment for Predictive Agents with Real-World Outcome Rewards
von: Han, Zhixin, et al.
Veröffentlicht: (2026)
von: Han, Zhixin, et al.
Veröffentlicht: (2026)
Synthesize, Partition, then Adapt: Eliciting Diverse Samples from Foundation Models
von: Wen, Yeming, et al.
Veröffentlicht: (2024)
von: Wen, Yeming, et al.
Veröffentlicht: (2024)
GUI-GENESIS: Automated Synthesis of Efficient Environments with Verifiable Rewards for GUI Agent Post-Training
von: Cao, Yuan, et al.
Veröffentlicht: (2026)
von: Cao, Yuan, et al.
Veröffentlicht: (2026)
Benchmarking World-Model Learning with Environment-Level Queries
von: Warrier, Archana, et al.
Veröffentlicht: (2025)
von: Warrier, Archana, et al.
Veröffentlicht: (2025)
The Evaluation Game: Beyond Static LLM Benchmarking
von: Wang, Paul, et al.
Veröffentlicht: (2026)
von: Wang, Paul, et al.
Veröffentlicht: (2026)
Adapting World Models with Latent-State Dynamics Residuals
von: Lanier, JB, et al.
Veröffentlicht: (2025)
von: Lanier, JB, et al.
Veröffentlicht: (2025)
Domain-Adapted Small Language Models for Reliable Clinical Triage
von: Aljohani, Manar, et al.
Veröffentlicht: (2026)
von: Aljohani, Manar, et al.
Veröffentlicht: (2026)
AdaptAgent: Adapting Multimodal Web Agents with Few-Shot Learning from Human Demonstrations
von: Verma, Gaurav, et al.
Veröffentlicht: (2024)
von: Verma, Gaurav, et al.
Veröffentlicht: (2024)
AndroidWorld: A Dynamic Benchmarking Environment for Autonomous Agents
von: Rawles, Christopher, et al.
Veröffentlicht: (2024)
von: Rawles, Christopher, et al.
Veröffentlicht: (2024)
Go Beyond Black-box Policies: Rethinking the Design of Learning Agent for Interpretable and Verifiable HVAC Control
von: An, Zhiyu, et al.
Veröffentlicht: (2024)
von: An, Zhiyu, et al.
Veröffentlicht: (2024)
Rubrics as Rewards: Reinforcement Learning Beyond Verifiable Domains
von: Gunjal, Anisha, et al.
Veröffentlicht: (2025)
von: Gunjal, Anisha, et al.
Veröffentlicht: (2025)
EnvGen: Generating and Adapting Environments via LLMs for Training Embodied Agents
von: Zala, Abhay, et al.
Veröffentlicht: (2024)
von: Zala, Abhay, et al.
Veröffentlicht: (2024)
Microeconomic Foundations of Multi-Agent Learning
von: Helou, Nassim
Veröffentlicht: (2026)
von: Helou, Nassim
Veröffentlicht: (2026)
DLLM-Searcher: Adapting Diffusion Large Language Model for Search Agents
von: Zhao, Jiahao, et al.
Veröffentlicht: (2026)
von: Zhao, Jiahao, et al.
Veröffentlicht: (2026)
Beyond Static Uncertainty: Modeling Temporal Uncertainty Dynamics for Probabilistic Time Series Forecasting
von: Wang, Yijun, et al.
Veröffentlicht: (2026)
von: Wang, Yijun, et al.
Veröffentlicht: (2026)
World Action Verifier: Self-Improving World Models via Forward-Inverse Asymmetry
von: Liu, Yuejiang, et al.
Veröffentlicht: (2026)
von: Liu, Yuejiang, et al.
Veröffentlicht: (2026)
Adapting the Behavior of Reinforcement Learning Agents to Changing Action Spaces and Reward Functions
von: de la Rosa, Raul, et al.
Veröffentlicht: (2026)
von: de la Rosa, Raul, et al.
Veröffentlicht: (2026)
Beyond Binary: Turning Partial Success into Dense Verifiable Rewards for Reinforcement Learning in Code Generation
von: Wang, Longwen, et al.
Veröffentlicht: (2026)
von: Wang, Longwen, et al.
Veröffentlicht: (2026)
A Guide to Failure in Machine Learning: Reliability and Robustness from Foundations to Practice
von: Heim, Eric, et al.
Veröffentlicht: (2025)
von: Heim, Eric, et al.
Veröffentlicht: (2025)
Hack-Verifiable Environments: Towards Evaluating Reward Hacking at Scale
von: Roth, Amit, et al.
Veröffentlicht: (2026)
von: Roth, Amit, et al.
Veröffentlicht: (2026)
REASONING GYM: Reasoning Environments for Reinforcement Learning with Verifiable Rewards
von: Stojanovski, Zafir, et al.
Veröffentlicht: (2025)
von: Stojanovski, Zafir, et al.
Veröffentlicht: (2025)
External Model Motivated Agents: Reinforcement Learning for Enhanced Environment Sampling
von: Bhagat, Rishav, et al.
Veröffentlicht: (2024)
von: Bhagat, Rishav, et al.
Veröffentlicht: (2024)
Raising the Bar in Graph OOD Generalization: Invariant Learning Beyond Explicit Environment Modeling
von: Shen, Xu, et al.
Veröffentlicht: (2025)
von: Shen, Xu, et al.
Veröffentlicht: (2025)
Beyond Verifiable Rewards: Rubric-Based GRM for Reinforced Fine-Tuning SWE Agents
von: Huang, Jiawei, et al.
Veröffentlicht: (2026)
von: Huang, Jiawei, et al.
Veröffentlicht: (2026)
A Reliable Knowledge Processing Framework for Combustion Science using Foundation Models
von: Sharma, Vansh, et al.
Veröffentlicht: (2023)
von: Sharma, Vansh, et al.
Veröffentlicht: (2023)
Towards Adapting Reinforcement Learning Agents to New Tasks: Insights from Q-Values
von: Ramaswamy, Ashwin, et al.
Veröffentlicht: (2024)
von: Ramaswamy, Ashwin, et al.
Veröffentlicht: (2024)
RLVMR: Reinforcement Learning with Verifiable Meta-Reasoning Rewards for Robust Long-Horizon Agents
von: Zhang, Zijing, et al.
Veröffentlicht: (2025)
von: Zhang, Zijing, et al.
Veröffentlicht: (2025)
Search, Verify and Feedback: Towards Next Generation Post-training Paradigm of Foundation Models via Verifier Engineering
von: Guan, Xinyan, et al.
Veröffentlicht: (2024)
von: Guan, Xinyan, et al.
Veröffentlicht: (2024)
Diffusion World Model: Future Modeling Beyond Step-by-Step Rollout for Offline Reinforcement Learning
von: Ding, Zihan, et al.
Veröffentlicht: (2024)
von: Ding, Zihan, et al.
Veröffentlicht: (2024)
Diffusion Transformers as Open-World Spatiotemporal Foundation Models
von: Yuan, Yuan, et al.
Veröffentlicht: (2024)
von: Yuan, Yuan, et al.
Veröffentlicht: (2024)
An Interactive Agent Foundation Model
von: Durante, Zane, et al.
Veröffentlicht: (2024)
von: Durante, Zane, et al.
Veröffentlicht: (2024)
World Models Unlock Optimal Foraging Strategies in Reinforcement Learning Agents
von: Fonseca, Yesid, et al.
Veröffentlicht: (2025)
von: Fonseca, Yesid, et al.
Veröffentlicht: (2025)
Reinforcement Learning with Verifiable yet Noisy Rewards under Imperfect Verifiers
von: Cai, Xin-Qiang, et al.
Veröffentlicht: (2025)
von: Cai, Xin-Qiang, et al.
Veröffentlicht: (2025)
Forecast2Anomaly (F2A): Adapting Multivariate Time Series Foundation Models for Anomaly Prediction
von: Hassan, Atif, et al.
Veröffentlicht: (2025)
von: Hassan, Atif, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Deep SPI: Safe Policy Improvement via World Models
von: Delgrange, Florent, et al.
Veröffentlicht: (2025) -
E-valuator: Reliable Agent Verifiers with Sequential Hypothesis Testing
von: Sadhuka, Shuvom, et al.
Veröffentlicht: (2025) -
CUA-Gym: Scaling Verifiable Training Environments and Tasks for Computer-Use Agents
von: Wang, Bowen, et al.
Veröffentlicht: (2026) -
D3-Gym: Constructing Real-World Verifiable Environments for Data-Driven Discovery
von: Moussa, Hanane Nour, et al.
Veröffentlicht: (2026) -
DeLF: Designing Learning Environments with Foundation Models
von: Afshar, Aida, et al.
Veröffentlicht: (2024)