In-Context Reinforcement Learning via Communicative World Models
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Martinez-Lopez, Fernando, Li, Tao, Lu, Yingdong, Chen, Juntao |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Stackelberg Coupling of Online Representation Learning and Reinforcement Learning
von: Martinez, Fernando, et al.
Veröffentlicht: (2025)
von: Martinez, Fernando, et al.
Veröffentlicht: (2025)
SPRIG: Stackelberg Perception-Reinforcement Learning with Internal Game Dynamics
von: Martinez-Lopez, Fernando, et al.
Veröffentlicht: (2025)
von: Martinez-Lopez, Fernando, et al.
Veröffentlicht: (2025)
Context and Diversity Matter: The Emergence of In-Context Learning in World Models
von: Wang, Fan, et al.
Veröffentlicht: (2025)
von: Wang, Fan, et al.
Veröffentlicht: (2025)
Reinforcement Learning from Delayed Observations via World Models
von: Karamzade, Armin, et al.
Veröffentlicht: (2024)
von: Karamzade, Armin, et al.
Veröffentlicht: (2024)
Vintix: Action Model via In-Context Reinforcement Learning
von: Polubarov, Andrey, et al.
Veröffentlicht: (2025)
von: Polubarov, Andrey, et al.
Veröffentlicht: (2025)
RLVR-World: Training World Models with Reinforcement Learning
von: Wu, Jialong, et al.
Veröffentlicht: (2025)
von: Wu, Jialong, et al.
Veröffentlicht: (2025)
DAWM: Diffusion Action World Models for Offline Reinforcement Learning via Action-Inferred Transitions
von: Li, Zongyue, et al.
Veröffentlicht: (2025)
von: Li, Zongyue, et al.
Veröffentlicht: (2025)
Towards Large-Scale In-Context Reinforcement Learning by Meta-Training in Randomized Worlds
von: Wang, Fan, et al.
Veröffentlicht: (2025)
von: Wang, Fan, et al.
Veröffentlicht: (2025)
In-Context Decision Transformer: Reinforcement Learning via Hierarchical Chain-of-Thought
von: Huang, Sili, et al.
Veröffentlicht: (2024)
von: Huang, Sili, et al.
Veröffentlicht: (2024)
Mixture-of-Experts Meets In-Context Reinforcement Learning
von: Wu, Wenhao, et al.
Veröffentlicht: (2025)
von: Wu, Wenhao, et al.
Veröffentlicht: (2025)
Hybrid Inverse Reinforcement Learning
von: Ren, Juntao, et al.
Veröffentlicht: (2024)
von: Ren, Juntao, et al.
Veröffentlicht: (2024)
Safe Reinforcement Learning using Finite-Horizon Gradient-based Estimation
von: Dai, Juntao, et al.
Veröffentlicht: (2024)
von: Dai, Juntao, et al.
Veröffentlicht: (2024)
From Observations to Events: Event-Aware World Model for Reinforcement Learning
von: Peng, Zhao-Han, et al.
Veröffentlicht: (2026)
von: Peng, Zhao-Han, et al.
Veröffentlicht: (2026)
Honesty to Subterfuge: In-Context Reinforcement Learning Can Make Honest Models Reward Hack
von: McKee-Reid, Leo, et al.
Veröffentlicht: (2024)
von: McKee-Reid, Leo, et al.
Veröffentlicht: (2024)
Towards Monotonic Improvement in In-Context Reinforcement Learning
von: Zhang, Wenhao, et al.
Veröffentlicht: (2025)
von: Zhang, Wenhao, et al.
Veröffentlicht: (2025)
Policy-Driven World Model Adaptation for Robust Offline Model-based Reinforcement Learning
von: Chen, Jiayu, et al.
Veröffentlicht: (2025)
von: Chen, Jiayu, et al.
Veröffentlicht: (2025)
Continual Reinforcement Learning by Planning with Online World Models
von: Liu, Zichen, et al.
Veröffentlicht: (2025)
von: Liu, Zichen, et al.
Veröffentlicht: (2025)
Distilling Reinforcement Learning Algorithms for In-Context Model-Based Planning
von: Son, Jaehyeon, et al.
Veröffentlicht: (2025)
von: Son, Jaehyeon, et al.
Veröffentlicht: (2025)
Object-Centric World Models for Causality-Aware Reinforcement Learning
von: Nishimoto, Yosuke, et al.
Veröffentlicht: (2025)
von: Nishimoto, Yosuke, et al.
Veröffentlicht: (2025)
Random Policy Enables In-Context Reinforcement Learning within Trust Horizons
von: Chen, Weiqin, et al.
Veröffentlicht: (2024)
von: Chen, Weiqin, et al.
Veröffentlicht: (2024)
Federated Learning for Discrete Optimal Transport with Large Population under Incomplete Information
von: Kaur, Navpreet, et al.
Veröffentlicht: (2024)
von: Kaur, Navpreet, et al.
Veröffentlicht: (2024)
Safe Urban Traffic Control via Uncertainty-Aware Conformal Prediction and World-Model Reinforcement Learning
von: Chandra, Joydeep, et al.
Veröffentlicht: (2026)
von: Chandra, Joydeep, et al.
Veröffentlicht: (2026)
In-Context Compositional Q-Learning for Offline Reinforcement Learning
von: Xu, Qiushui, et al.
Veröffentlicht: (2025)
von: Xu, Qiushui, et al.
Veröffentlicht: (2025)
Network Sparsity Unlocks the Scaling Potential of Deep Reinforcement Learning
von: Ma, Guozheng, et al.
Veröffentlicht: (2025)
von: Ma, Guozheng, et al.
Veröffentlicht: (2025)
In-Context Reinforcement Learning through Bayesian Fusion of Context and Value Prior
von: Berkes, Anaïs, et al.
Veröffentlicht: (2026)
von: Berkes, Anaïs, et al.
Veröffentlicht: (2026)
Enhancing Vision-Language Model Training with Reinforcement Learning in Synthetic Worlds for Real-World Success
von: Bredis, George, et al.
Veröffentlicht: (2025)
von: Bredis, George, et al.
Veröffentlicht: (2025)
In-Context Reinforcement Learning for Variable Action Spaces
von: Sinii, Viacheslav, et al.
Veröffentlicht: (2023)
von: Sinii, Viacheslav, et al.
Veröffentlicht: (2023)
Spatiotemporal Forecasting as Planning: A Model-Based Reinforcement Learning Approach with Generative World Models
von: Wu, Hao, et al.
Veröffentlicht: (2025)
von: Wu, Hao, et al.
Veröffentlicht: (2025)
World Models Unlock Optimal Foraging Strategies in Reinforcement Learning Agents
von: Fonseca, Yesid, et al.
Veröffentlicht: (2025)
von: Fonseca, Yesid, et al.
Veröffentlicht: (2025)
Revisiting Plasticity in Visual Reinforcement Learning: Data, Modules and Training Stages
von: Ma, Guozheng, et al.
Veröffentlicht: (2023)
von: Ma, Guozheng, et al.
Veröffentlicht: (2023)
Towards Automated Semantic Interpretability in Reinforcement Learning via Vision-Language Models
von: Li, Zhaoxin, et al.
Veröffentlicht: (2025)
von: Li, Zhaoxin, et al.
Veröffentlicht: (2025)
Solving Continual Offline Reinforcement Learning with Decision Transformer
von: Huang, Kaixin, et al.
Veröffentlicht: (2024)
von: Huang, Kaixin, et al.
Veröffentlicht: (2024)
Generative Pre-Trained Transformer for Symbolic Regression Base In-Context Reinforcement Learning
von: Li, Yanjie, et al.
Veröffentlicht: (2024)
von: Li, Yanjie, et al.
Veröffentlicht: (2024)
Towards Interpretable Deep Reinforcement Learning Models via Inverse Reinforcement Learning
von: Xie, Sean, et al.
Veröffentlicht: (2022)
von: Xie, Sean, et al.
Veröffentlicht: (2022)
Context-Enhanced Multi-View Trajectory Representation Learning: Bridging the Gap through Self-Supervised Models
von: Qian, Tangwen, et al.
Veröffentlicht: (2024)
von: Qian, Tangwen, et al.
Veröffentlicht: (2024)
FutureWorld: A Live Reinforcement Learning Environment for Predictive Agents with Real-World Outcome Rewards
von: Han, Zhixin, et al.
Veröffentlicht: (2026)
von: Han, Zhixin, et al.
Veröffentlicht: (2026)
Context-Sensitive Abstractions for Reinforcement Learning with Parameterized Actions
von: Nayyar, Rashmeet Kaur, et al.
Veröffentlicht: (2025)
von: Nayyar, Rashmeet Kaur, et al.
Veröffentlicht: (2025)
Heuristic Transformer: Belief Augmented In-Context Reinforcement Learning
von: Dippel, Oliver, et al.
Veröffentlicht: (2025)
von: Dippel, Oliver, et al.
Veröffentlicht: (2025)
Statistical Context Detection for Deep Lifelong Reinforcement Learning
von: Dick, Jeffery, et al.
Veröffentlicht: (2024)
von: Dick, Jeffery, et al.
Veröffentlicht: (2024)
Reasoner for Real-World Event Detection: Scaling Reinforcement Learning via Adaptive Perplexity-Aware Sampling Strategy
von: Zhang, Xiaoyun, et al.
Veröffentlicht: (2025)
von: Zhang, Xiaoyun, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Stackelberg Coupling of Online Representation Learning and Reinforcement Learning
von: Martinez, Fernando, et al.
Veröffentlicht: (2025) -
SPRIG: Stackelberg Perception-Reinforcement Learning with Internal Game Dynamics
von: Martinez-Lopez, Fernando, et al.
Veröffentlicht: (2025) -
Context and Diversity Matter: The Emergence of In-Context Learning in World Models
von: Wang, Fan, et al.
Veröffentlicht: (2025) -
Reinforcement Learning from Delayed Observations via World Models
von: Karamzade, Armin, et al.
Veröffentlicht: (2024) -
Vintix: Action Model via In-Context Reinforcement Learning
von: Polubarov, Andrey, et al.
Veröffentlicht: (2025)