Towards an Information Theoretic Framework of Context-Based Offline Meta-Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Li, Lanqing, Zhang, Hai, Zhang, Xinyu, Zhu, Shatong, Yu, Yang, Zhao, Junqiao, Heng, Pheng-Ann |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Scrutinize What We Ignore: Reining In Task Representation Shift Of Context-Based Offline Meta Reinforcement Learning
di: Zhang, Hai, et al.
Pubblicazione: (2024)
di: Zhang, Hai, et al.
Pubblicazione: (2024)
POWQMIX: Weighted Value Factorization with Potentially Optimal Joint Actions Recognition for Cooperative Multi-Agent Reinforcement Learning
di: Huang, Chang, et al.
Pubblicazione: (2024)
di: Huang, Chang, et al.
Pubblicazione: (2024)
CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation
di: Zhang, Zhengzhe, et al.
Pubblicazione: (2025)
di: Zhang, Zhengzhe, et al.
Pubblicazione: (2025)
Beyond Penalization: Diffusion-based Out-of-Distribution Detection and Selective Regularization in Offline Reinforcement Learning
di: Wang, Qingjun, et al.
Pubblicazione: (2026)
di: Wang, Qingjun, et al.
Pubblicazione: (2026)
Directed Information $γ$-covering: An Information-Theoretic Framework for Context Engineering
di: Huang, Hai
Pubblicazione: (2025)
di: Huang, Hai
Pubblicazione: (2025)
Towards Large-Scale In-Context Reinforcement Learning by Meta-Training in Randomized Worlds
di: Wang, Fan, et al.
Pubblicazione: (2025)
di: Wang, Fan, et al.
Pubblicazione: (2025)
Towards Robust Offline Reinforcement Learning under Diverse Data Corruption
di: Yang, Rui, et al.
Pubblicazione: (2023)
di: Yang, Rui, et al.
Pubblicazione: (2023)
A Theoretical Understanding of Gradient Bias in Meta-Reinforcement Learning
di: Feng, Xidong, et al.
Pubblicazione: (2021)
di: Feng, Xidong, et al.
Pubblicazione: (2021)
Residuals-based Offline Reinforcement Learning
di: Zhu, Qing, et al.
Pubblicazione: (2026)
di: Zhu, Qing, et al.
Pubblicazione: (2026)
Urban-Focused Multi-Task Offline Reinforcement Learning with Contrastive Data Sharing
di: Zhao, Xinbo, et al.
Pubblicazione: (2024)
di: Zhao, Xinbo, et al.
Pubblicazione: (2024)
An Information-Theoretic Analysis of OOD Generalization in Meta-Reinforcement Learning
di: Liu, Xingtu
Pubblicazione: (2025)
di: Liu, Xingtu
Pubblicazione: (2025)
From Reward-Free Representations to Preferences: Rethinking Offline Preference-Based Reinforcement Learning
di: Yang, Jun-Jie, et al.
Pubblicazione: (2026)
di: Yang, Jun-Jie, et al.
Pubblicazione: (2026)
Towards Robust Offline-to-Online Reinforcement Learning via Uncertainty and Smoothness
di: Wen, Xiaoyu, et al.
Pubblicazione: (2023)
di: Wen, Xiaoyu, et al.
Pubblicazione: (2023)
Vision-Based Deep Reinforcement Learning of UAV Autonomous Navigation Using Privileged Information
di: Wang, Junqiao, et al.
Pubblicazione: (2024)
di: Wang, Junqiao, et al.
Pubblicazione: (2024)
Towards Monotonic Improvement in In-Context Reinforcement Learning
di: Zhang, Wenhao, et al.
Pubblicazione: (2025)
di: Zhang, Wenhao, et al.
Pubblicazione: (2025)
Sample-Efficient Tabular Self-Play for Offline Robust Reinforcement Learning
di: Li, Na, et al.
Pubblicazione: (2025)
di: Li, Na, et al.
Pubblicazione: (2025)
Toward Information Theoretic Active Inverse Reinforcement Learning
di: Bajgar, Ondrej, et al.
Pubblicazione: (2024)
di: Bajgar, Ondrej, et al.
Pubblicazione: (2024)
RiboSphere: Learning Unified and Efficient Representations of RNA Structures
di: Zhang, Zhou, et al.
Pubblicazione: (2026)
di: Zhang, Zhou, et al.
Pubblicazione: (2026)
In-Context Compositional Q-Learning for Offline Reinforcement Learning
di: Xu, Qiushui, et al.
Pubblicazione: (2025)
di: Xu, Qiushui, et al.
Pubblicazione: (2025)
Contextual Latent World Models for Offline Meta Reinforcement Learning
di: Nakheai, Mohammadreza, et al.
Pubblicazione: (2026)
di: Nakheai, Mohammadreza, et al.
Pubblicazione: (2026)
Entropy Regularized Task Representation Learning for Offline Meta-Reinforcement Learning
di: Nakhaei, Mohammadreza, et al.
Pubblicazione: (2024)
di: Nakhaei, Mohammadreza, et al.
Pubblicazione: (2024)
DyDiff: Long-Horizon Rollout via Dynamics Diffusion for Offline Reinforcement Learning
di: Zhao, Hanye, et al.
Pubblicazione: (2024)
di: Zhao, Hanye, et al.
Pubblicazione: (2024)
Offline Trajectory Optimization for Offline Reinforcement Learning
di: Zhao, Ziqi, et al.
Pubblicazione: (2024)
di: Zhao, Ziqi, et al.
Pubblicazione: (2024)
Convergence and Emergence of In-Context Reinforcement Learning with Chain of Thought
di: Xie, Zixuan, et al.
Pubblicazione: (2026)
di: Xie, Zixuan, et al.
Pubblicazione: (2026)
Towards Provable Emergence of In-Context Reinforcement Learning
di: Wang, Jiuqi, et al.
Pubblicazione: (2025)
di: Wang, Jiuqi, et al.
Pubblicazione: (2025)
Hindsight Preference Learning for Offline Preference-based Reinforcement Learning
di: Gao, Chen-Xiao, et al.
Pubblicazione: (2024)
di: Gao, Chen-Xiao, et al.
Pubblicazione: (2024)
Meta-DT: Offline Meta-RL as Conditional Sequence Modeling with World Model Disentanglement
di: Wang, Zhi, et al.
Pubblicazione: (2024)
di: Wang, Zhi, et al.
Pubblicazione: (2024)
OASIS: Conditional Distribution Shaping for Offline Safe Reinforcement Learning
di: Yao, Yihang, et al.
Pubblicazione: (2024)
di: Yao, Yihang, et al.
Pubblicazione: (2024)
Energy-Weighted Flow Matching for Offline Reinforcement Learning
di: Zhang, Shiyuan, et al.
Pubblicazione: (2025)
di: Zhang, Shiyuan, et al.
Pubblicazione: (2025)
Bayesian Design Principles for Offline-to-Online Reinforcement Learning
di: Hu, Hao, et al.
Pubblicazione: (2024)
di: Hu, Hao, et al.
Pubblicazione: (2024)
Offline Meta-Reinforcement Learning with Flow-Based Task Inference and Adaptive Correction of Feature Overgeneralization
di: Wang, Min, et al.
Pubblicazione: (2026)
di: Wang, Min, et al.
Pubblicazione: (2026)
Information-Directed Offline-to-Online Reinforcement Learning
di: Chen, Keru
Pubblicazione: (2026)
di: Chen, Keru
Pubblicazione: (2026)
Enhancing Online Reinforcement Learning with Meta-Learned Objective from Offline Data
di: Deng, Shilong, et al.
Pubblicazione: (2025)
di: Deng, Shilong, et al.
Pubblicazione: (2025)
Online Estimation via Offline Estimation: An Information-Theoretic Framework
di: Foster, Dylan J., et al.
Pubblicazione: (2024)
di: Foster, Dylan J., et al.
Pubblicazione: (2024)
Energy-Guided Diffusion Sampling for Offline-to-Online Reinforcement Learning
di: Liu, Xu-Hui, et al.
Pubblicazione: (2024)
di: Liu, Xu-Hui, et al.
Pubblicazione: (2024)
Meta-Learning Reinforcement Learning for Crypto-Return Prediction
di: Wang, Junqiao, et al.
Pubblicazione: (2025)
di: Wang, Junqiao, et al.
Pubblicazione: (2025)
Corruption-Robust Offline Reinforcement Learning with General Function Approximation
di: Ye, Chenlu, et al.
Pubblicazione: (2023)
di: Ye, Chenlu, et al.
Pubblicazione: (2023)
MOBODY: Model Based Off-Dynamics Offline Reinforcement Learning
di: Guo, Yihong, et al.
Pubblicazione: (2025)
di: Guo, Yihong, et al.
Pubblicazione: (2025)
Federated Offline Reinforcement Learning
di: Zhou, Doudou, et al.
Pubblicazione: (2022)
di: Zhou, Doudou, et al.
Pubblicazione: (2022)
Residual Learning and Context Encoding for Adaptive Offline-to-Online Reinforcement Learning
di: Nakhaei, Mohammadreza, et al.
Pubblicazione: (2024)
di: Nakhaei, Mohammadreza, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Scrutinize What We Ignore: Reining In Task Representation Shift Of Context-Based Offline Meta Reinforcement Learning
di: Zhang, Hai, et al.
Pubblicazione: (2024) -
POWQMIX: Weighted Value Factorization with Potentially Optimal Joint Actions Recognition for Cooperative Multi-Agent Reinforcement Learning
di: Huang, Chang, et al.
Pubblicazione: (2024) -
CausalCOMRL: Context-Based Offline Meta-Reinforcement Learning with Causal Representation
di: Zhang, Zhengzhe, et al.
Pubblicazione: (2025) -
Beyond Penalization: Diffusion-based Out-of-Distribution Detection and Selective Regularization in Offline Reinforcement Learning
di: Wang, Qingjun, et al.
Pubblicazione: (2026) -
Directed Information $γ$-covering: An Information-Theoretic Framework for Context Engineering
di: Huang, Hai
Pubblicazione: (2025)