Continual Policy Distillation from Distributed Reinforcement Learning Teachers
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Yuxuan, He, Qijun, Yuan, Mingqi, Chen, Wen-Tse, Schneider, Jeff, Chen, Jiayu |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
ME-IGM: Individual-Global-Max in Maximum Entropy Multi-Agent Reinforcement Learning
par: Chen, Wen-Tse, et autres
Publié: (2024)
par: Chen, Wen-Tse, et autres
Publié: (2024)
Policy-Driven World Model Adaptation for Robust Offline Model-based Reinforcement Learning
par: Chen, Jiayu, et autres
Publié: (2025)
par: Chen, Jiayu, et autres
Publié: (2025)
Retrospective In-Context Learning for Temporal Credit Assignment with Large Language Models
par: Chen, Wen-Tse, et autres
Publié: (2026)
par: Chen, Wen-Tse, et autres
Publié: (2026)
Bayes Adaptive Monte Carlo Tree Search for Offline Model-based Reinforcement Learning
par: Chen, Jiayu, et autres
Publié: (2024)
par: Chen, Jiayu, et autres
Publié: (2024)
Vision Transformers that Never Stop Learning
par: Sun, Caihao, et autres
Publié: (2026)
par: Sun, Caihao, et autres
Publié: (2026)
Occupancy Reward Shaping: Improving Credit Assignment for Offline Goal-Conditioned Reinforcement Learning
par: Venugopal, Aravind, et autres
Publié: (2026)
par: Venugopal, Aravind, et autres
Publié: (2026)
State Combinatorial Generalization In Decision Making With Conditional Diffusion Models
par: Duan, Xintong, et autres
Publié: (2025)
par: Duan, Xintong, et autres
Publié: (2025)
Continual Deep Reinforcement Learning with Task-Agnostic Policy Distillation
par: Hafez, Muhammad Burhan, et autres
Publié: (2024)
par: Hafez, Muhammad Burhan, et autres
Publié: (2024)
Deep Reinforcement Learning with Hybrid Intrinsic Reward Model
par: Yuan, Mingqi, et autres
Publié: (2025)
par: Yuan, Mingqi, et autres
Publié: (2025)
Accelerated Online Reinforcement Learning using Auxiliary Start State Distributions
par: Mehra, Aman, et autres
Publié: (2025)
par: Mehra, Aman, et autres
Publié: (2025)
Offline Reinforcement Learning for Rotation Profile Control in Tokamaks
par: Sonker, Rohit, et autres
Publié: (2026)
par: Sonker, Rohit, et autres
Publié: (2026)
Causal Coordinated Concurrent Reinforcement Learning
par: Tse, Tim, et autres
Publié: (2024)
par: Tse, Tim, et autres
Publié: (2024)
Adaptive Data Exploitation in Deep Reinforcement Learning
par: Yuan, Mingqi, et autres
Publié: (2025)
par: Yuan, Mingqi, et autres
Publié: (2025)
Discretizing Continuous Action Space with Unimodal Probability Distributions for On-Policy Reinforcement Learning
par: Zhu, Yuanyang, et autres
Publié: (2024)
par: Zhu, Yuanyang, et autres
Publié: (2024)
AIM: Intent-Aware Unified world action Modeling with Spatial Value Maps
par: Fan, Liaoyuan, et autres
Publié: (2026)
par: Fan, Liaoyuan, et autres
Publié: (2026)
PolicyFlow: Policy Optimization with Continuous Normalizing Flow in Reinforcement Learning
par: Yang, Shunpeng, et autres
Publié: (2026)
par: Yang, Shunpeng, et autres
Publié: (2026)
ULTHO: Ultra-Lightweight yet Efficient Hyperparameter Optimization in Deep Reinforcement Learning
par: Yuan, Mingqi, et autres
Publié: (2025)
par: Yuan, Mingqi, et autres
Publié: (2025)
Plasticine: Accelerating Research in Plasticity-Motivated Deep Reinforcement Learning
par: Yuan, Mingqi, et autres
Publié: (2025)
par: Yuan, Mingqi, et autres
Publié: (2025)
Continual Distillation of Teachers from Different Domains
par: Michel, Nicolas, et autres
Publié: (2026)
par: Michel, Nicolas, et autres
Publié: (2026)
Continual Policy Distillation of Reinforcement Learning-based Controllers for Soft Robotic In-Hand Manipulation
par: Li, Lanpei, et autres
Publié: (2024)
par: Li, Lanpei, et autres
Publié: (2024)
Adversarial Dual On-Policy Distillation from Expressive Teacher
par: Wan, Zhenglin, et autres
Publié: (2026)
par: Wan, Zhenglin, et autres
Publié: (2026)
RLeXplore: Accelerating Research in Intrinsically-Motivated Reinforcement Learning
par: Yuan, Mingqi, et autres
Publié: (2024)
par: Yuan, Mingqi, et autres
Publié: (2024)
Group Relative Knowledge Distillation: Learning from Teacher's Relational Inductive Bias
par: Li, Chao, et autres
Publié: (2025)
par: Li, Chao, et autres
Publié: (2025)
Practical Policy Distillation for Reinforcement Learning in Radio Access Networks
par: Khosravi, Sara, et autres
Publié: (2025)
par: Khosravi, Sara, et autres
Publié: (2025)
Dual-Forward Path Teacher Knowledge Distillation: Bridging the Capacity Gap Between Teacher and Student
par: Li, Tong, et autres
Publié: (2025)
par: Li, Tong, et autres
Publié: (2025)
Enhancing Robustness of Offline Reinforcement Learning Under Data Corruption via Sharpness-Aware Minimization
par: Xu, Le, et autres
Publié: (2025)
par: Xu, Le, et autres
Publié: (2025)
Internalize the Temperature: On-Policy Self-Distillation as Policy Reheater for Reinforcement Learning
par: Yang, Xuewei, et autres
Publié: (2026)
par: Yang, Xuewei, et autres
Publié: (2026)
Evaluating Interpretable Reinforcement Learning by Distilling Policies into Programs
par: Kohler, Hector, et autres
Publié: (2025)
par: Kohler, Hector, et autres
Publié: (2025)
RLDG: Robotic Generalist Policy Distillation via Reinforcement Learning
par: Xu, Charles, et autres
Publié: (2024)
par: Xu, Charles, et autres
Publié: (2024)
Distillation-Guided Structural Transfer for Continual Learning Beyond Sparse Distributed Memory
par: Xue, Huiyan, et autres
Publié: (2025)
par: Xue, Huiyan, et autres
Publié: (2025)
Guiding Distribution Matching Distillation with Gradient-Based Reinforcement Learning
par: Dong, Linwei, et autres
Publié: (2026)
par: Dong, Linwei, et autres
Publié: (2026)
Learning beyond Teacher: Generalized On-Policy Distillation with Reward Extrapolation
par: Yang, Wenkai, et autres
Publié: (2026)
par: Yang, Wenkai, et autres
Publié: (2026)
Solving Continual Offline Reinforcement Learning with Decision Transformer
par: Huang, Kaixin, et autres
Publié: (2024)
par: Huang, Kaixin, et autres
Publié: (2024)
RLLTE: Long-Term Evolution Project of Reinforcement Learning
par: Yuan, Mingqi, et autres
Publié: (2023)
par: Yuan, Mingqi, et autres
Publié: (2023)
Dual Action Policy for Robust Sim-to-Real Reinforcement Learning
par: Terence, Ng Wen Zheng, et autres
Publié: (2024)
par: Terence, Ng Wen Zheng, et autres
Publié: (2024)
Rethinking Adversarial Attacks in Reinforcement Learning from Policy Distribution Perspective
par: Duan, Tianyang, et autres
Publié: (2025)
par: Duan, Tianyang, et autres
Publié: (2025)
Self-Composing Policies for Scalable Continual Reinforcement Learning
par: Malagón, Mikel, et autres
Publié: (2025)
par: Malagón, Mikel, et autres
Publié: (2025)
Hierarchical Subspaces of Policies for Continual Offline Reinforcement Learning
par: Kobanda, Anthony, et autres
Publié: (2024)
par: Kobanda, Anthony, et autres
Publié: (2024)
Efficient Online Reinforcement Learning for Diffusion Policy
par: Ma, Haitong, et autres
Publié: (2025)
par: Ma, Haitong, et autres
Publié: (2025)
How Ensembles of Distilled Policies Improve Generalisation in Reinforcement Learning
par: Weltevrede, Max, et autres
Publié: (2025)
par: Weltevrede, Max, et autres
Publié: (2025)
Documents similaires
-
ME-IGM: Individual-Global-Max in Maximum Entropy Multi-Agent Reinforcement Learning
par: Chen, Wen-Tse, et autres
Publié: (2024) -
Policy-Driven World Model Adaptation for Robust Offline Model-based Reinforcement Learning
par: Chen, Jiayu, et autres
Publié: (2025) -
Retrospective In-Context Learning for Temporal Credit Assignment with Large Language Models
par: Chen, Wen-Tse, et autres
Publié: (2026) -
Bayes Adaptive Monte Carlo Tree Search for Offline Model-based Reinforcement Learning
par: Chen, Jiayu, et autres
Publié: (2024) -
Vision Transformers that Never Stop Learning
par: Sun, Caihao, et autres
Publié: (2026)