Continual Task Learning through Adaptive Policy Self-Composition
Fuente:
arXiv
Guardado en:
| Autores principales: | Hu, Shengchao, Zhou, Yuhang, Fan, Ziqing, Hu, Jifeng, Shen, Li, Zhang, Ya, Tao, Dacheng |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Task-Aware Harmony Multi-Task Decision Transformer for Offline Reinforcement Learning
por: Fan, Ziqing, et al.
Publicado: (2024)
por: Fan, Ziqing, et al.
Publicado: (2024)
Prompt Tuning with Diffusion for Few-Shot Pre-trained Policy Generalization
por: Hu, Shengchao, et al.
Publicado: (2024)
por: Hu, Shengchao, et al.
Publicado: (2024)
Analytic Energy-Guided Policy Optimization for Offline Reinforcement Learning
por: Hu, Jifeng, et al.
Publicado: (2025)
por: Hu, Jifeng, et al.
Publicado: (2025)
HarmoDT: Harmony Multi-Task Decision Transformer for Offline Reinforcement Learning
por: Hu, Shengchao, et al.
Publicado: (2024)
por: Hu, Shengchao, et al.
Publicado: (2024)
Continual Diffuser (CoD): Mastering Continual Offline Reinforcement Learning with Experience Rehearsal
por: Hu, Jifeng, et al.
Publicado: (2024)
por: Hu, Jifeng, et al.
Publicado: (2024)
Decision Flow Policy Optimization
por: Hu, Jifeng, et al.
Publicado: (2025)
por: Hu, Jifeng, et al.
Publicado: (2025)
Learning Multi-Agent Communication from Graph Modeling Perspective
por: Hu, Shengchao, et al.
Publicado: (2024)
por: Hu, Shengchao, et al.
Publicado: (2024)
Q-value Regularized Transformer for Offline Reinforcement Learning
por: Hu, Shengchao, et al.
Publicado: (2024)
por: Hu, Shengchao, et al.
Publicado: (2024)
Task-Distributionally Robust Data-Free Meta-Learning
por: Hu, Zixuan, et al.
Publicado: (2023)
por: Hu, Zixuan, et al.
Publicado: (2023)
Communication Learning in Multi-Agent Systems from Graph Modeling Perspective
por: Hu, Shengchao, et al.
Publicado: (2024)
por: Hu, Shengchao, et al.
Publicado: (2024)
Adaptive Defense against Harmful Fine-Tuning for Large Language Models via Bayesian Data Scheduler
por: Hu, Zixuan, et al.
Publicado: (2025)
por: Hu, Zixuan, et al.
Publicado: (2025)
Continual Learning on Graphs: Challenges, Solutions, and Opportunities
por: Zhang, Xikun, et al.
Publicado: (2024)
por: Zhang, Xikun, et al.
Publicado: (2024)
Solving Continual Offline Reinforcement Learning with Decision Transformer
por: Huang, Kaixin, et al.
Publicado: (2024)
por: Huang, Kaixin, et al.
Publicado: (2024)
Adaptive Variational Continual Learning via Task-Heuristic Modelling
por: Yang, Fan
Publicado: (2024)
por: Yang, Fan
Publicado: (2024)
Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection
por: Fan, Ziqing, et al.
Publicado: (2025)
por: Fan, Ziqing, et al.
Publicado: (2025)
TimeAPN: Adaptive Amplitude-Phase Non-Stationarity Normalization for Time Series Forecasting
por: Hu, Yue, et al.
Publicado: (2026)
por: Hu, Yue, et al.
Publicado: (2026)
Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer
por: Kong, Yilun, et al.
Publicado: (2025)
por: Kong, Yilun, et al.
Publicado: (2025)
Solving Continual Offline RL through Selective Weights Activation on Aligned Spaces
por: Hu, Jifeng, et al.
Publicado: (2024)
por: Hu, Jifeng, et al.
Publicado: (2024)
A Step Back: Prefix Importance Ratio Stabilizes Policy Optimization
por: Lei, Shiye, et al.
Publicado: (2026)
por: Lei, Shiye, et al.
Publicado: (2026)
Learning from models beyond fine-tuning
por: Zheng, Hongling, et al.
Publicado: (2023)
por: Zheng, Hongling, et al.
Publicado: (2023)
Action-Adaptive Continual Learning: Enabling Policy Generalization under Dynamic Action Spaces
por: Pan, Chaofan, et al.
Publicado: (2025)
por: Pan, Chaofan, et al.
Publicado: (2025)
Neuron-level Balance between Stability and Plasticity in Deep Reinforcement Learning
por: Lan, Jiahua, et al.
Publicado: (2025)
por: Lan, Jiahua, et al.
Publicado: (2025)
Learning to Learn from APIs: Black-Box Data-Free Meta-Learning
por: Hu, Zixuan, et al.
Publicado: (2023)
por: Hu, Zixuan, et al.
Publicado: (2023)
AdaFlow: Imitation Learning with Variance-Adaptive Flow-Based Policies
por: Hu, Xixi, et al.
Publicado: (2024)
por: Hu, Xixi, et al.
Publicado: (2024)
SMILE: Zero-Shot Sparse Mixture of Low-Rank Experts Construction From Pre-Trained Foundation Models
por: Tang, Anke, et al.
Publicado: (2024)
por: Tang, Anke, et al.
Publicado: (2024)
Towards Theoretical Understandings of Self-Consuming Generative Models
por: Fu, Shi, et al.
Publicado: (2024)
por: Fu, Shi, et al.
Publicado: (2024)
Quantitative Estimation of Target Task Performance from Unsupervised Pretext Task in Semi/Self-Supervised Learning
por: Jia, Lin-Han, et al.
Publicado: (2025)
por: Jia, Lin-Han, et al.
Publicado: (2025)
Architecture, Dataset and Model-Scale Agnostic Data-free Meta-Learning
por: Hu, Zixuan, et al.
Publicado: (2023)
por: Hu, Zixuan, et al.
Publicado: (2023)
Network Sparsity Unlocks the Scaling Potential of Deep Reinforcement Learning
por: Ma, Guozheng, et al.
Publicado: (2025)
por: Ma, Guozheng, et al.
Publicado: (2025)
Efficient UAV Swarm-Based Multi-Task Federated Learning with Dynamic Task Knowledge Sharing
por: Yang, Yubo, et al.
Publicado: (2025)
por: Yang, Yubo, et al.
Publicado: (2025)
Efficient Differentiable Causal Discovery via Reliable Super-Structure Learning
por: Ma, Pingchuan, et al.
Publicado: (2026)
por: Ma, Pingchuan, et al.
Publicado: (2026)
Joint Input and Output Coordination for Class-Incremental Learning
por: Wang, Shuai, et al.
Publicado: (2024)
por: Wang, Shuai, et al.
Publicado: (2024)
Unlocking Tuning-Free Few-Shot Adaptability in Visual Foundation Models by Recycling Pre-Tuned LoRAs
por: Hu, Zixuan, et al.
Publicado: (2024)
por: Hu, Zixuan, et al.
Publicado: (2024)
In-Context Decision Transformer: Reinforcement Learning via Hierarchical Chain-of-Thought
por: Huang, Sili, et al.
Publicado: (2024)
por: Huang, Sili, et al.
Publicado: (2024)
Task-Aware Adaptive Modulation: A Replay-Free and Resource-Efficient Approach For Continual Graph Learning
por: Liu, Jingtao, et al.
Publicado: (2025)
por: Liu, Jingtao, et al.
Publicado: (2025)
Defense without Forgetting: Continual Adversarial Defense with Anisotropic & Isotropic Pseudo Replay
por: Zhou, Yuhang, et al.
Publicado: (2024)
por: Zhou, Yuhang, et al.
Publicado: (2024)
Policy Gradient with Adaptive Entropy Annealing for Continual Fine-Tuning
por: Zhang, Yaqian, et al.
Publicado: (2026)
por: Zhang, Yaqian, et al.
Publicado: (2026)
AGPO: Adaptive Group Policy Optimization with Dual Statistical Feedback
por: Hu, Miaobo, et al.
Publicado: (2026)
por: Hu, Miaobo, et al.
Publicado: (2026)
Offline Behavior Distillation
por: Lei, Shiye, et al.
Publicado: (2024)
por: Lei, Shiye, et al.
Publicado: (2024)
Episodic-free Task Selection for Few-shot Learning
por: Zhang, Tao
Publicado: (2024)
por: Zhang, Tao
Publicado: (2024)
Ejemplares similares
-
Task-Aware Harmony Multi-Task Decision Transformer for Offline Reinforcement Learning
por: Fan, Ziqing, et al.
Publicado: (2024) -
Prompt Tuning with Diffusion for Few-Shot Pre-trained Policy Generalization
por: Hu, Shengchao, et al.
Publicado: (2024) -
Analytic Energy-Guided Policy Optimization for Offline Reinforcement Learning
por: Hu, Jifeng, et al.
Publicado: (2025) -
HarmoDT: Harmony Multi-Task Decision Transformer for Offline Reinforcement Learning
por: Hu, Shengchao, et al.
Publicado: (2024) -
Continual Diffuser (CoD): Mastering Continual Offline Reinforcement Learning with Experience Rehearsal
por: Hu, Jifeng, et al.
Publicado: (2024)