Revisiting Plasticity in Visual Reinforcement Learning: Data, Modules and Training Stages
Fuente:
arXiv
Guardado en:
| Autores principales: | Ma, Guozheng, Li, Lu, Zhang, Sen, Liu, Zixuan, Wang, Zhen, Chen, Yixin, Shen, Li, Wang, Xueqian, Tao, Dacheng |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
A Comprehensive Survey of Data Augmentation in Visual Reinforcement Learning
por: Ma, Guozheng, et al.
Publicado: (2022)
por: Ma, Guozheng, et al.
Publicado: (2022)
Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer
por: Kong, Yilun, et al.
Publicado: (2025)
por: Kong, Yilun, et al.
Publicado: (2025)
Network Sparsity Unlocks the Scaling Potential of Deep Reinforcement Learning
por: Ma, Guozheng, et al.
Publicado: (2025)
por: Ma, Guozheng, et al.
Publicado: (2025)
Neuron-level Balance between Stability and Plasticity in Deep Reinforcement Learning
por: Lan, Jiahua, et al.
Publicado: (2025)
por: Lan, Jiahua, et al.
Publicado: (2025)
Plasticine: Accelerating Research in Plasticity-Motivated Deep Reinforcement Learning
por: Yuan, Mingqi, et al.
Publicado: (2025)
por: Yuan, Mingqi, et al.
Publicado: (2025)
What Makes Value Learning Efficient in Residual Reinforcement Learning?
por: Ma, Guozheng, et al.
Publicado: (2026)
por: Ma, Guozheng, et al.
Publicado: (2026)
Rethinking the Role of Dynamic Sparse Training for Scalable Deep Reinforcement Learning
por: Ma, Guozheng, et al.
Publicado: (2025)
por: Ma, Guozheng, et al.
Publicado: (2025)
Architecture, Dataset and Model-Scale Agnostic Data-free Meta-Learning
por: Hu, Zixuan, et al.
Publicado: (2023)
por: Hu, Zixuan, et al.
Publicado: (2023)
Learning to Learn from APIs: Black-Box Data-Free Meta-Learning
por: Hu, Zixuan, et al.
Publicado: (2023)
por: Hu, Zixuan, et al.
Publicado: (2023)
Adaptive Defense against Harmful Fine-Tuning for Large Language Models via Bayesian Data Scheduler
por: Hu, Zixuan, et al.
Publicado: (2025)
por: Hu, Zixuan, et al.
Publicado: (2025)
Task-Distributionally Robust Data-Free Meta-Learning
por: Hu, Zixuan, et al.
Publicado: (2023)
por: Hu, Zixuan, et al.
Publicado: (2023)
Safety Reasoning with Guidelines
por: Wang, Haoyu, et al.
Publicado: (2025)
por: Wang, Haoyu, et al.
Publicado: (2025)
QPO: Query-dependent Prompt Optimization via Multi-Loop Offline Reinforcement Learning
por: Kong, Yilun, et al.
Publicado: (2024)
por: Kong, Yilun, et al.
Publicado: (2024)
A Simple "Motivation" Can Enhance Reinforcement Finetuning of Large Reasoning Models
por: Zhang, Junjie, et al.
Publicado: (2025)
por: Zhang, Junjie, et al.
Publicado: (2025)
Unlocking Tuning-Free Few-Shot Adaptability in Visual Foundation Models by Recycling Pre-Tuned LoRAs
por: Hu, Zixuan, et al.
Publicado: (2024)
por: Hu, Zixuan, et al.
Publicado: (2024)
Solving Continual Offline Reinforcement Learning with Decision Transformer
por: Huang, Kaixin, et al.
Publicado: (2024)
por: Huang, Kaixin, et al.
Publicado: (2024)
Sparse Model Inversion: Efficient Inversion of Vision Transformers for Data-Free Applications
por: Hu, Zixuan, et al.
Publicado: (2025)
por: Hu, Zixuan, et al.
Publicado: (2025)
Language-based Trial and Error Falls Behind in the Era of Experience
por: Wang, Haoyu, et al.
Publicado: (2026)
por: Wang, Haoyu, et al.
Publicado: (2026)
DFWLayer: Differentiable Frank-Wolfe Optimization Layer
por: Liu, Zixuan, et al.
Publicado: (2023)
por: Liu, Zixuan, et al.
Publicado: (2023)
Task-Aware Harmony Multi-Task Decision Transformer for Offline Reinforcement Learning
por: Fan, Ziqing, et al.
Publicado: (2024)
por: Fan, Ziqing, et al.
Publicado: (2024)
Revisiting Catastrophic Forgetting in Large Language Model Tuning
por: Li, Hongyu, et al.
Publicado: (2024)
por: Li, Hongyu, et al.
Publicado: (2024)
Reinforcement Learning on Pre-Training Data
por: Li, Siheng, et al.
Publicado: (2025)
por: Li, Siheng, et al.
Publicado: (2025)
Wavelet Fourier Diffuser: Frequency-Aware Diffusion Model for Reinforcement Learning
por: Luo, Yifu, et al.
Publicado: (2025)
por: Luo, Yifu, et al.
Publicado: (2025)
Perception Before Reasoning: Two-Stage Reinforcement Learning for Visual Reasoning in Vision-Language Models
por: Chen, Yan, et al.
Publicado: (2025)
por: Chen, Yan, et al.
Publicado: (2025)
Pre-training with Synthetic Data Helps Offline Reinforcement Learning
por: Wang, Zecheng, et al.
Publicado: (2023)
por: Wang, Zecheng, et al.
Publicado: (2023)
Learning System Dynamics without Forgetting
por: Zhang, Xikun, et al.
Publicado: (2024)
por: Zhang, Xikun, et al.
Publicado: (2024)
Disentangling Feature Structure: A Mathematically Provable Two-Stage Training Dynamics in Transformers
por: Gong, Zixuan, et al.
Publicado: (2025)
por: Gong, Zixuan, et al.
Publicado: (2025)
Step-On-Feet Tuning: Scaling Self-Alignment of LLMs via Bootstrapping
por: Wang, Haoyu, et al.
Publicado: (2024)
por: Wang, Haoyu, et al.
Publicado: (2024)
Robust Policy Expansion for Offline-to-Online RL under Diverse Data Corruption
por: He, Longxiang, et al.
Publicado: (2025)
por: He, Longxiang, et al.
Publicado: (2025)
Controllable and Verifiable Tool-Use Data Synthesis for Agentic Reinforcement Learning
por: Xu, Siyuan, et al.
Publicado: (2026)
por: Xu, Siyuan, et al.
Publicado: (2026)
Dr. Seg: Revisiting GRPO Training for Visual Large Language Models through Perception-Oriented Design
por: Sun, Haoxiang, et al.
Publicado: (2026)
por: Sun, Haoxiang, et al.
Publicado: (2026)
Revisiting LLM Reasoning via Information Bottleneck
por: Lei, Shiye, et al.
Publicado: (2025)
por: Lei, Shiye, et al.
Publicado: (2025)
Offline Goal-Conditioned Reinforcement Learning for Safety-Critical Tasks with Recovery Policy
por: Cao, Chenyang, et al.
Publicado: (2024)
por: Cao, Chenyang, et al.
Publicado: (2024)
Continual Diffuser (CoD): Mastering Continual Offline Reinforcement Learning with Experience Rehearsal
por: Hu, Jifeng, et al.
Publicado: (2024)
por: Hu, Jifeng, et al.
Publicado: (2024)
Analytic Energy-Guided Policy Optimization for Offline Reinforcement Learning
por: Hu, Jifeng, et al.
Publicado: (2025)
por: Hu, Jifeng, et al.
Publicado: (2025)
Building Accurate Translation-Tailored LLMs with Language Aware Instruction Tuning
por: Zan, Changtong, et al.
Publicado: (2024)
por: Zan, Changtong, et al.
Publicado: (2024)
Efficient Differentiable Causal Discovery via Reliable Super-Structure Learning
por: Ma, Pingchuan, et al.
Publicado: (2026)
por: Ma, Pingchuan, et al.
Publicado: (2026)
SeRL: Self-Play Reinforcement Learning for Large Language Models with Limited Data
por: Fang, Wenkai, et al.
Publicado: (2025)
por: Fang, Wenkai, et al.
Publicado: (2025)
Offline Behavior Distillation
por: Lei, Shiye, et al.
Publicado: (2024)
por: Lei, Shiye, et al.
Publicado: (2024)
FREE: Faster and Better Data-Free Meta-Learning
por: Wei, Yongxian, et al.
Publicado: (2024)
por: Wei, Yongxian, et al.
Publicado: (2024)
Ejemplares similares
-
A Comprehensive Survey of Data Augmentation in Visual Reinforcement Learning
por: Ma, Guozheng, et al.
Publicado: (2022) -
Mastering Massive Multi-Task Reinforcement Learning via Mixture-of-Expert Decision Transformer
por: Kong, Yilun, et al.
Publicado: (2025) -
Network Sparsity Unlocks the Scaling Potential of Deep Reinforcement Learning
por: Ma, Guozheng, et al.
Publicado: (2025) -
Neuron-level Balance between Stability and Plasticity in Deep Reinforcement Learning
por: Lan, Jiahua, et al.
Publicado: (2025) -
Plasticine: Accelerating Research in Plasticity-Motivated Deep Reinforcement Learning
por: Yuan, Mingqi, et al.
Publicado: (2025)