Slow and Steady Wins the Race: Maintaining Plasticity with Hare and Tortoise Networks
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Lee, Hojoon, Cho, Hyeonseo, Kim, Hyunseung, Kim, Donghu, Min, Dugki, Choo, Jaegul, Lyle, Clare |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Do's and Don'ts: Learning Desirable Skills with Instruction Videos
par: Kim, Hyunseung, et autres
Publié: (2024)
par: Kim, Hyunseung, et autres
Publié: (2024)
Investigating Pre-Training Objectives for Generalization in Vision-Based Reinforcement Learning
par: Kim, Donghu, et autres
Publié: (2024)
par: Kim, Donghu, et autres
Publié: (2024)
SimBa: Simplicity Bias for Scaling Up Parameters in Deep Reinforcement Learning
par: Lee, Hojoon, et autres
Publié: (2024)
par: Lee, Hojoon, et autres
Publié: (2024)
FIRE: Frobenius-Isometry Reinitialization for Balancing the Stability-Plasticity Tradeoff
par: Han, Isaac, et autres
Publié: (2026)
par: Han, Isaac, et autres
Publié: (2026)
Building Resource-Constrained Language Agents: A Korean Case Study on Chemical Toxicity Information
par: Cho, Hojun, et autres
Publié: (2025)
par: Cho, Hojun, et autres
Publié: (2025)
Can Large Language Models Develop Strategic Reasoning? Post-training Insights from Learning Chess
par: Hwang, Dongyoon, et autres
Publié: (2025)
par: Hwang, Dongyoon, et autres
Publié: (2025)
Hyperspherical Normalization for Scalable Deep Reinforcement Learning
par: Lee, Hojoon, et autres
Publié: (2025)
par: Lee, Hojoon, et autres
Publié: (2025)
Dynamic Mixture of Experts Against Severe Distribution Shifts
par: Kim, Donghu
Publié: (2025)
par: Kim, Donghu
Publié: (2025)
Adapting Pretrained ViTs with Convolution Injector for Visuo-Motor Control
par: Hwang, Dongyoon, et autres
Publié: (2024)
par: Hwang, Dongyoon, et autres
Publié: (2024)
EPIC: Effective Prompting for Imbalanced-Class Data Synthesis in Tabular Data Classification via Large Language Models
par: Kim, Jinhee, et autres
Publié: (2024)
par: Kim, Jinhee, et autres
Publié: (2024)
When Model Meets New Normals: Test-time Adaptation for Unsupervised Time-series Anomaly Detection
par: Kim, Dongmin, et autres
Publié: (2023)
par: Kim, Dongmin, et autres
Publié: (2023)
Don't Let Bandit Feedback Pull Continual LLM-Recommender Updates Off Target
par: Kim, Taesan, et autres
Publié: (2026)
par: Kim, Taesan, et autres
Publié: (2026)
TCAN: Animating Human Images with Temporally Consistent Pose Guidance using Diffusion Models
par: Kim, Jeongho, et autres
Publié: (2024)
par: Kim, Jeongho, et autres
Publié: (2024)
Bones Can't Be Triangles: Accurate and Efficient Vertebrae Keypoint Estimation through Collaborative Error Revision
par: Kim, Jinhee, et autres
Publié: (2024)
par: Kim, Jinhee, et autres
Publié: (2024)
Self-Supervised Contrastive Learning for Long-term Forecasting
par: Park, Junwoo, et autres
Publié: (2024)
par: Park, Junwoo, et autres
Publié: (2024)
AgenticCache: Cache-Driven Asynchronous Planning for Embodied AI Agents
par: Kim, Hojoon, et autres
Publié: (2026)
par: Kim, Hojoon, et autres
Publié: (2026)
Maintaining Plasticity in Continual Learning via Regenerative Regularization
par: Kumar, Saurabh, et autres
Publié: (2023)
par: Kumar, Saurabh, et autres
Publié: (2023)
Retrieve Only Relevant Tables Whether Few or Many: Adaptive Table Retrieval Method
par: Kim, Taehee, et autres
Publié: (2026)
par: Kim, Taehee, et autres
Publié: (2026)
PHUMA: Physically-Grounded Humanoid Locomotion Dataset
par: Lee, Kyungmin, et autres
Publié: (2025)
par: Lee, Kyungmin, et autres
Publié: (2025)
Grokfast: Accelerated Grokking by Amplifying Slow Gradients
par: Lee, Jaerin, et autres
Publié: (2024)
par: Lee, Jaerin, et autres
Publié: (2024)
SNAP: Speaker Nulling for Artifact Projection in Speech Deepfake Detection
par: Jung, Kyudan, et autres
Publié: (2026)
par: Jung, Kyudan, et autres
Publié: (2026)
Monte Carlo Tree Diffusion for System 2 Planning
par: Yoon, Jaesik, et autres
Publié: (2025)
par: Yoon, Jaesik, et autres
Publié: (2025)
Cross-lingual Collapse: How Language-Centric Foundation Models Shape Reasoning in Large Language Models
par: Park, Cheonbok, et autres
Publié: (2025)
par: Park, Cheonbok, et autres
Publié: (2025)
PromptDresser: Improving the Quality and Controllability of Virtual Try-On via Generative Textual Prompt and Prompt-aware Mask
par: Kim, Jeongho, et autres
Publié: (2024)
par: Kim, Jeongho, et autres
Publié: (2024)
The Amazing Agent Race: Strong Tool Users, Weak Navigators
par: Kim, Zae Myung, et autres
Publié: (2026)
par: Kim, Zae Myung, et autres
Publié: (2026)
Find A Winning Sign: Sign Is All We Need to Win the Lottery
par: Oh, Junghun, et autres
Publié: (2025)
par: Oh, Junghun, et autres
Publié: (2025)
Plasticity as the Mirror of Empowerment
par: Abel, David, et autres
Publié: (2025)
par: Abel, David, et autres
Publié: (2025)
FlashSAC: Fast and Stable Off-Policy Reinforcement Learning for High-Dimensional Robot Control
par: Kim, Donghu, et autres
Publié: (2026)
par: Kim, Donghu, et autres
Publié: (2026)
Sommelier: Scalable Open Multi-turn Audio Pre-processing for Full-duplex Speech Language Models
par: Jung, Kyudan, et autres
Publié: (2026)
par: Jung, Kyudan, et autres
Publié: (2026)
Scalable Multi-Task Transfer Learning for Molecular Property Prediction
par: Lee, Chanhui, et autres
Publié: (2024)
par: Lee, Chanhui, et autres
Publié: (2024)
Task Addition in Multi-Task Learning by Geometrical Alignment
par: Yim, Soorin, et autres
Publié: (2024)
par: Yim, Soorin, et autres
Publié: (2024)
Self-Abstraction Learning for Effective and Stable Training of Deep Neural Networks
par: Cho, Wonyong, et autres
Publié: (2026)
par: Cho, Wonyong, et autres
Publié: (2026)
DASH: Warm-Starting Neural Network Training in Stationary Settings without Loss of Plasticity
par: Shin, Baekrok, et autres
Publié: (2024)
par: Shin, Baekrok, et autres
Publié: (2024)
VisualScratchpad: Inference-time Visual Concepts Analysis in Vision Language Models
par: Lim, Hyesu, et autres
Publié: (2026)
par: Lim, Hyesu, et autres
Publié: (2026)
Activation by Interval-wise Dropout: A Simple Way to Prevent Neural Networks from Plasticity Loss
par: Park, Sangyeon, et autres
Publié: (2025)
par: Park, Sangyeon, et autres
Publié: (2025)
Correctness-Optimized Residual Activation Lens (CORAL): Transferrable and Calibration-Aware Inference-Time Steering
par: Miao, Miranda Muqing, et autres
Publié: (2026)
par: Miao, Miranda Muqing, et autres
Publié: (2026)
CrafterDojo: A Suite of Foundation Models for Building Open-Ended Embodied Agents in Crafter
par: Park, Junyeong, et autres
Publié: (2025)
par: Park, Junyeong, et autres
Publié: (2025)
ECG-Reasoning-Benchmark: A Benchmark for Evaluating Clinical Reasoning Capabilities in ECG Interpretation
par: Oh, Jungwoo, et autres
Publié: (2026)
par: Oh, Jungwoo, et autres
Publié: (2026)
Layout-and-Retouch: A Dual-stage Framework for Improving Diversity in Personalized Image Generation
par: Kim, Kangyeol, et autres
Publié: (2024)
par: Kim, Kangyeol, et autres
Publié: (2024)
Single Ground Truth Is Not Enough: Adding Flexibility to Aspect-Based Sentiment Analysis Evaluation
par: Yang, Soyoung, et autres
Publié: (2024)
par: Yang, Soyoung, et autres
Publié: (2024)
Documents similaires
-
Do's and Don'ts: Learning Desirable Skills with Instruction Videos
par: Kim, Hyunseung, et autres
Publié: (2024) -
Investigating Pre-Training Objectives for Generalization in Vision-Based Reinforcement Learning
par: Kim, Donghu, et autres
Publié: (2024) -
SimBa: Simplicity Bias for Scaling Up Parameters in Deep Reinforcement Learning
par: Lee, Hojoon, et autres
Publié: (2024) -
FIRE: Frobenius-Isometry Reinitialization for Balancing the Stability-Plasticity Tradeoff
par: Han, Isaac, et autres
Publié: (2026) -
Building Resource-Constrained Language Agents: A Korean Case Study on Chemical Toxicity Information
par: Cho, Hojun, et autres
Publié: (2025)