Model Zoo: A Growing "Brain" That Learns Continually
Fuente:
arXiv
Guardado en:
| Autores principales: | Ramesh, Rahul, Chaudhari, Pratik |
|---|---|
| Formato: | Preprint |
| Publicado: |
2021
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Prospective Learning: Learning for a Dynamic Future
por: De Silva, Ashwin, et al.
Publicado: (2024)
por: De Silva, Ashwin, et al.
Publicado: (2024)
Learning Capacity: A Measure of the Effective Dimensionality of a Model
por: Chen, Daiwei, et al.
Publicado: (2023)
por: Chen, Daiwei, et al.
Publicado: (2023)
An Effective Gram Matrix Characterizes Generalization in Deep Networks
por: Yang, Rubing, et al.
Publicado: (2025)
por: Yang, Rubing, et al.
Publicado: (2025)
An Information-Geometric Distance on the Space of Tasks
por: Gao, Yansong, et al.
Publicado: (2020)
por: Gao, Yansong, et al.
Publicado: (2020)
Language Modeling with Learned Meta-Tokens
por: Shah, Alok N., et al.
Publicado: (2025)
por: Shah, Alok N., et al.
Publicado: (2025)
Heat Death of Generative Models in Closed-Loop Learning
por: Marchi, Matteo, et al.
Publicado: (2024)
por: Marchi, Matteo, et al.
Publicado: (2024)
Many Perception Tasks are Highly Redundant Functions of their Input Data
por: Ramesh, Rahul, et al.
Publicado: (2024)
por: Ramesh, Rahul, et al.
Publicado: (2024)
Budgeting Counterfactual for Offline RL
por: Liu, Yao, et al.
Publicado: (2023)
por: Liu, Yao, et al.
Publicado: (2023)
Adapting Machine Learning Diagnostic Models to New Populations Using a Small Amount of Data: Results from Clinical Neuroscience
por: Wang, Rongguang, et al.
Publicado: (2023)
por: Wang, Rongguang, et al.
Publicado: (2023)
A Confidence Interval for the $\ell_2$ Expected Calibration Error
por: Sun, Yan, et al.
Publicado: (2024)
por: Sun, Yan, et al.
Publicado: (2024)
Prospective Learning in Retrospect
por: Bai, Yuxin, et al.
Publicado: (2025)
por: Bai, Yuxin, et al.
Publicado: (2025)
Fast Feature Field ($\text{F}^3$): A Predictive Representation of Events
por: Das, Richeek, et al.
Publicado: (2025)
por: Das, Richeek, et al.
Publicado: (2025)
The Training Process of Many Deep Networks Explores the Same Low-Dimensional Manifold
por: Mao, Jialin, et al.
Publicado: (2023)
por: Mao, Jialin, et al.
Publicado: (2023)
How does Chain of Thought decompose complex tasks?
por: Nadgir, Amrut, et al.
Publicado: (2026)
por: Nadgir, Amrut, et al.
Publicado: (2026)
A Forget-and-Grow Strategy for Deep Reinforcement Learning Scaling in Continuous Control
por: Kang, Zilin, et al.
Publicado: (2025)
por: Kang, Zilin, et al.
Publicado: (2025)
FLAME: Adaptive Mixture-of-Experts for Continual Multimodal Multi-Task Learning
por: Han, Xing, et al.
Publicado: (2026)
por: Han, Xing, et al.
Publicado: (2026)
Growing with Experience: Growing Neural Networks in Deep Reinforcement Learning
por: Fehring, Lukas, et al.
Publicado: (2025)
por: Fehring, Lukas, et al.
Publicado: (2025)
Deep Implicit Optimization enables Robust Learnable Features for Deformable Image Registration
por: Jena, Rohit, et al.
Publicado: (2024)
por: Jena, Rohit, et al.
Publicado: (2024)
Meanings and Feelings of Large Language Models: Observability of Latent States in Generative AI
por: Liu, Tian Yu, et al.
Publicado: (2024)
por: Liu, Tian Yu, et al.
Publicado: (2024)
Time-Varying Propensity Score to Bridge the Gap between the Past and Present
por: Fakoor, Rasool, et al.
Publicado: (2022)
por: Fakoor, Rasool, et al.
Publicado: (2022)
A Model Zoo of Vision Transformers
por: Falk, Damian, et al.
Publicado: (2025)
por: Falk, Damian, et al.
Publicado: (2025)
The Impact of Model Zoo Size and Composition on Weight Space Learning
por: Falk, Damian, et al.
Publicado: (2025)
por: Falk, Damian, et al.
Publicado: (2025)
Bridging the Training-Inference Gap in LLMs by Leveraging Self-Generated Tokens
por: Cen, Zhepeng, et al.
Publicado: (2024)
por: Cen, Zhepeng, et al.
Publicado: (2024)
Model Selection with Model Zoo via Graph Learning
por: Li, Ziyu, et al.
Publicado: (2024)
por: Li, Ziyu, et al.
Publicado: (2024)
A Model Zoo on Phase Transitions in Neural Networks
por: Schürholt, Konstantin, et al.
Publicado: (2025)
por: Schürholt, Konstantin, et al.
Publicado: (2025)
Learning to Forget: Continual Learning with Adaptive Weight Decay
por: Ramesh, Aditya A., et al.
Publicado: (2026)
por: Ramesh, Aditya A., et al.
Publicado: (2026)
Grow-Prune-Freeze Networks: Adaptive & Continual Learning Technique for Olfactory Navigation
por: France, Kordel K., et al.
Publicado: (2026)
por: France, Kordel K., et al.
Publicado: (2026)
Cross-Modal Computational Model of Brain-Heart Interactions via HRV and EEG Feature
por: Pradeep, Malavika, et al.
Publicado: (2026)
por: Pradeep, Malavika, et al.
Publicado: (2026)
When To Grow? A Fitting Risk-Aware Policy for Layer Growing in Deep Neural Networks
por: Wu, Haihang, et al.
Publicado: (2024)
por: Wu, Haihang, et al.
Publicado: (2024)
Spatio-temporal DeepKriging in PyTorch: A Supplementary Application to Precipitation Data for Interpolation and Probabilistic Forecasting
por: Nag, Pratik
Publicado: (2025)
por: Nag, Pratik
Publicado: (2025)
Causal Foundation Models with Continuous Treatments
por: Stith, Christopher, et al.
Publicado: (2026)
por: Stith, Christopher, et al.
Publicado: (2026)
Adversarial Multi-dueling Bandits
por: Gajane, Pratik
Publicado: (2024)
por: Gajane, Pratik
Publicado: (2024)
Shared LoRA Subspaces for almost Strict Continual Learning
por: Kaushik, Prakhar, et al.
Publicado: (2026)
por: Kaushik, Prakhar, et al.
Publicado: (2026)
From Linearity to Non-Linearity: How Masked Autoencoders Capture Spatial Correlations
por: Bisulco, Anthony, et al.
Publicado: (2025)
por: Bisulco, Anthony, et al.
Publicado: (2025)
An Analytical Characterization of Sloppiness in Neural Networks: Insights from Linear Models
por: Mao, Jialin, et al.
Publicado: (2025)
por: Mao, Jialin, et al.
Publicado: (2025)
ZipIt! Merging Models from Different Tasks without Training
por: Stoica, George, et al.
Publicado: (2023)
por: Stoica, George, et al.
Publicado: (2023)
GradNetOT: Learning Optimal Transport Maps with GradNets
por: Chaudhari, Shreyas, et al.
Publicado: (2025)
por: Chaudhari, Shreyas, et al.
Publicado: (2025)
Resolving Interference (RI): Disentangling Models for Improved Model Merging
por: Ramesh, Pratik, et al.
Publicado: (2026)
por: Ramesh, Pratik, et al.
Publicado: (2026)
A Goemans-Williamson type algorithm for identifying subcohorts in clinical trials
por: Worah, Pratik
Publicado: (2025)
por: Worah, Pratik
Publicado: (2025)
Beyond Performance Scores: Directed Functional Connectivity as a Brain-Based Biomarker for Motor Skill Learning and Retention
por: Kamat, Anil, et al.
Publicado: (2025)
por: Kamat, Anil, et al.
Publicado: (2025)
Ejemplares similares
-
Prospective Learning: Learning for a Dynamic Future
por: De Silva, Ashwin, et al.
Publicado: (2024) -
Learning Capacity: A Measure of the Effective Dimensionality of a Model
por: Chen, Daiwei, et al.
Publicado: (2023) -
An Effective Gram Matrix Characterizes Generalization in Deep Networks
por: Yang, Rubing, et al.
Publicado: (2025) -
An Information-Geometric Distance on the Space of Tasks
por: Gao, Yansong, et al.
Publicado: (2020) -
Language Modeling with Learned Meta-Tokens
por: Shah, Alok N., et al.
Publicado: (2025)