The Effect of Architecture During Continual Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Hahn, Allyson, Raghavan, Krishnan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
On Understanding of the Dynamics of Model Capacity in Continual Learning
di: Chakraborty, Supriyo, et al.
Pubblicazione: (2025)
di: Chakraborty, Supriyo, et al.
Pubblicazione: (2025)
Mitigating Task-Order Sensitivity and Forgetting via Hierarchical Second-Order Consolidation
di: Nag, Protik, et al.
Pubblicazione: (2026)
di: Nag, Protik, et al.
Pubblicazione: (2026)
Sampling Imbalanced Data with Multi-objective Bilevel Optimization
di: Medlin, Karen, et al.
Pubblicazione: (2025)
di: Medlin, Karen, et al.
Pubblicazione: (2025)
Incentive-Aware Federated Averaging with Performance Guarantees under Strategic Participation
di: Maleki, Fateme, et al.
Pubblicazione: (2026)
di: Maleki, Fateme, et al.
Pubblicazione: (2026)
A Bilevel Optimization Framework for Imbalanced Data Classification
di: Medlin, Karen, et al.
Pubblicazione: (2024)
di: Medlin, Karen, et al.
Pubblicazione: (2024)
Deep Learning for Causal Inference: A Comparison of Architectures for Heterogeneous Treatment Effect Estimation
di: Papakostas, Demetrios, et al.
Pubblicazione: (2024)
di: Papakostas, Demetrios, et al.
Pubblicazione: (2024)
DELTA: Decoupling Long-Tailed Online Continual Learning
di: Raghavan, Siddeshwar, et al.
Pubblicazione: (2024)
di: Raghavan, Siddeshwar, et al.
Pubblicazione: (2024)
Effect of Optimizer, Initializer, and Architecture of Hypernetworks on Continual Learning from Demonstration
di: Auddy, Sayantan, et al.
Pubblicazione: (2023)
di: Auddy, Sayantan, et al.
Pubblicazione: (2023)
Double Machine Learning for Causal Inference under Shared-State Interference
di: Hays, Chris, et al.
Pubblicazione: (2025)
di: Hays, Chris, et al.
Pubblicazione: (2025)
Towards smaller, faster decoder-only transformers: Architectural variants and their implications
di: Suresh, Sathya Krishnan, et al.
Pubblicazione: (2024)
di: Suresh, Sathya Krishnan, et al.
Pubblicazione: (2024)
FedQueue: Queue-Aware Federated Learning for Cross-Facility HPC Training
di: Li, Yijiang, et al.
Pubblicazione: (2026)
di: Li, Yijiang, et al.
Pubblicazione: (2026)
Unsupervised Replay Strategies for Continual Learning with Limited Data
di: Bazhenov, Anthony, et al.
Pubblicazione: (2024)
di: Bazhenov, Anthony, et al.
Pubblicazione: (2024)
Continual Learning at the Edge: An Agnostic IIoT Architecture
di: García-Santaclara, Pablo, et al.
Pubblicazione: (2025)
di: García-Santaclara, Pablo, et al.
Pubblicazione: (2025)
Separations in the Representational Capabilities of Transformers and Recurrent Architectures
di: Bhattamishra, Satwik, et al.
Pubblicazione: (2024)
di: Bhattamishra, Satwik, et al.
Pubblicazione: (2024)
Noise-Tolerant Coreset-Based Class Incremental Continual Learning
di: Mucllari, Edison, et al.
Pubblicazione: (2025)
di: Mucllari, Edison, et al.
Pubblicazione: (2025)
Compound Fault Diagnosis for Train Transmission Systems Using Deep Learning with Fourier-enhanced Representation
di: Rico, Jonathan Adam, et al.
Pubblicazione: (2025)
di: Rico, Jonathan Adam, et al.
Pubblicazione: (2025)
Dynamic Synthetic Controls vs. Panel-Aware Double Machine Learning for Geo-Level Marketing Impact Estimation
di: Lee, Sang Su, et al.
Pubblicazione: (2025)
di: Lee, Sang Su, et al.
Pubblicazione: (2025)
Born a Transformer -- Always a Transformer? On the Effect of Pretraining on Architectural Abilities
di: Jobanputra, Mayank, et al.
Pubblicazione: (2025)
di: Jobanputra, Mayank, et al.
Pubblicazione: (2025)
TinyCL: An Efficient Hardware Architecture for Continual Learning on Autonomous Systems
di: Ressa, Eugenio, et al.
Pubblicazione: (2024)
di: Ressa, Eugenio, et al.
Pubblicazione: (2024)
IV-ICL: Bounding Causal Effects with Instrumental Variables via In-Context Learning
di: Balazadeh, Vahid, et al.
Pubblicazione: (2026)
di: Balazadeh, Vahid, et al.
Pubblicazione: (2026)
Causal Foundation Models with Continuous Treatments
di: Stith, Christopher, et al.
Pubblicazione: (2026)
di: Stith, Christopher, et al.
Pubblicazione: (2026)
The Impossibility of Inverse Permutation Learning in Transformer Models
di: Alur, Rohan, et al.
Pubblicazione: (2025)
di: Alur, Rohan, et al.
Pubblicazione: (2025)
A Bayesian Additive Regression Tree Model for Learning Conditional Average Treatment Effects in Regression Discontinuity Designs
di: Alcantara, Rafael, et al.
Pubblicazione: (2025)
di: Alcantara, Rafael, et al.
Pubblicazione: (2025)
Prediction of Hospital Associated Infections During Continuous Hospital Stays
di: Datta, Rituparna, et al.
Pubblicazione: (2025)
di: Datta, Rituparna, et al.
Pubblicazione: (2025)
CausalPFN: Amortized Causal Effect Estimation via In-Context Learning
di: Balazadeh, Vahid, et al.
Pubblicazione: (2025)
di: Balazadeh, Vahid, et al.
Pubblicazione: (2025)
Revisiting Neural Networks for Continual Learning: An Architectural Perspective
di: Lu, Aojun, et al.
Pubblicazione: (2024)
di: Lu, Aojun, et al.
Pubblicazione: (2024)
SPARC: Subspace-Aware Prompt Adaptation for Robust Continual Learning in LLMs
di: Jayasuriya, Dinithi, et al.
Pubblicazione: (2025)
di: Jayasuriya, Dinithi, et al.
Pubblicazione: (2025)
TS-HINT: Enhancing Semiconductor Time Series Regression Using Attention Hints From Large Language Model Reasoning
di: Rico, Jonathan Adam, et al.
Pubblicazione: (2025)
di: Rico, Jonathan Adam, et al.
Pubblicazione: (2025)
Incremental Multistep Forecasting of Battery Degradation Using Pseudo Targets
di: Rico, Jonathan Adam, et al.
Pubblicazione: (2025)
di: Rico, Jonathan Adam, et al.
Pubblicazione: (2025)
Learning During Detection: Continual Learning for Neural OFDM Receivers via DMRS
di: Obeed, Mohanad, et al.
Pubblicazione: (2026)
di: Obeed, Mohanad, et al.
Pubblicazione: (2026)
On the Effect of Instability on Learning Continuous-Time Linear Control Systems
di: Hafshejani, Reza Sadeghi, et al.
Pubblicazione: (2024)
di: Hafshejani, Reza Sadeghi, et al.
Pubblicazione: (2024)
Learning Regularizers: Learning Optimizers that can Regularize
di: Sahoo, Suraj Kumar, et al.
Pubblicazione: (2025)
di: Sahoo, Suraj Kumar, et al.
Pubblicazione: (2025)
Provably Learning Attention with Queries
di: Bhattamishra, Satwik, et al.
Pubblicazione: (2026)
di: Bhattamishra, Satwik, et al.
Pubblicazione: (2026)
Learning Predictive Checklists with Probabilistic Logic Programming
di: Makhija, Yukti, et al.
Pubblicazione: (2024)
di: Makhija, Yukti, et al.
Pubblicazione: (2024)
Algorithms for Collaborative Machine Learning under Statistical Heterogeneity
di: Hahn, Seok-Ju
Pubblicazione: (2024)
di: Hahn, Seok-Ju
Pubblicazione: (2024)
The Subjectivity of Monoculture
di: Jo, Nathanael, et al.
Pubblicazione: (2026)
di: Jo, Nathanael, et al.
Pubblicazione: (2026)
What Constitutes a Less Discriminatory Algorithm?
di: Laufer, Benjamin, et al.
Pubblicazione: (2024)
di: Laufer, Benjamin, et al.
Pubblicazione: (2024)
Estimating Treatment Effects with Independent Component Analysis
di: Reizinger, Patrik, et al.
Pubblicazione: (2025)
di: Reizinger, Patrik, et al.
Pubblicazione: (2025)
Learning Time-Varying Graph Signals via Koopman
di: Krishnan, Sivaram, et al.
Pubblicazione: (2025)
di: Krishnan, Sivaram, et al.
Pubblicazione: (2025)
Continuous Generative Neural Networks: A Wavelet-Based Architecture in Function Spaces
di: Alberti, Giovanni S., et al.
Pubblicazione: (2022)
di: Alberti, Giovanni S., et al.
Pubblicazione: (2022)
Documenti analoghi
-
On Understanding of the Dynamics of Model Capacity in Continual Learning
di: Chakraborty, Supriyo, et al.
Pubblicazione: (2025) -
Mitigating Task-Order Sensitivity and Forgetting via Hierarchical Second-Order Consolidation
di: Nag, Protik, et al.
Pubblicazione: (2026) -
Sampling Imbalanced Data with Multi-objective Bilevel Optimization
di: Medlin, Karen, et al.
Pubblicazione: (2025) -
Incentive-Aware Federated Averaging with Performance Guarantees under Strategic Participation
di: Maleki, Fateme, et al.
Pubblicazione: (2026) -
A Bilevel Optimization Framework for Imbalanced Data Classification
di: Medlin, Karen, et al.
Pubblicazione: (2024)