Efficient Continual Learning in Language Models via Thalamically Routed Cortical Columns
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Khadangi, Afshin |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Efficient Differentially Private Fine-Tuning of LLMs via Reinforcement Learning
par: Khadangi, Afshin, et autres
Publié: (2025)
par: Khadangi, Afshin, et autres
Publié: (2025)
Graph Reduction with Unsupervised Learning in Column Generation: A Routing Application
par: Abouelrous, Abdo, et autres
Publié: (2025)
par: Abouelrous, Abdo, et autres
Publié: (2025)
Reinforcement Learning for Solving the Pricing Problem in Column Generation: Applications to Vehicle Routing
par: Abouelrous, Abdo, et autres
Publié: (2025)
par: Abouelrous, Abdo, et autres
Publié: (2025)
Routing-Based Continual Learning for Multimodal Large Language Models
par: Mohta, Jay, et autres
Publié: (2025)
par: Mohta, Jay, et autres
Publié: (2025)
Learning to Route for Dynamic Adapter Composition in Continual Learning with Language Models
par: Araujo, Vladimir, et autres
Publié: (2024)
par: Araujo, Vladimir, et autres
Publié: (2024)
Winner-Take-All Column Row Sampling for Memory Efficient Adaptation of Language Model
par: Liu, Zirui, et autres
Publié: (2023)
par: Liu, Zirui, et autres
Publié: (2023)
Partial Column Generation with Graph Neural Networks for Team Formation and Routing
par: Dall'Olio, Giacomo, et autres
Publié: (2025)
par: Dall'Olio, Giacomo, et autres
Publié: (2025)
Noise Augmented Fine Tuning for Mitigating Hallucinations in Large Language Models
par: Khadangi, Afshin, et autres
Publié: (2025)
par: Khadangi, Afshin, et autres
Publié: (2025)
CognArtive: Large Language Models for Automating Art Analysis and Decoding Aesthetic Elements
par: Khadangi, Afshin, et autres
Publié: (2025)
par: Khadangi, Afshin, et autres
Publié: (2025)
Expert Routing with Synthetic Data for Continual Learning
par: Byun, Yewon, et autres
Publié: (2024)
par: Byun, Yewon, et autres
Publié: (2024)
Enhancing the Cross-Size Generalization for Solving Vehicle Routing Problems via Continual Learning
par: Li, Jingwen, et autres
Publié: (2025)
par: Li, Jingwen, et autres
Publié: (2025)
A Reinforcement-Learning-Based Multiple-Column Selection Strategy for Column Generation
par: Yuan, Haofeng, et autres
Publié: (2023)
par: Yuan, Haofeng, et autres
Publié: (2023)
HierRouter: Coordinated Routing of Specialized Large Language Models via Reinforcement Learning
par: Gupta, Nikunj, et autres
Publié: (2025)
par: Gupta, Nikunj, et autres
Publié: (2025)
SliceGPT: Compress Large Language Models by Deleting Rows and Columns
par: Ashkboos, Saleh, et autres
Publié: (2024)
par: Ashkboos, Saleh, et autres
Publié: (2024)
Conda: Column-Normalized Adam for Training Large Language Models Faster
par: Wang, Junjie, et autres
Publié: (2025)
par: Wang, Junjie, et autres
Publié: (2025)
Memory-Efficient Continual Learning with CLIP Models
par: King, Ryan, et autres
Publié: (2026)
par: King, Ryan, et autres
Publié: (2026)
Bullion: A Column Store for Machine Learning
par: Liao, Gang, et autres
Publié: (2024)
par: Liao, Gang, et autres
Publié: (2024)
Modular Continual Learning via Zero-Leakage Reconstruction Routing and Autonomous Task Discovery
par: Kermiche, Noureddine
Publié: (2026)
par: Kermiche, Noureddine
Publié: (2026)
CLARE: Continual Learning for Vision-Language-Action Models via Autonomous Adapter Routing and Expansion
par: Römer, Ralf, et autres
Publié: (2026)
par: Römer, Ralf, et autres
Publié: (2026)
Analytic Subspace Routing: How Recursive Least Squares Works in Continual Learning of Large Language Model
par: Tong, Kai, et autres
Publié: (2025)
par: Tong, Kai, et autres
Publié: (2025)
Continual Deep Reinforcement Learning for Decentralized Satellite Routing
par: Lozano-Cuadra, Federico, et autres
Publié: (2024)
par: Lozano-Cuadra, Federico, et autres
Publié: (2024)
All You Need is an Improving Column: Enhancing Column Generation for Parallel Machine Scheduling via Transformers
par: Hijazi, Amira, et autres
Publié: (2024)
par: Hijazi, Amira, et autres
Publié: (2024)
Algorithms for Learning Kernels Based on Centered Alignment
par: Cortes, Corinna, et autres
Publié: (2012)
par: Cortes, Corinna, et autres
Publié: (2012)
Spurious Forgetting in Continual Learning of Language Models
par: Zheng, Junhao, et autres
Publié: (2025)
par: Zheng, Junhao, et autres
Publié: (2025)
Adaptive Online Learning with LSTM Networks for Energy Price Prediction
par: Salihoglu, Salih, et autres
Publié: (2025)
par: Salihoglu, Salih, et autres
Publié: (2025)
Fair Column Subset Selection
par: Matakos, Antonis, et autres
Publié: (2023)
par: Matakos, Antonis, et autres
Publié: (2023)
Continual Learning for non-stationary regression via Memory-Efficient Replay
par: García-Santaclara, Pablo, et autres
Publié: (2026)
par: García-Santaclara, Pablo, et autres
Publié: (2026)
Goal-Guided Efficient Exploration via Large Language Model in Reinforcement Learning
par: Qi, Yajie, et autres
Publié: (2025)
par: Qi, Yajie, et autres
Publié: (2025)
Sample Efficient Reinforcement Learning via Large Vision Language Model Distillation
par: Lee, Donghoon, et autres
Publié: (2025)
par: Lee, Donghoon, et autres
Publié: (2025)
Inexact Column Generation for Bayesian Network Structure Learning via Difference-of-Submodular Optimization
par: Yang, Yiran, et autres
Publié: (2025)
par: Yang, Yiran, et autres
Publié: (2025)
RACER: Risk-Aware Calibrated Efficient Routing for Large Language Models
par: Hao, Sai, et autres
Publié: (2026)
par: Hao, Sai, et autres
Publié: (2026)
Routoo: Learning to Route to Large Language Models Effectively
par: Mohammadshahi, Alireza, et autres
Publié: (2024)
par: Mohammadshahi, Alireza, et autres
Publié: (2024)
Route Sparse Autoencoder to Interpret Large Language Models
par: Shi, Wei, et autres
Publié: (2025)
par: Shi, Wei, et autres
Publié: (2025)
Divide, Specialize, and Route: A New Approach to Efficient Ensemble Learning
par: Piwko, Jakub, et autres
Publié: (2025)
par: Piwko, Jakub, et autres
Publié: (2025)
Attribution-Guided Continual Learning for Large Language Models
par: Liu, Yazheng, et autres
Publié: (2026)
par: Liu, Yazheng, et autres
Publié: (2026)
Universal Model Routing for Efficient LLM Inference
par: Jitkrittum, Wittawat, et autres
Publié: (2025)
par: Jitkrittum, Wittawat, et autres
Publié: (2025)
Approximation of Permutation Invariant Polynomials by Transformers: Efficient Construction in Column-Size
par: Takeshita, Naoki, et autres
Publié: (2025)
par: Takeshita, Naoki, et autres
Publié: (2025)
PiCa: Parameter-Efficient Fine-Tuning with Column Space Projection
par: Hwang, Junseo, et autres
Publié: (2025)
par: Hwang, Junseo, et autres
Publié: (2025)
Learning Mamba as a Continual Learner: Meta-learning Selective State Space Models for Efficient Continual Learning
par: Zhao, Chongyang, et autres
Publié: (2024)
par: Zhao, Chongyang, et autres
Publié: (2024)
Analyzing Similarity Metrics for Data Selection for Language Model Pretraining
par: Sam, Dylan, et autres
Publié: (2025)
par: Sam, Dylan, et autres
Publié: (2025)
Documents similaires
-
Efficient Differentially Private Fine-Tuning of LLMs via Reinforcement Learning
par: Khadangi, Afshin, et autres
Publié: (2025) -
Graph Reduction with Unsupervised Learning in Column Generation: A Routing Application
par: Abouelrous, Abdo, et autres
Publié: (2025) -
Reinforcement Learning for Solving the Pricing Problem in Column Generation: Applications to Vehicle Routing
par: Abouelrous, Abdo, et autres
Publié: (2025) -
Routing-Based Continual Learning for Multimodal Large Language Models
par: Mohta, Jay, et autres
Publié: (2025) -
Learning to Route for Dynamic Adapter Composition in Continual Learning with Language Models
par: Araujo, Vladimir, et autres
Publié: (2024)