Efficient Continual Learning in Language Models via Thalamically Routed Cortical Columns
Fuente:
arXiv
Salvato in:
| Autore principale: | Khadangi, Afshin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Efficient Differentially Private Fine-Tuning of LLMs via Reinforcement Learning
di: Khadangi, Afshin, et al.
Pubblicazione: (2025)
di: Khadangi, Afshin, et al.
Pubblicazione: (2025)
Graph Reduction with Unsupervised Learning in Column Generation: A Routing Application
di: Abouelrous, Abdo, et al.
Pubblicazione: (2025)
di: Abouelrous, Abdo, et al.
Pubblicazione: (2025)
Reinforcement Learning for Solving the Pricing Problem in Column Generation: Applications to Vehicle Routing
di: Abouelrous, Abdo, et al.
Pubblicazione: (2025)
di: Abouelrous, Abdo, et al.
Pubblicazione: (2025)
Routing-Based Continual Learning for Multimodal Large Language Models
di: Mohta, Jay, et al.
Pubblicazione: (2025)
di: Mohta, Jay, et al.
Pubblicazione: (2025)
Learning to Route for Dynamic Adapter Composition in Continual Learning with Language Models
di: Araujo, Vladimir, et al.
Pubblicazione: (2024)
di: Araujo, Vladimir, et al.
Pubblicazione: (2024)
Winner-Take-All Column Row Sampling for Memory Efficient Adaptation of Language Model
di: Liu, Zirui, et al.
Pubblicazione: (2023)
di: Liu, Zirui, et al.
Pubblicazione: (2023)
Partial Column Generation with Graph Neural Networks for Team Formation and Routing
di: Dall'Olio, Giacomo, et al.
Pubblicazione: (2025)
di: Dall'Olio, Giacomo, et al.
Pubblicazione: (2025)
Noise Augmented Fine Tuning for Mitigating Hallucinations in Large Language Models
di: Khadangi, Afshin, et al.
Pubblicazione: (2025)
di: Khadangi, Afshin, et al.
Pubblicazione: (2025)
CognArtive: Large Language Models for Automating Art Analysis and Decoding Aesthetic Elements
di: Khadangi, Afshin, et al.
Pubblicazione: (2025)
di: Khadangi, Afshin, et al.
Pubblicazione: (2025)
Expert Routing with Synthetic Data for Continual Learning
di: Byun, Yewon, et al.
Pubblicazione: (2024)
di: Byun, Yewon, et al.
Pubblicazione: (2024)
Enhancing the Cross-Size Generalization for Solving Vehicle Routing Problems via Continual Learning
di: Li, Jingwen, et al.
Pubblicazione: (2025)
di: Li, Jingwen, et al.
Pubblicazione: (2025)
A Reinforcement-Learning-Based Multiple-Column Selection Strategy for Column Generation
di: Yuan, Haofeng, et al.
Pubblicazione: (2023)
di: Yuan, Haofeng, et al.
Pubblicazione: (2023)
HierRouter: Coordinated Routing of Specialized Large Language Models via Reinforcement Learning
di: Gupta, Nikunj, et al.
Pubblicazione: (2025)
di: Gupta, Nikunj, et al.
Pubblicazione: (2025)
SliceGPT: Compress Large Language Models by Deleting Rows and Columns
di: Ashkboos, Saleh, et al.
Pubblicazione: (2024)
di: Ashkboos, Saleh, et al.
Pubblicazione: (2024)
Conda: Column-Normalized Adam for Training Large Language Models Faster
di: Wang, Junjie, et al.
Pubblicazione: (2025)
di: Wang, Junjie, et al.
Pubblicazione: (2025)
Memory-Efficient Continual Learning with CLIP Models
di: King, Ryan, et al.
Pubblicazione: (2026)
di: King, Ryan, et al.
Pubblicazione: (2026)
Bullion: A Column Store for Machine Learning
di: Liao, Gang, et al.
Pubblicazione: (2024)
di: Liao, Gang, et al.
Pubblicazione: (2024)
Modular Continual Learning via Zero-Leakage Reconstruction Routing and Autonomous Task Discovery
di: Kermiche, Noureddine
Pubblicazione: (2026)
di: Kermiche, Noureddine
Pubblicazione: (2026)
CLARE: Continual Learning for Vision-Language-Action Models via Autonomous Adapter Routing and Expansion
di: Römer, Ralf, et al.
Pubblicazione: (2026)
di: Römer, Ralf, et al.
Pubblicazione: (2026)
Analytic Subspace Routing: How Recursive Least Squares Works in Continual Learning of Large Language Model
di: Tong, Kai, et al.
Pubblicazione: (2025)
di: Tong, Kai, et al.
Pubblicazione: (2025)
Continual Deep Reinforcement Learning for Decentralized Satellite Routing
di: Lozano-Cuadra, Federico, et al.
Pubblicazione: (2024)
di: Lozano-Cuadra, Federico, et al.
Pubblicazione: (2024)
All You Need is an Improving Column: Enhancing Column Generation for Parallel Machine Scheduling via Transformers
di: Hijazi, Amira, et al.
Pubblicazione: (2024)
di: Hijazi, Amira, et al.
Pubblicazione: (2024)
Algorithms for Learning Kernels Based on Centered Alignment
di: Cortes, Corinna, et al.
Pubblicazione: (2012)
di: Cortes, Corinna, et al.
Pubblicazione: (2012)
Spurious Forgetting in Continual Learning of Language Models
di: Zheng, Junhao, et al.
Pubblicazione: (2025)
di: Zheng, Junhao, et al.
Pubblicazione: (2025)
Adaptive Online Learning with LSTM Networks for Energy Price Prediction
di: Salihoglu, Salih, et al.
Pubblicazione: (2025)
di: Salihoglu, Salih, et al.
Pubblicazione: (2025)
Fair Column Subset Selection
di: Matakos, Antonis, et al.
Pubblicazione: (2023)
di: Matakos, Antonis, et al.
Pubblicazione: (2023)
Continual Learning for non-stationary regression via Memory-Efficient Replay
di: García-Santaclara, Pablo, et al.
Pubblicazione: (2026)
di: García-Santaclara, Pablo, et al.
Pubblicazione: (2026)
Goal-Guided Efficient Exploration via Large Language Model in Reinforcement Learning
di: Qi, Yajie, et al.
Pubblicazione: (2025)
di: Qi, Yajie, et al.
Pubblicazione: (2025)
Sample Efficient Reinforcement Learning via Large Vision Language Model Distillation
di: Lee, Donghoon, et al.
Pubblicazione: (2025)
di: Lee, Donghoon, et al.
Pubblicazione: (2025)
Inexact Column Generation for Bayesian Network Structure Learning via Difference-of-Submodular Optimization
di: Yang, Yiran, et al.
Pubblicazione: (2025)
di: Yang, Yiran, et al.
Pubblicazione: (2025)
RACER: Risk-Aware Calibrated Efficient Routing for Large Language Models
di: Hao, Sai, et al.
Pubblicazione: (2026)
di: Hao, Sai, et al.
Pubblicazione: (2026)
Routoo: Learning to Route to Large Language Models Effectively
di: Mohammadshahi, Alireza, et al.
Pubblicazione: (2024)
di: Mohammadshahi, Alireza, et al.
Pubblicazione: (2024)
Route Sparse Autoencoder to Interpret Large Language Models
di: Shi, Wei, et al.
Pubblicazione: (2025)
di: Shi, Wei, et al.
Pubblicazione: (2025)
Divide, Specialize, and Route: A New Approach to Efficient Ensemble Learning
di: Piwko, Jakub, et al.
Pubblicazione: (2025)
di: Piwko, Jakub, et al.
Pubblicazione: (2025)
Attribution-Guided Continual Learning for Large Language Models
di: Liu, Yazheng, et al.
Pubblicazione: (2026)
di: Liu, Yazheng, et al.
Pubblicazione: (2026)
Universal Model Routing for Efficient LLM Inference
di: Jitkrittum, Wittawat, et al.
Pubblicazione: (2025)
di: Jitkrittum, Wittawat, et al.
Pubblicazione: (2025)
Approximation of Permutation Invariant Polynomials by Transformers: Efficient Construction in Column-Size
di: Takeshita, Naoki, et al.
Pubblicazione: (2025)
di: Takeshita, Naoki, et al.
Pubblicazione: (2025)
PiCa: Parameter-Efficient Fine-Tuning with Column Space Projection
di: Hwang, Junseo, et al.
Pubblicazione: (2025)
di: Hwang, Junseo, et al.
Pubblicazione: (2025)
Learning Mamba as a Continual Learner: Meta-learning Selective State Space Models for Efficient Continual Learning
di: Zhao, Chongyang, et al.
Pubblicazione: (2024)
di: Zhao, Chongyang, et al.
Pubblicazione: (2024)
Analyzing Similarity Metrics for Data Selection for Language Model Pretraining
di: Sam, Dylan, et al.
Pubblicazione: (2025)
di: Sam, Dylan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Efficient Differentially Private Fine-Tuning of LLMs via Reinforcement Learning
di: Khadangi, Afshin, et al.
Pubblicazione: (2025) -
Graph Reduction with Unsupervised Learning in Column Generation: A Routing Application
di: Abouelrous, Abdo, et al.
Pubblicazione: (2025) -
Reinforcement Learning for Solving the Pricing Problem in Column Generation: Applications to Vehicle Routing
di: Abouelrous, Abdo, et al.
Pubblicazione: (2025) -
Routing-Based Continual Learning for Multimodal Large Language Models
di: Mohta, Jay, et al.
Pubblicazione: (2025) -
Learning to Route for Dynamic Adapter Composition in Continual Learning with Language Models
di: Araujo, Vladimir, et al.
Pubblicazione: (2024)