General-Purpose In-Context Learning by Meta-Learning Transformers
Fuente:
arXiv
Salvato in:
| Autori principali: | Kirsch, Louis, Harrison, James, Sohl-Dickstein, Jascha, Metz, Luke |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2022
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
The boundary of neural network trainability is fractal
di: Sohl-Dickstein, Jascha
Pubblicazione: (2024)
di: Sohl-Dickstein, Jascha
Pubblicazione: (2024)
LLM-Meta-SR: In-Context Learning for Evolving Selection Operators in Symbolic Regression
di: Zhang, Hengzhe, et al.
Pubblicazione: (2025)
di: Zhang, Hengzhe, et al.
Pubblicazione: (2025)
Evolving Reservoirs for Meta Reinforcement Learning
di: Léger, Corentin, et al.
Pubblicazione: (2023)
di: Léger, Corentin, et al.
Pubblicazione: (2023)
Meta-Learning Loss Functions for Deep Neural Networks
di: Raymond, Christian
Pubblicazione: (2024)
di: Raymond, Christian
Pubblicazione: (2024)
Massive Dimensions Reduction and Hybridization with Meta-heuristics in Deep Learning
di: Khosrowshahli, Rasa, et al.
Pubblicazione: (2024)
di: Khosrowshahli, Rasa, et al.
Pubblicazione: (2024)
Optimizing PM2.5 Forecasting Accuracy with Hybrid Meta-Heuristic and Machine Learning Models
di: Ghafariasl, Parviz, et al.
Pubblicazione: (2024)
di: Ghafariasl, Parviz, et al.
Pubblicazione: (2024)
Enabling Robust In-Context Memory and Rapid Task Adaptation in Transformers with Hebbian and Gradient-Based Plasticity
di: Chaudhary, Siddharth
Pubblicazione: (2025)
di: Chaudhary, Siddharth
Pubblicazione: (2025)
A Theory of Relation Learning and Cross-domain Generalization
di: Doumas, Leonidas A. A., et al.
Pubblicazione: (2019)
di: Doumas, Leonidas A. A., et al.
Pubblicazione: (2019)
Generalized Population-Based Training for Hyperparameter Optimization in Reinforcement Learning
di: Bai, Hui, et al.
Pubblicazione: (2024)
di: Bai, Hui, et al.
Pubblicazione: (2024)
Deep ARTMAP: Generalized Hierarchical Learning with Adaptive Resonance Theory
di: Melton, Niklas M., et al.
Pubblicazione: (2025)
di: Melton, Niklas M., et al.
Pubblicazione: (2025)
Instance Generation for Meta-Black-Box Optimization through Latent Space Reverse Engineering
di: Wang, Chen, et al.
Pubblicazione: (2025)
di: Wang, Chen, et al.
Pubblicazione: (2025)
On the Improvement of Generalization and Stability of Forward-Only Learning via Neural Polarization
di: Terres-Escudero, Erik B., et al.
Pubblicazione: (2024)
di: Terres-Escudero, Erik B., et al.
Pubblicazione: (2024)
Leave No Context Behind: Efficient Infinite Context Transformers with Infini-attention
di: Munkhdalai, Tsendsuren, et al.
Pubblicazione: (2024)
di: Munkhdalai, Tsendsuren, et al.
Pubblicazione: (2024)
Dynamical similarity analysis can identify compositional dynamics developing in RNNs
di: Guilhot, Quentin, et al.
Pubblicazione: (2024)
di: Guilhot, Quentin, et al.
Pubblicazione: (2024)
Recurrent Neural Networks Learn to Store and Generate Sequences using Non-Linear Representations
di: Csordás, Róbert, et al.
Pubblicazione: (2024)
di: Csordás, Róbert, et al.
Pubblicazione: (2024)
MetaBox-v2: A Unified Benchmark Platform for Meta-Black-Box Optimization
di: Ma, Zeyuan, et al.
Pubblicazione: (2025)
di: Ma, Zeyuan, et al.
Pubblicazione: (2025)
t-DGR: A Trajectory-Based Deep Generative Replay Method for Continual Learning in Decision Making
di: Yue, William, et al.
Pubblicazione: (2024)
di: Yue, William, et al.
Pubblicazione: (2024)
Learning Heuristics for Transit Network Design and Improvement with Deep Reinforcement Learning
di: Holliday, Andrew, et al.
Pubblicazione: (2024)
di: Holliday, Andrew, et al.
Pubblicazione: (2024)
Reinforced In-Context Black-Box Optimization
di: Song, Lei, et al.
Pubblicazione: (2024)
di: Song, Lei, et al.
Pubblicazione: (2024)
Hebbian Learning based Orthogonal Projection for Continual Learning of Spiking Neural Networks
di: Xiao, Mingqing, et al.
Pubblicazione: (2024)
di: Xiao, Mingqing, et al.
Pubblicazione: (2024)
Counter-Current Learning: A Biologically Plausible Dual Network Approach for Deep Learning
di: Kao, Chia-Hsiang, et al.
Pubblicazione: (2024)
di: Kao, Chia-Hsiang, et al.
Pubblicazione: (2024)
Task-free Adaptive Meta Black-box Optimization
di: Wang, Chao, et al.
Pubblicazione: (2026)
di: Wang, Chao, et al.
Pubblicazione: (2026)
Causal Learning with Neural Assemblies
di: Kopadi, Evangelia, et al.
Pubblicazione: (2026)
di: Kopadi, Evangelia, et al.
Pubblicazione: (2026)
On the Temperature of Machine Learning Systems
di: Zhang, Dong
Pubblicazione: (2024)
di: Zhang, Dong
Pubblicazione: (2024)
Learning and Improving Backgammon Strategy
di: Galperin, Gregory R.
Pubblicazione: (2025)
di: Galperin, Gregory R.
Pubblicazione: (2025)
Neuron-centric Hebbian Learning
di: Ferigo, Andrea, et al.
Pubblicazione: (2024)
di: Ferigo, Andrea, et al.
Pubblicazione: (2024)
Learning Graph Quantized Tokenizers
di: Wang, Limei, et al.
Pubblicazione: (2024)
di: Wang, Limei, et al.
Pubblicazione: (2024)
Dynamic Reinforcement Learning for Actors
di: Shibata, Katsunari
Pubblicazione: (2025)
di: Shibata, Katsunari
Pubblicazione: (2025)
Towards White Box Deep Learning
di: Satkiewicz, Maciej
Pubblicazione: (2024)
di: Satkiewicz, Maciej
Pubblicazione: (2024)
Fitness Approximation through Machine Learning
di: Tzruia, Itai, et al.
Pubblicazione: (2023)
di: Tzruia, Itai, et al.
Pubblicazione: (2023)
Prospective Compression in Human Abstraction Learning
di: Cano, Leonardo Hernandez, et al.
Pubblicazione: (2026)
di: Cano, Leonardo Hernandez, et al.
Pubblicazione: (2026)
Automated Deep Learning for Load Forecasting
di: Keisler, Julie, et al.
Pubblicazione: (2024)
di: Keisler, Julie, et al.
Pubblicazione: (2024)
Attending to Graph Transformers
di: Müller, Luis, et al.
Pubblicazione: (2023)
di: Müller, Luis, et al.
Pubblicazione: (2023)
Domain Generalization through Meta-Learning: A Survey
di: Khoee, Arsham Gholamzadeh, et al.
Pubblicazione: (2024)
di: Khoee, Arsham Gholamzadeh, et al.
Pubblicazione: (2024)
Deep Reinforcement Learning with Spiking Q-learning
di: Chen, Ding, et al.
Pubblicazione: (2022)
di: Chen, Ding, et al.
Pubblicazione: (2022)
On Non-Linear operators for Geometric Deep Learning
di: Sergeant-Perthuis, Grégoire, et al.
Pubblicazione: (2022)
di: Sergeant-Perthuis, Grégoire, et al.
Pubblicazione: (2022)
Introduction to Predictive Coding Networks for Machine Learning
di: Stenlund, Mikko
Pubblicazione: (2025)
di: Stenlund, Mikko
Pubblicazione: (2025)
Half-Space Feature Learning in Neural Networks
di: Yadav, Mahesh Lorik, et al.
Pubblicazione: (2024)
di: Yadav, Mahesh Lorik, et al.
Pubblicazione: (2024)
Mechanistic Neural Networks for Scientific Machine Learning
di: Pervez, Adeel, et al.
Pubblicazione: (2024)
di: Pervez, Adeel, et al.
Pubblicazione: (2024)
Offline Model-Based Optimization by Learning to Rank
di: Tan, Rong-Xi, et al.
Pubblicazione: (2024)
di: Tan, Rong-Xi, et al.
Pubblicazione: (2024)
Documenti analoghi
-
The boundary of neural network trainability is fractal
di: Sohl-Dickstein, Jascha
Pubblicazione: (2024) -
LLM-Meta-SR: In-Context Learning for Evolving Selection Operators in Symbolic Regression
di: Zhang, Hengzhe, et al.
Pubblicazione: (2025) -
Evolving Reservoirs for Meta Reinforcement Learning
di: Léger, Corentin, et al.
Pubblicazione: (2023) -
Meta-Learning Loss Functions for Deep Neural Networks
di: Raymond, Christian
Pubblicazione: (2024) -
Massive Dimensions Reduction and Hybridization with Meta-heuristics in Deep Learning
di: Khosrowshahli, Rasa, et al.
Pubblicazione: (2024)