A Resource Model For Neural Scaling Law
Fuente:
arXiv
Salvato in:
| Autori principali: | Song, Jinyeop, Liu, Ziming, Tegmark, Max, Gore, Jeff |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Beyond Uniform Scaling: Exploring Depth Heterogeneity in Neural Architectures
di: T, Akash Guna R., et al.
Pubblicazione: (2024)
di: T, Akash Guna R., et al.
Pubblicazione: (2024)
Fast Clifford Neural Layers
di: Xia, Tianxiang, et al.
Pubblicazione: (2025)
di: Xia, Tianxiang, et al.
Pubblicazione: (2025)
Hierarchical Self-Attention: Generalizing Neural Attention Mechanics to Multi-Scale Problems
di: Amizadeh, Saeed, et al.
Pubblicazione: (2025)
di: Amizadeh, Saeed, et al.
Pubblicazione: (2025)
Understanding the Functional Roles of Modelling Components in Spiking Neural Networks
di: Yin, Huifeng, et al.
Pubblicazione: (2024)
di: Yin, Huifeng, et al.
Pubblicazione: (2024)
Knowledge-aware Evolutionary Graph Neural Architecture Search
di: Wang, Chao, et al.
Pubblicazione: (2024)
di: Wang, Chao, et al.
Pubblicazione: (2024)
Multi-scale Topology Optimization using Neural Networks
di: Chen, Hongrui, et al.
Pubblicazione: (2024)
di: Chen, Hongrui, et al.
Pubblicazione: (2024)
Scaling Laws and Tradeoffs in Recurrent Networks of Expressive Neurons
di: Spieler, Aaron, et al.
Pubblicazione: (2026)
di: Spieler, Aaron, et al.
Pubblicazione: (2026)
On the Markov Property of Neural Algorithmic Reasoning: Analyses and Methods
di: Bohde, Montgomery, et al.
Pubblicazione: (2024)
di: Bohde, Montgomery, et al.
Pubblicazione: (2024)
Attentions Under the Microscope: A Comparative Study of Resource Utilization for Variants of Self-Attention
di: Tian, Zhengyu, et al.
Pubblicazione: (2025)
di: Tian, Zhengyu, et al.
Pubblicazione: (2025)
On Accelerating Edge AI: Optimizing Resource-Constrained Environments
di: Sander, Jacob, et al.
Pubblicazione: (2025)
di: Sander, Jacob, et al.
Pubblicazione: (2025)
Parallelization of Non-linear State-Space Models: Scaling Up Liquid-Resistance Liquid-Capacitance Networks for Efficient Sequence Modeling
di: Farsang, Mónika, et al.
Pubblicazione: (2025)
di: Farsang, Mónika, et al.
Pubblicazione: (2025)
SPEAR: Structured Pruning for Spiking Neural Networks via Synaptic Operation Estimation and Reinforcement Learning
di: Xie, Hui, et al.
Pubblicazione: (2025)
di: Xie, Hui, et al.
Pubblicazione: (2025)
NORACL: Neurogenesis for Oracle-free Resource-Adaptive Continual Learning
di: Raghunathan, Karthik Charan, et al.
Pubblicazione: (2026)
di: Raghunathan, Karthik Charan, et al.
Pubblicazione: (2026)
Traveling Waves Encode the Recent Past and Enhance Sequence Learning
di: Keller, T. Anderson, et al.
Pubblicazione: (2023)
di: Keller, T. Anderson, et al.
Pubblicazione: (2023)
Advancing Direct Training for Spiking Neural Networks with Circulate-Firing Neurons and Learnable Gradients
di: Zhou, Feifan, et al.
Pubblicazione: (2026)
di: Zhou, Feifan, et al.
Pubblicazione: (2026)
Perception-Informed Neural Networks: Beyond Physics-Informed Neural Networks
di: Mazandarani, Mehran, et al.
Pubblicazione: (2025)
di: Mazandarani, Mehran, et al.
Pubblicazione: (2025)
The Enduring Dominance of Deep Neural Networks: A Critical Analysis of the Fundamental Limitations of Quantum Machine Learning and Spiking Neural Networks
di: Ishikawa, Takehiro
Pubblicazione: (2025)
di: Ishikawa, Takehiro
Pubblicazione: (2025)
Probabilistic Neural Circuits
di: Martires, Pedro Zuidberg Dos
Pubblicazione: (2024)
di: Martires, Pedro Zuidberg Dos
Pubblicazione: (2024)
Neural Interpretable Reasoning
di: Barbiero, Pietro, et al.
Pubblicazione: (2025)
di: Barbiero, Pietro, et al.
Pubblicazione: (2025)
SpikeNAS: A Fast Memory-Aware Neural Architecture Search Framework for Spiking Neural Network-based Embedded AI Systems
di: Putra, Rachmad Vidya Wicaksana, et al.
Pubblicazione: (2024)
di: Putra, Rachmad Vidya Wicaksana, et al.
Pubblicazione: (2024)
LLS: Local Learning Rule for Deep Neural Networks Inspired by Neural Activity Synchronization
di: Apolinario, Marco Paul E., et al.
Pubblicazione: (2024)
di: Apolinario, Marco Paul E., et al.
Pubblicazione: (2024)
CR-BLEA: Contrastive Ranking for Adaptive Resource Allocation in Bilevel Evolutionary Algorithms
di: Xu, Dejun, et al.
Pubblicazione: (2025)
di: Xu, Dejun, et al.
Pubblicazione: (2025)
Restricted Bayesian Neural Network
di: Ganguly, Sourav, et al.
Pubblicazione: (2024)
di: Ganguly, Sourav, et al.
Pubblicazione: (2024)
Deep Oscillatory Neural Network
di: Rohan, Nurani Rajagopal, et al.
Pubblicazione: (2024)
di: Rohan, Nurani Rajagopal, et al.
Pubblicazione: (2024)
Time Elastic Neural Networks
di: Marteau, Pierre-François
Pubblicazione: (2024)
di: Marteau, Pierre-François
Pubblicazione: (2024)
Causal Learning with Neural Assemblies
di: Kopadi, Evangelia, et al.
Pubblicazione: (2026)
di: Kopadi, Evangelia, et al.
Pubblicazione: (2026)
Polysemanticity and Capacity in Neural Networks
di: Scherlis, Adam, et al.
Pubblicazione: (2022)
di: Scherlis, Adam, et al.
Pubblicazione: (2022)
Deep Neural Regression Collapse
di: Rangamani, Akshay, et al.
Pubblicazione: (2026)
di: Rangamani, Akshay, et al.
Pubblicazione: (2026)
A Theory of Synaptic Neural Balance: From Local to Global Order
di: Baldi, Pierre, et al.
Pubblicazione: (2024)
di: Baldi, Pierre, et al.
Pubblicazione: (2024)
A Neural Network Training Method Based on Distributed PID Control
di: Kun, Jiang
Pubblicazione: (2024)
di: Kun, Jiang
Pubblicazione: (2024)
What Planning Problems Can A Relational Neural Network Solve?
di: Mao, Jiayuan, et al.
Pubblicazione: (2023)
di: Mao, Jiayuan, et al.
Pubblicazione: (2023)
A Scalable Hybrid Training Approach for Recurrent Spiking Neural Networks
di: Baronig, Maximilian, et al.
Pubblicazione: (2025)
di: Baronig, Maximilian, et al.
Pubblicazione: (2025)
SEval-NAS: A Search-Agnostic Evaluation for Neural Architecture Search
di: Mih, Atah Nuh, et al.
Pubblicazione: (2026)
di: Mih, Atah Nuh, et al.
Pubblicazione: (2026)
SAN: Hypothesizing Long-Term Synaptic Development and Neural Engram Mechanism in Scalable Model's Parameter-Efficient Fine-Tuning
di: Dai, Gaole, et al.
Pubblicazione: (2024)
di: Dai, Gaole, et al.
Pubblicazione: (2024)
A Learning-Based Cooperative Coevolution Framework for Heterogeneous Large-Scale Global Optimization
di: Qiu, Wenjie, et al.
Pubblicazione: (2026)
di: Qiu, Wenjie, et al.
Pubblicazione: (2026)
Neural Thermodynamic Laws for Large Language Model Training
di: Liu, Ziming, et al.
Pubblicazione: (2025)
di: Liu, Ziming, et al.
Pubblicazione: (2025)
Continuous Spiking Graph Neural Networks
di: Yin, Nan, et al.
Pubblicazione: (2024)
di: Yin, Nan, et al.
Pubblicazione: (2024)
Feedback Favors the Generalization of Neural ODEs
di: Jia, Jindou, et al.
Pubblicazione: (2024)
di: Jia, Jindou, et al.
Pubblicazione: (2024)
Sheaf Neural Networks and biomedical applications
di: Mehrab, Aneeqa, et al.
Pubblicazione: (2026)
di: Mehrab, Aneeqa, et al.
Pubblicazione: (2026)
Spark: Modular Spiking Neural Networks
di: Franco, Mario, et al.
Pubblicazione: (2026)
di: Franco, Mario, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Beyond Uniform Scaling: Exploring Depth Heterogeneity in Neural Architectures
di: T, Akash Guna R., et al.
Pubblicazione: (2024) -
Fast Clifford Neural Layers
di: Xia, Tianxiang, et al.
Pubblicazione: (2025) -
Hierarchical Self-Attention: Generalizing Neural Attention Mechanics to Multi-Scale Problems
di: Amizadeh, Saeed, et al.
Pubblicazione: (2025) -
Understanding the Functional Roles of Modelling Components in Spiking Neural Networks
di: Yin, Huifeng, et al.
Pubblicazione: (2024) -
Knowledge-aware Evolutionary Graph Neural Architecture Search
di: Wang, Chao, et al.
Pubblicazione: (2024)