Formation of Representations in Neural Networks
Fuente:
arXiv
Salvato in:
| Autori principali: | Ziyin, Liu, Chuang, Isaac, Galanti, Tomer, Poggio, Tomaso |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Heterosynaptic Circuits Are Universal Gradient Machines
di: Ziyin, Liu, et al.
Pubblicazione: (2025)
di: Ziyin, Liu, et al.
Pubblicazione: (2025)
Parameter Symmetry Potentially Unifies Deep Learning Theory
di: Ziyin, Liu, et al.
Pubblicazione: (2025)
di: Ziyin, Liu, et al.
Pubblicazione: (2025)
A universal compression theory for lottery ticket hypothesis and neural scaling laws
di: Wang, Hong-Yi, et al.
Pubblicazione: (2025)
di: Wang, Hong-Yi, et al.
Pubblicazione: (2025)
Proof of a perfect platonic representation hypothesis
di: Ziyin, Liu, et al.
Pubblicazione: (2025)
di: Ziyin, Liu, et al.
Pubblicazione: (2025)
Neural Thermodynamics: Entropic Forces in Deep and Universal Representation Learning
di: Ziyin, Liu, et al.
Pubblicazione: (2025)
di: Ziyin, Liu, et al.
Pubblicazione: (2025)
Training Dynamics of Nonlinear Contrastive Learning Model in the High Dimensional Limit
di: Meng, Lineghuan, et al.
Pubblicazione: (2024)
di: Meng, Lineghuan, et al.
Pubblicazione: (2024)
Graph Neural Networks Do Not Always Oversmooth
di: Epping, Bastian, et al.
Pubblicazione: (2024)
di: Epping, Bastian, et al.
Pubblicazione: (2024)
Demolition and Reinforcement of Memories in Spin-Glass-like Neural Networks
di: Ventura, Enrico
Pubblicazione: (2024)
di: Ventura, Enrico
Pubblicazione: (2024)
Dynamical Mean-Field Theory of Self-Attention Neural Networks
di: Poc-López, Ángel, et al.
Pubblicazione: (2024)
di: Poc-López, Ángel, et al.
Pubblicazione: (2024)
Growing Neural Networks: Dynamic Evolution through Gradient Descent
di: Radhakrishnan, Anil, et al.
Pubblicazione: (2025)
di: Radhakrishnan, Anil, et al.
Pubblicazione: (2025)
The Rules-and-Facts Model for Simultaneous Generalization and Memorization in Neural Networks
di: Farné, Gabriele, et al.
Pubblicazione: (2026)
di: Farné, Gabriele, et al.
Pubblicazione: (2026)
Benchmarking Graph Neural Networks in Solving Hard Constraint Satisfaction Problems
di: Skenderi, Geri, et al.
Pubblicazione: (2026)
di: Skenderi, Geri, et al.
Pubblicazione: (2026)
A Random-Matrix Criterion for Initializing Gated Recurrent Neural Networks
di: Fioratti, Tommaso, et al.
Pubblicazione: (2026)
di: Fioratti, Tommaso, et al.
Pubblicazione: (2026)
Controlled Langevin Dynamics for Sampling of Feedforward Neural Networks Trained with Minibatches
di: Zambon, Alessandro, et al.
Pubblicazione: (2026)
di: Zambon, Alessandro, et al.
Pubblicazione: (2026)
A Federated Many-to-One Hopfield model for associative Neural Networks
di: Alessandrelli, Andrea, et al.
Pubblicazione: (2026)
di: Alessandrelli, Andrea, et al.
Pubblicazione: (2026)
Kernel Renormalization in Bayesian Deep Neural Networks: the Equivalent Wishart Ansatz in the Proportional Regime
di: Baglioni, Paolo, et al.
Pubblicazione: (2026)
di: Baglioni, Paolo, et al.
Pubblicazione: (2026)
Graph Neural Network Approach to Predicting Magnetization in Quasi-One-Dimensional Ising Systems
di: Slavin, V., et al.
Pubblicazione: (2025)
di: Slavin, V., et al.
Pubblicazione: (2025)
The Quantization Model of Neural Scaling
di: Michaud, Eric J., et al.
Pubblicazione: (2023)
di: Michaud, Eric J., et al.
Pubblicazione: (2023)
Siamese Neural Network for Label-Efficient Critical Phenomena Prediction in 3D Percolation Models
di: Wang, Shanshan, et al.
Pubblicazione: (2025)
di: Wang, Shanshan, et al.
Pubblicazione: (2025)
Statistical Physics of Deep Neural Networks: Generalization Capability, Beyond the Infinite Width, and Feature Learning
di: Ariosto, Sebastiano
Pubblicazione: (2025)
di: Ariosto, Sebastiano
Pubblicazione: (2025)
Diffusion Operator Geometry of Feedforward Representations
di: Reddy, Kanishka
Pubblicazione: (2026)
di: Reddy, Kanishka
Pubblicazione: (2026)
Dynamics of Meta-learning Representation in the Teacher-student Scenario
di: Wang, Hui, et al.
Pubblicazione: (2024)
di: Wang, Hui, et al.
Pubblicazione: (2024)
Signal-to-Noise Ratio and Sample Size Govern Representational Alignment in Neural Networks
di: Umar, Ali Hussaini, et al.
Pubblicazione: (2026)
di: Umar, Ali Hussaini, et al.
Pubblicazione: (2026)
Explaining Neural Scaling Laws
di: Bahri, Yasaman, et al.
Pubblicazione: (2021)
di: Bahri, Yasaman, et al.
Pubblicazione: (2021)
Scaling Laws and Representation Learning in Simple Hierarchical Languages: Transformers vs. Convolutional Architectures
di: Cagnetta, Francesco, et al.
Pubblicazione: (2025)
di: Cagnetta, Francesco, et al.
Pubblicazione: (2025)
Neural Scaling Laws Rooted in the Data Distribution
di: Brill, Ari
Pubblicazione: (2024)
di: Brill, Ari
Pubblicazione: (2024)
A Dynamical Model of Neural Scaling Laws
di: Bordelon, Blake, et al.
Pubblicazione: (2024)
di: Bordelon, Blake, et al.
Pubblicazione: (2024)
How Feature Learning Can Improve Neural Scaling Laws
di: Bordelon, Blake, et al.
Pubblicazione: (2024)
di: Bordelon, Blake, et al.
Pubblicazione: (2024)
Exact Fixed-Point Constraints in Neural-ODEs with Provable Universality
di: Pacifico, Feliciano Giuseppe, et al.
Pubblicazione: (2026)
di: Pacifico, Feliciano Giuseppe, et al.
Pubblicazione: (2026)
Rotation-equivariant Graph Neural Networks for Learning Glassy Liquids Representations
di: Pezzicoli, Francesco Saverio, et al.
Pubblicazione: (2022)
di: Pezzicoli, Francesco Saverio, et al.
Pubblicazione: (2022)
Deep Learning as Neural Low-Degree Filtering: A Spectral Theory of Hierarchical Feature Learning
di: Dandi, Yatin, et al.
Pubblicazione: (2026)
di: Dandi, Yatin, et al.
Pubblicazione: (2026)
Transfer Learning in Infinite Width Feature Learning Networks
di: Lauditi, Clarissa, et al.
Pubblicazione: (2025)
di: Lauditi, Clarissa, et al.
Pubblicazione: (2025)
A Theory of Saddle Escape in Deep Nonlinear Networks
di: Rawal, Divit, et al.
Pubblicazione: (2026)
di: Rawal, Divit, et al.
Pubblicazione: (2026)
Dynamical Decoupling of Generalization and Overfitting in Large Two-Layer Networks
di: Montanari, Andrea, et al.
Pubblicazione: (2025)
di: Montanari, Andrea, et al.
Pubblicazione: (2025)
Natural Quantization of Neural Networks
di: Barney, Richard, et al.
Pubblicazione: (2025)
di: Barney, Richard, et al.
Pubblicazione: (2025)
Statistical Mechanics Calculations Using Variational Autoregressive Networks and Quantum Annealing
di: Tamura, Yuta, et al.
Pubblicazione: (2024)
di: Tamura, Yuta, et al.
Pubblicazione: (2024)
Grokking as a First Order Phase Transition in Two Layer Networks
di: Rubin, Noa, et al.
Pubblicazione: (2023)
di: Rubin, Noa, et al.
Pubblicazione: (2023)
Initial Guessing Bias: How Untrained Networks Favor Some Classes
di: Francazi, Emanuele, et al.
Pubblicazione: (2023)
di: Francazi, Emanuele, et al.
Pubblicazione: (2023)
Asymptotics of SGD in Sequence-Single Index Models and Single-Layer Attention Networks
di: Arnaboldi, Luca, et al.
Pubblicazione: (2025)
di: Arnaboldi, Luca, et al.
Pubblicazione: (2025)
The Training Process of Many Deep Networks Explores the Same Low-Dimensional Manifold
di: Mao, Jialin, et al.
Pubblicazione: (2023)
di: Mao, Jialin, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Heterosynaptic Circuits Are Universal Gradient Machines
di: Ziyin, Liu, et al.
Pubblicazione: (2025) -
Parameter Symmetry Potentially Unifies Deep Learning Theory
di: Ziyin, Liu, et al.
Pubblicazione: (2025) -
A universal compression theory for lottery ticket hypothesis and neural scaling laws
di: Wang, Hong-Yi, et al.
Pubblicazione: (2025) -
Proof of a perfect platonic representation hypothesis
di: Ziyin, Liu, et al.
Pubblicazione: (2025) -
Neural Thermodynamics: Entropic Forces in Deep and Universal Representation Learning
di: Ziyin, Liu, et al.
Pubblicazione: (2025)