Streamlined optical training of large-scale modern deep learning architectures with direct feedback alignment
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Ziao, Müller, Kilian, Filipovich, Matthew, Launay, Julien, Ohana, Ruben, Pariente, Gustave, Mokaadi, Safa, Brossollet, Charles, Moreau, Fabien, Cappelli, Alessandro, Poli, Iacopo, Carron, Igor, Daudet, Laurent, Krzakala, Florent, Gigan, Sylvain |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Safo / Alphonse Daudet
par: Daudet, Alphonse
par: Daudet, Alphonse
TRON: Trainable, architecture-reconfigurable random optical neural networks
par: Wang, Ziao, et autres
Publié: (2026)
par: Wang, Ziao, et autres
Publié: (2026)
Estilos eruptivos asociados al volcanismo monogenético máfico de la región de Pasto Ventura, Puna Austral, Argentina
par: Rubén Filipovich
Publié: (2019)
par: Rubén Filipovich
Publié: (2019)
Price Dynamics in a Two-Period Reputation Model
par: Dragan Filipovich
Publié: (2001)
par: Dragan Filipovich
Publié: (2001)
Divergencia de intereses e informatividad de los mensajes en un modelo de señalización gratuita. Un ejemplo
par: Dragan Filipovich
Publié: (2008)
par: Dragan Filipovich
Publié: (2008)
Entropy Production from Density Field Theories for interacting particles systems
par: Brossollet, Antonin, et autres
Publié: (2025)
par: Brossollet, Antonin, et autres
Publié: (2025)
Learning with Restricted Boltzmann Machines: Asymptotics of AMP and GD in High Dimensions
par: Xu, Yizhou, et autres
Publié: (2025)
par: Xu, Yizhou, et autres
Publié: (2025)
Spectral Phase Transition and Optimal PCA in Block-Structured Spiked models
par: Mergny, Pierre, et autres
Publié: (2024)
par: Mergny, Pierre, et autres
Publié: (2024)
A High Dimensional Statistical Model for Adversarial Training: Geometry and Trade-Offs
par: Tanner, Kasimir, et autres
Publié: (2024)
par: Tanner, Kasimir, et autres
Publié: (2024)
Fundamental limits of Non-Linear Low-Rank Matrix Estimation
par: Mergny, Pierre, et autres
Publié: (2024)
par: Mergny, Pierre, et autres
Publié: (2024)
Sampling with flows, diffusion and autoregressive neural networks: A spin-glass perspective
par: Ghio, Davide, et autres
Publié: (2023)
par: Ghio, Davide, et autres
Publié: (2023)
Asymptotic Characterisation of Robust Empirical Risk Minimisation Performance in the Presence of Outliers
par: Vilucchio, Matteo, et autres
Publié: (2023)
par: Vilucchio, Matteo, et autres
Publié: (2023)
ColBERT-Zero: To Pre-train Or Not To Pre-train ColBERT models
par: Chaffin, Antoine, et autres
Publié: (2026)
par: Chaffin, Antoine, et autres
Publié: (2026)
Estimating rank-one matrices with mismatched prior and noise: universality and large deviations
par: Guionnet, Alice, et autres
Publié: (2023)
par: Guionnet, Alice, et autres
Publié: (2023)
A phase transition between positional and semantic learning in a solvable model of dot-product attention
par: Cui, Hugo, et autres
Publié: (2024)
par: Cui, Hugo, et autres
Publié: (2024)
Low-rank Matrix Estimation with Inhomogeneous Noise
par: Guionnet, Alice, et autres
Publié: (2022)
par: Guionnet, Alice, et autres
Publié: (2022)
Escaping mediocrity: how two-layer networks learn hard generalized linear models with SGD
par: Arnaboldi, Luca, et autres
Publié: (2023)
par: Arnaboldi, Luca, et autres
Publié: (2023)
Quenches in the Sherrington-Kirkpatrick model
par: Erba, Vittorio, et autres
Publié: (2024)
par: Erba, Vittorio, et autres
Publié: (2024)
The Computational Advantage of Depth: Learning High-Dimensional Hierarchical Functions with Gradient Descent
par: Dandi, Yatin, et autres
Publié: (2025)
par: Dandi, Yatin, et autres
Publié: (2025)
Computational Thresholds in Multi-Modal Learning via the Spiked Matrix-Tensor Model
par: Tabanelli, Hugo, et autres
Publié: (2025)
par: Tabanelli, Hugo, et autres
Publié: (2025)
Optimal scaling laws in learning hierarchical multi-index models
par: Defilippis, Leonardo, et autres
Publié: (2026)
par: Defilippis, Leonardo, et autres
Publié: (2026)
The Nuclear Route: Sharp Asymptotics of ERM in Overparameterized Quadratic Networks
par: Erba, Vittorio, et autres
Publié: (2025)
par: Erba, Vittorio, et autres
Publié: (2025)
Fundamental Limits of Matrix Sensing: Exact Asymptotics, Universality, and Applications
par: Xu, Yizhou, et autres
Publié: (2025)
par: Xu, Yizhou, et autres
Publié: (2025)
A Noise Sensitivity Exponent Controls Large Statistical-to-Computational Gaps in Single- and Multi-Index Models
par: Defilippis, Leonardo, et autres
Publié: (2026)
par: Defilippis, Leonardo, et autres
Publié: (2026)
Multi-layer State Evolution Under Random Convolutional Design
par: Daniels, Mara, et autres
Publié: (2022)
par: Daniels, Mara, et autres
Publié: (2022)
Deep Learning of Compositional Targets with Hierarchical Spectral Methods
par: Tabanelli, Hugo, et autres
Publié: (2026)
par: Tabanelli, Hugo, et autres
Publié: (2026)
Statistical mechanics of the maximum-average submatrix problem
par: Erba, Vittorio, et autres
Publié: (2023)
par: Erba, Vittorio, et autres
Publié: (2023)
Choose, Compose, Contemplate: Semantic Theorizing in Management Research
par: Lakshmi Balachandran Nair, et autres
Publié: (2026)
par: Lakshmi Balachandran Nair, et autres
Publié: (2026)
Analysis of learning a flow-based generative model from limited sample complexity
par: Cui, Hugo, et autres
Publié: (2023)
par: Cui, Hugo, et autres
Publié: (2023)
Provable Learning of Random Hierarchy Models and Hierarchical Shallow-to-Deep Chaining
par: Ren, Yunwei, et autres
Publié: (2026)
par: Ren, Yunwei, et autres
Publié: (2026)
On the Atypical Solutions of the Symmetric Binary Perceptron
par: Barbier, Damien, et autres
Publié: (2023)
par: Barbier, Damien, et autres
Publié: (2023)
Appropriateness of oxycodone use for acute pain in surgical and obstetric departments using a clinical data warehouse
par: Fabien Xuereb, et autres
Publié: (2025)
par: Fabien Xuereb, et autres
Publié: (2025)
Optical Computing with Spectrally Multiplexed Features in Complex Media
par: Dong, Xue, et autres
Publié: (2025)
par: Dong, Xue, et autres
Publié: (2025)
On Equational Noetherianity of Colorable Hierarchically Hyperbolic Groups
par: Barak, Ohana
Publié: (2024)
par: Barak, Ohana
Publié: (2024)
Effective Energy, Interactions And Out Of Equilibrium Nature Of Scalar Active Matter
par: Brossollet, Antonin, et autres
Publié: (2024)
par: Brossollet, Antonin, et autres
Publié: (2024)
Gaussian Universality of Perceptrons with Random Labels
par: Gerace, Federica, et autres
Publié: (2022)
par: Gerace, Federica, et autres
Publié: (2022)
Bayes-optimal learning of an extensive-width neural network from quadratically many samples
par: Maillard, Antoine, et autres
Publié: (2024)
par: Maillard, Antoine, et autres
Publié: (2024)
Deep Learning as Neural Low-Degree Filtering: A Spectral Theory of Hierarchical Feature Learning
par: Dandi, Yatin, et autres
Publié: (2026)
par: Dandi, Yatin, et autres
Publié: (2026)
Universality laws for Gaussian mixtures in generalized linear models
par: Dandi, Yatin, et autres
Publié: (2023)
par: Dandi, Yatin, et autres
Publié: (2023)
How Two-Layer Neural Networks Learn, One (Giant) Step at a Time
par: Dandi, Yatin, et autres
Publié: (2023)
par: Dandi, Yatin, et autres
Publié: (2023)
Documents similaires
-
Safo / Alphonse Daudet
par: Daudet, Alphonse -
TRON: Trainable, architecture-reconfigurable random optical neural networks
par: Wang, Ziao, et autres
Publié: (2026) -
Estilos eruptivos asociados al volcanismo monogenético máfico de la región de Pasto Ventura, Puna Austral, Argentina
par: Rubén Filipovich
Publié: (2019) -
Price Dynamics in a Two-Period Reputation Model
par: Dragan Filipovich
Publié: (2001) -
Divergencia de intereses e informatividad de los mensajes en un modelo de señalización gratuita. Un ejemplo
par: Dragan Filipovich
Publié: (2008)