On the Role of Initialization on the Implicit Bias in Deep Linear Networks
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Gruber, Oria, Avron, Haim |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Faster Randomized Methods for Orthogonality Constrained Problems
par: Shustin, Boris, et autres
Publié: (2021)
par: Shustin, Boris, et autres
Publié: (2021)
Higher Order Reduced Rank Regression
par: Greenberg, Leia, et autres
Publié: (2025)
par: Greenberg, Leia, et autres
Publié: (2025)
On Encoding Matrices using Quantum Circuits
par: Yosef, Liron Mor, et autres
Publié: (2025)
par: Yosef, Liron Mor, et autres
Publié: (2025)
Multivariate trace estimation using quantum state space linear algebra
par: Yosef, Liron Mor, et autres
Publié: (2024)
par: Yosef, Liron Mor, et autres
Publié: (2024)
Quasitubal Tensor Algebra Over Separable Hilbert Spaces
par: Mor, Uria, et autres
Publié: (2025)
par: Mor, Uria, et autres
Publié: (2025)
Demystifying Tubal Tensor Algebra
par: Avron, Haim, et autres
Publié: (2025)
par: Avron, Haim, et autres
Publié: (2025)
Deriving Transformer Architectures as Implicit Multinomial Regression
par: Actor, Jonas A., et autres
Publié: (2025)
par: Actor, Jonas A., et autres
Publié: (2025)
Escaping Spectral Bias without Backpropagation: Fast Implicit Neural Representations with Extreme Learning Machines
par: Cho, Woojin, et autres
Publié: (2026)
par: Cho, Woojin, et autres
Publié: (2026)
Provable Emergence of Deep Neural Collapse and Low-Rank Bias in $L^2$-Regularized Nonlinear Networks
par: Zangrando, Emanuele, et autres
Publié: (2024)
par: Zangrando, Emanuele, et autres
Publié: (2024)
Multi-scale DeepOnet (Mscale-DeepOnet) for Mitigating Spectral Bias in Learning High Frequency Operators of Oscillatory Functions
par: Wang, Bo, et autres
Publié: (2025)
par: Wang, Bo, et autres
Publié: (2025)
Bayesian Physics Informed Neural Networks for Linear Inverse problems
par: Mohammad-Djafari, Ali
Publié: (2025)
par: Mohammad-Djafari, Ali
Publié: (2025)
Random Neural Network Expressivity for Non-Linear Partial Differential Equations
par: Mehmood, Muhammed Ali, et autres
Publié: (2026)
par: Mehmood, Muhammed Ali, et autres
Publié: (2026)
Conformalized-DeepONet: A Distribution-Free Framework for Uncertainty Quantification in Deep Operator Networks
par: Moya, Christian, et autres
Publié: (2024)
par: Moya, Christian, et autres
Publié: (2024)
Deep Network Trainability via Persistent Subspace Orthogonality
par: Massucco, Alex, et autres
Publié: (2025)
par: Massucco, Alex, et autres
Publié: (2025)
Geometric Layer-wise Approximation Rates for Deep Networks
par: Zhang, Shijun, et autres
Publié: (2026)
par: Zhang, Shijun, et autres
Publié: (2026)
Expressive Power of Deep Networks on Manifolds: Simultaneous Approximation
par: Zhou, Hanfei, et autres
Publié: (2025)
par: Zhou, Hanfei, et autres
Publié: (2025)
Deep NURBS -- Admissible Physics-informed Neural Networks
par: Saidaoui, Hamed, et autres
Publié: (2022)
par: Saidaoui, Hamed, et autres
Publié: (2022)
Learning Discontinuous Galerkin Solutions to Elliptic Problems via Small Linear Convolutional Neural Networks
par: Celaya, Adrian, et autres
Publié: (2025)
par: Celaya, Adrian, et autres
Publié: (2025)
Deep Neural Network Solutions for Oscillatory Fredholm Integral Equations
par: Jiang, Jie, et autres
Publié: (2024)
par: Jiang, Jie, et autres
Publié: (2024)
Physics-informed Discretization-independent Deep Compositional Operator Network
par: Zhong, Weiheng, et autres
Publié: (2024)
par: Zhong, Weiheng, et autres
Publié: (2024)
Lattice-based Deep Neural Networks: Regularity and Tailored Regularization
par: Keller, Alexander, et autres
Publié: (2026)
par: Keller, Alexander, et autres
Publié: (2026)
Approximation Power of Deep Neural Networks: an explanatory mathematical survey
par: Davis, Owen, et autres
Publié: (2022)
par: Davis, Owen, et autres
Publié: (2022)
PirateNets: Physics-informed Deep Learning with Residual Adaptive Networks
par: Wang, Sifan, et autres
Publié: (2024)
par: Wang, Sifan, et autres
Publié: (2024)
On the Dimension-Free Approximation of Deep Neural Networks for Symmetric Korobov Functions
par: Lu, Yulong, et autres
Publié: (2025)
par: Lu, Yulong, et autres
Publié: (2025)
Efficient Transformer-Inspired Variants of Physics-Informed Deep Operator Networks
par: Wei, Zhi-Feng, et autres
Publié: (2025)
par: Wei, Zhi-Feng, et autres
Publié: (2025)
Deep Eigenspace Network for Parametric Non-self-adjoint Eigenvalue Problems
par: Li, H., et autres
Publié: (2025)
par: Li, H., et autres
Publié: (2025)
Sobolev Approximation of Deep ReLU Networks in Log-Barron Space
par: Song, Changhoon, et autres
Publié: (2026)
par: Song, Changhoon, et autres
Publié: (2026)
Inverse Evolution Layers: Physics-informed Regularizers for Deep Neural Networks
par: Liu, Chaoyu, et autres
Publié: (2023)
par: Liu, Chaoyu, et autres
Publié: (2023)
Learning from Linear Algebra: A Graph Neural Network Approach to Preconditioner Design for Conjugate Gradient Solvers
par: Trifonov, Vladislav, et autres
Publié: (2024)
par: Trifonov, Vladislav, et autres
Publié: (2024)
Pruning AMR: Efficient Visualization of Implicit Neural Representations via Weight Matrix Analysis
par: Zvonek, Jennifer, et autres
Publié: (2025)
par: Zvonek, Jennifer, et autres
Publié: (2025)
Stochastic Dimension Implicit Functional Projections for Exact Integral Conservation in High-Dimensional PINNs
par: Liang, Zhangyong
Publié: (2026)
par: Liang, Zhangyong
Publié: (2026)
Foundations of Polar Linear Algebra
par: Guasti, Giovanni
Publié: (2026)
par: Guasti, Giovanni
Publié: (2026)
Learning the Exact Time Integration Algorithm for Initial Value Problems by Randomized Neural Networks
par: Dong, Suchuan, et autres
Publié: (2025)
par: Dong, Suchuan, et autres
Publié: (2025)
Learning to Solve Related Linear Systems
par: Hegde, Disha, et autres
Publié: (2025)
par: Hegde, Disha, et autres
Publié: (2025)
Data-Augmented Predictive Deep Neural Network: Enhancing the extrapolation capabilities of non-intrusive surrogate models
par: Sun, Shuwen, et autres
Publié: (2024)
par: Sun, Shuwen, et autres
Publié: (2024)
ChebNet: Efficient and Stable Constructions of Deep Neural Networks with Rectified Power Units via Chebyshev Approximations
par: Tang, Shanshan, et autres
Publié: (2019)
par: Tang, Shanshan, et autres
Publié: (2019)
An Overview on Machine Learning Methods for Partial Differential Equations: from Physics Informed Neural Networks to Deep Operator Learning
par: Gonon, Lukas, et autres
Publié: (2024)
par: Gonon, Lukas, et autres
Publié: (2024)
MgNO: Efficient Parameterization of Linear Operators via Multigrid
par: He, Juncai, et autres
Publié: (2023)
par: He, Juncai, et autres
Publié: (2023)
Bayesian Deep Learning with Multilevel Trace-class Neural Networks
par: Chada, Neil K., et autres
Publié: (2022)
par: Chada, Neil K., et autres
Publié: (2022)
Domain Decomposition-based coupling of Operator Inference reduced order models via the Schwarz alternating method
par: Moore, Ian, et autres
Publié: (2024)
par: Moore, Ian, et autres
Publié: (2024)
Documents similaires
-
Faster Randomized Methods for Orthogonality Constrained Problems
par: Shustin, Boris, et autres
Publié: (2021) -
Higher Order Reduced Rank Regression
par: Greenberg, Leia, et autres
Publié: (2025) -
On Encoding Matrices using Quantum Circuits
par: Yosef, Liron Mor, et autres
Publié: (2025) -
Multivariate trace estimation using quantum state space linear algebra
par: Yosef, Liron Mor, et autres
Publié: (2024) -
Quasitubal Tensor Algebra Over Separable Hilbert Spaces
par: Mor, Uria, et autres
Publié: (2025)