Over-parameterised Shallow Neural Networks with Asymmetrical Node Scaling: Global Convergence Guarantees and Feature Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Caron, Francois, Ayed, Fadhel, Jung, Paul, Lee, Hoil, Lee, Juho, Yang, Hongseok |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Deep neural networks with dependent weights: Gaussian Process mixture limit, heavy tails, sparsity and compressibility
par: Lee, Hoil, et autres
Publié: (2022)
par: Lee, Hoil, et autres
Publié: (2022)
Learning Over-Relaxation Policies for ADMM with Convergence Guarantees
par: Lin, Junan, et autres
Publié: (2026)
par: Lin, Junan, et autres
Publié: (2026)
The Normal-Generalised Gamma-Pareto process: A novel pure-jump Lévy process with flexible tail and jump-activity properties
par: Ayed, Fadhel, et autres
Publié: (2020)
par: Ayed, Fadhel, et autres
Publié: (2020)
Beyond the Chinese Restaurant and Pitman-Yor processes: Statistical Models with Double Power-law Behavior
par: Ayed, Fadhel, et autres
Publié: (2019)
par: Ayed, Fadhel, et autres
Publié: (2019)
Solving Inverse Problems with Deep Linear Neural Networks: Global Convergence Guarantees for Gradient Descent with Weight Decay
par: Laus, Hannah, et autres
Publié: (2025)
par: Laus, Hannah, et autres
Publié: (2025)
Density-Driven Optimal Control: Convergence Guarantees for Stochastic LTI Multi-Agent Systems
par: Lee, Kooktae
Publié: (2026)
par: Lee, Kooktae
Publié: (2026)
Shallow Neural Networks Learn Low-Degree Spherical Polynomials with Feature Learning by Learnable Channel Attention
par: Yang, Yingzhen
Publié: (2025)
par: Yang, Yingzhen
Publié: (2025)
Grassmannian Geometry and Global Convergence of Variable Projection for Neural Networks
par: Dus, Mathias
Publié: (2026)
par: Dus, Mathias
Publié: (2026)
Plugging Weight-tying Nonnegative Neural Network into Proximal Splitting Method: Architecture for Guaranteeing Convergence to Optimal Point
par: Shimizu, Haruya, et autres
Publié: (2025)
par: Shimizu, Haruya, et autres
Publié: (2025)
Federated Dynamical Low-Rank Training with Global Loss Convergence Guarantees
par: Schotthöfer, Steffen, et autres
Publié: (2024)
par: Schotthöfer, Steffen, et autres
Publié: (2024)
Design and Scheduling of an AI-based Queueing System
par: Lee, Jiung, et autres
Publié: (2024)
par: Lee, Jiung, et autres
Publié: (2024)
Simple Stepsize for Quasi-Newton Methods with Global Convergence Guarantees
par: Agafonov, Artem, et autres
Publié: (2025)
par: Agafonov, Artem, et autres
Publié: (2025)
Learning Neural Contracting Dynamics: Extended Linearization and Global Guarantees
par: Jaffe, Sean, et autres
Publié: (2024)
par: Jaffe, Sean, et autres
Publié: (2024)
Similarity Matching Networks: Hebbian Learning and Convergence Over Multiple Time Scales
par: Centorrino, Veronica, et autres
Publié: (2025)
par: Centorrino, Veronica, et autres
Publié: (2025)
Geometric Control Theory Over Networks: Minimal Node Cardinality Disturbance Decoupling Problems
par: Lebon, Luca Claude Gino, et autres
Publié: (2025)
par: Lebon, Luca Claude Gino, et autres
Publié: (2025)
Memory-Reduced Meta-Learning with Guaranteed Convergence
par: Yang, Honglin, et autres
Publié: (2024)
par: Yang, Honglin, et autres
Publié: (2024)
Convergence Analyses of Davis-Yin Splitting via Scaled Relative Graphs
par: Lee, Jongmin, et autres
Publié: (2022)
par: Lee, Jongmin, et autres
Publié: (2022)
Modified Line Search Sequential Quadratic Methods for Equality-Constrained Optimization with Unified Global and Local Convergence Guarantees
par: Berahas, Albert S., et autres
Publié: (2024)
par: Berahas, Albert S., et autres
Publié: (2024)
Accelerated Over-Relaxation Heavy-Ball Method: Achieving Global Accelerated Convergence with Broad Generalization
par: Wei, Jingrong, et autres
Publié: (2024)
par: Wei, Jingrong, et autres
Publié: (2024)
Wasserstein Distributionally Robust Shallow Convex Neural Networks
par: Pallage, Julien, et autres
Publié: (2024)
par: Pallage, Julien, et autres
Publié: (2024)
Global Convergence and Rich Feature Learning in $L$-Layer Infinite-Width Neural Networks under $μ$P Parametrization
par: Chen, Zixiang, et autres
Publié: (2025)
par: Chen, Zixiang, et autres
Publié: (2025)
Differentiable Discrete Event Simulation for Queuing Network Control
par: Che, Ethan, et autres
Publié: (2024)
par: Che, Ethan, et autres
Publié: (2024)
Neural Risk Limiting Dispatch in Power Networks: Formulation and Generalization Guarantees
par: Chen, Ge, et autres
Publié: (2024)
par: Chen, Ge, et autres
Publié: (2024)
An Effective Iterative Solution for Independent Vector Analysis with Convergence Guarantees
par: Cosserat, Clément, et autres
Publié: (2024)
par: Cosserat, Clément, et autres
Publié: (2024)
Global Convergence Guarantees for Federated Policy Gradient Methods with Adversaries
par: Ganesh, Swetha, et autres
Publié: (2024)
par: Ganesh, Swetha, et autres
Publié: (2024)
On the Reachability of 3-Dimensional Paths with a Prescribed Curvature Bound
par: Bae, Juho, et autres
Publié: (2024)
par: Bae, Juho, et autres
Publié: (2024)
Gradient Descent Converges Linearly to Flatter Minima than Gradient Flow in Shallow Linear Networks
par: Beneventano, Pierfrancesco, et autres
Publié: (2025)
par: Beneventano, Pierfrancesco, et autres
Publié: (2025)
Toward Global Convergence of Gradient EM for Over-Parameterized Gaussian Mixture Models
par: Xu, Weihang, et autres
Publié: (2024)
par: Xu, Weihang, et autres
Publié: (2024)
A Recovery Guarantee for Sparse Neural Networks
par: Fridovich-Keil, Sara, et autres
Publié: (2025)
par: Fridovich-Keil, Sara, et autres
Publié: (2025)
QLABGrad: a Hyperparameter-Free and Convergence-Guaranteed Scheme for Deep Learning
par: Fu, Minghan, et autres
Publié: (2023)
par: Fu, Minghan, et autres
Publié: (2023)
Greedy Low-Rank Gradient Compression for Distributed Learning with Convergence Guarantees
par: Chen, Chuyan, et autres
Publié: (2025)
par: Chen, Chuyan, et autres
Publié: (2025)
A New First-Order Meta-Learning Algorithm with Convergence Guarantees
par: Chayti, El Mahdi, et autres
Publié: (2024)
par: Chayti, El Mahdi, et autres
Publié: (2024)
Robust Sparse Phase Retrieval: Statistical Guarantee, Optimality Theory and Convergent Algorithm
par: Fan, Jun, et autres
Publié: (2025)
par: Fan, Jun, et autres
Publié: (2025)
MAP Estimation with Denoisers: Convergence Rates and Guarantees
par: Pesme, Scott, et autres
Publié: (2025)
par: Pesme, Scott, et autres
Publié: (2025)
Convergence Analysis for Learning Orthonormal Deep Linear Neural Networks
par: Qin, Zhen, et autres
Publié: (2023)
par: Qin, Zhen, et autres
Publié: (2023)
Physics-Informed Neural Network Policy Iteration: Algorithms, Convergence, and Verification
par: Meng, Yiming, et autres
Publié: (2024)
par: Meng, Yiming, et autres
Publié: (2024)
A Dual Certificate Approach to Sparsity in Infinite-Width Shallow Neural Networks
par: Del Grande, Leonardo, et autres
Publié: (2026)
par: Del Grande, Leonardo, et autres
Publié: (2026)
Noise Resilience and Robust Convergence Guarantees for the Variational Quantum Eigensolver
par: Legnini, Mirko, et autres
Publié: (2026)
par: Legnini, Mirko, et autres
Publié: (2026)
Global Convergence of SGD On Two Layer Neural Nets
par: Gopalani, Pulkit, et autres
Publié: (2022)
par: Gopalani, Pulkit, et autres
Publié: (2022)
Robust Constrained Consensus and Inequality-constrained Distributed Optimization with Guaranteed Differential Privacy and Accurate Convergence
par: Wang, Yongqiang, et autres
Publié: (2024)
par: Wang, Yongqiang, et autres
Publié: (2024)
Documents similaires
-
Deep neural networks with dependent weights: Gaussian Process mixture limit, heavy tails, sparsity and compressibility
par: Lee, Hoil, et autres
Publié: (2022) -
Learning Over-Relaxation Policies for ADMM with Convergence Guarantees
par: Lin, Junan, et autres
Publié: (2026) -
The Normal-Generalised Gamma-Pareto process: A novel pure-jump Lévy process with flexible tail and jump-activity properties
par: Ayed, Fadhel, et autres
Publié: (2020) -
Beyond the Chinese Restaurant and Pitman-Yor processes: Statistical Models with Double Power-law Behavior
par: Ayed, Fadhel, et autres
Publié: (2019) -
Solving Inverse Problems with Deep Linear Neural Networks: Global Convergence Guarantees for Gradient Descent with Weight Decay
par: Laus, Hannah, et autres
Publié: (2025)