Convergence of gradient descent for deep neural networks
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Chatterjee, Sourav |
|---|---|
| Format: | Preprint |
| Publié: |
2022
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Error Bound Analysis for the Regularized Loss of Deep Linear Neural Networks
par: Chen, Po, et autres
Publié: (2025)
par: Chen, Po, et autres
Publié: (2025)
Convergence Conditions for Stochastic Line Search Based Optimization of Over-parametrized Models
par: Lapucci, Matteo, et autres
Publié: (2024)
par: Lapucci, Matteo, et autres
Publié: (2024)
A Layer Separation Optimization Framework for Cross-Entropy Training in Deep Learning
par: Liu, Yaru, et autres
Publié: (2026)
par: Liu, Yaru, et autres
Publié: (2026)
Convergence rate of the (1+1)-evolution strategy on locally strongly convex functions with lipschitz continuous gradient
par: Morinaga, Daiki, et autres
Publié: (2022)
par: Morinaga, Daiki, et autres
Publié: (2022)
Effectively Leveraging Momentum Terms in Stochastic Line Search Frameworks for Fast Optimization of Finite-Sum Problems
par: Lapucci, Matteo, et autres
Publié: (2024)
par: Lapucci, Matteo, et autres
Publié: (2024)
Faster Adaptive Optimization via Expected Gradient Outer Product Reparameterization
par: DePavia, Adela, et autres
Publié: (2025)
par: DePavia, Adela, et autres
Publié: (2025)
Exponential convergence rates for momentum stochastic gradient descent in the overparametrized setting
par: Gess, Benjamin, et autres
Publié: (2023)
par: Gess, Benjamin, et autres
Publié: (2023)
An Augmented Lagrangian Method for Training Recurrent Neural Networks
par: Wang, Yue, et autres
Publié: (2024)
par: Wang, Yue, et autres
Publié: (2024)
Sample-wise Constrained Learning via a Sequential Penalty Approach with Applications in Image Processing
par: Lanzillotta, Francesca, et autres
Publié: (2026)
par: Lanzillotta, Francesca, et autres
Publié: (2026)
On Maximum-a-Posteriori estimation with Plug & Play priors and stochastic gradient descent
par: Laumont, Rémi, et autres
Publié: (2022)
par: Laumont, Rémi, et autres
Publié: (2022)
Consensus-based optimization for closed-box adversarial attacks and a connection to evolution strategies
par: Roith, Tim, et autres
Publié: (2025)
par: Roith, Tim, et autres
Publié: (2025)
Inexact FPPA for the $\ell_0$ Sparse Regularization Problem
par: Fang, Ronglong, et autres
Publié: (2024)
par: Fang, Ronglong, et autres
Publié: (2024)
Quadratic Unconstrained Binary Optimisation for Training and Regularisation of Binary Neural Networks
par: Villumsen, Jonas Christoffer, et autres
Publié: (2026)
par: Villumsen, Jonas Christoffer, et autres
Publié: (2026)
Convergence of energy-based learning in linear resistive networks
par: Huijzer, Anne-Men, et autres
Publié: (2025)
par: Huijzer, Anne-Men, et autres
Publié: (2025)
Network-Optimised Spiking Neural Network for Event-Driven Networking
par: Bilal, Muhammad
Publié: (2025)
par: Bilal, Muhammad
Publié: (2025)
Enhancing training of physics-informed neural networks using domain-decomposition based preconditioning strategies
par: Kopaničáková, Alena, et autres
Publié: (2023)
par: Kopaničáková, Alena, et autres
Publié: (2023)
Refining Graphical Neural Network Predictions Using Flow Matching for Optimal Power Flow with Constraint-Satisfaction Guarantee
par: Khanal, Kshitiz
Publié: (2025)
par: Khanal, Kshitiz
Publié: (2025)
Towards Solving Polynomial-Objective Integer Programming with Hypergraph Neural Networks
par: Li, Minshuo, et autres
Publié: (2026)
par: Li, Minshuo, et autres
Publié: (2026)
Resolving the Exploration-Exploitation Dilemma in Evolutionary Algorithms: A Novel Human-Centered Framework
par: Shams, Ehsan
Publié: (2025)
par: Shams, Ehsan
Publié: (2025)
SVD-Preconditioned Gradient Descent Method for Solving Nonlinear Least Squares Problems
par: Chang, Zhipeng, et autres
Publié: (2026)
par: Chang, Zhipeng, et autres
Publié: (2026)
A Semismooth Newton Stochastic Proximal Point Algorithm with Variance Reduction
par: Milzarek, Andre, et autres
Publié: (2022)
par: Milzarek, Andre, et autres
Publié: (2022)
General Constrained Matrix Optimization
par: Garner, Casey, et autres
Publié: (2024)
par: Garner, Casey, et autres
Publié: (2024)
Spectrally Constrained Optimization
par: Garner, Casey, et autres
Publié: (2023)
par: Garner, Casey, et autres
Publié: (2023)
What is the long-run distribution of stochastic gradient descent? A large deviations analysis
par: Azizian, Waïss, et autres
Publié: (2024)
par: Azizian, Waïss, et autres
Publié: (2024)
Swarm-based gradient descent meets simulated annealing
par: Ding, Zhiyan, et autres
Publié: (2024)
par: Ding, Zhiyan, et autres
Publié: (2024)
Quadratic Surrogate Attractor for Particle Swarm Optimization
par: Clemente, Maurizio, et autres
Publié: (2026)
par: Clemente, Maurizio, et autres
Publié: (2026)
Distributionally Robust Geometric Joint Chance-Constrained Optimization: Neurodynamic Approaches
par: Valli, Ange, et autres
Publié: (2026)
par: Valli, Ange, et autres
Publié: (2026)
Nonsmooth Set-Gradient Ascent to the Pareto Front via Layered Hypervolume and Magnitude Indicators
par: Emmerich, Michael T. M.
Publié: (2026)
par: Emmerich, Michael T. M.
Publié: (2026)
Differentiability and Approximation of Probability Functions under Gaussian Mixture Models: A Bayesian Approach
par: Contador, Gonzalo, et autres
Publié: (2024)
par: Contador, Gonzalo, et autres
Publié: (2024)
Recent Advances in Non-convex Smoothness Conditions and Applicability to Deep Linear Neural Networks
par: Patel, Vivak, et autres
Publié: (2024)
par: Patel, Vivak, et autres
Publié: (2024)
Circuit realization and hardware linearization of monotone operator equilibrium networks
par: Chaffey, Thomas
Publié: (2025)
par: Chaffey, Thomas
Publié: (2025)
On the boundedness of the sequence generated by minibatch stochastic gradient descent
par: Bauschke, Heinz H., et autres
Publié: (2025)
par: Bauschke, Heinz H., et autres
Publié: (2025)
Power Homotopy for Zeroth-Order Non-Convex Optimizations
par: Xu, Chen
Publié: (2025)
par: Xu, Chen
Publié: (2025)
Global Optimization with A Power-Transformed Objective and Gaussian Smoothing
par: Xu, Chen
Publié: (2024)
par: Xu, Chen
Publié: (2024)
Gradient descent with adaptive stepsize converges (nearly) linearly under fourth-order growth
par: Davis, Damek, et autres
Publié: (2024)
par: Davis, Damek, et autres
Publié: (2024)
Convergence of Descent Optimization Algorithms under Polyak-Łojasiewicz-Kurdyka Conditions
par: Bento, G. C., et autres
Publié: (2024)
par: Bento, G. C., et autres
Publié: (2024)
An Algebraically Converging Stochastic Gradient Descent Algorithm for Global Optimization
par: Engquist, Björn, et autres
Publié: (2022)
par: Engquist, Björn, et autres
Publié: (2022)
Projected gradient descent accumulates at Bouligand stationary points
par: Olikier, Guillaume, et autres
Publié: (2024)
par: Olikier, Guillaume, et autres
Publié: (2024)
Parameter-free accelerated gradient descent for nonconvex minimization
par: Marumo, Naoki, et autres
Publié: (2022)
par: Marumo, Naoki, et autres
Publié: (2022)
Representation and Regression Problems in Neural Networks: Relaxation, Generalization, and Numerics
par: Liu, Kang, et autres
Publié: (2024)
par: Liu, Kang, et autres
Publié: (2024)
Documents similaires
-
Error Bound Analysis for the Regularized Loss of Deep Linear Neural Networks
par: Chen, Po, et autres
Publié: (2025) -
Convergence Conditions for Stochastic Line Search Based Optimization of Over-parametrized Models
par: Lapucci, Matteo, et autres
Publié: (2024) -
A Layer Separation Optimization Framework for Cross-Entropy Training in Deep Learning
par: Liu, Yaru, et autres
Publié: (2026) -
Convergence rate of the (1+1)-evolution strategy on locally strongly convex functions with lipschitz continuous gradient
par: Morinaga, Daiki, et autres
Publié: (2022) -
Effectively Leveraging Momentum Terms in Stochastic Line Search Frameworks for Fast Optimization of Finite-Sum Problems
par: Lapucci, Matteo, et autres
Publié: (2024)