Recent Advances in Non-convex Smoothness Conditions and Applicability to Deep Linear Neural Networks
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Patel, Vivak, Varner, Christian |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Error Bound Analysis for the Regularized Loss of Deep Linear Neural Networks
par: Chen, Po, et autres
Publié: (2025)
par: Chen, Po, et autres
Publié: (2025)
The Challenges of Optimization For Data Science
par: Varner, Christian, et autres
Publié: (2024)
par: Varner, Christian, et autres
Publié: (2024)
A Novel Gradient Methodology with Economical Objective Function Evaluations for Data Science Applications
par: Varner, Christian, et autres
Publié: (2023)
par: Varner, Christian, et autres
Publié: (2023)
A Novel First-order Method with Event-driven Objective Evaluations
par: Varner, Christian, et autres
Publié: (2025)
par: Varner, Christian, et autres
Publié: (2025)
Fixed-Point Neural Optimal Transport without Implicit Differentiation
par: Park, Yesom, et autres
Publié: (2026)
par: Park, Yesom, et autres
Publié: (2026)
A Layer Separation Optimization Framework for Cross-Entropy Training in Deep Learning
par: Liu, Yaru, et autres
Publié: (2026)
par: Liu, Yaru, et autres
Publié: (2026)
Expansive Natural Neural Gradient Flows for Energy Minimization
par: Dahmen, Wolfgang, et autres
Publié: (2025)
par: Dahmen, Wolfgang, et autres
Publié: (2025)
The Pontryagin Maximum Principle for Training Convolutional Neural Networks
par: Hofmann, Sebastian, et autres
Publié: (2025)
par: Hofmann, Sebastian, et autres
Publié: (2025)
Progressive Power Homotopy for Non-convex Optimization
par: Xu, Chen
Publié: (2026)
par: Xu, Chen
Publié: (2026)
A network based approach for unbalanced optimal transport on surfaces
par: Pan, Jiangong, et autres
Publié: (2024)
par: Pan, Jiangong, et autres
Publié: (2024)
Global Optimization with A Power-Transformed Objective and Gaussian Smoothing
par: Xu, Chen
Publié: (2024)
par: Xu, Chen
Publié: (2024)
Variational conditional normalizing flows for computing second-order mean field control problems
par: Zhao, Jiaxi, et autres
Publié: (2025)
par: Zhao, Jiaxi, et autres
Publié: (2025)
SVD-Preconditioned Gradient Descent Method for Solving Nonlinear Least Squares Problems
par: Chang, Zhipeng, et autres
Publié: (2026)
par: Chang, Zhipeng, et autres
Publié: (2026)
Faster Adaptive Optimization via Expected Gradient Outer Product Reparameterization
par: DePavia, Adela, et autres
Publié: (2025)
par: DePavia, Adela, et autres
Publié: (2025)
Power Homotopy for Zeroth-Order Non-Convex Optimizations
par: Xu, Chen
Publié: (2025)
par: Xu, Chen
Publié: (2025)
Randomized Matrix Sketching for Neural Network Training and Gradient Monitoring
par: Antil, Harbir, et autres
Publié: (2025)
par: Antil, Harbir, et autres
Publié: (2025)
Approximation of the Proximal Operator of the $\ell_\infty$ Norm Using a Neural Network
par: Linehan, Kathryn, et autres
Publié: (2024)
par: Linehan, Kathryn, et autres
Publié: (2024)
Self2Seg: Single-Image Self-Supervised Joint Segmentation and Denoising
par: Gruber, Nadja, et autres
Publié: (2023)
par: Gruber, Nadja, et autres
Publié: (2023)
Convergence, design and training of continuous-time dropout as a random batch method
par: Álvarez-López, Antonio, et autres
Publié: (2025)
par: Álvarez-López, Antonio, et autres
Publié: (2025)
Convergence of gradient descent for deep neural networks
par: Chatterjee, Sourav
Publié: (2022)
par: Chatterjee, Sourav
Publié: (2022)
Approximation and Gradient Descent Training with Neural Networks
par: Welper, G.
Publié: (2024)
par: Welper, G.
Publié: (2024)
A Single-Loop Bilevel Deep Learning Method for Optimal Control of Obstacle Problems
par: Song, Yongcun, et autres
Publié: (2026)
par: Song, Yongcun, et autres
Publié: (2026)
Stochastic Mirror Descent for Convex Optimization with Consensus Constraints
par: Borovykh, Anastasia, et autres
Publié: (2022)
par: Borovykh, Anastasia, et autres
Publié: (2022)
Deep Unfolding Network for Nonlinear Multi-Frequency Electrical Impedance Tomography
par: Alberti, Giovanni S., et autres
Publié: (2025)
par: Alberti, Giovanni S., et autres
Publié: (2025)
Deep Predictor-Corrector Networks for Robust Parameter Estimation in Non-autonomous System with Discontinuous Inputs
par: Gu, Gyeongwan, et autres
Publié: (2026)
par: Gu, Gyeongwan, et autres
Publié: (2026)
Prox-PINNs: A Deep Learning Algorithmic Framework for Elliptic Variational Inequalities
par: Gao, Yu, et autres
Publié: (2025)
par: Gao, Yu, et autres
Publié: (2025)
Meshless Shape Optimization using Neural Networks and Partial Differential Equations on Graphs
par: Martinet, Eloi, et autres
Publié: (2025)
par: Martinet, Eloi, et autres
Publié: (2025)
Convergence of Momentum-Based Optimization Algorithms with Time-Varying Parameters
par: Vidyasagar, Mathukumalli
Publié: (2025)
par: Vidyasagar, Mathukumalli
Publié: (2025)
Asymptotic stability properties and a priori bounds for Adam and other gradient descent optimization methods
par: Dereich, Steffen, et autres
Publié: (2025)
par: Dereich, Steffen, et autres
Publié: (2025)
Non-Asymptotic Analysis of Projected Gradient Descent for Physics-Informed Neural Networks
par: Nießen, Jonas, et autres
Publié: (2025)
par: Nießen, Jonas, et autres
Publié: (2025)
Objective Value Change and Shape-Based Accelerated Optimization for the Neural Network Approximation
par: Xie, Pengcheng, et autres
Publié: (2025)
par: Xie, Pengcheng, et autres
Publié: (2025)
Neural-network methods for two-dimensional finite-source reflector design
par: Hacking, Roel, et autres
Publié: (2026)
par: Hacking, Roel, et autres
Publié: (2026)
Adam Improves Muon: Adaptive Moment Estimation with Orthogonalized Momentum
par: Zhang, Minxin, et autres
Publié: (2026)
par: Zhang, Minxin, et autres
Publié: (2026)
To be or not to be stable, that is the question: understanding neural networks for inverse problems
par: Evangelista, Davide, et autres
Publié: (2022)
par: Evangelista, Davide, et autres
Publié: (2022)
Learning where to learn: Training data distribution optimization for scientific machine learning
par: Guerra, Nicolas, et autres
Publié: (2025)
par: Guerra, Nicolas, et autres
Publié: (2025)
Consensus-based optimization for closed-box adversarial attacks and a connection to evolution strategies
par: Roith, Tim, et autres
Publié: (2025)
par: Roith, Tim, et autres
Publié: (2025)
An Adaptive Tensor-Train Decomposition Approach for Efficient Deep Neural Network Compression
par: Luo, Shiyi, et autres
Publié: (2024)
par: Luo, Shiyi, et autres
Publié: (2024)
An Augmented Lagrangian Method for Training Recurrent Neural Networks
par: Wang, Yue, et autres
Publié: (2024)
par: Wang, Yue, et autres
Publié: (2024)
Riemannian AmbientFlow: Towards Simultaneous Manifold Learning and Generative Modeling from Corrupted Data
par: Diepeveen, Willem, et autres
Publié: (2026)
par: Diepeveen, Willem, et autres
Publié: (2026)
Convergence Conditions for Stochastic Line Search Based Optimization of Over-parametrized Models
par: Lapucci, Matteo, et autres
Publié: (2024)
par: Lapucci, Matteo, et autres
Publié: (2024)
Documents similaires
-
Error Bound Analysis for the Regularized Loss of Deep Linear Neural Networks
par: Chen, Po, et autres
Publié: (2025) -
The Challenges of Optimization For Data Science
par: Varner, Christian, et autres
Publié: (2024) -
A Novel Gradient Methodology with Economical Objective Function Evaluations for Data Science Applications
par: Varner, Christian, et autres
Publié: (2023) -
A Novel First-order Method with Event-driven Objective Evaluations
par: Varner, Christian, et autres
Publié: (2025) -
Fixed-Point Neural Optimal Transport without Implicit Differentiation
par: Park, Yesom, et autres
Publié: (2026)