Global Dynamics of Heavy-Tailed SGDs in Nonconvex Loss Landscape: Characterization and Control
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Xingyu, Rhee, Chang-Han |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Large Deviations and Metastability Analysis for Heavy-Tailed Dynamical Systems
di: Wang, Xingyu, et al.
Pubblicazione: (2023)
di: Wang, Xingyu, et al.
Pubblicazione: (2023)
First-Exit Time Analysis for Truncated Heavy-Tailed Dynamical Systems
di: Wang, Xingyu, et al.
Pubblicazione: (2026)
di: Wang, Xingyu, et al.
Pubblicazione: (2026)
Implicit Compressibility of Overparametrized Neural Networks Trained with Heavy-Tailed SGD
di: Wan, Yijun, et al.
Pubblicazione: (2023)
di: Wan, Yijun, et al.
Pubblicazione: (2023)
Strongly Efficient Rare-Event Simulation for Regularly Varying Lévy Processes with Infinite Activities
di: Wang, Xingyu, et al.
Pubblicazione: (2023)
di: Wang, Xingyu, et al.
Pubblicazione: (2023)
Diffusion Models with Heavy-Tailed Targets: Score Estimation and Sampling Guarantees
di: Yu, Yifeng, et al.
Pubblicazione: (2026)
di: Yu, Yifeng, et al.
Pubblicazione: (2026)
Concentration of General Stochastic Approximation Under Heavy-Tailed Markovian Noise
di: Agrawal, Shubhada, et al.
Pubblicazione: (2026)
di: Agrawal, Shubhada, et al.
Pubblicazione: (2026)
Algorithmic Stability of Stochastic Gradient Descent with Momentum under Heavy-Tailed Noise
di: Dang, Thanh, et al.
Pubblicazione: (2025)
di: Dang, Thanh, et al.
Pubblicazione: (2025)
On the Nonconvexity of Push-Forward Constraints and Its Consequences in Machine Learning
di: de Lara, Lucas, et al.
Pubblicazione: (2024)
di: de Lara, Lucas, et al.
Pubblicazione: (2024)
Steady-State Behavior of Constant-Stepsize Stochastic Approximation: Gaussian Approximation and Tail Bounds
di: Wang, Zedong, et al.
Pubblicazione: (2026)
di: Wang, Zedong, et al.
Pubblicazione: (2026)
Tail Asymptotics of Cluster Sizes in Multivariate Heavy-Tailed Hawkes Processes
di: Blanchet, Jose, et al.
Pubblicazione: (2025)
di: Blanchet, Jose, et al.
Pubblicazione: (2025)
Stability and Generalization of Nonconvex Optimization with Heavy-Tailed Noise
di: Chen, Hongxu, et al.
Pubblicazione: (2026)
di: Chen, Hongxu, et al.
Pubblicazione: (2026)
Sharper Perturbed-Kullback-Leibler Exponential Tail Bounds for Beta and Dirichlet Distributions
di: Perrault, Pierre
Pubblicazione: (2025)
di: Perrault, Pierre
Pubblicazione: (2025)
Variational Tail Bounds for Norms of Random Vectors and Matrices
di: Bahmani, Sohail
Pubblicazione: (2025)
di: Bahmani, Sohail
Pubblicazione: (2025)
Near-Optimal Decentralized Stochastic Nonconvex Optimization with Heavy-Tailed Noise
di: Wang, Menglian, et al.
Pubblicazione: (2026)
di: Wang, Menglian, et al.
Pubblicazione: (2026)
Characterizing Dynamical Stability of Stochastic Gradient Descent in Overparameterized Learning
di: Chemnitz, Dennis, et al.
Pubblicazione: (2024)
di: Chemnitz, Dennis, et al.
Pubblicazione: (2024)
Sharp Concentration Inequalities: Phase Transition and Mixing of Orlicz Tails with Variance
di: Shen, Yinan, et al.
Pubblicazione: (2026)
di: Shen, Yinan, et al.
Pubblicazione: (2026)
Sample Path Large Deviations for Multivariate Heavy-Tailed Hawkes Processes and Related Lévy Processes
di: Blanchet, Jose, et al.
Pubblicazione: (2025)
di: Blanchet, Jose, et al.
Pubblicazione: (2025)
A Method For Bounding Tail Probabilities
di: Zlatanov, Nikola
Pubblicazione: (2024)
di: Zlatanov, Nikola
Pubblicazione: (2024)
Variational Smoothing and Inference for SDEs from Sparse Data with Dynamic Neural Flows
di: Wang, Yu, et al.
Pubblicazione: (2026)
di: Wang, Yu, et al.
Pubblicazione: (2026)
Resolving Node Identifiability in Graph Neural Processes via Laplacian Spectral Encodings
di: Yan, Zimo, et al.
Pubblicazione: (2025)
di: Yan, Zimo, et al.
Pubblicazione: (2025)
Optimal Asynchronous Stochastic Nonconvex Optimization under Heavy-Tailed Noise
di: Wu, Yidong, et al.
Pubblicazione: (2026)
di: Wu, Yidong, et al.
Pubblicazione: (2026)
EVT-Based Rate-Preserving Distributional Robustness for Tail Risk Functionals
di: Deo, Anand
Pubblicazione: (2025)
di: Deo, Anand
Pubblicazione: (2025)
Properties of Discrete Sliced Wasserstein Losses
di: Tanguy, Eloi, et al.
Pubblicazione: (2023)
di: Tanguy, Eloi, et al.
Pubblicazione: (2023)
A General Reduction for High-Probability Analysis with General Light-Tailed Distributions
di: Attia, Amit, et al.
Pubblicazione: (2024)
di: Attia, Amit, et al.
Pubblicazione: (2024)
Tail-Aware Information-Theoretic Generalization for RLHF and SGLD
di: Zhang, Huiming, et al.
Pubblicazione: (2026)
di: Zhang, Huiming, et al.
Pubblicazione: (2026)
A Note on Asynchronous Challenges: Unveiling Formulaic Bias and Data Loss in the Hayashi-Yoshida Estimator
di: Georgiadis, Evangelos
Pubblicazione: (2024)
di: Georgiadis, Evangelos
Pubblicazione: (2024)
Convergence Error Analysis of Reflected Gradient Langevin Dynamics for Globally Optimizing Non-Convex Constrained Problems
di: Sato, Kanji, et al.
Pubblicazione: (2022)
di: Sato, Kanji, et al.
Pubblicazione: (2022)
Decentralized Proximal Stochastic Gradient Langevin Dynamics
di: Islam, Mohammad Rafiqul, et al.
Pubblicazione: (2026)
di: Islam, Mohammad Rafiqul, et al.
Pubblicazione: (2026)
Convergence of SGD for Training Neural Networks with Sliced Wasserstein Losses
di: Tanguy, Eloi
Pubblicazione: (2023)
di: Tanguy, Eloi
Pubblicazione: (2023)
Birth-death dynamics for sampling: Global convergence, approximations and their asymptotics
di: Lu, Yulong, et al.
Pubblicazione: (2022)
di: Lu, Yulong, et al.
Pubblicazione: (2022)
Static and Dynamic Approaches to Computing Barycenters of Probability Measures on Graphs
di: Gentile, David, et al.
Pubblicazione: (2026)
di: Gentile, David, et al.
Pubblicazione: (2026)
A Gaussian Comparison Theorem for Training Dynamics in Machine Learning
di: Panahi, Ashkan
Pubblicazione: (2026)
di: Panahi, Ashkan
Pubblicazione: (2026)
Tail Asymptotic of Heavy-Tail Risks with Elliptical Copula
di: Wang, Kai, et al.
Pubblicazione: (2024)
di: Wang, Kai, et al.
Pubblicazione: (2024)
Tail-Sensitive KL and Rényi Convergence of Unadjusted Hamiltonian Monte Carlo via One-Shot Couplings
di: Bou-Rabee, Nawaf, et al.
Pubblicazione: (2026)
di: Bou-Rabee, Nawaf, et al.
Pubblicazione: (2026)
Convergence, Sticking and Escape: Stochastic Dynamics Near Critical Points in SGD
di: Dudukalov, Dmitry, et al.
Pubblicazione: (2025)
di: Dudukalov, Dmitry, et al.
Pubblicazione: (2025)
Homogenization of Multi-agent Learning Dynamics in Finite-state Markov Games
di: Kerzreho, Yann
Pubblicazione: (2025)
di: Kerzreho, Yann
Pubblicazione: (2025)
Denoising distances beyond the volumetric barrier
di: Huang, Han, et al.
Pubblicazione: (2026)
di: Huang, Han, et al.
Pubblicazione: (2026)
Reconstructing the Geometry of Random Geometric Graphs
di: Huang, Han, et al.
Pubblicazione: (2024)
di: Huang, Han, et al.
Pubblicazione: (2024)
Large Deviation Upper Bounds and Improved MSE Rates of Nonlinear SGD: Heavy-tailed Noise and Power of Symmetry
di: Armacki, Aleksandar, et al.
Pubblicazione: (2024)
di: Armacki, Aleksandar, et al.
Pubblicazione: (2024)
ResNets of All Shapes and Sizes: Convergence of Training Dynamics in the Large-scale Limit
di: Chaintron, Louis-Pierre, et al.
Pubblicazione: (2026)
di: Chaintron, Louis-Pierre, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Large Deviations and Metastability Analysis for Heavy-Tailed Dynamical Systems
di: Wang, Xingyu, et al.
Pubblicazione: (2023) -
First-Exit Time Analysis for Truncated Heavy-Tailed Dynamical Systems
di: Wang, Xingyu, et al.
Pubblicazione: (2026) -
Implicit Compressibility of Overparametrized Neural Networks Trained with Heavy-Tailed SGD
di: Wan, Yijun, et al.
Pubblicazione: (2023) -
Strongly Efficient Rare-Event Simulation for Regularly Varying Lévy Processes with Infinite Activities
di: Wang, Xingyu, et al.
Pubblicazione: (2023) -
Diffusion Models with Heavy-Tailed Targets: Score Estimation and Sampling Guarantees
di: Yu, Yifeng, et al.
Pubblicazione: (2026)