Structured and Fast Optimization: The Kronecker SGD Algorithm
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Song, Zhao, Yue, Song |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Fast Inference with Kronecker-Sparse Matrices
par: Gonon, Antoine, et autres
Publié: (2024)
par: Gonon, Antoine, et autres
Publié: (2024)
Rethinking Bregman Divergences in Kronecker-Factored Optimizers
par: Liu, Bing, et autres
Publié: (2026)
par: Liu, Bing, et autres
Publié: (2026)
Scaling Laws of SignSGD in Linear Regression: When Does It Outperform SGD?
par: Kim, Jihwan, et autres
Publié: (2026)
par: Kim, Jihwan, et autres
Publié: (2026)
Quantum Speedup for Spectral Approximation of Kronecker Products
par: Gao, Yeqi, et autres
Publié: (2024)
par: Gao, Yeqi, et autres
Publié: (2024)
Generalization and Optimization of SGD with Lookahead
par: Li, Kangcheng, et autres
Publié: (2025)
par: Li, Kangcheng, et autres
Publié: (2025)
Topology-aware Generalization of Decentralized SGD
par: Zhu, Tongtian, et autres
Publié: (2022)
par: Zhu, Tongtian, et autres
Publié: (2022)
Does SGD really happen in tiny subspaces?
par: Song, Minhak, et autres
Publié: (2024)
par: Song, Minhak, et autres
Publié: (2024)
Kronecker-Structured Nonparametric Spatiotemporal Point Processes
par: Xu, Zhitong, et autres
Publié: (2026)
par: Xu, Zhitong, et autres
Publié: (2026)
Scalable Gaussian Processes with Latent Kronecker Structure
par: Lin, Jihao Andreas, et autres
Publié: (2025)
par: Lin, Jihao Andreas, et autres
Publié: (2025)
Fast and Efficient Matching Algorithm with Deadline Instances
par: Song, Zhao, et autres
Publié: (2023)
par: Song, Zhao, et autres
Publié: (2023)
A Short Note on Batch-efficient Divide-and-Conquer Algorithm for EigenDecomposition
par: Song, Yue
Publié: (2026)
par: Song, Yue
Publié: (2026)
Bootstrap SGD: Algorithmic Stability and Robustness
par: Christmann, Andreas, et autres
Publié: (2024)
par: Christmann, Andreas, et autres
Publié: (2024)
Improved Stability and Generalization Guarantees of the Decentralized SGD Algorithm
par: Bars, Batiste Le, et autres
Publié: (2023)
par: Bars, Batiste Le, et autres
Publié: (2023)
Non-Euclidean SGD for Structured Optimization: Unified Analysis and Improved Rates
par: Kovalev, Dmitry, et autres
Publié: (2025)
par: Kovalev, Dmitry, et autres
Publié: (2025)
The ADMM-PINNs Algorithmic Framework for Nonsmooth PDE-Constrained Optimization: A Deep Learning Approach
par: Song, Yongcun, et autres
Publié: (2023)
par: Song, Yongcun, et autres
Publié: (2023)
Diagonalisation SGD: Fast & Convergent SGD for Non-Differentiable Models via Reparameterisation and Smoothing
par: Wagner, Dominik, et autres
Publié: (2024)
par: Wagner, Dominik, et autres
Publié: (2024)
Faster Algorithms for Structured Linear and Kernel Support Vector Machines
par: Gu, Yuzhou, et autres
Publié: (2023)
par: Gu, Yuzhou, et autres
Publié: (2023)
Higher-Order Transformers With Kronecker-Structured Attention
par: Omranpour, Soroush, et autres
Publié: (2024)
par: Omranpour, Soroush, et autres
Publié: (2024)
SLowcal-SGD: Slow Query Points Improve Local-SGD for Stochastic Convex Optimization
par: Dahan, Tehila, et autres
Publié: (2023)
par: Dahan, Tehila, et autres
Publié: (2023)
The Optimization Landscape of SGD Across the Feature Learning Strength
par: Atanasov, Alexander, et autres
Publié: (2024)
par: Atanasov, Alexander, et autres
Publié: (2024)
Fast Last-Iterate Convergence of SGD in the Smooth Interpolation Regime
par: Attia, Amit, et autres
Publié: (2025)
par: Attia, Amit, et autres
Publié: (2025)
Trustworthy Efficient Communication for Distributed Learning using LQ-SGD Algorithm
par: Li, Hongyang, et autres
Publié: (2025)
par: Li, Hongyang, et autres
Publié: (2025)
Suspicious Alignment of SGD: A Fine-Grained Step Size Condition Analysis
par: Deng, Shenyang, et autres
Publié: (2026)
par: Deng, Shenyang, et autres
Publié: (2026)
SketchySGD: Reliable Stochastic Optimization via Randomized Curvature Estimates
par: Frangella, Zachary, et autres
Publié: (2022)
par: Frangella, Zachary, et autres
Publié: (2022)
Learning Kronecker-Structured Graphs from Smooth Signals
par: Shi, Changhao, et autres
Publié: (2025)
par: Shi, Changhao, et autres
Publié: (2025)
Fast RoPE Attention: Combining the Polynomial Method and Fast Fourier Transform
par: Alman, Josh, et autres
Publié: (2025)
par: Alman, Josh, et autres
Publié: (2025)
Truncated Non-Uniform Quantization for Distributed SGD
par: Yan, Guangfeng, et autres
Publié: (2024)
par: Yan, Guangfeng, et autres
Publié: (2024)
Sign-SGD via Parameter-Free Optimization
par: Medyakov, Daniil, et autres
Publié: (2025)
par: Medyakov, Daniil, et autres
Publié: (2025)
From PowerSGD to PowerSGD+: Low-Rank Gradient Compression for Distributed Optimization with Convergence Guarantees
par: Xie, Shengping, et autres
Publié: (2025)
par: Xie, Shengping, et autres
Publié: (2025)
Scaling Gaussian Processes for Learning Curve Prediction via Latent Kronecker Structure
par: Lin, Jihao Andreas, et autres
Publié: (2024)
par: Lin, Jihao Andreas, et autres
Publié: (2024)
Minibatch and Local SGD: Algorithmic Stability and Linear Speedup in Generalization
par: Lei, Yunwen, et autres
Publié: (2023)
par: Lei, Yunwen, et autres
Publié: (2023)
Stochastic Resetting Mitigates Latent Gradient Bias of SGD from Label Noise
par: Bae, Youngkyoung, et autres
Publié: (2024)
par: Bae, Youngkyoung, et autres
Publié: (2024)
Adapt or Forget: Provable Tradeoffs Between Adam and SGD in Nonstationary Optimization
par: Sahu, Sharan, et autres
Publié: (2026)
par: Sahu, Sharan, et autres
Publié: (2026)
The Optimality of (Accelerated) SGD for High-Dimensional Quadratic Optimization
par: Zhang, Haihan, et autres
Publié: (2024)
par: Zhang, Haihan, et autres
Publié: (2024)
SGD with Partial Hessian for Deep Neural Networks Optimization
par: Sun, Ying, et autres
Publié: (2024)
par: Sun, Ying, et autres
Publié: (2024)
Optimal Projection-Free Adaptive SGD for Matrix Optimization
par: Kovalev, Dmitry
Publié: (2026)
par: Kovalev, Dmitry
Publié: (2026)
On the Provable Suboptimality of Momentum SGD in Nonstationary Stochastic Optimization
par: Sahu, Sharan, et autres
Publié: (2026)
par: Sahu, Sharan, et autres
Publié: (2026)
An Iterative Algorithm for Rescaled Hyperbolic Functions Regression
par: Gao, Yeqi, et autres
Publié: (2023)
par: Gao, Yeqi, et autres
Publié: (2023)
Optimal and Efficient Algorithms for Decentralized Online Convex Optimization
par: Wan, Yuanyu, et autres
Publié: (2024)
par: Wan, Yuanyu, et autres
Publié: (2024)
FastEagle: Cascaded Drafting for Accelerating Speculative Decoding
par: Huang, Haiduo, et autres
Publié: (2025)
par: Huang, Haiduo, et autres
Publié: (2025)
Documents similaires
-
Fast Inference with Kronecker-Sparse Matrices
par: Gonon, Antoine, et autres
Publié: (2024) -
Rethinking Bregman Divergences in Kronecker-Factored Optimizers
par: Liu, Bing, et autres
Publié: (2026) -
Scaling Laws of SignSGD in Linear Regression: When Does It Outperform SGD?
par: Kim, Jihwan, et autres
Publié: (2026) -
Quantum Speedup for Spectral Approximation of Kronecker Products
par: Gao, Yeqi, et autres
Publié: (2024) -
Generalization and Optimization of SGD with Lookahead
par: Li, Kangcheng, et autres
Publié: (2025)