Gradient-Free Approaches is a Key to an Efficient Interaction with Markovian Stochasticity
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Prokhorov, Boris, Chebykin, Semyon, Gasnikov, Alexander, Beznosikov, Aleksandr |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
First Order Methods with Markovian Noise: from Acceleration to Variational Inequalities
par: Beznosikov, Aleksandr, et autres
Publié: (2023)
par: Beznosikov, Aleksandr, et autres
Publié: (2023)
Activations and Gradients Compression for Model-Parallel Training
par: Rudakov, Mikhail, et autres
Publié: (2024)
par: Rudakov, Mikhail, et autres
Publié: (2024)
Optimal Data Splitting in Distributed Optimization for Machine Learning
par: Medyakov, Daniil, et autres
Publié: (2024)
par: Medyakov, Daniil, et autres
Publié: (2024)
Accelerated Stochastic ExtraGradient: Mixing Hessian and Gradient Similarity to Reduce Communication in Distributed and Federated Learning
par: Bylinkin, Dmitry, et autres
Publié: (2024)
par: Bylinkin, Dmitry, et autres
Publié: (2024)
Distributed Saddle-Point Problems: Lower Bounds, Near-Optimal and Robust Algorithms
par: Beznosikov, Aleksandr, et autres
Publié: (2020)
par: Beznosikov, Aleksandr, et autres
Publié: (2020)
Similarity, Compression and Local Steps: Three Pillars of Efficient Communications for Distributed Variational Inequalities
par: Beznosikov, Aleksandr, et autres
Publié: (2023)
par: Beznosikov, Aleksandr, et autres
Publié: (2023)
Stochastic Gradient Methods with Preconditioned Updates
par: Sadiev, Abdurakhmon, et autres
Publié: (2022)
par: Sadiev, Abdurakhmon, et autres
Publié: (2022)
Accelerated Stochastic Gradient Method with Applications to Consensus Problem in Markov-Varying Networks
par: Solodkin, Vladimir, et autres
Publié: (2024)
par: Solodkin, Vladimir, et autres
Publié: (2024)
Optimal Analysis of Method with Batching for Monotone Stochastic Finite-Sum Variational Inequalities
par: Pichugin, Alexander, et autres
Publié: (2024)
par: Pichugin, Alexander, et autres
Publié: (2024)
Random-reshuffled SARAH does not need a full gradient computations
par: Beznosikov, Aleksandr, et autres
Publié: (2021)
par: Beznosikov, Aleksandr, et autres
Publié: (2021)
Clipping Improves Adam-Norm and AdaGrad-Norm when the Noise Is Heavy-Tailed
par: Chezhegov, Savelii, et autres
Publié: (2024)
par: Chezhegov, Savelii, et autres
Publié: (2024)
Method with Batching for Stochastic Finite-Sum Variational Inequalities in Non-Euclidean Setting
par: Pichugin, Alexander, et autres
Publié: (2024)
par: Pichugin, Alexander, et autres
Publié: (2024)
Sign Operator for Coping with Heavy-Tailed Noise in Non-Convex Optimization: High Probability Bounds Under $(L_0, L_1)$-Smoothness
par: Kornilov, Nikita, et autres
Publié: (2025)
par: Kornilov, Nikita, et autres
Publié: (2025)
Ito Diffusion Approximation of Universal Ito Chains for Sampling, Optimization and Boosting
par: Ustimenko, Aleksei, et autres
Publié: (2023)
par: Ustimenko, Aleksei, et autres
Publié: (2023)
Stochastic Frank-Wolfe: Unified Analysis and Zoo of Special Cases
par: Nazykov, Ruslan, et autres
Publié: (2024)
par: Nazykov, Ruslan, et autres
Publié: (2024)
Variance Reduction Methods Do Not Need to Compute Full Gradients: Improved Efficiency through Shuffling
par: Medyakov, Daniil, et autres
Publié: (2025)
par: Medyakov, Daniil, et autres
Publié: (2025)
Exploring New Frontiers in Vertical Federated Learning: the Role of Saddle Point Reformulation
par: Beznosikov, Aleksandr, et autres
Publié: (2026)
par: Beznosikov, Aleksandr, et autres
Publié: (2026)
Methods for Optimization Problems with Markovian Stochasticity and Non-Euclidean Geometry
par: Solodkin, Vladimir, et autres
Publié: (2024)
par: Solodkin, Vladimir, et autres
Publié: (2024)
Sarah Frank-Wolfe: Methods for Constrained Optimization with Best Rates and Practical Features
par: Beznosikov, Aleksandr, et autres
Publié: (2023)
par: Beznosikov, Aleksandr, et autres
Publié: (2023)
Hierarchical Mixture-of-Experts with Two-Stage Optimization
par: Molodtsov, Gleb, et autres
Publié: (2026)
par: Molodtsov, Gleb, et autres
Publié: (2026)
Methods for Solving Variational Inequalities with Markovian Stochasticity
par: Solodkin, Vladimir, et autres
Publié: (2024)
par: Solodkin, Vladimir, et autres
Publié: (2024)
Bregman Proximal Method for Efficient Communications under Similarity
par: Beznosikov, Aleksandr, et autres
Publié: (2023)
par: Beznosikov, Aleksandr, et autres
Publié: (2023)
Extragradient Sliding for Composite Non-Monotone Variational Inequalities
par: Emelyanov, Roman, et autres
Publié: (2024)
par: Emelyanov, Roman, et autres
Publié: (2024)
Local SGD for Near-Quadratic Problems: Improving Convergence under Unconstrained Noise Conditions
par: Sadchikov, Andrey, et autres
Publié: (2024)
par: Sadchikov, Andrey, et autres
Publié: (2024)
Accelerated Methods with Compression for Horizontal and Vertical Federated Learning
par: Stanko, Sergey, et autres
Publié: (2024)
par: Stanko, Sergey, et autres
Publié: (2024)
WeightLoRA: Keep Only Necessary Adapters
par: Veprikov, Andrey, et autres
Publié: (2025)
par: Veprikov, Andrey, et autres
Publié: (2025)
Decentralized Personalized Federated Learning for Min-Max Problems
par: Borodich, Ekaterina, et autres
Publié: (2021)
par: Borodich, Ekaterina, et autres
Publié: (2021)
Sign-SGD via Parameter-Free Optimization
par: Medyakov, Daniil, et autres
Publié: (2025)
par: Medyakov, Daniil, et autres
Publié: (2025)
Convergence of Clipped-SGD for Convex $(L_0,L_1)$-Smooth Optimization with Heavy-Tailed Noise
par: Chezhegov, Savelii, et autres
Publié: (2025)
par: Chezhegov, Savelii, et autres
Publié: (2025)
Enhancing Stability of Physics-Informed Neural Network Training Through Saddle-Point Reformulation
par: Bylinkin, Dmitry, et autres
Publié: (2025)
par: Bylinkin, Dmitry, et autres
Publié: (2025)
Power of Generalized Smoothness in Stochastic Convex Optimization: First- and Zero-Order Algorithms
par: Lobanov, Aleksandr, et autres
Publié: (2025)
par: Lobanov, Aleksandr, et autres
Publié: (2025)
Accelerated Methods with Compressed Communications for Distributed Optimization Problems under Data Similarity
par: Bylinkin, Dmitry, et autres
Publié: (2024)
par: Bylinkin, Dmitry, et autres
Publié: (2024)
High Probability Complexity Bounds for Non-Smooth Stochastic Optimization with Heavy-Tailed Noise
par: Gorbunov, Eduard, et autres
Publié: (2021)
par: Gorbunov, Eduard, et autres
Publié: (2021)
Where Does Warm-Up Come From? Adaptive Scheduling for Norm-Constrained Optimizers
par: Riabinin, Artem, et autres
Publié: (2026)
par: Riabinin, Artem, et autres
Publié: (2026)
Shuffling Heuristic in Variational Inequalities: Establishing New Convergence Guarantees
par: Medyakov, Daniil, et autres
Publié: (2025)
par: Medyakov, Daniil, et autres
Publié: (2025)
Preconditioned Norms: A Unified Framework for Steepest Descent, Quasi-Newton and Adaptive Methods
par: Veprikov, Andrey, et autres
Publié: (2025)
par: Veprikov, Andrey, et autres
Publié: (2025)
Stochastic-Constrained Stochastic Optimization with Markovian Data
par: Kim, Yeongjong, et autres
Publié: (2023)
par: Kim, Yeongjong, et autres
Publié: (2023)
Accelerated Methods with Complexity Separation Under Data Similarity for Federated Learning Problems
par: Bylinkin, Dmitry, et autres
Publié: (2026)
par: Bylinkin, Dmitry, et autres
Publié: (2026)
Zero-Order Optimization for LLM Fine-Tuning via Learnable Direction Sampling
par: Parfenov, Valery, et autres
Publié: (2026)
par: Parfenov, Valery, et autres
Publié: (2026)
One-Point Feedback for Composite Optimization with Applications to Distributed and Federated Learning
par: Beznosikov, Aleksandr, et autres
Publié: (2021)
par: Beznosikov, Aleksandr, et autres
Publié: (2021)
Documents similaires
-
First Order Methods with Markovian Noise: from Acceleration to Variational Inequalities
par: Beznosikov, Aleksandr, et autres
Publié: (2023) -
Activations and Gradients Compression for Model-Parallel Training
par: Rudakov, Mikhail, et autres
Publié: (2024) -
Optimal Data Splitting in Distributed Optimization for Machine Learning
par: Medyakov, Daniil, et autres
Publié: (2024) -
Accelerated Stochastic ExtraGradient: Mixing Hessian and Gradient Similarity to Reduce Communication in Distributed and Federated Learning
par: Bylinkin, Dmitry, et autres
Publié: (2024) -
Distributed Saddle-Point Problems: Lower Bounds, Near-Optimal and Robust Algorithms
par: Beznosikov, Aleksandr, et autres
Publié: (2020)