Gradient-Free Approaches is a Key to an Efficient Interaction with Markovian Stochasticity
Fuente:
arXiv
Guardado en:
| Autores principales: | Prokhorov, Boris, Chebykin, Semyon, Gasnikov, Alexander, Beznosikov, Aleksandr |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
First Order Methods with Markovian Noise: from Acceleration to Variational Inequalities
por: Beznosikov, Aleksandr, et al.
Publicado: (2023)
por: Beznosikov, Aleksandr, et al.
Publicado: (2023)
Activations and Gradients Compression for Model-Parallel Training
por: Rudakov, Mikhail, et al.
Publicado: (2024)
por: Rudakov, Mikhail, et al.
Publicado: (2024)
Optimal Data Splitting in Distributed Optimization for Machine Learning
por: Medyakov, Daniil, et al.
Publicado: (2024)
por: Medyakov, Daniil, et al.
Publicado: (2024)
Accelerated Stochastic ExtraGradient: Mixing Hessian and Gradient Similarity to Reduce Communication in Distributed and Federated Learning
por: Bylinkin, Dmitry, et al.
Publicado: (2024)
por: Bylinkin, Dmitry, et al.
Publicado: (2024)
Distributed Saddle-Point Problems: Lower Bounds, Near-Optimal and Robust Algorithms
por: Beznosikov, Aleksandr, et al.
Publicado: (2020)
por: Beznosikov, Aleksandr, et al.
Publicado: (2020)
Similarity, Compression and Local Steps: Three Pillars of Efficient Communications for Distributed Variational Inequalities
por: Beznosikov, Aleksandr, et al.
Publicado: (2023)
por: Beznosikov, Aleksandr, et al.
Publicado: (2023)
Stochastic Gradient Methods with Preconditioned Updates
por: Sadiev, Abdurakhmon, et al.
Publicado: (2022)
por: Sadiev, Abdurakhmon, et al.
Publicado: (2022)
Accelerated Stochastic Gradient Method with Applications to Consensus Problem in Markov-Varying Networks
por: Solodkin, Vladimir, et al.
Publicado: (2024)
por: Solodkin, Vladimir, et al.
Publicado: (2024)
Optimal Analysis of Method with Batching for Monotone Stochastic Finite-Sum Variational Inequalities
por: Pichugin, Alexander, et al.
Publicado: (2024)
por: Pichugin, Alexander, et al.
Publicado: (2024)
Random-reshuffled SARAH does not need a full gradient computations
por: Beznosikov, Aleksandr, et al.
Publicado: (2021)
por: Beznosikov, Aleksandr, et al.
Publicado: (2021)
Clipping Improves Adam-Norm and AdaGrad-Norm when the Noise Is Heavy-Tailed
por: Chezhegov, Savelii, et al.
Publicado: (2024)
por: Chezhegov, Savelii, et al.
Publicado: (2024)
Method with Batching for Stochastic Finite-Sum Variational Inequalities in Non-Euclidean Setting
por: Pichugin, Alexander, et al.
Publicado: (2024)
por: Pichugin, Alexander, et al.
Publicado: (2024)
Sign Operator for Coping with Heavy-Tailed Noise in Non-Convex Optimization: High Probability Bounds Under $(L_0, L_1)$-Smoothness
por: Kornilov, Nikita, et al.
Publicado: (2025)
por: Kornilov, Nikita, et al.
Publicado: (2025)
Ito Diffusion Approximation of Universal Ito Chains for Sampling, Optimization and Boosting
por: Ustimenko, Aleksei, et al.
Publicado: (2023)
por: Ustimenko, Aleksei, et al.
Publicado: (2023)
Stochastic Frank-Wolfe: Unified Analysis and Zoo of Special Cases
por: Nazykov, Ruslan, et al.
Publicado: (2024)
por: Nazykov, Ruslan, et al.
Publicado: (2024)
Variance Reduction Methods Do Not Need to Compute Full Gradients: Improved Efficiency through Shuffling
por: Medyakov, Daniil, et al.
Publicado: (2025)
por: Medyakov, Daniil, et al.
Publicado: (2025)
Exploring New Frontiers in Vertical Federated Learning: the Role of Saddle Point Reformulation
por: Beznosikov, Aleksandr, et al.
Publicado: (2026)
por: Beznosikov, Aleksandr, et al.
Publicado: (2026)
Methods for Optimization Problems with Markovian Stochasticity and Non-Euclidean Geometry
por: Solodkin, Vladimir, et al.
Publicado: (2024)
por: Solodkin, Vladimir, et al.
Publicado: (2024)
Sarah Frank-Wolfe: Methods for Constrained Optimization with Best Rates and Practical Features
por: Beznosikov, Aleksandr, et al.
Publicado: (2023)
por: Beznosikov, Aleksandr, et al.
Publicado: (2023)
Hierarchical Mixture-of-Experts with Two-Stage Optimization
por: Molodtsov, Gleb, et al.
Publicado: (2026)
por: Molodtsov, Gleb, et al.
Publicado: (2026)
Methods for Solving Variational Inequalities with Markovian Stochasticity
por: Solodkin, Vladimir, et al.
Publicado: (2024)
por: Solodkin, Vladimir, et al.
Publicado: (2024)
Bregman Proximal Method for Efficient Communications under Similarity
por: Beznosikov, Aleksandr, et al.
Publicado: (2023)
por: Beznosikov, Aleksandr, et al.
Publicado: (2023)
Extragradient Sliding for Composite Non-Monotone Variational Inequalities
por: Emelyanov, Roman, et al.
Publicado: (2024)
por: Emelyanov, Roman, et al.
Publicado: (2024)
Local SGD for Near-Quadratic Problems: Improving Convergence under Unconstrained Noise Conditions
por: Sadchikov, Andrey, et al.
Publicado: (2024)
por: Sadchikov, Andrey, et al.
Publicado: (2024)
Accelerated Methods with Compression for Horizontal and Vertical Federated Learning
por: Stanko, Sergey, et al.
Publicado: (2024)
por: Stanko, Sergey, et al.
Publicado: (2024)
WeightLoRA: Keep Only Necessary Adapters
por: Veprikov, Andrey, et al.
Publicado: (2025)
por: Veprikov, Andrey, et al.
Publicado: (2025)
Decentralized Personalized Federated Learning for Min-Max Problems
por: Borodich, Ekaterina, et al.
Publicado: (2021)
por: Borodich, Ekaterina, et al.
Publicado: (2021)
Sign-SGD via Parameter-Free Optimization
por: Medyakov, Daniil, et al.
Publicado: (2025)
por: Medyakov, Daniil, et al.
Publicado: (2025)
Convergence of Clipped-SGD for Convex $(L_0,L_1)$-Smooth Optimization with Heavy-Tailed Noise
por: Chezhegov, Savelii, et al.
Publicado: (2025)
por: Chezhegov, Savelii, et al.
Publicado: (2025)
Enhancing Stability of Physics-Informed Neural Network Training Through Saddle-Point Reformulation
por: Bylinkin, Dmitry, et al.
Publicado: (2025)
por: Bylinkin, Dmitry, et al.
Publicado: (2025)
Power of Generalized Smoothness in Stochastic Convex Optimization: First- and Zero-Order Algorithms
por: Lobanov, Aleksandr, et al.
Publicado: (2025)
por: Lobanov, Aleksandr, et al.
Publicado: (2025)
Accelerated Methods with Compressed Communications for Distributed Optimization Problems under Data Similarity
por: Bylinkin, Dmitry, et al.
Publicado: (2024)
por: Bylinkin, Dmitry, et al.
Publicado: (2024)
High Probability Complexity Bounds for Non-Smooth Stochastic Optimization with Heavy-Tailed Noise
por: Gorbunov, Eduard, et al.
Publicado: (2021)
por: Gorbunov, Eduard, et al.
Publicado: (2021)
Where Does Warm-Up Come From? Adaptive Scheduling for Norm-Constrained Optimizers
por: Riabinin, Artem, et al.
Publicado: (2026)
por: Riabinin, Artem, et al.
Publicado: (2026)
Shuffling Heuristic in Variational Inequalities: Establishing New Convergence Guarantees
por: Medyakov, Daniil, et al.
Publicado: (2025)
por: Medyakov, Daniil, et al.
Publicado: (2025)
Preconditioned Norms: A Unified Framework for Steepest Descent, Quasi-Newton and Adaptive Methods
por: Veprikov, Andrey, et al.
Publicado: (2025)
por: Veprikov, Andrey, et al.
Publicado: (2025)
Stochastic-Constrained Stochastic Optimization with Markovian Data
por: Kim, Yeongjong, et al.
Publicado: (2023)
por: Kim, Yeongjong, et al.
Publicado: (2023)
Accelerated Methods with Complexity Separation Under Data Similarity for Federated Learning Problems
por: Bylinkin, Dmitry, et al.
Publicado: (2026)
por: Bylinkin, Dmitry, et al.
Publicado: (2026)
Zero-Order Optimization for LLM Fine-Tuning via Learnable Direction Sampling
por: Parfenov, Valery, et al.
Publicado: (2026)
por: Parfenov, Valery, et al.
Publicado: (2026)
One-Point Feedback for Composite Optimization with Applications to Distributed and Federated Learning
por: Beznosikov, Aleksandr, et al.
Publicado: (2021)
por: Beznosikov, Aleksandr, et al.
Publicado: (2021)
Ejemplares similares
-
First Order Methods with Markovian Noise: from Acceleration to Variational Inequalities
por: Beznosikov, Aleksandr, et al.
Publicado: (2023) -
Activations and Gradients Compression for Model-Parallel Training
por: Rudakov, Mikhail, et al.
Publicado: (2024) -
Optimal Data Splitting in Distributed Optimization for Machine Learning
por: Medyakov, Daniil, et al.
Publicado: (2024) -
Accelerated Stochastic ExtraGradient: Mixing Hessian and Gradient Similarity to Reduce Communication in Distributed and Federated Learning
por: Bylinkin, Dmitry, et al.
Publicado: (2024) -
Distributed Saddle-Point Problems: Lower Bounds, Near-Optimal and Robust Algorithms
por: Beznosikov, Aleksandr, et al.
Publicado: (2020)