AGD: an Auto-switchable Optimizer using Stepwise Gradient Difference for Preconditioning Matrix
Fuente:
arXiv
Salvato in:
| Autori principali: | Yue, Yun, Ye, Zhiling, Jiang, Jiadi, Liu, Yongchao, Zhang, Ke |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
An Optimistic Gradient Tracking Method for Distributed Minimax Optimization
di: Huang, Yan, et al.
Pubblicazione: (2025)
di: Huang, Yan, et al.
Pubblicazione: (2025)
Tailoring Gradient Methods for Differentially-Private Distributed Optimization
di: Wang, Yongqiang, et al.
Pubblicazione: (2022)
di: Wang, Yongqiang, et al.
Pubblicazione: (2022)
Decentralized Gradient-Free Methods for Stochastic Non-Smooth Non-Convex Optimization
di: Lin, Zhenwei, et al.
Pubblicazione: (2023)
di: Lin, Zhenwei, et al.
Pubblicazione: (2023)
Smoothed Gradient Clipping and Error Feedback for Decentralized Optimization under Symmetric Heavy-Tailed Noise
di: Yu, Shuhua, et al.
Pubblicazione: (2023)
di: Yu, Shuhua, et al.
Pubblicazione: (2023)
Load Balancing with Network Latencies via Distributed Gradient Descent
di: Balseiro, Santiago R., et al.
Pubblicazione: (2025)
di: Balseiro, Santiago R., et al.
Pubblicazione: (2025)
CONGO: Compressive Online Gradient Optimization
di: Carleton, Jeremy, et al.
Pubblicazione: (2024)
di: Carleton, Jeremy, et al.
Pubblicazione: (2024)
D-PDLP: Scaling PDLP to Distributed Multi-GPU Systems
di: Li, Hongpei, et al.
Pubblicazione: (2026)
di: Li, Hongpei, et al.
Pubblicazione: (2026)
Decentralized Distributed Optimization for Saddle Point Problems
di: Rogozin, Alexander, et al.
Pubblicazione: (2021)
di: Rogozin, Alexander, et al.
Pubblicazione: (2021)
Decentralized Nonsmooth Nonconvex Optimization with Client Sampling
di: Chen, Xinyan, et al.
Pubblicazione: (2026)
di: Chen, Xinyan, et al.
Pubblicazione: (2026)
Problem-Parameter-Free Decentralized Nonconvex Stochastic Optimization
di: Li, Jiaxiang, et al.
Pubblicazione: (2024)
di: Li, Jiaxiang, et al.
Pubblicazione: (2024)
Optimizing Stochastic Gradient Push under Broadcast Communications
di: Nguyen, Tuan, et al.
Pubblicazione: (2026)
di: Nguyen, Tuan, et al.
Pubblicazione: (2026)
Distributed Constrained Combinatorial Optimization leveraging Hypergraph Neural Networks
di: Heydaribeni, Nasimeh, et al.
Pubblicazione: (2023)
di: Heydaribeni, Nasimeh, et al.
Pubblicazione: (2023)
Distributed Constraint-Coupled Optimization: Harnessing ADMM-consensus for robustness
di: Messilem, Mohamed Abdelmouamin, et al.
Pubblicazione: (2025)
di: Messilem, Mohamed Abdelmouamin, et al.
Pubblicazione: (2025)
One-Point Feedback for Composite Optimization with Applications to Distributed and Federated Learning
di: Beznosikov, Aleksandr, et al.
Pubblicazione: (2021)
di: Beznosikov, Aleksandr, et al.
Pubblicazione: (2021)
Decentralized Nonconvex Optimization under Heavy-Tailed Noise: Normalization and Optimal Convergence
di: Yu, Shuhua, et al.
Pubblicazione: (2025)
di: Yu, Shuhua, et al.
Pubblicazione: (2025)
From Sequential to Parallel: Reformulating Dynamic Programming as GPU Kernels for Large-Scale Stochastic Combinatorial Optimization
di: Zhao, Jingyi, et al.
Pubblicazione: (2026)
di: Zhao, Jingyi, et al.
Pubblicazione: (2026)
Distributed Difference of Convex Optimization
di: Khatana, Vivek, et al.
Pubblicazione: (2024)
di: Khatana, Vivek, et al.
Pubblicazione: (2024)
Adaptive Federated Learning with Auto-Tuned Clients
di: Kim, Junhyung Lyle, et al.
Pubblicazione: (2023)
di: Kim, Junhyung Lyle, et al.
Pubblicazione: (2023)
OptPipe: Memory- and Scheduling-Optimized Pipeline Parallelism for LLM Training
di: Li, Hongpei, et al.
Pubblicazione: (2025)
di: Li, Hongpei, et al.
Pubblicazione: (2025)
Krylov Solvers for Interior Point Methods with Applications in Radiation Therapy and Support Vector Machines
di: Liu, Felix, et al.
Pubblicazione: (2023)
di: Liu, Felix, et al.
Pubblicazione: (2023)
A Hybrid Stochastic Gradient Tracking Method for Distributed Online Optimization Over Time-Varying Directed Networks
di: Shi, Xinli, et al.
Pubblicazione: (2025)
di: Shi, Xinli, et al.
Pubblicazione: (2025)
A Bias-Correction Decentralized Stochastic Gradient Algorithm with Momentum Acceleration
di: Hu, Yuchen, et al.
Pubblicazione: (2025)
di: Hu, Yuchen, et al.
Pubblicazione: (2025)
Optimality in Decentralized Optimization under Bandwidth Constraints
di: Tyurin, Alexander
Pubblicazione: (2026)
di: Tyurin, Alexander
Pubblicazione: (2026)
EDiT: A Local-SGD-Based Efficient Distributed Training Method for Large Language Models
di: Cheng, Jialiang, et al.
Pubblicazione: (2024)
di: Cheng, Jialiang, et al.
Pubblicazione: (2024)
An Accelerated Distributed Stochastic Gradient Method with Momentum
di: Huang, Kun, et al.
Pubblicazione: (2024)
di: Huang, Kun, et al.
Pubblicazione: (2024)
Activations and Gradients Compression for Model-Parallel Training
di: Rudakov, Mikhail, et al.
Pubblicazione: (2024)
di: Rudakov, Mikhail, et al.
Pubblicazione: (2024)
Efficient Gradient Methods for Distributed Saddle Problems
di: Luo, Ruichen, et al.
Pubblicazione: (2026)
di: Luo, Ruichen, et al.
Pubblicazione: (2026)
A First-Order Algorithm for Decentralised Min-Max Problems
di: Malitsky, Yura, et al.
Pubblicazione: (2023)
di: Malitsky, Yura, et al.
Pubblicazione: (2023)
Non-ergodic linear convergence property of the delayed gradient descent under the strongly convexity and the Polyak-Łojasiewicz condition
di: Choi, Hyung Jun, et al.
Pubblicazione: (2023)
di: Choi, Hyung Jun, et al.
Pubblicazione: (2023)
Accelerating Optimal Power Flow with GPUs: SIMD Abstraction of Nonlinear Programs and Condensed-Space Interior-Point Methods
di: Shin, Sungho, et al.
Pubblicazione: (2023)
di: Shin, Sungho, et al.
Pubblicazione: (2023)
Temporal Parallelisation of the HJB Equation and Continuous-Time Linear Quadratic Control
di: Särkkä, Simo, et al.
Pubblicazione: (2022)
di: Särkkä, Simo, et al.
Pubblicazione: (2022)
Distributed Stochastic Momentum Tracking with Local Updates: Achieving Optimal Communication and Iteration Complexities
di: Huang, Kun, et al.
Pubblicazione: (2025)
di: Huang, Kun, et al.
Pubblicazione: (2025)
Large-Scale LLM Inference with Heterogeneous Workloads: Prefill-Decode Contention and Asymptotically Optimal Control
di: Lin, Ruihan, et al.
Pubblicazione: (2026)
di: Lin, Ruihan, et al.
Pubblicazione: (2026)
An efficient implementation of parallel simulated annealing algorithm in GPUs
di: Ferreiro, A. M., et al.
Pubblicazione: (2024)
di: Ferreiro, A. M., et al.
Pubblicazione: (2024)
Modeling Task Mapping for Data-intensive Applications in Heterogeneous Systems
di: Wilhelm, Martin, et al.
Pubblicazione: (2022)
di: Wilhelm, Martin, et al.
Pubblicazione: (2022)
A GPU-Accelerated Distributed Algorithm for Optimal Power Flow in Distribution Systems
di: Ryu, Minseok, et al.
Pubblicazione: (2025)
di: Ryu, Minseok, et al.
Pubblicazione: (2025)
Average-case optimization analysis for distributed consensus algorithms on regular graphs
di: Nguyen, Nhat Trung, et al.
Pubblicazione: (2024)
di: Nguyen, Nhat Trung, et al.
Pubblicazione: (2024)
GPU-Accelerated Primal Heuristics for Mixed Integer Programming
di: Çördük, Akif, et al.
Pubblicazione: (2025)
di: Çördük, Akif, et al.
Pubblicazione: (2025)
Time-varying Mixing Matrix Design for Energy-efficient Decentralized Federated Learning
di: Zhang, Xusheng, et al.
Pubblicazione: (2025)
di: Zhang, Xusheng, et al.
Pubblicazione: (2025)
Distributed Conjugate Gradient Method via Conjugate Direction Tracking
di: Shorinwa, Ola, et al.
Pubblicazione: (2023)
di: Shorinwa, Ola, et al.
Pubblicazione: (2023)
Documenti analoghi
-
An Optimistic Gradient Tracking Method for Distributed Minimax Optimization
di: Huang, Yan, et al.
Pubblicazione: (2025) -
Tailoring Gradient Methods for Differentially-Private Distributed Optimization
di: Wang, Yongqiang, et al.
Pubblicazione: (2022) -
Decentralized Gradient-Free Methods for Stochastic Non-Smooth Non-Convex Optimization
di: Lin, Zhenwei, et al.
Pubblicazione: (2023) -
Smoothed Gradient Clipping and Error Feedback for Decentralized Optimization under Symmetric Heavy-Tailed Noise
di: Yu, Shuhua, et al.
Pubblicazione: (2023) -
Load Balancing with Network Latencies via Distributed Gradient Descent
di: Balseiro, Santiago R., et al.
Pubblicazione: (2025)