Enregistré dans:
| Auteurs principaux: | Almansoori, Abdulla Jasem, Horváth, Samuel, Takáč, Martin |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2410.03497 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
PaDPaF: Partial Disentanglement with Partially-Federated GANs
par: Almansoori, Abdulla Jasem, et autres
Publié: (2022)
par: Almansoori, Abdulla Jasem, et autres
Publié: (2022)
Faster Than SVD, Smarter Than SGD: The OPLoRA Alternating Update
par: Almansoori, Abdulla Jasem, et autres
Publié: (2025)
par: Almansoori, Abdulla Jasem, et autres
Publié: (2025)
Beyond SGD, Without SVD: Proximal Subspace Iteration LoRA with Diagonal Fractional K-FAC
par: Almansoori, Abdulla Jasem, et autres
Publié: (2026)
par: Almansoori, Abdulla Jasem, et autres
Publié: (2026)
Stochastic Gradient Methods with Preconditioned Updates
par: Sadiev, Abdurakhmon, et autres
Publié: (2022)
par: Sadiev, Abdurakhmon, et autres
Publié: (2022)
FRUGAL: Memory-Efficient Optimization by Reducing State Overhead for Scalable Training
par: Zmushko, Philip, et autres
Publié: (2024)
par: Zmushko, Philip, et autres
Publié: (2024)
FedPeWS: Personalized Warmup via Subnetworks for Enhanced Heterogeneous Federated Learning
par: Tastan, Nurbek, et autres
Publié: (2024)
par: Tastan, Nurbek, et autres
Publié: (2024)
Generalising Battery Control in Net-Zero Buildings via Personalised Federated RL
par: Avila, Nicolas M Cuadrado, et autres
Publié: (2024)
par: Avila, Nicolas M Cuadrado, et autres
Publié: (2024)
Byzantine-Robust Optimization under $(L_0, L_1)$-Smoothness
par: Bolatov, Arman, et autres
Publié: (2026)
par: Bolatov, Arman, et autres
Publié: (2026)
Federated Learning Can Find Friends That Are Advantageous
par: Tupitsa, Nazarii, et autres
Publié: (2024)
par: Tupitsa, Nazarii, et autres
Publié: (2024)
Generalized Policy Learning for Smart Grids: FL TRPO Approach
par: Li, Yunxiang, et autres
Publié: (2024)
par: Li, Yunxiang, et autres
Publié: (2024)
LionMuon: Alternating Spectral and Sign Descent for Efficient Training
par: Bolatov, Arman, et autres
Publié: (2026)
par: Bolatov, Arman, et autres
Publié: (2026)
Remove that Square Root: A New Efficient Scale-Invariant Version of AdaGrad
par: Choudhury, Sayantan, et autres
Publié: (2024)
par: Choudhury, Sayantan, et autres
Publié: (2024)
LoFT: Low-Rank Adaptation That Behaves Like Full Fine-Tuning
par: Tastan, Nurbek, et autres
Publié: (2025)
par: Tastan, Nurbek, et autres
Publié: (2025)
Revisiting LocalSGD and SCAFFOLD: Improved Rates and Missing Analysis
par: Luo, Ruichen, et autres
Publié: (2025)
par: Luo, Ruichen, et autres
Publié: (2025)
Simple Stepsize for Quasi-Newton Methods with Global Convergence Guarantees
par: Agafonov, Artem, et autres
Publié: (2025)
par: Agafonov, Artem, et autres
Publié: (2025)
MoSE: Mixture of Slimmable Experts for Efficient and Adaptive Language Models
par: Tastan, Nurbek, et autres
Publié: (2026)
par: Tastan, Nurbek, et autres
Publié: (2026)
Efficient Conformal Prediction under Data Heterogeneity
par: Plassier, Vincent, et autres
Publié: (2023)
par: Plassier, Vincent, et autres
Publié: (2023)
Enhancing Policy Gradient with the Polyak Step-Size Adaption
par: Li, Yunxiang, et autres
Publié: (2024)
par: Li, Yunxiang, et autres
Publié: (2024)
Methods for Convex $(L_0,L_1)$-Smooth Optimization: Clipping, Acceleration, and Adaptivity
par: Gorbunov, Eduard, et autres
Publié: (2024)
par: Gorbunov, Eduard, et autres
Publié: (2024)
Methods with Local Steps and Random Reshuffling for Generally Smooth Non-Convex Federated Optimization
par: Demidovich, Yury, et autres
Publié: (2024)
par: Demidovich, Yury, et autres
Publié: (2024)
Preconditioned Norms: A Unified Framework for Steepest Descent, Quasi-Newton and Adaptive Methods
par: Veprikov, Andrey, et autres
Publié: (2025)
par: Veprikov, Andrey, et autres
Publié: (2025)
What Scalable Second-Order Information Knows for Pruning at Initialization
par: Navarrete, Ivo Gollini, et autres
Publié: (2025)
par: Navarrete, Ivo Gollini, et autres
Publié: (2025)
CYCle: Choosing Your Collaborators Wisely to Enhance Collaborative Fairness in Decentralized Learning
par: Tastan, Nurbek, et autres
Publié: (2025)
par: Tastan, Nurbek, et autres
Publié: (2025)
Clipping Improves Adam-Norm and AdaGrad-Norm when the Noise Is Heavy-Tailed
par: Chezhegov, Savelii, et autres
Publié: (2024)
par: Chezhegov, Savelii, et autres
Publié: (2024)
Who to Trust? Aggregating Client Predictions in Federated Distillation
par: Kovalchuk, Viktor, et autres
Publié: (2025)
par: Kovalchuk, Viktor, et autres
Publié: (2025)
Aequa: Fair Model Rewards in Collaborative Learning via Slimmable Networks
par: Tastan, Nurbek, et autres
Publié: (2025)
par: Tastan, Nurbek, et autres
Publié: (2025)
Random-reshuffled SARAH does not need a full gradient computations
par: Beznosikov, Aleksandr, et autres
Publié: (2021)
par: Beznosikov, Aleksandr, et autres
Publié: (2021)
Decentralized Personalized Federated Learning
par: Kharrat, Salma, et autres
Publié: (2024)
par: Kharrat, Salma, et autres
Publié: (2024)
Search-Adaptor: Embedding Customization for Information Retrieval
par: Yoon, Jinsung, et autres
Publié: (2023)
par: Yoon, Jinsung, et autres
Publié: (2023)
Expert or not? assessing data quality in offline reinforcement learning
par: Asadulaev, Arip, et autres
Publié: (2025)
par: Asadulaev, Arip, et autres
Publié: (2025)
The AI Data Scientist
par: Akimov, Farkhad, et autres
Publié: (2025)
par: Akimov, Farkhad, et autres
Publié: (2025)
Similarity, Compression and Local Steps: Three Pillars of Efficient Communications for Distributed Variational Inequalities
par: Beznosikov, Aleksandr, et autres
Publié: (2023)
par: Beznosikov, Aleksandr, et autres
Publié: (2023)
Enhancing BERT Fine-Tuning for Sentiment Analysis in Lower-Resourced Languages
par: Kubík, Jozef, et autres
Publié: (2025)
par: Kubík, Jozef, et autres
Publié: (2025)
Vanishing Feature: Diagnosing Model Merging and Beyond
par: Qu, Xingyu, et autres
Publié: (2024)
par: Qu, Xingyu, et autres
Publié: (2024)
Low-Resource Machine Translation through the Lens of Personalized Federated Learning
par: Moskvoretskii, Viktor, et autres
Publié: (2024)
par: Moskvoretskii, Viktor, et autres
Publié: (2024)
GainAdaptor: Learning Quadrupedal Locomotion with Dual Actors for Adaptable and Energy-Efficient Walking on Various Terrains
par: Kim, Mincheol, et autres
Publié: (2024)
par: Kim, Mincheol, et autres
Publié: (2024)
FRESCO: Federated Reinforcement Energy System for Cooperative Optimization
par: Cuadrado, Nicolas Mauricio, et autres
Publié: (2024)
par: Cuadrado, Nicolas Mauricio, et autres
Publié: (2024)
Approximating Heavy-Tailed Distributions with a Mixture of Bernstein Phase-Type and Hyperexponential Models
par: Ziani, Abdelhakim, et autres
Publié: (2025)
par: Ziani, Abdelhakim, et autres
Publié: (2025)
Knowledge Distillation from Large Language Models for Household Energy Modeling
par: Takrouri, Mohannad, et autres
Publié: (2025)
par: Takrouri, Mohannad, et autres
Publié: (2025)
Can Muon Fine-tune Adam-Pretrained Models?
par: Qu, Xingyu, et autres
Publié: (2026)
par: Qu, Xingyu, et autres
Publié: (2026)
Documents similaires
-
PaDPaF: Partial Disentanglement with Partially-Federated GANs
par: Almansoori, Abdulla Jasem, et autres
Publié: (2022) -
Faster Than SVD, Smarter Than SGD: The OPLoRA Alternating Update
par: Almansoori, Abdulla Jasem, et autres
Publié: (2025) -
Beyond SGD, Without SVD: Proximal Subspace Iteration LoRA with Diagonal Fractional K-FAC
par: Almansoori, Abdulla Jasem, et autres
Publié: (2026) -
Stochastic Gradient Methods with Preconditioned Updates
par: Sadiev, Abdurakhmon, et autres
Publié: (2022) -
FRUGAL: Memory-Efficient Optimization by Reducing State Overhead for Scalable Training
par: Zmushko, Philip, et autres
Publié: (2024)