Enregistré dans:
| Auteurs principaux: | Ferbach, Damien, Goujaud, Baptiste, Gidel, Gauthier, Dieuleveut, Aymeric |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2310.19103 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Dimension-adapted Momentum Outscales SGD
par: Ferbach, Damien, et autres
Publié: (2025)
par: Ferbach, Damien, et autres
Publié: (2025)
Logarithmic-time Schedules for Scaling Language Models with Momentum
par: Ferbach, Damien, et autres
Publié: (2026)
par: Ferbach, Damien, et autres
Publié: (2026)
Self-Consuming Generative Models with Curated Data Provably Optimize Human Preferences
par: Ferbach, Damien, et autres
Publié: (2024)
par: Ferbach, Damien, et autres
Publié: (2024)
Provable non-accelerations of the heavy-ball method
par: Goujaud, Baptiste, et autres
Publié: (2023)
par: Goujaud, Baptiste, et autres
Publié: (2023)
Counter-examples in first-order optimization: a constructive approach
par: Goujaud, Baptiste, et autres
Publié: (2023)
par: Goujaud, Baptiste, et autres
Publié: (2023)
Open Problem: Two Riddles in Heavy-Ball Dynamics
par: Goujaud, Baptiste, et autres
Publié: (2025)
par: Goujaud, Baptiste, et autres
Publié: (2025)
PEPit: computer-assisted worst-case analyses of first-order optimization methods in Python
par: Goujaud, Baptiste, et autres
Publié: (2022)
par: Goujaud, Baptiste, et autres
Publié: (2022)
Compressed and distributed least-squares regression: convergence rates with applications to Federated Learning
par: Philippenko, Constantin, et autres
Publié: (2023)
par: Philippenko, Constantin, et autres
Publié: (2023)
Performative Prediction with Neural Networks
par: Mofakhami, Mehrnaz, et autres
Publié: (2023)
par: Mofakhami, Mehrnaz, et autres
Publié: (2023)
Scaffold with Stochastic Gradients: New Analysis with Linear Speed-Up
par: Mangold, Paul, et autres
Publié: (2025)
par: Mangold, Paul, et autres
Publié: (2025)
Byzantine-Robust Gossip: Insights from a Dual Approach
par: Gaucher, Renaud, et autres
Publié: (2024)
par: Gaucher, Renaud, et autres
Publié: (2024)
Tight Analysis of Decentralized SGD: A Markov Chain Perspective
par: Versini, Lucas, et autres
Publié: (2026)
par: Versini, Lucas, et autres
Publié: (2026)
Unified Breakdown Analysis for Byzantine Robust Gossip
par: Gaucher, Renaud, et autres
Publié: (2024)
par: Gaucher, Renaud, et autres
Publié: (2024)
From Inexact Gradients to Byzantine Robustness: Acceleration and Optimization under Similarity
par: Gaucher, Renaud, et autres
Publié: (2026)
par: Gaucher, Renaud, et autres
Publié: (2026)
A Tight Theory of Error Feedback Algorithms in Distributed Optimization
par: Thomsen, Daniel Berg, et autres
Publié: (2026)
par: Thomsen, Daniel Berg, et autres
Publié: (2026)
Scalable Utility-Aware Multiclass Calibration
par: Hegazy, Mahmoud, et autres
Publié: (2025)
par: Hegazy, Mahmoud, et autres
Publié: (2025)
Random features models: a way to study the success of naive imputation
par: Ayme, Alexis, et autres
Publié: (2024)
par: Ayme, Alexis, et autres
Publié: (2024)
When is Momentum Extragradient Optimal? A Polynomial-Based Analysis
par: Kim, Junhyung Lyle, et autres
Publié: (2022)
par: Kim, Junhyung Lyle, et autres
Publié: (2022)
Tight analyses of first-order methods with error feedback
par: Thomsen, Daniel Berg, et autres
Publié: (2025)
par: Thomsen, Daniel Berg, et autres
Publié: (2025)
Federated Majorize-Minimization: Beyond Parameter Aggregation
par: Dieuleveut, Aymeric, et autres
Publié: (2025)
par: Dieuleveut, Aymeric, et autres
Publié: (2025)
Linear Mode Connectivity in Sparse Neural Networks
par: McDermott, Luke, et autres
Publié: (2023)
par: McDermott, Luke, et autres
Publié: (2023)
Sarah Frank-Wolfe: Methods for Constrained Optimization with Best Rates and Practical Features
par: Beznosikov, Aleksandr, et autres
Publié: (2023)
par: Beznosikov, Aleksandr, et autres
Publié: (2023)
General Causal Imputation via Synthetic Interventions
par: Jiralerspong, Marco, et autres
Publié: (2024)
par: Jiralerspong, Marco, et autres
Publié: (2024)
Refined Analysis of Federated Averaging and Federated Richardson-Romberg
par: Mangold, Paul, et autres
Publié: (2024)
par: Mangold, Paul, et autres
Publié: (2024)
Valid Selection among Conformal Sets
par: Hegazy, Mahmoud, et autres
Publié: (2025)
par: Hegazy, Mahmoud, et autres
Publié: (2025)
A Study of Condition Numbers for First-Order Optimization
par: Guille-Escuret, Charles, et autres
Publié: (2020)
par: Guille-Escuret, Charles, et autres
Publié: (2020)
Omega: Optimistic EMA Gradients
par: Ramirez, Juan, et autres
Publié: (2023)
par: Ramirez, Juan, et autres
Publié: (2023)
Gradient Descent on Logistic Regression: Do Large Step-Sizes Work with Data on the Sphere?
par: Meng, Si Yi, et autres
Publié: (2025)
par: Meng, Si Yi, et autres
Publié: (2025)
Soft Prompt Threats: Attacking Safety Alignment and Unlearning in Open-Source LLMs through the Embedding Space
par: Schwinn, Leo, et autres
Publié: (2024)
par: Schwinn, Leo, et autres
Publié: (2024)
Optimal Transport-based Conformal Prediction
par: Thurin, Gauthier, et autres
Publié: (2025)
par: Thurin, Gauthier, et autres
Publié: (2025)
Landscaping Linear Mode Connectivity
par: Singh, Sidak Pal, et autres
Publié: (2024)
par: Singh, Sidak Pal, et autres
Publié: (2024)
On the Stability of Iterative Retraining of Generative Models on their own Data
par: Bertrand, Quentin, et autres
Publié: (2023)
par: Bertrand, Quentin, et autres
Publié: (2023)
In-Context Learning Can Re-learn Forbidden Tasks
par: Xhonneux, Sophie, et autres
Publié: (2024)
par: Xhonneux, Sophie, et autres
Publié: (2024)
Efficient Adversarial Training in LLMs with Continuous Attacks
par: Xhonneux, Sophie, et autres
Publié: (2024)
par: Xhonneux, Sophie, et autres
Publié: (2024)
Sliced-Wasserstein Estimation with Spherical Harmonics as Control Variates
par: Leluc, Rémi, et autres
Publié: (2024)
par: Leluc, Rémi, et autres
Publié: (2024)
Siegel Neural Networks
par: Nguyen, Xuan Son, et autres
Publié: (2025)
par: Nguyen, Xuan Son, et autres
Publié: (2025)
Convergence Rates for Distribution Matching with Sliced Optimal Transport
par: Thurin, Gauthier, et autres
Publié: (2026)
par: Thurin, Gauthier, et autres
Publié: (2026)
Fusion of Graph Neural Networks via Optimal Transport
par: Ormaniec, Weronika, et autres
Publié: (2025)
par: Ormaniec, Weronika, et autres
Publié: (2025)
Layer-wise Linear Mode Connectivity
par: Adilova, Linara, et autres
Publié: (2023)
par: Adilova, Linara, et autres
Publié: (2023)
Generalized Linear Mode Connectivity for Transformers
par: Theus, Alexander, et autres
Publié: (2025)
par: Theus, Alexander, et autres
Publié: (2025)
Documents similaires
-
Dimension-adapted Momentum Outscales SGD
par: Ferbach, Damien, et autres
Publié: (2025) -
Logarithmic-time Schedules for Scaling Language Models with Momentum
par: Ferbach, Damien, et autres
Publié: (2026) -
Self-Consuming Generative Models with Curated Data Provably Optimize Human Preferences
par: Ferbach, Damien, et autres
Publié: (2024) -
Provable non-accelerations of the heavy-ball method
par: Goujaud, Baptiste, et autres
Publié: (2023) -
Counter-examples in first-order optimization: a constructive approach
par: Goujaud, Baptiste, et autres
Publié: (2023)