Federated UCBVI: Communication-Efficient Federated Regret Minimization with Heterogeneous Agents
Fuente:
arXiv
Salvato in:
| Autori principali: | Labbi, Safwan, Tiapkin, Daniil, Mancini, Lorenzo, Mangold, Paul, Moulines, Eric |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
On Global Convergence Rates for Federated Softmax Policy Gradient under Heterogeneous Environments
di: Labbi, Safwan, et al.
Pubblicazione: (2025)
di: Labbi, Safwan, et al.
Pubblicazione: (2025)
Refined Analysis of Entropy-Regularized Actor-Critic
di: Labbi, Safwan, et al.
Pubblicazione: (2026)
di: Labbi, Safwan, et al.
Pubblicazione: (2026)
Beyond Softmax and Entropy: Convergence Rates of Policy Gradients with f-SoftArgmax Parameterization & Coupled Regularization
di: Labbi, Safwan, et al.
Pubblicazione: (2026)
di: Labbi, Safwan, et al.
Pubblicazione: (2026)
SCAFFLSA: Taming Heterogeneity in Federated Linear Stochastic Approximation and TD Learning
di: Mangold, Paul, et al.
Pubblicazione: (2024)
di: Mangold, Paul, et al.
Pubblicazione: (2024)
Convergence Guarantees for Federated SARSA with Local Training and Heterogeneous Agents
di: Mangold, Paul, et al.
Pubblicazione: (2025)
di: Mangold, Paul, et al.
Pubblicazione: (2025)
Joint Channel Selection using FedDRL in V2X
di: Mancini, Lorenzo, et al.
Pubblicazione: (2024)
di: Mancini, Lorenzo, et al.
Pubblicazione: (2024)
Finite-Sample Convergence Bounds for Trust Region Policy Optimization in Mean-Field Games
di: Ocello, Antonio, et al.
Pubblicazione: (2025)
di: Ocello, Antonio, et al.
Pubblicazione: (2025)
Refined Analysis of Federated Averaging and Federated Richardson-Romberg
di: Mangold, Paul, et al.
Pubblicazione: (2024)
di: Mangold, Paul, et al.
Pubblicazione: (2024)
Gaussian Approximation and Multiplier Bootstrap for Federated Linear Stochastic Approximation
di: Levin, Ilya, et al.
Pubblicazione: (2026)
di: Levin, Ilya, et al.
Pubblicazione: (2026)
Improved High-Probability Bounds for the Temporal Difference Learning Algorithm via Exponential Stability
di: Samsonov, Sergey, et al.
Pubblicazione: (2023)
di: Samsonov, Sergey, et al.
Pubblicazione: (2023)
Scaffold with Stochastic Gradients: New Analysis with Linear Speed-Up
di: Mangold, Paul, et al.
Pubblicazione: (2025)
di: Mangold, Paul, et al.
Pubblicazione: (2025)
A Refined Analysis of UCBVI
di: Drago, Simone, et al.
Pubblicazione: (2025)
di: Drago, Simone, et al.
Pubblicazione: (2025)
Proximal Point Nash Learning from Human Feedback
di: Tiapkin, Daniil, et al.
Pubblicazione: (2025)
di: Tiapkin, Daniil, et al.
Pubblicazione: (2025)
Demonstration-Regularized RL
di: Tiapkin, Daniil, et al.
Pubblicazione: (2023)
di: Tiapkin, Daniil, et al.
Pubblicazione: (2023)
Incentivized Learning in Principal-Agent Bandit Games
di: Scheid, Antoine, et al.
Pubblicazione: (2024)
di: Scheid, Antoine, et al.
Pubblicazione: (2024)
Narrowing the Gap between Adversarial and Stochastic MDPs via Policy Optimization
di: Tiapkin, Daniil, et al.
Pubblicazione: (2024)
di: Tiapkin, Daniil, et al.
Pubblicazione: (2024)
Model-free Posterior Sampling via Learning Rate Randomization
di: Tiapkin, Daniil, et al.
Pubblicazione: (2023)
di: Tiapkin, Daniil, et al.
Pubblicazione: (2023)
Queuing dynamics of asynchronous Federated Learning
di: Leconte, Louis, et al.
Pubblicazione: (2024)
di: Leconte, Louis, et al.
Pubblicazione: (2024)
Communication-Efficient Federated Learning with Adaptive Number of Participants
di: Skorik, Sergey, et al.
Pubblicazione: (2025)
di: Skorik, Sergey, et al.
Pubblicazione: (2025)
Communication-Efficient Federated Learning With Data and Client Heterogeneity
di: Zakerinia, Hossein, et al.
Pubblicazione: (2022)
di: Zakerinia, Hossein, et al.
Pubblicazione: (2022)
Optimizing Backward Policies in GFlowNets via Trajectory Likelihood Maximization
di: Gritsaev, Timofei, et al.
Pubblicazione: (2024)
di: Gritsaev, Timofei, et al.
Pubblicazione: (2024)
Revisiting Non-Acyclic GFlowNets in Discrete Environments
di: Morozov, Nikita, et al.
Pubblicazione: (2025)
di: Morozov, Nikita, et al.
Pubblicazione: (2025)
Generative Flow Networks as Entropy-Regularized RL
di: Tiapkin, Daniil, et al.
Pubblicazione: (2023)
di: Tiapkin, Daniil, et al.
Pubblicazione: (2023)
Federated Q-Learning: Linear Regret Speedup with Low Communication Cost
di: Zheng, Zhong, et al.
Pubblicazione: (2023)
di: Zheng, Zhong, et al.
Pubblicazione: (2023)
Learning Shortest Paths with Generative Flow Networks
di: Morozov, Nikita, et al.
Pubblicazione: (2026)
di: Morozov, Nikita, et al.
Pubblicazione: (2026)
Regret and Sample Complexity of Online Q-Learning via Concentration of Stochastic Approximation with Time-Inhomogeneous Markov Chains
di: Singh, Rahul, et al.
Pubblicazione: (2026)
di: Singh, Rahul, et al.
Pubblicazione: (2026)
Adaptive Set-Mass Calibration with Conformal Prediction
di: Kazantsev, Daniil, et al.
Pubblicazione: (2025)
di: Kazantsev, Daniil, et al.
Pubblicazione: (2025)
Communication Efficient Federated Learning with Linear Convergence on Heterogeneous Data
di: Liu, Jie, et al.
Pubblicazione: (2025)
di: Liu, Jie, et al.
Pubblicazione: (2025)
Personalized Federated Learning by Energy-Efficient UAV Communications
di: Guo, Shiqian, et al.
Pubblicazione: (2026)
di: Guo, Shiqian, et al.
Pubblicazione: (2026)
Optimizing Asynchronous Federated Learning: A Delicate Trade-Off Between Model-Parameter Staleness and Update Frequency
di: Alahyane, Abdelkrim, et al.
Pubblicazione: (2025)
di: Alahyane, Abdelkrim, et al.
Pubblicazione: (2025)
Efficient Swap Regret Minimization in Combinatorial Bandits
di: Kontogiannis, Andreas, et al.
Pubblicazione: (2026)
di: Kontogiannis, Andreas, et al.
Pubblicazione: (2026)
Regret-Optimal Q-Learning with Low Cost for Single-Agent and Federated Reinforcement Learning
di: Zhang, Haochen, et al.
Pubblicazione: (2025)
di: Zhang, Haochen, et al.
Pubblicazione: (2025)
Adaptive Self-Distillation for Minimizing Client Drift in Heterogeneous Federated Learning
di: Yashwanth, M, et al.
Pubblicazione: (2023)
di: Yashwanth, M, et al.
Pubblicazione: (2023)
Federated Q-Learning with Reference-Advantage Decomposition: Almost Optimal Regret and Logarithmic Communication Cost
di: Zheng, Zhong, et al.
Pubblicazione: (2024)
di: Zheng, Zhong, et al.
Pubblicazione: (2024)
Improving GFlowNets with Monte Carlo Tree Search
di: Morozov, Nikita, et al.
Pubblicazione: (2024)
di: Morozov, Nikita, et al.
Pubblicazione: (2024)
Efficient Conformal Prediction under Data Heterogeneity
di: Plassier, Vincent, et al.
Pubblicazione: (2023)
di: Plassier, Vincent, et al.
Pubblicazione: (2023)
Communication-Efficient Gluon in Federated Learning
di: Qian, Xun, et al.
Pubblicazione: (2026)
di: Qian, Xun, et al.
Pubblicazione: (2026)
Memory-adaptive Depth-wise Heterogeneous Federated Learning
di: Zhang, Kai, et al.
Pubblicazione: (2023)
di: Zhang, Kai, et al.
Pubblicazione: (2023)
Regret-Based Federated Causal Discovery with Unknown Interventions
di: Baldo, Federico, et al.
Pubblicazione: (2025)
di: Baldo, Federico, et al.
Pubblicazione: (2025)
Communication-Efficient Heterogeneous Federated Learning with Generalized Heavy-Ball Momentum
di: Zaccone, Riccardo, et al.
Pubblicazione: (2023)
di: Zaccone, Riccardo, et al.
Pubblicazione: (2023)
Documenti analoghi
-
On Global Convergence Rates for Federated Softmax Policy Gradient under Heterogeneous Environments
di: Labbi, Safwan, et al.
Pubblicazione: (2025) -
Refined Analysis of Entropy-Regularized Actor-Critic
di: Labbi, Safwan, et al.
Pubblicazione: (2026) -
Beyond Softmax and Entropy: Convergence Rates of Policy Gradients with f-SoftArgmax Parameterization & Coupled Regularization
di: Labbi, Safwan, et al.
Pubblicazione: (2026) -
SCAFFLSA: Taming Heterogeneity in Federated Linear Stochastic Approximation and TD Learning
di: Mangold, Paul, et al.
Pubblicazione: (2024) -
Convergence Guarantees for Federated SARSA with Local Training and Heterogeneous Agents
di: Mangold, Paul, et al.
Pubblicazione: (2025)