FedGRPO: Privately Optimizing Foundation Models with Group-Relative Rewards from Domain Client
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhu, Gongxi, Gu, Hanlin, Fan, Lixin, Yang, Qiang, Han, Yuxing |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
FedMIA: An Effective Membership Inference Attack Exploiting "All for One" Principle in Federated Learning
di: Zhu, Gongxi, et al.
Pubblicazione: (2024)
di: Zhu, Gongxi, et al.
Pubblicazione: (2024)
A Theoretical Analysis of Efficiency Constrained Utility-Privacy Bi-Objective Optimization in Federated Learning
di: Gu, Hanlin, et al.
Pubblicazione: (2023)
di: Gu, Hanlin, et al.
Pubblicazione: (2023)
Unlearning during Learning: An Efficient Federated Machine Unlearning Method
di: Gu, Hanlin, et al.
Pubblicazione: (2024)
di: Gu, Hanlin, et al.
Pubblicazione: (2024)
Disentangling data distribution for Federated Learning
di: Zhao, Xinyuan, et al.
Pubblicazione: (2024)
di: Zhao, Xinyuan, et al.
Pubblicazione: (2024)
Grounding Foundation Models through Federated Transfer Learning: A General Framework
di: Kang, Yan, et al.
Pubblicazione: (2023)
di: Kang, Yan, et al.
Pubblicazione: (2023)
FedTracker: Furnishing Ownership Verification and Traceability for Federated Learning Model
di: Shao, Shuo, et al.
Pubblicazione: (2022)
di: Shao, Shuo, et al.
Pubblicazione: (2022)
MO-GRPO: Mitigating Reward Hacking of Group Relative Policy Optimization on Multi-Objective Problems
di: Ichihara, Yuki, et al.
Pubblicazione: (2025)
di: Ichihara, Yuki, et al.
Pubblicazione: (2025)
Large-Small Model Collaborative Framework for Federated Continual Learning
di: Yu, Hao, et al.
Pubblicazione: (2025)
di: Yu, Hao, et al.
Pubblicazione: (2025)
FedDAPL: Toward Client-Private Generalization in Federated Learning
di: Loaliyan, Soroosh Safari, et al.
Pubblicazione: (2025)
di: Loaliyan, Soroosh Safari, et al.
Pubblicazione: (2025)
Ferrari: Federated Feature Unlearning via Optimizing Feature Sensitivity
di: Gu, Hanlin, et al.
Pubblicazione: (2024)
di: Gu, Hanlin, et al.
Pubblicazione: (2024)
FedAdOb: Privacy-Preserving Federated Deep Learning with Adaptive Obfuscation
di: Gu, Hanlin, et al.
Pubblicazione: (2024)
di: Gu, Hanlin, et al.
Pubblicazione: (2024)
UDM-GRPO: Stable and Efficient Group Relative Policy Optimization for Uniform Discrete Diffusion Models
di: Wang, Jiaqi, et al.
Pubblicazione: (2026)
di: Wang, Jiaqi, et al.
Pubblicazione: (2026)
FedConv: A Learning-on-Model Paradigm for Heterogeneous Federated Clients
di: Shen, Leming, et al.
Pubblicazione: (2025)
di: Shen, Leming, et al.
Pubblicazione: (2025)
F-GRPO: Factorized Group-Relative Policy Optimization for Unified Candidate Generation and Ranking
di: Surana, Rohan, et al.
Pubblicazione: (2026)
di: Surana, Rohan, et al.
Pubblicazione: (2026)
Latent-GRPO: Group Relative Policy Optimization for Latent Reasoning
di: Deng, Jingcheng, et al.
Pubblicazione: (2026)
di: Deng, Jingcheng, et al.
Pubblicazione: (2026)
FedEval-LLM: Federated Evaluation of Large Language Models on Downstream Tasks with Collective Wisdom
di: He, Yuanqin, et al.
Pubblicazione: (2024)
di: He, Yuanqin, et al.
Pubblicazione: (2024)
Co-GRPO: Co-Optimized Group Relative Policy Optimization for Masked Diffusion Model
di: Zhou, Renping, et al.
Pubblicazione: (2025)
di: Zhou, Renping, et al.
Pubblicazione: (2025)
FedMOA: Federated GRPO for Personalized Reasoning LLMs under Heterogeneous Rewards
di: Wang, Ziyao, et al.
Pubblicazione: (2026)
di: Wang, Ziyao, et al.
Pubblicazione: (2026)
Scaf-GRPO: Scaffolded Group Relative Policy Optimization for Enhancing LLM Reasoning
di: Zhang, Xichen, et al.
Pubblicazione: (2025)
di: Zhang, Xichen, et al.
Pubblicazione: (2025)
WS-GRPO: Weakly-Supervised Group-Relative Policy Optimization for Rollout-Efficient Reasoning
di: Mundada, Gagan, et al.
Pubblicazione: (2026)
di: Mundada, Gagan, et al.
Pubblicazione: (2026)
EP-GRPO: Entropy-Progress Aligned Group Relative Policy Optimization with Implicit Process Guidance
di: Yu, Song, et al.
Pubblicazione: (2026)
di: Yu, Song, et al.
Pubblicazione: (2026)
GRPO-VPS: Enhancing Group Relative Policy Optimization with Verifiable Process Supervision for Effective Reasoning
di: Wang, Jingyi, et al.
Pubblicazione: (2026)
di: Wang, Jingyi, et al.
Pubblicazione: (2026)
AceGRPO: Adaptive Curriculum Enhanced Group Relative Policy Optimization for Autonomous Machine Learning Engineering
di: Cai, Yuzhu, et al.
Pubblicazione: (2026)
di: Cai, Yuzhu, et al.
Pubblicazione: (2026)
GRPO is Secretly a Process Reward Model
di: Sullivan, Michael, et al.
Pubblicazione: (2025)
di: Sullivan, Michael, et al.
Pubblicazione: (2025)
FedProxy: Federated Fine-Tuning of LLMs via Proxy SLMs and Heterogeneity-Aware Fusion
di: Fan, Tao, et al.
Pubblicazione: (2026)
di: Fan, Tao, et al.
Pubblicazione: (2026)
Gradient Starvation in Binary-Reward GRPO: Why Group-Mean Centering Fails and Why the Simplest Fix Works
di: Nie, Wenhua, et al.
Pubblicazione: (2026)
di: Nie, Wenhua, et al.
Pubblicazione: (2026)
CoDistill-GRPO: A Co-Distillation Recipe for Efficient Group Relative Policy Optimization
di: Kwon, Soo Min, et al.
Pubblicazione: (2026)
di: Kwon, Soo Min, et al.
Pubblicazione: (2026)
FedCCRL: Federated Domain Generalization with Cross-Client Representation Learning
di: Wang, Xinpeng, et al.
Pubblicazione: (2024)
di: Wang, Xinpeng, et al.
Pubblicazione: (2024)
MC-GRPO: Median-Centered Group Relative Policy Optimization for Small-Rollout Reinforcement Learning
di: Kim, Youngeun
Pubblicazione: (2026)
di: Kim, Youngeun
Pubblicazione: (2026)
FedZMG: Efficient Client-Side Optimization in Federated Learning
di: Zantalis, Fotios, et al.
Pubblicazione: (2026)
di: Zantalis, Fotios, et al.
Pubblicazione: (2026)
GRAPH-GRPO-LEX: Contract Graph Modeling and Reinforcement Learning with Group Relative Policy Optimization
di: Dechtiar, Moriya, et al.
Pubblicazione: (2025)
di: Dechtiar, Moriya, et al.
Pubblicazione: (2025)
dFlowGRPO: Rate-Aware Policy Optimization for Discrete Flow Models
di: Wan, Zhengyan, et al.
Pubblicazione: (2026)
di: Wan, Zhengyan, et al.
Pubblicazione: (2026)
Rewarding the Unlikely: Lifting GRPO Beyond Distribution Sharpening
di: He, Andre, et al.
Pubblicazione: (2025)
di: He, Andre, et al.
Pubblicazione: (2025)
Handling Spatial-Temporal Data Heterogeneity for Federated Continual Learning via Tail Anchor
di: Yu, Hao, et al.
Pubblicazione: (2024)
di: Yu, Hao, et al.
Pubblicazione: (2024)
FedRG: Unleashing the Representation Geometry for Federated Learning with Noisy Clients
di: Wen, Tian, et al.
Pubblicazione: (2026)
di: Wen, Tian, et al.
Pubblicazione: (2026)
FedAWA: Adaptive Optimization of Aggregation Weights in Federated Learning Using Client Vectors
di: Shi, Changlong, et al.
Pubblicazione: (2025)
di: Shi, Changlong, et al.
Pubblicazione: (2025)
IB-GRPO: Aligning LLM-based Learning Path Recommendation with Educational Objectives via Indicator-Based Group Relative Policy Optimization
di: Wang, Shuai, et al.
Pubblicazione: (2026)
di: Wang, Shuai, et al.
Pubblicazione: (2026)
GIFT: Group-Relative Implicit Fine-Tuning Integrates GRPO with DPO and UNA
di: Wang, Zhichao
Pubblicazione: (2025)
di: Wang, Zhichao
Pubblicazione: (2025)
Scaling Reward Modeling without Human Supervision
di: Fan, Jingxuan, et al.
Pubblicazione: (2026)
di: Fan, Jingxuan, et al.
Pubblicazione: (2026)
FedOUI: OUI-Guided Client Weighting for Federated Aggregation
di: Fernández-Hernández, Alberto, et al.
Pubblicazione: (2026)
di: Fernández-Hernández, Alberto, et al.
Pubblicazione: (2026)
Documenti analoghi
-
FedMIA: An Effective Membership Inference Attack Exploiting "All for One" Principle in Federated Learning
di: Zhu, Gongxi, et al.
Pubblicazione: (2024) -
A Theoretical Analysis of Efficiency Constrained Utility-Privacy Bi-Objective Optimization in Federated Learning
di: Gu, Hanlin, et al.
Pubblicazione: (2023) -
Unlearning during Learning: An Efficient Federated Machine Unlearning Method
di: Gu, Hanlin, et al.
Pubblicazione: (2024) -
Disentangling data distribution for Federated Learning
di: Zhao, Xinyuan, et al.
Pubblicazione: (2024) -
Grounding Foundation Models through Federated Transfer Learning: A General Framework
di: Kang, Yan, et al.
Pubblicazione: (2023)