FedRLHF: A Convergence-Guaranteed Federated Framework for Privacy-Preserving and Personalized RLHF
Fuente:
arXiv
Guardado en:
| Autores principales: | Fan, Flint Xiaofeng, Tan, Cheston, Ong, Yew-Soon, Wattenhofer, Roger, Ooi, Wei-Tsang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
FedAttr: Towards Privacy-preserving Client-Level Attribution in Federated LLM Fine-tuning
por: Zhang, Su, et al.
Publicado: (2026)
por: Zhang, Su, et al.
Publicado: (2026)
FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation
por: Jiang, Wenzheng, et al.
Publicado: (2025)
por: Jiang, Wenzheng, et al.
Publicado: (2025)
Vertical Federated Graph Neural Network for Recommender System
por: Mai, Peihua, et al.
Publicado: (2023)
por: Mai, Peihua, et al.
Publicado: (2023)
Hiding in Plain Sight: Disguising Data Stealing Attacks in Federated Learning
por: Garov, Kostadin, et al.
Publicado: (2023)
por: Garov, Kostadin, et al.
Publicado: (2023)
VFLAIR-LLM: A Comprehensive Framework and Benchmark for Split Learning of LLMs
por: Gu, Zixuan, et al.
Publicado: (2025)
por: Gu, Zixuan, et al.
Publicado: (2025)
Agentic-AI Healthcare: Multilingual, Privacy-First Framework with MCP Agents
por: Shehab, Mohammed A.
Publicado: (2025)
por: Shehab, Mohammed A.
Publicado: (2025)
PAC-DP: Personalized Adaptive Clipping for Differentially Private Federated Learning
por: Zhou, Hao, et al.
Publicado: (2026)
por: Zhou, Hao, et al.
Publicado: (2026)
Memory poisoning and secure multi-agent systems
por: Torra, Vicenç, et al.
Publicado: (2026)
por: Torra, Vicenç, et al.
Publicado: (2026)
Evaluating Membership Inference Attacks in heterogeneous-data setups
por: van Dartel, Bram, et al.
Publicado: (2025)
por: van Dartel, Bram, et al.
Publicado: (2025)
Terrarium: Revisiting the Blackboard for Multi-Agent Safety, Privacy, and Security Studies
por: Nakamura, Mason, et al.
Publicado: (2025)
por: Nakamura, Mason, et al.
Publicado: (2025)
FEDLAD: Federated Evaluation of Deep Leakage Attacks and Defenses
por: Baglin, Isaac, et al.
Publicado: (2024)
por: Baglin, Isaac, et al.
Publicado: (2024)
Sovereign-OS: A Charter-Governed Operating System for Autonomous AI Agents with Verifiable Fiscal Discipline
por: Yuan, Aojie, et al.
Publicado: (2026)
por: Yuan, Aojie, et al.
Publicado: (2026)
LLM Scalability Risk for Agentic-AI and Model Supply Chain Security
por: Ahi, Kiarash, et al.
Publicado: (2026)
por: Ahi, Kiarash, et al.
Publicado: (2026)
SPEAR:Exact Gradient Inversion of Batches in Federated Learning
por: Dimitrov, Dimitar I., et al.
Publicado: (2024)
por: Dimitrov, Dimitar I., et al.
Publicado: (2024)
An Efficient Learning Framework For Federated XGBoost Using Secret Sharing And Distributed Optimization
por: Xie, Lunchen, et al.
Publicado: (2021)
por: Xie, Lunchen, et al.
Publicado: (2021)
DeTrigger: A Gradient-Centric Approach to Backdoor Attack Mitigation in Federated Learning
por: Lee, Kichang, et al.
Publicado: (2024)
por: Lee, Kichang, et al.
Publicado: (2024)
Enhancing Federated Learning Convergence with Dynamic Data Queue and Data Entropy-driven Participant Selection
por: Herath, Charuka, et al.
Publicado: (2024)
por: Herath, Charuka, et al.
Publicado: (2024)
Position Paper: Rethinking Privacy in RL for Sequential Decision-making in the Age of LLMs
por: Fan, Flint Xiaofeng, et al.
Publicado: (2025)
por: Fan, Flint Xiaofeng, et al.
Publicado: (2025)
Portable Agent Memory: A Protocol for Cryptographically-Verified Memory Transfer Across Heterogeneous AI Agents
por: Ravindran, Santhosh Kumar
Publicado: (2026)
por: Ravindran, Santhosh Kumar
Publicado: (2026)
Seeing the Forest through the Trees: Data Leakage from Partial Transformer Gradients
por: Li, Weijun, et al.
Publicado: (2024)
por: Li, Weijun, et al.
Publicado: (2024)
A V2X-based Privacy Preserving Federated Measuring and Learning System
por: Alekszejenkó, Levente, et al.
Publicado: (2024)
por: Alekszejenkó, Levente, et al.
Publicado: (2024)
IntentMiner: Intent Inversion Attack via Tool Call Analysis in the Model Context Protocol
por: Yao, Yunhao, et al.
Publicado: (2025)
por: Yao, Yunhao, et al.
Publicado: (2025)
Design Principles for the Construction of a Benchmark Evaluating Security Operation Capabilities of Multi-agent AI Systems
por: Cai, Yicheng, et al.
Publicado: (2026)
por: Cai, Yicheng, et al.
Publicado: (2026)
Secure Decentralized Learning with Blockchain
por: Zhang, Xiaoxue, et al.
Publicado: (2023)
por: Zhang, Xiaoxue, et al.
Publicado: (2023)
Towards Optimal Agentic Architectures for Offensive Security Tasks
por: David, Isaac, et al.
Publicado: (2026)
por: David, Isaac, et al.
Publicado: (2026)
Prompt Fencing: A Cryptographic Approach to Establishing Security Boundaries in Large Language Model Prompts
por: Peh, Steven
Publicado: (2025)
por: Peh, Steven
Publicado: (2025)
Security Attack and Defense Strategies for Autonomous Agent Frameworks: A Layered Review with OpenClaw as a Case Study
por: Xu, Luyao, et al.
Publicado: (2026)
por: Xu, Luyao, et al.
Publicado: (2026)
FedStrategist: A Meta-Learning Framework for Adaptive and Robust Aggregation in Federated Learning
por: Haque, Md Rafid, et al.
Publicado: (2025)
por: Haque, Md Rafid, et al.
Publicado: (2025)
Hidden in Memory: Sleeper Memory Poisoning in LLM Agents
por: Pulipaka, Sidharth, et al.
Publicado: (2026)
por: Pulipaka, Sidharth, et al.
Publicado: (2026)
SPEAR++: Scaling Gradient Inversion via Sparsely-Used Dictionary Learning
por: Bakarsky, Alexander, et al.
Publicado: (2025)
por: Bakarsky, Alexander, et al.
Publicado: (2025)
XFED: Non-Collusive Model Poisoning Attack Against Byzantine-Robust Federated Classifiers
por: Mouri, Israt Jahan, et al.
Publicado: (2026)
por: Mouri, Israt Jahan, et al.
Publicado: (2026)
An Agentic Multi-Agent Architecture for Cybersecurity Risk Management
por: Gupta, Ravish, et al.
Publicado: (2026)
por: Gupta, Ravish, et al.
Publicado: (2026)
Towards trustworthy agentic AI: a comprehensive survey of safety, robustness, privacy, and system security
por: Qi, Jinhu, et al.
Publicado: (2026)
por: Qi, Jinhu, et al.
Publicado: (2026)
Securing Federated Sensitive Topic Classification against Poisoning Attacks
por: Chu, Tianyue, et al.
Publicado: (2022)
por: Chu, Tianyue, et al.
Publicado: (2022)
Depth-Dependent Indirect Prompt Injection in Tool-Calling ReAct Agents: Injection Depth, Payload Framing, and Turn-Budget Sensitivity
por: Rashidi, Mohammadreza
Publicado: (2026)
por: Rashidi, Mohammadreza
Publicado: (2026)
Owner-Harm: A Missing Threat Model for AI Agent Safety
por: Zhang, Dongcheng, et al.
Publicado: (2026)
por: Zhang, Dongcheng, et al.
Publicado: (2026)
Adversarial Feeds Steer LLM Agent Decisions Against Their Defaults
por: Usman, Rana Muhammad
Publicado: (2026)
por: Usman, Rana Muhammad
Publicado: (2026)
Information Fidelity in Tool-Using LLM Agents: A Martingale Analysis of the Model Context Protocol
por: Fan, Flint Xiaofeng, et al.
Publicado: (2026)
por: Fan, Flint Xiaofeng, et al.
Publicado: (2026)
ILION: Deterministic Pre-Execution Safety Gates for Agentic AI Systems
por: Chitan, Florin Adrian
Publicado: (2026)
por: Chitan, Florin Adrian
Publicado: (2026)
Session Risk Memory (SRM): Temporal Authorization for Deterministic Pre-Execution Safety Gates
por: Chitan, Florin Adrian
Publicado: (2026)
por: Chitan, Florin Adrian
Publicado: (2026)
Ejemplares similares
-
FedAttr: Towards Privacy-preserving Client-Level Attribution in Federated LLM Fine-tuning
por: Zhang, Su, et al.
Publicado: (2026) -
FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation
por: Jiang, Wenzheng, et al.
Publicado: (2025) -
Vertical Federated Graph Neural Network for Recommender System
por: Mai, Peihua, et al.
Publicado: (2023) -
Hiding in Plain Sight: Disguising Data Stealing Attacks in Federated Learning
por: Garov, Kostadin, et al.
Publicado: (2023) -
VFLAIR-LLM: A Comprehensive Framework and Benchmark for Split Learning of LLMs
por: Gu, Zixuan, et al.
Publicado: (2025)