FedPOB: Sample-Efficient Federated Prompt Optimization via Bandits
Fuente:
arXiv
Guardado en:
| Autores principales: | Lu, Pingchen, Hong, Zhi, Shang, Zhiwei, Wang, Zhiyong, Ban, Yikun, Shu, Yao, Zhang, Min, Qiu, Shuang, Dai, Zhongxiang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Linear and Neural Dueling Bandits with Delayed Feedback
por: Wang, Xiangyi, et al.
Publicado: (2026)
por: Wang, Xiangyi, et al.
Publicado: (2026)
MASPOB: Bandit-Based Prompt Optimization for Multi-Agent Systems with Graph Neural Networks
por: Hong, Zhi, et al.
Publicado: (2026)
por: Hong, Zhi, et al.
Publicado: (2026)
T-POP: Test-Time Personalization with Online Preference Feedback
por: Qu, Zikun, et al.
Publicado: (2025)
por: Qu, Zikun, et al.
Publicado: (2025)
Meta-Prompt Optimization for LLM-Based Sequential Decision Making
por: Kong, Mingze, et al.
Publicado: (2025)
por: Kong, Mingze, et al.
Publicado: (2025)
Federated Linear Dueling Bandits
por: Huang, Xuhan, et al.
Publicado: (2025)
por: Huang, Xuhan, et al.
Publicado: (2025)
Adaptive Batch-Wise Sample Scheduling for Direct Preference Optimization
por: Huang, Zixuan, et al.
Publicado: (2025)
por: Huang, Zixuan, et al.
Publicado: (2025)
Workflow-R1: Group Sub-sequence Policy Optimization for Multi-turn Workflow Construction
por: Kong, Mingze, et al.
Publicado: (2026)
por: Kong, Mingze, et al.
Publicado: (2026)
Self-Reflective Generation at Test Time
por: Mu, Jian, et al.
Publicado: (2025)
por: Mu, Jian, et al.
Publicado: (2025)
Neural Exploitation and Exploration of Contextual Bandits
por: Ban, Yikun, et al.
Publicado: (2023)
por: Ban, Yikun, et al.
Publicado: (2023)
Prompt Optimization with EASE? Efficient Ordering-aware Automated Selection of Exemplars
por: Wu, Zhaoxuan, et al.
Publicado: (2024)
por: Wu, Zhaoxuan, et al.
Publicado: (2024)
Refining Adaptive Zeroth-Order Optimization at Ease
por: Shu, Yao, et al.
Publicado: (2025)
por: Shu, Yao, et al.
Publicado: (2025)
Meta Clustering of Neural Bandits
por: Ban, Yikun, et al.
Publicado: (2024)
por: Ban, Yikun, et al.
Publicado: (2024)
Large Language Model-Enhanced Multi-Armed Bandits
por: Sun, Jiahang, et al.
Publicado: (2025)
por: Sun, Jiahang, et al.
Publicado: (2025)
Online Clustering of Dueling Bandits
por: Wang, Zhiyong, et al.
Publicado: (2025)
por: Wang, Zhiyong, et al.
Publicado: (2025)
Why Zeroth-Order Adaptation May Forget Less: A Randomized Shaping Theory
por: Shu, Yao, et al.
Publicado: (2026)
por: Shu, Yao, et al.
Publicado: (2026)
FedConPE: Efficient Federated Conversational Bandits with Heterogeneous Clients
por: Li, Zhuohua, et al.
Publicado: (2024)
por: Li, Zhuohua, et al.
Publicado: (2024)
FedLion: Faster Adaptive Federated Optimization with Fewer Communication
por: Tang, Zhiwei, et al.
Publicado: (2024)
por: Tang, Zhiwei, et al.
Publicado: (2024)
Localized Zeroth-Order Prompt Optimization
por: Hu, Wenyang, et al.
Publicado: (2024)
por: Hu, Wenyang, et al.
Publicado: (2024)
AutoFed: Personalized Federated Traffic Prediction via Adaptive Prompt
por: Zhao, Zijian, et al.
Publicado: (2025)
por: Zhao, Zijian, et al.
Publicado: (2025)
Neural Dueling Bandits: Preference-Based Optimization with Human Feedback
por: Verma, Arun, et al.
Publicado: (2024)
por: Verma, Arun, et al.
Publicado: (2024)
Sample Complexity of Identifying the Nonredundancy of Nontransitive Games in Dueling Bandits
por: Lu, Shang, et al.
Publicado: (2025)
por: Lu, Shang, et al.
Publicado: (2025)
Neural Active Learning Beyond Bandits
por: Ban, Yikun, et al.
Publicado: (2024)
por: Ban, Yikun, et al.
Publicado: (2024)
FedMPT: Federated Multi-label Prompt Tuning of Vision-Language Models
por: Wang, Xucong, et al.
Publicado: (2026)
por: Wang, Xucong, et al.
Publicado: (2026)
ActiveDPO: Active Direct Preference Optimization for Sample-Efficient Alignment
por: Lin, Xiaoqiang, et al.
Publicado: (2025)
por: Lin, Xiaoqiang, et al.
Publicado: (2025)
Fed-BAC: Federated Bandit-Guided Additive Clustering in Hierarchical Federated Learning
por: Bashir, Satwat, et al.
Publicado: (2026)
por: Bashir, Satwat, et al.
Publicado: (2026)
PageRank Bandits for Link Prediction
por: Ban, Yikun, et al.
Publicado: (2024)
por: Ban, Yikun, et al.
Publicado: (2024)
Prompt Optimization with Human Feedback
por: Lin, Xiaoqiang, et al.
Publicado: (2024)
por: Lin, Xiaoqiang, et al.
Publicado: (2024)
FedHPL: Efficient Heterogeneous Federated Learning with Prompt Tuning and Logit Distillation
por: Ma, Yuting, et al.
Publicado: (2024)
por: Ma, Yuting, et al.
Publicado: (2024)
Contextual Rollout Bandits for Reinforcement Learning with Verifiable Rewards
por: Lu, Xiaodong, et al.
Publicado: (2026)
por: Lu, Xiaodong, et al.
Publicado: (2026)
Federated Contextual Cascading Bandits with Asynchronous Communication and Heterogeneous Users
por: Yang, Hantao, et al.
Publicado: (2024)
por: Yang, Hantao, et al.
Publicado: (2024)
FedDEAP: Adaptive Dual-Prompt Tuning for Multi-Domain Federated Learning
por: Zheng, Yubin, et al.
Publicado: (2025)
por: Zheng, Yubin, et al.
Publicado: (2025)
FedAdamW: A Communication-Efficient Optimizer with Convergence and Generalization Guarantees for Federated Large Models
por: Liu, Junkang, et al.
Publicado: (2025)
por: Liu, Junkang, et al.
Publicado: (2025)
FedZMG: Efficient Client-Side Optimization in Federated Learning
por: Zantalis, Fotios, et al.
Publicado: (2026)
por: Zantalis, Fotios, et al.
Publicado: (2026)
Efficient Multi-objective Prompt Optimization via Pure-exploration Bandits
por: Li, Donghao, et al.
Publicado: (2026)
por: Li, Donghao, et al.
Publicado: (2026)
FedRTS: Federated Robust Pruning via Combinatorial Thompson Sampling
por: Huang, Hong, et al.
Publicado: (2025)
por: Huang, Hong, et al.
Publicado: (2025)
Prompt Optimization with Logged Bandit Data
por: Kiyohara, Haruka, et al.
Publicado: (2025)
por: Kiyohara, Haruka, et al.
Publicado: (2025)
FedDPG: An Adaptive Yet Efficient Prompt-tuning Approach in Federated Learning Settings
por: Shakeri, Ali, et al.
Publicado: (2025)
por: Shakeri, Ali, et al.
Publicado: (2025)
FedOne: Query-Efficient Federated Learning for Black-box Discrete Prompt Learning
por: Wang, Ganyu, et al.
Publicado: (2025)
por: Wang, Ganyu, et al.
Publicado: (2025)
FedSTaS: Client Stratification and Client Level Sampling for Efficient Federated Learning
por: Slessor, Jordan, et al.
Publicado: (2024)
por: Slessor, Jordan, et al.
Publicado: (2024)
Active Human Feedback Collection via Neural Contextual Dueling Bandits
por: Verma, Arun, et al.
Publicado: (2025)
por: Verma, Arun, et al.
Publicado: (2025)
Ejemplares similares
-
Linear and Neural Dueling Bandits with Delayed Feedback
por: Wang, Xiangyi, et al.
Publicado: (2026) -
MASPOB: Bandit-Based Prompt Optimization for Multi-Agent Systems with Graph Neural Networks
por: Hong, Zhi, et al.
Publicado: (2026) -
T-POP: Test-Time Personalization with Online Preference Feedback
por: Qu, Zikun, et al.
Publicado: (2025) -
Meta-Prompt Optimization for LLM-Based Sequential Decision Making
por: Kong, Mingze, et al.
Publicado: (2025) -
Federated Linear Dueling Bandits
por: Huang, Xuhan, et al.
Publicado: (2025)