Token-Level Prompt Mixture with Parameter-Free Routing for Federated Domain Generalization
Fuente:
arXiv
Salvato in:
| Autori principali: | Gong, Shuai, Cui, Chaoran, Dong, Xiaolin, Nie, Xiushan, Zhu, Lei, Chang, Xiaojun |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Federated Domain Generalization via Prompt Learning and Aggregation
di: Gong, Shuai, et al.
Pubblicazione: (2024)
di: Gong, Shuai, et al.
Pubblicazione: (2024)
Routing-Free Mixture-of-Experts
di: Liu, Yilun, et al.
Pubblicazione: (2026)
di: Liu, Yilun, et al.
Pubblicazione: (2026)
PERFT: Parameter-Efficient Routed Fine-Tuning for Mixture-of-Expert Model
di: Liu, Yilun, et al.
Pubblicazione: (2024)
di: Liu, Yilun, et al.
Pubblicazione: (2024)
Post-Training is About States, Not Tokens: A State Distribution View of SFT, RL, and On-Policy Distillation
di: Nie, Dong
Pubblicazione: (2026)
di: Nie, Dong
Pubblicazione: (2026)
Parameter-Efficient Routed Fine-Tuning: Mixture-of-Experts Demands Mixture of Adaptation Modules
di: Liu, Yilun, et al.
Pubblicazione: (2025)
di: Liu, Yilun, et al.
Pubblicazione: (2025)
Prompt Learning for Generalized Vehicle Routing
di: Liu, Fei, et al.
Pubblicazione: (2024)
di: Liu, Fei, et al.
Pubblicazione: (2024)
Token-Level LLM Collaboration via FusionRoute
di: Xiong, Nuoya, et al.
Pubblicazione: (2026)
di: Xiong, Nuoya, et al.
Pubblicazione: (2026)
Efficient Training of Large-Scale AI Models Through Federated Mixture-of-Experts: A System-Level Approach
di: Chen, Xiaobing, et al.
Pubblicazione: (2025)
di: Chen, Xiaobing, et al.
Pubblicazione: (2025)
TimeDP: Learning to Generate Multi-Domain Time Series with Domain Prompts
di: Huang, Yu-Hao, et al.
Pubblicazione: (2025)
di: Huang, Yu-Hao, et al.
Pubblicazione: (2025)
HiLoRA: Adaptive Hierarchical LoRA Routing for Training-Free Domain Generalization
di: Han, Ziyi, et al.
Pubblicazione: (2025)
di: Han, Ziyi, et al.
Pubblicazione: (2025)
Parameter-Efficient Token Embedding Editing for Clinical Class-Level Unlearning
di: Hou, Iyad Ait, et al.
Pubblicazione: (2026)
di: Hou, Iyad Ait, et al.
Pubblicazione: (2026)
ProToken: Token-Level Attribution for Federated Large Language Models
di: Gill, Waris, et al.
Pubblicazione: (2026)
di: Gill, Waris, et al.
Pubblicazione: (2026)
Routing Mamba: Scaling State Space Models with Mixture-of-Experts Projection
di: Zhan, Zheng, et al.
Pubblicazione: (2025)
di: Zhan, Zheng, et al.
Pubblicazione: (2025)
RouteHijack: Routing-Aware Attack on Mixture-of-Experts LLMs
di: Xu, Zhiyuan, et al.
Pubblicazione: (2026)
di: Xu, Zhiyuan, et al.
Pubblicazione: (2026)
PM-MOE: Mixture of Experts on Private Model Parameters for Personalized Federated Learning
di: Feng, Yu, et al.
Pubblicazione: (2025)
di: Feng, Yu, et al.
Pubblicazione: (2025)
Towards Generalization-Oriented Models for Vehicle Routing Problems with Mixture-of-Experts
di: Miao, Changhao, et al.
Pubblicazione: (2026)
di: Miao, Changhao, et al.
Pubblicazione: (2026)
Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies
di: Fan, Junchao, et al.
Pubblicazione: (2025)
di: Fan, Junchao, et al.
Pubblicazione: (2025)
Input Domain Aware MoE: Decoupling Routing Decisions from Task Optimization in Mixture of Experts
di: Hua, Yongxiang, et al.
Pubblicazione: (2025)
di: Hua, Yongxiang, et al.
Pubblicazione: (2025)
DRAGD: A Federated Unlearning Data Reconstruction Attack Based on Gradient Differences
di: Ju, Bocheng, et al.
Pubblicazione: (2025)
di: Ju, Bocheng, et al.
Pubblicazione: (2025)
NExT-Guard: Training-Free Streaming Safeguard without Token-Level Labels
di: Fang, Junfeng, et al.
Pubblicazione: (2026)
di: Fang, Junfeng, et al.
Pubblicazione: (2026)
Geometric Mixture-of-Experts with Curvature-Guided Adaptive Routing for Graph Representation Learning
di: Cao, Haifang, et al.
Pubblicazione: (2026)
di: Cao, Haifang, et al.
Pubblicazione: (2026)
Erase then Rectify: A Training-Free Parameter Editing Approach for Cost-Effective Graph Unlearning
di: Yang, Zhe-Rui, et al.
Pubblicazione: (2024)
di: Yang, Zhe-Rui, et al.
Pubblicazione: (2024)
On Token's Dilemma: Dynamic MoE with Drift-Aware Token Assignment for Continual Learning of Large Vision Language Models
di: Zhao, Chongyang, et al.
Pubblicazione: (2026)
di: Zhao, Chongyang, et al.
Pubblicazione: (2026)
Federated Domain Generalization: A Survey
di: Li, Ying, et al.
Pubblicazione: (2023)
di: Li, Ying, et al.
Pubblicazione: (2023)
Multilingual Routing in Mixture-of-Experts
di: Bandarkar, Lucas, et al.
Pubblicazione: (2025)
di: Bandarkar, Lucas, et al.
Pubblicazione: (2025)
Route Experts by Sequence, not by Token
di: Wen, Tiansheng, et al.
Pubblicazione: (2025)
di: Wen, Tiansheng, et al.
Pubblicazione: (2025)
Neural Inhibition Improves Dynamic Routing and Mixture of Experts
di: Zou, Will Y., et al.
Pubblicazione: (2025)
di: Zou, Will Y., et al.
Pubblicazione: (2025)
Learning to Reason with Mixture of Tokens
di: Jain, Adit, et al.
Pubblicazione: (2025)
di: Jain, Adit, et al.
Pubblicazione: (2025)
Training Free Guided Flow Matching with Optimal Control
di: Wang, Luran, et al.
Pubblicazione: (2024)
di: Wang, Luran, et al.
Pubblicazione: (2024)
CITER: Collaborative Inference for Efficient Large Language Model Decoding with Token-Level Routing
di: Zheng, Wenhao, et al.
Pubblicazione: (2025)
di: Zheng, Wenhao, et al.
Pubblicazione: (2025)
DynaMoE: Dynamic Token-Level Expert Activation with Layer-Wise Adaptive Capacity for Mixture-of-Experts Neural Networks
di: Gülmez, Gökdeniz
Pubblicazione: (2026)
di: Gülmez, Gökdeniz
Pubblicazione: (2026)
One Node Per User: Node-Level Federated Learning for Graph Neural Networks
di: Gao, Zhidong, et al.
Pubblicazione: (2024)
di: Gao, Zhidong, et al.
Pubblicazione: (2024)
Mixture of Masters: Sparse Chess Language Models with Player Routing
di: Frisoni, Giacomo, et al.
Pubblicazione: (2026)
di: Frisoni, Giacomo, et al.
Pubblicazione: (2026)
ProbMoE: Differentiable Probabilistic Routing for Mixture-of-Experts
di: Zhao, Heng, et al.
Pubblicazione: (2026)
di: Zhao, Heng, et al.
Pubblicazione: (2026)
Learning to Route LLMs with Confidence Tokens
di: Chuang, Yu-Neng, et al.
Pubblicazione: (2024)
di: Chuang, Yu-Neng, et al.
Pubblicazione: (2024)
Adaptive Computation Depth via Learned Token Routing in Transformers
di: Mohammed, Ahmed Abdelmuniem Abdalla
Pubblicazione: (2026)
di: Mohammed, Ahmed Abdelmuniem Abdalla
Pubblicazione: (2026)
Soft-to-Hard Routing in Sparse Mixture-of-Experts Models
di: Rastegar, Reza
Pubblicazione: (2026)
di: Rastegar, Reza
Pubblicazione: (2026)
MVMoE: Multi-Task Vehicle Routing Solver with Mixture-of-Experts
di: Zhou, Jianan, et al.
Pubblicazione: (2024)
di: Zhou, Jianan, et al.
Pubblicazione: (2024)
DiPrompT: Disentangled Prompt Tuning for Multiple Latent Domain Generalization in Federated Learning
di: Bai, Sikai, et al.
Pubblicazione: (2024)
di: Bai, Sikai, et al.
Pubblicazione: (2024)
The Illusion of Specialization: Unveiling the Domain-Invariant "Standing Committee" in Mixture-of-Experts Models
di: Wang, Yan, et al.
Pubblicazione: (2026)
di: Wang, Yan, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Federated Domain Generalization via Prompt Learning and Aggregation
di: Gong, Shuai, et al.
Pubblicazione: (2024) -
Routing-Free Mixture-of-Experts
di: Liu, Yilun, et al.
Pubblicazione: (2026) -
PERFT: Parameter-Efficient Routed Fine-Tuning for Mixture-of-Expert Model
di: Liu, Yilun, et al.
Pubblicazione: (2024) -
Post-Training is About States, Not Tokens: A State Distribution View of SFT, RL, and On-Policy Distillation
di: Nie, Dong
Pubblicazione: (2026) -
Parameter-Efficient Routed Fine-Tuning: Mixture-of-Experts Demands Mixture of Adaptation Modules
di: Liu, Yilun, et al.
Pubblicazione: (2025)