From Sparse to Soft Mixtures of Experts
Fuente:
arXiv
Salvato in:
| Autori principali: | Puigcerver, Joan, Riquelme, Carlos, Mustafa, Basil, Houlsby, Neil |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Routers in Vision Mixture of Experts: An Empirical Study
di: Liu, Tianlin, et al.
Pubblicazione: (2024)
di: Liu, Tianlin, et al.
Pubblicazione: (2024)
Conditional Diffusion on Web-Scale Image Pairs leads to Diverse Image Variations
di: Kumar, Manoj, et al.
Pubblicazione: (2024)
di: Kumar, Manoj, et al.
Pubblicazione: (2024)
MoLEx: Mixture of Layer Experts for Finetuning with Sparse Upcycling
di: Teo, Rachel S. Y., et al.
Pubblicazione: (2025)
di: Teo, Rachel S. Y., et al.
Pubblicazione: (2025)
MomentumSMoE: Integrating Momentum into Sparse Mixture of Experts
di: Teo, Rachel S. Y., et al.
Pubblicazione: (2024)
di: Teo, Rachel S. Y., et al.
Pubblicazione: (2024)
Expert Race: A Flexible Routing Strategy for Scaling Diffusion Transformer with Mixture of Experts
di: Yuan, Yike, et al.
Pubblicazione: (2025)
di: Yuan, Yike, et al.
Pubblicazione: (2025)
Adaptive Shared Experts with LoRA-Based Mixture of Experts for Multi-Task Learning
di: Yang, Minghao, et al.
Pubblicazione: (2025)
di: Yang, Minghao, et al.
Pubblicazione: (2025)
Mixture of Nested Experts: Adaptive Processing of Visual Tokens
di: Jain, Gagan, et al.
Pubblicazione: (2024)
di: Jain, Gagan, et al.
Pubblicazione: (2024)
Soft Task-Aware Routing of Experts for Equivariant Representation Learning
di: Jeon, Jaebyeong, et al.
Pubblicazione: (2025)
di: Jeon, Jaebyeong, et al.
Pubblicazione: (2025)
Co-Supervised Learning: Improving Weak-to-Strong Generalization with Hierarchical Mixture of Experts
di: Liu, Yuejiang, et al.
Pubblicazione: (2024)
di: Liu, Yuejiang, et al.
Pubblicazione: (2024)
MoSE: Skill-by-Skill Mixture-of-Experts Learning for Embodied Autonomous Machines
di: Xu, Lu, et al.
Pubblicazione: (2025)
di: Xu, Lu, et al.
Pubblicazione: (2025)
PA-Net: Precipitation-Adaptive Mixture-of-Experts for Long-Tail Rainfall Nowcasting
di: Xiao, Xinyu, et al.
Pubblicazione: (2026)
di: Xiao, Xinyu, et al.
Pubblicazione: (2026)
MoQE: Improve Quantization Model performance via Mixture of Quantization Experts
di: Zhang, Jinhao, et al.
Pubblicazione: (2025)
di: Zhang, Jinhao, et al.
Pubblicazione: (2025)
I2MoE: Interpretable Multimodal Interaction-aware Mixture-of-Experts
di: Xin, Jiayi, et al.
Pubblicazione: (2025)
di: Xin, Jiayi, et al.
Pubblicazione: (2025)
MoEIoU: Rethinking Bounding-Box Regression as a Mixture of Experts
di: Edula, Vinay, et al.
Pubblicazione: (2026)
di: Edula, Vinay, et al.
Pubblicazione: (2026)
SPADE: Spatial Transcriptomics and Pathology Alignment Using a Mixture of Data Experts for an Expressive Latent Space
di: Redekop, Ekaterina, et al.
Pubblicazione: (2025)
di: Redekop, Ekaterina, et al.
Pubblicazione: (2025)
MoLE: Enhancing Human-centric Text-to-image Diffusion via Mixture of Low-rank Experts
di: Zhu, Jie, et al.
Pubblicazione: (2024)
di: Zhu, Jie, et al.
Pubblicazione: (2024)
BioFact-MoE: Biologically Factorized Mixture of Experts for Vision-Language Prognostic Modeling in Hepatocellular Carcinoma
di: Yang, Junlin, et al.
Pubblicazione: (2026)
di: Yang, Junlin, et al.
Pubblicazione: (2026)
Parameter-Efficient Quantized Mixture-of-Experts Meets Vision-Language Instruction Tuning for Semiconductor Electron Micrograph Analysis
di: Srinivas, Sakhinana Sagar, et al.
Pubblicazione: (2024)
di: Srinivas, Sakhinana Sagar, et al.
Pubblicazione: (2024)
CP-MoE: Consistency-Preserving Mixture-of-Experts for Continual Learning
di: Liu, Yang, et al.
Pubblicazione: (2026)
di: Liu, Yang, et al.
Pubblicazione: (2026)
MoPE: Mixture of Prompt Experts for Parameter-Efficient and Scalable Multimodal Fusion
di: Jiang, Ruixiang, et al.
Pubblicazione: (2024)
di: Jiang, Ruixiang, et al.
Pubblicazione: (2024)
GC-MoE: Genomics-Guided Cell-Type-Specific Mixture of Experts for Histology-Based Single-Cell Spatial Transcriptomics
di: Shiku, Kaito, et al.
Pubblicazione: (2026)
di: Shiku, Kaito, et al.
Pubblicazione: (2026)
Multi-level Mixture of Experts for Multimodal Entity Linking
di: Hu, Zhiwei, et al.
Pubblicazione: (2025)
di: Hu, Zhiwei, et al.
Pubblicazione: (2025)
Double-Stage Feature-Level Clustering-Based Mixture of Experts Framework
di: Badjie, Bakary, et al.
Pubblicazione: (2025)
di: Badjie, Bakary, et al.
Pubblicazione: (2025)
PaliGemma: A versatile 3B VLM for transfer
di: Beyer, Lucas, et al.
Pubblicazione: (2024)
di: Beyer, Lucas, et al.
Pubblicazione: (2024)
XAI for Skin Cancer Detection with Prototypes and Non-Expert Supervision
di: Correia, Miguel, et al.
Pubblicazione: (2024)
di: Correia, Miguel, et al.
Pubblicazione: (2024)
SparseSwin: Swin Transformer with Sparse Transformer Block
di: Pinasthika, Krisna, et al.
Pubblicazione: (2023)
di: Pinasthika, Krisna, et al.
Pubblicazione: (2023)
SoftPQ: Robust Instance Segmentation Evaluation via Soft Matching and Tunable Thresholds
di: Karmakar, Ranit, et al.
Pubblicazione: (2025)
di: Karmakar, Ranit, et al.
Pubblicazione: (2025)
SAME: Learning Generic Language-Guided Visual Navigation with State-Adaptive Mixture of Experts
di: Zhou, Gengze, et al.
Pubblicazione: (2024)
di: Zhou, Gengze, et al.
Pubblicazione: (2024)
Soft-Di[M]O: Improving One-Step Discrete Image Generation with Soft Embeddings
di: Zhu, Yuanzhi, et al.
Pubblicazione: (2025)
di: Zhu, Yuanzhi, et al.
Pubblicazione: (2025)
MEGAN: Mixture of Experts for Robust Uncertainty Estimation in Endoscopy Videos
di: Agbelese, Damola, et al.
Pubblicazione: (2025)
di: Agbelese, Damola, et al.
Pubblicazione: (2025)
EvidenceMoE: A Physics-Guided Mixture-of-Experts with Evidential Critics for Advancing Fluorescence Light Detection and Ranging in Scattering Media
di: Erbas, Ismail, et al.
Pubblicazione: (2025)
di: Erbas, Ismail, et al.
Pubblicazione: (2025)
Soft-TransFormers for Continual Learning
di: Kang, Haeyong, et al.
Pubblicazione: (2024)
di: Kang, Haeyong, et al.
Pubblicazione: (2024)
Robust Experts: the Effect of Adversarial Training on CNNs with Sparse Mixture-of-Experts Layers
di: Pavlitska, Svetlana, et al.
Pubblicazione: (2025)
di: Pavlitska, Svetlana, et al.
Pubblicazione: (2025)
Sparse-vDiT: Unleashing the Power of Sparse Attention to Accelerate Video Diffusion Transformers
di: Chen, Pengtao, et al.
Pubblicazione: (2025)
di: Chen, Pengtao, et al.
Pubblicazione: (2025)
Object-Centric Learning with Slot Mixture Module
di: Kirilenko, Daniil, et al.
Pubblicazione: (2023)
di: Kirilenko, Daniil, et al.
Pubblicazione: (2023)
PSReg: Prior-guided Sparse Mixture of Experts for Point Cloud Registration
di: Huang, Xiaoshui, et al.
Pubblicazione: (2025)
di: Huang, Xiaoshui, et al.
Pubblicazione: (2025)
Interpreting CLIP with Hierarchical Sparse Autoencoders
di: Zaigrajew, Vladimir, et al.
Pubblicazione: (2025)
di: Zaigrajew, Vladimir, et al.
Pubblicazione: (2025)
SoftPatch: Unsupervised Anomaly Detection with Noisy Data
di: Jiang, Xi, et al.
Pubblicazione: (2024)
di: Jiang, Xi, et al.
Pubblicazione: (2024)
Fast Graph Neural Network for Image Classification
di: Gharasuie, Mustafa Mohammadi, et al.
Pubblicazione: (2025)
di: Gharasuie, Mustafa Mohammadi, et al.
Pubblicazione: (2025)
Ortho-Hydra: Orthogonalized Experts for DiT LoRA
di: Ji, Seunghyun
Pubblicazione: (2026)
di: Ji, Seunghyun
Pubblicazione: (2026)
Documenti analoghi
-
Routers in Vision Mixture of Experts: An Empirical Study
di: Liu, Tianlin, et al.
Pubblicazione: (2024) -
Conditional Diffusion on Web-Scale Image Pairs leads to Diverse Image Variations
di: Kumar, Manoj, et al.
Pubblicazione: (2024) -
MoLEx: Mixture of Layer Experts for Finetuning with Sparse Upcycling
di: Teo, Rachel S. Y., et al.
Pubblicazione: (2025) -
MomentumSMoE: Integrating Momentum into Sparse Mixture of Experts
di: Teo, Rachel S. Y., et al.
Pubblicazione: (2024) -
Expert Race: A Flexible Routing Strategy for Scaling Diffusion Transformer with Mixture of Experts
di: Yuan, Yike, et al.
Pubblicazione: (2025)