Mixture of Group Experts for Learning Invariant Representations
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kang, Lei, Li, Jia, Tian, Mi, Huang, Hua |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Mixture of Experts Made Personalized: Federated Prompt Learning for Vision-Language Models
par: Luo, Jun, et autres
Publié: (2024)
par: Luo, Jun, et autres
Publié: (2024)
LiME: Lightweight Mixture of Experts for Efficient Multimodal Multi-task Learning
par: Kowsher, Md, et autres
Publié: (2026)
par: Kowsher, Md, et autres
Publié: (2026)
CP-MoE: Consistency-Preserving Mixture-of-Experts for Continual Learning
par: Liu, Yang, et autres
Publié: (2026)
par: Liu, Yang, et autres
Publié: (2026)
Multi-level Mixture of Experts for Multimodal Entity Linking
par: Hu, Zhiwei, et autres
Publié: (2025)
par: Hu, Zhiwei, et autres
Publié: (2025)
MoLEx: Mixture of Layer Experts for Finetuning with Sparse Upcycling
par: Teo, Rachel S. Y., et autres
Publié: (2025)
par: Teo, Rachel S. Y., et autres
Publié: (2025)
MomentumSMoE: Integrating Momentum into Sparse Mixture of Experts
par: Teo, Rachel S. Y., et autres
Publié: (2024)
par: Teo, Rachel S. Y., et autres
Publié: (2024)
URRL-IMVC: Unified and Robust Representation Learning for Incomplete Multi-View Clustering
par: Teng, Ge, et autres
Publié: (2024)
par: Teng, Ge, et autres
Publié: (2024)
Cross-View Graph Consistency Learning for Invariant Graph Representations
par: Chen, Jie, et autres
Publié: (2023)
par: Chen, Jie, et autres
Publié: (2023)
SAME: Learning Generic Language-Guided Visual Navigation with State-Adaptive Mixture of Experts
par: Zhou, Gengze, et autres
Publié: (2024)
par: Zhou, Gengze, et autres
Publié: (2024)
MoPE: Mixture of Prompt Experts for Parameter-Efficient and Scalable Multimodal Fusion
par: Jiang, Ruixiang, et autres
Publié: (2024)
par: Jiang, Ruixiang, et autres
Publié: (2024)
MoDoMoDo: Multi-Domain Data Mixtures for Multimodal LLM Reinforcement Learning
par: Liang, Yiqing, et autres
Publié: (2025)
par: Liang, Yiqing, et autres
Publié: (2025)
Hyperbolic Multimodal Representation Learning for Biological Taxonomies
par: Gong, ZeMing, et autres
Publié: (2025)
par: Gong, ZeMing, et autres
Publié: (2025)
Verbalized Representation Learning for Interpretable Few-Shot Generalization
par: Yang, Cheng-Fu, et autres
Publié: (2024)
par: Yang, Cheng-Fu, et autres
Publié: (2024)
T-MARS: Improving Visual Representations by Circumventing Text Feature Learning
par: Maini, Pratyush, et autres
Publié: (2023)
par: Maini, Pratyush, et autres
Publié: (2023)
Stable Routing for Mixture-of-Experts in Class-Incremental Learning
par: Guo, Zirui, et autres
Publié: (2026)
par: Guo, Zirui, et autres
Publié: (2026)
MOFI: Learning Image Representations from Noisy Entity Annotated Images
par: Wu, Wentao, et autres
Publié: (2023)
par: Wu, Wentao, et autres
Publié: (2023)
MoPD: Mixture-of-Prompts Distillation for Vision-Language Models
par: Chen, Yang, et autres
Publié: (2024)
par: Chen, Yang, et autres
Publié: (2024)
BridgeTower: Building Bridges Between Encoders in Vision-Language Representation Learning
par: Xu, Xiao, et autres
Publié: (2022)
par: Xu, Xiao, et autres
Publié: (2022)
Rethinking Weight Decay for Robust Fine-Tuning of Foundation Models
par: Tian, Junjiao, et autres
Publié: (2024)
par: Tian, Junjiao, et autres
Publié: (2024)
Maximizing Information in Domain-Invariant Representation Improves Transfer Learning
par: Li, Adrian Shuai, et autres
Publié: (2023)
par: Li, Adrian Shuai, et autres
Publié: (2023)
MedXpertQA: Benchmarking Expert-Level Medical Reasoning and Understanding
par: Zuo, Yuxin, et autres
Publié: (2025)
par: Zuo, Yuxin, et autres
Publié: (2025)
Scaling Up Temporal Domain Generalization via Temporal Experts Averaging
par: Liu, Aoming, et autres
Publié: (2025)
par: Liu, Aoming, et autres
Publié: (2025)
MemLoRA: Distilling Expert Adapters for On-Device Memory Systems
par: Bini, Massimo, et autres
Publié: (2025)
par: Bini, Massimo, et autres
Publié: (2025)
Multilinear Mixture of Experts: Scalable Expert Specialization through Factorization
par: Oldfield, James, et autres
Publié: (2024)
par: Oldfield, James, et autres
Publié: (2024)
Manager: Aggregating Insights from Unimodal Experts in Two-Tower VLMs and MLLMs
par: Xu, Xiao, et autres
Publié: (2025)
par: Xu, Xiao, et autres
Publié: (2025)
BEEM: Boosting Performance of Early Exit DNNs using Multi-Exit Classifiers as Experts
par: Bajpai, Divya Jyoti, et autres
Publié: (2025)
par: Bajpai, Divya Jyoti, et autres
Publié: (2025)
Learning to Think in Physics: Breaking Shortcut Learning in Scientific Diffusion via Representation Alignment
par: Jia, Haozhe, et autres
Publié: (2026)
par: Jia, Haozhe, et autres
Publié: (2026)
EMoE: Eigenbasis-Guided Routing for Mixture-of-Experts
par: Cheng, Anzhe, et autres
Publié: (2026)
par: Cheng, Anzhe, et autres
Publié: (2026)
SELMA: Learning and Merging Skill-Specific Text-to-Image Experts with Auto-Generated Data
par: Li, Jialu, et autres
Publié: (2024)
par: Li, Jialu, et autres
Publié: (2024)
MoDE: CLIP Data Experts via Clustering
par: Ma, Jiawei, et autres
Publié: (2024)
par: Ma, Jiawei, et autres
Publié: (2024)
COD: Learning Conditional Invariant Representation for Domain Adaptation Regression
par: Yang, Hao-Ran, et autres
Publié: (2024)
par: Yang, Hao-Ran, et autres
Publié: (2024)
FocalLens: Instruction Tuning Enables Zero-Shot Conditional Image Representations
par: Hsieh, Cheng-Yu, et autres
Publié: (2025)
par: Hsieh, Cheng-Yu, et autres
Publié: (2025)
Video Relationship Detection Using Mixture of Experts
par: Shaabana, Ala, et autres
Publié: (2024)
par: Shaabana, Ala, et autres
Publié: (2024)
Scaling Continual Learning to 300+ Tasks with Bi-Level Routing Mixture-of-Experts
par: Lou, Meng, et autres
Publié: (2026)
par: Lou, Meng, et autres
Publié: (2026)
RADAR: Relative Angular Divergence Across Representations
par: Cadet, Xavier, et autres
Publié: (2026)
par: Cadet, Xavier, et autres
Publié: (2026)
Robust Experts: the Effect of Adversarial Training on CNNs with Sparse Mixture-of-Experts Layers
par: Pavlitska, Svetlana, et autres
Publié: (2025)
par: Pavlitska, Svetlana, et autres
Publié: (2025)
MoEGCL: Mixture of Ego-Graphs Contrastive Representation Learning for Multi-View Clustering
par: Zhu, Jian, et autres
Publié: (2025)
par: Zhu, Jian, et autres
Publié: (2025)
How Do Vision-Language Models Process Conflicting Information Across Modalities?
par: Hua, Tianze, et autres
Publié: (2025)
par: Hua, Tianze, et autres
Publié: (2025)
Similarity-Dissimilarity Loss for Multi-label Supervised Contrastive Learning
par: Huang, Guangming, et autres
Publié: (2024)
par: Huang, Guangming, et autres
Publié: (2024)
Vision-Language Models Create Cross-Modal Task Representations
par: Luo, Grace, et autres
Publié: (2024)
par: Luo, Grace, et autres
Publié: (2024)
Documents similaires
-
Mixture of Experts Made Personalized: Federated Prompt Learning for Vision-Language Models
par: Luo, Jun, et autres
Publié: (2024) -
LiME: Lightweight Mixture of Experts for Efficient Multimodal Multi-task Learning
par: Kowsher, Md, et autres
Publié: (2026) -
CP-MoE: Consistency-Preserving Mixture-of-Experts for Continual Learning
par: Liu, Yang, et autres
Publié: (2026) -
Multi-level Mixture of Experts for Multimodal Entity Linking
par: Hu, Zhiwei, et autres
Publié: (2025) -
MoLEx: Mixture of Layer Experts for Finetuning with Sparse Upcycling
par: Teo, Rachel S. Y., et autres
Publié: (2025)