MoIIE: Mixture of Intra- and Inter-Modality Experts for Large Vision Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Dianyi, Wang, Siyuan, Li, Zejun, Wang, Yikun, Li, Yitong, Tang, Duyu, Shen, Xiaoyu, Huang, Xuanjing, Wei, Zhongyu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Not All Models Suit Expert Offloading: On Local Routing Consistency of Mixture-of-Expert Models
di: Liang, Jingcong, et al.
Pubblicazione: (2025)
di: Liang, Jingcong, et al.
Pubblicazione: (2025)
Activating Distributed Visual Region within LLMs for Efficient and Effective Vision-Language Training and Inference
di: Wang, Siyuan, et al.
Pubblicazione: (2024)
di: Wang, Siyuan, et al.
Pubblicazione: (2024)
Mixture of Lookup Experts
di: Jie, Shibo, et al.
Pubblicazione: (2025)
di: Jie, Shibo, et al.
Pubblicazione: (2025)
EmbSpatial-Bench: Benchmarking Spatial Understanding for Embodied Tasks with Large Vision-Language Models
di: Du, Mengfei, et al.
Pubblicazione: (2024)
di: Du, Mengfei, et al.
Pubblicazione: (2024)
HardcoreLogic: Challenging Large Reasoning Models with Long-tail Logic Puzzle Games
di: Liang, Jingcong, et al.
Pubblicazione: (2025)
di: Liang, Jingcong, et al.
Pubblicazione: (2025)
VoCoT: Unleashing Visually Grounded Multi-Step Reasoning in Large Multi-Modal Models
di: Li, Zejun, et al.
Pubblicazione: (2024)
di: Li, Zejun, et al.
Pubblicazione: (2024)
Autoregressive Semantic Visual Reconstruction Helps VLMs Understand Better
di: Wang, Dianyi, et al.
Pubblicazione: (2025)
di: Wang, Dianyi, et al.
Pubblicazione: (2025)
DELAN: Dual-Level Alignment for Vision-and-Language Navigation by Cross-Modal Contrastive Learning
di: Du, Mengfei, et al.
Pubblicazione: (2024)
di: Du, Mengfei, et al.
Pubblicazione: (2024)
OViP: Online Vision-Language Preference Learning for VLM Hallucination
di: Liu, Shujun, et al.
Pubblicazione: (2025)
di: Liu, Shujun, et al.
Pubblicazione: (2025)
Simple o3: Towards Interleaved Vision-Language Reasoning
di: Wang, Ye, et al.
Pubblicazione: (2025)
di: Wang, Ye, et al.
Pubblicazione: (2025)
SpatialNav: Leveraging Spatial Scene Graphs for Zero-Shot Vision-and-Language Navigation
di: Zhang, Jiwen, et al.
Pubblicazione: (2026)
di: Zhang, Jiwen, et al.
Pubblicazione: (2026)
MoE-LLaVA: Mixture of Experts for Large Vision-Language Models
di: Lin, Bin, et al.
Pubblicazione: (2024)
di: Lin, Bin, et al.
Pubblicazione: (2024)
EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models
di: Jing, Linglin, et al.
Pubblicazione: (2025)
di: Jing, Linglin, et al.
Pubblicazione: (2025)
Identity-Driven Hierarchical Role-Playing Agents
di: Sun, Libo, et al.
Pubblicazione: (2024)
di: Sun, Libo, et al.
Pubblicazione: (2024)
MoE-I$^2$: Compressing Mixture of Experts Models through Inter-Expert Pruning and Intra-Expert Low-Rank Decomposition
di: Yang, Cheng, et al.
Pubblicazione: (2024)
di: Yang, Cheng, et al.
Pubblicazione: (2024)
ALaRM: Align Language Models via Hierarchical Rewards Modeling
di: Lai, Yuhang, et al.
Pubblicazione: (2024)
di: Lai, Yuhang, et al.
Pubblicazione: (2024)
MedMoE: Modality-Specialized Mixture of Experts for Medical Vision-Language Understanding
di: Chopra, Shivang, et al.
Pubblicazione: (2025)
di: Chopra, Shivang, et al.
Pubblicazione: (2025)
FourierMoE: Fourier Mixture-of-Experts Adaptation of Large Language Models
di: Jiang, Juyong, et al.
Pubblicazione: (2026)
di: Jiang, Juyong, et al.
Pubblicazione: (2026)
HyLaT: Efficient Multi-Agent Communication via Hybrid Latent-Text Protocol
di: Mou, Xinyi, et al.
Pubblicazione: (2026)
di: Mou, Xinyi, et al.
Pubblicazione: (2026)
HAF-RM: A Hybrid Alignment Framework for Reward Model Training
di: Liu, Shujun, et al.
Pubblicazione: (2024)
di: Liu, Shujun, et al.
Pubblicazione: (2024)
Fair-MoE: Fairness-Oriented Mixture of Experts in Vision-Language Models
di: Wang, Peiran, et al.
Pubblicazione: (2025)
di: Wang, Peiran, et al.
Pubblicazione: (2025)
Benchmark Self-Evolving: A Multi-Agent Framework for Dynamic LLM Evaluation
di: Wang, Siyuan, et al.
Pubblicazione: (2024)
di: Wang, Siyuan, et al.
Pubblicazione: (2024)
Synergistic Multi-Agent Framework with Trajectory Learning for Knowledge-Intensive Tasks
di: Yue, Shengbin, et al.
Pubblicazione: (2024)
di: Yue, Shengbin, et al.
Pubblicazione: (2024)
Sparse-Dense Mixture of Experts Adapter for Multi-Modal Tracking
di: Zhu, Yabin, et al.
Pubblicazione: (2026)
di: Zhu, Yabin, et al.
Pubblicazione: (2026)
MoVA: Adapting Mixture of Vision Experts to Multimodal Context
di: Zong, Zhuofan, et al.
Pubblicazione: (2024)
di: Zong, Zhuofan, et al.
Pubblicazione: (2024)
EAC-MoE: Expert-Selection Aware Compressor for Mixture-of-Experts Large Language Models
di: Chen, Yuanteng, et al.
Pubblicazione: (2025)
di: Chen, Yuanteng, et al.
Pubblicazione: (2025)
A Survey on Mixture of Experts in Large Language Models
di: Cai, Weilin, et al.
Pubblicazione: (2024)
di: Cai, Weilin, et al.
Pubblicazione: (2024)
Not All Experts are Equal: Efficient Expert Pruning and Skipping for Mixture-of-Experts Large Language Models
di: Lu, Xudong, et al.
Pubblicazione: (2024)
di: Lu, Xudong, et al.
Pubblicazione: (2024)
MoDES: Accelerating Mixture-of-Experts Multimodal Large Language Models via Dynamic Expert Skipping
di: Huang, Yushi, et al.
Pubblicazione: (2025)
di: Huang, Yushi, et al.
Pubblicazione: (2025)
AsyMoE: Leveraging Modal Asymmetry for Enhanced Expert Specialization in Large Vision-Language Models
di: Zhang, Heng, et al.
Pubblicazione: (2025)
di: Zhang, Heng, et al.
Pubblicazione: (2025)
Unveiling the Truth and Facilitating Change: Towards Agent-based Large-scale Social Movement Simulation
di: Mou, Xinyi, et al.
Pubblicazione: (2024)
di: Mou, Xinyi, et al.
Pubblicazione: (2024)
Mixture-of-Visual-Thoughts: Exploring Context-Adaptive Reasoning Mode Selection for General Visual Reasoning
di: Li, Zejun, et al.
Pubblicazione: (2025)
di: Li, Zejun, et al.
Pubblicazione: (2025)
DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts
di: Feng, Yuchen, et al.
Pubblicazione: (2025)
di: Feng, Yuchen, et al.
Pubblicazione: (2025)
MoME: Mixture of Multimodal Experts for Generalist Multimodal Large Language Models
di: Shen, Leyang, et al.
Pubblicazione: (2024)
di: Shen, Leyang, et al.
Pubblicazione: (2024)
Solving Token Gradient Conflict in Mixture-of-Experts for Large Vision-Language Model
di: Yang, Longrong, et al.
Pubblicazione: (2024)
di: Yang, Longrong, et al.
Pubblicazione: (2024)
AutoJudger: An Agent-Driven Framework for Efficient Benchmarking of MLLMs
di: Ding, Xuanwen, et al.
Pubblicazione: (2025)
di: Ding, Xuanwen, et al.
Pubblicazione: (2025)
HieraMAS: Optimizing Intra-Node LLM Mixtures and Inter-Node Topology for Multi-Agent Systems
di: Yao, Tianjun, et al.
Pubblicazione: (2026)
di: Yao, Tianjun, et al.
Pubblicazione: (2026)
AW-MoE: All-Weather Mixture of Experts for Robust Multi-Modal 3D Object Detection
di: Lin, Hongwei, et al.
Pubblicazione: (2026)
di: Lin, Hongwei, et al.
Pubblicazione: (2026)
MoE-LPR: Multilingual Extension of Large Language Models through Mixture-of-Experts with Language Priors Routing
di: Zhou, Hao, et al.
Pubblicazione: (2024)
di: Zhou, Hao, et al.
Pubblicazione: (2024)
MobileVLM: A Vision-Language Model for Better Intra- and Inter-UI Understanding
di: Wu, Qinzhuo, et al.
Pubblicazione: (2024)
di: Wu, Qinzhuo, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Not All Models Suit Expert Offloading: On Local Routing Consistency of Mixture-of-Expert Models
di: Liang, Jingcong, et al.
Pubblicazione: (2025) -
Activating Distributed Visual Region within LLMs for Efficient and Effective Vision-Language Training and Inference
di: Wang, Siyuan, et al.
Pubblicazione: (2024) -
Mixture of Lookup Experts
di: Jie, Shibo, et al.
Pubblicazione: (2025) -
EmbSpatial-Bench: Benchmarking Spatial Understanding for Embodied Tasks with Large Vision-Language Models
di: Du, Mengfei, et al.
Pubblicazione: (2024) -
HardcoreLogic: Challenging Large Reasoning Models with Long-tail Logic Puzzle Games
di: Liang, Jingcong, et al.
Pubblicazione: (2025)