ExFusion: Efficient Transformer Training via Multi-Experts Fusion
Fuente:
arXiv
Guardado en:
| Autores principales: | Ruan, Jiacheng, Dong, Daize, Qu, Xiaoye, Zhu, Tong, Liu, Ting, Fu, Yuzhuo, Cheng, Yu, Xiang, Suncheng |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
iDAT: inverse Distillation Adapter-Tuning
por: Ruan, Jiacheng, et al.
Publicado: (2024)
por: Ruan, Jiacheng, et al.
Publicado: (2024)
Understanding Robustness of Parameter-Efficient Tuning for Image Classification
por: Ruan, Jiacheng, et al.
Publicado: (2024)
por: Ruan, Jiacheng, et al.
Publicado: (2024)
Dynamic Data Mixing Maximizes Instruction Tuning for Mixture-of-Experts
por: Zhu, Tong, et al.
Publicado: (2024)
por: Zhu, Tong, et al.
Publicado: (2024)
LLaMA-MoE: Building Mixture-of-Experts from LLaMA with Continual Pre-training
por: Zhu, Tong, et al.
Publicado: (2024)
por: Zhu, Tong, et al.
Publicado: (2024)
Oceanship: A Large-Scale Dataset for Underwater Audio Target Recognition
por: Li, Zeyu, et al.
Publicado: (2024)
por: Li, Zeyu, et al.
Publicado: (2024)
LLaMA-MoE v2: Exploring Sparsity of LLaMA from Perspective of Mixture-of-Experts with Post-Training
por: Qu, Xiaoye, et al.
Publicado: (2024)
por: Qu, Xiaoye, et al.
Publicado: (2024)
VM-UNet: Vision Mamba UNet for Medical Image Segmentation
por: Ruan, Jiacheng, et al.
Publicado: (2024)
por: Ruan, Jiacheng, et al.
Publicado: (2024)
Learning Multi-axis Representation in Frequency Domain for Medical Image Segmentation
por: Ruan, Jiacheng, et al.
Publicado: (2023)
por: Ruan, Jiacheng, et al.
Publicado: (2023)
CLIP-MoE: Towards Building Mixture of Experts for CLIP with Diversified Multiplet Upcycling
por: Zhang, Jihai, et al.
Publicado: (2024)
por: Zhang, Jihai, et al.
Publicado: (2024)
BasketHAR: A Multimodal Dataset for Human Activity Recognition and Sport Analysis in Basketball Training Scenarios
por: Gao, Xian, et al.
Publicado: (2026)
por: Gao, Xian, et al.
Publicado: (2026)
Learning Collaborative Knowledge with Multimodal Representation for Polyp Re-Identification
por: Xiang, Suncheng, et al.
Publicado: (2024)
por: Xiang, Suncheng, et al.
Publicado: (2024)
BALR-SAM: Boundary-Aware Low-Rank Adaptation of SAM for Resource-Efficient Medical Image Segmentation
por: Liu, Zelin, et al.
Publicado: (2025)
por: Liu, Zelin, et al.
Publicado: (2025)
Adaptive Transformer Attention and Multi-Scale Fusion for Spine 3D Segmentation
por: Xiang, Yanlin, et al.
Publicado: (2025)
por: Xiang, Yanlin, et al.
Publicado: (2025)
MicroAUNet: Boundary-Enhanced Multi-scale Fusion with Knowledge Distillation for Colonoscopy Polyp Image Segmentation
por: Wang, Ziyi, et al.
Publicado: (2025)
por: Wang, Ziyi, et al.
Publicado: (2025)
GPF-Net: Gated Progressive Fusion Learning for Polyp Re-Identification
por: Xiang, Suncheng, et al.
Publicado: (2025)
por: Xiang, Suncheng, et al.
Publicado: (2025)
Audio Does Matter: Importance-Aware Multi-Granularity Fusion for Video Moment Retrieval
por: Lin, Junan, et al.
Publicado: (2025)
por: Lin, Junan, et al.
Publicado: (2025)
EfficienT-HDR: An Efficient Transformer-Based Framework via Multi-Exposure Fusion for HDR Reconstruction
por: Huang, Yu-Shen, et al.
Publicado: (2025)
por: Huang, Yu-Shen, et al.
Publicado: (2025)
MME-SCI: A Comprehensive and Challenging Science Benchmark for Multimodal Large Language Models
por: Ruan, Jiacheng, et al.
Publicado: (2025)
por: Ruan, Jiacheng, et al.
Publicado: (2025)
ME-Mamba: Multi-Expert Mamba with Efficient Knowledge Capture and Fusion for Multimodal Survival Analysis
por: Zhang, Chengsheng, et al.
Publicado: (2025)
por: Zhang, Chengsheng, et al.
Publicado: (2025)
Look, Compare, Decide: Alleviating Hallucination in Large Vision-Language Models via Multi-View Multi-Path Reasoning
por: Qu, Xiaoye, et al.
Publicado: (2024)
por: Qu, Xiaoye, et al.
Publicado: (2024)
Resilient Sensor Fusion under Adverse Sensor Failures via Multi-Modal Expert Fusion
por: Park, Konyul, et al.
Publicado: (2025)
por: Park, Konyul, et al.
Publicado: (2025)
Towards Stabilized and Efficient Diffusion Transformers through Long-Skip-Connections with Spectral Constraints
por: Chen, Guanjie, et al.
Publicado: (2024)
por: Chen, Guanjie, et al.
Publicado: (2024)
MoCTEFuse: Illumination-Gated Mixture of Chiral Transformer Experts for Multi-Level Infrared and Visible Image Fusion
por: Jinfu, Li, et al.
Publicado: (2025)
por: Jinfu, Li, et al.
Publicado: (2025)
Efficient Multi-Slide Visual-Language Feature Fusion for Placental Disease Classification
por: Guo, Hang, et al.
Publicado: (2025)
por: Guo, Hang, et al.
Publicado: (2025)
Reversible Efficient Diffusion for Image Fusion
por: Xu, Xingxin, et al.
Publicado: (2026)
por: Xu, Xingxin, et al.
Publicado: (2026)
Dynamic Multi-Target Fusion for Efficient Audio-Visual Navigation
por: Yu, Yinfeng, et al.
Publicado: (2025)
por: Yu, Yinfeng, et al.
Publicado: (2025)
SatFusion: A Unified Framework for Enhancing Remote Sensing Images via Multi-Frame and Multi-Source Images Fusion
por: Tong, Yufei, et al.
Publicado: (2025)
por: Tong, Yufei, et al.
Publicado: (2025)
GeminiFusion: Efficient Pixel-wise Multimodal Fusion for Vision Transformer
por: Jia, Ding, et al.
Publicado: (2024)
por: Jia, Ding, et al.
Publicado: (2024)
MM-CamObj: A Comprehensive Multimodal Dataset for Camouflaged Object Scenarios
por: Ruan, Jiacheng, et al.
Publicado: (2024)
por: Ruan, Jiacheng, et al.
Publicado: (2024)
DiffThinker: Towards Generative Multimodal Reasoning with Diffusion Models
por: He, Zefeng, et al.
Publicado: (2025)
por: He, Zefeng, et al.
Publicado: (2025)
Target-aware Bidirectional Fusion Transformer for Aerial Object Tracking
por: Sun, Xinglong, et al.
Publicado: (2025)
por: Sun, Xinglong, et al.
Publicado: (2025)
Degradation-Robust Fusion: An Efficient Degradation-Aware Diffusion Framework for Multimodal Image Fusion in Arbitrary Degradation Scenarios
por: Shi, Yu, et al.
Publicado: (2026)
por: Shi, Yu, et al.
Publicado: (2026)
Block-based Symmetric Pruning and Fusion for Efficient Vision Transformers
por: Hsieh, Yi-Kuan, et al.
Publicado: (2025)
por: Hsieh, Yi-Kuan, et al.
Publicado: (2025)
GROVER: Graph-guided Representation of Omics and Vision with Expert Regulation for Adaptive Spatial Multi-omics Fusion
por: Xiao, Yongjun, et al.
Publicado: (2025)
por: Xiao, Yongjun, et al.
Publicado: (2025)
FrameThinker: Learning to Think with Long Videos via Multi-Turn Frame Spotlighting
por: He, Zefeng, et al.
Publicado: (2025)
por: He, Zefeng, et al.
Publicado: (2025)
EIAD: Explainable Industrial Anomaly Detection Via Multi-Modal Large Language Models
por: Zhang, Zongyun, et al.
Publicado: (2025)
por: Zhang, Zongyun, et al.
Publicado: (2025)
Customized Fusion: A Closed-Loop Dynamic Network for Adaptive Multi-Task-Aware Infrared-Visible Image Fusion
por: Yang, Zengyi, et al.
Publicado: (2026)
por: Yang, Zengyi, et al.
Publicado: (2026)
FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion
por: Lu, Yu, et al.
Publicado: (2025)
por: Lu, Yu, et al.
Publicado: (2025)
Event-based Motion Deblurring via Multi-Temporal Granularity Fusion
por: Lin, Xiaopeng, et al.
Publicado: (2024)
por: Lin, Xiaopeng, et al.
Publicado: (2024)
MedCore: Boundary-Preserving Medical Core Pruning for MedSAM
por: Zhang, Cenwei, et al.
Publicado: (2026)
por: Zhang, Cenwei, et al.
Publicado: (2026)
Ejemplares similares
-
iDAT: inverse Distillation Adapter-Tuning
por: Ruan, Jiacheng, et al.
Publicado: (2024) -
Understanding Robustness of Parameter-Efficient Tuning for Image Classification
por: Ruan, Jiacheng, et al.
Publicado: (2024) -
Dynamic Data Mixing Maximizes Instruction Tuning for Mixture-of-Experts
por: Zhu, Tong, et al.
Publicado: (2024) -
LLaMA-MoE: Building Mixture-of-Experts from LLaMA with Continual Pre-training
por: Zhu, Tong, et al.
Publicado: (2024) -
Oceanship: A Large-Scale Dataset for Underwater Audio Target Recognition
por: Li, Zeyu, et al.
Publicado: (2024)