MI-Pruner: Crossmodal Mutual Information-guided Token Pruner for Efficient MLLMs
Fuente:
arXiv
Saved in:
| Main Authors: | Li, Jiameng, Tiulpin, Aleksei, Blaschko, Matthew B. |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
SoftCFG: Uncertainty-guided Stable Guidance for Visual Autoregressive Model
by: Xu, Dongli, et al.
Published: (2025)
by: Xu, Dongli, et al.
Published: (2025)
EchoPrune: Interpreting Redundancy as Temporal Echoes for Efficient VideoLLMs
by: Li, Jiameng, et al.
Published: (2026)
by: Li, Jiameng, et al.
Published: (2026)
CARE: Confidence-aware Ratio Estimation for Medical Biomarkers
by: Li, Jiameng, et al.
Published: (2025)
by: Li, Jiameng, et al.
Published: (2025)
LearnPruner: Rethinking Attention-based Token Pruning in Vision Language Models
by: Takezoe, Rinyoichi, et al.
Published: (2026)
by: Takezoe, Rinyoichi, et al.
Published: (2026)
D2Pruner: Debiased Importance and Structural Diversity for MLLM Token Pruning
by: Zhang, Evelyn, et al.
Published: (2025)
by: Zhang, Evelyn, et al.
Published: (2025)
SeGPruner: Semantic-Geometric Visual Token Pruner for 3D Question Answering
by: Li, Wenli, et al.
Published: (2026)
by: Li, Wenli, et al.
Published: (2026)
VLM-Pruner: Buffering for Spatial Sparsity in an Efficient VLM Centrifugal Token Pruning Paradigm
by: Wu, Zhenkai, et al.
Published: (2025)
by: Wu, Zhenkai, et al.
Published: (2025)
SAFE-Pruner: Semantic Attention-Guided Future-Aware Token Pruning for Efficient Vision-Language-Action Manipulation
by: Ma, Shilin, et al.
Published: (2026)
by: Ma, Shilin, et al.
Published: (2026)
Pip-Stereo: Progressive Iterations Pruner for Iterative Optimization based Stereo Matching
by: Zheng, Jintu, et al.
Published: (2026)
by: Zheng, Jintu, et al.
Published: (2026)
UPDP: A Unified Progressive Depth Pruner for CNN and Vision Transformer
by: Liu, Ji, et al.
Published: (2024)
by: Liu, Ji, et al.
Published: (2024)
MedPruner: Training-Free Hierarchical Token Pruning for Efficient 3D Medical Image Understanding in Vision-Language Models
by: Liu, Shengyuan, et al.
Published: (2026)
by: Liu, Shengyuan, et al.
Published: (2026)
DiP-GO: A Diffusion Pruner via Few-step Gradient Optimization
by: Zhu, Haowei, et al.
Published: (2024)
by: Zhu, Haowei, et al.
Published: (2024)
CLASH: A Benchmark for Cross-Modal Contradiction Detection
by: Popordanoska, Teodora, et al.
Published: (2025)
by: Popordanoska, Teodora, et al.
Published: (2025)
RCP: Representation Consistency Pruner for Mitigating Distribution Shift in Large Vision-Language Models
by: Zhang, Jianwei, et al.
Published: (2026)
by: Zhang, Jianwei, et al.
Published: (2026)
BiasPruner: Debiased Continual Learning for Medical Image Classification
by: Bayasi, Nourhan, et al.
Published: (2024)
by: Bayasi, Nourhan, et al.
Published: (2024)
AgilePruner: An Empirical Study of Attention and Diversity for Adaptive Visual Token Pruning in Large Vision-Language Models
by: Baek, Changwoo, et al.
Published: (2026)
by: Baek, Changwoo, et al.
Published: (2026)
RL-Pruner: Structured Pruning Using Reinforcement Learning for CNN Compression and Acceleration
by: Wang, Boyao, et al.
Published: (2024)
by: Wang, Boyao, et al.
Published: (2024)
freePruner: A Training-free Approach for Large Multimodal Model Acceleration
by: Xu, Bingxin, et al.
Published: (2024)
by: Xu, Bingxin, et al.
Published: (2024)
LD-Pruner: Efficient Pruning of Latent Diffusion Models using Task-Agnostic Insights
by: Castells, Thibault, et al.
Published: (2024)
by: Castells, Thibault, et al.
Published: (2024)
Separate, Dynamic and Differentiable (SMART) Pruner for Block/Output Channel Pruning on Computer Vision Tasks
by: Ding, Guanhua, et al.
Published: (2024)
by: Ding, Guanhua, et al.
Published: (2024)
SiNGR: Brain Tumor Segmentation via Signed Normalized Geodesic Transform Regression
by: Dang, Trung, et al.
Published: (2024)
by: Dang, Trung, et al.
Published: (2024)
Image-level Regression for Uncertainty-aware Retinal Image Segmentation
by: Dang, Trung, et al.
Published: (2024)
by: Dang, Trung, et al.
Published: (2024)
Predicting Knee Osteoarthritis Progression from Structural MRI using Deep Learning
by: Panfilov, Egor, et al.
Published: (2022)
by: Panfilov, Egor, et al.
Published: (2022)
AgenticPruner: MAC-Constrained Neural Network Compression via LLM-Driven Strategy Search
by: Esmat, Shahrzad, et al.
Published: (2026)
by: Esmat, Shahrzad, et al.
Published: (2026)
LoG-VMamba: Local-Global Vision Mamba for Medical Image Segmentation
by: Dang, Trung Dinh Quoc, et al.
Published: (2024)
by: Dang, Trung Dinh Quoc, et al.
Published: (2024)
VISTA: Enhancing Vision-Text Alignment in MLLMs via Cross-Modal Mutual Information Maximization
by: Li, Mingxiao, et al.
Published: (2025)
by: Li, Mingxiao, et al.
Published: (2025)
SyncVSR: Data-Efficient Visual Speech Recognition with End-to-End Crossmodal Audio Token Synchronization
by: Ahn, Young Jin, et al.
Published: (2024)
by: Ahn, Young Jin, et al.
Published: (2024)
NAB: Neural Adaptive Binning for Sparse-View CT reconstruction
by: Xie, Wangduo, et al.
Published: (2026)
by: Xie, Wangduo, et al.
Published: (2026)
QG-VTC: Question-Guided Visual Token Compression in MLLMs for Efficient VQA
by: Li, Shuai, et al.
Published: (2025)
by: Li, Shuai, et al.
Published: (2025)
Crossmodal learning for Crop Canopy Trait Estimation
by: Ayanlade, Timilehin T., et al.
Published: (2025)
by: Ayanlade, Timilehin T., et al.
Published: (2025)
[CLS] Token Tells Everything Needed for Training-free Efficient MLLMs
by: Wang, Ao, et al.
Published: (2024)
by: Wang, Ao, et al.
Published: (2024)
Multimodal Industrial Anomaly Detection by Crossmodal Feature Mapping
by: Costanzino, Alex, et al.
Published: (2023)
by: Costanzino, Alex, et al.
Published: (2023)
Improving Robustness of Deep Learning Based Knee MRI Segmentation: Mixup and Adversarial Domain Adaptation
by: Panfilov, Egor, et al.
Published: (2019)
by: Panfilov, Egor, et al.
Published: (2019)
Magic-MM-Embedding: Towards Visual-Token-Efficient Universal Multimodal Embedding with MLLMs
by: Li, Qi, et al.
Published: (2026)
by: Li, Qi, et al.
Published: (2026)
RedundancyLens: Revealing and Exploiting Visual Token Processing Redundancy for Efficient Decoder-Only MLLMs
by: Li, Hongliang, et al.
Published: (2025)
by: Li, Hongliang, et al.
Published: (2025)
Mutual Information guided Visual Contrastive Learning
by: Chen, Hanyang, et al.
Published: (2025)
by: Chen, Hanyang, et al.
Published: (2025)
Revisiting Reweighted Risk for Calibration: AURC, Focal, and Inverse Focal Loss
by: Zhou, Han, et al.
Published: (2025)
by: Zhou, Han, et al.
Published: (2025)
GauSS-MI: Gaussian Splatting Shannon Mutual Information for Active 3D Reconstruction
by: Xie, Yuhan, et al.
Published: (2025)
by: Xie, Yuhan, et al.
Published: (2025)
ReGATE: Learning Faster and Better with Fewer Tokens in MLLMs
by: Li, Chaoyu, et al.
Published: (2025)
by: Li, Chaoyu, et al.
Published: (2025)
Tuned Reverse Distillation: Enhancing Multimodal Industrial Anomaly Detection with Crossmodal Tuners
by: Liu, Xinyue, et al.
Published: (2024)
by: Liu, Xinyue, et al.
Published: (2024)
Similar Items
-
SoftCFG: Uncertainty-guided Stable Guidance for Visual Autoregressive Model
by: Xu, Dongli, et al.
Published: (2025) -
EchoPrune: Interpreting Redundancy as Temporal Echoes for Efficient VideoLLMs
by: Li, Jiameng, et al.
Published: (2026) -
CARE: Confidence-aware Ratio Estimation for Medical Biomarkers
by: Li, Jiameng, et al.
Published: (2025) -
LearnPruner: Rethinking Attention-based Token Pruning in Vision Language Models
by: Takezoe, Rinyoichi, et al.
Published: (2026) -
D2Pruner: Debiased Importance and Structural Diversity for MLLM Token Pruning
by: Zhang, Evelyn, et al.
Published: (2025)