MPM: Mutual Pair Merging for Efficient Vision Transformers
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ravé, Simon, Rasti, Pejman, Rousseau, David |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Unlocking Zero-Shot Plant Segmentation with Pl@ntNet Intelligence
par: Ravé, Simon, et autres
Publié: (2025)
par: Ravé, Simon, et autres
Publié: (2025)
FREE-Merging: Fourier Transform for Efficient Model Merging
par: Zheng, Shenghe, et autres
Publié: (2024)
par: Zheng, Shenghe, et autres
Publié: (2024)
Brain-Inspired Stepwise Patch Merging for Vision Transformers
par: Yu, Yonghao, et autres
Publié: (2024)
par: Yu, Yonghao, et autres
Publié: (2024)
ALGM: Adaptive Local-then-Global Token Merging for Efficient Semantic Segmentation with Plain Vision Transformers
par: Norouzi, Narges, et autres
Publié: (2024)
par: Norouzi, Narges, et autres
Publié: (2024)
Learning to Merge Tokens via Decoupled Embedding for Efficient Vision Transformers
par: Lee, Dong Hoon, et autres
Publié: (2024)
par: Lee, Dong Hoon, et autres
Publié: (2024)
Convolutional Initialization for Data-Efficient Vision Transformers
par: Zheng, Jianqiao, et autres
Publié: (2024)
par: Zheng, Jianqiao, et autres
Publié: (2024)
DORA: Dynamic Online Reinforcement Agent for Token Merging in Vision Transformers
par: He, Kaixuan, et autres
Publié: (2026)
par: He, Kaixuan, et autres
Publié: (2026)
Lossless Token Merging Even Without Fine-Tuning in Vision Transformers
par: Lee, Jaeyeon, et autres
Publié: (2025)
par: Lee, Jaeyeon, et autres
Publié: (2025)
Intra-task Mutual Attention based Vision Transformer for Few-Shot Learning
par: Jiang, Weihao, et autres
Publié: (2024)
par: Jiang, Weihao, et autres
Publié: (2024)
Towards Efficient Vision State Space Models via Token Merging
par: Park, Jinyoung, et autres
Publié: (2025)
par: Park, Jinyoung, et autres
Publié: (2025)
Efficient Visual Transformer by Learnable Token Merging
par: Wang, Yancheng, et autres
Publié: (2024)
par: Wang, Yancheng, et autres
Publié: (2024)
Continual Self-Supervised Learning with Masked Autoencoders in Remote Sensing
par: Möllenbrok, Lars, et autres
Publié: (2025)
par: Möllenbrok, Lars, et autres
Publié: (2025)
A Plasticity-Aware Method for Continual Self-Supervised Learning in Remote Sensing
par: Möllenbrok, Lars, et autres
Publié: (2025)
par: Möllenbrok, Lars, et autres
Publié: (2025)
RobustMerge: Parameter-Efficient Model Merging for MLLMs with Direction Robustness
par: Zeng, Fanhu, et autres
Publié: (2025)
par: Zeng, Fanhu, et autres
Publié: (2025)
MPM: A Unified 2D-3D Human Pose Representation via Masked Pose Modeling
par: Zhang, Zhenyu, et autres
Publié: (2023)
par: Zhang, Zhenyu, et autres
Publié: (2023)
Structured Initialization for Vision Transformers
par: Zheng, Jianqiao, et autres
Publié: (2025)
par: Zheng, Jianqiao, et autres
Publié: (2025)
Structured Initialization for Attention in Vision Transformers
par: Zheng, Jianqiao, et autres
Publié: (2024)
par: Zheng, Jianqiao, et autres
Publié: (2024)
HyCoT: A Transformer-Based Autoencoder for Hyperspectral Image Compression
par: Fuchs, Martin Hermann Paul, et autres
Publié: (2024)
par: Fuchs, Martin Hermann Paul, et autres
Publié: (2024)
GFM4MPM: Towards Geospatial Foundation Models for Mineral Prospectivity Mapping
par: Daruna, Angel, et autres
Publié: (2024)
par: Daruna, Angel, et autres
Publié: (2024)
MR-MLLM: Mutual Reinforcement of Multimodal Comprehension and Vision Perception
par: Wang, Guanqun, et autres
Publié: (2024)
par: Wang, Guanqun, et autres
Publié: (2024)
HyVIC: A Metric-Driven Spatio-Spectral Hyperspectral Image Compression Architecture Based on Variational Autoencoders
par: Fuchs, Martin Hermann Paul, et autres
Publié: (2026)
par: Fuchs, Martin Hermann Paul, et autres
Publié: (2026)
Multi-Tailed Vision Transformer for Efficient Inference
par: Wang, Yunke, et autres
Publié: (2022)
par: Wang, Yunke, et autres
Publié: (2022)
Adjustable Spatio-Spectral Hyperspectral Image Compression Network
par: Fuchs, Martin Hermann Paul, et autres
Publié: (2025)
par: Fuchs, Martin Hermann Paul, et autres
Publié: (2025)
Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning
par: Zhong, Hanwen, et autres
Publié: (2025)
par: Zhong, Hanwen, et autres
Publié: (2025)
Parameter-Efficient Interventions for Enhanced Model Merging
par: Osial, Marcin, et autres
Publié: (2024)
par: Osial, Marcin, et autres
Publié: (2024)
big.LITTLE Vision Transformer for Efficient Visual Recognition
par: Guo, He, et autres
Publié: (2024)
par: Guo, He, et autres
Publié: (2024)
Multi-Attribute Vision Transformers are Efficient and Robust Learners
par: Gani, Hanan, et autres
Publié: (2024)
par: Gani, Hanan, et autres
Publié: (2024)
EA-ViT: Efficient Adaptation for Elastic Vision Transformer
par: Zhu, Chen, et autres
Publié: (2025)
par: Zhu, Chen, et autres
Publié: (2025)
PPT: Token Pruning and Pooling for Efficient Vision Transformers
par: Wu, Xinjian, et autres
Publié: (2023)
par: Wu, Xinjian, et autres
Publié: (2023)
Parameter-Efficient and Memory-Efficient Tuning for Vision Transformer: A Disentangled Approach
par: Zhang, Taolin, et autres
Publié: (2024)
par: Zhang, Taolin, et autres
Publié: (2024)
PADRe: A Unifying Polynomial Attention Drop-in Replacement for Efficient Vision Transformer
par: Letourneau, Pierre-David, et autres
Publié: (2024)
par: Letourneau, Pierre-David, et autres
Publié: (2024)
FTerViT: Fully Ternary Vision Transformer
par: Ruciński, Szymon, et autres
Publié: (2026)
par: Ruciński, Szymon, et autres
Publié: (2026)
Multi-modal Mutual-Guidance Conditional Prompt Learning for Vision-Language Models
par: Yang, Shijun, et autres
Publié: (2025)
par: Yang, Shijun, et autres
Publié: (2025)
Token-Space Mask Prediction for Efficient Vision Transformer Segmentation
par: Galagain, Calvin, et autres
Publié: (2026)
par: Galagain, Calvin, et autres
Publié: (2026)
Efficient Spatio-Temporal Vegetation Pixel Classification with Vision Transformers
par: Gomes, Alan, et autres
Publié: (2026)
par: Gomes, Alan, et autres
Publié: (2026)
ToSA: Token Selective Attention for Efficient Vision Transformers
par: Singh, Manish Kumar, et autres
Publié: (2024)
par: Singh, Manish Kumar, et autres
Publié: (2024)
Artifacts and Attention Sinks: Structured Approximations for Efficient Vision Transformers
par: Lu, Andrew, et autres
Publié: (2025)
par: Lu, Andrew, et autres
Publié: (2025)
Adaptively Bypassing Vision Transformer Blocks for Efficient Visual Tracking
par: Yang, Xiangyang, et autres
Publié: (2024)
par: Yang, Xiangyang, et autres
Publié: (2024)
S2AFormer: Strip Self-Attention for Efficient Vision Transformer
par: Xu, Guoan, et autres
Publié: (2025)
par: Xu, Guoan, et autres
Publié: (2025)
Centroid-centered Modeling for Efficient Vision Transformer Pre-training
par: Yan, Xin, et autres
Publié: (2023)
par: Yan, Xin, et autres
Publié: (2023)
Documents similaires
-
Unlocking Zero-Shot Plant Segmentation with Pl@ntNet Intelligence
par: Ravé, Simon, et autres
Publié: (2025) -
FREE-Merging: Fourier Transform for Efficient Model Merging
par: Zheng, Shenghe, et autres
Publié: (2024) -
Brain-Inspired Stepwise Patch Merging for Vision Transformers
par: Yu, Yonghao, et autres
Publié: (2024) -
ALGM: Adaptive Local-then-Global Token Merging for Efficient Semantic Segmentation with Plain Vision Transformers
par: Norouzi, Narges, et autres
Publié: (2024) -
Learning to Merge Tokens via Decoupled Embedding for Efficient Vision Transformers
par: Lee, Dong Hoon, et autres
Publié: (2024)