TinyDrop: Tiny Model Guided Token Dropping for Vision Transformers
Fuente:
arXiv
Saved in:
| Main Authors: | Wang, Guoxin, Wang, Qingyuan, Huang, Binhua, Chen, Shaowu, John, Deepu |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
HiRED: Attention-Guided Token Dropping for Efficient Inference of High-Resolution Vision-Language Models
by: Arif, Kazi Hasan Ibn, et al.
Published: (2024)
by: Arif, Kazi Hasan Ibn, et al.
Published: (2024)
Optimal Brain Connection: Towards Efficient Structural Pruning
by: Chen, Shaowu, et al.
Published: (2025)
by: Chen, Shaowu, et al.
Published: (2025)
MoCrop: Training Free Motion Guided Cropping for Efficient Video Action Recognition
by: Huang, Binhua, et al.
Published: (2025)
by: Huang, Binhua, et al.
Published: (2025)
Tiny-Engram: Trigger-Indexed Concept Tables for Generative Vision
by: Cai, Runyuan, et al.
Published: (2026)
by: Cai, Runyuan, et al.
Published: (2026)
Heterogeneous Graph Transformer for Multiple Tiny Object Tracking in RGB-T Videos
by: Xu, Qingyu, et al.
Published: (2024)
by: Xu, Qingyu, et al.
Published: (2024)
TinyFusion: Diffusion Transformers Learned Shallow
by: Fang, Gongfan, et al.
Published: (2024)
by: Fang, Gongfan, et al.
Published: (2024)
StreamTinyNet: video streaming analysis with spatial-temporal TinyML
by: Shalby, Hazem Hesham Yousef, et al.
Published: (2024)
by: Shalby, Hazem Hesham Yousef, et al.
Published: (2024)
Tiny-ViT: A Compact Vision Transformer for Efficient and Explainable Potato Leaf Disease Classification
by: Mia, Shakil, et al.
Published: (2026)
by: Mia, Shakil, et al.
Published: (2026)
TinyFormer: Preserving Tiny Objects in YOLO-DETR Hybrid Real-time Detectors
by: Hsieh, Jun-Wei, et al.
Published: (2026)
by: Hsieh, Jun-Wei, et al.
Published: (2026)
Variation-aware Vision Token Dropping for Faster Large Vision-Language Models
by: Chen, Junjie, et al.
Published: (2025)
by: Chen, Junjie, et al.
Published: (2025)
TinyLVLM-eHub: Towards Comprehensive and Efficient Evaluation for Large Vision-Language Models
by: Shao, Wenqi, et al.
Published: (2023)
by: Shao, Wenqi, et al.
Published: (2023)
Tiny Machine Learning: Progress and Futures
by: Lin, Ji, et al.
Published: (2024)
by: Lin, Ji, et al.
Published: (2024)
AttentionDrop: A Novel Regularization Method for Transformer Models
by: Baig, Mirza Samad Ahmed, et al.
Published: (2025)
by: Baig, Mirza Samad Ahmed, et al.
Published: (2025)
Grounding-Aware Token Pruning: Recovering from Drastic Performance Drops in Visual Grounding Caused by Pruning
by: Chien, Tzu-Chun, et al.
Published: (2025)
by: Chien, Tzu-Chun, et al.
Published: (2025)
Noise-Robust Tiny Object Localization with Flows
by: Sun, Huixin, et al.
Published: (2026)
by: Sun, Huixin, et al.
Published: (2026)
EvRainDrop: HyperGraph-guided Completion for Effective Frame and Event Stream Aggregation
by: Wang, Futian, et al.
Published: (2025)
by: Wang, Futian, et al.
Published: (2025)
ORXE: Orchestrating Experts for Dynamically Configurable Efficiency
by: Wang, Qingyuan, et al.
Published: (2025)
by: Wang, Qingyuan, et al.
Published: (2025)
SAM-Sode: Towards Faithful Explanations for Tiny Bacteria Detection
by: Tan, Wanying, et al.
Published: (2026)
by: Tan, Wanying, et al.
Published: (2026)
Wake Vision: A Tailored Dataset and Benchmark Suite for TinyML Computer Vision Applications
by: Banbury, Colby, et al.
Published: (2024)
by: Banbury, Colby, et al.
Published: (2024)
LogTinyLLM: Tiny Large Language Models Based Contextual Log Anomaly Detection
by: Ocansey, Isaiah Thompson, et al.
Published: (2025)
by: Ocansey, Isaiah Thompson, et al.
Published: (2025)
TinyViT-Batten: Few-Shot Vision Transformer with Explainable Attention for Early Batten-Disease Detection on Pediatric MRI
by: Uppalapati, Khartik, et al.
Published: (2025)
by: Uppalapati, Khartik, et al.
Published: (2025)
TinyAlign: Boosting Lightweight Vision-Language Models by Mitigating Modal Alignment Bottlenecks
by: Hu, Yuanze, et al.
Published: (2025)
by: Hu, Yuanze, et al.
Published: (2025)
TinySAM 2: Extreme Memory Compression for Efficient Track Anything Model
by: Ding, Zhaoyuan, et al.
Published: (2026)
by: Ding, Zhaoyuan, et al.
Published: (2026)
Scale-Aware Relay and Scale-Adaptive Loss for Tiny Object Detection in Aerial Images
by: Li, Jinfu, et al.
Published: (2025)
by: Li, Jinfu, et al.
Published: (2025)
Not Like Transformers: Drop the Beat Representation for Dance Generation with Mamba-Based Diffusion Model
by: Park, Sangjune, et al.
Published: (2026)
by: Park, Sangjune, et al.
Published: (2026)
Multi-modal Spatio-Temporal Transformer for High-resolution Land Subsidence Prediction
by: Yao, Wendong, et al.
Published: (2025)
by: Yao, Wendong, et al.
Published: (2025)
TinyVLM: Zero-Shot Object Detection on Microcontrollers via Vision-Language Distillation with Matryoshka Embeddings
by: Wilson, Bibin
Published: (2026)
by: Wilson, Bibin
Published: (2026)
TinySSL: Distilled Self-Supervised Pretraining for Sub-Megabyte MCU Models
by: Wilson, Bibin
Published: (2026)
by: Wilson, Bibin
Published: (2026)
Tiny Inference-Time Scaling with Latent Verifiers
by: Bucciarelli, Davide, et al.
Published: (2026)
by: Bucciarelli, Davide, et al.
Published: (2026)
FastTab: A Fast Table Recognizer with a Tiny Recursive Module and 1D Transformers
by: Hamdi, Laziz, et al.
Published: (2026)
by: Hamdi, Laziz, et al.
Published: (2026)
NubbleDrop: A Simple Way to Improve Matching Strategy for Prompted One-Shot Segmentation
by: Xu, Zhiyu, et al.
Published: (2024)
by: Xu, Zhiyu, et al.
Published: (2024)
CoilDrop-MRI: Self-supervised physics-guided MRI reconstruction with coil dropout
by: Song, Tongxi, et al.
Published: (2026)
by: Song, Tongxi, et al.
Published: (2026)
Tiny Models are the Computational Saver for Large Models
by: Wang, Qingyuan, et al.
Published: (2024)
by: Wang, Qingyuan, et al.
Published: (2024)
TinyViM: Frequency Decoupling for Tiny Hybrid Vision Mamba
by: Ma, Xiaowen, et al.
Published: (2024)
by: Ma, Xiaowen, et al.
Published: (2024)
Rethinking Token Reduction for Large Vision-Language Models
by: Wang, Yi, et al.
Published: (2026)
by: Wang, Yi, et al.
Published: (2026)
COXNet: Cross-Layer Fusion with Adaptive Alignment and Scale Integration for RGBT Tiny Object Detection
by: Peng, Peiran, et al.
Published: (2025)
by: Peng, Peiran, et al.
Published: (2025)
TinyEcoWeedNet: Edge Efficient Real-Time Aerial Agricultural Weed Detection
by: Khater, Omar H., et al.
Published: (2025)
by: Khater, Omar H., et al.
Published: (2025)
Evaluation of GPT-4o and GPT-4o-mini's Vision Capabilities for Compositional Analysis from Dried Solution Drops
by: Dangi, Deven B., et al.
Published: (2024)
by: Dangi, Deven B., et al.
Published: (2024)
GTP-ViT: Efficient Vision Transformers via Graph-based Token Propagation
by: Xu, Xuwei, et al.
Published: (2023)
by: Xu, Xuwei, et al.
Published: (2023)
Simple Drop-in LoRA Conditioning on Attention Layers Will Improve Your Diffusion Model
by: Choi, Joo Young, et al.
Published: (2024)
by: Choi, Joo Young, et al.
Published: (2024)
Similar Items
-
HiRED: Attention-Guided Token Dropping for Efficient Inference of High-Resolution Vision-Language Models
by: Arif, Kazi Hasan Ibn, et al.
Published: (2024) -
Optimal Brain Connection: Towards Efficient Structural Pruning
by: Chen, Shaowu, et al.
Published: (2025) -
MoCrop: Training Free Motion Guided Cropping for Efficient Video Action Recognition
by: Huang, Binhua, et al.
Published: (2025) -
Tiny-Engram: Trigger-Indexed Concept Tables for Generative Vision
by: Cai, Runyuan, et al.
Published: (2026) -
Heterogeneous Graph Transformer for Multiple Tiny Object Tracking in RGB-T Videos
by: Xu, Qingyu, et al.
Published: (2024)