Adaptively Bypassing Vision Transformer Blocks for Efficient Visual Tracking
Fuente:
arXiv
Saved in:
| Main Authors: | Yang, Xiangyang, Zeng, Dan, Wang, Xucheng, Wu, You, Ye, Hengzhou, Zhao, Qijun, Li, Shuiwang |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Learning an Adaptive and View-Invariant Vision Transformer for Real-Time UAV Tracking
by: Wu, You, et al.
Published: (2024)
by: Wu, You, et al.
Published: (2024)
Learning Motion Blur Robust Vision Transformers for Real-Time UAV Tracking
by: Wu, You, et al.
Published: (2024)
by: Wu, You, et al.
Published: (2024)
Learning Occlusion-Robust Vision Transformers for Real-Time UAV Tracking
by: Wu, You, et al.
Published: (2025)
by: Wu, You, et al.
Published: (2025)
MambaNUT: Nighttime UAV Tracking via Mamba-based Adaptive Curriculum Learning
by: Wu, You, et al.
Published: (2024)
by: Wu, You, et al.
Published: (2024)
Tracking Transforming Objects: A Benchmark
by: Wu, You, et al.
Published: (2024)
by: Wu, You, et al.
Published: (2024)
Fully Spiking Neural Networks with Target Awareness for Energy-Efficient UAV Tracking
by: Zhong, Pengzhi, et al.
Published: (2026)
by: Zhong, Pengzhi, et al.
Published: (2026)
Vision-Based Anti Unmanned Aerial Technology: Opportunities and Challenges
by: Ding, Guanghai, et al.
Published: (2025)
by: Ding, Guanghai, et al.
Published: (2025)
CapeNext: Rethinking and Refining Dynamic Support Information for Category-Agnostic Pose Estimation
by: Zhu, Yu, et al.
Published: (2025)
by: Zhu, Yu, et al.
Published: (2025)
Low-Light Object Tracking: A Benchmark
by: Zhong, Pengzhi, et al.
Published: (2024)
by: Zhong, Pengzhi, et al.
Published: (2024)
Camouflaged Object Tracking: A Benchmark
by: Guo, Xiaoyu, et al.
Published: (2024)
by: Guo, Xiaoyu, et al.
Published: (2024)
FreqTrack: Frequency Learning based Vision Transformer for RGB-Event Object Tracking
by: You, Jinlin, et al.
Published: (2026)
by: You, Jinlin, et al.
Published: (2026)
SMTrack: End-to-End Trained Spiking Neural Networks for Multi-Object Tracking in RGB Videos
by: Zhong, Pengzhi, et al.
Published: (2025)
by: Zhong, Pengzhi, et al.
Published: (2025)
big.LITTLE Vision Transformer for Efficient Visual Recognition
by: Guo, He, et al.
Published: (2024)
by: Guo, He, et al.
Published: (2024)
Block-based Symmetric Pruning and Fusion for Efficient Vision Transformers
by: Hsieh, Yi-Kuan, et al.
Published: (2025)
by: Hsieh, Yi-Kuan, et al.
Published: (2025)
Similarity-Guided Layer-Adaptive Vision Transformer for UAV Tracking
by: Xue, Chaocan, et al.
Published: (2025)
by: Xue, Chaocan, et al.
Published: (2025)
PPT: Token Pruning and Pooling for Efficient Vision Transformers
by: Wu, Xinjian, et al.
Published: (2023)
by: Wu, Xinjian, et al.
Published: (2023)
$\text{PKS}^4$:Parallel Kinematic Selective State Space Scanners for Efficient Video Understanding
by: Zeng, Lingjie, et al.
Published: (2026)
by: Zeng, Lingjie, et al.
Published: (2026)
CAS-ViT: Convolutional Additive Self-attention Vision Transformers for Efficient Mobile Applications
by: Zhang, Tianfang, et al.
Published: (2024)
by: Zhang, Tianfang, et al.
Published: (2024)
Towards Reflected Object Detection: A Benchmark
by: Wu, Yiquan, et al.
Published: (2024)
by: Wu, Yiquan, et al.
Published: (2024)
FlashVGGT: Efficient and Scalable Visual Geometry Transformers with Compressed Descriptor Attention
by: Wang, Zipeng, et al.
Published: (2025)
by: Wang, Zipeng, et al.
Published: (2025)
GM-Skip: Metric-Guided Transformer Block Skipping for Efficient Vision-Language Models
by: Huang, Lianming, et al.
Published: (2025)
by: Huang, Lianming, et al.
Published: (2025)
DyDiT++: Diffusion Transformers with Timestep and Spatial Dynamics for Efficient Visual Generation
by: Zhao, Wangbo, et al.
Published: (2025)
by: Zhao, Wangbo, et al.
Published: (2025)
Active Visual Perception: Opportunities and Challenges
by: Li, Yian, et al.
Published: (2025)
by: Li, Yian, et al.
Published: (2025)
Tracking Reflected Objects: A Benchmark
by: Guo, Xiaoyu, et al.
Published: (2024)
by: Guo, Xiaoyu, et al.
Published: (2024)
EventFlash: Towards Efficient MLLMs for Event-Based Vision
by: Liu, Shaoyu, et al.
Published: (2026)
by: Liu, Shaoyu, et al.
Published: (2026)
Entropy Reveals Block Importance in Masked Self-Supervised Vision Transformers
by: Xiang, Peihao, et al.
Published: (2026)
by: Xiang, Peihao, et al.
Published: (2026)
Depth Adaptive Efficient Visual Autoregressive Modeling
by: Li, Chunliang, et al.
Published: (2026)
by: Li, Chunliang, et al.
Published: (2026)
RGB-Sonar Tracking Benchmark and Spatial Cross-Attention Transformer Tracker
by: Li, Yunfeng, et al.
Published: (2024)
by: Li, Yunfeng, et al.
Published: (2024)
VPTracker: Global Vision-Language Tracking via Visual Prompt
by: Wang, Jingchao, et al.
Published: (2025)
by: Wang, Jingchao, et al.
Published: (2025)
PASTS: Progress-Aware Spatio-Temporal Transformer Speaker For Vision-and-Language Navigation
by: Wang, Liuyi, et al.
Published: (2023)
by: Wang, Liuyi, et al.
Published: (2023)
Dynamic Patch-aware Enrichment Transformer for Occluded Person Re-Identification
by: Zhang, Xin, et al.
Published: (2024)
by: Zhang, Xin, et al.
Published: (2024)
Transformer-based RGB-T Tracking with Channel and Spatial Feature Fusion
by: Li, Yunfeng, et al.
Published: (2024)
by: Li, Yunfeng, et al.
Published: (2024)
Efficient Motion Prompt Learning for Robust Visual Tracking
by: Zhao, Jie, et al.
Published: (2025)
by: Zhao, Jie, et al.
Published: (2025)
AdaptVision: Efficient Vision-Language Models via Adaptive Visual Acquisition
by: Lin, Zichuan, et al.
Published: (2025)
by: Lin, Zichuan, et al.
Published: (2025)
MixFormerV2: Efficient Fully Transformer Tracking
by: Cui, Yutao, et al.
Published: (2023)
by: Cui, Yutao, et al.
Published: (2023)
Exploring Dynamic Transformer for Efficient Object Tracking
by: Zhu, Jiawen, et al.
Published: (2024)
by: Zhu, Jiawen, et al.
Published: (2024)
Event-Adaptive State Transition and Gated Fusion for RGB-Event Object Tracking
by: You, Jinlin, et al.
Published: (2026)
by: You, Jinlin, et al.
Published: (2026)
FocusTrack: A Self-Adaptive Local Sampling Algorithm for Efficient Anti-UAV Tracking
by: Wang, Ying, et al.
Published: (2025)
by: Wang, Ying, et al.
Published: (2025)
Federated Vision Transformer with Adaptive Focal Loss for Medical Image Classification
by: Zhao, Xinyuan, et al.
Published: (2026)
by: Zhao, Xinyuan, et al.
Published: (2026)
ARIW-Framework: Adaptive Robust Iterative Watermarking Framework
by: Wu, Shaowu, et al.
Published: (2025)
by: Wu, Shaowu, et al.
Published: (2025)
Similar Items
-
Learning an Adaptive and View-Invariant Vision Transformer for Real-Time UAV Tracking
by: Wu, You, et al.
Published: (2024) -
Learning Motion Blur Robust Vision Transformers for Real-Time UAV Tracking
by: Wu, You, et al.
Published: (2024) -
Learning Occlusion-Robust Vision Transformers for Real-Time UAV Tracking
by: Wu, You, et al.
Published: (2025) -
MambaNUT: Nighttime UAV Tracking via Mamba-based Adaptive Curriculum Learning
by: Wu, You, et al.
Published: (2024) -
Tracking Transforming Objects: A Benchmark
by: Wu, You, et al.
Published: (2024)