Similarity-Guided Layer-Adaptive Vision Transformer for UAV Tracking
Fuente:
arXiv
Guardado en:
| Autores principales: | Xue, Chaocan, Zhong, Bineng, Liang, Qihua, Zheng, Yaozong, Li, Ning, Xue, Yuanliang, Song, Shuxiang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Dual-branch Distilled Transformer for Efficient Asymmetric UAV Tracking
por: Yang, Hongtao, et al.
Publicado: (2026)
por: Yang, Hongtao, et al.
Publicado: (2026)
Boosting Self-Supervised Tracking with Contextual Prompts and Noise Learning
por: Zheng, Yaozong, et al.
Publicado: (2026)
por: Zheng, Yaozong, et al.
Publicado: (2026)
Decoupled Spatio-Temporal Consistency Learning for Self-Supervised Tracking
por: Zheng, Yaozong, et al.
Publicado: (2025)
por: Zheng, Yaozong, et al.
Publicado: (2025)
Less is More: Token Context-aware Learning for Object Tracking
por: Xu, Chenlong, et al.
Publicado: (2025)
por: Xu, Chenlong, et al.
Publicado: (2025)
Learning to Track Instance from Single Nature Language Description
por: Zheng, Yaozong, et al.
Publicado: (2026)
por: Zheng, Yaozong, et al.
Publicado: (2026)
Robust RGB-T Tracking via Learnable Visual Fourier Prompt Fine-tuning and Modality Fusion Prompt Generation
por: Yang, Hongtao, et al.
Publicado: (2025)
por: Yang, Hongtao, et al.
Publicado: (2025)
Robust Tracking via Mamba-based Context-aware Token Learning
por: Xie, Jinxia, et al.
Publicado: (2024)
por: Xie, Jinxia, et al.
Publicado: (2024)
ODTrack: Online Dense Temporal Token Learning for Visual Tracking
por: Zheng, Yaozong, et al.
Publicado: (2024)
por: Zheng, Yaozong, et al.
Publicado: (2024)
UBATrack: Spatio-Temporal State Space Model for General Multi-Modal Tracking
por: Liang, Qihua, et al.
Publicado: (2026)
por: Liang, Qihua, et al.
Publicado: (2026)
Dynamic Updates for Language Adaptation in Visual-Language Tracking
por: Li, Xiaohai, et al.
Publicado: (2025)
por: Li, Xiaohai, et al.
Publicado: (2025)
MambaLCT: Boosting Tracking via Long-term Context State Space Model
por: Li, Xiaohai, et al.
Publicado: (2024)
por: Li, Xiaohai, et al.
Publicado: (2024)
Towards Universal Modal Tracking with Online Dense Temporal Token Learning
por: Zheng, Yaozong, et al.
Publicado: (2025)
por: Zheng, Yaozong, et al.
Publicado: (2025)
An Efficient Token Compression Framework for Visual Object Tracking
por: Wu, Weijing, et al.
Publicado: (2026)
por: Wu, Weijing, et al.
Publicado: (2026)
Autoregressive Queries for Adaptive Tracking with Spatio-TemporalTransformers
por: Xie, Jinxia, et al.
Publicado: (2024)
por: Xie, Jinxia, et al.
Publicado: (2024)
Explicit Visual Prompts for Visual Object Tracking
por: Shi, Liangtao, et al.
Publicado: (2024)
por: Shi, Liangtao, et al.
Publicado: (2024)
Adaptive Perception for Unified Visual Multi-modal Object Tracking
por: Hu, Xiantao, et al.
Publicado: (2025)
por: Hu, Xiantao, et al.
Publicado: (2025)
Explicit Context Reasoning with Supervision for Visual Tracking
por: Zeng, Fansheng, et al.
Publicado: (2025)
por: Zeng, Fansheng, et al.
Publicado: (2025)
Learning an Adaptive and View-Invariant Vision Transformer for Real-Time UAV Tracking
por: Wu, You, et al.
Publicado: (2024)
por: Wu, You, et al.
Publicado: (2024)
Bidirectional Prototype-Reward co-Evolution for Test-Time Adaptation of Vision-Language Models
por: Qiao, Xiaozhen, et al.
Publicado: (2025)
por: Qiao, Xiaozhen, et al.
Publicado: (2025)
Layer-Guided UAV Tracking: Enhancing Efficiency and Occlusion Robustness
por: Zhou, Yang, et al.
Publicado: (2026)
por: Zhou, Yang, et al.
Publicado: (2026)
Learning Occlusion-Robust Vision Transformers for Real-Time UAV Tracking
por: Wu, You, et al.
Publicado: (2025)
por: Wu, You, et al.
Publicado: (2025)
Learning Motion Blur Robust Vision Transformers for Real-Time UAV Tracking
por: Wu, You, et al.
Publicado: (2024)
por: Wu, You, et al.
Publicado: (2024)
Instruction-Guided Fusion of Multi-Layer Visual Features in Large Vision-Language Models
por: Li, Xu, et al.
Publicado: (2024)
por: Li, Xu, et al.
Publicado: (2024)
UAV-Track VLA: Embodied Aerial Tracking via Vision-Language-Action Models
por: Zhang, Qiyao, et al.
Publicado: (2026)
por: Zhang, Qiyao, et al.
Publicado: (2026)
Sparse-Tuning: Adapting Vision Transformers with Efficient Fine-tuning and Inference
por: Liu, Ting, et al.
Publicado: (2024)
por: Liu, Ting, et al.
Publicado: (2024)
Adaptively Bypassing Vision Transformer Blocks for Efficient Visual Tracking
por: Yang, Xiangyang, et al.
Publicado: (2024)
por: Yang, Xiangyang, et al.
Publicado: (2024)
Exploiting Multimodal Spatial-temporal Patterns for Video Object Tracking
por: Hu, Xiantao, et al.
Publicado: (2024)
por: Hu, Xiantao, et al.
Publicado: (2024)
Similarity Guided Multimodal Fusion Transformer for Semantic Location Prediction in Social Media
por: Zhang, Zhizhen, et al.
Publicado: (2024)
por: Zhang, Zhizhen, et al.
Publicado: (2024)
GauSTAR: Gaussian Surface Tracking and Reconstruction
por: Zheng, Chengwei, et al.
Publicado: (2025)
por: Zheng, Chengwei, et al.
Publicado: (2025)
Efficient Vision-Language Reasoning via Adaptive Token Pruning
por: Li, Xue, et al.
Publicado: (2025)
por: Li, Xue, et al.
Publicado: (2025)
GM-Skip: Metric-Guided Transformer Block Skipping for Efficient Vision-Language Models
por: Huang, Lianming, et al.
Publicado: (2025)
por: Huang, Lianming, et al.
Publicado: (2025)
Pyramid Token Pruning for High-Resolution Large Vision-Language Models via Region, Token, and Instruction-Guided Importance
por: Liang, Yuxuan, et al.
Publicado: (2025)
por: Liang, Yuxuan, et al.
Publicado: (2025)
FocusTrack: A Self-Adaptive Local Sampling Algorithm for Efficient Anti-UAV Tracking
por: Wang, Ying, et al.
Publicado: (2025)
por: Wang, Ying, et al.
Publicado: (2025)
SMTrack: End-to-End Trained Spiking Neural Networks for Multi-Object Tracking in RGB Videos
por: Zhong, Pengzhi, et al.
Publicado: (2025)
por: Zhong, Pengzhi, et al.
Publicado: (2025)
MAIL++: Multi-Modal Bi-directional Agent Layer for Vision-Language Models
por: Chen, Kaixiang, et al.
Publicado: (2026)
por: Chen, Kaixiang, et al.
Publicado: (2026)
Towards Vision-Language Geo-Foundation Model: A Survey
por: Zhou, Yue, et al.
Publicado: (2024)
por: Zhou, Yue, et al.
Publicado: (2024)
DARTer: Dynamic Adaptive Representation Tracker for Nighttime UAV Tracking
por: Li, Xuzhao, et al.
Publicado: (2025)
por: Li, Xuzhao, et al.
Publicado: (2025)
ImOV3D: Learning Open-Vocabulary Point Clouds 3D Object Detection from Only 2D Images
por: Yang, Timing, et al.
Publicado: (2024)
por: Yang, Timing, et al.
Publicado: (2024)
Fully Spiking Neural Networks with Target Awareness for Energy-Efficient UAV Tracking
por: Zhong, Pengzhi, et al.
Publicado: (2026)
por: Zhong, Pengzhi, et al.
Publicado: (2026)
MambaNUT: Nighttime UAV Tracking via Mamba-based Adaptive Curriculum Learning
por: Wu, You, et al.
Publicado: (2024)
por: Wu, You, et al.
Publicado: (2024)
Ejemplares similares
-
Dual-branch Distilled Transformer for Efficient Asymmetric UAV Tracking
por: Yang, Hongtao, et al.
Publicado: (2026) -
Boosting Self-Supervised Tracking with Contextual Prompts and Noise Learning
por: Zheng, Yaozong, et al.
Publicado: (2026) -
Decoupled Spatio-Temporal Consistency Learning for Self-Supervised Tracking
por: Zheng, Yaozong, et al.
Publicado: (2025) -
Less is More: Token Context-aware Learning for Object Tracking
por: Xu, Chenlong, et al.
Publicado: (2025) -
Learning to Track Instance from Single Nature Language Description
por: Zheng, Yaozong, et al.
Publicado: (2026)