AViTMP: A Tracking-Specific Transformer for Single-Branch Visual Tracking
Fuente:
arXiv
Saved in:
| Main Authors: | Tang, Chuanming, Wang, Kai, van de Weijer, Joost, Zhang, Jianlin, Huang, Yongmei |
|---|---|
| Format: | Preprint |
| Published: |
2023
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
IterInv: Iterative Inversion for Pixel-Level T2I Models
by: Tang, Chuanming, et al.
Published: (2023)
by: Tang, Chuanming, et al.
Published: (2023)
LocInv: Localization-aware Inversion for Text-Guided Image Editing
by: Tang, Chuanming, et al.
Published: (2024)
by: Tang, Chuanming, et al.
Published: (2024)
STCMOT: Spatio-Temporal Cohesion Learning for UAV-Based Multiple Object Tracking
by: Ma, Jianbo, et al.
Published: (2024)
by: Ma, Jianbo, et al.
Published: (2024)
Correlation-Embedded Transformer Tracking: A Single-Branch Framework
by: Xie, Fei, et al.
Published: (2024)
by: Xie, Fei, et al.
Published: (2024)
Calibrating Higher-Order Statistics for Few-Shot Class-Incremental Learning with Pre-trained Vision Transformers
by: Goswami, Dipam, et al.
Published: (2024)
by: Goswami, Dipam, et al.
Published: (2024)
Revisiting Color-Event based Tracking: A Unified Network, Dataset, and Metric
by: Tang, Chuanming, et al.
Published: (2022)
by: Tang, Chuanming, et al.
Published: (2022)
Multi-Class Textual-Inversion Secretly Yields a Semantic-Agnostic Classifier
by: Wang, Kai, et al.
Published: (2024)
by: Wang, Kai, et al.
Published: (2024)
Enhancing Perceptual Quality in Video Super-Resolution through Temporally-Consistent Detail Synthesis using Diffusion Models
by: Rota, Claudio, et al.
Published: (2023)
by: Rota, Claudio, et al.
Published: (2023)
AViT: Adapting Vision Transformers for Small Skin Lesion Segmentation Datasets
by: Du, Siyi, et al.
Published: (2023)
by: Du, Siyi, et al.
Published: (2023)
ColorPeel: Color Prompt Learning with Diffusion Models via Color and Shape Disentanglement
by: Butt, Muhammad Atif, et al.
Published: (2024)
by: Butt, Muhammad Atif, et al.
Published: (2024)
TMP: Temporal Motion Propagation for Online Video Super-Resolution
by: Zhang, Zhengqiang, et al.
Published: (2023)
by: Zhang, Zhengqiang, et al.
Published: (2023)
BronchoTrack: Airway Lumen Tracking for Branch-Level Bronchoscopic Localization
by: Tian, Qingyao, et al.
Published: (2024)
by: Tian, Qingyao, et al.
Published: (2024)
Ask and Remember: A Questions-Only Replay Strategy for Continual Visual Question Answering
by: Marouf, Imad Eddine, et al.
Published: (2025)
by: Marouf, Imad Eddine, et al.
Published: (2025)
The Art of Deception: Color Visual Illusions and Diffusion Models
by: Gomez-Villa, Alex, et al.
Published: (2024)
by: Gomez-Villa, Alex, et al.
Published: (2024)
Training-free image inversion for one-step diffusion models
by: Wu, Tao, et al.
Published: (2026)
by: Wu, Tao, et al.
Published: (2026)
TrackVLA: Embodied Visual Tracking in the Wild
by: Wang, Shaoan, et al.
Published: (2025)
by: Wang, Shaoan, et al.
Published: (2025)
VastTrack: Vast Category Visual Object Tracking
by: Peng, Liang, et al.
Published: (2024)
by: Peng, Liang, et al.
Published: (2024)
Adversarial Concept Distillation for One-Step Diffusion Personalization
by: Yang, Yixiong, et al.
Published: (2025)
by: Yang, Yixiong, et al.
Published: (2025)
Towards General Multimodal Visual Tracking
by: Lu, Andong, et al.
Published: (2025)
by: Lu, Andong, et al.
Published: (2025)
Exemplar-free Continual Representation Learning via Learnable Drift Compensation
by: Gomez-Villa, Alex, et al.
Published: (2024)
by: Gomez-Villa, Alex, et al.
Published: (2024)
Adaptively Bypassing Vision Transformer Blocks for Efficient Visual Tracking
by: Yang, Xiangyang, et al.
Published: (2024)
by: Yang, Xiangyang, et al.
Published: (2024)
LumiCtrl : Learning Illuminant Prompts for Lighting Control in Personalized Text-to-Image Models
by: Butt, Muhammad Atif, et al.
Published: (2025)
by: Butt, Muhammad Atif, et al.
Published: (2025)
AViLA: Asynchronous Vision-Language Agent for Streaming Multimodal Data Interaction
by: Zhang, Gengyuan, et al.
Published: (2025)
by: Zhang, Gengyuan, et al.
Published: (2025)
Assessing Open-world Forgetting in Generative Image Model Customization
by: Laria, Héctor, et al.
Published: (2024)
by: Laria, Héctor, et al.
Published: (2024)
Free-Lunch Color-Texture Disentanglement for Stylized Image Generation
by: Qin, Jiang, et al.
Published: (2025)
by: Qin, Jiang, et al.
Published: (2025)
FeCAM: Exploiting the Heterogeneity of Class Distributions in Exemplar-Free Continual Learning
by: Goswami, Dipam, et al.
Published: (2023)
by: Goswami, Dipam, et al.
Published: (2023)
Tracking the Unstable: Appearance-Guided Motion Modeling for Robust Multi-Object Tracking in UAV-Captured Videos
by: Ma, Jianbo, et al.
Published: (2025)
by: Ma, Jianbo, et al.
Published: (2025)
Spatial Orthogonal Refinement for Robust RGB-Event Visual Object Tracking
by: Huang, Dexing, et al.
Published: (2026)
by: Huang, Dexing, et al.
Published: (2026)
DynamicTrack: Advancing Gigapixel Tracking in Crowded Scenes
by: Zhao, Yunqi, et al.
Published: (2024)
by: Zhao, Yunqi, et al.
Published: (2024)
PillarTrack:Boosting Pillar Representation for Transformer-based 3D Single Object Tracking on Point Clouds
by: Xu, Weisheng, et al.
Published: (2024)
by: Xu, Weisheng, et al.
Published: (2024)
ClickTrack: Towards Real-time Interactive Single Object Tracking
by: Wang, Kuiran, et al.
Published: (2024)
by: Wang, Kuiran, et al.
Published: (2024)
Unifying Visual and Vision-Language Tracking via Contrastive Learning
by: Ma, Yinchao, et al.
Published: (2024)
by: Ma, Yinchao, et al.
Published: (2024)
Adapting SAM 2 for Visual Object Tracking: 1st Place Solution for MMVPR Challenge Multi-Modal Tracking
by: Yang, Cheng-Yen, et al.
Published: (2025)
by: Yang, Cheng-Yen, et al.
Published: (2025)
Unified Sequence-to-Sequence Learning for Single- and Multi-Modal Visual Object Tracking
by: Chen, Xin, et al.
Published: (2023)
by: Chen, Xin, et al.
Published: (2023)
DeTrack: In-model Latent Denoising Learning for Visual Object Tracking
by: Zhou, Xinyu, et al.
Published: (2025)
by: Zhou, Xinyu, et al.
Published: (2025)
Track-On: Transformer-based Online Point Tracking with Memory
by: Aydemir, Görkay, et al.
Published: (2025)
by: Aydemir, Görkay, et al.
Published: (2025)
SpikeTrack: A Spike-driven Framework for Efficient Visual Tracking
by: Zhang, Qiuyang, et al.
Published: (2026)
by: Zhang, Qiuyang, et al.
Published: (2026)
Covariances for Free: Exploiting Mean Distributions for Training-free Federated Learning
by: Goswami, Dipam, et al.
Published: (2024)
by: Goswami, Dipam, et al.
Published: (2024)
Explicit Visual Prompts for Visual Object Tracking
by: Shi, Liangtao, et al.
Published: (2024)
by: Shi, Liangtao, et al.
Published: (2024)
On the importance of cross-task features for class-incremental learning
by: Soutif--Cormerais, Albin, et al.
Published: (2021)
by: Soutif--Cormerais, Albin, et al.
Published: (2021)
Similar Items
-
IterInv: Iterative Inversion for Pixel-Level T2I Models
by: Tang, Chuanming, et al.
Published: (2023) -
LocInv: Localization-aware Inversion for Text-Guided Image Editing
by: Tang, Chuanming, et al.
Published: (2024) -
STCMOT: Spatio-Temporal Cohesion Learning for UAV-Based Multiple Object Tracking
by: Ma, Jianbo, et al.
Published: (2024) -
Correlation-Embedded Transformer Tracking: A Single-Branch Framework
by: Xie, Fei, et al.
Published: (2024) -
Calibrating Higher-Order Statistics for Few-Shot Class-Incremental Learning with Pre-trained Vision Transformers
by: Goswami, Dipam, et al.
Published: (2024)