Autoregressive Queries for Adaptive Tracking with Spatio-TemporalTransformers
Fuente:
arXiv
Salvato in:
| Autori principali: | Xie, Jinxia, Zhong, Bineng, Mo, Zhiyi, Zhang, Shengping, Shi, Liangtao, Song, Shuxiang, Ji, Rongrong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Robust Tracking via Mamba-based Context-aware Token Learning
di: Xie, Jinxia, et al.
Pubblicazione: (2024)
di: Xie, Jinxia, et al.
Pubblicazione: (2024)
Decoupled Spatio-Temporal Consistency Learning for Self-Supervised Tracking
di: Zheng, Yaozong, et al.
Pubblicazione: (2025)
di: Zheng, Yaozong, et al.
Pubblicazione: (2025)
ODTrack: Online Dense Temporal Token Learning for Visual Tracking
di: Zheng, Yaozong, et al.
Pubblicazione: (2024)
di: Zheng, Yaozong, et al.
Pubblicazione: (2024)
Adaptive Perception for Unified Visual Multi-modal Object Tracking
di: Hu, Xiantao, et al.
Pubblicazione: (2025)
di: Hu, Xiantao, et al.
Pubblicazione: (2025)
Explicit Visual Prompts for Visual Object Tracking
di: Shi, Liangtao, et al.
Pubblicazione: (2024)
di: Shi, Liangtao, et al.
Pubblicazione: (2024)
Dynamic Updates for Language Adaptation in Visual-Language Tracking
di: Li, Xiaohai, et al.
Pubblicazione: (2025)
di: Li, Xiaohai, et al.
Pubblicazione: (2025)
UBATrack: Spatio-Temporal State Space Model for General Multi-Modal Tracking
di: Liang, Qihua, et al.
Pubblicazione: (2026)
di: Liang, Qihua, et al.
Pubblicazione: (2026)
Explicit Context Reasoning with Supervision for Visual Tracking
di: Zeng, Fansheng, et al.
Pubblicazione: (2025)
di: Zeng, Fansheng, et al.
Pubblicazione: (2025)
MambaLCT: Boosting Tracking via Long-term Context State Space Model
di: Li, Xiaohai, et al.
Pubblicazione: (2024)
di: Li, Xiaohai, et al.
Pubblicazione: (2024)
An Efficient Token Compression Framework for Visual Object Tracking
di: Wu, Weijing, et al.
Pubblicazione: (2026)
di: Wu, Weijing, et al.
Pubblicazione: (2026)
Towards Universal Modal Tracking with Online Dense Temporal Token Learning
di: Zheng, Yaozong, et al.
Pubblicazione: (2025)
di: Zheng, Yaozong, et al.
Pubblicazione: (2025)
Similarity-Guided Layer-Adaptive Vision Transformer for UAV Tracking
di: Xue, Chaocan, et al.
Pubblicazione: (2025)
di: Xue, Chaocan, et al.
Pubblicazione: (2025)
Long-Range Feature Propagating for Natural Image Matting
di: Liu, Qinglin, et al.
Pubblicazione: (2021)
di: Liu, Qinglin, et al.
Pubblicazione: (2021)
Dual-branch Distilled Transformer for Efficient Asymmetric UAV Tracking
di: Yang, Hongtao, et al.
Pubblicazione: (2026)
di: Yang, Hongtao, et al.
Pubblicazione: (2026)
Less is More: Token Context-aware Learning for Object Tracking
di: Xu, Chenlong, et al.
Pubblicazione: (2025)
di: Xu, Chenlong, et al.
Pubblicazione: (2025)
Learning to Track Instance from Single Nature Language Description
di: Zheng, Yaozong, et al.
Pubblicazione: (2026)
di: Zheng, Yaozong, et al.
Pubblicazione: (2026)
Boosting Self-Supervised Tracking with Contextual Prompts and Noise Learning
di: Zheng, Yaozong, et al.
Pubblicazione: (2026)
di: Zheng, Yaozong, et al.
Pubblicazione: (2026)
Sparse-Tuning: Adapting Vision Transformers with Efficient Fine-tuning and Inference
di: Liu, Ting, et al.
Pubblicazione: (2024)
di: Liu, Ting, et al.
Pubblicazione: (2024)
Transformer RGBT Tracking with Spatio-Temporal Multimodal Tokens
di: Sun, Dengdi, et al.
Pubblicazione: (2024)
di: Sun, Dengdi, et al.
Pubblicazione: (2024)
End-to-End Human Instance Matting
di: Liu, Qinglin, et al.
Pubblicazione: (2024)
di: Liu, Qinglin, et al.
Pubblicazione: (2024)
Video-Language Alignment via Spatio-Temporal Graph Transformer
di: Zhang, Shi-Xue, et al.
Pubblicazione: (2024)
di: Zhang, Shi-Xue, et al.
Pubblicazione: (2024)
Robust RGB-T Tracking via Learnable Visual Fourier Prompt Fine-tuning and Modality Fusion Prompt Generation
di: Yang, Hongtao, et al.
Pubblicazione: (2025)
di: Yang, Hongtao, et al.
Pubblicazione: (2025)
Exploiting Multimodal Spatial-temporal Patterns for Video Object Tracking
di: Hu, Xiantao, et al.
Pubblicazione: (2024)
di: Hu, Xiantao, et al.
Pubblicazione: (2024)
MSC: Multi-Scale Spatio-Temporal Causal Attention for Autoregressive Video Diffusion
di: Xu, Xunnong, et al.
Pubblicazione: (2024)
di: Xu, Xunnong, et al.
Pubblicazione: (2024)
Classifier-Centric Adaptive Framework for Open-Vocabulary Camouflaged Object Segmentation
di: Zhang, Hanyu, et al.
Pubblicazione: (2025)
di: Zhang, Hanyu, et al.
Pubblicazione: (2025)
HAD: Hierarchical Asymmetric Distillation to Bridge Spatio-Temporal Gaps in Event-Based Object Tracking
di: Deng, Yao, et al.
Pubblicazione: (2025)
di: Deng, Yao, et al.
Pubblicazione: (2025)
Towards Accurate Post-Training Quantization of Vision Transformers via Error Reduction
di: Zhong, Yunshan, et al.
Pubblicazione: (2024)
di: Zhong, Yunshan, et al.
Pubblicazione: (2024)
ACTrack: Adding Spatio-Temporal Condition for Visual Object Tracking
di: Han, Yushan, et al.
Pubblicazione: (2024)
di: Han, Yushan, et al.
Pubblicazione: (2024)
SFDA-rPPG: Source-Free Domain Adaptive Remote Physiological Measurement with Spatio-Temporal Consistency
di: Xie, Yiping, et al.
Pubblicazione: (2024)
di: Xie, Yiping, et al.
Pubblicazione: (2024)
Diversifying Query: Region-Guided Transformer for Temporal Sentence Grounding
di: Sun, Xiaolong, et al.
Pubblicazione: (2024)
di: Sun, Xiaolong, et al.
Pubblicazione: (2024)
STCMOT: Spatio-Temporal Cohesion Learning for UAV-Based Multiple Object Tracking
di: Ma, Jianbo, et al.
Pubblicazione: (2024)
di: Ma, Jianbo, et al.
Pubblicazione: (2024)
DMTrack: Spatio-Temporal Multimodal Tracking via Dual-Adapter
di: Li, Weihong, et al.
Pubblicazione: (2025)
di: Li, Weihong, et al.
Pubblicazione: (2025)
TQD-Track: Temporal Query Denoising for 3D Multi-Object Tracking
di: Ding, Shuxiao, et al.
Pubblicazione: (2025)
di: Ding, Shuxiao, et al.
Pubblicazione: (2025)
Temporal-Enhanced Multimodal Transformer for Referring Multi-Object Tracking and Segmentation
di: Xiao, Changcheng, et al.
Pubblicazione: (2024)
di: Xiao, Changcheng, et al.
Pubblicazione: (2024)
MambaVT: Spatio-Temporal Contextual Modeling for robust RGB-T Tracking
di: Lai, Simiao, et al.
Pubblicazione: (2024)
di: Lai, Simiao, et al.
Pubblicazione: (2024)
Track the Answer: Extending TextVQA from Image to Video with Spatio-Temporal Clues
di: Zhang, Yan, et al.
Pubblicazione: (2024)
di: Zhang, Yan, et al.
Pubblicazione: (2024)
Spatio-Temporal Bi-directional Cross-frame Memory for Distractor Filtering Point Cloud Single Object Tracking
di: Sun, Shaoyu, et al.
Pubblicazione: (2024)
di: Sun, Shaoyu, et al.
Pubblicazione: (2024)
Efficient Spatio-Temporal Vegetation Pixel Classification with Vision Transformers
di: Gomes, Alan, et al.
Pubblicazione: (2026)
di: Gomes, Alan, et al.
Pubblicazione: (2026)
Blur-aware Spatio-temporal Sparse Transformer for Video Deblurring
di: Zhang, Huicong, et al.
Pubblicazione: (2024)
di: Zhang, Huicong, et al.
Pubblicazione: (2024)
Transformer-Based Spatio-Temporal Association of Apple Fruitlets
di: Freeman, Harry, et al.
Pubblicazione: (2025)
di: Freeman, Harry, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Robust Tracking via Mamba-based Context-aware Token Learning
di: Xie, Jinxia, et al.
Pubblicazione: (2024) -
Decoupled Spatio-Temporal Consistency Learning for Self-Supervised Tracking
di: Zheng, Yaozong, et al.
Pubblicazione: (2025) -
ODTrack: Online Dense Temporal Token Learning for Visual Tracking
di: Zheng, Yaozong, et al.
Pubblicazione: (2024) -
Adaptive Perception for Unified Visual Multi-modal Object Tracking
di: Hu, Xiantao, et al.
Pubblicazione: (2025) -
Explicit Visual Prompts for Visual Object Tracking
di: Shi, Liangtao, et al.
Pubblicazione: (2024)