Dynamic Updates for Language Adaptation in Visual-Language Tracking
Fuente:
arXiv
Saved in:
| Main Authors: | Li, Xiaohai, Zhong, Bineng, Liang, Qihua, Mo, Zhiyi, Nong, Jian, Song, Shuxiang |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
MambaLCT: Boosting Tracking via Long-term Context State Space Model
by: Li, Xiaohai, et al.
Published: (2024)
by: Li, Xiaohai, et al.
Published: (2024)
An Efficient Token Compression Framework for Visual Object Tracking
by: Wu, Weijing, et al.
Published: (2026)
by: Wu, Weijing, et al.
Published: (2026)
Robust Tracking via Mamba-based Context-aware Token Learning
by: Xie, Jinxia, et al.
Published: (2024)
by: Xie, Jinxia, et al.
Published: (2024)
UBATrack: Spatio-Temporal State Space Model for General Multi-Modal Tracking
by: Liang, Qihua, et al.
Published: (2026)
by: Liang, Qihua, et al.
Published: (2026)
Learning to Track Instance from Single Nature Language Description
by: Zheng, Yaozong, et al.
Published: (2026)
by: Zheng, Yaozong, et al.
Published: (2026)
Decoupled Spatio-Temporal Consistency Learning for Self-Supervised Tracking
by: Zheng, Yaozong, et al.
Published: (2025)
by: Zheng, Yaozong, et al.
Published: (2025)
ODTrack: Online Dense Temporal Token Learning for Visual Tracking
by: Zheng, Yaozong, et al.
Published: (2024)
by: Zheng, Yaozong, et al.
Published: (2024)
Adaptive Perception for Unified Visual Multi-modal Object Tracking
by: Hu, Xiantao, et al.
Published: (2025)
by: Hu, Xiantao, et al.
Published: (2025)
Less is More: Token Context-aware Learning for Object Tracking
by: Xu, Chenlong, et al.
Published: (2025)
by: Xu, Chenlong, et al.
Published: (2025)
Similarity-Guided Layer-Adaptive Vision Transformer for UAV Tracking
by: Xue, Chaocan, et al.
Published: (2025)
by: Xue, Chaocan, et al.
Published: (2025)
Boosting Self-Supervised Tracking with Contextual Prompts and Noise Learning
by: Zheng, Yaozong, et al.
Published: (2026)
by: Zheng, Yaozong, et al.
Published: (2026)
Autoregressive Queries for Adaptive Tracking with Spatio-TemporalTransformers
by: Xie, Jinxia, et al.
Published: (2024)
by: Xie, Jinxia, et al.
Published: (2024)
Dual-branch Distilled Transformer for Efficient Asymmetric UAV Tracking
by: Yang, Hongtao, et al.
Published: (2026)
by: Yang, Hongtao, et al.
Published: (2026)
Explicit Visual Prompts for Visual Object Tracking
by: Shi, Liangtao, et al.
Published: (2024)
by: Shi, Liangtao, et al.
Published: (2024)
Explicit Context Reasoning with Supervision for Visual Tracking
by: Zeng, Fansheng, et al.
Published: (2025)
by: Zeng, Fansheng, et al.
Published: (2025)
Robust RGB-T Tracking via Learnable Visual Fourier Prompt Fine-tuning and Modality Fusion Prompt Generation
by: Yang, Hongtao, et al.
Published: (2025)
by: Yang, Hongtao, et al.
Published: (2025)
Towards Universal Modal Tracking with Online Dense Temporal Token Learning
by: Zheng, Yaozong, et al.
Published: (2025)
by: Zheng, Yaozong, et al.
Published: (2025)
Exploiting Multimodal Spatial-temporal Patterns for Video Object Tracking
by: Hu, Xiantao, et al.
Published: (2024)
by: Hu, Xiantao, et al.
Published: (2024)
ETTA: Efficient Test-Time Adaptation for Vision-Language Models through Dynamic Embedding Updates
by: Dastmalchi, Hamidreza, et al.
Published: (2025)
by: Dastmalchi, Hamidreza, et al.
Published: (2025)
Cascade Prompt Learning for Vision-Language Model Adaptation
by: Wu, Ge, et al.
Published: (2024)
by: Wu, Ge, et al.
Published: (2024)
SMTrack: End-to-End Trained Spiking Neural Networks for Multi-Object Tracking in RGB Videos
by: Zhong, Pengzhi, et al.
Published: (2025)
by: Zhong, Pengzhi, et al.
Published: (2025)
Language-Guided Joint Audio-Visual Editing via One-Shot Adaptation
by: Liang, Susan, et al.
Published: (2024)
by: Liang, Susan, et al.
Published: (2024)
Context-Aware Integration of Language and Visual References for Natural Language Tracking
by: Shao, Yanyan, et al.
Published: (2024)
by: Shao, Yanyan, et al.
Published: (2024)
Customizing Visual-Language Foundation Models for Multi-modal Anomaly Detection and Reasoning
by: Xu, Xiaohao, et al.
Published: (2024)
by: Xu, Xiaohao, et al.
Published: (2024)
DualEdit: Dual Editing for Knowledge Updating in Vision-Language Models
by: Shi, Zhiyi, et al.
Published: (2025)
by: Shi, Zhiyi, et al.
Published: (2025)
VL-UniTrack: A Unified Framework with Visual-Language Prompts for UAV-Ground Visual Tracking
by: Xu, Boyue, et al.
Published: (2026)
by: Xu, Boyue, et al.
Published: (2026)
Dynamic Rank Adaptation for Vision-Language Models
by: Wang, Jiahui, et al.
Published: (2025)
by: Wang, Jiahui, et al.
Published: (2025)
Advancing Reliable Test-Time Adaptation of Vision-Language Models under Visual Variations
by: Liang, Yiwen, et al.
Published: (2025)
by: Liang, Yiwen, et al.
Published: (2025)
VPTracker: Global Vision-Language Tracking via Visual Prompt
by: Wang, Jingchao, et al.
Published: (2025)
by: Wang, Jingchao, et al.
Published: (2025)
Unifying Visual and Vision-Language Tracking via Contrastive Learning
by: Ma, Yinchao, et al.
Published: (2024)
by: Ma, Yinchao, et al.
Published: (2024)
Towards Compatible Fine-tuning for Vision-Language Model Updates
by: Wang, Zhengbo, et al.
Published: (2024)
by: Wang, Zhengbo, et al.
Published: (2024)
DTLLM-VLT: Diverse Text Generation for Visual Language Tracking Based on LLM
by: Li, Xuchen, et al.
Published: (2024)
by: Li, Xuchen, et al.
Published: (2024)
GLAD: Generative Language-Assisted Visual Tracking for Low-Semantic Templates
by: Luo, Xingyu, et al.
Published: (2026)
by: Luo, Xingyu, et al.
Published: (2026)
VastTrack: Vast Category Visual Object Tracking
by: Peng, Liang, et al.
Published: (2024)
by: Peng, Liang, et al.
Published: (2024)
Visual Language Tracking with Multi-modal Interaction: A Robust Benchmark
by: Li, Xuchen, et al.
Published: (2024)
by: Li, Xuchen, et al.
Published: (2024)
ChatTracker: Enhancing Visual Tracking Performance via Chatting with Multimodal Large Language Model
by: Sun, Yiming, et al.
Published: (2024)
by: Sun, Yiming, et al.
Published: (2024)
Not All Frame Features Are Equal: Video-to-4D Generation via Decoupling Dynamic-Static Features
by: Yang, Liying, et al.
Published: (2025)
by: Yang, Liying, et al.
Published: (2025)
TrackVLA: Embodied Visual Tracking in the Wild
by: Wang, Shaoan, et al.
Published: (2025)
by: Wang, Shaoan, et al.
Published: (2025)
MMAIF: Multi-task and Multi-degradation All-in-One for Image Fusion with Language Guidance
by: Cao, Zihan, et al.
Published: (2025)
by: Cao, Zihan, et al.
Published: (2025)
Fully Spiking Neural Networks with Target Awareness for Energy-Efficient UAV Tracking
by: Zhong, Pengzhi, et al.
Published: (2026)
by: Zhong, Pengzhi, et al.
Published: (2026)
Similar Items
-
MambaLCT: Boosting Tracking via Long-term Context State Space Model
by: Li, Xiaohai, et al.
Published: (2024) -
An Efficient Token Compression Framework for Visual Object Tracking
by: Wu, Weijing, et al.
Published: (2026) -
Robust Tracking via Mamba-based Context-aware Token Learning
by: Xie, Jinxia, et al.
Published: (2024) -
UBATrack: Spatio-Temporal State Space Model for General Multi-Modal Tracking
by: Liang, Qihua, et al.
Published: (2026) -
Learning to Track Instance from Single Nature Language Description
by: Zheng, Yaozong, et al.
Published: (2026)