VL-UniTrack: A Unified Framework with Visual-Language Prompts for UAV-Ground Visual Tracking
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Xu, Boyue, Hou, Ruichao, Ren, Tongwei, Wu, Gangshan |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Learning Frequency and Memory-Aware Prompts for Multi-Modal Object Tracking
par: Xu, Boyue, et autres
Publié: (2025)
par: Xu, Boyue, et autres
Publié: (2025)
SwiTrack: Tri-State Switch for Cross-Modal Object Tracking
par: Xu, Boyue, et autres
Publié: (2025)
par: Xu, Boyue, et autres
Publié: (2025)
RGB-D Tracking via Hierarchical Modality Aggregation and Distribution Network
par: Xu, Boyue, et autres
Publié: (2025)
par: Xu, Boyue, et autres
Publié: (2025)
RGB-D Video Object Segmentation via Enhanced Multi-store Feature Memory
par: Xu, Boyue, et autres
Publié: (2025)
par: Xu, Boyue, et autres
Publié: (2025)
MTNet: Learning modality-aware representation with transformer for RGBT tracking
par: Hou, Ruichao, et autres
Publié: (2025)
par: Hou, Ruichao, et autres
Publié: (2025)
KAN-SAM: Kolmogorov-Arnold Network Guided Segment Anything Model for RGB-T Salient Object Detection
par: Li, Xingyuan, et autres
Publié: (2025)
par: Li, Xingyuan, et autres
Publié: (2025)
UniTrack: Differentiable Graph Representation Learning for Multi-Object Tracking
par: Galoaa, Bishoy, et autres
Publié: (2026)
par: Galoaa, Bishoy, et autres
Publié: (2026)
HyPSAM: Hybrid Prompt-driven Segment Anything Model for RGB-Thermal Salient Object Detection
par: Hou, Ruichao, et autres
Publié: (2025)
par: Hou, Ruichao, et autres
Publié: (2025)
UAUTrack: Towards Unified Multimodal Anti-UAV Visual Tracking
par: Ren, Qionglin, et autres
Publié: (2025)
par: Ren, Qionglin, et autres
Publié: (2025)
GLAD: Generative Language-Assisted Visual Tracking for Low-Semantic Templates
par: Luo, Xingyu, et autres
Publié: (2026)
par: Luo, Xingyu, et autres
Publié: (2026)
Spatial-Temporal Human-Object Interaction Detection
par: Sun, Xu, et autres
Publié: (2025)
par: Sun, Xu, et autres
Publié: (2025)
Explicit Visual Prompts for Visual Object Tracking
par: Shi, Liangtao, et autres
Publié: (2024)
par: Shi, Liangtao, et autres
Publié: (2024)
VPTracker: Global Vision-Language Tracking via Visual Prompt
par: Wang, Jingchao, et autres
Publié: (2025)
par: Wang, Jingchao, et autres
Publié: (2025)
HIPTrack: Visual Tracking with Historical Prompts
par: Cai, Wenrui, et autres
Publié: (2023)
par: Cai, Wenrui, et autres
Publié: (2023)
UniVL: Unified Vision-Language Embedding for Spatially Grounded Contextual Image Generation
par: Wang, Jiayun, et autres
Publié: (2026)
par: Wang, Jiayun, et autres
Publié: (2026)
UniSOT: A Unified Framework for Multi-Modality Single Object Tracking
par: Ma, Yinchao, et autres
Publié: (2025)
par: Ma, Yinchao, et autres
Publié: (2025)
Unifying Visual and Vision-Language Tracking via Contrastive Learning
par: Ma, Yinchao, et autres
Publié: (2024)
par: Ma, Yinchao, et autres
Publié: (2024)
Youtu-VL: Unleashing Visual Potential via Unified Vision-Language Supervision
par: Wei, Zhixiang, et autres
Publié: (2026)
par: Wei, Zhixiang, et autres
Publié: (2026)
MUST: The First Dataset and Unified Framework for Multispectral UAV Single Object Tracking
par: Qin, Haolin, et autres
Publié: (2025)
par: Qin, Haolin, et autres
Publié: (2025)
SpikeTrack: A Spike-driven Framework for Efficient Visual Tracking
par: Zhang, Qiuyang, et autres
Publié: (2026)
par: Zhang, Qiuyang, et autres
Publié: (2026)
X Modality Assisting RGBT Object Tracking
par: Ding, Zhaisheng, et autres
Publié: (2023)
par: Ding, Zhaisheng, et autres
Publié: (2023)
Uni-Animator: Towards Unified Visual Colorization
par: Chen, Xinyuan, et autres
Publié: (2026)
par: Chen, Xinyuan, et autres
Publié: (2026)
Efficient Motion Prompt Learning for Robust Visual Tracking
par: Zhao, Jie, et autres
Publié: (2025)
par: Zhao, Jie, et autres
Publié: (2025)
MixFormerV2: Efficient Fully Transformer Tracking
par: Cui, Yutao, et autres
Publié: (2023)
par: Cui, Yutao, et autres
Publié: (2023)
Unified Multimodal Visual Tracking with Dual Mixture-of-Experts
par: Hong, Lingyi, et autres
Publié: (2026)
par: Hong, Lingyi, et autres
Publié: (2026)
UTPTrack: Towards Simple and Unified Token Pruning for Visual Tracking
par: Wu, Hao, et autres
Publié: (2026)
par: Wu, Hao, et autres
Publié: (2026)
Adaptive Perception for Unified Visual Multi-modal Object Tracking
par: Hu, Xiantao, et autres
Publié: (2025)
par: Hu, Xiantao, et autres
Publié: (2025)
SAMITE: Position Prompted SAM2 with Calibrated Memory for Visual Object Tracking
par: Xu, Qianxiong, et autres
Publié: (2025)
par: Xu, Qianxiong, et autres
Publié: (2025)
TrackVLA: Embodied Visual Tracking in the Wild
par: Wang, Shaoan, et autres
Publié: (2025)
par: Wang, Shaoan, et autres
Publié: (2025)
UniModel: A Visual-Only Framework for Unified Multimodal Understanding and Generation
par: Zhang, Chi, et autres
Publié: (2025)
par: Zhang, Chi, et autres
Publié: (2025)
UMind-VL: A Generalist Ultrasound Vision-Language Model for Unified Grounded Perception and Comprehensive Interpretation
par: Chen, Dengbo, et autres
Publié: (2025)
par: Chen, Dengbo, et autres
Publié: (2025)
UncTrack: Reliable Visual Object Tracking with Uncertainty-Aware Prototype Memory Network
par: Yao, Siyuan, et autres
Publié: (2025)
par: Yao, Siyuan, et autres
Publié: (2025)
Dynamic Updates for Language Adaptation in Visual-Language Tracking
par: Li, Xiaohai, et autres
Publié: (2025)
par: Li, Xiaohai, et autres
Publié: (2025)
UAV-VL-R1: Generalizing Vision-Language Models via Supervised Fine-Tuning and Multi-Stage GRPO for UAV Visual Reasoning
par: Guan, Jiajin, et autres
Publié: (2025)
par: Guan, Jiajin, et autres
Publié: (2025)
Prompt-Driven Temporal Domain Adaptation for Nighttime UAV Tracking
par: Fu, Changhong, et autres
Publié: (2024)
par: Fu, Changhong, et autres
Publié: (2024)
VastTrack: Vast Category Visual Object Tracking
par: Peng, Liang, et autres
Publié: (2024)
par: Peng, Liang, et autres
Publié: (2024)
UniDGF: A Unified Detection-to-Generation Framework for Hierarchical Object Visual Recognition
par: Nan, Xinyu, et autres
Publié: (2025)
par: Nan, Xinyu, et autres
Publié: (2025)
MeDocVL: A Visual Language Model for Medical Document Understanding and Parsing
par: Wang, Wenjie, et autres
Publié: (2026)
par: Wang, Wenjie, et autres
Publié: (2026)
DiffusionUavLoc: Visually Prompted Diffusion for Cross-View UAV Localization
par: Liu, Tao, et autres
Publié: (2025)
par: Liu, Tao, et autres
Publié: (2025)
Uni-MDTrack: Learning Decoupled Memory and Dynamic States for Parameter-Efficient Visual Tracking in All Modality
par: Cai, Wenrui, et autres
Publié: (2026)
par: Cai, Wenrui, et autres
Publié: (2026)
Documents similaires
-
Learning Frequency and Memory-Aware Prompts for Multi-Modal Object Tracking
par: Xu, Boyue, et autres
Publié: (2025) -
SwiTrack: Tri-State Switch for Cross-Modal Object Tracking
par: Xu, Boyue, et autres
Publié: (2025) -
RGB-D Tracking via Hierarchical Modality Aggregation and Distribution Network
par: Xu, Boyue, et autres
Publié: (2025) -
RGB-D Video Object Segmentation via Enhanced Multi-store Feature Memory
par: Xu, Boyue, et autres
Publié: (2025) -
MTNet: Learning modality-aware representation with transformer for RGBT tracking
par: Hou, Ruichao, et autres
Publié: (2025)