Adaptive Perception for Unified Visual Multi-modal Object Tracking
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Hu, Xiantao, Zhong, Bineng, Liang, Qihua, Mo, Zhiyi, Shi, Liangtao, Tai, Ying, Yang, Jian |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Explicit Visual Prompts for Visual Object Tracking
par: Shi, Liangtao, et autres
Publié: (2024)
par: Shi, Liangtao, et autres
Publié: (2024)
Dynamic Updates for Language Adaptation in Visual-Language Tracking
par: Li, Xiaohai, et autres
Publié: (2025)
par: Li, Xiaohai, et autres
Publié: (2025)
An Efficient Token Compression Framework for Visual Object Tracking
par: Wu, Weijing, et autres
Publié: (2026)
par: Wu, Weijing, et autres
Publié: (2026)
UBATrack: Spatio-Temporal State Space Model for General Multi-Modal Tracking
par: Liang, Qihua, et autres
Publié: (2026)
par: Liang, Qihua, et autres
Publié: (2026)
Explicit Context Reasoning with Supervision for Visual Tracking
par: Zeng, Fansheng, et autres
Publié: (2025)
par: Zeng, Fansheng, et autres
Publié: (2025)
ODTrack: Online Dense Temporal Token Learning for Visual Tracking
par: Zheng, Yaozong, et autres
Publié: (2024)
par: Zheng, Yaozong, et autres
Publié: (2024)
Autoregressive Queries for Adaptive Tracking with Spatio-TemporalTransformers
par: Xie, Jinxia, et autres
Publié: (2024)
par: Xie, Jinxia, et autres
Publié: (2024)
Exploiting Multimodal Spatial-temporal Patterns for Video Object Tracking
par: Hu, Xiantao, et autres
Publié: (2024)
par: Hu, Xiantao, et autres
Publié: (2024)
Robust Tracking via Mamba-based Context-aware Token Learning
par: Xie, Jinxia, et autres
Publié: (2024)
par: Xie, Jinxia, et autres
Publié: (2024)
MambaLCT: Boosting Tracking via Long-term Context State Space Model
par: Li, Xiaohai, et autres
Publié: (2024)
par: Li, Xiaohai, et autres
Publié: (2024)
Dual-branch Distilled Transformer for Efficient Asymmetric UAV Tracking
par: Yang, Hongtao, et autres
Publié: (2026)
par: Yang, Hongtao, et autres
Publié: (2026)
Less is More: Token Context-aware Learning for Object Tracking
par: Xu, Chenlong, et autres
Publié: (2025)
par: Xu, Chenlong, et autres
Publié: (2025)
Robust RGB-T Tracking via Learnable Visual Fourier Prompt Fine-tuning and Modality Fusion Prompt Generation
par: Yang, Hongtao, et autres
Publié: (2025)
par: Yang, Hongtao, et autres
Publié: (2025)
Decoupled Spatio-Temporal Consistency Learning for Self-Supervised Tracking
par: Zheng, Yaozong, et autres
Publié: (2025)
par: Zheng, Yaozong, et autres
Publié: (2025)
Similarity-Guided Layer-Adaptive Vision Transformer for UAV Tracking
par: Xue, Chaocan, et autres
Publié: (2025)
par: Xue, Chaocan, et autres
Publié: (2025)
Learning to Track Instance from Single Nature Language Description
par: Zheng, Yaozong, et autres
Publié: (2026)
par: Zheng, Yaozong, et autres
Publié: (2026)
SwimVG: Step-wise Multimodal Fusion and Adaption for Visual Grounding
par: Shi, Liangtao, et autres
Publié: (2025)
par: Shi, Liangtao, et autres
Publié: (2025)
Boosting Self-Supervised Tracking with Contextual Prompts and Noise Learning
par: Zheng, Yaozong, et autres
Publié: (2026)
par: Zheng, Yaozong, et autres
Publié: (2026)
Towards Universal Modal Tracking with Online Dense Temporal Token Learning
par: Zheng, Yaozong, et autres
Publié: (2025)
par: Zheng, Yaozong, et autres
Publié: (2025)
Sparse-Tuning: Adapting Vision Transformers with Efficient Fine-tuning and Inference
par: Liu, Ting, et autres
Publié: (2024)
par: Liu, Ting, et autres
Publié: (2024)
PlugTrack: Multi-Perceptive Motion Analysis for Adaptive Fusion in Multi-Object Tracking
par: Kim, Seungjae, et autres
Publié: (2025)
par: Kim, Seungjae, et autres
Publié: (2025)
SMTrack: End-to-End Trained Spiking Neural Networks for Multi-Object Tracking in RGB Videos
par: Zhong, Pengzhi, et autres
Publié: (2025)
par: Zhong, Pengzhi, et autres
Publié: (2025)
Visual Object Tracking on Multi-modal RGB-D Videos: A Review
par: Zhu, Xue-Feng, et autres
Publié: (2022)
par: Zhu, Xue-Feng, et autres
Publié: (2022)
Learning Multi-scale Spatial-frequency Features for Image Denoising
par: Zhao, Xu, et autres
Publié: (2025)
par: Zhao, Xu, et autres
Publié: (2025)
AGSwap: Overcoming Category Boundaries in Object Fusion via Adaptive Group Swapping
par: Zhang, Zedong, et autres
Publié: (2025)
par: Zhang, Zedong, et autres
Publié: (2025)
Awesome Multi-modal Object Tracking
par: Zhang, Chunhui, et autres
Publié: (2024)
par: Zhang, Chunhui, et autres
Publié: (2024)
InstructSeg: Unifying Instructed Visual Segmentation with Multi-modal Large Language Models
par: Wei, Cong, et autres
Publié: (2024)
par: Wei, Cong, et autres
Publié: (2024)
Unified Sequence-to-Sequence Learning for Single- and Multi-Modal Visual Object Tracking
par: Chen, Xin, et autres
Publié: (2023)
par: Chen, Xin, et autres
Publié: (2023)
The Solution for Single Object Tracking Task of Perception Test Challenge 2024
par: Zhong, Zhiqiang, et autres
Publié: (2024)
par: Zhong, Zhiqiang, et autres
Publié: (2024)
Diff-MM: Exploring Pre-trained Text-to-Image Generation Model for Unified Multi-modal Object Tracking
par: Xuan, Shiyu, et autres
Publié: (2025)
par: Xuan, Shiyu, et autres
Publié: (2025)
Unified-modal Salient Object Detection via Adaptive Prompt Learning
par: Wang, Kunpeng, et autres
Publié: (2023)
par: Wang, Kunpeng, et autres
Publié: (2023)
HYDRA: Unifying Multi-modal Generation and Understanding via Representation-Harmonized Tokenization
par: Qiu, Xuerui, et autres
Publié: (2026)
par: Qiu, Xuerui, et autres
Publié: (2026)
MCTrack: A Unified 3D Multi-Object Tracking Framework for Autonomous Driving
par: Wang, Xiyang, et autres
Publié: (2024)
par: Wang, Xiyang, et autres
Publié: (2024)
Multi-Object Tracking by Hierarchical Visual Representations
par: Cao, Jinkun, et autres
Publié: (2024)
par: Cao, Jinkun, et autres
Publié: (2024)
Adaptive Guidance Learning for Camouflaged Object Detection
par: Chen, Zhennan, et autres
Publié: (2024)
par: Chen, Zhennan, et autres
Publié: (2024)
Exploring Reliable Spatiotemporal Dependencies for Efficient Visual Tracking
par: Shi, Junze, et autres
Publié: (2026)
par: Shi, Junze, et autres
Publié: (2026)
Multi-Object Tracking in the Dark
par: Wang, Xinzhe, et autres
Publié: (2024)
par: Wang, Xinzhe, et autres
Publié: (2024)
LLMTrack: Semantic Multi-Object Tracking with Multi-modal Large Language Models
par: Liao, Pan, et autres
Publié: (2026)
par: Liao, Pan, et autres
Publié: (2026)
PoseStreamer: A Multi-modal Framework for 3D Tracking of Unseen Moving Objects
par: Yang, Huiming, et autres
Publié: (2025)
par: Yang, Huiming, et autres
Publié: (2025)
VastTrack: Vast Category Visual Object Tracking
par: Peng, Liang, et autres
Publié: (2024)
par: Peng, Liang, et autres
Publié: (2024)
Documents similaires
-
Explicit Visual Prompts for Visual Object Tracking
par: Shi, Liangtao, et autres
Publié: (2024) -
Dynamic Updates for Language Adaptation in Visual-Language Tracking
par: Li, Xiaohai, et autres
Publié: (2025) -
An Efficient Token Compression Framework for Visual Object Tracking
par: Wu, Weijing, et autres
Publié: (2026) -
UBATrack: Spatio-Temporal State Space Model for General Multi-Modal Tracking
par: Liang, Qihua, et autres
Publié: (2026) -
Explicit Context Reasoning with Supervision for Visual Tracking
par: Zeng, Fansheng, et autres
Publié: (2025)