UBATrack: Spatio-Temporal State Space Model for General Multi-Modal Tracking
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Liang, Qihua, Chen, Liang, Zheng, Yaozong, Nong, Jian, Mo, Zhiyi, Zhong, Bineng |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Decoupled Spatio-Temporal Consistency Learning for Self-Supervised Tracking
par: Zheng, Yaozong, et autres
Publié: (2025)
par: Zheng, Yaozong, et autres
Publié: (2025)
ODTrack: Online Dense Temporal Token Learning for Visual Tracking
par: Zheng, Yaozong, et autres
Publié: (2024)
par: Zheng, Yaozong, et autres
Publié: (2024)
Dynamic Updates for Language Adaptation in Visual-Language Tracking
par: Li, Xiaohai, et autres
Publié: (2025)
par: Li, Xiaohai, et autres
Publié: (2025)
MambaLCT: Boosting Tracking via Long-term Context State Space Model
par: Li, Xiaohai, et autres
Publié: (2024)
par: Li, Xiaohai, et autres
Publié: (2024)
Robust RGB-T Tracking via Learnable Visual Fourier Prompt Fine-tuning and Modality Fusion Prompt Generation
par: Yang, Hongtao, et autres
Publié: (2025)
par: Yang, Hongtao, et autres
Publié: (2025)
Towards Universal Modal Tracking with Online Dense Temporal Token Learning
par: Zheng, Yaozong, et autres
Publié: (2025)
par: Zheng, Yaozong, et autres
Publié: (2025)
Adaptive Perception for Unified Visual Multi-modal Object Tracking
par: Hu, Xiantao, et autres
Publié: (2025)
par: Hu, Xiantao, et autres
Publié: (2025)
Less is More: Token Context-aware Learning for Object Tracking
par: Xu, Chenlong, et autres
Publié: (2025)
par: Xu, Chenlong, et autres
Publié: (2025)
Learning to Track Instance from Single Nature Language Description
par: Zheng, Yaozong, et autres
Publié: (2026)
par: Zheng, Yaozong, et autres
Publié: (2026)
Robust Tracking via Mamba-based Context-aware Token Learning
par: Xie, Jinxia, et autres
Publié: (2024)
par: Xie, Jinxia, et autres
Publié: (2024)
Dual-branch Distilled Transformer for Efficient Asymmetric UAV Tracking
par: Yang, Hongtao, et autres
Publié: (2026)
par: Yang, Hongtao, et autres
Publié: (2026)
Similarity-Guided Layer-Adaptive Vision Transformer for UAV Tracking
par: Xue, Chaocan, et autres
Publié: (2025)
par: Xue, Chaocan, et autres
Publié: (2025)
Boosting Self-Supervised Tracking with Contextual Prompts and Noise Learning
par: Zheng, Yaozong, et autres
Publié: (2026)
par: Zheng, Yaozong, et autres
Publié: (2026)
Autoregressive Queries for Adaptive Tracking with Spatio-TemporalTransformers
par: Xie, Jinxia, et autres
Publié: (2024)
par: Xie, Jinxia, et autres
Publié: (2024)
An Efficient Token Compression Framework for Visual Object Tracking
par: Wu, Weijing, et autres
Publié: (2026)
par: Wu, Weijing, et autres
Publié: (2026)
Explicit Visual Prompts for Visual Object Tracking
par: Shi, Liangtao, et autres
Publié: (2024)
par: Shi, Liangtao, et autres
Publié: (2024)
Bridging Time and Space: Decoupled Spatio-Temporal Alignment for Video Grounding
par: Tu, Xuezhen, et autres
Publié: (2026)
par: Tu, Xuezhen, et autres
Publié: (2026)
Cross Space and Time: A Spatio-Temporal Unitized Model for Traffic Flow Forecasting
par: Ruan, Weilin, et autres
Publié: (2024)
par: Ruan, Weilin, et autres
Publié: (2024)
VideoMamba: Spatio-Temporal Selective State Space Model
par: Park, Jinyoung, et autres
Publié: (2024)
par: Park, Jinyoung, et autres
Publié: (2024)
A Novel State Space Model with Local Enhancement and State Sharing for Image Fusion
par: Cao, Zihan, et autres
Publié: (2024)
par: Cao, Zihan, et autres
Publié: (2024)
Exploiting Multimodal Spatial-temporal Patterns for Video Object Tracking
par: Hu, Xiantao, et autres
Publié: (2024)
par: Hu, Xiantao, et autres
Publié: (2024)
Spatio-Temporal State Space Model For Efficient Event-Based Optical Flow
par: Humais, Muhammad Ahmed, et autres
Publié: (2025)
par: Humais, Muhammad Ahmed, et autres
Publié: (2025)
EventMamba: Enhancing Spatio-Temporal Locality with State Space Models for Event-Based Video Reconstruction
par: Ge, Chengjie, et autres
Publié: (2025)
par: Ge, Chengjie, et autres
Publié: (2025)
Genesis: Multimodal Driving Scene Generation with Spatio-Temporal and Cross-Modal Consistency
par: Guo, Xiangyu, et autres
Publié: (2025)
par: Guo, Xiangyu, et autres
Publié: (2025)
Explicit Context Reasoning with Supervision for Visual Tracking
par: Zeng, Fansheng, et autres
Publié: (2025)
par: Zeng, Fansheng, et autres
Publié: (2025)
UniTS: Unified Spatio-Temporal Generative Model for Remote Sensing
par: Zhang, Yuxiang, et autres
Publié: (2025)
par: Zhang, Yuxiang, et autres
Publié: (2025)
Mining Multi-Modality Spatio-Temporal Cues for Video Important Person Identification
par: Wang, Xiao, et autres
Publié: (2026)
par: Wang, Xiao, et autres
Publié: (2026)
MambaVT: Spatio-Temporal Contextual Modeling for robust RGB-T Tracking
par: Lai, Simiao, et autres
Publié: (2024)
par: Lai, Simiao, et autres
Publié: (2024)
VMambaMorph: a Multi-Modality Deformable Image Registration Framework based on Visual State Space Model with Cross-Scan Module
par: Wang, Ziyang, et autres
Publié: (2024)
par: Wang, Ziyang, et autres
Publié: (2024)
Exploring Modality-Aware Fusion and Decoupled Temporal Propagation for Multi-Modal Object Tracking
par: Wang, Shilei, et autres
Publié: (2026)
par: Wang, Shilei, et autres
Publié: (2026)
Transformer RGBT Tracking with Spatio-Temporal Multimodal Tokens
par: Sun, Dengdi, et autres
Publié: (2024)
par: Sun, Dengdi, et autres
Publié: (2024)
SMTrack: End-to-End Trained Spiking Neural Networks for Multi-Object Tracking in RGB Videos
par: Zhong, Pengzhi, et autres
Publié: (2025)
par: Zhong, Pengzhi, et autres
Publié: (2025)
HAD: Hierarchical Asymmetric Distillation to Bridge Spatio-Temporal Gaps in Event-Based Object Tracking
par: Deng, Yao, et autres
Publié: (2025)
par: Deng, Yao, et autres
Publié: (2025)
Multi-Modal Video Dialog State Tracking in the Wild
par: Abdessaied, Adnen, et autres
Publié: (2024)
par: Abdessaied, Adnen, et autres
Publié: (2024)
State Space Prompting via Gathering and Spreading Spatio-Temporal Information for Video Understanding
par: Zhou, Jiahuan, et autres
Publié: (2025)
par: Zhou, Jiahuan, et autres
Publié: (2025)
Mixture-of-Mamba: Enhancing Multi-Modal State-Space Models with Modality-Aware Sparsity
par: Liang, Weixin, et autres
Publié: (2025)
par: Liang, Weixin, et autres
Publié: (2025)
ACTrack: Adding Spatio-Temporal Condition for Visual Object Tracking
par: Han, Yushan, et autres
Publié: (2024)
par: Han, Yushan, et autres
Publié: (2024)
MoChat: Joints-Grouped Spatio-Temporal Grounding LLM for Multi-Turn Motion Comprehension and Description
par: Mo, Jiawei, et autres
Publié: (2024)
par: Mo, Jiawei, et autres
Publié: (2024)
Temporal Correlation Meets Embedding: Towards a 2nd Generation of JDE-based Real-Time Multi-Object Tracking
par: Zhang, Yunfei, et autres
Publié: (2024)
par: Zhang, Yunfei, et autres
Publié: (2024)
Collaborative Multi-Modal Coding for High-Quality 3D Generation
par: Cao, Ziang, et autres
Publié: (2025)
par: Cao, Ziang, et autres
Publié: (2025)
Documents similaires
-
Decoupled Spatio-Temporal Consistency Learning for Self-Supervised Tracking
par: Zheng, Yaozong, et autres
Publié: (2025) -
ODTrack: Online Dense Temporal Token Learning for Visual Tracking
par: Zheng, Yaozong, et autres
Publié: (2024) -
Dynamic Updates for Language Adaptation in Visual-Language Tracking
par: Li, Xiaohai, et autres
Publié: (2025) -
MambaLCT: Boosting Tracking via Long-term Context State Space Model
par: Li, Xiaohai, et autres
Publié: (2024) -
Robust RGB-T Tracking via Learnable Visual Fourier Prompt Fine-tuning and Modality Fusion Prompt Generation
par: Yang, Hongtao, et autres
Publié: (2025)