Uni-MDTrack: Learning Decoupled Memory and Dynamic States for Parameter-Efficient Visual Tracking in All Modality
Fuente:
arXiv
Salvato in:
| Autori principali: | Cai, Wenrui, Lu, Zhenyi, Li, Yuzhe, Feng, Yongchao, Zhang, Jinqing, Liu, Qingjie, Wang, Yunhong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
SPMTrack: Spatio-Temporal Parameter-Efficient Fine-Tuning with Mixture of Experts for Scalable Visual Tracking
di: Cai, Wenrui, et al.
Pubblicazione: (2025)
di: Cai, Wenrui, et al.
Pubblicazione: (2025)
HIPTrack: Visual Tracking with Historical Prompts
di: Cai, Wenrui, et al.
Pubblicazione: (2023)
di: Cai, Wenrui, et al.
Pubblicazione: (2023)
SkeletonX: Data-Efficient Skeleton-based Action Recognition via Cross-sample Feature Aggregation
di: Zhang, Zongye, et al.
Pubblicazione: (2025)
di: Zhang, Zongye, et al.
Pubblicazione: (2025)
Lightweight Spatial Embedding for Vision-based 3D Occupancy Prediction
di: Zhang, Jinqing, et al.
Pubblicazione: (2024)
di: Zhang, Jinqing, et al.
Pubblicazione: (2024)
MutDet: Mutually Optimizing Pre-training for Remote Sensing Object Detection
di: Huang, Ziyue, et al.
Pubblicazione: (2024)
di: Huang, Ziyue, et al.
Pubblicazione: (2024)
GeoBEV: Learning Geometric BEV Representation for Multi-view 3D Object Detection
di: Zhang, Jinqing, et al.
Pubblicazione: (2024)
di: Zhang, Jinqing, et al.
Pubblicazione: (2024)
PACF: Prototype Augmented Compact Features for Improving Domain Adaptive Object Detection
di: Liu, Chenguang, et al.
Pubblicazione: (2025)
di: Liu, Chenguang, et al.
Pubblicazione: (2025)
ResWorld: Temporal Residual World Model for End-to-End Autonomous Driving
di: Zhang, Jinqing, et al.
Pubblicazione: (2026)
di: Zhang, Jinqing, et al.
Pubblicazione: (2026)
AttriPrompt: Dynamic Prompt Composition Learning for CLIP
di: Zhan, Qiqi, et al.
Pubblicazione: (2025)
di: Zhan, Qiqi, et al.
Pubblicazione: (2025)
OpenRSD: Towards Open-prompts for Object Detection in Remote Sensing Images
di: Huang, Ziyue, et al.
Pubblicazione: (2025)
di: Huang, Ziyue, et al.
Pubblicazione: (2025)
FSD-BEV: Foreground Self-Distillation for Multi-view 3D Object Detection
di: Jiang, Zheng, et al.
Pubblicazione: (2024)
di: Jiang, Zheng, et al.
Pubblicazione: (2024)
UniPT: Universal Parallel Tuning for Transfer Learning with Efficient Parameter and Memory
di: Diao, Haiwen, et al.
Pubblicazione: (2023)
di: Diao, Haiwen, et al.
Pubblicazione: (2023)
DSD-DA: Distillation-based Source Debiasing for Domain Adaptive Object Detection
di: Feng, Yongchao, et al.
Pubblicazione: (2023)
di: Feng, Yongchao, et al.
Pubblicazione: (2023)
Vision-Language Model for Object Detection and Segmentation: A Review and Evaluation
di: Feng, Yongchao, et al.
Pubblicazione: (2025)
di: Feng, Yongchao, et al.
Pubblicazione: (2025)
CtxMIM: Context-Enhanced Masked Image Modeling for Remote Sensing Image Understanding
di: Zhang, Mingming, et al.
Pubblicazione: (2023)
di: Zhang, Mingming, et al.
Pubblicazione: (2023)
HiT: Building Mapping with Hierarchical Transformers
di: Zhang, Mingming, et al.
Pubblicazione: (2023)
di: Zhang, Mingming, et al.
Pubblicazione: (2023)
Incremental Object Detection with CLIP
di: Huang, Ziyue, et al.
Pubblicazione: (2023)
di: Huang, Ziyue, et al.
Pubblicazione: (2023)
Semantic Enhanced Few-shot Object Detection
di: Wang, Zheng, et al.
Pubblicazione: (2024)
di: Wang, Zheng, et al.
Pubblicazione: (2024)
Multi-Timescale Motion-Decoupled Spiking Transformer for Audio-Visual Zero-Shot Learning
di: Li, Wenrui, et al.
Pubblicazione: (2025)
di: Li, Wenrui, et al.
Pubblicazione: (2025)
UniSOT: A Unified Framework for Multi-Modality Single Object Tracking
di: Ma, Yinchao, et al.
Pubblicazione: (2025)
di: Ma, Yinchao, et al.
Pubblicazione: (2025)
Multi-Modal Decouple and Recouple Network for Robust 3D Object Detection
di: Ding, Rui, et al.
Pubblicazione: (2026)
di: Ding, Rui, et al.
Pubblicazione: (2026)
Reasoning-Driven Anomaly Detection and Localization with Image-Level Supervision
di: Jin, Yizhou, et al.
Pubblicazione: (2026)
di: Jin, Yizhou, et al.
Pubblicazione: (2026)
ActiveDC: Distribution Calibration for Active Finetuning
di: Xu, Wenshuai, et al.
Pubblicazione: (2023)
di: Xu, Wenshuai, et al.
Pubblicazione: (2023)
Generic Knowledge Boosted Pre-training For Remote Sensing Images
di: Huang, Ziyue, et al.
Pubblicazione: (2024)
di: Huang, Ziyue, et al.
Pubblicazione: (2024)
Beyond Open Vocabulary: Multimodal Prompting for Object Detection in Remote Sensing Images
di: Yang, Shuai, et al.
Pubblicazione: (2026)
di: Yang, Shuai, et al.
Pubblicazione: (2026)
Exploring Modality-Aware Fusion and Decoupled Temporal Propagation for Multi-Modal Object Tracking
di: Wang, Shilei, et al.
Pubblicazione: (2026)
di: Wang, Shilei, et al.
Pubblicazione: (2026)
Unified Sequence-to-Sequence Learning for Single- and Multi-Modal Visual Object Tracking
di: Chen, Xin, et al.
Pubblicazione: (2023)
di: Chen, Xin, et al.
Pubblicazione: (2023)
Exploring Active Learning for Label-Efficient Training of Semantic Neural Radiance Field
di: Zhu, Yuzhe, et al.
Pubblicazione: (2025)
di: Zhu, Yuzhe, et al.
Pubblicazione: (2025)
VL-UniTrack: A Unified Framework with Visual-Language Prompts for UAV-Ground Visual Tracking
di: Xu, Boyue, et al.
Pubblicazione: (2026)
di: Xu, Boyue, et al.
Pubblicazione: (2026)
Time-, Memory- and Parameter-Efficient Visual Adaptation
di: Mercea, Otniel-Bogdan, et al.
Pubblicazione: (2024)
di: Mercea, Otniel-Bogdan, et al.
Pubblicazione: (2024)
CST: Calibration Side-Tuning for Parameter and Memory Efficient Transfer Learning
di: Chen, Feng
Pubblicazione: (2024)
di: Chen, Feng
Pubblicazione: (2024)
Efficient Motion Prompt Learning for Robust Visual Tracking
di: Zhao, Jie, et al.
Pubblicazione: (2025)
di: Zhao, Jie, et al.
Pubblicazione: (2025)
Towards Robust and Controllable Text-to-Motion via Masked Autoregressive Diffusion
di: Zhang, Zongye, et al.
Pubblicazione: (2025)
di: Zhang, Zongye, et al.
Pubblicazione: (2025)
UniCMs: A Unified Consistency Model For Efficient Multimodal Generation and Understanding
di: Xu, Chenkai, et al.
Pubblicazione: (2025)
di: Xu, Chenkai, et al.
Pubblicazione: (2025)
Learning Frequency and Memory-Aware Prompts for Multi-Modal Object Tracking
di: Xu, Boyue, et al.
Pubblicazione: (2025)
di: Xu, Boyue, et al.
Pubblicazione: (2025)
Mem4D: Decoupling Static and Dynamic Memory for Dynamic Scene Reconstruction
di: Cai, Xudong, et al.
Pubblicazione: (2025)
di: Cai, Xudong, et al.
Pubblicazione: (2025)
Parameter-Efficient Modality-Balanced Symmetric Fusion for Multimodal Remote Sensing Semantic Segmentation
di: Li, Haocheng, et al.
Pubblicazione: (2026)
di: Li, Haocheng, et al.
Pubblicazione: (2026)
UniTrack: Differentiable Graph Representation Learning for Multi-Object Tracking
di: Galoaa, Bishoy, et al.
Pubblicazione: (2026)
di: Galoaa, Bishoy, et al.
Pubblicazione: (2026)
MDReID: Modality-Decoupled Learning for Any-to-Any Multi-Modal Object Re-Identification
di: Feng, Yingying, et al.
Pubblicazione: (2025)
di: Feng, Yingying, et al.
Pubblicazione: (2025)
Offline Preference Optimization for Rectified Flow with Noise-Tracked Pairs
di: Lu, Yunhong, et al.
Pubblicazione: (2026)
di: Lu, Yunhong, et al.
Pubblicazione: (2026)
Documenti analoghi
-
SPMTrack: Spatio-Temporal Parameter-Efficient Fine-Tuning with Mixture of Experts for Scalable Visual Tracking
di: Cai, Wenrui, et al.
Pubblicazione: (2025) -
HIPTrack: Visual Tracking with Historical Prompts
di: Cai, Wenrui, et al.
Pubblicazione: (2023) -
SkeletonX: Data-Efficient Skeleton-based Action Recognition via Cross-sample Feature Aggregation
di: Zhang, Zongye, et al.
Pubblicazione: (2025) -
Lightweight Spatial Embedding for Vision-based 3D Occupancy Prediction
di: Zhang, Jinqing, et al.
Pubblicazione: (2024) -
MutDet: Mutually Optimizing Pre-training for Remote Sensing Object Detection
di: Huang, Ziyue, et al.
Pubblicazione: (2024)