Learning Progressive Adaptation for Multi-Modal Tracking
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, He, Xu, Tianyang, Tang, Zhangyong, Wu, Xiao-Jun, Kittler, Josef |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
UASTrack: A Unified Adaptive Selection Framework with Modality-Customization in Single Object Tracking
par: Wang, He, et autres
Publié: (2025)
par: Wang, He, et autres
Publié: (2025)
Serial Over Parallel: Learning Continual Unification for Multi-Modal Visual Object Tracking and Benchmarking
par: Tang, Zhangyong, et autres
Publié: (2025)
par: Tang, Zhangyong, et autres
Publié: (2025)
TENet: Targetness Entanglement Incorporating with Multi-Scale Pooling and Mutually-Guided Fusion for RGB-E Object Tracking
par: Shao, Pengcheng, et autres
Publié: (2024)
par: Shao, Pengcheng, et autres
Publié: (2024)
Revisiting RGBT Tracking Benchmarks from the Perspective of Modality Validity: A New Benchmark, Problem, and Solution
par: Tang, Zhangyong, et autres
Publié: (2024)
par: Tang, Zhangyong, et autres
Publié: (2024)
BusReF: Infrared-Visible images registration and fusion focus on reconstructible area using one set of features
par: Zhang, Zeyang, et autres
Publié: (2023)
par: Zhang, Zeyang, et autres
Publié: (2023)
A Tri-Modal Dataset and a Baseline System for Tracking Unmanned Aerial Vehicles
par: Xu, Tianyang, et autres
Publié: (2025)
par: Xu, Tianyang, et autres
Publié: (2025)
MMDRFuse: Distilled Mini-Model with Dynamic Refresh for Multi-Modality Image Fusion
par: Deng, Yanglin, et autres
Publié: (2024)
par: Deng, Yanglin, et autres
Publié: (2024)
Multi-Paradigm Collaborative Adversarial Attack Against Multi-Modal Large Language Models
par: Li, Yuanbo, et autres
Publié: (2026)
par: Li, Yuanbo, et autres
Publié: (2026)
Collaborating Vision, Depth, and Thermal Signals for Multi-Modal Tracking: Dataset and Algorithm
par: Zhu, Xue-Feng, et autres
Publié: (2025)
par: Zhu, Xue-Feng, et autres
Publié: (2025)
Omni Survey for Multimodality Analysis in Visual Object Tracking
par: Tang, Zhangyong, et autres
Publié: (2025)
par: Tang, Zhangyong, et autres
Publié: (2025)
EvaNet: Towards More Efficient and Consistent Infrared and Visible Image Fusion Assessment
par: Cheng, Chunyang, et autres
Publié: (2026)
par: Cheng, Chunyang, et autres
Publié: (2026)
TextFusion: Unveiling the Power of Textual Semantics for Controllable Image Fusion
par: Cheng, Chunyang, et autres
Publié: (2023)
par: Cheng, Chunyang, et autres
Publié: (2023)
An Improved Graph Pooling Network for Skeleton-Based Action Recognition
par: Wu, Cong, et autres
Publié: (2024)
par: Wu, Cong, et autres
Publié: (2024)
Dynamic Subframe Splitting and Spatio-Temporal Motion Entangled Sparse Attention for RGB-E Tracking
par: Shao, Pengcheng, et autres
Publié: (2024)
par: Shao, Pengcheng, et autres
Publié: (2024)
UniSOT: A Unified Framework for Multi-Modality Single Object Tracking
par: Ma, Yinchao, et autres
Publié: (2025)
par: Ma, Yinchao, et autres
Publié: (2025)
Learning Topology-Driven Multi-Subspace Fusion for Grassmannian Deep Network
par: Yu, Xuan, et autres
Publié: (2025)
par: Yu, Xuan, et autres
Publié: (2025)
Decoupling Stability and Plasticity for Multi-Modal Test-Time Adaptation
par: He, Yongbo, et autres
Publié: (2026)
par: He, Yongbo, et autres
Publié: (2026)
Pseudo Labelling for Enhanced Masked Autoencoders
par: Nandam, Srinivasa Rao, et autres
Publié: (2024)
par: Nandam, Srinivasa Rao, et autres
Publié: (2024)
One Model for ALL: Low-Level Task Interaction Is a Key to Task-Agnostic Image Fusion
par: Cheng, Chunyang, et autres
Publié: (2025)
par: Cheng, Chunyang, et autres
Publié: (2025)
Towards Highly Transferable Vision-Language Attack via Semantic-Augmented Dynamic Contrastive Interaction
par: Li, Yuanbo, et autres
Publié: (2026)
par: Li, Yuanbo, et autres
Publié: (2026)
Pedestrian Attribute Recognition via Hierarchical Cross-Modality HyperGraph Learning
par: Wang, Xiao, et autres
Publié: (2025)
par: Wang, Xiao, et autres
Publié: (2025)
M$^2$IV: Towards Efficient and Fine-grained Multimodal In-Context Learning via Representation Engineering
par: Li, Yanshu, et autres
Publié: (2025)
par: Li, Yanshu, et autres
Publié: (2025)
Progressive Energy-Based Cooperative Learning for Multi-Domain Image-to-Image Translation
par: Song, Weinan, et autres
Publié: (2023)
par: Song, Weinan, et autres
Publié: (2023)
All in One: Exploring Unified Vision-Language Tracking with Multi-Modal Alignment
par: Zhang, Chunhui, et autres
Publié: (2023)
par: Zhang, Chunhui, et autres
Publié: (2023)
Progressive Representation Learning for Real-Time UAV Tracking
par: Fu, Changhong, et autres
Publié: (2024)
par: Fu, Changhong, et autres
Publié: (2024)
PortraitTalk: Towards Customizable One-Shot Audio-to-Talking Face Generation
par: Nazarieh, Fatemeh, et autres
Publié: (2024)
par: Nazarieh, Fatemeh, et autres
Publié: (2024)
Spatio-temporal Graph Learning on Adaptive Mined Key Frames for High-performance Multi-Object Tracking
par: Wang, Futian, et autres
Publié: (2025)
par: Wang, Futian, et autres
Publié: (2025)
MMXU: A Multi-Modal and Multi-X-ray Understanding Dataset for Disease Progression
par: Mu, Linjie, et autres
Publié: (2025)
par: Mu, Linjie, et autres
Publié: (2025)
SMLNet: A SPD Manifold Learning Network for Infrared and Visible Image Fusion
par: Kang, Huan, et autres
Publié: (2024)
par: Kang, Huan, et autres
Publié: (2024)
Progressive Multi-Source Domain Adaptation for Personalized Facial Expression Recognition
par: Zeeshan, Muhammad Osama, et autres
Publié: (2025)
par: Zeeshan, Muhammad Osama, et autres
Publié: (2025)
H-MBA: Hierarchical MamBa Adaptation for Multi-Modal Video Understanding in Autonomous Driving
par: Chen, Siran, et autres
Publié: (2025)
par: Chen, Siran, et autres
Publié: (2025)
C2C: Component-to-Composition Learning for Zero-Shot Compositional Action Recognition
par: Li, Rongchang, et autres
Publié: (2024)
par: Li, Rongchang, et autres
Publié: (2024)
Mining Multi-Modality Spatio-Temporal Cues for Video Important Person Identification
par: Wang, Xiao, et autres
Publié: (2026)
par: Wang, Xiao, et autres
Publié: (2026)
Beyond Strict Pairing: Arbitrarily Paired Training for High-Performance Infrared and Visible Image Fusion
par: Deng, Yanglin, et autres
Publié: (2026)
par: Deng, Yanglin, et autres
Publié: (2026)
Multi-modal Test-time Adaptation via Adaptive Probabilistic Gaussian Calibration
par: Xu, Jinglin, et autres
Publié: (2026)
par: Xu, Jinglin, et autres
Publié: (2026)
FusionBooster: A Unified Image Fusion Boosting Paradigm
par: Cheng, Chunyang, et autres
Publié: (2023)
par: Cheng, Chunyang, et autres
Publié: (2023)
CLAMP: Contrastive Learning with Adaptive Multi-loss and Progressive Fusion for Multimodal Aspect-Based Sentiment Analysis
par: He, Xiaoqiang
Publié: (2025)
par: He, Xiaoqiang
Publié: (2025)
Adaptive Hyper-Graph Convolution Network for Skeleton-based Human Action Recognition with Virtual Connections
par: Zhou, Youwei, et autres
Publié: (2024)
par: Zhou, Youwei, et autres
Publié: (2024)
Customize Segment Anything Model for Multi-Modal Semantic Segmentation with Mixture of LoRA Experts
par: Zhu, Chenyang, et autres
Publié: (2024)
par: Zhu, Chenyang, et autres
Publié: (2024)
Multi-Prompt with Depth Partitioned Cross-Modal Learning
par: Tian, Yingjie, et autres
Publié: (2023)
par: Tian, Yingjie, et autres
Publié: (2023)
Documents similaires
-
UASTrack: A Unified Adaptive Selection Framework with Modality-Customization in Single Object Tracking
par: Wang, He, et autres
Publié: (2025) -
Serial Over Parallel: Learning Continual Unification for Multi-Modal Visual Object Tracking and Benchmarking
par: Tang, Zhangyong, et autres
Publié: (2025) -
TENet: Targetness Entanglement Incorporating with Multi-Scale Pooling and Mutually-Guided Fusion for RGB-E Object Tracking
par: Shao, Pengcheng, et autres
Publié: (2024) -
Revisiting RGBT Tracking Benchmarks from the Perspective of Modality Validity: A New Benchmark, Problem, and Solution
par: Tang, Zhangyong, et autres
Publié: (2024) -
BusReF: Infrared-Visible images registration and fusion focus on reconstructible area using one set of features
par: Zhang, Zeyang, et autres
Publié: (2023)