Modality-Guided Dynamic Graph Fusion and Temporal Diffusion for Self-Supervised RGB-T Tracking
Fuente:
arXiv
Saved in:
| Main Authors: | Li, Shenglan, Yao, Rui, Zhou, Yong, Zhu, Hancheng, Sun, Kunyang, Liu, Bing, Shao, Zhiwen, Zhao, Jiaqi |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
DTTNet: Improving Video Shadow Detection via Dark-Aware Guidance and Tokenized Temporal Modeling
by: Li, Zhicheng, et al.
Published: (2025)
by: Li, Zhicheng, et al.
Published: (2025)
Facial Action Unit Detection by Adaptively Constraining Self-Attention and Causally Deconfounding Sample
by: Shao, Zhiwen, et al.
Published: (2024)
by: Shao, Zhiwen, et al.
Published: (2024)
Content-Adaptive Image Retouching Guided by Attribute-Based Text Representation
by: Zhu, Hancheng, et al.
Published: (2025)
by: Zhu, Hancheng, et al.
Published: (2025)
DiffusionLane: Diffusion Model for Lane Detection
by: Zhou, Kunyang, et al.
Published: (2025)
by: Zhou, Kunyang, et al.
Published: (2025)
Dynamic Subframe Splitting and Spatio-Temporal Motion Entangled Sparse Attention for RGB-E Tracking
by: Shao, Pengcheng, et al.
Published: (2024)
by: Shao, Pengcheng, et al.
Published: (2024)
Multi-Modality Spatio-Temporal Forecasting via Self-Supervised Learning
by: Deng, Jiewen, et al.
Published: (2024)
by: Deng, Jiewen, et al.
Published: (2024)
RQFormer: Rotated Query Transformer for End-to-End Oriented Object Detection
by: Zhao, Jiaqi, et al.
Published: (2023)
by: Zhao, Jiaqi, et al.
Published: (2023)
OrientedFormer: An End-to-End Transformer-Based Oriented Object Detector in Remote Sensing Images
by: Zhao, Jiaqi, et al.
Published: (2024)
by: Zhao, Jiaqi, et al.
Published: (2024)
Modality-Decoupled RGB-Thermal Object Detector via Query Fusion
by: Tian, Chao, et al.
Published: (2026)
by: Tian, Chao, et al.
Published: (2026)
Cross Fusion RGB-T Tracking with Bi-directional Adapter
by: Zeng, Zhirong, et al.
Published: (2024)
by: Zeng, Zhirong, et al.
Published: (2024)
TENet: Targetness Entanglement Incorporating with Multi-Scale Pooling and Mutually-Guided Fusion for RGB-E Object Tracking
by: Shao, Pengcheng, et al.
Published: (2024)
by: Shao, Pengcheng, et al.
Published: (2024)
Self-Supervised Temporal Graph learning with Temporal and Structural Intensity Alignment
by: Liu, Meng, et al.
Published: (2023)
by: Liu, Meng, et al.
Published: (2023)
Robust RGB-T Tracking via Learnable Visual Fourier Prompt Fine-tuning and Modality Fusion Prompt Generation
by: Yang, Hongtao, et al.
Published: (2025)
by: Yang, Hongtao, et al.
Published: (2025)
Exploring Modality-Aware Fusion and Decoupled Temporal Propagation for Multi-Modal Object Tracking
by: Wang, Shilei, et al.
Published: (2026)
by: Wang, Shilei, et al.
Published: (2026)
BTMTrack: Robust RGB-T Tracking via Dual-template Bridging and Temporal-Modal Candidate Elimination
by: Zhang, Zhongxuan, et al.
Published: (2025)
by: Zhang, Zhongxuan, et al.
Published: (2025)
Lane2Seq: Towards Unified Lane Detection via Sequence Generation
by: Zhou, Kunyang
Published: (2024)
by: Zhou, Kunyang
Published: (2024)
Adaptive Spatio-Temporal Graphs with Self-Supervised Pretraining for Multi-Horizon Weather Forecasting
by: Liu, Yao
Published: (2025)
by: Liu, Yao
Published: (2025)
OmniSat: Self-Supervised Modality Fusion for Earth Observation
by: Astruc, Guillaume, et al.
Published: (2024)
by: Astruc, Guillaume, et al.
Published: (2024)
Event-Adaptive State Transition and Gated Fusion for RGB-Event Object Tracking
by: You, Jinlin, et al.
Published: (2026)
by: You, Jinlin, et al.
Published: (2026)
Type Information-Assisted Self-Supervised Knowledge Graph Denoising
by: Sun, Jiaqi, et al.
Published: (2025)
by: Sun, Jiaqi, et al.
Published: (2025)
MambaVT: Spatio-Temporal Contextual Modeling for robust RGB-T Tracking
by: Lai, Simiao, et al.
Published: (2024)
by: Lai, Simiao, et al.
Published: (2024)
Trust-Gated RGB-Depth Fusion and Self-Supervised Spatiotemporal Modelling for Crowd Anomaly Detection
by: Ms.Sindhu T, et al.
Published: (2026)
by: Ms.Sindhu T, et al.
Published: (2026)
Decoupled Spatio-Temporal Consistency Learning for Self-Supervised Tracking
by: Zheng, Yaozong, et al.
Published: (2025)
by: Zheng, Yaozong, et al.
Published: (2025)
Modality-Aware Infrared and Visible Image Fusion with Target-Aware Supervision
by: Sun, Tianyao, et al.
Published: (2025)
by: Sun, Tianyao, et al.
Published: (2025)
Self-Supervised Multi-Object Tracking with Path Consistency
by: Lu, Zijia, et al.
Published: (2024)
by: Lu, Zijia, et al.
Published: (2024)
Temporal Adaptive RGBT Tracking with Modality Prompt
by: Wang, Hongyu, et al.
Published: (2024)
by: Wang, Hongyu, et al.
Published: (2024)
R2H-Diff: Guided Spectral Diffusion Model for RGB-to-Hyperspectral Reconstruction
by: Ding, Songyu, et al.
Published: (2026)
by: Ding, Songyu, et al.
Published: (2026)
Transformer-based RGB-T Tracking with Channel and Spatial Feature Fusion
by: Li, Yunfeng, et al.
Published: (2024)
by: Li, Yunfeng, et al.
Published: (2024)
Multi-Floor Exploration for Ground Robots via an Incremental Reachable Graph and Structural Priors
by: Zhu, Zhiwen, et al.
Published: (2026)
by: Zhu, Zhiwen, et al.
Published: (2026)
Self-Supervised Contrastive Graph Clustering Network via Structural Information Fusion
by: Ji, Xiaoyang, et al.
Published: (2024)
by: Ji, Xiaoyang, et al.
Published: (2024)
Knowledge-Guided Dynamic Modality Attention Fusion Framework for Multimodal Sentiment Analysis
by: Feng, Xinyu, et al.
Published: (2024)
by: Feng, Xinyu, et al.
Published: (2024)
RAFT-MSF++: Temporal Geometry-Motion Feature Fusion for Self-Supervised Monocular Scene Flow
by: Sun, Xunpei, et al.
Published: (2026)
by: Sun, Xunpei, et al.
Published: (2026)
Frequency-Guided Fusion For RGB-Thermal Semantic Segmentation
by: Canıtez, İsmail Emre, et al.
Published: (2026)
by: Canıtez, İsmail Emre, et al.
Published: (2026)
Audio-Guided Dynamic Modality Fusion with Stereo-Aware Attention for Audio-Visual Navigation
by: Li, Jia, et al.
Published: (2025)
by: Li, Jia, et al.
Published: (2025)
Cross-Modal Clustering-Guided Negative Sampling for Self-Supervised Joint Learning from Medical Images and Reports
by: Lan, Libin, et al.
Published: (2025)
by: Lan, Libin, et al.
Published: (2025)
RGB-D Tracking via Hierarchical Modality Aggregation and Distribution Network
by: Xu, Boyue, et al.
Published: (2025)
by: Xu, Boyue, et al.
Published: (2025)
LLMTM: Benchmarking and Optimizing LLMs for Temporal Motif Analysis in Dynamic Graphs
by: Hao, Bing, et al.
Published: (2025)
by: Hao, Bing, et al.
Published: (2025)
Cross-Modal Purification and Fusion for Small-Object RGB-D Transmission-Line Defect Detection
by: Cui, Jiaming, et al.
Published: (2026)
by: Cui, Jiaming, et al.
Published: (2026)
DepthMatch: Semi-Supervised RGB-D Scene Parsing through Depth-Guided Regularization
by: Huang, Jianxin, et al.
Published: (2025)
by: Huang, Jianxin, et al.
Published: (2025)
RGB-Event Fusion with Self-Attention for Collision Prediction
by: Bonazzi, Pietro, et al.
Published: (2025)
by: Bonazzi, Pietro, et al.
Published: (2025)
Similar Items
-
DTTNet: Improving Video Shadow Detection via Dark-Aware Guidance and Tokenized Temporal Modeling
by: Li, Zhicheng, et al.
Published: (2025) -
Facial Action Unit Detection by Adaptively Constraining Self-Attention and Causally Deconfounding Sample
by: Shao, Zhiwen, et al.
Published: (2024) -
Content-Adaptive Image Retouching Guided by Attribute-Based Text Representation
by: Zhu, Hancheng, et al.
Published: (2025) -
DiffusionLane: Diffusion Model for Lane Detection
by: Zhou, Kunyang, et al.
Published: (2025) -
Dynamic Subframe Splitting and Spatio-Temporal Motion Entangled Sparse Attention for RGB-E Tracking
by: Shao, Pengcheng, et al.
Published: (2024)