Dynamic Disentangled Fusion Network for RGBT Tracking
Fuente:
arXiv
Guardado en:
| Autores principales: | Li, Chenglong, Wang, Tao, Ding, Zhaodong, Xiao, Yun, Tang, Jin |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
AFter: Attention-based Fusion Router for RGBT Tracking
por: Lu, Andong, et al.
Publicado: (2024)
por: Lu, Andong, et al.
Publicado: (2024)
RGBT Tracking via All-layer Multimodal Interactions with Progressive Fusion Mamba
por: Lu, Andong, et al.
Publicado: (2024)
por: Lu, Andong, et al.
Publicado: (2024)
Breaking Shallow Limits: Task-Driven Pixel Fusion for Gap-free RGBT Tracking
por: Lu, Andong, et al.
Publicado: (2025)
por: Lu, Andong, et al.
Publicado: (2025)
Breaking Modality Gap in RGBT Tracking: Coupled Knowledge Distillation
por: Lu, Andong, et al.
Publicado: (2024)
por: Lu, Andong, et al.
Publicado: (2024)
Cross-modulated Attention Transformer for RGBT Tracking
por: Xiao, Yun, et al.
Publicado: (2024)
por: Xiao, Yun, et al.
Publicado: (2024)
Modality-missing RGBT Tracking: Invertible Prompt Learning and High-quality Benchmarks
por: Lu, Andong, et al.
Publicado: (2023)
por: Lu, Andong, et al.
Publicado: (2023)
Transformer RGBT Tracking with Spatio-Temporal Multimodal Tokens
por: Sun, Dengdi, et al.
Publicado: (2024)
por: Sun, Dengdi, et al.
Publicado: (2024)
Decoupled Cross-Modal Alignment Network for Text-RGBT Person Retrieval and A High-Quality Benchmark
por: Deng, Yifei, et al.
Publicado: (2025)
por: Deng, Yifei, et al.
Publicado: (2025)
Graph-based Semantic Calibration Network for Unaligned UAV RGBT Image Semantic Segmentation and A Large-scale Benchmark
por: Fan, Fangqiang, et al.
Publicado: (2026)
por: Fan, Fangqiang, et al.
Publicado: (2026)
X Modality Assisting RGBT Object Tracking
por: Ding, Zhaisheng, et al.
Publicado: (2023)
por: Ding, Zhaisheng, et al.
Publicado: (2023)
Temporal Adaptive RGBT Tracking with Modality Prompt
por: Wang, Hongyu, et al.
Publicado: (2024)
por: Wang, Hongyu, et al.
Publicado: (2024)
Multimodal Spatio-temporal Graph Learning for Alignment-free RGBT Video Object Detection
por: Wang, Qishun, et al.
Publicado: (2025)
por: Wang, Qishun, et al.
Publicado: (2025)
Alignment-Free RGBT Salient Object Detection: Semantics-guided Asymmetric Correlation Network and A Unified Benchmark
por: Wang, Kunpeng, et al.
Publicado: (2024)
por: Wang, Kunpeng, et al.
Publicado: (2024)
RAGTrack: Language-aware RGBT Tracking with Retrieval-Augmented Generation
por: Li, Hao, et al.
Publicado: (2026)
por: Li, Hao, et al.
Publicado: (2026)
Visible-Thermal Multiple Object Tracking: Large-scale Video Dataset and Progressive Fusion Approach
por: Zhu, Yabin, et al.
Publicado: (2024)
por: Zhu, Yabin, et al.
Publicado: (2024)
CADTrack: Learning Contextual Aggregation with Deformable Alignment for Robust RGBT Tracking
por: Li, Hao, et al.
Publicado: (2025)
por: Li, Hao, et al.
Publicado: (2025)
Revisiting RGBT Tracking Benchmarks from the Perspective of Modality Validity: A New Benchmark, Problem, and Solution
por: Tang, Zhangyong, et al.
Publicado: (2024)
por: Tang, Zhangyong, et al.
Publicado: (2024)
DCG ReID: Disentangling Collaboration and Guidance Fusion Representations for Multi-modal Vehicle Re-Identification
por: Zheng, Aihua, et al.
Publicado: (2026)
por: Zheng, Aihua, et al.
Publicado: (2026)
Pedestrian Attribute Recognition via CLIP based Prompt Vision-Language Fusion
por: Wang, Xiao, et al.
Publicado: (2023)
por: Wang, Xiao, et al.
Publicado: (2023)
Text-Guided Coarse-to-Fine Fusion Network for Robust Remote Sensing Visual Question Answering
por: Zhao, Zhicheng, et al.
Publicado: (2024)
por: Zhao, Zhicheng, et al.
Publicado: (2024)
Guidance Disentanglement Network for Optics-Guided Thermal UAV Image Super-Resolution
por: Zhao, Zhicheng, et al.
Publicado: (2024)
por: Zhao, Zhicheng, et al.
Publicado: (2024)
Sparse-Dense Mixture of Experts Adapter for Multi-Modal Tracking
por: Zhu, Yabin, et al.
Publicado: (2026)
por: Zhu, Yabin, et al.
Publicado: (2026)
DeTrack: A Benchmark and Altitude-Aware Dual World Model for Drone-embodied Tracking
por: Hu, Guyue, et al.
Publicado: (2026)
por: Hu, Guyue, et al.
Publicado: (2026)
Towards General Multimodal Visual Tracking
por: Lu, Andong, et al.
Publicado: (2025)
por: Lu, Andong, et al.
Publicado: (2025)
Towards Robust Optical-SAR Object Detection under Missing Modalities: A Dynamic Quality-Aware Fusion Framework
por: Zhao, Zhicheng, et al.
Publicado: (2025)
por: Zhao, Zhicheng, et al.
Publicado: (2025)
RGBT-Ground Benchmark: Visual Grounding Beyond RGB in Complex Real-World Scenarios
por: Zhao, Tianyi, et al.
Publicado: (2025)
por: Zhao, Tianyi, et al.
Publicado: (2025)
COXNet: Cross-Layer Fusion with Adaptive Alignment and Scale Integration for RGBT Tiny Object Detection
por: Peng, Peiran, et al.
Publicado: (2025)
por: Peng, Peiran, et al.
Publicado: (2025)
Collaborative Enhancement Network for Low-quality Multi-spectral Vehicle Re-identification
por: Zheng, Aihua, et al.
Publicado: (2025)
por: Zheng, Aihua, et al.
Publicado: (2025)
M-SpecGene: Generalized Foundation Model for RGBT Multispectral Vision
por: Zhou, Kailai, et al.
Publicado: (2025)
por: Zhou, Kailai, et al.
Publicado: (2025)
CattleFace-RGBT: RGB-T Cattle Facial Landmark Benchmark
por: Coffman, Ethan, et al.
Publicado: (2024)
por: Coffman, Ethan, et al.
Publicado: (2024)
CRSOT: Cross-Resolution Object Tracking using Unaligned Frame and Event Cameras
por: Zhu, Yabin, et al.
Publicado: (2024)
por: Zhu, Yabin, et al.
Publicado: (2024)
Cognitive Disentanglement for Referring Multi-Object Tracking
por: Liang, Shaofeng, et al.
Publicado: (2025)
por: Liang, Shaofeng, et al.
Publicado: (2025)
Contrast-Phys: Unsupervised Video-based Remote Physiological Measurement via Spatiotemporal Contrast
por: Sun, Zhaodong, et al.
Publicado: (2022)
por: Sun, Zhaodong, et al.
Publicado: (2022)
Contrast-Phys+: Unsupervised and Weakly-supervised Video-based Remote Physiological Measurement via Spatiotemporal Contrast
por: Sun, Zhaodong, et al.
Publicado: (2023)
por: Sun, Zhaodong, et al.
Publicado: (2023)
Cross-modal Fuzzy Alignment Network for Text-Aerial Person Retrieval and A Large-scale Benchmark
por: Deng, Yifei, et al.
Publicado: (2026)
por: Deng, Yifei, et al.
Publicado: (2026)
Nighttime Person Re-Identification via Collaborative Enhancement Network with Multi-domain Learning
por: Lu, Andong, et al.
Publicado: (2023)
por: Lu, Andong, et al.
Publicado: (2023)
Mixture of Scale Experts for Alignment-free RGBT Video Object Detection and A Unified Benchmark
por: Wang, Qishun, et al.
Publicado: (2024)
por: Wang, Qishun, et al.
Publicado: (2024)
MTNet: Learning modality-aware representation with transformer for RGBT tracking
por: Hou, Ruichao, et al.
Publicado: (2025)
por: Hou, Ruichao, et al.
Publicado: (2025)
Mitigating the Impact of Prominent Position Shift in Drone-based RGBT Object Detection
por: Zhang, Yan, et al.
Publicado: (2025)
por: Zhang, Yan, et al.
Publicado: (2025)
Physics-Constrained Cross-Resolution Enhancement Network for Optics-Guided Thermal UAV Image Super-Resolution
por: Zhao, Zhicheng, et al.
Publicado: (2026)
por: Zhao, Zhicheng, et al.
Publicado: (2026)
Ejemplares similares
-
AFter: Attention-based Fusion Router for RGBT Tracking
por: Lu, Andong, et al.
Publicado: (2024) -
RGBT Tracking via All-layer Multimodal Interactions with Progressive Fusion Mamba
por: Lu, Andong, et al.
Publicado: (2024) -
Breaking Shallow Limits: Task-Driven Pixel Fusion for Gap-free RGBT Tracking
por: Lu, Andong, et al.
Publicado: (2025) -
Breaking Modality Gap in RGBT Tracking: Coupled Knowledge Distillation
por: Lu, Andong, et al.
Publicado: (2024) -
Cross-modulated Attention Transformer for RGBT Tracking
por: Xiao, Yun, et al.
Publicado: (2024)