Visible-Thermal Multiple Object Tracking: Large-scale Video Dataset and Progressive Fusion Approach
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhu, Yabin, Wang, Qianwu, Li, Chenglong, Tang, Jin, Huang, Zhixiang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
CRSOT: Cross-Resolution Object Tracking using Unaligned Frame and Event Cameras
por: Zhu, Yabin, et al.
Publicado: (2024)
por: Zhu, Yabin, et al.
Publicado: (2024)
Sparse-Dense Mixture of Experts Adapter for Multi-Modal Tracking
por: Zhu, Yabin, et al.
Publicado: (2026)
por: Zhu, Yabin, et al.
Publicado: (2026)
RGBT Tracking via All-layer Multimodal Interactions with Progressive Fusion Mamba
por: Lu, Andong, et al.
Publicado: (2024)
por: Lu, Andong, et al.
Publicado: (2024)
Alignment-Free RGB-T Salient Object Detection: A Large-scale Dataset and Progressive Correlation Network
por: Wang, Kunpeng, et al.
Publicado: (2024)
por: Wang, Kunpeng, et al.
Publicado: (2024)
Dynamic Disentangled Fusion Network for RGBT Tracking
por: Li, Chenglong, et al.
Publicado: (2024)
por: Li, Chenglong, et al.
Publicado: (2024)
AFter: Attention-based Fusion Router for RGBT Tracking
por: Lu, Andong, et al.
Publicado: (2024)
por: Lu, Andong, et al.
Publicado: (2024)
SoccerNet-Tracking: Multiple Object Tracking Dataset and Benchmark in Soccer Videos
por: Cioppa, Anthony, et al.
Publicado: (2022)
por: Cioppa, Anthony, et al.
Publicado: (2022)
Progressive Domain Adaptation for Thermal Infrared Object Tracking
por: Li, Qiao, et al.
Publicado: (2024)
por: Li, Qiao, et al.
Publicado: (2024)
Breaking Shallow Limits: Task-Driven Pixel Fusion for Gap-free RGBT Tracking
por: Lu, Andong, et al.
Publicado: (2025)
por: Lu, Andong, et al.
Publicado: (2025)
Visible-Thermal Tiny Object Detection: A Benchmark Dataset and Baselines
por: Ying, Xinyi, et al.
Publicado: (2024)
por: Ying, Xinyi, et al.
Publicado: (2024)
Multiple Object Tracking in Video SAR: A Benchmark and Tracking Baseline
por: Chen, Haoxiang, et al.
Publicado: (2025)
por: Chen, Haoxiang, et al.
Publicado: (2025)
Cross-modal Fuzzy Alignment Network for Text-Aerial Person Retrieval and A Large-scale Benchmark
por: Deng, Yifei, et al.
Publicado: (2026)
por: Deng, Yifei, et al.
Publicado: (2026)
RT-RMOT: A Dataset and Framework for RGB-Thermal Referring Multi-Object Tracking
por: Yu, Yanqiu, et al.
Publicado: (2026)
por: Yu, Yanqiu, et al.
Publicado: (2026)
Bridging the Scale Gap: Balanced Tiny and General Object Detection in Remote Sensing Imagery
por: Zhao, Zhicheng, et al.
Publicado: (2025)
por: Zhao, Zhicheng, et al.
Publicado: (2025)
Navigation Around Unknown Space Objects Using Visible-Thermal Image Fusion
por: Elias, Eric J., et al.
Publicado: (2025)
por: Elias, Eric J., et al.
Publicado: (2025)
Language-Depth Navigated Thermal and Visible Image Fusion
por: Zhang, Jinchang, et al.
Publicado: (2025)
por: Zhang, Jinchang, et al.
Publicado: (2025)
Graph-based Semantic Calibration Network for Unaligned UAV RGBT Image Semantic Segmentation and A Large-scale Benchmark
por: Fan, Fangqiang, et al.
Publicado: (2026)
por: Fan, Fangqiang, et al.
Publicado: (2026)
Towards Robust Optical-SAR Object Detection under Missing Modalities: A Dynamic Quality-Aware Fusion Framework
por: Zhao, Zhicheng, et al.
Publicado: (2025)
por: Zhao, Zhicheng, et al.
Publicado: (2025)
Large Language Model Guided Progressive Feature Alignment for Multimodal UAV Object Detection
por: Wu, Wentao, et al.
Publicado: (2025)
por: Wu, Wentao, et al.
Publicado: (2025)
HOIGen-1M: A Large-scale Dataset for Human-Object Interaction Video Generation
por: Liu, Kun, et al.
Publicado: (2025)
por: Liu, Kun, et al.
Publicado: (2025)
Learning Adaptive Fusion Bank for Multi-modal Salient Object Detection
por: Wang, Kunpeng, et al.
Publicado: (2024)
por: Wang, Kunpeng, et al.
Publicado: (2024)
Structure and Progress Aware Diffusion for Medical Image Segmentation
por: Song, Siyuan, et al.
Publicado: (2026)
por: Song, Siyuan, et al.
Publicado: (2026)
BihoT: A Large-Scale Dataset and Benchmark for Hyperspectral Camouflaged Object Tracking
por: Wang, Hanzheng, et al.
Publicado: (2024)
por: Wang, Hanzheng, et al.
Publicado: (2024)
EPOFusion: Exposure aware Progressive Optimization Method for Infrared and Visible Image Fusion
por: Wang, Zhiwei, et al.
Publicado: (2026)
por: Wang, Zhiwei, et al.
Publicado: (2026)
SonarT165: A Large-scale Benchmark and STFTrack Framework for Acoustic Object Tracking
por: Li, Yunfeng, et al.
Publicado: (2025)
por: Li, Yunfeng, et al.
Publicado: (2025)
FutrTrack: A Camera-LiDAR Fusion Transformer for 3D Multiple Object Tracking
por: Teye, Martha Teiko, et al.
Publicado: (2025)
por: Teye, Martha Teiko, et al.
Publicado: (2025)
DeTrack: A Benchmark and Altitude-Aware Dual World Model for Drone-embodied Tracking
por: Hu, Guyue, et al.
Publicado: (2026)
por: Hu, Guyue, et al.
Publicado: (2026)
Multiple Object Tracking as ID Prediction
por: Gao, Ruopeng, et al.
Publicado: (2024)
por: Gao, Ruopeng, et al.
Publicado: (2024)
Online Pseudo-Label Unified Object Detection for Multiple Datasets Training
por: Tang, XiaoJun, et al.
Publicado: (2024)
por: Tang, XiaoJun, et al.
Publicado: (2024)
ViFu: Multiple 360$^\circ$ Objects Reconstruction with Clean Background via Visible Part Fusion
por: Xu, Tianhan, et al.
Publicado: (2024)
por: Xu, Tianhan, et al.
Publicado: (2024)
Modality-missing RGBT Tracking: Invertible Prompt Learning and High-quality Benchmarks
por: Lu, Andong, et al.
Publicado: (2023)
por: Lu, Andong, et al.
Publicado: (2023)
Multimodal Spatio-temporal Graph Learning for Alignment-free RGBT Video Object Detection
por: Wang, Qishun, et al.
Publicado: (2025)
por: Wang, Qishun, et al.
Publicado: (2025)
Towards General Multimodal Visual Tracking
por: Lu, Andong, et al.
Publicado: (2025)
por: Lu, Andong, et al.
Publicado: (2025)
TeamTrack: A Dataset for Multi-Sport Multi-Object Tracking in Full-pitch Videos
por: Scott, Atom, et al.
Publicado: (2024)
por: Scott, Atom, et al.
Publicado: (2024)
ICPL-ReID: Identity-Conditional Prompt Learning for Multi-Spectral Object Re-Identification
por: Li, Shihao, et al.
Publicado: (2025)
por: Li, Shihao, et al.
Publicado: (2025)
Heterogeneous Graph Transformer for Multiple Tiny Object Tracking in RGB-T Videos
por: Xu, Qingyu, et al.
Publicado: (2024)
por: Xu, Qingyu, et al.
Publicado: (2024)
Progressive Scaling Visual Object Tracking
por: Hong, Jack, et al.
Publicado: (2025)
por: Hong, Jack, et al.
Publicado: (2025)
Learning Where to Focus: Density-Driven Guidance for Detecting Dense Tiny Objects
por: Zhao, Zhicheng, et al.
Publicado: (2025)
por: Zhao, Zhicheng, et al.
Publicado: (2025)
FTPFusion: Frequency-Aware Infrared and Visible Video Fusion with Temporal Perturbation
por: Li, Xilai, et al.
Publicado: (2026)
por: Li, Xilai, et al.
Publicado: (2026)
Pedestrian Attribute Recognition via CLIP based Prompt Vision-Language Fusion
por: Wang, Xiao, et al.
Publicado: (2023)
por: Wang, Xiao, et al.
Publicado: (2023)
Ejemplares similares
-
CRSOT: Cross-Resolution Object Tracking using Unaligned Frame and Event Cameras
por: Zhu, Yabin, et al.
Publicado: (2024) -
Sparse-Dense Mixture of Experts Adapter for Multi-Modal Tracking
por: Zhu, Yabin, et al.
Publicado: (2026) -
RGBT Tracking via All-layer Multimodal Interactions with Progressive Fusion Mamba
por: Lu, Andong, et al.
Publicado: (2024) -
Alignment-Free RGB-T Salient Object Detection: A Large-scale Dataset and Progressive Correlation Network
por: Wang, Kunpeng, et al.
Publicado: (2024) -
Dynamic Disentangled Fusion Network for RGBT Tracking
por: Li, Chenglong, et al.
Publicado: (2024)