Breaking Shallow Limits: Task-Driven Pixel Fusion for Gap-free RGBT Tracking
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Lu, Andong, Guo, Yuanzhi, Wang, Wanyu, Li, Chenglong, Tang, Jin, Luo, Bin |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
AFter: Attention-based Fusion Router for RGBT Tracking
par: Lu, Andong, et autres
Publié: (2024)
par: Lu, Andong, et autres
Publié: (2024)
RGBT Tracking via All-layer Multimodal Interactions with Progressive Fusion Mamba
par: Lu, Andong, et autres
Publié: (2024)
par: Lu, Andong, et autres
Publié: (2024)
Breaking Modality Gap in RGBT Tracking: Coupled Knowledge Distillation
par: Lu, Andong, et autres
Publié: (2024)
par: Lu, Andong, et autres
Publié: (2024)
Modality-missing RGBT Tracking: Invertible Prompt Learning and High-quality Benchmarks
par: Lu, Andong, et autres
Publié: (2023)
par: Lu, Andong, et autres
Publié: (2023)
Transformer RGBT Tracking with Spatio-Temporal Multimodal Tokens
par: Sun, Dengdi, et autres
Publié: (2024)
par: Sun, Dengdi, et autres
Publié: (2024)
Dynamic Disentangled Fusion Network for RGBT Tracking
par: Li, Chenglong, et autres
Publié: (2024)
par: Li, Chenglong, et autres
Publié: (2024)
Towards General Multimodal Visual Tracking
par: Lu, Andong, et autres
Publié: (2025)
par: Lu, Andong, et autres
Publié: (2025)
Cross-modulated Attention Transformer for RGBT Tracking
par: Xiao, Yun, et autres
Publié: (2024)
par: Xiao, Yun, et autres
Publié: (2024)
Multimodal Spatio-temporal Graph Learning for Alignment-free RGBT Video Object Detection
par: Wang, Qishun, et autres
Publié: (2025)
par: Wang, Qishun, et autres
Publié: (2025)
Nighttime Person Re-Identification via Collaborative Enhancement Network with Multi-domain Learning
par: Lu, Andong, et autres
Publié: (2023)
par: Lu, Andong, et autres
Publié: (2023)
Alignment-Free RGBT Salient Object Detection: Semantics-guided Asymmetric Correlation Network and A Unified Benchmark
par: Wang, Kunpeng, et autres
Publié: (2024)
par: Wang, Kunpeng, et autres
Publié: (2024)
Towards Robust Optical-SAR Object Detection under Missing Modalities: A Dynamic Quality-Aware Fusion Framework
par: Zhao, Zhicheng, et autres
Publié: (2025)
par: Zhao, Zhicheng, et autres
Publié: (2025)
Decoupled Cross-Modal Alignment Network for Text-RGBT Person Retrieval and A High-Quality Benchmark
par: Deng, Yifei, et autres
Publié: (2025)
par: Deng, Yifei, et autres
Publié: (2025)
Graph-based Semantic Calibration Network for Unaligned UAV RGBT Image Semantic Segmentation and A Large-scale Benchmark
par: Fan, Fangqiang, et autres
Publié: (2026)
par: Fan, Fangqiang, et autres
Publié: (2026)
RAGTrack: Language-aware RGBT Tracking with Retrieval-Augmented Generation
par: Li, Hao, et autres
Publié: (2026)
par: Li, Hao, et autres
Publié: (2026)
X Modality Assisting RGBT Object Tracking
par: Ding, Zhaisheng, et autres
Publié: (2023)
par: Ding, Zhaisheng, et autres
Publié: (2023)
Temporal Adaptive RGBT Tracking with Modality Prompt
par: Wang, Hongyu, et autres
Publié: (2024)
par: Wang, Hongyu, et autres
Publié: (2024)
CADTrack: Learning Contextual Aggregation with Deformable Alignment for Robust RGBT Tracking
par: Li, Hao, et autres
Publié: (2025)
par: Li, Hao, et autres
Publié: (2025)
Visible-Thermal Multiple Object Tracking: Large-scale Video Dataset and Progressive Fusion Approach
par: Zhu, Yabin, et autres
Publié: (2024)
par: Zhu, Yabin, et autres
Publié: (2024)
Mixture of Scale Experts for Alignment-free RGBT Video Object Detection and A Unified Benchmark
par: Wang, Qishun, et autres
Publié: (2024)
par: Wang, Qishun, et autres
Publié: (2024)
Revisiting RGBT Tracking Benchmarks from the Perspective of Modality Validity: A New Benchmark, Problem, and Solution
par: Tang, Zhangyong, et autres
Publié: (2024)
par: Tang, Zhangyong, et autres
Publié: (2024)
ICPL-ReID: Identity-Conditional Prompt Learning for Multi-Spectral Object Re-Identification
par: Li, Shihao, et autres
Publié: (2025)
par: Li, Shihao, et autres
Publié: (2025)
Learning Adaptive Fusion Bank for Multi-modal Salient Object Detection
par: Wang, Kunpeng, et autres
Publié: (2024)
par: Wang, Kunpeng, et autres
Publié: (2024)
Bridging the Scale Gap: Balanced Tiny and General Object Detection in Remote Sensing Imagery
par: Zhao, Zhicheng, et autres
Publié: (2025)
par: Zhao, Zhicheng, et autres
Publié: (2025)
DeTrack: A Benchmark and Altitude-Aware Dual World Model for Drone-embodied Tracking
par: Hu, Guyue, et autres
Publié: (2026)
par: Hu, Guyue, et autres
Publié: (2026)
Adapting Segment Anything Model to Multi-modal Salient Object Detection with Semantic Feature Fusion Guidance
par: Wang, Kunpeng, et autres
Publié: (2024)
par: Wang, Kunpeng, et autres
Publié: (2024)
Sparse-Dense Mixture of Experts Adapter for Multi-Modal Tracking
par: Zhu, Yabin, et autres
Publié: (2026)
par: Zhu, Yabin, et autres
Publié: (2026)
COXNet: Cross-Layer Fusion with Adaptive Alignment and Scale Integration for RGBT Tiny Object Detection
par: Peng, Peiran, et autres
Publié: (2025)
par: Peng, Peiran, et autres
Publié: (2025)
Learning Where to Focus: Density-Driven Guidance for Detecting Dense Tiny Objects
par: Zhao, Zhicheng, et autres
Publié: (2025)
par: Zhao, Zhicheng, et autres
Publié: (2025)
Text-Guided Coarse-to-Fine Fusion Network for Robust Remote Sensing Visual Question Answering
par: Zhao, Zhicheng, et autres
Publié: (2024)
par: Zhao, Zhicheng, et autres
Publié: (2024)
GeminiFusion: Efficient Pixel-wise Multimodal Fusion for Vision Transformer
par: Jia, Ding, et autres
Publié: (2024)
par: Jia, Ding, et autres
Publié: (2024)
DCG ReID: Disentangling Collaboration and Guidance Fusion Representations for Multi-modal Vehicle Re-Identification
par: Zheng, Aihua, et autres
Publié: (2026)
par: Zheng, Aihua, et autres
Publié: (2026)
CattleFace-RGBT: RGB-T Cattle Facial Landmark Benchmark
par: Coffman, Ethan, et autres
Publié: (2024)
par: Coffman, Ethan, et autres
Publié: (2024)
Pedestrian Attribute Recognition via CLIP based Prompt Vision-Language Fusion
par: Wang, Xiao, et autres
Publié: (2023)
par: Wang, Xiao, et autres
Publié: (2023)
InfinityDrive: Breaking Time Limits in Driving World Models
par: Guo, Xi, et autres
Publié: (2024)
par: Guo, Xi, et autres
Publié: (2024)
TrackingWorld: World-centric Monocular 3D Tracking of Almost All Pixels
par: Lu, Jiahao, et autres
Publié: (2025)
par: Lu, Jiahao, et autres
Publié: (2025)
One-step Latent-free Image Generation with Pixel Mean Flows
par: Lu, Yiyang, et autres
Publié: (2026)
par: Lu, Yiyang, et autres
Publié: (2026)
M-SpecGene: Generalized Foundation Model for RGBT Multispectral Vision
par: Zhou, Kailai, et autres
Publié: (2025)
par: Zhou, Kailai, et autres
Publié: (2025)
YOLOv11-RGBT: Towards a Comprehensive Single-Stage Multispectral Object Detection Framework
par: Wan, Dahang, et autres
Publié: (2025)
par: Wan, Dahang, et autres
Publié: (2025)
Causality-Driven Infrared and Visible Image Fusion
par: Ma, Linli, et autres
Publié: (2025)
par: Ma, Linli, et autres
Publié: (2025)
Documents similaires
-
AFter: Attention-based Fusion Router for RGBT Tracking
par: Lu, Andong, et autres
Publié: (2024) -
RGBT Tracking via All-layer Multimodal Interactions with Progressive Fusion Mamba
par: Lu, Andong, et autres
Publié: (2024) -
Breaking Modality Gap in RGBT Tracking: Coupled Knowledge Distillation
par: Lu, Andong, et autres
Publié: (2024) -
Modality-missing RGBT Tracking: Invertible Prompt Learning and High-quality Benchmarks
par: Lu, Andong, et autres
Publié: (2023) -
Transformer RGBT Tracking with Spatio-Temporal Multimodal Tokens
par: Sun, Dengdi, et autres
Publié: (2024)