Modality-Decoupled RGB-Thermal Object Detector via Query Fusion
Fuente:
arXiv
Saved in:
| Main Authors: | Tian, Chao, Zhou, Zikun, Yang, Chao, Zhu, Guoqing, Zhong, Fu'an, He, Zhenyu |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Learning A Robust RGB-Thermal Detector for Extreme Modality Imbalance
by: Tian, Chao, et al.
Published: (2025)
by: Tian, Chao, et al.
Published: (2025)
Data Generation Scheme for Thermal Modality with Edge-Guided Adversarial Conditional Diffusion Model
by: Zhu, Guoqing, et al.
Published: (2024)
by: Zhu, Guoqing, et al.
Published: (2024)
Fusing in 3D: Free-Viewpoint Fusion Rendering with a 3D Infrared-Visible Scene Representation
by: Yang, Chao, et al.
Published: (2026)
by: Yang, Chao, et al.
Published: (2026)
LiteFusion: Taming 3D Object Detectors from Vision-Based to Multi-Modal with Minimal Adaptation
by: Ren, Xiangxuan, et al.
Published: (2025)
by: Ren, Xiangxuan, et al.
Published: (2025)
Robust RGB-T Tracking via Learnable Visual Fourier Prompt Fine-tuning and Modality Fusion Prompt Generation
by: Yang, Hongtao, et al.
Published: (2025)
by: Yang, Hongtao, et al.
Published: (2025)
RTFDNet: Fusion-Decoupling for Robust RGB-T Segmentation
by: Tan, Kunyu, et al.
Published: (2026)
by: Tan, Kunyu, et al.
Published: (2026)
Physical Adversarial Clothing Evades Visible-Thermal Detectors via Non-Overlapping RGB-T Pattern
by: Zhu, Xiaopei, et al.
Published: (2026)
by: Zhu, Xiaopei, et al.
Published: (2026)
Exploring Modality-Aware Fusion and Decoupled Temporal Propagation for Multi-Modal Object Tracking
by: Wang, Shilei, et al.
Published: (2026)
by: Wang, Shilei, et al.
Published: (2026)
MambaSOD: Dual Mamba-Driven Cross-Modal Fusion Network for RGB-D Salient Object Detection
by: Zhan, Yue, et al.
Published: (2024)
by: Zhan, Yue, et al.
Published: (2024)
Harnessing Vision-Language Pretrained Models with Temporal-Aware Adaptation for Referring Video Object Segmentation
by: Zhou, Zikun, et al.
Published: (2024)
by: Zhou, Zikun, et al.
Published: (2024)
Unleashing the Power of Motion and Depth: A Selective Fusion Strategy for RGB-D Video Salient Object Detection
by: He, Jiahao, et al.
Published: (2025)
by: He, Jiahao, et al.
Published: (2025)
Cross-Modal Purification and Fusion for Small-Object RGB-D Transmission-Line Defect Detection
by: Cui, Jiaming, et al.
Published: (2026)
by: Cui, Jiaming, et al.
Published: (2026)
Modality-Guided Dynamic Graph Fusion and Temporal Diffusion for Self-Supervised RGB-T Tracking
by: Li, Shenglan, et al.
Published: (2025)
by: Li, Shenglan, et al.
Published: (2025)
RTracker: Recoverable Tracking via PN Tree Structured Memory
by: Huang, Yuqing, et al.
Published: (2024)
by: Huang, Yuqing, et al.
Published: (2024)
Adversarial Robustness in RGB-Skeleton Action Recognition: Leveraging Attention Modality Reweighter
by: Liu, Chao, et al.
Published: (2024)
by: Liu, Chao, et al.
Published: (2024)
AgentRVOS for MeViS-Text Track of 5th PVUW Challenge: 3rd Method
by: Miao, Deshui, et al.
Published: (2026)
by: Miao, Deshui, et al.
Published: (2026)
You Only Need Two Detectors to Achieve Multi-Modal 3D Multi-Object Tracking
by: Wang, Xiyang, et al.
Published: (2023)
by: Wang, Xiyang, et al.
Published: (2023)
ZeroPose: CAD-Prompted Zero-shot Object 6D Pose Estimation in Cluttered Scenes
by: Chen, Jianqiu, et al.
Published: (2023)
by: Chen, Jianqiu, et al.
Published: (2023)
XTrack: Multimodal Training Boosts RGB-X Video Object Trackers
by: Tan, Yuedong, et al.
Published: (2024)
by: Tan, Yuedong, et al.
Published: (2024)
Enhancing Traffic Object Detection in Variable Illumination with RGB-Event Fusion
by: Liu, Zhanwen, et al.
Published: (2023)
by: Liu, Zhanwen, et al.
Published: (2023)
Decoupled PROB: Decoupled Query Initialization Tasks and Objectness-Class Learning for Open World Object Detection
by: Inoue, Riku, et al.
Published: (2025)
by: Inoue, Riku, et al.
Published: (2025)
MambaVLT: Time-Evolving Multimodal State Space Model for Vision-Language Tracking
by: Liu, Xinqi, et al.
Published: (2024)
by: Liu, Xinqi, et al.
Published: (2024)
Modality-Specific Hierarchical Enhancement for RGB-D Camouflaged Object Detection
by: Niu, Yuzhen, et al.
Published: (2026)
by: Niu, Yuzhen, et al.
Published: (2026)
Class-aware Domain Knowledge Fusion and Fission for Continual Test-Time Adaptation
by: Zhou, Jiahuan, et al.
Published: (2025)
by: Zhou, Jiahuan, et al.
Published: (2025)
WaveMamba: Wavelet-Driven Mamba Fusion for RGB-Infrared Object Detection
by: Zhu, Haodong, et al.
Published: (2025)
by: Zhu, Haodong, et al.
Published: (2025)
Frequency-Guided Fusion For RGB-Thermal Semantic Segmentation
by: Canıtez, İsmail Emre, et al.
Published: (2026)
by: Canıtez, İsmail Emre, et al.
Published: (2026)
Salient Object Detection in RGB-D Videos
by: Mou, Ao, et al.
Published: (2023)
by: Mou, Ao, et al.
Published: (2023)
How Far Are We from Generating Missing Modalities with Foundation Models?
by: Ke, Guanzhou, et al.
Published: (2025)
by: Ke, Guanzhou, et al.
Published: (2025)
Universal Multi-view Black-box Attack against Object Detectors via Layout Optimization
by: Wang, Donghua, et al.
Published: (2024)
by: Wang, Donghua, et al.
Published: (2024)
Heterogeneous Graph Transformer for Multiple Tiny Object Tracking in RGB-T Videos
by: Xu, Qingyu, et al.
Published: (2024)
by: Xu, Qingyu, et al.
Published: (2024)
Spectral-Aware Global Fusion for RGB-Thermal Semantic Segmentation
by: Zhang, Ce, et al.
Published: (2025)
by: Zhang, Ce, et al.
Published: (2025)
Hand-Centric Motion Refinement for 3D Hand-Object Interaction via Hierarchical Spatial-Temporal Modeling
by: Hao, Yuze, et al.
Published: (2024)
by: Hao, Yuze, et al.
Published: (2024)
DMPT: Decoupled Modality-aware Prompt Tuning for Multi-modal Object Re-identification
by: Lin, Minghui, et al.
Published: (2025)
by: Lin, Minghui, et al.
Published: (2025)
AdaFuse-Det: Adaptive Cross-Modal Fusion of Event Cameras for Robust Object Detection in Low-Light RGB Imagery
by: Imandi, Raju, et al.
Published: (2026)
by: Imandi, Raju, et al.
Published: (2026)
DeFusion: An Effective Decoupling Fusion Network for Multi-Modal Pregnancy Prediction
by: Ouyang, Xueqiang, et al.
Published: (2025)
by: Ouyang, Xueqiang, et al.
Published: (2025)
SMTrack: End-to-End Trained Spiking Neural Networks for Multi-Object Tracking in RGB Videos
by: Zhong, Pengzhi, et al.
Published: (2025)
by: Zhong, Pengzhi, et al.
Published: (2025)
StageInteractor: Query-based Object Detector with Cross-stage Interaction
by: Teng, Yao, et al.
Published: (2023)
by: Teng, Yao, et al.
Published: (2023)
Enhanced Automotive Object Detection via RGB-D Fusion in a DiffusionDet Framework
by: Orfaig, Eliraz, et al.
Published: (2024)
by: Orfaig, Eliraz, et al.
Published: (2024)
HAPNet: Toward Superior RGB-Thermal Scene Parsing via Hybrid, Asymmetric, and Progressive Heterogeneous Feature Fusion
by: Li, Jiahang, et al.
Published: (2024)
by: Li, Jiahang, et al.
Published: (2024)
Backdoor Attacks on Open Vocabulary Object Detectors via Multi-Modal Prompt Tuning
by: Raj, Ankita, et al.
Published: (2025)
by: Raj, Ankita, et al.
Published: (2025)
Similar Items
-
Learning A Robust RGB-Thermal Detector for Extreme Modality Imbalance
by: Tian, Chao, et al.
Published: (2025) -
Data Generation Scheme for Thermal Modality with Edge-Guided Adversarial Conditional Diffusion Model
by: Zhu, Guoqing, et al.
Published: (2024) -
Fusing in 3D: Free-Viewpoint Fusion Rendering with a 3D Infrared-Visible Scene Representation
by: Yang, Chao, et al.
Published: (2026) -
LiteFusion: Taming 3D Object Detectors from Vision-Based to Multi-Modal with Minimal Adaptation
by: Ren, Xiangxuan, et al.
Published: (2025) -
Robust RGB-T Tracking via Learnable Visual Fourier Prompt Fine-tuning and Modality Fusion Prompt Generation
by: Yang, Hongtao, et al.
Published: (2025)