Rethinking Early-Fusion Strategies for Improved Multispectral Object Detection
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhang, Xue, Cao, Si-Yuan, Wang, Fang, Zhang, Runmin, Wu, Zhe, Zhang, Xiaohan, Bai, Xiaokai, Shen, Hui-Liang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction
por: Zhang, Runmin, et al.
Publicado: (2025)
por: Zhang, Runmin, et al.
Publicado: (2025)
Boosting Instance Awareness via Cross-View Correlation with 4D Radar and Camera for 3D Object Detection
por: Bai, Xiaokai, et al.
Publicado: (2026)
por: Bai, Xiaokai, et al.
Publicado: (2026)
Recurrent Cross-View Object Geo-Localization
por: Zhang, Xiaohan, et al.
Publicado: (2025)
por: Zhang, Xiaohan, et al.
Publicado: (2025)
SD4R: Sparse-to-Dense Learning for 3D Object Detection with 4D Radar
por: Bai, Xiaokai, et al.
Publicado: (2026)
por: Bai, Xiaokai, et al.
Publicado: (2026)
Structure-Aware Radar-Camera Depth Estimation
por: Zhang, Fuyi, et al.
Publicado: (2025)
por: Zhang, Fuyi, et al.
Publicado: (2025)
RaGS: Unleashing 3D Gaussian Splatting from 4D Radar and Monocular Cues for 3D Object Detection
por: Bai, Xiaokai, et al.
Publicado: (2025)
por: Bai, Xiaokai, et al.
Publicado: (2025)
Rethinking Early-Fusion Strategies for Improved Multimodal Image Segmentation
por: Shen, Zhengwen, et al.
Publicado: (2025)
por: Shen, Zhengwen, et al.
Publicado: (2025)
Rethinking Unsupervised Cross-modal Flow Estimation: Learning from Decoupled Optimization and Consistency Constraint
por: Zhang, Runmin, et al.
Publicado: (2025)
por: Zhang, Runmin, et al.
Publicado: (2025)
DLRMamba: Distilling Low-Rank Mamba for Edge Multispectral Fusion Object Detection
por: Zhang, Qianqian, et al.
Publicado: (2026)
por: Zhang, Qianqian, et al.
Publicado: (2026)
TFDet: Target-Aware Fusion for RGB-T Pedestrian Detection
por: Zhang, Xue, et al.
Publicado: (2023)
por: Zhang, Xue, et al.
Publicado: (2023)
IRDFusion: Iterative Relation-Map Difference guided Feature Fusion for Multispectral Object Detection
por: Shen, Jifeng, et al.
Publicado: (2025)
por: Shen, Jifeng, et al.
Publicado: (2025)
Fourier-enhanced Implicit Neural Fusion Network for Multispectral and Hyperspectral Image Fusion
por: Liang, Yu-Jie, et al.
Publicado: (2024)
por: Liang, Yu-Jie, et al.
Publicado: (2024)
Optimizing Multispectral Object Detection: A Bag of Tricks and Comprehensive Benchmarks
por: Zhou, Chen, et al.
Publicado: (2024)
por: Zhou, Chen, et al.
Publicado: (2024)
EDFFDNet: Towards Accurate and Efficient Unsupervised Multi-Grid Image Registration
por: Zhu, Haokai, et al.
Publicado: (2025)
por: Zhu, Haokai, et al.
Publicado: (2025)
MS-DETR: Multispectral Pedestrian Detection Transformer with Loosely Coupled Fusion and Modality-Balanced Optimization
por: Xing, Yinghui, et al.
Publicado: (2023)
por: Xing, Yinghui, et al.
Publicado: (2023)
CDFormer: Cross-Domain Few-Shot Object Detection Transformer Against Feature Confusion
por: Meng, Boyuan, et al.
Publicado: (2025)
por: Meng, Boyuan, et al.
Publicado: (2025)
Multispectral State-Space Feature Fusion: Bridging Shared and Cross-Parametric Interactions for Object Detection
por: Shen, Jifeng, et al.
Publicado: (2025)
por: Shen, Jifeng, et al.
Publicado: (2025)
S-BEVLoc: BEV-based Self-supervised Framework for Large-scale LiDAR Global Localization
por: Zhang, Chenghao, et al.
Publicado: (2025)
por: Zhang, Chenghao, et al.
Publicado: (2025)
Size-invariance Matters: Rethinking Metrics and Losses for Imbalanced Multi-object Salient Object Detection
por: Li, Feiran, et al.
Publicado: (2024)
por: Li, Feiran, et al.
Publicado: (2024)
MCOD: The First Challenging Benchmark for Multispectral Camouflaged Object Detection
por: Li, Yang, et al.
Publicado: (2025)
por: Li, Yang, et al.
Publicado: (2025)
DEPFusion: Dual-Domain Enhancement and Priority-Guided Mamba Fusion for UAV Multispectral Object Detection
por: Li, Shucong, et al.
Publicado: (2025)
por: Li, Shucong, et al.
Publicado: (2025)
Context and Geometry Aware Voxel Transformer for Semantic Scene Completion
por: Yu, Zhu, et al.
Publicado: (2024)
por: Yu, Zhu, et al.
Publicado: (2024)
Frequency Perception Network for Camouflaged Object Detection
por: Cong, Runmin, et al.
Publicado: (2023)
por: Cong, Runmin, et al.
Publicado: (2023)
SSHNet: Unsupervised Cross-modal Homography Estimation via Problem Reformulation and Split Optimization
por: Yu, Junchen, et al.
Publicado: (2024)
por: Yu, Junchen, et al.
Publicado: (2024)
Strip-Fusion: Spatiotemporal Fusion for Multispectral Pedestrian Detection
por: Kanu-Asiegbu, Asiegbu Miracle, et al.
Publicado: (2026)
por: Kanu-Asiegbu, Asiegbu Miracle, et al.
Publicado: (2026)
SCPNet: Unsupervised Cross-modal Homography Estimation via Intra-modal Self-supervised Learning
por: Zhang, Runmin, et al.
Publicado: (2024)
por: Zhang, Runmin, et al.
Publicado: (2024)
Wavelet-based Multi-View Fusion of 4D Radar Tensor and Camera for Robust 3D Object Detection
por: Guan, Runwei, et al.
Publicado: (2025)
por: Guan, Runwei, et al.
Publicado: (2025)
SparseLIF: High-Performance Sparse LiDAR-Camera Fusion for 3D Object Detection
por: Zhang, Hongcheng, et al.
Publicado: (2024)
por: Zhang, Hongcheng, et al.
Publicado: (2024)
G2HFNet: GeoGran-Aware Hierarchical Feature Fusion Network for Salient Object Detection in Optical Remote Sensing Images
por: Wan, Bin, et al.
Publicado: (2026)
por: Wan, Bin, et al.
Publicado: (2026)
SFFR: Spatial-Frequency Feature Reconstruction for Multispectral Aerial Object Detection
por: Zuo, Xin, et al.
Publicado: (2025)
por: Zuo, Xin, et al.
Publicado: (2025)
MSCoTDet: Language-driven Multi-modal Fusion for Improved Multispectral Pedestrian Detection
por: Kim, Taeheon, et al.
Publicado: (2024)
por: Kim, Taeheon, et al.
Publicado: (2024)
YOLOv11-RGBT: Towards a Comprehensive Single-Stage Multispectral Object Detection Framework
por: Wan, Dahang, et al.
Publicado: (2025)
por: Wan, Dahang, et al.
Publicado: (2025)
SGDFormer: One-stage Transformer-based Architecture for Cross-Spectral Stereo Image Guided Denoising
por: Zhang, Runmin, et al.
Publicado: (2024)
por: Zhang, Runmin, et al.
Publicado: (2024)
Multispectral Detection Transformer with Infrared-Centric Feature Fusion
por: Hwang, Seongmin, et al.
Publicado: (2025)
por: Hwang, Seongmin, et al.
Publicado: (2025)
Cross-Level Sensor Fusion with Object Lists via Transformer for 3D Object Detection
por: Liu, Xiangzhong, et al.
Publicado: (2025)
por: Liu, Xiangzhong, et al.
Publicado: (2025)
Video Object Segmentation via SAM 2: The 4th Solution for LSVOS Challenge VOS Track
por: Pan, Feiyu, et al.
Publicado: (2024)
por: Pan, Feiyu, et al.
Publicado: (2024)
Attention Fusion Reverse Distillation for Multi-Lighting Image Anomaly Detection
por: Zhang, Yiheng, et al.
Publicado: (2024)
por: Zhang, Yiheng, et al.
Publicado: (2024)
Large Depth Completion Model from Sparse Observations
por: Yu, Zhu, et al.
Publicado: (2026)
por: Yu, Zhu, et al.
Publicado: (2026)
Language Driven Occupancy Prediction
por: Yu, Zhu, et al.
Publicado: (2024)
por: Yu, Zhu, et al.
Publicado: (2024)
FreDFT: Frequency Domain Fusion Transformer for Visible-Infrared Object Detection
por: Wu, Wencong, et al.
Publicado: (2025)
por: Wu, Wencong, et al.
Publicado: (2025)
Ejemplares similares
-
Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction
por: Zhang, Runmin, et al.
Publicado: (2025) -
Boosting Instance Awareness via Cross-View Correlation with 4D Radar and Camera for 3D Object Detection
por: Bai, Xiaokai, et al.
Publicado: (2026) -
Recurrent Cross-View Object Geo-Localization
por: Zhang, Xiaohan, et al.
Publicado: (2025) -
SD4R: Sparse-to-Dense Learning for 3D Object Detection with 4D Radar
por: Bai, Xiaokai, et al.
Publicado: (2026) -
Structure-Aware Radar-Camera Depth Estimation
por: Zhang, Fuyi, et al.
Publicado: (2025)