Invisible Gas Detection: An RGB-Thermal Cross Attention Network and A New Benchmark
Fuente:
arXiv
Saved in:
| Main Authors: | Wang, Jue, Lin, Yuxiang, Zhao, Qi, Luo, Dong, Chen, Shuaibao, Chen, Wei, Peng, Xiaojiang |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
FlexEdit: Marrying Free-Shape Masks to VLLM for Flexible Image Editing
by: Yuan, Tianshuo, et al.
Published: (2024)
by: Yuan, Tianshuo, et al.
Published: (2024)
RGB-to-Polarization Estimation: A New Task and Benchmark Study
by: Lin, Beibei, et al.
Published: (2025)
by: Lin, Beibei, et al.
Published: (2025)
RGB-Sonar Tracking Benchmark and Spatial Cross-Attention Transformer Tracker
by: Li, Yunfeng, et al.
Published: (2024)
by: Li, Yunfeng, et al.
Published: (2024)
DPDEdit: Detail-Preserved Diffusion Models for Multimodal Fashion Image Editing
by: Wang, Xiaolong, et al.
Published: (2024)
by: Wang, Xiaolong, et al.
Published: (2024)
A Saliency Enhanced Feature Fusion based multiscale RGB-D Salient Object Detection Network
by: Huang, Rui, et al.
Published: (2024)
by: Huang, Rui, et al.
Published: (2024)
Emotion-LLaMAv2 and MMEVerse: A New Framework and Benchmark for Multimodal Emotion Understanding
by: Peng, Xiaojiang, et al.
Published: (2026)
by: Peng, Xiaojiang, et al.
Published: (2026)
3D Landmark Detection on Human Point Clouds: A Benchmark and A Dual Cascade Point Transformer Framework
by: Zhang, Fan, et al.
Published: (2024)
by: Zhang, Fan, et al.
Published: (2024)
LPCAN: Lightweight Pyramid Cross-Attention Network for Rail Surface Defect Detection Using RGB-D Data
by: Alex, Jackie, et al.
Published: (2026)
by: Alex, Jackie, et al.
Published: (2026)
Depth Awakens: A Depth-perceptual Attention Fusion Network for RGB-D Camouflaged Object Detection
by: Liua, Xinran, et al.
Published: (2024)
by: Liua, Xinran, et al.
Published: (2024)
Deep Fourier-embedded Network for RGB and Thermal Salient Object Detection
by: Lyu, Pengfei, et al.
Published: (2024)
by: Lyu, Pengfei, et al.
Published: (2024)
A Unified Structure for Efficient RGB and RGB-D Salient Object Detection
by: Peng, Peng, et al.
Published: (2020)
by: Peng, Peng, et al.
Published: (2020)
Gated Cross-Attention Network for Depth Completion
by: Jia, Xiaogang, et al.
Published: (2023)
by: Jia, Xiaogang, et al.
Published: (2023)
Alignment-Free RGB-T Salient Object Detection: A Large-scale Dataset and Progressive Correlation Network
by: Wang, Kunpeng, et al.
Published: (2024)
by: Wang, Kunpeng, et al.
Published: (2024)
Segment Any RGB-Thermal Model with Language-aided Distillation
by: Xing, Dong, et al.
Published: (2025)
by: Xing, Dong, et al.
Published: (2025)
Rethinking RGB-D Salient Object Detection: Models, Data Sets, and Large-Scale Benchmarks
by: Fan, Deng-Ping, et al.
Published: (2019)
by: Fan, Deng-Ping, et al.
Published: (2019)
CSDNet: Detect Salient Object in Depth-Thermal via A Lightweight Cross Shallow and Deep Perception Network
by: Yu, Xiaotong, et al.
Published: (2024)
by: Yu, Xiaotong, et al.
Published: (2024)
RMAFF-PSN: A Residual Multi-Scale Attention Feature Fusion Photometric Stereo Network
by: Luo, Kai, et al.
Published: (2024)
by: Luo, Kai, et al.
Published: (2024)
MIPS at SemEval-2024 Task 3: Multimodal Emotion-Cause Pair Extraction in Conversations with Multimodal Language Models
by: Cheng, Zebang, et al.
Published: (2024)
by: Cheng, Zebang, et al.
Published: (2024)
Leveraging Bottom-Up and Top-Down Attention for Few-Shot Object Detection
by: Chen, Xianyu, et al.
Published: (2020)
by: Chen, Xianyu, et al.
Published: (2020)
A Dual-Modulation Framework for RGB-T Crowd Counting via Spatially Modulated Attention and Adaptive Fusion
by: Feng, Yuhong, et al.
Published: (2025)
by: Feng, Yuhong, et al.
Published: (2025)
Learning Multi-Modal Prototypes for Cross-Domain Few-Shot Object Detection
by: Wang, Wanqi, et al.
Published: (2026)
by: Wang, Wanqi, et al.
Published: (2026)
Point-aware Interaction and CNN-induced Refinement Network for RGB-D Salient Object Detection
by: Cong, Runmin, et al.
Published: (2023)
by: Cong, Runmin, et al.
Published: (2023)
IAM: Enhancing RGB-D Instance Segmentation with New Benchmarks
by: Jung, Aecheon, et al.
Published: (2025)
by: Jung, Aecheon, et al.
Published: (2025)
Leveraging RGB-D Data with Cross-Modal Context Mining for Glass Surface Detection
by: Lin, Jiaying, et al.
Published: (2022)
by: Lin, Jiaying, et al.
Published: (2022)
STENet: Superpixel Token Enhancing Network for RGB-D Salient Object Detection
by: Chen, Jianlin, et al.
Published: (2026)
by: Chen, Jianlin, et al.
Published: (2026)
Physics-Constrained Cross-Resolution Enhancement Network for Optics-Guided Thermal UAV Image Super-Resolution
by: Zhao, Zhicheng, et al.
Published: (2026)
by: Zhao, Zhicheng, et al.
Published: (2026)
Hierarchical Attention and Parallel Filter Fusion Network for Multi-Source Data Classification
by: Luo, Han, et al.
Published: (2024)
by: Luo, Han, et al.
Published: (2024)
Parallel Cross Strip Attention Network for Single Image Dehazing
by: Tong, Lihan, et al.
Published: (2024)
by: Tong, Lihan, et al.
Published: (2024)
LEAF: Unveiling Two Sides of the Same Coin in Semi-supervised Facial Expression Recognition
by: Zhang, Fan, et al.
Published: (2024)
by: Zhang, Fan, et al.
Published: (2024)
Human Body Restoration with One-Step Diffusion Model and A New Benchmark
by: Gong, Jue, et al.
Published: (2025)
by: Gong, Jue, et al.
Published: (2025)
Cross-Spectral Attention for Unsupervised RGB-IR Face Verification and Person Re-identification
by: Nikhal, Kshitij, et al.
Published: (2024)
by: Nikhal, Kshitij, et al.
Published: (2024)
HSANET: A Hybrid Self-Cross Attention Network For Remote Sensing Change Detection
by: Han, Chengxi, et al.
Published: (2025)
by: Han, Chengxi, et al.
Published: (2025)
MSCT: Differential Cross-Modal Attention for Deepfake Detection
by: Wei, Fangda, et al.
Published: (2026)
by: Wei, Fangda, et al.
Published: (2026)
PEOD: A Pixel-Aligned Event-RGB Benchmark for Object Detection under Challenging Conditions
by: Cui, Luoping, et al.
Published: (2025)
by: Cui, Luoping, et al.
Published: (2025)
Invisible Yet Detected: PelFANet with Attention-Guided Anatomical Fusion for Pelvic Fracture Diagnosis
by: Bhuiyan, Siam Tahsin, et al.
Published: (2025)
by: Bhuiyan, Siam Tahsin, et al.
Published: (2025)
FSCA-Net: Feature-Separated Cross-Attention Network for Robust Multi-Dataset Training
by: Chen, Yuehai
Published: (2026)
by: Chen, Yuehai
Published: (2026)
TherA: Thermal-Aware Visual-Language Prompting for Controllable RGB-to-Thermal Infrared Translation
by: Lee, Dong-Guw, et al.
Published: (2026)
by: Lee, Dong-Guw, et al.
Published: (2026)
Video Generation with Stable Transparency via Shiftable RGB-A Distribution Learner
by: Dong, Haotian, et al.
Published: (2025)
by: Dong, Haotian, et al.
Published: (2025)
MMCLIP: Cross-modal Attention Masked Modelling for Medical Language-Image Pre-Training
by: Wu, Biao, et al.
Published: (2024)
by: Wu, Biao, et al.
Published: (2024)
MambaSOD: Dual Mamba-Driven Cross-Modal Fusion Network for RGB-D Salient Object Detection
by: Zhan, Yue, et al.
Published: (2024)
by: Zhan, Yue, et al.
Published: (2024)
Similar Items
-
FlexEdit: Marrying Free-Shape Masks to VLLM for Flexible Image Editing
by: Yuan, Tianshuo, et al.
Published: (2024) -
RGB-to-Polarization Estimation: A New Task and Benchmark Study
by: Lin, Beibei, et al.
Published: (2025) -
RGB-Sonar Tracking Benchmark and Spatial Cross-Attention Transformer Tracker
by: Li, Yunfeng, et al.
Published: (2024) -
DPDEdit: Detail-Preserved Diffusion Models for Multimodal Fashion Image Editing
by: Wang, Xiaolong, et al.
Published: (2024) -
A Saliency Enhanced Feature Fusion based multiscale RGB-D Salient Object Detection Network
by: Huang, Rui, et al.
Published: (2024)