Saved in:
| Main Authors: | Li, Huadong, Dong, Shichao, Wang, Jin, Fu, Rong, Jing, Minhao, Liang, Jiajun, Fan, Haoqiang, Ji, Renhe |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | https://arxiv.org/abs/2405.19914 |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Sparse Beats Dense: Rethinking Supervision in Radar-Camera Depth Completion
by: Li, Huadong, et al.
Published: (2023)
by: Li, Huadong, et al.
Published: (2023)
MegActor: Harness the Power of Raw Video for Vivid Portrait Animation
by: Yang, Shurong, et al.
Published: (2024)
by: Yang, Shurong, et al.
Published: (2024)
MegActor-$Σ$: Unlocking Flexible Mixed-Modal Control in Portrait Animation with Diffusion Transformer
by: Yang, Shurong, et al.
Published: (2024)
by: Yang, Shurong, et al.
Published: (2024)
Preliminary analysis of RGB-NIR Image Registration techniques for off-road forestry environments
by: Deoli, Pankaj, et al.
Published: (2026)
by: Deoli, Pankaj, et al.
Published: (2026)
ColorMamba: Towards High-quality NIR-to-RGB Spectral Translation with Mamba
by: Zhai, Huiyu, et al.
Published: (2024)
by: Zhai, Huiyu, et al.
Published: (2024)
Cross-modal Fundus Image Registration under Large FoV Disparity
by: Li, Hongyang, et al.
Published: (2025)
by: Li, Hongyang, et al.
Published: (2025)
CalibNet: Dual-branch Cross-modal Calibration for RGB-D Salient Instance Segmentation
by: Pei, Jialun, et al.
Published: (2023)
by: Pei, Jialun, et al.
Published: (2023)
TAR: Text Semantic Assisted Cross-modal Image Registration Framework for Optical and SAR Images
by: Cai, Zhuoyu, et al.
Published: (2026)
by: Cai, Zhuoyu, et al.
Published: (2026)
A Time Series Dataset of NIR Spectra and RGB and NIR-HSI Images of the Barley Germination Process
by: Engstrøm, Ole-Christian Galbo, et al.
Published: (2025)
by: Engstrøm, Ole-Christian Galbo, et al.
Published: (2025)
Detection Fire in Camera RGB-NIR
by: Khai, Nguyen Truong, et al.
Published: (2025)
by: Khai, Nguyen Truong, et al.
Published: (2025)
Pixel-aligned RGB-NIR Stereo Imaging and Dataset for Robot Vision
by: Kim, Jinnyeong, et al.
Published: (2024)
by: Kim, Jinnyeong, et al.
Published: (2024)
Cross-modal Identity Mapping: Minimizing Information Loss in Modality Conversion via Reinforcement Learning
by: Jia, Haonan, et al.
Published: (2026)
by: Jia, Haonan, et al.
Published: (2026)
Pix2Next: Leveraging Vision Foundation Models for RGB to NIR Image Translation
by: Jin, Youngwan, et al.
Published: (2024)
by: Jin, Youngwan, et al.
Published: (2024)
Ambient-robust Inverse Rendering using Active RGB-NIR Imaging
by: Chung, Hoon-Gyu, et al.
Published: (2026)
by: Chung, Hoon-Gyu, et al.
Published: (2026)
Towards Saner Deep Image Registration
by: Duan, Bin, et al.
Published: (2023)
by: Duan, Bin, et al.
Published: (2023)
Forensics-Bench: A Comprehensive Forgery Detection Benchmark Suite for Large Vision Language Models
by: Wang, Jin, et al.
Published: (2025)
by: Wang, Jin, et al.
Published: (2025)
A 3D Cross-modal Keypoint Descriptor for MR-US Matching and Registration
by: Morozov, Daniil, et al.
Published: (2025)
by: Morozov, Daniil, et al.
Published: (2025)
Region-Aware Exposure Consistency Network for Mixed Exposure Correction
by: Liu, Jin, et al.
Published: (2024)
by: Liu, Jin, et al.
Published: (2024)
Beyond LLaVA-HD: Diving into High-Resolution Large Multimodal Models
by: Zhang, Yi-Fan, et al.
Published: (2024)
by: Zhang, Yi-Fan, et al.
Published: (2024)
Geometry-to-Image Synthesis-Driven Generative Point Cloud Registration
by: Jiang, Haobo, et al.
Published: (2025)
by: Jiang, Haobo, et al.
Published: (2025)
EDFFDNet: Towards Accurate and Efficient Unsupervised Multi-Grid Image Registration
by: Zhu, Haokai, et al.
Published: (2025)
by: Zhu, Haokai, et al.
Published: (2025)
Learning Flow-Guided Registration for RGB-Event Semantic Segmentation
by: Yao, Zhen, et al.
Published: (2025)
by: Yao, Zhen, et al.
Published: (2025)
XR-VLM: Cross-Relationship Modeling with Multi-part Prompts and Visual Features for Fine-Grained Recognition
by: Wang, Chuanming, et al.
Published: (2025)
by: Wang, Chuanming, et al.
Published: (2025)
Enhancing Reward Models for High-quality Image Generation: Beyond Text-Image Alignment
by: Ba, Ying, et al.
Published: (2025)
by: Ba, Ying, et al.
Published: (2025)
Towards Context-aware Convolutional Network for Image Restoration
by: Hao, Fangwei, et al.
Published: (2024)
by: Hao, Fangwei, et al.
Published: (2024)
Cross Fusion RGB-T Tracking with Bi-directional Adapter
by: Zeng, Zhirong, et al.
Published: (2024)
by: Zeng, Zhirong, et al.
Published: (2024)
Encoding Matching Criteria for Cross-domain Deformable Image Registration
by: Wang, Zhuoyuan, et al.
Published: (2024)
by: Wang, Zhuoyuan, et al.
Published: (2024)
Learning Exposure Correction in Dynamic Scenes
by: Liu, Jin, et al.
Published: (2024)
by: Liu, Jin, et al.
Published: (2024)
Paired-CSLiDAR: Height-Stratified Registration for Cross-Source Aerial-Ground LiDAR Pose Refinement
by: Hoover, Montana, et al.
Published: (2026)
by: Hoover, Montana, et al.
Published: (2026)
End-to-End RGB-IR Joint Image Compression With Channel-wise Cross-modality Entropy Model
by: Wang, Haofeng, et al.
Published: (2025)
by: Wang, Haofeng, et al.
Published: (2025)
HRDecoder: High-Resolution Decoder Network for Fundus Image Lesion Segmentation
by: Ding, Ziyuan, et al.
Published: (2024)
by: Ding, Ziyuan, et al.
Published: (2024)
CSCPR: Cross-Source-Context Indoor RGB-D Place Recognition
by: Liang, Jing, et al.
Published: (2024)
by: Liang, Jing, et al.
Published: (2024)
UTSRMorph: A Unified Transformer and Superresolution Network for Unsupervised Medical Image Registration
by: Zhang, Runshi, et al.
Published: (2024)
by: Zhang, Runshi, et al.
Published: (2024)
Masked Contrastive Reconstruction for Cross-modal Medical Image-Report Retrieval
by: Wei, Zeqiang, et al.
Published: (2023)
by: Wei, Zeqiang, et al.
Published: (2023)
CIBR: Cross-modal Information Bottleneck Regularization for Robust CLIP Generalization
by: Ji, Yingrui, et al.
Published: (2025)
by: Ji, Yingrui, et al.
Published: (2025)
A cross-modal network for facial expression recognition
by: Tian, Chunwei, et al.
Published: (2026)
by: Tian, Chunwei, et al.
Published: (2026)
Cross-modal State Space Modeling for Real-time RGB-thermal Wild Scene Semantic Segmentation
by: Guo, Xiaodong, et al.
Published: (2025)
by: Guo, Xiaodong, et al.
Published: (2025)
Depicting Beyond Scores: Advancing Image Quality Assessment through Multi-modal Language Models
by: You, Zhiyuan, et al.
Published: (2023)
by: You, Zhiyuan, et al.
Published: (2023)
Dissecting RGB-D Learning for Improved Multi-modal Fusion
by: Chen, Hao, et al.
Published: (2023)
by: Chen, Hao, et al.
Published: (2023)
A Labeled Ophthalmic Ultrasound Dataset with Medical Report Generation Based on Cross-modal Deep Learning
by: Wang, Jing, et al.
Published: (2024)
by: Wang, Jing, et al.
Published: (2024)
Similar Items
-
Sparse Beats Dense: Rethinking Supervision in Radar-Camera Depth Completion
by: Li, Huadong, et al.
Published: (2023) -
MegActor: Harness the Power of Raw Video for Vivid Portrait Animation
by: Yang, Shurong, et al.
Published: (2024) -
MegActor-$Σ$: Unlocking Flexible Mixed-Modal Control in Portrait Animation with Diffusion Transformer
by: Yang, Shurong, et al.
Published: (2024) -
Preliminary analysis of RGB-NIR Image Registration techniques for off-road forestry environments
by: Deoli, Pankaj, et al.
Published: (2026) -
ColorMamba: Towards High-quality NIR-to-RGB Spectral Translation with Mamba
by: Zhai, Huiyu, et al.
Published: (2024)