Text-Guided Channel Perturbation and Pretrained Knowledge Integration for Unified Multi-Modality Image Fusion
Fuente:
arXiv
Salvato in:
| Autori principali: | Li, Xilai, Li, Xiaosong, Jiang, Weijun |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
All-weather Multi-Modality Image Fusion: Unified Framework and 100k Benchmark
di: Li, Xilai, et al.
Pubblicazione: (2024)
di: Li, Xilai, et al.
Pubblicazione: (2024)
FTPFusion: Frequency-Aware Infrared and Visible Video Fusion with Temporal Perturbation
di: Li, Xilai, et al.
Pubblicazione: (2026)
di: Li, Xilai, et al.
Pubblicazione: (2026)
AWM-Fuse: Multi-Modality Image Fusion for Adverse Weather via Global and Local Text Perception
di: Li, Xilai, et al.
Pubblicazione: (2025)
di: Li, Xilai, et al.
Pubblicazione: (2025)
MMA-UNet: A Multi-Modal Asymmetric UNet Architecture for Infrared and Visible Image Fusion
di: Huang, Jingxue, et al.
Pubblicazione: (2024)
di: Huang, Jingxue, et al.
Pubblicazione: (2024)
SAMF: Small-Area-Aware Multi-focus Image Fusion for Object Detection
di: Li, Xilai, et al.
Pubblicazione: (2024)
di: Li, Xilai, et al.
Pubblicazione: (2024)
UMCFuse: A Unified Multiple Complex Scenes Infrared and Visible Image Fusion Framework
di: Li, Xilai, et al.
Pubblicazione: (2024)
di: Li, Xilai, et al.
Pubblicazione: (2024)
Bridging the Gap between Multi-focus and Multi-modal: A Focused Integration Framework for Multi-modal Image Fusion
di: Li, Xilai, et al.
Pubblicazione: (2023)
di: Li, Xilai, et al.
Pubblicazione: (2023)
MAVFusion: Efficient Infrared and Visible Video Fusion via Motion-Aware Sparse Interaction
di: Li, Xilai, et al.
Pubblicazione: (2026)
di: Li, Xilai, et al.
Pubblicazione: (2026)
Energy-Guided Optimization for Personalized Image Editing with Pretrained Text-to-Image Diffusion Models
di: Jiang, Rui, et al.
Pubblicazione: (2025)
di: Jiang, Rui, et al.
Pubblicazione: (2025)
Unifying Heterogeneous Multi-Modal Remote Sensing Detection Via Language-Pivoted Pretraining
di: Li, Yuxuan, et al.
Pubblicazione: (2026)
di: Li, Yuxuan, et al.
Pubblicazione: (2026)
Multi-Grained Text-Guided Image Fusion for Multi-Exposure and Multi-Focus Scenarios
di: Tang, Mingwei, et al.
Pubblicazione: (2025)
di: Tang, Mingwei, et al.
Pubblicazione: (2025)
UniMed-CLIP: Towards a Unified Image-Text Pretraining Paradigm for Diverse Medical Imaging Modalities
di: Khattak, Muhammad Uzair, et al.
Pubblicazione: (2024)
di: Khattak, Muhammad Uzair, et al.
Pubblicazione: (2024)
Channel Attention-Guided Cross-Modal Knowledge Distillation for Referring Image Segmentation
di: Yang, Chen
Pubblicazione: (2026)
di: Yang, Chen
Pubblicazione: (2026)
A Luminance-Aware Multi-Scale Network for Polarization Image Fusion with a Multi-Scene Dataset
di: Huang, Zhuangfan, et al.
Pubblicazione: (2025)
di: Huang, Zhuangfan, et al.
Pubblicazione: (2025)
Interaction-Guided Two-Branch Image Dehazing Network
di: Liu, Huichun, et al.
Pubblicazione: (2024)
di: Liu, Huichun, et al.
Pubblicazione: (2024)
UniFuse: A Unified All-in-One Framework for Multi-Modal Medical Image Fusion Under Diverse Degradations and Misalignments
di: Su, Dayong, et al.
Pubblicazione: (2025)
di: Su, Dayong, et al.
Pubblicazione: (2025)
TSJNet: A Multi-modality Target and Semantic Awareness Joint-driven Image Fusion Network
di: Jie, Yuchan, et al.
Pubblicazione: (2024)
di: Jie, Yuchan, et al.
Pubblicazione: (2024)
Simultaneous Tri-Modal Medical Image Fusion and Super-Resolution using Conditional Diffusion Model
di: Xu, Yushen, et al.
Pubblicazione: (2024)
di: Xu, Yushen, et al.
Pubblicazione: (2024)
Equivariant Multi-Modality Image Fusion
di: Zhao, Zixiang, et al.
Pubblicazione: (2023)
di: Zhao, Zixiang, et al.
Pubblicazione: (2023)
MaxFusion: Plug&Play Multi-Modal Generation in Text-to-Image Diffusion Models
di: Nair, Nithin Gopalakrishnan, et al.
Pubblicazione: (2024)
di: Nair, Nithin Gopalakrishnan, et al.
Pubblicazione: (2024)
Missing No More: Dictionary-Guided Cross-Modal Image Fusion under Missing Infrared
di: Zhang, Yafei, et al.
Pubblicazione: (2026)
di: Zhang, Yafei, et al.
Pubblicazione: (2026)
Bridging Text and Vision: A Multi-View Text-Vision Registration Approach for Cross-Modal Place Recognition
di: Shang, Tianyi, et al.
Pubblicazione: (2025)
di: Shang, Tianyi, et al.
Pubblicazione: (2025)
Text-DiFuse: An Interactive Multi-Modal Image Fusion Framework based on Text-modulated Diffusion Model
di: Zhang, Hao, et al.
Pubblicazione: (2024)
di: Zhang, Hao, et al.
Pubblicazione: (2024)
TUNI: Real-time RGB-T Semantic Segmentation with Unified Multi-Modal Feature Extraction and Cross-Modal Feature Fusion
di: Guo, Xiaodong, et al.
Pubblicazione: (2025)
di: Guo, Xiaodong, et al.
Pubblicazione: (2025)
Contrastive Learning-Driven Traffic Sign Perception: Multi-Modal Fusion of Text and Vision
di: Lu, Qiang, et al.
Pubblicazione: (2025)
di: Lu, Qiang, et al.
Pubblicazione: (2025)
Affective Behaviour Analysis via Integrating Multi-Modal Knowledge
di: Zhang, Wei, et al.
Pubblicazione: (2024)
di: Zhang, Wei, et al.
Pubblicazione: (2024)
OracleSage: Towards Unified Visual-Linguistic Understanding of Oracle Bone Scripts through Cross-Modal Knowledge Fusion
di: Jiang, Hanqi, et al.
Pubblicazione: (2024)
di: Jiang, Hanqi, et al.
Pubblicazione: (2024)
DMF-Net: Image-Guided Point Cloud Completion with Dual-Channel Modality Fusion and Shape-Aware Upsampling Transformer
di: Mao, Aihua, et al.
Pubblicazione: (2024)
di: Mao, Aihua, et al.
Pubblicazione: (2024)
USP: Unified Self-Supervised Pretraining for Image Generation and Understanding
di: Chu, Xiangxiang, et al.
Pubblicazione: (2025)
di: Chu, Xiangxiang, et al.
Pubblicazione: (2025)
Unveiling the Depths: A Multi-Modal Fusion Framework for Challenging Scenarios
di: Xu, Jialei, et al.
Pubblicazione: (2024)
di: Xu, Jialei, et al.
Pubblicazione: (2024)
MaeFuse: Transferring Omni Features with Pretrained Masked Autoencoders for Infrared and Visible Image Fusion via Guided Training
di: Li, Jiayang, et al.
Pubblicazione: (2024)
di: Li, Jiayang, et al.
Pubblicazione: (2024)
DIFF-MF: A Difference-Driven Channel-Spatial State Space Model for Multi-Modal Image Fusion
di: Sun, Yiming, et al.
Pubblicazione: (2026)
di: Sun, Yiming, et al.
Pubblicazione: (2026)
MM-Retinal: Knowledge-Enhanced Foundational Pretraining with Fundus Image-Text Expertise
di: Wu, Ruiqi, et al.
Pubblicazione: (2024)
di: Wu, Ruiqi, et al.
Pubblicazione: (2024)
Generative Multi-Focus Image Fusion
di: Xie, Xinzhe, et al.
Pubblicazione: (2025)
di: Xie, Xinzhe, et al.
Pubblicazione: (2025)
One Latent Space to Rule All Degradations: Unifying Restoration Knowledge for Image Fusion
di: Ma, Haolong, et al.
Pubblicazione: (2025)
di: Ma, Haolong, et al.
Pubblicazione: (2025)
Feature Perturbation Pool-based Fusion Network for Unified Multi-Class Industrial Defect Detection
di: Xu, Yuanchan, et al.
Pubblicazione: (2026)
di: Xu, Yuanchan, et al.
Pubblicazione: (2026)
Unified Multi-Modal Image Synthesis for Missing Modality Imputation
di: Zhang, Yue, et al.
Pubblicazione: (2023)
di: Zhang, Yue, et al.
Pubblicazione: (2023)
Better with Less: Tackling Heterogeneous Multi-Modal Image Joint Pretraining via Conditioned and Degraded Masked Autoencoder
di: Peng, Bowen, et al.
Pubblicazione: (2026)
di: Peng, Bowen, et al.
Pubblicazione: (2026)
A Unified Foundation Model for All-in-One Multi-Modal Remote Sensing Image Restoration and Fusion with Language Prompting
di: Cui, Yongchuan, et al.
Pubblicazione: (2026)
di: Cui, Yongchuan, et al.
Pubblicazione: (2026)
CLIP-Guided Data Augmentation for Night-Time Image Dehazing
di: Ge, Xining, et al.
Pubblicazione: (2026)
di: Ge, Xining, et al.
Pubblicazione: (2026)
Documenti analoghi
-
All-weather Multi-Modality Image Fusion: Unified Framework and 100k Benchmark
di: Li, Xilai, et al.
Pubblicazione: (2024) -
FTPFusion: Frequency-Aware Infrared and Visible Video Fusion with Temporal Perturbation
di: Li, Xilai, et al.
Pubblicazione: (2026) -
AWM-Fuse: Multi-Modality Image Fusion for Adverse Weather via Global and Local Text Perception
di: Li, Xilai, et al.
Pubblicazione: (2025) -
MMA-UNet: A Multi-Modal Asymmetric UNet Architecture for Infrared and Visible Image Fusion
di: Huang, Jingxue, et al.
Pubblicazione: (2024) -
SAMF: Small-Area-Aware Multi-focus Image Fusion for Object Detection
di: Li, Xilai, et al.
Pubblicazione: (2024)