ControlFusion: A Controllable Image Fusion Framework with Language-Vision Degradation Prompts
Fuente:
arXiv
Saved in:
| Main Authors: | Tang, Linfeng, Wang, Yeda, Cai, Zhanchuan, Jiang, Junjun, Ma, Jiayi |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
DSPFusion: Image Fusion via Degradation and Semantic Dual-Prior Guidance
by: Tang, Linfeng, et al.
Published: (2025)
by: Tang, Linfeng, et al.
Published: (2025)
Robust Fusion Controller: Degradation-aware Image Fusion with Fine-grained Language Instructions
by: Zhang, Hao, et al.
Published: (2025)
by: Zhang, Hao, et al.
Published: (2025)
Text-IF: Leveraging Semantic Text Guidance for Degradation-Aware and Interactive Image Fusion
by: Yi, Xunpeng, et al.
Published: (2024)
by: Yi, Xunpeng, et al.
Published: (2024)
Fusion from Decomposition: A Self-Supervised Approach for Image Fusion and Beyond
by: Liang, Pengwei, et al.
Published: (2024)
by: Liang, Pengwei, et al.
Published: (2024)
Towards Unified Semantic and Controllable Image Fusion: A Diffusion Transformer Approach
by: Li, Jiayang, et al.
Published: (2025)
by: Li, Jiayang, et al.
Published: (2025)
VideoFusion: A Spatio-Temporal Collaborative Network for Multi-modal Video Fusion
by: Tang, Linfeng, et al.
Published: (2025)
by: Tang, Linfeng, et al.
Published: (2025)
Balancing Task-invariant Interaction and Task-specific Adaptation for Unified Image Fusion
by: Hu, Xingyu, et al.
Published: (2025)
by: Hu, Xingyu, et al.
Published: (2025)
TemCoCo: Temporally Consistent Multi-modal Video Fusion with Visual-Semantic Collaboration
by: Gong, Meiqi, et al.
Published: (2025)
by: Gong, Meiqi, et al.
Published: (2025)
Degradation-Robust Fusion: An Efficient Degradation-Aware Diffusion Framework for Multimodal Image Fusion in Arbitrary Degradation Scenarios
by: Shi, Yu, et al.
Published: (2026)
by: Shi, Yu, et al.
Published: (2026)
MaeFuse: Transferring Omni Features with Pretrained Masked Autoencoders for Infrared and Visible Image Fusion via Guided Training
by: Li, Jiayang, et al.
Published: (2024)
by: Li, Jiayang, et al.
Published: (2024)
DDFusion:Degradation-Decoupled Fusion Framework for Robust Infrared and Visible Images Fusion
by: Zhang, Tianpei, et al.
Published: (2025)
by: Zhang, Tianpei, et al.
Published: (2025)
Beyond Degradation Redundancy: Contrastive Prompt Learning for All-in-One Image Restoration
by: Wu, Gang, et al.
Published: (2025)
by: Wu, Gang, et al.
Published: (2025)
Multi-modal Fusion based Q-distribution Prediction for Controlled Nuclear Fusion
by: Wang, Shiao, et al.
Published: (2024)
by: Wang, Shiao, et al.
Published: (2024)
FUSE: Label-Free Image-Event Joint Monocular Depth Estimation via Frequency-Decoupled Alignment and Degradation-Robust Fusion
by: Sun, Pihai, et al.
Published: (2025)
by: Sun, Pihai, et al.
Published: (2025)
Enhancing Infrared Vision: Progressive Prompt Fusion Network and Benchmark
by: Liu, Jinyuan, et al.
Published: (2025)
by: Liu, Jinyuan, et al.
Published: (2025)
CtrlFuse: Mask-Prompt Guided Controllable Infrared and Visible Image Fusion
by: Sun, Yiming, et al.
Published: (2026)
by: Sun, Yiming, et al.
Published: (2026)
Image Fusion via Vision-Language Model
by: Zhao, Zixiang, et al.
Published: (2024)
by: Zhao, Zixiang, et al.
Published: (2024)
Unveiling the Depths: A Multi-Modal Fusion Framework for Challenging Scenarios
by: Xu, Jialei, et al.
Published: (2024)
by: Xu, Jialei, et al.
Published: (2024)
Pedestrian Attribute Recognition via CLIP based Prompt Vision-Language Fusion
by: Wang, Xiao, et al.
Published: (2023)
by: Wang, Xiao, et al.
Published: (2023)
Text-DiFuse: An Interactive Multi-Modal Image Fusion Framework based on Text-modulated Diffusion Model
by: Zhang, Hao, et al.
Published: (2024)
by: Zhang, Hao, et al.
Published: (2024)
Dif-Fusion: Towards High Color Fidelity in Infrared and Visible Image Fusion with Diffusion Models
by: Yue, Jun, et al.
Published: (2023)
by: Yue, Jun, et al.
Published: (2023)
Coupled Degradation Modeling and Fusion: A VLM-Guided Degradation-Coupled Network for Degradation-Aware Infrared and Visible Image Fusion
by: Zhang, Tianpei, et al.
Published: (2025)
by: Zhang, Tianpei, et al.
Published: (2025)
TextFusion: Unveiling the Power of Textual Semantics for Controllable Image Fusion
by: Cheng, Chunyang, et al.
Published: (2023)
by: Cheng, Chunyang, et al.
Published: (2023)
SocialFusion: Addressing Social Degradation in Pre-trained Vision-Language Models
by: Tahboub, Hamza, et al.
Published: (2025)
by: Tahboub, Hamza, et al.
Published: (2025)
Dual-Domain Perspective on Degradation-Aware Fusion: A VLM-Guided Robust Infrared and Visible Image Fusion Framework
by: Zhang, Tianpei, et al.
Published: (2025)
by: Zhang, Tianpei, et al.
Published: (2025)
Image Deblurring by Exploring In-depth Properties of Transformer
by: Liang, Pengwei, et al.
Published: (2023)
by: Liang, Pengwei, et al.
Published: (2023)
SimpleFusion: A Simple Fusion Framework for Infrared and Visible Images
by: Chen, Ming, et al.
Published: (2024)
by: Chen, Ming, et al.
Published: (2024)
EVF-SAM: Early Vision-Language Fusion for Text-Prompted Segment Anything Model
by: Zhang, Yuxuan, et al.
Published: (2024)
by: Zhang, Yuxuan, et al.
Published: (2024)
MagicFuse: Single Image Fusion for Visual and Semantic Reinforcement
by: Zhang, Hao, et al.
Published: (2026)
by: Zhang, Hao, et al.
Published: (2026)
Controllable Longer Image Animation with Diffusion Models
by: Wang, Qiang, et al.
Published: (2024)
by: Wang, Qiang, et al.
Published: (2024)
Efficient Rectified Flow for Image Fusion
by: Wang, Zirui, et al.
Published: (2025)
by: Wang, Zirui, et al.
Published: (2025)
Enhanced Object Tracking by Self-Supervised Auxiliary Depth Estimation Learning
by: Wei, Zhenyu, et al.
Published: (2024)
by: Wei, Zhenyu, et al.
Published: (2024)
EVLF: Early Vision-Language Fusion for Generative Dataset Distillation
by: Cai, Wenqi, et al.
Published: (2026)
by: Cai, Wenqi, et al.
Published: (2026)
Degradation-Aware Image Enhancement via Vision-Language Classification
by: Cai, Jie, et al.
Published: (2025)
by: Cai, Jie, et al.
Published: (2025)
Conditional Controllable Image Fusion
by: Cao, Bing, et al.
Published: (2024)
by: Cao, Bing, et al.
Published: (2024)
UltraFusion: Ultra High Dynamic Imaging using Exposure Fusion
by: Chen, Zixuan, et al.
Published: (2025)
by: Chen, Zixuan, et al.
Published: (2025)
VLC Fusion: Vision-Language Conditioned Sensor Fusion for Robust Object Detection
by: Taparia, Aditya, et al.
Published: (2025)
by: Taparia, Aditya, et al.
Published: (2025)
One Latent Space to Rule All Degradations: Unifying Restoration Knowledge for Image Fusion
by: Ma, Haolong, et al.
Published: (2025)
by: Ma, Haolong, et al.
Published: (2025)
ControlMLLM: Training-Free Visual Prompt Learning for Multimodal Large Language Models
by: Wu, Mingrui, et al.
Published: (2024)
by: Wu, Mingrui, et al.
Published: (2024)
CoMatch: Dynamic Covisibility-Aware Transformer for Bilateral Subpixel-Level Semi-Dense Image Matching
by: Li, Zizhuo, et al.
Published: (2025)
by: Li, Zizhuo, et al.
Published: (2025)
Similar Items
-
DSPFusion: Image Fusion via Degradation and Semantic Dual-Prior Guidance
by: Tang, Linfeng, et al.
Published: (2025) -
Robust Fusion Controller: Degradation-aware Image Fusion with Fine-grained Language Instructions
by: Zhang, Hao, et al.
Published: (2025) -
Text-IF: Leveraging Semantic Text Guidance for Degradation-Aware and Interactive Image Fusion
by: Yi, Xunpeng, et al.
Published: (2024) -
Fusion from Decomposition: A Self-Supervised Approach for Image Fusion and Beyond
by: Liang, Pengwei, et al.
Published: (2024) -
Towards Unified Semantic and Controllable Image Fusion: A Diffusion Transformer Approach
by: Li, Jiayang, et al.
Published: (2025)