Robust Fusion Controller: Degradation-aware Image Fusion with Fine-grained Language Instructions
Fuente:
arXiv
Saved in:
| Main Authors: | Zhang, Hao, Zha, Yanping, Zhuang, Qingwei, Shao, Zhenfeng, Ma, Jiayi |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
MagicFuse: Single Image Fusion for Visual and Semantic Reinforcement
by: Zhang, Hao, et al.
Published: (2026)
by: Zhang, Hao, et al.
Published: (2026)
ControlFusion: A Controllable Image Fusion Framework with Language-Vision Degradation Prompts
by: Tang, Linfeng, et al.
Published: (2025)
by: Tang, Linfeng, et al.
Published: (2025)
Text-IF: Leveraging Semantic Text Guidance for Degradation-Aware and Interactive Image Fusion
by: Yi, Xunpeng, et al.
Published: (2024)
by: Yi, Xunpeng, et al.
Published: (2024)
DDFusion:Degradation-Decoupled Fusion Framework for Robust Infrared and Visible Images Fusion
by: Zhang, Tianpei, et al.
Published: (2025)
by: Zhang, Tianpei, et al.
Published: (2025)
DSPFusion: Image Fusion via Degradation and Semantic Dual-Prior Guidance
by: Tang, Linfeng, et al.
Published: (2025)
by: Tang, Linfeng, et al.
Published: (2025)
Degradation-Robust Fusion: An Efficient Degradation-Aware Diffusion Framework for Multimodal Image Fusion in Arbitrary Degradation Scenarios
by: Shi, Yu, et al.
Published: (2026)
by: Shi, Yu, et al.
Published: (2026)
Text-DiFuse: An Interactive Multi-Modal Image Fusion Framework based on Text-modulated Diffusion Model
by: Zhang, Hao, et al.
Published: (2024)
by: Zhang, Hao, et al.
Published: (2024)
Fusion from Decomposition: A Self-Supervised Approach for Image Fusion and Beyond
by: Liang, Pengwei, et al.
Published: (2024)
by: Liang, Pengwei, et al.
Published: (2024)
Dual-Domain Perspective on Degradation-Aware Fusion: A VLM-Guided Robust Infrared and Visible Image Fusion Framework
by: Zhang, Tianpei, et al.
Published: (2025)
by: Zhang, Tianpei, et al.
Published: (2025)
Coupled Degradation Modeling and Fusion: A VLM-Guided Degradation-Coupled Network for Degradation-Aware Infrared and Visible Image Fusion
by: Zhang, Tianpei, et al.
Published: (2025)
by: Zhang, Tianpei, et al.
Published: (2025)
FireEdit: Fine-grained Instruction-based Image Editing via Region-aware Vision Language Model
by: Zhou, Jun, et al.
Published: (2025)
by: Zhou, Jun, et al.
Published: (2025)
Dif-Fusion: Towards High Color Fidelity in Infrared and Visible Image Fusion with Diffusion Models
by: Yue, Jun, et al.
Published: (2023)
by: Yue, Jun, et al.
Published: (2023)
S4Fusion: Saliency-aware Selective State Space Model for Infrared Visible Image Fusion
by: Ma, Haolong, et al.
Published: (2024)
by: Ma, Haolong, et al.
Published: (2024)
F4-ITS: Fine-grained Feature Fusion for Food Image-Text Search
by: Asokan, Raghul
Published: (2025)
by: Asokan, Raghul
Published: (2025)
WIFE-Fusion:Wavelet-aware Intra-inter Frequency Enhancement for Multi-model Image Fusion
by: Zhang, Tianpei, et al.
Published: (2025)
by: Zhang, Tianpei, et al.
Published: (2025)
Perception-as-Control: Fine-grained Controllable Image Animation with 3D-aware Motion Representation
by: Chen, Yingjie, et al.
Published: (2025)
by: Chen, Yingjie, et al.
Published: (2025)
Efficient Rectified Flow for Image Fusion
by: Wang, Zirui, et al.
Published: (2025)
by: Wang, Zirui, et al.
Published: (2025)
Fusion in Your Way: Aligning Image Fusion with Heterogeneous Demands via Direct Preference Optimization
by: Su, Weijian, et al.
Published: (2026)
by: Su, Weijian, et al.
Published: (2026)
Uncertainty-aware Spatial-Frequency Registration and Fusion for Infrared and Visible Images
by: Li, Xingyuan, et al.
Published: (2026)
by: Li, Xingyuan, et al.
Published: (2026)
One Latent Space to Rule All Degradations: Unifying Restoration Knowledge for Image Fusion
by: Ma, Haolong, et al.
Published: (2025)
by: Ma, Haolong, et al.
Published: (2025)
VideoFusion: A Spatio-Temporal Collaborative Network for Multi-modal Video Fusion
by: Tang, Linfeng, et al.
Published: (2025)
by: Tang, Linfeng, et al.
Published: (2025)
TemCoCo: Temporally Consistent Multi-modal Video Fusion with Visual-Semantic Collaboration
by: Gong, Meiqi, et al.
Published: (2025)
by: Gong, Meiqi, et al.
Published: (2025)
Towards Unified Semantic and Controllable Image Fusion: A Diffusion Transformer Approach
by: Li, Jiayang, et al.
Published: (2025)
by: Li, Jiayang, et al.
Published: (2025)
Text-Guided Coarse-to-Fine Fusion Network for Robust Remote Sensing Visual Question Answering
by: Zhao, Zhicheng, et al.
Published: (2024)
by: Zhao, Zhicheng, et al.
Published: (2024)
Entity-Guided Multi-Task Learning for Infrared and Visible Image Fusion
by: Shao, Wenyu, et al.
Published: (2026)
by: Shao, Wenyu, et al.
Published: (2026)
Multi-modal Reference Learning for Fine-grained Text-to-Image Retrieval
by: Ma, Zehong, et al.
Published: (2025)
by: Ma, Zehong, et al.
Published: (2025)
VLC Fusion: Vision-Language Conditioned Sensor Fusion for Robust Object Detection
by: Taparia, Aditya, et al.
Published: (2025)
by: Taparia, Aditya, et al.
Published: (2025)
Segmenting and Understanding: Region-aware Semantic Attention for Fine-grained Image Quality Assessment with Large Language Models
by: Song, Chenyue, et al.
Published: (2025)
by: Song, Chenyue, et al.
Published: (2025)
Image Fusion via Vision-Language Model
by: Zhao, Zixiang, et al.
Published: (2024)
by: Zhao, Zixiang, et al.
Published: (2024)
Balancing Task-invariant Interaction and Task-specific Adaptation for Unified Image Fusion
by: Hu, Xingyu, et al.
Published: (2025)
by: Hu, Xingyu, et al.
Published: (2025)
Instruction-Driven Fusion of Infrared-Visible Images: Tailoring for Diverse Downstream Tasks
by: Yang, Zengyi, et al.
Published: (2024)
by: Yang, Zengyi, et al.
Published: (2024)
EPOFusion: Exposure aware Progressive Optimization Method for Infrared and Visible Image Fusion
by: Wang, Zhiwei, et al.
Published: (2026)
by: Wang, Zhiwei, et al.
Published: (2026)
BFA: Best-Feature-Aware Fusion for Multi-View Fine-grained Manipulation
by: Lan, Zihan, et al.
Published: (2025)
by: Lan, Zihan, et al.
Published: (2025)
Fine-grained Defocus Blur Control for Generative Image Models
by: Shrivastava, Ayush, et al.
Published: (2025)
by: Shrivastava, Ayush, et al.
Published: (2025)
Residual Prior-driven Frequency-aware Network for Image Fusion
by: Zheng, Guan, et al.
Published: (2025)
by: Zheng, Guan, et al.
Published: (2025)
Language-Depth Navigated Thermal and Visible Image Fusion
by: Zhang, Jinchang, et al.
Published: (2025)
by: Zhang, Jinchang, et al.
Published: (2025)
Enhancing Adaptive Deep Networks for Image Classification via Uncertainty-aware Decision Fusion
by: Zhang, Xu, et al.
Published: (2024)
by: Zhang, Xu, et al.
Published: (2024)
UniFusion: A Unified Image Fusion Framework with Robust Representation and Source-Aware Preservation
by: Li, Xingyuan, et al.
Published: (2026)
by: Li, Xingyuan, et al.
Published: (2026)
Libra-MIL: Multimodal Prototypes Stereoscopic Infused with Task-specific Language Priors for Few-shot Whole Slide Image Classification
by: Zhuang, Zhenfeng, et al.
Published: (2025)
by: Zhuang, Zhenfeng, et al.
Published: (2025)
Task-driven Image Fusion with Learnable Fusion Loss
by: Bai, Haowen, et al.
Published: (2024)
by: Bai, Haowen, et al.
Published: (2024)
Similar Items
-
MagicFuse: Single Image Fusion for Visual and Semantic Reinforcement
by: Zhang, Hao, et al.
Published: (2026) -
ControlFusion: A Controllable Image Fusion Framework with Language-Vision Degradation Prompts
by: Tang, Linfeng, et al.
Published: (2025) -
Text-IF: Leveraging Semantic Text Guidance for Degradation-Aware and Interactive Image Fusion
by: Yi, Xunpeng, et al.
Published: (2024) -
DDFusion:Degradation-Decoupled Fusion Framework for Robust Infrared and Visible Images Fusion
by: Zhang, Tianpei, et al.
Published: (2025) -
DSPFusion: Image Fusion via Degradation and Semantic Dual-Prior Guidance
by: Tang, Linfeng, et al.
Published: (2025)