TextFusion: Unveiling the Power of Textual Semantics for Controllable Image Fusion
Fuente:
arXiv
Saved in:
| Main Authors: | Cheng, Chunyang, Xu, Tianyang, Wu, Xiao-Jun, Li, Hui, Li, Xi, Tang, Zhangyong, Kittler, Josef |
|---|---|
| Format: | Preprint |
| Published: |
2023
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
FusionBooster: A Unified Image Fusion Boosting Paradigm
by: Cheng, Chunyang, et al.
Published: (2023)
by: Cheng, Chunyang, et al.
Published: (2023)
EvaNet: Towards More Efficient and Consistent Infrared and Visible Image Fusion Assessment
by: Cheng, Chunyang, et al.
Published: (2026)
by: Cheng, Chunyang, et al.
Published: (2026)
SMLNet: A SPD Manifold Learning Network for Infrared and Visible Image Fusion
by: Kang, Huan, et al.
Published: (2024)
by: Kang, Huan, et al.
Published: (2024)
GrFormer: A Novel Transformer on Grassmann Manifold for Infrared and Visible Image Fusion
by: Kang, Huan, et al.
Published: (2025)
by: Kang, Huan, et al.
Published: (2025)
MMDRFuse: Distilled Mini-Model with Dynamic Refresh for Multi-Modality Image Fusion
by: Deng, Yanglin, et al.
Published: (2024)
by: Deng, Yanglin, et al.
Published: (2024)
MdaIF: Robust One-Stop Multi-Degradation-Aware Image Fusion with Language-Driven Semantics
by: Li, Jing, et al.
Published: (2025)
by: Li, Jing, et al.
Published: (2025)
TENet: Targetness Entanglement Incorporating with Multi-Scale Pooling and Mutually-Guided Fusion for RGB-E Object Tracking
by: Shao, Pengcheng, et al.
Published: (2024)
by: Shao, Pengcheng, et al.
Published: (2024)
Beyond Strict Pairing: Arbitrarily Paired Training for High-Performance Infrared and Visible Image Fusion
by: Deng, Yanglin, et al.
Published: (2026)
by: Deng, Yanglin, et al.
Published: (2026)
One Model for ALL: Low-Level Task Interaction Is a Key to Task-Agnostic Image Fusion
by: Cheng, Chunyang, et al.
Published: (2025)
by: Cheng, Chunyang, et al.
Published: (2025)
Explainable Classifier for Malignant Lymphoma Subtyping via Cell Graph and Image Fusion
by: Nishiyama, Daiki, et al.
Published: (2025)
by: Nishiyama, Daiki, et al.
Published: (2025)
From Text to Pixels: A Context-Aware Semantic Synergy Solution for Infrared and Visible Image Fusion
by: Li, Xingyuan, et al.
Published: (2023)
by: Li, Xingyuan, et al.
Published: (2023)
Revisiting RGBT Tracking Benchmarks from the Perspective of Modality Validity: A New Benchmark, Problem, and Solution
by: Tang, Zhangyong, et al.
Published: (2024)
by: Tang, Zhangyong, et al.
Published: (2024)
Learning Progressive Adaptation for Multi-Modal Tracking
by: Wang, He, et al.
Published: (2026)
by: Wang, He, et al.
Published: (2026)
UASTrack: A Unified Adaptive Selection Framework with Modality-Customization in Single Object Tracking
by: Wang, He, et al.
Published: (2025)
by: Wang, He, et al.
Published: (2025)
Cognitive Linguistic Identity Fusion Score (CLIFS): A Scalable Cognition-Informed Approach to Quantifying Identity Fusion from Text
by: Wright, Devin R., et al.
Published: (2025)
by: Wright, Devin R., et al.
Published: (2025)
CFFormer: Cross CNN-Transformer Channel Attention and Spatial Feature Fusion for Improved Segmentation of Heterogeneous Medical Images
by: Li, Jiaxuan, et al.
Published: (2025)
by: Li, Jiaxuan, et al.
Published: (2025)
FACEMUG: A Multimodal Generative and Fusion Framework for Local Facial Editing
by: Lu, Wanglong, et al.
Published: (2024)
by: Lu, Wanglong, et al.
Published: (2024)
Intrinsic Image Fusion for Multi-View 3D Material Reconstruction
by: Kocsis, Peter, et al.
Published: (2025)
by: Kocsis, Peter, et al.
Published: (2025)
VersaGen: Unleashing Versatile Visual Control for Text-to-Image Synthesis
by: Chen, Zhipeng, et al.
Published: (2024)
by: Chen, Zhipeng, et al.
Published: (2024)
Serial Over Parallel: Learning Continual Unification for Multi-Modal Visual Object Tracking and Benchmarking
by: Tang, Zhangyong, et al.
Published: (2025)
by: Tang, Zhangyong, et al.
Published: (2025)
SemanticAgent: A Semantics-Aware Framework for Text-to-SQL Data Synthesis
by: Gao, Qiang, et al.
Published: (2026)
by: Gao, Qiang, et al.
Published: (2026)
Hierarchical Image-Guided 3D Point Cloud Segmentation in Industrial Scenes via Multi-View Bayesian Fusion
by: Zhu, Yu, et al.
Published: (2025)
by: Zhu, Yu, et al.
Published: (2025)
Text-Visual Semantic Constrained AI-Generated Image Quality Assessment
by: Li, Qiang, et al.
Published: (2025)
by: Li, Qiang, et al.
Published: (2025)
Fusion and Grouping Strategies in Deep Learning for Local Climate Zone Classification of Multimodal Remote Sensing Data
by: Thomas, Ancymol, et al.
Published: (2026)
by: Thomas, Ancymol, et al.
Published: (2026)
Evaluation Metric for Quality Control and Generative Models in Histopathology Images
by: Jeevan, Pranav, et al.
Published: (2024)
by: Jeevan, Pranav, et al.
Published: (2024)
Residual Transformer Fusion Network for Salt and Pepper Image Denoising
by: Putra, Bintang Pradana Erlangga, et al.
Published: (2025)
by: Putra, Bintang Pradana Erlangga, et al.
Published: (2025)
Language Predicts Identity Fusion Across Cultures and Reveals Divergent Pathways to Violence
by: Wright, Devin R., et al.
Published: (2026)
by: Wright, Devin R., et al.
Published: (2026)
Omni Survey for Multimodality Analysis in Visual Object Tracking
by: Tang, Zhangyong, et al.
Published: (2025)
by: Tang, Zhangyong, et al.
Published: (2025)
AnatoMaskGAN: GNN-Driven Slice Feature Fusion and Noise Augmentation for Medical Semantic Image Synthesis
by: Wu, Zonglin, et al.
Published: (2025)
by: Wu, Zonglin, et al.
Published: (2025)
Unveiling Text in Challenging Stone Inscriptions: A Character-Context-Aware Patching Strategy for Binarization
by: Jena, Pratyush, et al.
Published: (2026)
by: Jena, Pratyush, et al.
Published: (2026)
Multimodal Ensemble with Conditional Feature Fusion for Dysgraphia Diagnosis in Children from Handwriting Samples
by: Kunhoth, Jayakanth, et al.
Published: (2024)
by: Kunhoth, Jayakanth, et al.
Published: (2024)
TextDoctor: Unified Document Image Inpainting via Patch Pyramid Diffusion Models
by: Lu, Wanglong, et al.
Published: (2025)
by: Lu, Wanglong, et al.
Published: (2025)
Dynamic Brightness Adaptation for Robust Multi-modal Image Fusion
by: Sun, Yiming, et al.
Published: (2024)
by: Sun, Yiming, et al.
Published: (2024)
Reference Dataset and Benchmark for Reconstructing Laser Parameters from On-axis Video in Powder Bed Fusion of Bulk Stainless Steel
by: Blanc, Cyril, et al.
Published: (2024)
by: Blanc, Cyril, et al.
Published: (2024)
Disentangling Generation and Regression in Stochastic Interpolants for Controllable Image Restoration
by: Liu, Yi, et al.
Published: (2026)
by: Liu, Yi, et al.
Published: (2026)
U-Net-Like Spiking Neural Networks for Single Image Dehazing
by: Li, Huibin, et al.
Published: (2025)
by: Li, Huibin, et al.
Published: (2025)
Lightweight Complementary-Cue Fusion for Robust Video Face Forgery Detection
by: Baek, Sunghwan, et al.
Published: (2026)
by: Baek, Sunghwan, et al.
Published: (2026)
Frequency-Decomposed INR for NIR-Assisted Low-Light RGB Image Denoising
by: Shi, Ligen, et al.
Published: (2026)
by: Shi, Ligen, et al.
Published: (2026)
Normalizing Flow-Based Metric for Image Generation
by: Jeevan, Pranav, et al.
Published: (2024)
by: Jeevan, Pranav, et al.
Published: (2024)
WISE: A World Knowledge-Informed Semantic Evaluation for Text-to-Image Generation
by: Niu, Yuwei, et al.
Published: (2025)
by: Niu, Yuwei, et al.
Published: (2025)
Similar Items
-
FusionBooster: A Unified Image Fusion Boosting Paradigm
by: Cheng, Chunyang, et al.
Published: (2023) -
EvaNet: Towards More Efficient and Consistent Infrared and Visible Image Fusion Assessment
by: Cheng, Chunyang, et al.
Published: (2026) -
SMLNet: A SPD Manifold Learning Network for Infrared and Visible Image Fusion
by: Kang, Huan, et al.
Published: (2024) -
GrFormer: A Novel Transformer on Grassmann Manifold for Infrared and Visible Image Fusion
by: Kang, Huan, et al.
Published: (2025) -
MMDRFuse: Distilled Mini-Model with Dynamic Refresh for Multi-Modality Image Fusion
by: Deng, Yanglin, et al.
Published: (2024)