Fusion in Your Way: Aligning Image Fusion with Heterogeneous Demands via Direct Preference Optimization
Fuente:
arXiv
Saved in:
| Main Authors: | Su, Weijian, Zhang, Songqian, Han, Yuqi, Zhuang, Jian, Huang, Yongdong, Zhang, Qiang |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Scale-GS: Efficient Scalable Gaussian Splatting via Redundancy-filtering Training on Streaming Content
by: Yang, Jiayu, et al.
Published: (2025)
by: Yang, Jiayu, et al.
Published: (2025)
UTA-Sign: Unsupervised Thermal Video Augmentation via Event-Assisted Traffic Signage Sketching
by: Han, Yuqi, et al.
Published: (2025)
by: Han, Yuqi, et al.
Published: (2025)
D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples
by: Hu, Zijing, et al.
Published: (2025)
by: Hu, Zijing, et al.
Published: (2025)
Follow-Your-Preference: Towards Preference-Aligned Image Inpainting
by: Shen, Yutao, et al.
Published: (2025)
by: Shen, Yutao, et al.
Published: (2025)
Uncertainty-Aware Exploratory Direct Preference Optimization for Multimodal Large Language Models
by: Zhang, Huatian, et al.
Published: (2026)
by: Zhang, Huatian, et al.
Published: (2026)
Harmonized Tabular-Image Fusion via Gradient-Aligned Alternating Learning
by: Huang, Longfei, et al.
Published: (2026)
by: Huang, Longfei, et al.
Published: (2026)
Robust Fusion Controller: Degradation-aware Image Fusion with Fine-grained Language Instructions
by: Zhang, Hao, et al.
Published: (2025)
by: Zhang, Hao, et al.
Published: (2025)
AVC-DPO: Aligned Video Captioning via Direct Preference Optimization
by: Tang, Jiyang, et al.
Published: (2025)
by: Tang, Jiyang, et al.
Published: (2025)
Control Your Queries: Heterogeneous Query Interaction for Camera-Radar Fusion
by: Wu, Jialong, et al.
Published: (2026)
by: Wu, Jialong, et al.
Published: (2026)
Multi-Branch Non-Homogeneous Image Dehazing via Concentration Partitioning and Image Fusion
by: Zhang, Yingming, et al.
Published: (2026)
by: Zhang, Yingming, et al.
Published: (2026)
AMF-MedIT: An Efficient Align-Modulation-Fusion Framework for Medical Image-Tabular Data
by: Yu, Congjing, et al.
Published: (2025)
by: Yu, Congjing, et al.
Published: (2025)
ReAlign: Generalizable Image Forgery Detection via Reasoning-Aligned Representation
by: Huang, Qing, et al.
Published: (2026)
by: Huang, Qing, et al.
Published: (2026)
Multi-View Fusion Neural Network for Traffic Demand Prediction
by: Zhang, Dongran, et al.
Published: (2024)
by: Zhang, Dongran, et al.
Published: (2024)
IAIFNet: An Illumination-Aware Infrared and Visible Image Fusion Network
by: Yang, Qiao, et al.
Published: (2023)
by: Yang, Qiao, et al.
Published: (2023)
PFDepth: Heterogeneous Pinhole-Fisheye Joint Depth Estimation via Distortion-aware Gaussian-Splatted Volumetric Fusion
by: Zhang, Zhiwei, et al.
Published: (2025)
by: Zhang, Zhiwei, et al.
Published: (2025)
Boost Your Human Image Generation Model via Direct Preference Optimization
by: Na, Sanghyeon, et al.
Published: (2024)
by: Na, Sanghyeon, et al.
Published: (2024)
Image Fusion via Vision-Language Model
by: Zhao, Zixiang, et al.
Published: (2024)
by: Zhao, Zixiang, et al.
Published: (2024)
ADHMR: Aligning Diffusion-based Human Mesh Recovery via Direct Preference Optimization
by: Shen, Wenhao, et al.
Published: (2025)
by: Shen, Wenhao, et al.
Published: (2025)
Waver: Wave Your Way to Lifelike Video Generation
by: Zhang, Yifu, et al.
Published: (2025)
by: Zhang, Yifu, et al.
Published: (2025)
Re-Align: Aligning Vision Language Models via Retrieval-Augmented Direct Preference Optimization
by: Xing, Shuo, et al.
Published: (2025)
by: Xing, Shuo, et al.
Published: (2025)
Diff-Instruct++: Training One-step Text-to-image Generator Model to Align with Human Preferences
by: Luo, Weijian
Published: (2024)
by: Luo, Weijian
Published: (2024)
OnlineVPO: Align Video Diffusion Model with Online Video-Centric Preference Optimization
by: Zhang, Jiacheng, et al.
Published: (2024)
by: Zhang, Jiacheng, et al.
Published: (2024)
SSPFusion: A Semantic Structure-Preserving Approach for Infrared and Visible Image Fusion
by: Yang, Qiao, et al.
Published: (2023)
by: Yang, Qiao, et al.
Published: (2023)
Task-driven Image Fusion with Learnable Fusion Loss
by: Bai, Haowen, et al.
Published: (2024)
by: Bai, Haowen, et al.
Published: (2024)
Smoothed Preference Optimization via ReNoise Inversion for Aligning Diffusion Models with Varied Human Preferences
by: Lu, Yunhong, et al.
Published: (2025)
by: Lu, Yunhong, et al.
Published: (2025)
EMOdiffhead: Continuously Emotional Control in Talking Head Generation via Diffusion
by: Zhang, Jian, et al.
Published: (2024)
by: Zhang, Jian, et al.
Published: (2024)
SFDFusion: An Efficient Spatial-Frequency Domain Fusion Network for Infrared and Visible Image Fusion
by: Hu, Kun, et al.
Published: (2024)
by: Hu, Kun, et al.
Published: (2024)
SMFusion: Semantic-Preserving Fusion of Multimodal Medical Images for Enhanced Clinical Diagnosis
by: Xiang, Haozhe, et al.
Published: (2025)
by: Xiang, Haozhe, et al.
Published: (2025)
ReFusion: Learning Image Fusion from Reconstruction with Learnable Loss via Meta-Learning
by: Bai, Haowen, et al.
Published: (2023)
by: Bai, Haowen, et al.
Published: (2023)
Fourier-enhanced Implicit Neural Fusion Network for Multispectral and Hyperspectral Image Fusion
by: Liang, Yu-Jie, et al.
Published: (2024)
by: Liang, Yu-Jie, et al.
Published: (2024)
Personalized Federated Learning via Dual-Prompt Optimization and Cross Fusion
by: Zhang, Yuguang, et al.
Published: (2025)
by: Zhang, Yuguang, et al.
Published: (2025)
Fuse4Seg: Image Fusion for Multi-Modal Medical Segmentation via Bi-level Optimization
by: Guo, Yuchen, et al.
Published: (2024)
by: Guo, Yuchen, et al.
Published: (2024)
SphereFusion: Efficient Panorama Depth Estimation via Gated Fusion
by: Yan, Qingsong, et al.
Published: (2025)
by: Yan, Qingsong, et al.
Published: (2025)
Prompt-A-Video: Prompt Your Video Diffusion Model via Preference-Aligned LLM
by: Ji, Yatai, et al.
Published: (2024)
by: Ji, Yatai, et al.
Published: (2024)
Equivariant Multi-Modality Image Fusion
by: Zhao, Zixiang, et al.
Published: (2023)
by: Zhao, Zixiang, et al.
Published: (2023)
HetSSNet: Spatial-Spectral Heterogeneous Graph Learning Network for Panchromatic and Multispectral Images Fusion
by: Ma, Mengting, et al.
Published: (2025)
by: Ma, Mengting, et al.
Published: (2025)
OmniFood8K: Single-Image Nutrition Estimation via Hierarchical Frequency-Aligned Fusion
by: Yu, Dongjian, et al.
Published: (2026)
by: Yu, Dongjian, et al.
Published: (2026)
Fusion is all you need: Face Fusion for Customized Identity-Preserving Image Synthesis
by: Mohamed, Salaheldin, et al.
Published: (2024)
by: Mohamed, Salaheldin, et al.
Published: (2024)
DepthFusion: Depth-Aware Hybrid Feature Fusion for LiDAR-Camera 3D Object Detection
by: Ji, Mingqian, et al.
Published: (2025)
by: Ji, Mingqian, et al.
Published: (2025)
GeminiFusion: Efficient Pixel-wise Multimodal Fusion for Vision Transformer
by: Jia, Ding, et al.
Published: (2024)
by: Jia, Ding, et al.
Published: (2024)
Similar Items
-
Scale-GS: Efficient Scalable Gaussian Splatting via Redundancy-filtering Training on Streaming Content
by: Yang, Jiayu, et al.
Published: (2025) -
UTA-Sign: Unsupervised Thermal Video Augmentation via Event-Assisted Traffic Signage Sketching
by: Han, Yuqi, et al.
Published: (2025) -
D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples
by: Hu, Zijing, et al.
Published: (2025) -
Follow-Your-Preference: Towards Preference-Aligned Image Inpainting
by: Shen, Yutao, et al.
Published: (2025) -
Uncertainty-Aware Exploratory Direct Preference Optimization for Multimodal Large Language Models
by: Zhang, Huatian, et al.
Published: (2026)