Bridging the Gap: Aligning Text-to-Image Diffusion Models with Specific Feedback
Fuente:
arXiv
Guardado en:
| Autores principales: | Niu, Xuexiang, Tang, Jinping, Wang, Lei, Zhu, Ge |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Bridging the Intention-Expression Gap: Aligning Multi-Dimensional Preferences via Hierarchical Relevance Feedback in Text-to-Image Diffusion
por: Wang, Wenxi, et al.
Publicado: (2026)
por: Wang, Wenxi, et al.
Publicado: (2026)
Category-level Text-to-Image Retrieval Improved: Bridging the Domain Gap with Diffusion Models and Vision Encoders
por: Khan, Faizan Farooq, et al.
Publicado: (2025)
por: Khan, Faizan Farooq, et al.
Publicado: (2025)
Asynchronous Denoising Diffusion Models for Aligning Text-to-Image Generation
por: Hu, Zijing, et al.
Publicado: (2025)
por: Hu, Zijing, et al.
Publicado: (2025)
Can Diffusion Models Bridge the Domain Gap in Cardiac MR Imaging?
por: Wong, Xin Ci, et al.
Publicado: (2025)
por: Wong, Xin Ci, et al.
Publicado: (2025)
TextRegion: Text-Aligned Region Tokens from Frozen Image-Text Models
por: Xiao, Yao, et al.
Publicado: (2025)
por: Xiao, Yao, et al.
Publicado: (2025)
Fair Text to Medical Image Diffusion Model with Subgroup Distribution Aligned Tuning
por: Han, Xu, et al.
Publicado: (2024)
por: Han, Xu, et al.
Publicado: (2024)
StyleBlend: Enhancing Style-Specific Content Creation in Text-to-Image Diffusion Models
por: Chen, Zichong, et al.
Publicado: (2025)
por: Chen, Zichong, et al.
Publicado: (2025)
Energy-oriented Diffusion Bridge for Image Restoration with Foundational Diffusion Models
por: Hou, Jinhui, et al.
Publicado: (2026)
por: Hou, Jinhui, et al.
Publicado: (2026)
Text-Anchored Score Composition: Tackling Condition Misalignment in Text-to-Image Diffusion Models
por: Wang, Luozhou, et al.
Publicado: (2023)
por: Wang, Luozhou, et al.
Publicado: (2023)
GrOCE:Graph-Guided Online Concept Erasure for Text-to-Image Diffusion Models
por: Han, Ning, et al.
Publicado: (2025)
por: Han, Ning, et al.
Publicado: (2025)
Bridging the Perception Gap in Image Super-Resolution Evaluation
por: Su, Shaolin, et al.
Publicado: (2025)
por: Su, Shaolin, et al.
Publicado: (2025)
A Dense Reward View on Aligning Text-to-Image Diffusion with Preference
por: Yang, Shentao, et al.
Publicado: (2024)
por: Yang, Shentao, et al.
Publicado: (2024)
CoMat: Aligning Text-to-Image Diffusion Model with Image-to-Text Concept Matching
por: Jiang, Dongzhi, et al.
Publicado: (2024)
por: Jiang, Dongzhi, et al.
Publicado: (2024)
Bridging Annotation Gaps: Transferring Labels to Align Object Detection Datasets
por: Kennerley, Mikhail, et al.
Publicado: (2025)
por: Kennerley, Mikhail, et al.
Publicado: (2025)
FreeInit: Bridging Initialization Gap in Video Diffusion Models
por: Wu, Tianxing, et al.
Publicado: (2023)
por: Wu, Tianxing, et al.
Publicado: (2023)
Bridging the RGB-IR Gap: Consensus and Discrepancy Modeling for Text-Guided Multispectral Detection
por: Wu, Jiaqi, et al.
Publicado: (2026)
por: Wu, Jiaqi, et al.
Publicado: (2026)
Safeguard Text-to-Image Diffusion Models with Human Feedback Inversion
por: Kim, Sanghyun, et al.
Publicado: (2024)
por: Kim, Sanghyun, et al.
Publicado: (2024)
Residual Diffusion Bridge Model for Image Restoration
por: Wang, Hebaixu, et al.
Publicado: (2025)
por: Wang, Hebaixu, et al.
Publicado: (2025)
DSG-World: Learning a 3D Gaussian World Model from Dual State Videos
por: Hu, Wenhao, et al.
Publicado: (2025)
por: Hu, Wenhao, et al.
Publicado: (2025)
PC-Diffusion: Aligning Diffusion Models with Human Preferences via Preference Classifier
por: Wang, Shaomeng, et al.
Publicado: (2025)
por: Wang, Shaomeng, et al.
Publicado: (2025)
Mind the Gap: Aligning Vision Foundation Models to Image Feature Matching
por: Liu, Yuhan, et al.
Publicado: (2025)
por: Liu, Yuhan, et al.
Publicado: (2025)
LADB: Latent Aligned Diffusion Bridges for Semi-Supervised Domain Translation
por: Wang, Xuqin, et al.
Publicado: (2025)
por: Wang, Xuqin, et al.
Publicado: (2025)
PrefPaint: Aligning Image Inpainting Diffusion Model with Human Preference
por: Liu, Kendong, et al.
Publicado: (2024)
por: Liu, Kendong, et al.
Publicado: (2024)
Text-Printed Image: Bridging the Image-Text Modality Gap for Text-centric Training of Large Vision-Language Models
por: Yamabe, Shojiro, et al.
Publicado: (2025)
por: Yamabe, Shojiro, et al.
Publicado: (2025)
ControlNet-XS: Rethinking the Control of Text-to-Image Diffusion Models as Feedback-Control Systems
por: Zavadski, Denis, et al.
Publicado: (2023)
por: Zavadski, Denis, et al.
Publicado: (2023)
Noise Projection: Closing the Prompt-Agnostic Gap Behind Text-to-Image Misalignment in Diffusion Models
por: Tong, Yunze, et al.
Publicado: (2025)
por: Tong, Yunze, et al.
Publicado: (2025)
Disciplined Diffusion: Text-to-Image Diffusion Model against NSFW Generation
por: Zhang, Chi, et al.
Publicado: (2026)
por: Zhang, Chi, et al.
Publicado: (2026)
Palette Aligned Image Diffusion
por: Aharoni, Elad, et al.
Publicado: (2025)
por: Aharoni, Elad, et al.
Publicado: (2025)
Auditing Data Provenance in Real-world Text-to-Image Diffusion Models for Privacy and Copyright Protection
por: Zhu, Jie, et al.
Publicado: (2025)
por: Zhu, Jie, et al.
Publicado: (2025)
Filter & Align: Leveraging Human Knowledge to Curate Image-Text Data
por: Zhang, Lei, et al.
Publicado: (2023)
por: Zhang, Lei, et al.
Publicado: (2023)
Scaling Down Text Encoders of Text-to-Image Diffusion Models
por: Wang, Lifu, et al.
Publicado: (2025)
por: Wang, Lifu, et al.
Publicado: (2025)
Security Tensors as a Cross-Modal Bridge: Extending Text-Aligned Safety to Vision in LVLM
por: Li, Shen, et al.
Publicado: (2025)
por: Li, Shen, et al.
Publicado: (2025)
AlignIT: Enhancing Prompt Alignment in Customization of Text-to-Image Models
por: Agarwal, Aishwarya, et al.
Publicado: (2024)
por: Agarwal, Aishwarya, et al.
Publicado: (2024)
Bridging the Skill Gap in Clinical CBCT Interpretation with CBCTRepD
por: Wu, Qinxin, et al.
Publicado: (2026)
por: Wu, Qinxin, et al.
Publicado: (2026)
Bridging Visual Affective Gap: Borrowing Textual Knowledge by Learning from Noisy Image-Text Pairs
por: Wu, Daiqing, et al.
Publicado: (2025)
por: Wu, Daiqing, et al.
Publicado: (2025)
Self-Cross Diffusion Guidance for Text-to-Image Synthesis of Similar Subjects
por: Qiu, Weimin, et al.
Publicado: (2024)
por: Qiu, Weimin, et al.
Publicado: (2024)
Text Image Inpainting via Global Structure-Guided Diffusion Models
por: Zhu, Shipeng, et al.
Publicado: (2024)
por: Zhu, Shipeng, et al.
Publicado: (2024)
Learning from Mistakes: Iterative Prompt Relabeling for Text-to-Image Diffusion Model Training
por: Chen, Xinyan, et al.
Publicado: (2023)
por: Chen, Xinyan, et al.
Publicado: (2023)
Versatile Diffusion: Text, Images and Variations All in One Diffusion Model
por: Xu, Xingqian, et al.
Publicado: (2022)
por: Xu, Xingqian, et al.
Publicado: (2022)
Post-training Quantization for Text-to-Image Diffusion Models with Progressive Calibration and Activation Relaxing
por: Tang, Siao, et al.
Publicado: (2023)
por: Tang, Siao, et al.
Publicado: (2023)
Ejemplares similares
-
Bridging the Intention-Expression Gap: Aligning Multi-Dimensional Preferences via Hierarchical Relevance Feedback in Text-to-Image Diffusion
por: Wang, Wenxi, et al.
Publicado: (2026) -
Category-level Text-to-Image Retrieval Improved: Bridging the Domain Gap with Diffusion Models and Vision Encoders
por: Khan, Faizan Farooq, et al.
Publicado: (2025) -
Asynchronous Denoising Diffusion Models for Aligning Text-to-Image Generation
por: Hu, Zijing, et al.
Publicado: (2025) -
Can Diffusion Models Bridge the Domain Gap in Cardiac MR Imaging?
por: Wong, Xin Ci, et al.
Publicado: (2025) -
TextRegion: Text-Aligned Region Tokens from Frozen Image-Text Models
por: Xiao, Yao, et al.
Publicado: (2025)