Learning User Preferences for Image Generation Model
Fuente:
arXiv
Saved in:
| Main Authors: | Mo, Wenyi, Ba, Ying, Zhang, Tianyu, Bai, Yalong, Li, Biye |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
PrefGen: Multimodal Preference Learning for Preference-Conditioned Image Generation
by: Mo, Wenyi, et al.
Published: (2025)
by: Mo, Wenyi, et al.
Published: (2025)
Enhancing Reward Models for High-quality Image Generation: Beyond Text-Image Alignment
by: Ba, Ying, et al.
Published: (2025)
by: Ba, Ying, et al.
Published: (2025)
V2Flow: Unifying Visual Tokenization and Large Language Model Vocabularies for Autoregressive Image Generation
by: Zhang, Guiwei, et al.
Published: (2025)
by: Zhang, Guiwei, et al.
Published: (2025)
Pareto-Guided Optimal Transport for Multi-Reward Alignment
by: Ba, Ying, et al.
Published: (2026)
by: Ba, Ying, et al.
Published: (2026)
Premier: Personalized Preference Modulation with Learnable User Embedding in Text-to-Image Generation
by: Wang, Zihao, et al.
Published: (2026)
by: Wang, Zihao, et al.
Published: (2026)
Dynamic Prompt Optimizing for Text-to-Image Generation
by: Mo, Wenyi, et al.
Published: (2024)
by: Mo, Wenyi, et al.
Published: (2024)
Uniform Attention Maps: Boosting Image Fidelity in Reconstruction and Editing
by: Mo, Wenyi, et al.
Published: (2024)
by: Mo, Wenyi, et al.
Published: (2024)
STAR: Scale-wise Text-conditioned AutoRegressive image generation
by: Ma, Xiaoxiao, et al.
Published: (2024)
by: Ma, Xiaoxiao, et al.
Published: (2024)
StyleInject: Parameter Efficient Tuning of Text-to-Image Diffusion Models
by: Zhou, Mohan, et al.
Published: (2024)
by: Zhou, Mohan, et al.
Published: (2024)
SyncDPO: Enhancing Temporal Synchronization in Video-Audio Joint Generation via Preference Learning
by: Cheng, Xin, et al.
Published: (2026)
by: Cheng, Xin, et al.
Published: (2026)
Learning Multi-dimensional Human Preference for Text-to-Image Generation
by: Zhang, Sixian, et al.
Published: (2024)
by: Zhang, Sixian, et al.
Published: (2024)
MRT: Masked Region Transformer for Layered Image Generation and Editing at Scale
by: Tang, Zhicong, et al.
Published: (2026)
by: Tang, Zhicong, et al.
Published: (2026)
Vision-Language Models Assisted Unsupervised Video Anomaly Detection
by: Jiang, Yalong, et al.
Published: (2024)
by: Jiang, Yalong, et al.
Published: (2024)
A User-Friendly Framework for Generating Model-Preferred Prompts in Text-to-Image Synthesis
by: Hei, Nailei, et al.
Published: (2024)
by: Hei, Nailei, et al.
Published: (2024)
Equipping Diffusion Models with Differentiable Spatial Entropy for Low-Light Image Enhancement
by: Lian, Wenyi, et al.
Published: (2024)
by: Lian, Wenyi, et al.
Published: (2024)
TexControl: Sketch-Based Two-Stage Fashion Image Generation Using Diffusion Model
by: Zhang, Yongming, et al.
Published: (2024)
by: Zhang, Yongming, et al.
Published: (2024)
Evaluating Image Caption via Cycle-consistent Text-to-Image Generation
by: Cui, Tianyu, et al.
Published: (2025)
by: Cui, Tianyu, et al.
Published: (2025)
VisionReward: Fine-Grained Multi-Dimensional Human Preference Learning for Image and Video Generation
by: Xu, Jiazheng, et al.
Published: (2024)
by: Xu, Jiazheng, et al.
Published: (2024)
Diverse Teaching and Label Propagation for Generic Semi-Supervised Medical Image Segmentation
by: Li, Wei, et al.
Published: (2025)
by: Li, Wei, et al.
Published: (2025)
Human-Guided Image Generation for Expanding Small-Scale Training Image Datasets
by: Chen, Changjian, et al.
Published: (2024)
by: Chen, Changjian, et al.
Published: (2024)
MagicWand: A Universal Agent for Generation and Evaluation Aligned with User Preference
by: Xu, Zitong, et al.
Published: (2025)
by: Xu, Zitong, et al.
Published: (2025)
Diffusion-SDPO: Safeguarded Direct Preference Optimization for Diffusion Models
by: Fu, Minghao, et al.
Published: (2025)
by: Fu, Minghao, et al.
Published: (2025)
DOEPatch: Dynamically Optimized Ensemble Model for Adversarial Patches Generation
by: Tan, Wenyi, et al.
Published: (2023)
by: Tan, Wenyi, et al.
Published: (2023)
GDPO-SR: Group Direct Preference Optimization for One-Step Generative Image Super-Resolution
by: Yi, Qiaosi, et al.
Published: (2026)
by: Yi, Qiaosi, et al.
Published: (2026)
Optimizing Multi-Round Enhanced Training in Diffusion Models for Improved Preference Understanding
by: Li, Kun, et al.
Published: (2025)
by: Li, Kun, et al.
Published: (2025)
Anomaly-Preference Image Generation
by: Wang, Fuyun, et al.
Published: (2026)
by: Wang, Fuyun, et al.
Published: (2026)
AGFSync: Leveraging AI-Generated Feedback for Preference Optimization in Text-to-Image Generation
by: An, Jingkun, et al.
Published: (2024)
by: An, Jingkun, et al.
Published: (2024)
LightGen: Efficient Image Generation through Knowledge Distillation and Direct Preference Optimization
by: Wu, Xianfeng, et al.
Published: (2025)
by: Wu, Xianfeng, et al.
Published: (2025)
Say Cheese! Detail-Preserving Portrait Collection Generation via Natural Language Edits
by: Sun, Zelong, et al.
Published: (2026)
by: Sun, Zelong, et al.
Published: (2026)
Diffusion-NPO: Negative Preference Optimization for Better Preference Aligned Generation of Diffusion Models
by: Wang, Fu-Yun, et al.
Published: (2025)
by: Wang, Fu-Yun, et al.
Published: (2025)
Supporting Vision-Language Model Inference with Confounder-pruning Knowledge Prompt
by: Li, Jiangmeng, et al.
Published: (2022)
by: Li, Jiangmeng, et al.
Published: (2022)
Towards Anatomically Plausible Human Image Generation via Synthetic Localized Preferences
by: Li, Bao, et al.
Published: (2026)
by: Li, Bao, et al.
Published: (2026)
Sketch-Guided Scene Image Generation
by: Zhang, Tianyu, et al.
Published: (2024)
by: Zhang, Tianyu, et al.
Published: (2024)
Scalable Ranked Preference Optimization for Text-to-Image Generation
by: Karthik, Shyamgopal, et al.
Published: (2024)
by: Karthik, Shyamgopal, et al.
Published: (2024)
Ranking-based Preference Optimization for Diffusion Models from Implicit User Feedback
by: Wu, Yi-Lun, et al.
Published: (2025)
by: Wu, Yi-Lun, et al.
Published: (2025)
CLIP-TNseg: A Multi-Modal Hybrid Framework for Thyroid Nodule Segmentation in Ultrasound Images
by: Sun, Xinjie, et al.
Published: (2024)
by: Sun, Xinjie, et al.
Published: (2024)
Physics-Informed Untrained Learning for RGB-Guided Superresolution Single-Pixel Hyperspectral Imaging
by: Zhang, Hao, et al.
Published: (2026)
by: Zhang, Hao, et al.
Published: (2026)
EmoAttack: Emotion-to-Image Diffusion Models for Emotional Backdoor Generation
by: Wei, Tianyu, et al.
Published: (2024)
by: Wei, Tianyu, et al.
Published: (2024)
Aesthetic Post-Training Diffusion Models from Generic Preferences with Step-by-step Preference Optimization
by: Liang, Zhanhao, et al.
Published: (2024)
by: Liang, Zhanhao, et al.
Published: (2024)
EditVerse: Unifying Image and Video Editing and Generation with In-Context Learning
by: Ju, Xuan, et al.
Published: (2025)
by: Ju, Xuan, et al.
Published: (2025)
Similar Items
-
PrefGen: Multimodal Preference Learning for Preference-Conditioned Image Generation
by: Mo, Wenyi, et al.
Published: (2025) -
Enhancing Reward Models for High-quality Image Generation: Beyond Text-Image Alignment
by: Ba, Ying, et al.
Published: (2025) -
V2Flow: Unifying Visual Tokenization and Large Language Model Vocabularies for Autoregressive Image Generation
by: Zhang, Guiwei, et al.
Published: (2025) -
Pareto-Guided Optimal Transport for Multi-Reward Alignment
by: Ba, Ying, et al.
Published: (2026) -
Premier: Personalized Preference Modulation with Learnable User Embedding in Text-to-Image Generation
by: Wang, Zihao, et al.
Published: (2026)