Learning Multi-dimensional Human Preference for Text-to-Image Generation
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Zhang, Sixian, Wang, Bohan, Wu, Junqiang, Li, Yan, Gao, Tingting, Zhang, Di, Wang, Zhongyuan |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
MUSE: Multi-Subject Unified Synthesis via Explicit Layout Semantic Expansion
von: Peng, Fei, et al.
Veröffentlicht: (2025)
von: Peng, Fei, et al.
Veröffentlicht: (2025)
OneReward: Unified Mask-Guided Image Generation via Multi-Task Human Preference Learning
von: Gong, Yuan, et al.
Veröffentlicht: (2025)
von: Gong, Yuan, et al.
Veröffentlicht: (2025)
VisionReward: Fine-Grained Multi-Dimensional Human Preference Learning for Image and Video Generation
von: Xu, Jiazheng, et al.
Veröffentlicht: (2024)
von: Xu, Jiazheng, et al.
Veröffentlicht: (2024)
MotionRL: Align Text-to-Motion Generation to Human Preferences with Multi-Reward Reinforcement Learning
von: Liu, Xiaoyang, et al.
Veröffentlicht: (2024)
von: Liu, Xiaoyang, et al.
Veröffentlicht: (2024)
Premier: Personalized Preference Modulation with Learnable User Embedding in Text-to-Image Generation
von: Wang, Zihao, et al.
Veröffentlicht: (2026)
von: Wang, Zihao, et al.
Veröffentlicht: (2026)
Few-Step Distillation for Text-to-Image Generation: A Practical Guide
von: Pu, Yifan, et al.
Veröffentlicht: (2025)
von: Pu, Yifan, et al.
Veröffentlicht: (2025)
Universal Prompt Optimizer for Safe Text-to-Image Generation
von: Wu, Zongyu, et al.
Veröffentlicht: (2024)
von: Wu, Zongyu, et al.
Veröffentlicht: (2024)
SG-Adapter: Enhancing Text-to-Image Generation with Scene Graph Guidance
von: Shen, Guibao, et al.
Veröffentlicht: (2024)
von: Shen, Guibao, et al.
Veröffentlicht: (2024)
Paragraph-to-Image Generation with Information-Enriched Diffusion Model
von: Wu, Weijia, et al.
Veröffentlicht: (2023)
von: Wu, Weijia, et al.
Veröffentlicht: (2023)
Facial Expression Generation Aligned with Human Preference for Natural Dyadic Interaction
von: Chen, Xu, et al.
Veröffentlicht: (2026)
von: Chen, Xu, et al.
Veröffentlicht: (2026)
A User-Friendly Framework for Generating Model-Preferred Prompts in Text-to-Image Synthesis
von: Hei, Nailei, et al.
Veröffentlicht: (2024)
von: Hei, Nailei, et al.
Veröffentlicht: (2024)
Learning User Preferences for Image Generation Model
von: Mo, Wenyi, et al.
Veröffentlicht: (2025)
von: Mo, Wenyi, et al.
Veröffentlicht: (2025)
Bridging the Intention-Expression Gap: Aligning Multi-Dimensional Preferences via Hierarchical Relevance Feedback in Text-to-Image Diffusion
von: Wang, Wenxi, et al.
Veröffentlicht: (2026)
von: Wang, Wenxi, et al.
Veröffentlicht: (2026)
Detecting Human Artifacts from Text-to-Image Models
von: Wang, Kaihong, et al.
Veröffentlicht: (2024)
von: Wang, Kaihong, et al.
Veröffentlicht: (2024)
InstructEngine: Instruction-driven Text-to-Image Alignment
von: Lu, Xingyu, et al.
Veröffentlicht: (2025)
von: Lu, Xingyu, et al.
Veröffentlicht: (2025)
Anomaly-Preference Image Generation
von: Wang, Fuyun, et al.
Veröffentlicht: (2026)
von: Wang, Fuyun, et al.
Veröffentlicht: (2026)
DreamReward: Text-to-3D Generation with Human Preference
von: Ye, Junliang, et al.
Veröffentlicht: (2024)
von: Ye, Junliang, et al.
Veröffentlicht: (2024)
Generalizing Alignment Paradigm of Text-to-Image Generation with Preferences through $f$-divergence Minimization
von: Sun, Haoyuan, et al.
Veröffentlicht: (2024)
von: Sun, Haoyuan, et al.
Veröffentlicht: (2024)
HyperDet: Generalizable Detection of Synthesized Images by Generating and Merging A Mixture of Hyper LoRAs
von: Cao, Huangsen, et al.
Veröffentlicht: (2024)
von: Cao, Huangsen, et al.
Veröffentlicht: (2024)
Pref-GRPO: Pairwise Preference Reward-based GRPO for Stable Text-to-Image Reinforcement Learning
von: Wang, Yibin, et al.
Veröffentlicht: (2025)
von: Wang, Yibin, et al.
Veröffentlicht: (2025)
Double Helix Diffusion for Cross-Domain Anomaly Image Generation
von: Wu, Linchun, et al.
Veröffentlicht: (2025)
von: Wu, Linchun, et al.
Veröffentlicht: (2025)
Adaptively Clustering Neighbor Elements for Image-Text Generation
von: Wang, Zihua, et al.
Veröffentlicht: (2023)
von: Wang, Zihua, et al.
Veröffentlicht: (2023)
Aligning Multimodal LLM with Human Preference: A Survey
von: Yu, Tao, et al.
Veröffentlicht: (2025)
von: Yu, Tao, et al.
Veröffentlicht: (2025)
CoMM: A Coherent Interleaved Image-Text Dataset for Multimodal Understanding and Generation
von: Chen, Wei, et al.
Veröffentlicht: (2024)
von: Chen, Wei, et al.
Veröffentlicht: (2024)
SIT-FER: Integration of Semantic-, Instance-, Text-level Information for Semi-supervised Facial Expression Recognition
von: Ding, Sixian, et al.
Veröffentlicht: (2025)
von: Ding, Sixian, et al.
Veröffentlicht: (2025)
Multi-Scale Gaussian-Language Map for Zero-shot Embodied Navigation and Reasoning
von: Zhang, Sixian, et al.
Veröffentlicht: (2026)
von: Zhang, Sixian, et al.
Veröffentlicht: (2026)
Diffusion Model as a Noise-Aware Latent Reward Model for Step-Level Preference Optimization
von: Zhang, Tao, et al.
Veröffentlicht: (2025)
von: Zhang, Tao, et al.
Veröffentlicht: (2025)
Preference Score Distillation: Leveraging 2D Rewards to Align Text-to-3D Generation with Human Preference
von: Leng, Jiaqi, et al.
Veröffentlicht: (2026)
von: Leng, Jiaqi, et al.
Veröffentlicht: (2026)
Scalable Ranked Preference Optimization for Text-to-Image Generation
von: Karthik, Shyamgopal, et al.
Veröffentlicht: (2024)
von: Karthik, Shyamgopal, et al.
Veröffentlicht: (2024)
Parrot: Pareto-optimal Multi-Reward Reinforcement Learning Framework for Text-to-Image Generation
von: Lee, Seung Hyun, et al.
Veröffentlicht: (2024)
von: Lee, Seung Hyun, et al.
Veröffentlicht: (2024)
Qwen-Image-Bench: From Generation to Creation in Text-to-Image Evaluation
von: Li, Niantong, et al.
Veröffentlicht: (2026)
von: Li, Niantong, et al.
Veröffentlicht: (2026)
Exploring Text-to-Motion Generation with Human Preference
von: Sheng, Jenny, et al.
Veröffentlicht: (2024)
von: Sheng, Jenny, et al.
Veröffentlicht: (2024)
AGFSync: Leveraging AI-Generated Feedback for Preference Optimization in Text-to-Image Generation
von: An, Jingkun, et al.
Veröffentlicht: (2024)
von: An, Jingkun, et al.
Veröffentlicht: (2024)
MIGC: Multi-Instance Generation Controller for Text-to-Image Synthesis
von: Zhou, Dewei, et al.
Veröffentlicht: (2024)
von: Zhou, Dewei, et al.
Veröffentlicht: (2024)
Forge-and-Quench: Enhancing Image Generation for Higher Fidelity in Unified Multimodal Models
von: Zeng, Yanbing, et al.
Veröffentlicht: (2026)
von: Zeng, Yanbing, et al.
Veröffentlicht: (2026)
Scale Contrastive Learning with Selective Attentions for Blind Image Quality Assessment
von: Hu, Runze, et al.
Veröffentlicht: (2024)
von: Hu, Runze, et al.
Veröffentlicht: (2024)
Compositional Text-to-Image Generation Via Region-aware Bimodal Direct Preference Optimization
von: Liu, Zhuohan, et al.
Veröffentlicht: (2026)
von: Liu, Zhuohan, et al.
Veröffentlicht: (2026)
Multi-Sequence Parotid Gland Lesion Segmentation via Expert Text-Guided Segment Anything Model
von: Wu, Zhongyuan, et al.
Veröffentlicht: (2025)
von: Wu, Zhongyuan, et al.
Veröffentlicht: (2025)
Human Image Generation: A Comprehensive Survey
von: Jia, Zhen, et al.
Veröffentlicht: (2022)
von: Jia, Zhen, et al.
Veröffentlicht: (2022)
Rich Human Feedback for Text-to-Image Generation
von: Liang, Youwei, et al.
Veröffentlicht: (2023)
von: Liang, Youwei, et al.
Veröffentlicht: (2023)
Ähnliche Einträge
-
MUSE: Multi-Subject Unified Synthesis via Explicit Layout Semantic Expansion
von: Peng, Fei, et al.
Veröffentlicht: (2025) -
OneReward: Unified Mask-Guided Image Generation via Multi-Task Human Preference Learning
von: Gong, Yuan, et al.
Veröffentlicht: (2025) -
VisionReward: Fine-Grained Multi-Dimensional Human Preference Learning for Image and Video Generation
von: Xu, Jiazheng, et al.
Veröffentlicht: (2024) -
MotionRL: Align Text-to-Motion Generation to Human Preferences with Multi-Reward Reinforcement Learning
von: Liu, Xiaoyang, et al.
Veröffentlicht: (2024) -
Premier: Personalized Preference Modulation with Learnable User Embedding in Text-to-Image Generation
von: Wang, Zihao, et al.
Veröffentlicht: (2026)