Aligning Diffusion Models by Optimizing Human Utility
Fuente:
arXiv
Salvato in:
| Autori principali: | Li, Shufan, Kallidromitis, Konstantinos, Gokul, Akash, Kato, Yusuke, Kozuka, Kazuki |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Reflect-DiT: Inference-Time Scaling for Text-to-Image Diffusion Transformers via In-Context Reflection
di: Li, Shufan, et al.
Pubblicazione: (2025)
di: Li, Shufan, et al.
Pubblicazione: (2025)
OmniFlow: Any-to-Any Generation with Multi-Modal Rectified Flows
di: Li, Shufan, et al.
Pubblicazione: (2024)
di: Li, Shufan, et al.
Pubblicazione: (2024)
LaViDa: A Large Diffusion Language Model for Multimodal Understanding
di: Li, Shufan, et al.
Pubblicazione: (2025)
di: Li, Shufan, et al.
Pubblicazione: (2025)
Guidance Contrastive Token Credit Assignment for Discrete Policy Optimization
di: Li, Shufan, et al.
Pubblicazione: (2026)
di: Li, Shufan, et al.
Pubblicazione: (2026)
SegLLM: Multi-round Reasoning Segmentation
di: Wang, XuDong, et al.
Pubblicazione: (2024)
di: Wang, XuDong, et al.
Pubblicazione: (2024)
MobileWorldBench: Towards Semantic World Modeling For Mobile Agents
di: Li, Shufan, et al.
Pubblicazione: (2025)
di: Li, Shufan, et al.
Pubblicazione: (2025)
Wild2Avatar: Rendering Humans Behind Occlusions
di: Xiang, Tiange, et al.
Pubblicazione: (2023)
di: Xiang, Tiange, et al.
Pubblicazione: (2023)
PopAlign: Population-Level Alignment for Fair Text-to-Image Generation
di: Li, Shufan, et al.
Pubblicazione: (2024)
di: Li, Shufan, et al.
Pubblicazione: (2024)
BootPIG: Bootstrapping Zero-shot Personalized Image Generation Capabilities in Pretrained Diffusion Models
di: Purushwalkam, Senthil, et al.
Pubblicazione: (2024)
di: Purushwalkam, Senthil, et al.
Pubblicazione: (2024)
Calibrated Multi-Preference Optimization for Aligning Diffusion Models
di: Lee, Kyungmin, et al.
Pubblicazione: (2025)
di: Lee, Kyungmin, et al.
Pubblicazione: (2025)
UniEgoMotion: A Unified Model for Egocentric Motion Reconstruction, Forecasting, and Generation
di: Patel, Chaitanya, et al.
Pubblicazione: (2025)
di: Patel, Chaitanya, et al.
Pubblicazione: (2025)
PrefPaint: Aligning Image Inpainting Diffusion Model with Human Preference
di: Liu, Kendong, et al.
Pubblicazione: (2024)
di: Liu, Kendong, et al.
Pubblicazione: (2024)
Diffusion-NPO: Negative Preference Optimization for Better Preference Aligned Generation of Diffusion Models
di: Wang, Fu-Yun, et al.
Pubblicazione: (2025)
di: Wang, Fu-Yun, et al.
Pubblicazione: (2025)
PC-Diffusion: Aligning Diffusion Models with Human Preferences via Preference Classifier
di: Wang, Shaomeng, et al.
Pubblicazione: (2025)
di: Wang, Shaomeng, et al.
Pubblicazione: (2025)
Smoothed Preference Optimization via ReNoise Inversion for Aligning Diffusion Models with Varied Human Preferences
di: Lu, Yunhong, et al.
Pubblicazione: (2025)
di: Lu, Yunhong, et al.
Pubblicazione: (2025)
ADHMR: Aligning Diffusion-based Human Mesh Recovery via Direct Preference Optimization
di: Shen, Wenhao, et al.
Pubblicazione: (2025)
di: Shen, Wenhao, et al.
Pubblicazione: (2025)
Mamba-ND: Selective State Space Modeling for Multi-Dimensional Data
di: Li, Shufan, et al.
Pubblicazione: (2024)
di: Li, Shufan, et al.
Pubblicazione: (2024)
Margin-aware Preference Optimization for Aligning Diffusion Models without Reference
di: Hong, Jiwoo, et al.
Pubblicazione: (2024)
di: Hong, Jiwoo, et al.
Pubblicazione: (2024)
Diagnosing Vision Language Models' Perception by Leveraging Human Methods for Color Vision Deficiencies
di: Hayashi, Kazuki, et al.
Pubblicazione: (2025)
di: Hayashi, Kazuki, et al.
Pubblicazione: (2025)
MVReward: Better Aligning and Evaluating Multi-View Diffusion Models with Human Preferences
di: Wang, Weitao, et al.
Pubblicazione: (2024)
di: Wang, Weitao, et al.
Pubblicazione: (2024)
ImageReFL: Balancing Quality and Diversity in Human-Aligned Diffusion Models
di: Sorokin, Dmitrii, et al.
Pubblicazione: (2025)
di: Sorokin, Dmitrii, et al.
Pubblicazione: (2025)
AlignTok: Aligning Visual Foundation Encoders to Tokenizers for Diffusion Models
di: Chen, Bowei, et al.
Pubblicazione: (2025)
di: Chen, Bowei, et al.
Pubblicazione: (2025)
Sparse-LaViDa: Sparse Multimodal Discrete Diffusion Language Models
di: Li, Shufan, et al.
Pubblicazione: (2025)
di: Li, Shufan, et al.
Pubblicazione: (2025)
ColorizeDiffusion v2: Enhancing Reference-based Sketch Colorization Through Separating Utilities
di: Yan, Dingkun, et al.
Pubblicazione: (2025)
di: Yan, Dingkun, et al.
Pubblicazione: (2025)
Hyperbolic Active Learning for Semantic Segmentation under Domain Shift
di: Franco, Luca, et al.
Pubblicazione: (2023)
di: Franco, Luca, et al.
Pubblicazione: (2023)
Lavida-O: Elastic Large Masked Diffusion Models for Unified Multimodal Understanding and Generation
di: Li, Shufan, et al.
Pubblicazione: (2025)
di: Li, Shufan, et al.
Pubblicazione: (2025)
OnlineVPO: Align Video Diffusion Model with Online Video-Centric Preference Optimization
di: Zhang, Jiacheng, et al.
Pubblicazione: (2024)
di: Zhang, Jiacheng, et al.
Pubblicazione: (2024)
D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples
di: Hu, Zijing, et al.
Pubblicazione: (2025)
di: Hu, Zijing, et al.
Pubblicazione: (2025)
Align Your Steps: Optimizing Sampling Schedules in Diffusion Models
di: Sabour, Amirmojtaba, et al.
Pubblicazione: (2024)
di: Sabour, Amirmojtaba, et al.
Pubblicazione: (2024)
Diffusion-RPO: Aligning Diffusion Models through Relative Preference Optimization
di: Gu, Yi, et al.
Pubblicazione: (2024)
di: Gu, Yi, et al.
Pubblicazione: (2024)
InstructAny2Pix: Flexible Visual Editing via Multimodal Instruction Following
di: Li, Shufan, et al.
Pubblicazione: (2023)
di: Li, Shufan, et al.
Pubblicazione: (2023)
SHARE: Scene-Human Aligned Reconstruction
di: Li, Joshua, et al.
Pubblicazione: (2025)
di: Li, Joshua, et al.
Pubblicazione: (2025)
Enhancing Privacy-Utility Trade-offs to Mitigate Memorization in Diffusion Models
di: Chen, Chen, et al.
Pubblicazione: (2025)
di: Chen, Chen, et al.
Pubblicazione: (2025)
Towards Artwork Explanation in Large-scale Vision Language Models
di: Hayashi, Kazuki, et al.
Pubblicazione: (2024)
di: Hayashi, Kazuki, et al.
Pubblicazione: (2024)
LaViDa-R1: Advancing Reasoning for Unified Multimodal Diffusion Language Models
di: Li, Shufan, et al.
Pubblicazione: (2026)
di: Li, Shufan, et al.
Pubblicazione: (2026)
IDDM: Identity-Decoupled Personalized Diffusion Models with a Tunable Privacy-Utility Trade-off
di: Dai, Linyan, et al.
Pubblicazione: (2026)
di: Dai, Linyan, et al.
Pubblicazione: (2026)
Palette Aligned Image Diffusion
di: Aharoni, Elad, et al.
Pubblicazione: (2025)
di: Aharoni, Elad, et al.
Pubblicazione: (2025)
Align-cDAE: Alzheimer's Disease Progression Modeling with Attention-Aligned Conditional Diffusion Auto-Encoder
di: Das, Ayantika, et al.
Pubblicazione: (2026)
di: Das, Ayantika, et al.
Pubblicazione: (2026)
Beyond Binary Preference: Aligning Diffusion Models to Fine-grained Criteria by Decoupling Attributes
di: Meng, Chenye, et al.
Pubblicazione: (2026)
di: Meng, Chenye, et al.
Pubblicazione: (2026)
Beyond the Noise: Aligning Prompts with Latent Representations in Diffusion Models
di: Ramos, Vasco, et al.
Pubblicazione: (2025)
di: Ramos, Vasco, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Reflect-DiT: Inference-Time Scaling for Text-to-Image Diffusion Transformers via In-Context Reflection
di: Li, Shufan, et al.
Pubblicazione: (2025) -
OmniFlow: Any-to-Any Generation with Multi-Modal Rectified Flows
di: Li, Shufan, et al.
Pubblicazione: (2024) -
LaViDa: A Large Diffusion Language Model for Multimodal Understanding
di: Li, Shufan, et al.
Pubblicazione: (2025) -
Guidance Contrastive Token Credit Assignment for Discrete Policy Optimization
di: Li, Shufan, et al.
Pubblicazione: (2026) -
SegLLM: Multi-round Reasoning Segmentation
di: Wang, XuDong, et al.
Pubblicazione: (2024)