Di3PO - Diptych Diffusion DPO for Targeted Improvements in Image Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Reddy, Sanjana, Malhi, Ishaan, Ma, Sally, Dutta, Praneet |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Preserving Product Fidelity in Large Scale Image Recontextualization with Diffusion Models
par: Malhi, Ishaan, et autres
Publié: (2025)
par: Malhi, Ishaan, et autres
Publié: (2025)
EdgeDiT: Hardware-Aware Diffusion Transformers for Efficient On-Device Image Generation
par: Kodavanti, Sravanth, et autres
Publié: (2026)
par: Kodavanti, Sravanth, et autres
Publié: (2026)
Inversion-DPO: Precise and Efficient Post-Training for Diffusion Models
par: Li, Zejian, et autres
Publié: (2025)
par: Li, Zejian, et autres
Publié: (2025)
VideoDPO: Omni-Preference Alignment for Video Diffusion Generation
par: Liu, Runtao, et autres
Publié: (2024)
par: Liu, Runtao, et autres
Publié: (2024)
DiMSUM: Diffusion Mamba -- A Scalable and Unified Spatial-Frequency Method for Image Generation
par: Phung, Hao, et autres
Publié: (2024)
par: Phung, Hao, et autres
Publié: (2024)
Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising
par: Fang, Gongfan, et autres
Publié: (2024)
par: Fang, Gongfan, et autres
Publié: (2024)
Interactive Video Generation via Domain Adaptation
par: Rawal, Ishaan, et autres
Publié: (2025)
par: Rawal, Ishaan, et autres
Publié: (2025)
When Preferences Diverge: Aligning Diffusion Models with Minority-Aware Adaptive DPO
par: Zhang, Lingfan, et autres
Publié: (2025)
par: Zhang, Lingfan, et autres
Publié: (2025)
FocusDPO: Dynamic Preference Optimization for Multi-Subject Personalized Image Generation via Adaptive Focus
par: Jin, Qiaoqiao, et autres
Publié: (2025)
par: Jin, Qiaoqiao, et autres
Publié: (2025)
Q-DiT: Accurate Post-Training Quantization for Diffusion Transformers
par: Chen, Lei, et autres
Publié: (2024)
par: Chen, Lei, et autres
Publié: (2024)
DiVa-360: The Dynamic Visual Dataset for Immersive Neural Fields
par: Lu, Cheng-You, et autres
Publié: (2023)
par: Lu, Cheng-You, et autres
Publié: (2023)
LaDiC: Are Diffusion Models Really Inferior to Autoregressive Counterparts for Image-to-Text Generation?
par: Wang, Yuchi, et autres
Publié: (2024)
par: Wang, Yuchi, et autres
Publié: (2024)
RealDPO: Real or Not Real, that is the Preference
par: Cheng, Guo, et autres
Publié: (2025)
par: Cheng, Guo, et autres
Publié: (2025)
CoDi: Conditional Diffusion Distillation for Higher-Fidelity and Faster Image Generation
par: Mei, Kangfu, et autres
Publié: (2023)
par: Mei, Kangfu, et autres
Publié: (2023)
MIA-DPO: Multi-Image Augmented Direct Preference Optimization For Large Vision-Language Models
par: Liu, Ziyu, et autres
Publié: (2024)
par: Liu, Ziyu, et autres
Publié: (2024)
BalancedDPO: Adaptive Multi-Metric Alignment
par: Tamboli, Dipesh, et autres
Publié: (2025)
par: Tamboli, Dipesh, et autres
Publié: (2025)
Longitudinal Boundary Sharpness Coefficient Slopes Predict Time to Alzheimer's Disease Conversion in Mild Cognitive Impairment: A Survival Analysis Using the ADNI Cohort
par: Cherukuri, Ishaan
Publié: (2026)
par: Cherukuri, Ishaan
Publié: (2026)
MMFace-DiT: A Dual-Stream Diffusion Transformer for High-Fidelity Multimodal Face Generation
par: Krishnamurthy, Bharath, et autres
Publié: (2026)
par: Krishnamurthy, Bharath, et autres
Publié: (2026)
Generation of Heterogeneous PET Images from Uniform Organ Activity Maps Using a Pretrained Domain-Adapted Diffusion Model
par: Li, Suya, et autres
Publié: (2026)
par: Li, Suya, et autres
Publié: (2026)
AlignDiT: Multimodal Aligned Diffusion Transformer for Synchronized Speech Generation
par: Choi, Jeongsoo, et autres
Publié: (2025)
par: Choi, Jeongsoo, et autres
Publié: (2025)
Reg-DPO: SFT-Regularized Direct Preference Optimization with GT-Pair for Improving Video Generation
par: Du, Jie, et autres
Publié: (2025)
par: Du, Jie, et autres
Publié: (2025)
DPO: Dual-Perturbation Optimization for Test-time Adaptation in 3D Object Detection
par: Chen, Zhuoxiao, et autres
Publié: (2024)
par: Chen, Zhuoxiao, et autres
Publié: (2024)
Curriculum-DPO++: Direct Preference Optimization via Data and Model Curricula for Text-to-Image Generation
par: Croitoru, Florinel-Alin, et autres
Publié: (2026)
par: Croitoru, Florinel-Alin, et autres
Publié: (2026)
OmniDiT: Extending Diffusion Transformer to Omni-VTON Framework
par: Zeng, Weixuan, et autres
Publié: (2026)
par: Zeng, Weixuan, et autres
Publié: (2026)
Delving into RL for Image Generation with CoT: A Study on DPO vs. GRPO
par: Tong, Chengzhuo, et autres
Publié: (2025)
par: Tong, Chengzhuo, et autres
Publié: (2025)
DPO Learning with LLMs-Judge Signal for Computer Use Agents
par: Luo, Man, et autres
Publié: (2025)
par: Luo, Man, et autres
Publié: (2025)
HQ-DiT: Efficient Diffusion Transformer with FP4 Hybrid Quantization
par: Liu, Wenxuan, et autres
Publié: (2024)
par: Liu, Wenxuan, et autres
Publié: (2024)
DiG: Scalable and Efficient Diffusion Models with Gated Linear Attention
par: Zhu, Lianghui, et autres
Publié: (2024)
par: Zhu, Lianghui, et autres
Publié: (2024)
JointDiT: Enhancing RGB-Depth Joint Modeling with Diffusion Transformers
par: Byung-Ki, Kwon, et autres
Publié: (2025)
par: Byung-Ki, Kwon, et autres
Publié: (2025)
Unveiling Redundancy in Diffusion Transformers (DiTs): A Systematic Study
par: Sun, Xibo, et autres
Publié: (2024)
par: Sun, Xibo, et autres
Publié: (2024)
DiT-VTON: Diffusion Transformer Framework for Unified Multi-Category Virtual Try-On and Virtual Try-All with Integrated Image Editing
par: Li, Qi, et autres
Publié: (2025)
par: Li, Qi, et autres
Publié: (2025)
Paired Image Generation with Diffusion-Guided Diffusion Models
par: Zhang, Haoxuan, et autres
Publié: (2025)
par: Zhang, Haoxuan, et autres
Publié: (2025)
DeCo: Frequency-Decoupled Pixel Diffusion for End-to-End Image Generation
par: Ma, Zehong, et autres
Publié: (2025)
par: Ma, Zehong, et autres
Publié: (2025)
Wonder3D++: Cross-domain Diffusion for High-fidelity 3D Generation from a Single Image
par: Yang, Yuxiao, et autres
Publié: (2025)
par: Yang, Yuxiao, et autres
Publié: (2025)
City-Mesh3R: Simulation-Ready City-Scale 3D Mesh Reconstruction from Multi-View Images
par: Paul, Sayan, et autres
Publié: (2026)
par: Paul, Sayan, et autres
Publié: (2026)
LuxDiT: Lighting Estimation with Video Diffusion Transformer
par: Liang, Ruofan, et autres
Publié: (2025)
par: Liang, Ruofan, et autres
Publié: (2025)
VL-DPO: Vision-Language-Guided Finetuning for Preference-Aligned Autonomous Driving
par: Xu, Zhefan, et autres
Publié: (2026)
par: Xu, Zhefan, et autres
Publié: (2026)
Advanced Underwater Image Quality Enhancement via Hybrid Super-Resolution Convolutional Neural Networks and Multi-Scale Retinex-Based Defogging Techniques
par: Gogireddy, Yugandhar Reddy, et autres
Publié: (2024)
par: Gogireddy, Yugandhar Reddy, et autres
Publié: (2024)
Unified Text-Image Generation with Weakness-Targeted Post-Training
par: Chen, Jiahui, et autres
Publié: (2026)
par: Chen, Jiahui, et autres
Publié: (2026)
CCIS-Diff: A Generative Model with Stable Diffusion Prior for Controlled Colonoscopy Image Synthesis
par: Xie, Yifan, et autres
Publié: (2024)
par: Xie, Yifan, et autres
Publié: (2024)
Documents similaires
-
Preserving Product Fidelity in Large Scale Image Recontextualization with Diffusion Models
par: Malhi, Ishaan, et autres
Publié: (2025) -
EdgeDiT: Hardware-Aware Diffusion Transformers for Efficient On-Device Image Generation
par: Kodavanti, Sravanth, et autres
Publié: (2026) -
Inversion-DPO: Precise and Efficient Post-Training for Diffusion Models
par: Li, Zejian, et autres
Publié: (2025) -
VideoDPO: Omni-Preference Alignment for Video Diffusion Generation
par: Liu, Runtao, et autres
Publié: (2024) -
DiMSUM: Diffusion Mamba -- A Scalable and Unified Spatial-Frequency Method for Image Generation
par: Phung, Hao, et autres
Publié: (2024)