OMR-Diffusion:Optimizing Multi-Round Enhanced Training in Diffusion Models for Improved Intent Understanding
Fuente:
arXiv
Saved in:
| Main Authors: | Li, Kun, Wang, Jianhui, Zhang, Miao, Wang, Xueqian |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Optimizing Multi-Round Enhanced Training in Diffusion Models for Improved Preference Understanding
by: Li, Kun, et al.
Published: (2025)
by: Li, Kun, et al.
Published: (2025)
TDRI: Two-Phase Dialogue Refinement and Co-Adaptation for Interactive Image Generation
by: Feng, Yuheng, et al.
Published: (2025)
by: Feng, Yuheng, et al.
Published: (2025)
Enhancing Intent Understanding for Ambiguous prompt: A Human-Machine Co-Adaption Strategy
by: He, Yangfan, et al.
Published: (2025)
by: He, Yangfan, et al.
Published: (2025)
MARS: Memory-Enhanced Agents with Reflective Self-improvement
by: Liang, Xuechen, et al.
Published: (2025)
by: Liang, Xuechen, et al.
Published: (2025)
Understanding and Improving Training-free Loss-based Diffusion Guidance
by: Shen, Yifei, et al.
Published: (2024)
by: Shen, Yifei, et al.
Published: (2024)
Generative Image Coding with Diffusion Prior
by: Chang, Jianhui
Published: (2025)
by: Chang, Jianhui
Published: (2025)
An Efficient Framework for Enhancing Discriminative Models via Diffusion Techniques
by: Li, Chunxiao, et al.
Published: (2024)
by: Li, Chunxiao, et al.
Published: (2024)
Toward a More Complete OMR Solution
by: Yang, Guang, et al.
Published: (2024)
by: Yang, Guang, et al.
Published: (2024)
TINA: Text-Free Inversion Attack for Unlearned Text-to-Image Diffusion Models
by: Xiang, Qianlong, et al.
Published: (2026)
by: Xiang, Qianlong, et al.
Published: (2026)
Enhancing Low-Cost Video Editing with Lightweight Adaptors and Temporal-Aware Inversion
by: He, Yangfan, et al.
Published: (2025)
by: He, Yangfan, et al.
Published: (2025)
SpinMeRound: Consistent Multi-View Identity Generation Using Diffusion Models
by: Galanakis, Stathis, et al.
Published: (2025)
by: Galanakis, Stathis, et al.
Published: (2025)
MIND: Multi-Scale Intent Diffusion for Text-Driven Physics-Based Humanoid Control
by: Li, Bin, et al.
Published: (2026)
by: Li, Bin, et al.
Published: (2026)
GaussianDiffusion: 3D Gaussian Splatting for Denoising Diffusion Probabilistic Models with Structured Noise
by: Li, Xinhai, et al.
Published: (2023)
by: Li, Xinhai, et al.
Published: (2023)
Calibrated Multi-Preference Optimization for Aligning Diffusion Models
by: Lee, Kyungmin, et al.
Published: (2025)
by: Lee, Kyungmin, et al.
Published: (2025)
LVAgent: Long Video Understanding by Multi-Round Dynamical Collaboration of MLLM Agents
by: Chen, Boyu, et al.
Published: (2025)
by: Chen, Boyu, et al.
Published: (2025)
Noise Diffusion for Enhancing Semantic Faithfulness in Text-to-Image Synthesis
by: Miao, Boming, et al.
Published: (2024)
by: Miao, Boming, et al.
Published: (2024)
Dense Cross-Connected Ensemble Convolutional Neural Networks for Enhanced Model Robustness
by: Wang, Longwei, et al.
Published: (2024)
by: Wang, Longwei, et al.
Published: (2024)
OMR: Occlusion-Aware Memory-Based Refinement for Video Lane Detection
by: Jin, Dongkwon, et al.
Published: (2024)
by: Jin, Dongkwon, et al.
Published: (2024)
Improved Immiscible Diffusion: Accelerate Diffusion Training by Reducing Its Miscibility
by: Li, Yiheng, et al.
Published: (2025)
by: Li, Yiheng, et al.
Published: (2025)
LLM-grounded Diffusion: Enhancing Prompt Understanding of Text-to-Image Diffusion Models with Large Language Models
by: Lian, Long, et al.
Published: (2023)
by: Lian, Long, et al.
Published: (2023)
Tuning Timestep-Distilled Diffusion Model Using Pairwise Sample Optimization
by: Miao, Zichen, et al.
Published: (2024)
by: Miao, Zichen, et al.
Published: (2024)
ReDiffuse: Rotation Equivariant Diffusion Model for Multi-focus Image Fusion
by: Li, Bo, et al.
Published: (2026)
by: Li, Bo, et al.
Published: (2026)
4Diffusion: Multi-view Video Diffusion Model for 4D Generation
by: Zhang, Haiyu, et al.
Published: (2024)
by: Zhang, Haiyu, et al.
Published: (2024)
Mimir: Improving Video Diffusion Models for Precise Text Understanding
by: Tan, Shuai, et al.
Published: (2024)
by: Tan, Shuai, et al.
Published: (2024)
Diffusion-SDPO: Safeguarded Direct Preference Optimization for Diffusion Models
by: Fu, Minghao, et al.
Published: (2025)
by: Fu, Minghao, et al.
Published: (2025)
Redistribute Ensemble Training for Mitigating Memorization in Diffusion Models
by: Guan, Xiaoliu, et al.
Published: (2025)
by: Guan, Xiaoliu, et al.
Published: (2025)
Model Will Tell: Training Membership Inference for Diffusion Models
by: Fu, Xiaomeng, et al.
Published: (2024)
by: Fu, Xiaomeng, et al.
Published: (2024)
Diffusion Model as a Noise-Aware Latent Reward Model for Step-Level Preference Optimization
by: Zhang, Tao, et al.
Published: (2025)
by: Zhang, Tao, et al.
Published: (2025)
D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples
by: Hu, Zijing, et al.
Published: (2025)
by: Hu, Zijing, et al.
Published: (2025)
FineDiffusion: Scaling up Diffusion Models for Fine-grained Image Generation with 10,000 Classes
by: Pan, Ziying, et al.
Published: (2024)
by: Pan, Ziying, et al.
Published: (2024)
Isolated Diffusion: Optimizing Multi-Concept Text-to-Image Generation Training-Freely with Isolated Diffusion Guidance
by: Zhu, Jingyuan, et al.
Published: (2024)
by: Zhu, Jingyuan, et al.
Published: (2024)
CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion
by: Li, Yanyu, et al.
Published: (2025)
by: Li, Yanyu, et al.
Published: (2025)
CoMPaSS: Enhancing Spatial Understanding in Text-to-Image Diffusion Models
by: Zhang, Gaoyang, et al.
Published: (2024)
by: Zhang, Gaoyang, et al.
Published: (2024)
Distill, Diffuse, and Semanticize (DDS): Annotation-Free 3D Scene Understanding Based on Multi-Granularity Distillation and Graph-Diffusion-Based Segmentation
by: Wang, Yijing, et al.
Published: (2026)
by: Wang, Yijing, et al.
Published: (2026)
Coding-Prior Guided Diffusion Network for Video Deblurring
by: Liu, Yike, et al.
Published: (2025)
by: Liu, Yike, et al.
Published: (2025)
EmoDiffusion: Enhancing Emotional 3D Facial Animation with Latent Diffusion Models
by: Zhang, Yixuan, et al.
Published: (2025)
by: Zhang, Yixuan, et al.
Published: (2025)
Consistent Diffusion: Denoising Diffusion Model with Data-Consistent Training for Image Restoration
by: Cheng, Xinlong, et al.
Published: (2024)
by: Cheng, Xinlong, et al.
Published: (2024)
FilmWeaver: Weaving Consistent Multi-Shot Videos with Cache-Guided Autoregressive Diffusion
by: Luo, Xiangyang, et al.
Published: (2025)
by: Luo, Xiangyang, et al.
Published: (2025)
DiMo: Discrete Diffusion Modeling for Motion Generation and Understanding
by: Zhang, Ning, et al.
Published: (2026)
by: Zhang, Ning, et al.
Published: (2026)
Optimizing for the Shortest Path in Denoising Diffusion Model
by: Chen, Ping, et al.
Published: (2025)
by: Chen, Ping, et al.
Published: (2025)
Similar Items
-
Optimizing Multi-Round Enhanced Training in Diffusion Models for Improved Preference Understanding
by: Li, Kun, et al.
Published: (2025) -
TDRI: Two-Phase Dialogue Refinement and Co-Adaptation for Interactive Image Generation
by: Feng, Yuheng, et al.
Published: (2025) -
Enhancing Intent Understanding for Ambiguous prompt: A Human-Machine Co-Adaption Strategy
by: He, Yangfan, et al.
Published: (2025) -
MARS: Memory-Enhanced Agents with Reflective Self-improvement
by: Liang, Xuechen, et al.
Published: (2025) -
Understanding and Improving Training-free Loss-based Diffusion Guidance
by: Shen, Yifei, et al.
Published: (2024)