TDM-R1: Reinforcing Few-Step Diffusion Models with Non-Differentiable Reward
Fuente:
arXiv
Salvato in:
| Autori principali: | Luo, Yihong, Hu, Tianyang, Luo, Weijian, Tang, Jing |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Learning Few-Step Diffusion Models by Trajectory Distribution Matching
di: Luo, Yihong, et al.
Pubblicazione: (2025)
di: Luo, Yihong, et al.
Pubblicazione: (2025)
Reward-Instruct: A Reward-Centric Approach to Fast Photo-Realistic Image Generation
di: Luo, Yihong, et al.
Pubblicazione: (2025)
di: Luo, Yihong, et al.
Pubblicazione: (2025)
Reinforcing Diffusion Models by Direct Group Preference Optimization
di: Luo, Yihong, et al.
Pubblicazione: (2025)
di: Luo, Yihong, et al.
Pubblicazione: (2025)
Learning Discrete Autoregressive Priors with Wasserstein Gradient Flow
di: Zheng, Bowen, et al.
Pubblicazione: (2026)
di: Zheng, Bowen, et al.
Pubblicazione: (2026)
You Only Sample Once: Taming One-Step Text-to-Image Synthesis by Self-Cooperative Diffusion GANs
di: Luo, Yihong, et al.
Pubblicazione: (2024)
di: Luo, Yihong, et al.
Pubblicazione: (2024)
Adding Additional Control to One-Step Diffusion with Joint Distribution Matching
di: Luo, Yihong, et al.
Pubblicazione: (2025)
di: Luo, Yihong, et al.
Pubblicazione: (2025)
Noise Consistency Training: A Native Approach for One-Step Generator in Learning Additional Controls
di: Luo, Yihong, et al.
Pubblicazione: (2025)
di: Luo, Yihong, et al.
Pubblicazione: (2025)
Diff-Instruct++: Training One-step Text-to-image Generator Model to Align with Human Preferences
di: Luo, Weijian
Pubblicazione: (2024)
di: Luo, Weijian
Pubblicazione: (2024)
Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL
di: Wu, Junyi, et al.
Pubblicazione: (2026)
di: Wu, Junyi, et al.
Pubblicazione: (2026)
Taming the Entropy Cliff: Variable Codebook Size Quantization for Autoregressive Visual Generation
di: Zheng, Bowen, et al.
Pubblicazione: (2026)
di: Zheng, Bowen, et al.
Pubblicazione: (2026)
Optimizing Few-Step Sampler for Diffusion Probabilistic Model
di: Huang, Jen-Yuan
Pubblicazione: (2024)
di: Huang, Jen-Yuan
Pubblicazione: (2024)
One-Step Diffusion Distillation through Score Implicit Matching
di: Luo, Weijian, et al.
Pubblicazione: (2024)
di: Luo, Weijian, et al.
Pubblicazione: (2024)
FlowSteer: Guiding Few-Step Image Synthesis with Authentic Trajectories
di: Ke, Lei, et al.
Pubblicazione: (2025)
di: Ke, Lei, et al.
Pubblicazione: (2025)
Continuous-Time Distribution Matching for Few-Step Diffusion Distillation
di: Liu, Tao, et al.
Pubblicazione: (2026)
di: Liu, Tao, et al.
Pubblicazione: (2026)
InverFill: One-Step Inversion for Enhanced Few-Step Diffusion Inpainting
di: Vu, Duc, et al.
Pubblicazione: (2026)
di: Vu, Duc, et al.
Pubblicazione: (2026)
Beyond VLM-Based Rewards: Diffusion-Native Latent Reward Modeling
di: Liu, Gongye, et al.
Pubblicazione: (2026)
di: Liu, Gongye, et al.
Pubblicazione: (2026)
AdvDMD: Adversarial Reward Meets DMD For High-Quality Few-Step Generation
di: Wang, Xu, et al.
Pubblicazione: (2026)
di: Wang, Xu, et al.
Pubblicazione: (2026)
Q-Sched: Pushing the Boundaries of Few-Step Diffusion Models with Quantization-Aware Scheduling
di: Frumkin, Natalia, et al.
Pubblicazione: (2025)
di: Frumkin, Natalia, et al.
Pubblicazione: (2025)
Accelerating Diffusion Sampling with Optimized Time Steps
di: Xue, Shuchen, et al.
Pubblicazione: (2024)
di: Xue, Shuchen, et al.
Pubblicazione: (2024)
Statistical Management of the False Discovery Rate in Medical Instance Segmentation Based on Conformal Risk Control
di: Dai, Mengxia, et al.
Pubblicazione: (2025)
di: Dai, Mengxia, et al.
Pubblicazione: (2025)
Denoising Fisher Training For Neural Implicit Samplers
di: Luo, Weijian, et al.
Pubblicazione: (2024)
di: Luo, Weijian, et al.
Pubblicazione: (2024)
Schedule On the Fly: Diffusion Time Prediction for Faster and Better Image Generation
di: Ye, Zilyu, et al.
Pubblicazione: (2024)
di: Ye, Zilyu, et al.
Pubblicazione: (2024)
David and Goliath: Small One-step Model Beats Large Diffusion with Score Post-training
di: Luo, Weijian, et al.
Pubblicazione: (2024)
di: Luo, Weijian, et al.
Pubblicazione: (2024)
Flash Diffusion: Accelerating Any Conditional Diffusion Model for Few Steps Image Generation
di: Chadebec, Clément, et al.
Pubblicazione: (2024)
di: Chadebec, Clément, et al.
Pubblicazione: (2024)
Mitigating Coordinate Prediction Bias from Positional Encoding Failures
di: Tao, Xingjian, et al.
Pubblicazione: (2025)
di: Tao, Xingjian, et al.
Pubblicazione: (2025)
Reinforcement Learning with Robust Rubric Rewards
di: Yu, Ya-Qi, et al.
Pubblicazione: (2026)
di: Yu, Ya-Qi, et al.
Pubblicazione: (2026)
Collaborative Few-Step Distillation and Low-Bit Quantization for Wan2.2 Dual-Expert Video Diffusion Models
di: Du, Jinyang, et al.
Pubblicazione: (2026)
di: Du, Jinyang, et al.
Pubblicazione: (2026)
MixDQ: Memory-Efficient Few-Step Text-to-Image Diffusion Models with Metric-Decoupled Mixed Precision Quantization
di: Zhao, Tianchen, et al.
Pubblicazione: (2024)
di: Zhao, Tianchen, et al.
Pubblicazione: (2024)
Uncovering the Text Embedding in Text-to-Image Diffusion Models
di: Yu, Hu, et al.
Pubblicazione: (2024)
di: Yu, Hu, et al.
Pubblicazione: (2024)
VideoRewardBench: Comprehensive Evaluation of Multimodal Reward Models for Video Understanding
di: Zhang, Zhihong, et al.
Pubblicazione: (2025)
di: Zhang, Zhihong, et al.
Pubblicazione: (2025)
GARDO: Reinforcing Diffusion Models without Reward Hacking
di: He, Haoran, et al.
Pubblicazione: (2025)
di: He, Haoran, et al.
Pubblicazione: (2025)
Beyond Words and Pixels: A Benchmark for Implicit World Knowledge Reasoning in Generative Models
di: Han, Tianyang, et al.
Pubblicazione: (2025)
di: Han, Tianyang, et al.
Pubblicazione: (2025)
DualFast: Dual-Speedup Framework for Fast Sampling of Diffusion Models
di: Yu, Hu, et al.
Pubblicazione: (2025)
di: Yu, Hu, et al.
Pubblicazione: (2025)
Prompt-Agnostic Adversarial Perturbation for Customized Diffusion Models
di: Wan, Cong, et al.
Pubblicazione: (2024)
di: Wan, Cong, et al.
Pubblicazione: (2024)
Joint PET-MRI Reconstruction with Diffusion Stochastic Differential Model
di: Xie, Taofeng, et al.
Pubblicazione: (2024)
di: Xie, Taofeng, et al.
Pubblicazione: (2024)
Flash-DMD: Towards High-Fidelity Few-Step Image Generation with Efficient Distillation and Joint Reinforcement Learning
di: Chen, Guanjie, et al.
Pubblicazione: (2025)
di: Chen, Guanjie, et al.
Pubblicazione: (2025)
Geo-R1: Improving Few-Shot Geospatial Referring Expression Understanding with Reinforcement Fine-Tuning
di: Zhang, Zilun, et al.
Pubblicazione: (2025)
di: Zhang, Zilun, et al.
Pubblicazione: (2025)
EMO-R3: Reflective Reinforcement Learning for Emotional Reasoning in Multimodal Large Language Models
di: Fang, Yiyang, et al.
Pubblicazione: (2026)
di: Fang, Yiyang, et al.
Pubblicazione: (2026)
MVR: Multi-view Video Reward Shaping for Reinforcement Learning
di: Luo, Lirui, et al.
Pubblicazione: (2026)
di: Luo, Lirui, et al.
Pubblicazione: (2026)
CCCaption: Dual-Reward Reinforcement Learning for Complete and Correct Image Captioning
di: Tang, Zhijiang, et al.
Pubblicazione: (2026)
di: Tang, Zhijiang, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Learning Few-Step Diffusion Models by Trajectory Distribution Matching
di: Luo, Yihong, et al.
Pubblicazione: (2025) -
Reward-Instruct: A Reward-Centric Approach to Fast Photo-Realistic Image Generation
di: Luo, Yihong, et al.
Pubblicazione: (2025) -
Reinforcing Diffusion Models by Direct Group Preference Optimization
di: Luo, Yihong, et al.
Pubblicazione: (2025) -
Learning Discrete Autoregressive Priors with Wasserstein Gradient Flow
di: Zheng, Bowen, et al.
Pubblicazione: (2026) -
You Only Sample Once: Taming One-Step Text-to-Image Synthesis by Self-Cooperative Diffusion GANs
di: Luo, Yihong, et al.
Pubblicazione: (2024)