RL for Consistency Models: Faster Reward Guided Text-to-Image Generation
Fuente:
arXiv
Salvato in:
| Autori principali: | Oertell, Owen, Chang, Jonathan D., Zhang, Yiyi, Brantley, Kianté, Sun, Wen |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Scaling Offline RL via Efficient and Expressive Shortcut Models
di: Espinosa-Dice, Nicolas, et al.
Pubblicazione: (2025)
di: Espinosa-Dice, Nicolas, et al.
Pubblicazione: (2025)
REBEL: Reinforcement Learning via Regressing Relative Rewards
di: Gao, Zhaolin, et al.
Pubblicazione: (2024)
di: Gao, Zhaolin, et al.
Pubblicazione: (2024)
Dataset Reset Policy Optimization for RLHF
di: Chang, Jonathan D., et al.
Pubblicazione: (2024)
di: Chang, Jonathan D., et al.
Pubblicazione: (2024)
LLMs Can Learn to Reason Via Off-Policy RL
di: Ritter, Daniel, et al.
Pubblicazione: (2026)
di: Ritter, Daniel, et al.
Pubblicazione: (2026)
SpatialReward: Verifiable Spatial Reward Modeling for Fine-Grained Spatial Consistency in Text-to-Image Generation
di: Zhou, Sashuai, et al.
Pubblicazione: (2026)
di: Zhou, Sashuai, et al.
Pubblicazione: (2026)
ProxT2I: Efficient Reward-Guided Text-to-Image Generation via Proximal Diffusion
di: Fang, Zhenghan, et al.
Pubblicazione: (2025)
di: Fang, Zhenghan, et al.
Pubblicazione: (2025)
CycleNet: Rethinking Cycle Consistency in Text-Guided Diffusion for Image Manipulation
di: Xu, Sihan, et al.
Pubblicazione: (2023)
di: Xu, Sihan, et al.
Pubblicazione: (2023)
Contextualized Diffusion Models for Text-Guided Image and Video Generation
di: Yang, Ling, et al.
Pubblicazione: (2024)
di: Yang, Ling, et al.
Pubblicazione: (2024)
Training-Free Consistent Text-to-Image Generation
di: Tewel, Yoad, et al.
Pubblicazione: (2024)
di: Tewel, Yoad, et al.
Pubblicazione: (2024)
Personalized Reward Modeling for Text-to-Image Generation
di: Lee, Jeongeun, et al.
Pubblicazione: (2025)
di: Lee, Jeongeun, et al.
Pubblicazione: (2025)
Aligning Text-to-Image Diffusion Models with Reward Backpropagation
di: Prabhudesai, Mihir, et al.
Pubblicazione: (2023)
di: Prabhudesai, Mihir, et al.
Pubblicazione: (2023)
RealGen: Photorealistic Text-to-Image Generation via Detector-Guided Rewards
di: Ye, Junyan, et al.
Pubblicazione: (2025)
di: Ye, Junyan, et al.
Pubblicazione: (2025)
Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL
di: Wu, Junyi, et al.
Pubblicazione: (2026)
di: Wu, Junyi, et al.
Pubblicazione: (2026)
Generalizing Consistency Policy to Visual RL with Prioritized Proximal Experience Regularization
di: Li, Haoran, et al.
Pubblicazione: (2024)
di: Li, Haoran, et al.
Pubblicazione: (2024)
FuRL: Visual-Language Models as Fuzzy Rewards for Reinforcement Learning
di: Fu, Yuwei, et al.
Pubblicazione: (2024)
di: Fu, Yuwei, et al.
Pubblicazione: (2024)
Reward Guided Latent Consistency Distillation
di: Li, Jiachen, et al.
Pubblicazione: (2024)
di: Li, Jiachen, et al.
Pubblicazione: (2024)
Generalized Consistency Trajectory Models for Image Manipulation
di: Kim, Beomsu, et al.
Pubblicazione: (2024)
di: Kim, Beomsu, et al.
Pubblicazione: (2024)
Annealed Relaxation of Speculative Decoding for Faster Autoregressive Image Generation
di: Li, Xingyao, et al.
Pubblicazione: (2026)
di: Li, Xingyao, et al.
Pubblicazione: (2026)
AutoRubric-T2I: Robust Rule-Based Reward Model for Text-to-Image Alignment
di: Kao, Kuei-Chun, et al.
Pubblicazione: (2026)
di: Kao, Kuei-Chun, et al.
Pubblicazione: (2026)
Consistent Flow Distillation for Text-to-3D Generation
di: Yan, Runjie, et al.
Pubblicazione: (2025)
di: Yan, Runjie, et al.
Pubblicazione: (2025)
Deep Reward Supervisions for Tuning Text-to-Image Diffusion Models
di: Wu, Xiaoshi, et al.
Pubblicazione: (2024)
di: Wu, Xiaoshi, et al.
Pubblicazione: (2024)
MedSegFactory: Text-Guided Generation of Medical Image-Mask Pairs
di: Mao, Jiawei, et al.
Pubblicazione: (2025)
di: Mao, Jiawei, et al.
Pubblicazione: (2025)
Alignment-Guided Score Matching for Text-to-Image Alignment in Diffusion Models
di: Lee, Jaa-Yeon, et al.
Pubblicazione: (2026)
di: Lee, Jaa-Yeon, et al.
Pubblicazione: (2026)
Adversarial Imitation Learning via Boosting
di: Chang, Jonathan D., et al.
Pubblicazione: (2024)
di: Chang, Jonathan D., et al.
Pubblicazione: (2024)
Precise: SDE-Consistent Stochastic Sampling for RL Post-Training of Flow-Matching Models
di: Zou, Jade, et al.
Pubblicazione: (2026)
di: Zou, Jade, et al.
Pubblicazione: (2026)
CoDi: Conditional Diffusion Distillation for Higher-Fidelity and Faster Image Generation
di: Mei, Kangfu, et al.
Pubblicazione: (2023)
di: Mei, Kangfu, et al.
Pubblicazione: (2023)
One-Prompt-One-Story: Free-Lunch Consistent Text-to-Image Generation Using a Single Prompt
di: Liu, Tao, et al.
Pubblicazione: (2025)
di: Liu, Tao, et al.
Pubblicazione: (2025)
Reward Score Matching: Unifying Reward-based Fine-tuning for Flow and Diffusion Models
di: Lee, Jeongjae, et al.
Pubblicazione: (2026)
di: Lee, Jeongjae, et al.
Pubblicazione: (2026)
Improving Text-to-Image Generation with Intrinsic Self-Confidence Rewards
di: Kim, Seungwook, et al.
Pubblicazione: (2026)
di: Kim, Seungwook, et al.
Pubblicazione: (2026)
Assessing Image Inpainting via Re-Inpainting Self-Consistency Evaluation
di: Chen, Tianyi, et al.
Pubblicazione: (2024)
di: Chen, Tianyi, et al.
Pubblicazione: (2024)
Training-Free Reward-Guided Image Editing via Trajectory Optimal Control
di: Chang, Jinho, et al.
Pubblicazione: (2025)
di: Chang, Jinho, et al.
Pubblicazione: (2025)
JetFormer: An Autoregressive Generative Model of Raw Images and Text
di: Tschannen, Michael, et al.
Pubblicazione: (2024)
di: Tschannen, Michael, et al.
Pubblicazione: (2024)
PreciseCam: Precise Camera Control for Text-to-Image Generation
di: Bernal-Berdun, Edurne, et al.
Pubblicazione: (2025)
di: Bernal-Berdun, Edurne, et al.
Pubblicazione: (2025)
Hierarchical Variational Policies for Reward-Guided Diffusion
di: Pandey, Kushagra, et al.
Pubblicazione: (2026)
di: Pandey, Kushagra, et al.
Pubblicazione: (2026)
Enhance Multimodal Consistency and Coherence for Text-Image Plan Generation
di: Lu, Xiaoxin, et al.
Pubblicazione: (2025)
di: Lu, Xiaoxin, et al.
Pubblicazione: (2025)
Multimodal LLMs as Customized Reward Models for Text-to-Image Generation
di: Zhou, Shijie, et al.
Pubblicazione: (2025)
di: Zhou, Shijie, et al.
Pubblicazione: (2025)
Towards Effective Usage of Human-Centric Priors in Diffusion Models for Text-based Human Image Generation
di: Wang, Junyan, et al.
Pubblicazione: (2024)
di: Wang, Junyan, et al.
Pubblicazione: (2024)
Text-To-Image with Generative Adversarial Networks
di: Momen-Tayefeh, Mehrshad
Pubblicazione: (2024)
di: Momen-Tayefeh, Mehrshad
Pubblicazione: (2024)
RLAnything: Forge Environment, Policy, and Reward Model in Completely Dynamic RL System
di: Wang, Yinjie, et al.
Pubblicazione: (2026)
di: Wang, Yinjie, et al.
Pubblicazione: (2026)
Focus On What Matters: Separated Models For Visual-Based RL Generalization
di: Zhang, Di, et al.
Pubblicazione: (2024)
di: Zhang, Di, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Scaling Offline RL via Efficient and Expressive Shortcut Models
di: Espinosa-Dice, Nicolas, et al.
Pubblicazione: (2025) -
REBEL: Reinforcement Learning via Regressing Relative Rewards
di: Gao, Zhaolin, et al.
Pubblicazione: (2024) -
Dataset Reset Policy Optimization for RLHF
di: Chang, Jonathan D., et al.
Pubblicazione: (2024) -
LLMs Can Learn to Reason Via Off-Policy RL
di: Ritter, Daniel, et al.
Pubblicazione: (2026) -
SpatialReward: Verifiable Spatial Reward Modeling for Fine-Grained Spatial Consistency in Text-to-Image Generation
di: Zhou, Sashuai, et al.
Pubblicazione: (2026)