Adding Conditional Control to Diffusion Models with Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhao, Yulai, Uehara, Masatoshi, Scalia, Gabriele, Kung, Sunyuan, Biancalani, Tommaso, Levine, Sergey, Hajiramezanali, Ehsan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Bridging Model-Based Optimization and Generative Modeling via Conservative Fine-Tuning of Diffusion Models
di: Uehara, Masatoshi, et al.
Pubblicazione: (2024)
di: Uehara, Masatoshi, et al.
Pubblicazione: (2024)
Understanding Reinforcement Learning-Based Fine-Tuning of Diffusion Models: A Tutorial and Review
di: Uehara, Masatoshi, et al.
Pubblicazione: (2024)
di: Uehara, Masatoshi, et al.
Pubblicazione: (2024)
Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control
di: Uehara, Masatoshi, et al.
Pubblicazione: (2024)
di: Uehara, Masatoshi, et al.
Pubblicazione: (2024)
Feedback Efficient Online Fine-Tuning of Diffusion Models
di: Uehara, Masatoshi, et al.
Pubblicazione: (2024)
di: Uehara, Masatoshi, et al.
Pubblicazione: (2024)
Iterative Distillation for Reward-Guided Fine-Tuning of Diffusion Models in Biomolecular Design
di: Su, Xingyu, et al.
Pubblicazione: (2025)
di: Su, Xingyu, et al.
Pubblicazione: (2025)
Dynamic Search for Inference-Time Alignment in Diffusion Models
di: Li, Xiner, et al.
Pubblicazione: (2025)
di: Li, Xiner, et al.
Pubblicazione: (2025)
Inference-Time Alignment in Diffusion Models with Reward-Guided Generation: Tutorial and Review
di: Uehara, Masatoshi, et al.
Pubblicazione: (2025)
di: Uehara, Masatoshi, et al.
Pubblicazione: (2025)
Derivative-Free Guidance in Continuous and Discrete Diffusion Models with Soft Value-Based Decoding
di: Li, Xiner, et al.
Pubblicazione: (2024)
di: Li, Xiner, et al.
Pubblicazione: (2024)
RAG-Enhanced Collaborative LLM Agents for Drug Discovery
di: Lee, Namkyeong, et al.
Pubblicazione: (2025)
di: Lee, Namkyeong, et al.
Pubblicazione: (2025)
Reward-Guided Iterative Refinement in Diffusion Models at Test-Time with Applications to Protein and DNA Design
di: Uehara, Masatoshi, et al.
Pubblicazione: (2025)
di: Uehara, Masatoshi, et al.
Pubblicazione: (2025)
Hierarchically branched diffusion models leverage dataset structure for class-conditional generation
di: Tseng, Alex M., et al.
Pubblicazione: (2022)
di: Tseng, Alex M., et al.
Pubblicazione: (2022)
Fine-Tuning Discrete Diffusion Models via Reward Optimization with Applications to DNA and Protein Design
di: Wang, Chenyu, et al.
Pubblicazione: (2024)
di: Wang, Chenyu, et al.
Pubblicazione: (2024)
MolCap-Arena: A Comprehensive Captioning Benchmark on Language-Enhanced Molecular Property Prediction
di: Edwards, Carl, et al.
Pubblicazione: (2024)
di: Edwards, Carl, et al.
Pubblicazione: (2024)
Functional Graphical Models: Structure Enables Offline Data-Driven Optimization
di: Kuba, Jakub Grudzien, et al.
Pubblicazione: (2024)
di: Kuba, Jakub Grudzien, et al.
Pubblicazione: (2024)
Cell Morphology-Guided Small Molecule Generation with GFlowNets
di: Lu, Stephen Zhewen, et al.
Pubblicazione: (2024)
di: Lu, Stephen Zhewen, et al.
Pubblicazione: (2024)
DC-W2S: Dual-Consensus Weak-to-Strong Training for Reliable Process Reward Modeling in Biological Reasoning
di: Chan, Chi-Min, et al.
Pubblicazione: (2026)
di: Chan, Chi-Min, et al.
Pubblicazione: (2026)
Big Cooperative Learning
di: Cong, Yulai
Pubblicazione: (2024)
di: Cong, Yulai
Pubblicazione: (2024)
Provable Reward-Agnostic Preference-Based Reinforcement Learning
di: Zhan, Wenhao, et al.
Pubblicazione: (2023)
di: Zhan, Wenhao, et al.
Pubblicazione: (2023)
Training Diffusion Models with Reinforcement Learning
di: Black, Kevin, et al.
Pubblicazione: (2023)
di: Black, Kevin, et al.
Pubblicazione: (2023)
Reinforcement Learning with Action Chunking
di: Li, Qiyang, et al.
Pubblicazione: (2025)
di: Li, Qiyang, et al.
Pubblicazione: (2025)
Intention-Conditioned Flow Occupancy Models
di: Zheng, Chongyi, et al.
Pubblicazione: (2025)
di: Zheng, Chongyi, et al.
Pubblicazione: (2025)
A mechanistically interpretable neural network for regulatory genomics
di: Tseng, Alex M., et al.
Pubblicazione: (2024)
di: Tseng, Alex M., et al.
Pubblicazione: (2024)
Unsupervised Zero-Shot Reinforcement Learning via Functional Reward Encodings
di: Frans, Kevin, et al.
Pubblicazione: (2024)
di: Frans, Kevin, et al.
Pubblicazione: (2024)
AssayBench: An Assay-Level Virtual Cell Benchmark for LLMs and Agents
di: De Brouwer, Edward, et al.
Pubblicazione: (2026)
di: De Brouwer, Edward, et al.
Pubblicazione: (2026)
ControlMol: Adding Substructure Control To Molecule Diffusion Models
di: Zhengyang, Qi, et al.
Pubblicazione: (2024)
di: Zhengyang, Qi, et al.
Pubblicazione: (2024)
Knowledgeable Language Models as Black-Box Optimizers for Personalized Medicine
di: Yao, Michael S., et al.
Pubblicazione: (2025)
di: Yao, Michael S., et al.
Pubblicazione: (2025)
RLDG: Robotic Generalist Policy Distillation via Reinforcement Learning
di: Xu, Charles, et al.
Pubblicazione: (2024)
di: Xu, Charles, et al.
Pubblicazione: (2024)
Contextualizing biological perturbation experiments through language
di: Wu, Menghua, et al.
Pubblicazione: (2025)
di: Wu, Menghua, et al.
Pubblicazione: (2025)
OGBench: Benchmarking Offline Goal-Conditioned RL
di: Park, Seohong, et al.
Pubblicazione: (2024)
di: Park, Seohong, et al.
Pubblicazione: (2024)
Interactive Dialogue Agents via Reinforcement Learning on Hindsight Regenerations
di: Hong, Joey, et al.
Pubblicazione: (2024)
di: Hong, Joey, et al.
Pubblicazione: (2024)
Flow Q-Learning
di: Park, Seohong, et al.
Pubblicazione: (2025)
di: Park, Seohong, et al.
Pubblicazione: (2025)
Vision-Language Models Provide Promptable Representations for Reinforcement Learning
di: Chen, William, et al.
Pubblicazione: (2024)
di: Chen, William, et al.
Pubblicazione: (2024)
HIQL: Offline Goal-Conditioned RL with Latent States as Actions
di: Park, Seohong, et al.
Pubblicazione: (2023)
di: Park, Seohong, et al.
Pubblicazione: (2023)
Q-SFT: Q-Learning for Language Models via Supervised Fine-Tuning
di: Hong, Joey, et al.
Pubblicazione: (2024)
di: Hong, Joey, et al.
Pubblicazione: (2024)
Diffusion Models for Reinforcement Learning: A Survey
di: Zhu, Zhengbang, et al.
Pubblicazione: (2023)
di: Zhu, Zhengbang, et al.
Pubblicazione: (2023)
Inference-Time Alignment Control for Diffusion Models with Reinforcement Learning Guidance
di: Jin, Luozhijie, et al.
Pubblicazione: (2025)
di: Jin, Luozhijie, et al.
Pubblicazione: (2025)
RLAC: Reinforcement Learning with Adversarial Critic for Free-Form Generation Tasks
di: Wu, Mian, et al.
Pubblicazione: (2025)
di: Wu, Mian, et al.
Pubblicazione: (2025)
Cliqueformer: Model-Based Optimization with Structured Transformers
di: Kuba, Jakub Grudzien, et al.
Pubblicazione: (2024)
di: Kuba, Jakub Grudzien, et al.
Pubblicazione: (2024)
Joint Embedding vs Reconstruction: Provable Benefits of Latent Space Prediction for Self Supervised Learning
di: Van Assel, Hugues, et al.
Pubblicazione: (2025)
di: Van Assel, Hugues, et al.
Pubblicazione: (2025)
Transitive RL: Value Learning via Divide and Conquer
di: Park, Seohong, et al.
Pubblicazione: (2025)
di: Park, Seohong, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Bridging Model-Based Optimization and Generative Modeling via Conservative Fine-Tuning of Diffusion Models
di: Uehara, Masatoshi, et al.
Pubblicazione: (2024) -
Understanding Reinforcement Learning-Based Fine-Tuning of Diffusion Models: A Tutorial and Review
di: Uehara, Masatoshi, et al.
Pubblicazione: (2024) -
Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control
di: Uehara, Masatoshi, et al.
Pubblicazione: (2024) -
Feedback Efficient Online Fine-Tuning of Diffusion Models
di: Uehara, Masatoshi, et al.
Pubblicazione: (2024) -
Iterative Distillation for Reward-Guided Fine-Tuning of Diffusion Models in Biomolecular Design
di: Su, Xingyu, et al.
Pubblicazione: (2025)