Fine-Tuning Diffusion Models for Molecular Generation via Reinforcement Learning and Fast Sampling
Fuente:
arXiv
Guardado en:
| Autores principales: | Lin, Guang, Tu, Shikui, Xu, Lei |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Boosting Efficiency in Task-Agnostic Exploration through Causal Knowledge
por: Yang, Yupei, et al.
Publicado: (2024)
por: Yang, Yupei, et al.
Publicado: (2024)
DLPO: Diffusion Model Loss-Guided Reinforcement Learning for Fine-Tuning Text-to-Speech Diffusion Models
por: Chen, Jingyi, et al.
Publicado: (2024)
por: Chen, Jingyi, et al.
Publicado: (2024)
THFlow: A Temporally Hierarchical Flow Matching Framework for 3D Peptide Design
por: Huang, Dengdeng, et al.
Publicado: (2025)
por: Huang, Dengdeng, et al.
Publicado: (2025)
Score as Action: Fine-Tuning Diffusion Generative Models by Continuous-time Reinforcement Learning
por: Zhao, Hanyang, et al.
Publicado: (2025)
por: Zhao, Hanyang, et al.
Publicado: (2025)
Blending Supervised and Reinforcement Fine-Tuning with Prefix Sampling
por: Huang, Zeyu, et al.
Publicado: (2025)
por: Huang, Zeyu, et al.
Publicado: (2025)
Bridging Model-Based Optimization and Generative Modeling via Conservative Fine-Tuning of Diffusion Models
por: Uehara, Masatoshi, et al.
Publicado: (2024)
por: Uehara, Masatoshi, et al.
Publicado: (2024)
Thompson Sampling via Fine-Tuning of LLMs
por: Menet, Nicolas, et al.
Publicado: (2025)
por: Menet, Nicolas, et al.
Publicado: (2025)
ESSAM: A Novel Competitive Evolution Strategies Approach to Reinforcement Learning for Memory Efficient LLMs Fine-Tuning
por: Sun, Zhishen, et al.
Publicado: (2026)
por: Sun, Zhishen, et al.
Publicado: (2026)
Fine-Tuning Diffusion Models via Intermediate Distribution Shaping
por: Anil, Gautham Govind, et al.
Publicado: (2025)
por: Anil, Gautham Govind, et al.
Publicado: (2025)
dUltra: Ultra-Fast Diffusion Language Models via Reinforcement Learning
por: Chen, Shirui, et al.
Publicado: (2025)
por: Chen, Shirui, et al.
Publicado: (2025)
Understanding Reinforcement Learning-Based Fine-Tuning of Diffusion Models: A Tutorial and Review
por: Uehara, Masatoshi, et al.
Publicado: (2024)
por: Uehara, Masatoshi, et al.
Publicado: (2024)
Diffusion-DICE: In-Sample Diffusion Guidance for Offline Reinforcement Learning
por: Mao, Liyuan, et al.
Publicado: (2024)
por: Mao, Liyuan, et al.
Publicado: (2024)
A Survey on Parameter-Efficient Fine-Tuning for Foundation Models in Federated Learning
por: Bian, Jieming, et al.
Publicado: (2025)
por: Bian, Jieming, et al.
Publicado: (2025)
FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed
por: Dang, Sizhe, et al.
Publicado: (2025)
por: Dang, Sizhe, et al.
Publicado: (2025)
Enhancing Reinforcement Learning Fine-Tuning with an Online Refiner
por: Ma, Hao, et al.
Publicado: (2026)
por: Ma, Hao, et al.
Publicado: (2026)
Reinforcement Learning Fine-Tunes a Sparse Subnetwork in Large Language Models
por: Balashov, Andrii
Publicado: (2025)
por: Balashov, Andrii
Publicado: (2025)
Reinforcement Learning Fine-Tuning Enhances Activation Intensity and Diversity in the Internal Circuitry of LLMs
por: Zhang, Honglin, et al.
Publicado: (2025)
por: Zhang, Honglin, et al.
Publicado: (2025)
Reward Sharpness-Aware Fine-Tuning for Diffusion Models
por: Kim, Kwanyoung, et al.
Publicado: (2026)
por: Kim, Kwanyoung, et al.
Publicado: (2026)
RPO:Reinforcement Fine-Tuning with Partial Reasoning Optimization
por: Yi, Hongzhu, et al.
Publicado: (2026)
por: Yi, Hongzhu, et al.
Publicado: (2026)
Robust Reinforcement Learning from Human Feedback for Large Language Models Fine-Tuning
por: Ye, Kai, et al.
Publicado: (2025)
por: Ye, Kai, et al.
Publicado: (2025)
RIFT: Repurposing Negative Samples via Reward-Informed Fine-Tuning
por: Liu, Zehua, et al.
Publicado: (2026)
por: Liu, Zehua, et al.
Publicado: (2026)
On the Entropy Dynamics in Reinforcement Fine-Tuning of Large Language Models
por: Wang, Shumin, et al.
Publicado: (2026)
por: Wang, Shumin, et al.
Publicado: (2026)
Efficient Differentially Private Fine-Tuning of LLMs via Reinforcement Learning
por: Khadangi, Afshin, et al.
Publicado: (2025)
por: Khadangi, Afshin, et al.
Publicado: (2025)
Ultra-Fast Language Generation via Discrete Diffusion Divergence Instruct
por: Zheng, Haoyang, et al.
Publicado: (2025)
por: Zheng, Haoyang, et al.
Publicado: (2025)
Supervised Fine Tuning on Curated Data is Reinforcement Learning (and can be improved)
por: Qin, Chongli, et al.
Publicado: (2025)
por: Qin, Chongli, et al.
Publicado: (2025)
Adaptive Policy Selection and Fine-Tuning under Interaction Budgets for Offline-to-Online Reinforcement Learning
por: Bozkurt, Alper Kamil, et al.
Publicado: (2026)
por: Bozkurt, Alper Kamil, et al.
Publicado: (2026)
Supervised Fine-Tuning as Inverse Reinforcement Learning
por: Sun, Hao
Publicado: (2024)
por: Sun, Hao
Publicado: (2024)
Fine-Tuning Discrete Diffusion Models via Reward Optimization with Applications to DNA and Protein Design
por: Wang, Chenyu, et al.
Publicado: (2024)
por: Wang, Chenyu, et al.
Publicado: (2024)
DiFFPO: Training Diffusion LLMs to Reason Fast and Furious via Reinforcement Learning
por: Zhao, Hanyang, et al.
Publicado: (2025)
por: Zhao, Hanyang, et al.
Publicado: (2025)
SRFT: A Single-Stage Method with Supervised and Reinforcement Fine-Tuning for Reasoning
por: Fu, Yuqian, et al.
Publicado: (2025)
por: Fu, Yuqian, et al.
Publicado: (2025)
Fast Sampling via Discrete Non-Markov Diffusion Models with Predetermined Transition Time
por: Chen, Zixiang, et al.
Publicado: (2023)
por: Chen, Zixiang, et al.
Publicado: (2023)
Learning What Reinforcement Learning Can't: Interleaved Online Fine-Tuning for Hardest Questions
por: Ma, Lu, et al.
Publicado: (2025)
por: Ma, Lu, et al.
Publicado: (2025)
SATQuest: A Verifier for Logical Reasoning Evaluation and Reinforcement Fine-Tuning of LLMs
por: Zhao, Yanxiao, et al.
Publicado: (2025)
por: Zhao, Yanxiao, et al.
Publicado: (2025)
Towards Fast Safe Online Reinforcement Learning via Policy Finetuning
por: Chen, Keru, et al.
Publicado: (2024)
por: Chen, Keru, et al.
Publicado: (2024)
Upweighting Easy Samples in Fine-Tuning Mitigates Forgetting
por: Sanyal, Sunny, et al.
Publicado: (2025)
por: Sanyal, Sunny, et al.
Publicado: (2025)
Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control
por: Uehara, Masatoshi, et al.
Publicado: (2024)
por: Uehara, Masatoshi, et al.
Publicado: (2024)
FRoD: Full-Rank Efficient Fine-Tuning with Rotational Degrees for Fast Convergence
por: Wan, Guoan, et al.
Publicado: (2025)
por: Wan, Guoan, et al.
Publicado: (2025)
Diffusion Fine-Tuning via Reparameterized Policy Gradient of the Soft Q-Function
por: Kang, Hyeongyu, et al.
Publicado: (2025)
por: Kang, Hyeongyu, et al.
Publicado: (2025)
Internalizing Curriculum Judgment for LLM Reinforcement Fine-Tuning
por: Zheng, Han, et al.
Publicado: (2026)
por: Zheng, Han, et al.
Publicado: (2026)
RPO: Fine-Tuning Visual Generative Models via Rich Vision-Language Preferences
por: Zhao, Hanyang, et al.
Publicado: (2025)
por: Zhao, Hanyang, et al.
Publicado: (2025)
Ejemplares similares
-
Boosting Efficiency in Task-Agnostic Exploration through Causal Knowledge
por: Yang, Yupei, et al.
Publicado: (2024) -
DLPO: Diffusion Model Loss-Guided Reinforcement Learning for Fine-Tuning Text-to-Speech Diffusion Models
por: Chen, Jingyi, et al.
Publicado: (2024) -
THFlow: A Temporally Hierarchical Flow Matching Framework for 3D Peptide Design
por: Huang, Dengdeng, et al.
Publicado: (2025) -
Score as Action: Fine-Tuning Diffusion Generative Models by Continuous-time Reinforcement Learning
por: Zhao, Hanyang, et al.
Publicado: (2025) -
Blending Supervised and Reinforcement Fine-Tuning with Prefix Sampling
por: Huang, Zeyu, et al.
Publicado: (2025)