Fine-Tuning Diffusion Models via Intermediate Distribution Shaping
Fuente:
arXiv
Salvato in:
| Autori principali: | Anil, Gautham Govind, Haque, Shaan Ul, Kannen, Nithish, Nagaraj, Dheeraj, Shakkottai, Sanjay, Shanmugam, Karthikeyan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Interleaved Gibbs Diffusion: Generating Discrete-Continuous Data with Implicit Constraints
di: Anil, Gautham Govind, et al.
Pubblicazione: (2025)
di: Anil, Gautham Govind, et al.
Pubblicazione: (2025)
Efficient Approximate Posterior Sampling with Annealed Langevin Monte Carlo
di: Parulekar, Advait, et al.
Pubblicazione: (2025)
di: Parulekar, Advait, et al.
Pubblicazione: (2025)
Glauber Generative Model: Discrete Diffusion Models via Binary Classification
di: Varma, Harshit, et al.
Pubblicazione: (2024)
di: Varma, Harshit, et al.
Pubblicazione: (2024)
Stochastic Re-weighted Gradient Descent via Distributionally Robust Optimization
di: Kumar, Ramnath, et al.
Pubblicazione: (2023)
di: Kumar, Ramnath, et al.
Pubblicazione: (2023)
Model Editing by Standard Fine-Tuning
di: Gangadhar, Govind, et al.
Pubblicazione: (2024)
di: Gangadhar, Govind, et al.
Pubblicazione: (2024)
Entropy Aware Reward Guidance for Diffusion Language Model Alignment
di: Tejaswi, Atula, et al.
Pubblicazione: (2026)
di: Tejaswi, Atula, et al.
Pubblicazione: (2026)
Bandits with Mean Bounds
di: Sharma, Nihal, et al.
Pubblicazione: (2020)
di: Sharma, Nihal, et al.
Pubblicazione: (2020)
Machine Unlearning under Overparameterization
di: Block, Jacob L., et al.
Pubblicazione: (2025)
di: Block, Jacob L., et al.
Pubblicazione: (2025)
Safety Subspaces are Not Linearly Distinct: A Fine-Tuning Case Study
di: Ponkshe, Kaustubh, et al.
Pubblicazione: (2025)
di: Ponkshe, Kaustubh, et al.
Pubblicazione: (2025)
Beyond Propagation of Chaos: A Stochastic Algorithm for Mean Field Optimization
di: Tankala, Chandan, et al.
Pubblicazione: (2025)
di: Tankala, Chandan, et al.
Pubblicazione: (2025)
PITA: Preference-Guided Inference-Time Alignment for LLM Post-Training
di: Bobbili, Sarat Chandra, et al.
Pubblicazione: (2025)
di: Bobbili, Sarat Chandra, et al.
Pubblicazione: (2025)
Proactive Agents for Multi-Turn Text-to-Image Generation Under Uncertainty
di: Hahn, Meera, et al.
Pubblicazione: (2024)
di: Hahn, Meera, et al.
Pubblicazione: (2024)
Learning from Label Proportions: Bootstrapping Supervised Learners via Belief Propagation
di: Havaldar, Shreyas, et al.
Pubblicazione: (2023)
di: Havaldar, Shreyas, et al.
Pubblicazione: (2023)
Generating Universal Adversarial Perturbations for Quantum Classifiers
di: Anil, Gautham, et al.
Pubblicazione: (2024)
di: Anil, Gautham, et al.
Pubblicazione: (2024)
Stronger Enforcement of Instruction Hierarchy via Augmented Intermediate Representations
di: Kariyappa, Sanjay, et al.
Pubblicazione: (2025)
di: Kariyappa, Sanjay, et al.
Pubblicazione: (2025)
Towards a Pretrained Model for Restless Bandits via Multi-arm Generalization
di: Zhao, Yunfan, et al.
Pubblicazione: (2023)
di: Zhao, Yunfan, et al.
Pubblicazione: (2023)
Bandits with Stochastic Experts: Constant Regret, Empirical Experts and Episodes
di: Sharma, Nihal, et al.
Pubblicazione: (2021)
di: Sharma, Nihal, et al.
Pubblicazione: (2021)
Combinatorial Multi-armed Bandits: Arm Selection via Group Testing
di: Mukherjee, Arpan, et al.
Pubblicazione: (2024)
di: Mukherjee, Arpan, et al.
Pubblicazione: (2024)
Finite time analysis of temporal difference learning with linear function approximation: Tail averaging and regularisation
di: Patil, Gandharv, et al.
Pubblicazione: (2022)
di: Patil, Gandharv, et al.
Pubblicazione: (2022)
Representational Alignment Across Model Layers and Brain Regions with Multi-Level Optimal Transport
di: Shah, Shaan, et al.
Pubblicazione: (2025)
di: Shah, Shaan, et al.
Pubblicazione: (2025)
Bridging Model-Based Optimization and Generative Modeling via Conservative Fine-Tuning of Diffusion Models
di: Uehara, Masatoshi, et al.
Pubblicazione: (2024)
di: Uehara, Masatoshi, et al.
Pubblicazione: (2024)
Reward Sharpness-Aware Fine-Tuning for Diffusion Models
di: Kim, Kwanyoung, et al.
Pubblicazione: (2026)
di: Kim, Kwanyoung, et al.
Pubblicazione: (2026)
Fine-Tuning Diffusion Models for Molecular Generation via Reinforcement Learning and Fast Sampling
di: Lin, Guang, et al.
Pubblicazione: (2026)
di: Lin, Guang, et al.
Pubblicazione: (2026)
Fairness under Covariate Shift: Improving Fairness-Accuracy tradeoff with few Unlabeled Test Samples
di: Havaldar, Shreyas, et al.
Pubblicazione: (2023)
di: Havaldar, Shreyas, et al.
Pubblicazione: (2023)
A Decision-Language Model (DLM) for Dynamic Restless Multi-Armed Bandit Tasks in Public Health
di: Behari, Nikhil, et al.
Pubblicazione: (2024)
di: Behari, Nikhil, et al.
Pubblicazione: (2024)
Fine-Tuning Discrete Diffusion Models via Reward Optimization with Applications to DNA and Protein Design
di: Wang, Chenyu, et al.
Pubblicazione: (2024)
di: Wang, Chenyu, et al.
Pubblicazione: (2024)
PREFINE: Preference-Based Implicit Reward and Cost Fine-Tuning for Safety Alignment
di: Verma, Richa, et al.
Pubblicazione: (2026)
di: Verma, Richa, et al.
Pubblicazione: (2026)
In-Context Learning with Transformers: Softmax Attention Adapts to Function Lipschitzness
di: Collins, Liam, et al.
Pubblicazione: (2024)
di: Collins, Liam, et al.
Pubblicazione: (2024)
Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control
di: Uehara, Masatoshi, et al.
Pubblicazione: (2024)
di: Uehara, Masatoshi, et al.
Pubblicazione: (2024)
Diffusion Fine-Tuning via Reparameterized Policy Gradient of the Soft Q-Function
di: Kang, Hyeongyu, et al.
Pubblicazione: (2025)
di: Kang, Hyeongyu, et al.
Pubblicazione: (2025)
DLPO: Diffusion Model Loss-Guided Reinforcement Learning for Fine-Tuning Text-to-Speech Diffusion Models
di: Chen, Jingyi, et al.
Pubblicazione: (2024)
di: Chen, Jingyi, et al.
Pubblicazione: (2024)
Feedback Efficient Online Fine-Tuning of Diffusion Models
di: Uehara, Masatoshi, et al.
Pubblicazione: (2024)
di: Uehara, Masatoshi, et al.
Pubblicazione: (2024)
SVFT: Parameter-Efficient Fine-Tuning with Singular Vectors
di: Lingam, Vijay, et al.
Pubblicazione: (2024)
di: Lingam, Vijay, et al.
Pubblicazione: (2024)
Fine-tuning Flow Matching Generative Models with Intermediate Feedback
di: Fan, Jiajun, et al.
Pubblicazione: (2025)
di: Fan, Jiajun, et al.
Pubblicazione: (2025)
Fine-Tuning Discrete Diffusion Models with Policy Gradient Methods
di: Zekri, Oussama, et al.
Pubblicazione: (2025)
di: Zekri, Oussama, et al.
Pubblicazione: (2025)
Stabilizing LLM Supervised Fine-Tuning via Explicit Distributional Control
di: Wang, Xinyu, et al.
Pubblicazione: (2026)
di: Wang, Xinyu, et al.
Pubblicazione: (2026)
Constrained Posterior Sampling: Time Series Generation with Hard Constraints
di: Narasimhan, Sai Shankar, et al.
Pubblicazione: (2024)
di: Narasimhan, Sai Shankar, et al.
Pubblicazione: (2024)
How Robust is Model Editing after Fine-Tuning? An Empirical Study on Text-to-Image Diffusion Models
di: He, Feng, et al.
Pubblicazione: (2025)
di: He, Feng, et al.
Pubblicazione: (2025)
Thompson Sampling via Fine-Tuning of LLMs
di: Menet, Nicolas, et al.
Pubblicazione: (2025)
di: Menet, Nicolas, et al.
Pubblicazione: (2025)
Evaluating Generalization and Representation Stability in Small LMs via Prompting, Fine-Tuning and Out-of-Distribution Prompts
di: Raja, Rahul, et al.
Pubblicazione: (2025)
di: Raja, Rahul, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Interleaved Gibbs Diffusion: Generating Discrete-Continuous Data with Implicit Constraints
di: Anil, Gautham Govind, et al.
Pubblicazione: (2025) -
Efficient Approximate Posterior Sampling with Annealed Langevin Monte Carlo
di: Parulekar, Advait, et al.
Pubblicazione: (2025) -
Glauber Generative Model: Discrete Diffusion Models via Binary Classification
di: Varma, Harshit, et al.
Pubblicazione: (2024) -
Stochastic Re-weighted Gradient Descent via Distributionally Robust Optimization
di: Kumar, Ramnath, et al.
Pubblicazione: (2023) -
Model Editing by Standard Fine-Tuning
di: Gangadhar, Govind, et al.
Pubblicazione: (2024)