A Simple and Effective Reinforcement Learning Method for Text-to-Image Diffusion Fine-tuning
Fuente:
arXiv
Guardado en:
| Autores principales: | Gupta, Shashank, Ahuja, Chaitanya, Lin, Tsung-Yu, Roy, Sreya Dutta, Oosterhuis, Harrie, de Rijke, Maarten, Shukla, Satya Narayan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Practical and Robust Safety Guarantees for Advanced Counterfactual Learning to Rank
por: Gupta, Shashank, et al.
Publicado: (2024)
por: Gupta, Shashank, et al.
Publicado: (2024)
Proximal Ranking Policy Optimization for Practical Safety in Counterfactual Learning to Rank
por: Gupta, Shashank, et al.
Publicado: (2024)
por: Gupta, Shashank, et al.
Publicado: (2024)
A First Look at Selection Bias in Preference Elicitation for Recommendation
por: Gupta, Shashank, et al.
Publicado: (2024)
por: Gupta, Shashank, et al.
Publicado: (2024)
Optimal Baseline Corrections for Off-Policy Contextual Bandits
por: Gupta, Shashank, et al.
Publicado: (2024)
por: Gupta, Shashank, et al.
Publicado: (2024)
Estimating the Hessian Matrix of Ranking Objectives for Stochastic Learning to Rank with Gradient Boosted Trees
por: Kang, Jingwei, et al.
Publicado: (2024)
por: Kang, Jingwei, et al.
Publicado: (2024)
Following the Eye-Tracking Evidence: Established Web-Search Assumptions Fail in Carousel Interfaces
por: Kang, Jingwei, et al.
Publicado: (2026)
por: Kang, Jingwei, et al.
Publicado: (2026)
A Simpler Alternative to Variational Regularized Counterfactual Risk Minimization
por: Bakker, Hua Chang, et al.
Publicado: (2024)
por: Bakker, Hua Chang, et al.
Publicado: (2024)
Rethinking Click Models in Light of Carousel Interfaces: Theory-Based Categorization and Design of Click Models
por: Kang, Jingwei, et al.
Publicado: (2025)
por: Kang, Jingwei, et al.
Publicado: (2025)
Going Beyond Popularity and Positivity Bias: Correcting for Multifactorial Bias in Recommender Systems
por: Huang, Jin, et al.
Publicado: (2024)
por: Huang, Jin, et al.
Publicado: (2024)
Is Interpretable Machine Learning Effective at Feature Selection for Neural Learning-to-Rank?
por: Lyu, Lijun, et al.
Publicado: (2024)
por: Lyu, Lijun, et al.
Publicado: (2024)
AQA: Adaptive Question Answering in a Society of LLMs via Contextual Multi-Armed Bandit
por: Hoveyda, Mohanna, et al.
Publicado: (2024)
por: Hoveyda, Mohanna, et al.
Publicado: (2024)
Adaptive Orchestration of Modular Generative Information Access Systems
por: Hoveyda, Mohanna, et al.
Publicado: (2025)
por: Hoveyda, Mohanna, et al.
Publicado: (2025)
Learning to Rank with Variable Result Presentation Lengths
por: Knyazev, Norman, et al.
Publicado: (2025)
por: Knyazev, Norman, et al.
Publicado: (2025)
A Non-Parametric Choice Model That Learns How Users Choose Between Recommended Options
por: Krause, Thorsten, et al.
Publicado: (2025)
por: Krause, Thorsten, et al.
Publicado: (2025)
Towards Two-Stage Counterfactual Learning to Rank
por: Gupta, Shashank, et al.
Publicado: (2025)
por: Gupta, Shashank, et al.
Publicado: (2025)
Local Feature Selection without Label or Feature Leakage for Interpretable Machine Learning Predictions
por: Oosterhuis, Harrie, et al.
Publicado: (2024)
por: Oosterhuis, Harrie, et al.
Publicado: (2024)
RecGaze: The First Eye Tracking and User Interaction Dataset for Carousel Interfaces
por: de Leon-Martinez, Santiago, et al.
Publicado: (2025)
por: de Leon-Martinez, Santiago, et al.
Publicado: (2025)
Optimizing Compound Retrieval Systems
por: Oosterhuis, Harrie, et al.
Publicado: (2025)
por: Oosterhuis, Harrie, et al.
Publicado: (2025)
A Minimalist Method for Fine-tuning Text-to-Image Diffusion Models
por: Miao, Yanting, et al.
Publicado: (2025)
por: Miao, Yanting, et al.
Publicado: (2025)
Learning to Localize Objects Improves Spatial Reasoning in Visual-LLMs
por: Ranasinghe, Kanchana, et al.
Publicado: (2024)
por: Ranasinghe, Kanchana, et al.
Publicado: (2024)
Safe, Efficient, and Robust Reinforcement Learning for Ranking and Diffusion Models
por: Gupta, Shashank
Publicado: (2025)
por: Gupta, Shashank
Publicado: (2025)
Heteroscedastic Temporal Variational Autoencoder For Irregular Time Series
por: Shukla, Satya Narayan, et al.
Publicado: (2021)
por: Shukla, Satya Narayan, et al.
Publicado: (2021)
Reliable Confidence Intervals for Information Retrieval Evaluation Using Generative A.I
por: Oosterhuis, Harrie, et al.
Publicado: (2024)
por: Oosterhuis, Harrie, et al.
Publicado: (2024)
Cultural and Historical Identity in Amitav Ghosh’s River of Smoke: A Postcolonial Perspective
por: Satya Narayan
Publicado: (2021)
por: Satya Narayan
Publicado: (2021)
Depicting Culture and Identity in Amitav Ghosh’s The Shadow Lines
por: Satya Narayan
Publicado: (2017)
por: Satya Narayan
Publicado: (2017)
Cultural and Historical Identity in Amitav Ghosh’s River of Smoke: A Postcolonial Perspective
por: Satya Narayan
Publicado: (2021)
por: Satya Narayan
Publicado: (2021)
KnowTuning: Knowledge-aware Fine-tuning for Large Language Models
por: Lyu, Yougang, et al.
Publicado: (2024)
por: Lyu, Yougang, et al.
Publicado: (2024)
Improvise, Adapt, Overcome -- Telescopic Adapters for Efficient Fine-tuning of Vision Language Models in Medical Imaging
por: Mishra, Ujjwal, et al.
Publicado: (2025)
por: Mishra, Ujjwal, et al.
Publicado: (2025)
DreamBlend: Advancing Personalized Fine-tuning of Text-to-Image Diffusion Models
por: Ram, Shwetha, et al.
Publicado: (2024)
por: Ram, Shwetha, et al.
Publicado: (2024)
FT-Shield: A Watermark Against Unauthorized Fine-tuning in Text-to-Image Diffusion Models
por: Cui, Yingqian, et al.
Publicado: (2023)
por: Cui, Yingqian, et al.
Publicado: (2023)
Benchmark Granularity and Model Robustness for Image-Text Retrieval
por: Hendriksen, Mariya, et al.
Publicado: (2024)
por: Hendriksen, Mariya, et al.
Publicado: (2024)
DiffExp: Efficient Exploration in Reward Fine-tuning for Text-to-Image Diffusion Models
por: Chae, Daewon, et al.
Publicado: (2025)
por: Chae, Daewon, et al.
Publicado: (2025)
Object-Driven One-Shot Fine-tuning of Text-to-Image Diffusion with Prototypical Embedding
por: Lu, Jianxiang, et al.
Publicado: (2024)
por: Lu, Jianxiang, et al.
Publicado: (2024)
Match & Choose: Model Selection Framework for Fine-tuning Text-to-Image Diffusion Models
por: Lewandowski, Basile, et al.
Publicado: (2025)
por: Lewandowski, Basile, et al.
Publicado: (2025)
Angiomyolipoma of the broad ligament
por: Satya Dutta
Publicado: (2020)
por: Satya Dutta
Publicado: (2020)
Papillary cystadenocarcinoma of the parotid gland: a rare sub-variant of salivary gland adenocarcinoma
por: Satya Dutta
Publicado: (2022)
por: Satya Dutta
Publicado: (2022)
Giant cell reparative granuloma of the nasal cavity: a rare site of presentation with review of literature
por: Satya Dutta
Publicado: (2020)
por: Satya Dutta
Publicado: (2020)
Optimized Text Embedding Models and Benchmarks for Amharic Passage Retrieval
por: Mekonnen, Kidist Amde, et al.
Publicado: (2025)
por: Mekonnen, Kidist Amde, et al.
Publicado: (2025)
Consolidating Ranking and Relevance Predictions of Large Language Models through Post-Processing
por: Yan, Le, et al.
Publicado: (2024)
por: Yan, Le, et al.
Publicado: (2024)
Pigments measured on water bottle samples during TYRO cruise NAPP90-1
por: Oosterhuis, Swier
Publicado: (2013)
por: Oosterhuis, Swier
Publicado: (2013)
Ejemplares similares
-
Practical and Robust Safety Guarantees for Advanced Counterfactual Learning to Rank
por: Gupta, Shashank, et al.
Publicado: (2024) -
Proximal Ranking Policy Optimization for Practical Safety in Counterfactual Learning to Rank
por: Gupta, Shashank, et al.
Publicado: (2024) -
A First Look at Selection Bias in Preference Elicitation for Recommendation
por: Gupta, Shashank, et al.
Publicado: (2024) -
Optimal Baseline Corrections for Off-Policy Contextual Bandits
por: Gupta, Shashank, et al.
Publicado: (2024) -
Estimating the Hessian Matrix of Ranking Objectives for Stochastic Learning to Rank with Gradient Boosted Trees
por: Kang, Jingwei, et al.
Publicado: (2024)