Alchemist: Turning Public Text-to-Image Data into Generative Gold
Fuente:
arXiv
Saved in:
| Main Authors: | Startsev, Valerii, Ustyuzhanin, Alexander, Kirillov, Alexey, Baranchuk, Dmitry, Kastryulin, Sergey |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Does Diffusion Beat GAN in Image Super Resolution?
by: Kuznedelev, Denis, et al.
Published: (2024)
by: Kuznedelev, Denis, et al.
Published: (2024)
YaART: Yet Another ART Rendering Technology
by: Kastryulin, Sergey, et al.
Published: (2024)
by: Kastryulin, Sergey, et al.
Published: (2024)
Revisiting Autoregressive Models for Generative Image Classification
by: Sudakov, Ilia, et al.
Published: (2026)
by: Sudakov, Ilia, et al.
Published: (2026)
QUASAR: QUality and Aesthetics Scoring with Advanced Representations
by: Kastryulin, Sergey, et al.
Published: (2024)
by: Kastryulin, Sergey, et al.
Published: (2024)
Invertible Consistency Distillation for Text-Guided Image Editing in Around 7 Steps
by: Starodubcev, Nikita, et al.
Published: (2024)
by: Starodubcev, Nikita, et al.
Published: (2024)
IQA-Adapter: Exploring Knowledge Transfer from Image Quality Assessment to Diffusion-based Generative Models
by: Abud, Khaled, et al.
Published: (2024)
by: Abud, Khaled, et al.
Published: (2024)
CasTex: Cascaded Text-to-Texture Synthesis via Explicit Texture Maps and Physically-Based Shading
by: Aliev, Mishan, et al.
Published: (2025)
by: Aliev, Mishan, et al.
Published: (2025)
Switti: Designing Scale-Wise Transformers for Text-to-Image Synthesis
by: Voronov, Anton, et al.
Published: (2024)
by: Voronov, Anton, et al.
Published: (2024)
Alchemist: Unlocking Efficiency in Text-to-Image Model Training via Meta-Gradient Data Selection
by: Ding, Kaixin, et al.
Published: (2025)
by: Ding, Kaixin, et al.
Published: (2025)
Your Student is Better Than Expected: Adaptive Teacher-Student Collaboration for Text-Conditional Diffusion Models
by: Starodubcev, Nikita, et al.
Published: (2023)
by: Starodubcev, Nikita, et al.
Published: (2023)
Accurate Compression of Text-to-Image Diffusion Models via Vector Quantization
by: Egiazarian, Vage, et al.
Published: (2024)
by: Egiazarian, Vage, et al.
Published: (2024)
Bridging the Gap Between Saliency Prediction and Image Quality Assessment
by: Alexey, Kirillov, et al.
Published: (2024)
by: Alexey, Kirillov, et al.
Published: (2024)
Rethinking Global Text Conditioning in Diffusion Transformers
by: Starodubcev, Nikita, et al.
Published: (2026)
by: Starodubcev, Nikita, et al.
Published: (2026)
Scale-wise Distillation of Diffusion Models
by: Starodubcev, Nikita, et al.
Published: (2025)
by: Starodubcev, Nikita, et al.
Published: (2025)
Registers Matter for Pixel-Space Diffusion Transformers
by: Starodubcev, Nikita, et al.
Published: (2026)
by: Starodubcev, Nikita, et al.
Published: (2026)
Hierarchical B-frame Video Coding for Long Group of Pictures
by: Kirillov, Ivan, et al.
Published: (2024)
by: Kirillov, Ivan, et al.
Published: (2024)
MADrive: Memory-Augmented Driving Scene Modeling
by: Karpikova, Polina, et al.
Published: (2025)
by: Karpikova, Polina, et al.
Published: (2025)
Inverse Bridge Matching Distillation
by: Gushchin, Nikita, et al.
Published: (2025)
by: Gushchin, Nikita, et al.
Published: (2025)
MUMU: Bootstrapping Multimodal Image Generation from Text-to-Image Data
by: Berman, William, et al.
Published: (2024)
by: Berman, William, et al.
Published: (2024)
Visual Concept-driven Image Generation with Text-to-Image Diffusion Model
by: Rahman, Tanzila, et al.
Published: (2024)
by: Rahman, Tanzila, et al.
Published: (2024)
Scalable Ranked Preference Optimization for Text-to-Image Generation
by: Karthik, Shyamgopal, et al.
Published: (2024)
by: Karthik, Shyamgopal, et al.
Published: (2024)
Can Text-to-Image Generative Models Accurately Depict Age? A Comparative Study on Synthetic Portrait Generation and Age Estimation
by: Novikov, Alexey A., et al.
Published: (2025)
by: Novikov, Alexey A., et al.
Published: (2025)
Harnessing Caption Detailness for Data-Efficient Text-to-Image Generation
by: Wang, Xinran, et al.
Published: (2025)
by: Wang, Xinran, et al.
Published: (2025)
Proactive Agents for Multi-Turn Text-to-Image Generation Under Uncertainty
by: Hahn, Meera, et al.
Published: (2024)
by: Hahn, Meera, et al.
Published: (2024)
Camera Control for Text-to-Image Generation via Learning Viewpoint Tokens
by: Lu, Xinxuan, et al.
Published: (2026)
by: Lu, Xinxuan, et al.
Published: (2026)
MSSPlace: Multi-Sensor Place Recognition with Visual and Text Semantics
by: Melekhin, Alexander, et al.
Published: (2024)
by: Melekhin, Alexander, et al.
Published: (2024)
Talk2Image: A Multi-Agent System for Multi-Turn Image Generation and Editing
by: Ma, Shichao, et al.
Published: (2025)
by: Ma, Shichao, et al.
Published: (2025)
Surgical Text-to-Image Generation
by: Nwoye, Chinedu Innocent, et al.
Published: (2024)
by: Nwoye, Chinedu Innocent, et al.
Published: (2024)
TextBoost: Boosting Text Encoder for Personalized Text-to-Image Generation
by: Park, NaHyeon, et al.
Published: (2024)
by: Park, NaHyeon, et al.
Published: (2024)
Color Conditional Generation with Sliced Wasserstein Guidance
by: Lobashev, Alexander, et al.
Published: (2025)
by: Lobashev, Alexander, et al.
Published: (2025)
HISTAI: An Open-Source, Large-Scale Whole Slide Image Dataset for Computational Pathology
by: Nechaev, Dmitry, et al.
Published: (2025)
by: Nechaev, Dmitry, et al.
Published: (2025)
Not Just Pretty Pictures: Toward Interventional Data Augmentation Using Text-to-Image Generators
by: Yuan, Jianhao, et al.
Published: (2022)
by: Yuan, Jianhao, et al.
Published: (2022)
Generating an Image From 1,000 Words: Enhancing Text-to-Image With Structured Captions
by: Gutflaish, Eyal, et al.
Published: (2025)
by: Gutflaish, Eyal, et al.
Published: (2025)
ReNO: Enhancing One-step Text-to-Image Models through Reward-based Noise Optimization
by: Eyring, Luca, et al.
Published: (2024)
by: Eyring, Luca, et al.
Published: (2024)
Text4Seg: Reimagining Image Segmentation as Text Generation
by: Lan, Mengcheng, et al.
Published: (2024)
by: Lan, Mengcheng, et al.
Published: (2024)
Prompt Refinement with Image Pivot for Text-to-Image Generation
by: Zhan, Jingtao, et al.
Published: (2024)
by: Zhan, Jingtao, et al.
Published: (2024)
A Review on Generative AI For Text-To-Image and Image-To-Image Generation and Implications To Scientific Images
by: Sordo, Zineb, et al.
Published: (2025)
by: Sordo, Zineb, et al.
Published: (2025)
Approach to Designing CV Systems for Medical Applications: Data, Architecture and AI
by: Ryabtsev, Dmitry, et al.
Published: (2025)
by: Ryabtsev, Dmitry, et al.
Published: (2025)
Generating Intermediate Representations for Compositional Text-To-Image Generation
by: Galun, Ran, et al.
Published: (2024)
by: Galun, Ran, et al.
Published: (2024)
Generating Multimodal Images with GAN: Integrating Text, Image, and Style
by: Tan, Chaoyi, et al.
Published: (2025)
by: Tan, Chaoyi, et al.
Published: (2025)
Similar Items
-
Does Diffusion Beat GAN in Image Super Resolution?
by: Kuznedelev, Denis, et al.
Published: (2024) -
YaART: Yet Another ART Rendering Technology
by: Kastryulin, Sergey, et al.
Published: (2024) -
Revisiting Autoregressive Models for Generative Image Classification
by: Sudakov, Ilia, et al.
Published: (2026) -
QUASAR: QUality and Aesthetics Scoring with Advanced Representations
by: Kastryulin, Sergey, et al.
Published: (2024) -
Invertible Consistency Distillation for Text-Guided Image Editing in Around 7 Steps
by: Starodubcev, Nikita, et al.
Published: (2024)