Not Just Pretty Pictures: Toward Interventional Data Augmentation Using Text-to-Image Generators
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yuan, Jianhao, Pinto, Francesco, Davies, Adam, Torr, Philip |
|---|---|
| Format: | Preprint |
| Publié: |
2022
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Hidden in Plain Sight: Evaluating Abstract Shape Recognition in Vision-Language Models
par: Hemmat, Arshia, et autres
Publié: (2024)
par: Hemmat, Arshia, et autres
Publié: (2024)
Beyond Pretty Pictures: Combined Single- and Multi-Image Super-resolution for Sentinel-2 Images
par: Retnanto, Aditya, et autres
Publié: (2025)
par: Retnanto, Aditya, et autres
Publié: (2025)
Self-Discovering Interpretable Diffusion Latent Directions for Responsible Text-to-Image Generation
par: Li, Hang, et autres
Publié: (2023)
par: Li, Hang, et autres
Publié: (2023)
When Pretty Isn't Useful: Investigating Why Modern Text-to-Image Models Fail as Reliable Training Data Generators
par: Adamkiewicz, Krzysztof, et autres
Publié: (2026)
par: Adamkiewicz, Krzysztof, et autres
Publié: (2026)
DreamPolisher: Towards High-Quality Text-to-3D Generation via Geometric Diffusion
par: Lin, Yuanze, et autres
Publié: (2024)
par: Lin, Yuanze, et autres
Publié: (2024)
LikePhys: Evaluating Intuitive Physics Understanding in Video Diffusion Models via Likelihood Preference
par: Yuan, Jianhao, et autres
Publié: (2025)
par: Yuan, Jianhao, et autres
Publié: (2025)
CogBlender: Towards Continuous Cognitive Intervention in Text-to-Image Generation
par: Dang, Shengqi, et autres
Publié: (2026)
par: Dang, Shengqi, et autres
Publié: (2026)
As Firm As Their Foundations: Can open-sourced foundation models be used to create adversarial examples for downstream tasks?
par: Hu, Anjun, et autres
Publié: (2024)
par: Hu, Anjun, et autres
Publié: (2024)
ImageRAGTurbo: Towards One-step Text-to-Image Generation with Retrieval-Augmented Diffusion Models
par: Qiu, Peijie, et autres
Publié: (2026)
par: Qiu, Peijie, et autres
Publié: (2026)
Which Model Generated This Image? A Model-Agnostic Approach for Origin Attribution
par: Liu, Fengyuan, et autres
Publié: (2024)
par: Liu, Fengyuan, et autres
Publié: (2024)
Semantic Score Distillation Sampling for Compositional Text-to-3D Generation
par: Yang, Ling, et autres
Publié: (2024)
par: Yang, Ling, et autres
Publié: (2024)
Not Just Text: Uncovering Vision Modality Typographic Threats in Image Generation Models
par: Cheng, Hao, et autres
Publié: (2024)
par: Cheng, Hao, et autres
Publié: (2024)
Specify and Edit: Overcoming Ambiguity in Text-Based Image Editing
par: Iakovleva, Ekaterina, et autres
Publié: (2024)
par: Iakovleva, Ekaterina, et autres
Publié: (2024)
Towards Reliable Identification of Diffusion-based Image Manipulations
par: Costanzino, Alex, et autres
Publié: (2025)
par: Costanzino, Alex, et autres
Publié: (2025)
Not Just Streaks: Towards Ground Truth for Single Image Deraining
par: Ba, Yunhao, et autres
Publié: (2022)
par: Ba, Yunhao, et autres
Publié: (2022)
Articulate3D: Zero-Shot Text-Driven 3D Object Posing
par: Deb, Oishi, et autres
Publié: (2025)
par: Deb, Oishi, et autres
Publié: (2025)
An Image Is Worth 1000 Lies: Adversarial Transferability across Prompts on Vision-Language Models
par: Luo, Haochen, et autres
Publié: (2024)
par: Luo, Haochen, et autres
Publié: (2024)
kNN-CLIP: Retrieval Enables Training-Free Segmentation on Continually Expanding Large Vocabularies
par: Gui, Zhongrui, et autres
Publié: (2024)
par: Gui, Zhongrui, et autres
Publié: (2024)
A Simple Data Augmentation Strategy for Text-in-Image Scientific VQA
par: Shoer, Belal, et autres
Publié: (2025)
par: Shoer, Belal, et autres
Publié: (2025)
DTVI: Dual-Stage Textual and Visual Intervention for Safe Text-to-Image Generation
par: Tan, Binhong, et autres
Publié: (2026)
par: Tan, Binhong, et autres
Publié: (2026)
VMem: Consistent Interactive Video Scene Generation with Surfel-Indexed View Memory
par: Li, Runjia, et autres
Publié: (2025)
par: Li, Runjia, et autres
Publié: (2025)
The Factuality Tax of Diversity-Intervened Text-to-Image Generation: Benchmark and Fact-Augmented Intervention
par: Wan, Yixin, et autres
Publié: (2024)
par: Wan, Yixin, et autres
Publié: (2024)
Brain-Inspired Multimodal Spiking Neural Network for Image-Text Retrieval
par: Zong, Xintao, et autres
Publié: (2026)
par: Zong, Xintao, et autres
Publié: (2026)
Words Worth a Thousand Pictures: Measuring and Understanding Perceptual Variability in Text-to-Image Generation
par: Tang, Raphael, et autres
Publié: (2024)
par: Tang, Raphael, et autres
Publié: (2024)
An Effective Data Augmentation Method by Asking Questions about Scene Text Images
par: Yao, Xu, et autres
Publié: (2026)
par: Yao, Xu, et autres
Publié: (2026)
AttnDreamBooth: Towards Text-Aligned Personalized Text-to-Image Generation
par: Pang, Lianyu, et autres
Publié: (2024)
par: Pang, Lianyu, et autres
Publié: (2024)
Data Augmentation for Text-based Person Retrieval Using Large Language Models
par: Li, Zheng, et autres
Publié: (2024)
par: Li, Zheng, et autres
Publié: (2024)
Diffusion-based Image Generation for In-distribution Data Augmentation in Surface Defect Detection
par: Capogrosso, Luigi, et autres
Publié: (2024)
par: Capogrosso, Luigi, et autres
Publié: (2024)
Beautiful Images, Toxic Words: Understanding and Addressing Offensive Text in Generated Images
par: Kumar, Aditya, et autres
Publié: (2025)
par: Kumar, Aditya, et autres
Publié: (2025)
Multimodal Large Language Models for Image, Text, and Speech Data Augmentation: A Survey
par: Sapkota, Ranjan, et autres
Publié: (2025)
par: Sapkota, Ranjan, et autres
Publié: (2025)
AlignGuard: Scalable Safety Alignment for Text-to-Image Generation
par: Liu, Runtao, et autres
Publié: (2024)
par: Liu, Runtao, et autres
Publié: (2024)
Revisiting Data Augmentation for Ultrasound Images
par: Tupper, Adam, et autres
Publié: (2025)
par: Tupper, Adam, et autres
Publié: (2025)
You Only Need Half: Boosting Data Augmentation by Using Partial Content
par: Hu, Juntao, et autres
Publié: (2024)
par: Hu, Juntao, et autres
Publié: (2024)
CLIP-Guided Data Augmentation for Night-Time Image Dehazing
par: Ge, Xining, et autres
Publié: (2026)
par: Ge, Xining, et autres
Publié: (2026)
Diffusion-Based Data Augmentation for Medical Image Segmentation
par: Nazir, Maham, et autres
Publié: (2025)
par: Nazir, Maham, et autres
Publié: (2025)
PhyCustom: Towards Realistic Physical Customization in Text-to-Image Generation
par: Wu, Fan, et autres
Publié: (2025)
par: Wu, Fan, et autres
Publié: (2025)
Direct3D: Scalable Image-to-3D Generation via 3D Latent Diffusion Transformer
par: Wu, Shuang, et autres
Publié: (2024)
par: Wu, Shuang, et autres
Publié: (2024)
ImageSet2Text: Describing Sets of Images through Text
par: Riccio, Piera, et autres
Publié: (2025)
par: Riccio, Piera, et autres
Publié: (2025)
Alchemist: Turning Public Text-to-Image Data into Generative Gold
par: Startsev, Valerii, et autres
Publié: (2025)
par: Startsev, Valerii, et autres
Publié: (2025)
Harnessing Caption Detailness for Data-Efficient Text-to-Image Generation
par: Wang, Xinran, et autres
Publié: (2025)
par: Wang, Xinran, et autres
Publié: (2025)
Documents similaires
-
Hidden in Plain Sight: Evaluating Abstract Shape Recognition in Vision-Language Models
par: Hemmat, Arshia, et autres
Publié: (2024) -
Beyond Pretty Pictures: Combined Single- and Multi-Image Super-resolution for Sentinel-2 Images
par: Retnanto, Aditya, et autres
Publié: (2025) -
Self-Discovering Interpretable Diffusion Latent Directions for Responsible Text-to-Image Generation
par: Li, Hang, et autres
Publié: (2023) -
When Pretty Isn't Useful: Investigating Why Modern Text-to-Image Models Fail as Reliable Training Data Generators
par: Adamkiewicz, Krzysztof, et autres
Publié: (2026) -
DreamPolisher: Towards High-Quality Text-to-3D Generation via Geometric Diffusion
par: Lin, Yuanze, et autres
Publié: (2024)