Beautiful Images, Toxic Words: Understanding and Addressing Offensive Text in Generated Images
Fuente:
arXiv
Salvato in:
| Autori principali: | Kumar, Aditya, Blanchard, Tom, Dziedzic, Adam, Boenisch, Franziska |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Radioactive Watermarks in Diffusion and Autoregressive Image Generative Models
di: Meintz, Michel, et al.
Pubblicazione: (2025)
di: Meintz, Michel, et al.
Pubblicazione: (2025)
Privacy Attacks on Image AutoRegressive Models
di: Kowalczuk, Antoni, et al.
Pubblicazione: (2025)
di: Kowalczuk, Antoni, et al.
Pubblicazione: (2025)
BitMark: Watermarking Bitwise Autoregressive Image Generative Models
di: Kerner, Louis, et al.
Pubblicazione: (2025)
di: Kerner, Louis, et al.
Pubblicazione: (2025)
SERUM: Simple, Efficient, Robust, and Unifying Marking for Diffusion-based Image Generation
di: Kociszewski, Jan, et al.
Pubblicazione: (2026)
di: Kociszewski, Jan, et al.
Pubblicazione: (2026)
Precise Parameter Localization for Textual Generation in Diffusion Models
di: Staniszewski, Łukasz, et al.
Pubblicazione: (2025)
di: Staniszewski, Łukasz, et al.
Pubblicazione: (2025)
Localizing Memorization in SSL Vision Encoders
di: Wang, Wenhao, et al.
Pubblicazione: (2024)
di: Wang, Wenhao, et al.
Pubblicazione: (2024)
Finding DoRI: Discovery of Retained Images in Diffusion Models
di: Kowalczuk, Antoni, et al.
Pubblicazione: (2025)
di: Kowalczuk, Antoni, et al.
Pubblicazione: (2025)
Implementing Adaptations for Vision AutoRegressive Model
di: Shaikh, Kaif, et al.
Pubblicazione: (2025)
di: Shaikh, Kaif, et al.
Pubblicazione: (2025)
Conditioned Activation Transport for T2I Safety Steering
di: Chrabąszcz, Maciej, et al.
Pubblicazione: (2026)
di: Chrabąszcz, Maciej, et al.
Pubblicazione: (2026)
Captured by Captions: On Memorization and its Mitigation in CLIP Models
di: Wang, Wenhao, et al.
Pubblicazione: (2025)
di: Wang, Wenhao, et al.
Pubblicazione: (2025)
Demystifying Foreground-Background Memorization in Diffusion Models
di: Di, Jimmy Z., et al.
Pubblicazione: (2025)
di: Di, Jimmy Z., et al.
Pubblicazione: (2025)
Learning Continuous 3D Words for Text-to-Image Generation
di: Cheng, Ta-Ying, et al.
Pubblicazione: (2024)
di: Cheng, Ta-Ying, et al.
Pubblicazione: (2024)
Words Worth a Thousand Pictures: Measuring and Understanding Perceptual Variability in Text-to-Image Generation
di: Tang, Raphael, et al.
Pubblicazione: (2024)
di: Tang, Raphael, et al.
Pubblicazione: (2024)
Generating an Image From 1,000 Words: Enhancing Text-to-Image With Structured Captions
di: Gutflaish, Eyal, et al.
Pubblicazione: (2025)
di: Gutflaish, Eyal, et al.
Pubblicazione: (2025)
Addressing Image Hallucination in Text-to-Image Generation through Factual Image Retrieval
di: Lim, Youngsun, et al.
Pubblicazione: (2024)
di: Lim, Youngsun, et al.
Pubblicazione: (2024)
Understanding and Mitigating Toxicity in Image-Text Pretraining Datasets: A Case Study on LLaVA
di: Kanjula, Karthik Reddy, et al.
Pubblicazione: (2025)
di: Kanjula, Karthik Reddy, et al.
Pubblicazione: (2025)
Benchmarking Robust Self-Supervised Learning Across Diverse Downstream Tasks
di: Kowalczuk, Antoni, et al.
Pubblicazione: (2024)
di: Kowalczuk, Antoni, et al.
Pubblicazione: (2024)
Erasing 'Ugly' from the Internet: Propagation of the Beauty Myth in Text-Image Models
di: Dinkar, Tanvi, et al.
Pubblicazione: (2025)
di: Dinkar, Tanvi, et al.
Pubblicazione: (2025)
GradBias: Unveiling Word Influence on Bias in Text-to-Image Generative Models
di: D'Incà, Moreno, et al.
Pubblicazione: (2024)
di: D'Incà, Moreno, et al.
Pubblicazione: (2024)
Localizing and Mitigating Memorization in Image Autoregressive Models
di: Kasliwal, Aditya, et al.
Pubblicazione: (2025)
di: Kasliwal, Aditya, et al.
Pubblicazione: (2025)
PopAlign: Population-Level Alignment for Fair Text-to-Image Generation
di: Li, Shufan, et al.
Pubblicazione: (2024)
di: Li, Shufan, et al.
Pubblicazione: (2024)
Beyond Words: Advancing Long-Text Image Generation via Multimodal Autoregressive Models
di: Wang, Alex Jinpeng, et al.
Pubblicazione: (2025)
di: Wang, Alex Jinpeng, et al.
Pubblicazione: (2025)
Morphological Addressing of Identity Basins in Text-to-Image Diffusion Models
di: Fraser, Andrew
Pubblicazione: (2026)
di: Fraser, Andrew
Pubblicazione: (2026)
Addressing Text Embedding Leakage in Diffusion-based Image Editing
di: Mun, Sunung, et al.
Pubblicazione: (2024)
di: Mun, Sunung, et al.
Pubblicazione: (2024)
Unifying Contrastive and Generative Objectives for Visual Understanding and Text-to-Image Generation
di: Li, Chao, et al.
Pubblicazione: (2026)
di: Li, Chao, et al.
Pubblicazione: (2026)
An Image Is Worth Ten Thousand Words: Verbose-Text Induction Attacks on VLMs
di: Luo, Zhi, et al.
Pubblicazione: (2025)
di: Luo, Zhi, et al.
Pubblicazione: (2025)
Finding Beautiful and Happy Images for Mental Health and Well-being Applications
di: Xie, Ruitao, et al.
Pubblicazione: (2024)
di: Xie, Ruitao, et al.
Pubblicazione: (2024)
TIBET: Identifying and Evaluating Biases in Text-to-Image Generative Models
di: Chinchure, Aditya, et al.
Pubblicazione: (2023)
di: Chinchure, Aditya, et al.
Pubblicazione: (2023)
RealCustom: Narrowing Real Text Word for Real-Time Open-Domain Text-to-Image Customization
di: Huang, Mengqi, et al.
Pubblicazione: (2024)
di: Huang, Mengqi, et al.
Pubblicazione: (2024)
LLM-grounded Diffusion: Enhancing Prompt Understanding of Text-to-Image Diffusion Models with Large Language Models
di: Lian, Long, et al.
Pubblicazione: (2023)
di: Lian, Long, et al.
Pubblicazione: (2023)
Reading Images Like Texts: Sequential Image Understanding in Vision-Language Models
di: Li, Yueyan, et al.
Pubblicazione: (2025)
di: Li, Yueyan, et al.
Pubblicazione: (2025)
TextCoT: Zoom In for Enhanced Multimodal Text-Rich Image Understanding
di: Luan, Bozhi, et al.
Pubblicazione: (2024)
di: Luan, Bozhi, et al.
Pubblicazione: (2024)
Finetuning-Free Personalization of Text to Image Generation via Hypernetworks
di: Shrestha, Sagar, et al.
Pubblicazione: (2025)
di: Shrestha, Sagar, et al.
Pubblicazione: (2025)
A Review on Generative AI For Text-To-Image and Image-To-Image Generation and Implications To Scientific Images
di: Sordo, Zineb, et al.
Pubblicazione: (2025)
di: Sordo, Zineb, et al.
Pubblicazione: (2025)
Understanding Reward Hacking in Text-to-Image Reinforcement Learning
di: Hong, Yunqi, et al.
Pubblicazione: (2026)
di: Hong, Yunqi, et al.
Pubblicazione: (2026)
Surgical Text-to-Image Generation
di: Nwoye, Chinedu Innocent, et al.
Pubblicazione: (2024)
di: Nwoye, Chinedu Innocent, et al.
Pubblicazione: (2024)
CoMM: A Coherent Interleaved Image-Text Dataset for Multimodal Understanding and Generation
di: Chen, Wei, et al.
Pubblicazione: (2024)
di: Chen, Wei, et al.
Pubblicazione: (2024)
Prompt Refinement with Image Pivot for Text-to-Image Generation
di: Zhan, Jingtao, et al.
Pubblicazione: (2024)
di: Zhan, Jingtao, et al.
Pubblicazione: (2024)
ImageRAGTurbo: Towards One-step Text-to-Image Generation with Retrieval-Augmented Diffusion Models
di: Qiu, Peijie, et al.
Pubblicazione: (2026)
di: Qiu, Peijie, et al.
Pubblicazione: (2026)
ImageDoctor: Diagnosing Text-to-Image Generation via Grounded Image Reasoning
di: Guo, Yuxiang, et al.
Pubblicazione: (2025)
di: Guo, Yuxiang, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Radioactive Watermarks in Diffusion and Autoregressive Image Generative Models
di: Meintz, Michel, et al.
Pubblicazione: (2025) -
Privacy Attacks on Image AutoRegressive Models
di: Kowalczuk, Antoni, et al.
Pubblicazione: (2025) -
BitMark: Watermarking Bitwise Autoregressive Image Generative Models
di: Kerner, Louis, et al.
Pubblicazione: (2025) -
SERUM: Simple, Efficient, Robust, and Unifying Marking for Diffusion-based Image Generation
di: Kociszewski, Jan, et al.
Pubblicazione: (2026) -
Precise Parameter Localization for Textual Generation in Diffusion Models
di: Staniszewski, Łukasz, et al.
Pubblicazione: (2025)