A Systematic Review of Open Datasets Used in Text-to-Image (T2I) Gen AI Model Safety
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Rouf, Rakeen, Bavalatti, Trupti, Ahmed, Osama, Potdar, Dhaval, Jawed, Faraz |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
AiGen-FoodReview: A Multimodal Dataset of Machine-Generated Restaurant Reviews and Images on Social Media
par: Gambetti, Alessandro, et autres
Publié: (2024)
par: Gambetti, Alessandro, et autres
Publié: (2024)
ComfyGen: Prompt-Adaptive Workflows for Text-to-Image Generation
par: Gal, Rinon, et autres
Publié: (2024)
par: Gal, Rinon, et autres
Publié: (2024)
Text-to-Image Cross-Modal Generation: A Systematic Review
par: Żelaszczyk, Maciej, et autres
Publié: (2024)
par: Żelaszczyk, Maciej, et autres
Publié: (2024)
DermaSynth: Rich Synthetic Image-Text Pairs Using Open Access Dermatology Datasets
par: Yilmaz, Abdurrahim, et autres
Publié: (2025)
par: Yilmaz, Abdurrahim, et autres
Publié: (2025)
BIMCV-R: A Landmark Dataset for 3D CT Text-Image Retrieval
par: Chen, Yinda, et autres
Publié: (2024)
par: Chen, Yinda, et autres
Publié: (2024)
R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation
par: Chen, Kaijie, et autres
Publié: (2025)
par: Chen, Kaijie, et autres
Publié: (2025)
A High-Quality Text-Rich Image Instruction Tuning Dataset via Hybrid Instruction Generation
par: Zhou, Shijie, et autres
Publié: (2024)
par: Zhou, Shijie, et autres
Publié: (2024)
ReMI: A Dataset for Reasoning with Multiple Images
par: Kazemi, Mehran, et autres
Publié: (2024)
par: Kazemi, Mehran, et autres
Publié: (2024)
BIOMEDICA: An Open Biomedical Image-Caption Archive, Dataset, and Vision-Language Models Derived from Scientific Literature
par: Lozano, Alejandro, et autres
Publié: (2025)
par: Lozano, Alejandro, et autres
Publié: (2025)
WAON: A Large-Scale Japanese Image-Text Dataset for Cultural Adaptation in Contrastive Vision-Language Models
par: Sugiura, Issa, et autres
Publié: (2025)
par: Sugiura, Issa, et autres
Publié: (2025)
Linguistically Informed Multimodal Fusion for Vietnamese Scene-Text Image Captioning: Dataset, Graph Framework, and Phonological Attention
par: Nguyen, Nhi Ngoc-Yen, et autres
Publié: (2026)
par: Nguyen, Nhi Ngoc-Yen, et autres
Publié: (2026)
Image2Text2Image: A Novel Framework for Label-Free Evaluation of Image-to-Text Generation with Text-to-Image Diffusion Models
par: Huang, Jia-Hong, et autres
Publié: (2024)
par: Huang, Jia-Hong, et autres
Publié: (2024)
Can Large Vision-Language Models Detect Images Copyright Infringement from GenAI?
par: Xu, Qipan, et autres
Publié: (2025)
par: Xu, Qipan, et autres
Publié: (2025)
FLUX-Reason-6M & PRISM-Bench: A Million-Scale Text-to-Image Reasoning Dataset and Comprehensive Benchmark
par: Fang, Rongyao, et autres
Publié: (2025)
par: Fang, Rongyao, et autres
Publié: (2025)
SafeGen: Mitigating Sexually Explicit Content Generation in Text-to-Image Models
par: Li, Xinfeng, et autres
Publié: (2024)
par: Li, Xinfeng, et autres
Publié: (2024)
GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation
par: Li, Baiqi, et autres
Publié: (2024)
par: Li, Baiqi, et autres
Publié: (2024)
Ethical-Lens: Curbing Malicious Usages of Open-Source Text-to-Image Models
par: Cai, Yuzhu, et autres
Publié: (2024)
par: Cai, Yuzhu, et autres
Publié: (2024)
ReasonGen-R1: CoT for Autoregressive Image generation models through SFT and RL
par: Zhang, Yu, et autres
Publié: (2025)
par: Zhang, Yu, et autres
Publié: (2025)
Not All Similarities Are Created Equal: Leveraging Data-Driven Biases to Inform GenAI Copyright Disputes
par: Hacohen, Uri, et autres
Publié: (2024)
par: Hacohen, Uri, et autres
Publié: (2024)
TextTIGER: Text-based Intelligent Generation with Entity Prompt Refinement for Text-to-Image Generation
par: Ozaki, Shintaro, et autres
Publié: (2025)
par: Ozaki, Shintaro, et autres
Publié: (2025)
Chitrakshara: A Large Multilingual Multimodal Dataset for Indian languages
par: Khan, Shaharukh, et autres
Publié: (2026)
par: Khan, Shaharukh, et autres
Publié: (2026)
Optimizing Prompts for Text-to-Image Generation
par: Hao, Yaru, et autres
Publié: (2022)
par: Hao, Yaru, et autres
Publié: (2022)
ELITE: Enhanced Language-Image Toxicity Evaluation for Safety
par: Lee, Wonjun, et autres
Publié: (2025)
par: Lee, Wonjun, et autres
Publié: (2025)
ANOLE: An Open, Autoregressive, Native Large Multimodal Models for Interleaved Image-Text Generation
par: Chern, Ethan, et autres
Publié: (2024)
par: Chern, Ethan, et autres
Publié: (2024)
Unconstrained Open Vocabulary Image Classification: Zero-Shot Transfer from Text to Image via CLIP Inversion
par: Allgeuer, Philipp, et autres
Publié: (2024)
par: Allgeuer, Philipp, et autres
Publié: (2024)
Fast Prompt Alignment for Text-to-Image Generation
par: Mrini, Khalil, et autres
Publié: (2024)
par: Mrini, Khalil, et autres
Publié: (2024)
Pico-Banana-400K: A Large-Scale Dataset for Text-Guided Image Editing
par: Qian, Yusu, et autres
Publié: (2025)
par: Qian, Yusu, et autres
Publié: (2025)
SafeGen-Bench: Benchmarking Safety in Image-Conditioned Text-to-Video Generation
par: Ma, Yingzi, et autres
Publié: (2026)
par: Ma, Yingzi, et autres
Publié: (2026)
xGen-MM (BLIP-3): A Family of Open Large Multimodal Models
par: Xue, Le, et autres
Publié: (2024)
par: Xue, Le, et autres
Publié: (2024)
Improving Automatic Text Recognition with Language Models in the PyLaia Open-Source Library
par: Tarride, Solène, et autres
Publié: (2024)
par: Tarride, Solène, et autres
Publié: (2024)
Precision or Recall? An Analysis of Image Captions for Training Text-to-Image Generation Model
par: Cheng, Sheng, et autres
Publié: (2024)
par: Cheng, Sheng, et autres
Publié: (2024)
Quality-Aware Image-Text Alignment for Opinion-Unaware Image Quality Assessment
par: Agnolucci, Lorenzo, et autres
Publié: (2024)
par: Agnolucci, Lorenzo, et autres
Publié: (2024)
Multimodal Human-AI Synergy for Medical Imaging Quality Control: A Hybrid Intelligence Framework with Adaptive Dataset Curation and Closed-Loop Evaluation
par: Qin, Zhi, et autres
Publié: (2025)
par: Qin, Zhi, et autres
Publié: (2025)
Emergent Visual-Semantic Hierarchies in Image-Text Representations
par: Alper, Morris, et autres
Publié: (2024)
par: Alper, Morris, et autres
Publié: (2024)
Evaluating the Evaluators: Metrics for Compositional Text-to-Image Generation
par: Kasaei, Seyed Amir, et autres
Publié: (2025)
par: Kasaei, Seyed Amir, et autres
Publié: (2025)
Universal Prompt Optimizer for Safe Text-to-Image Generation
par: Wu, Zongyu, et autres
Publié: (2024)
par: Wu, Zongyu, et autres
Publié: (2024)
Constructing Multilingual Visual-Text Datasets Revealing Visual Multilingual Ability of Vision Language Models
par: Atuhurra, Jesse, et autres
Publié: (2024)
par: Atuhurra, Jesse, et autres
Publié: (2024)
DiffChat: Learning to Chat with Text-to-Image Synthesis Models for Interactive Image Creation
par: Wang, Jiapeng, et autres
Publié: (2024)
par: Wang, Jiapeng, et autres
Publié: (2024)
Sumotosima: A Framework and Dataset for Classifying and Summarizing Otoscopic Images
par: Khan, Eram Anwarul, et autres
Publié: (2024)
par: Khan, Eram Anwarul, et autres
Publié: (2024)
The Side Effects of Being Smart: Safety Risks in MLLMs' Multi-Image Reasoning
par: Chen, Renmiao, et autres
Publié: (2026)
par: Chen, Renmiao, et autres
Publié: (2026)
Documents similaires
-
AiGen-FoodReview: A Multimodal Dataset of Machine-Generated Restaurant Reviews and Images on Social Media
par: Gambetti, Alessandro, et autres
Publié: (2024) -
ComfyGen: Prompt-Adaptive Workflows for Text-to-Image Generation
par: Gal, Rinon, et autres
Publié: (2024) -
Text-to-Image Cross-Modal Generation: A Systematic Review
par: Żelaszczyk, Maciej, et autres
Publié: (2024) -
DermaSynth: Rich Synthetic Image-Text Pairs Using Open Access Dermatology Datasets
par: Yilmaz, Abdurrahim, et autres
Publié: (2025) -
BIMCV-R: A Landmark Dataset for 3D CT Text-Image Retrieval
par: Chen, Yinda, et autres
Publié: (2024)