Text-to-Image Representativity Fairness Evaluation Framework
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yamani, Asma, Baslyman, Malak |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Establishing Heuristics for Improving the Usability of GUI Machine Learning Tools for Novice Users
par: Yamani, Asma, et autres
Publié: (2024)
par: Yamani, Asma, et autres
Publié: (2024)
Towards Geographic Inclusion in the Evaluation of Text-to-Image Models
par: Hall, Melissa, et autres
Publié: (2024)
par: Hall, Melissa, et autres
Publié: (2024)
Semantic Draw Engineering for Text-to-Image Creation
par: Li, Yang, et autres
Publié: (2023)
par: Li, Yang, et autres
Publié: (2023)
Bridging Text and Image for Artist Style Transfer via Contrastive Learning
par: Liu, Zhi-Song, et autres
Publié: (2024)
par: Liu, Zhi-Song, et autres
Publié: (2024)
POET: Supporting Prompting Creativity and Personalization with Automated Expansion of Text-to-Image Generation
par: Han, Evans Xu, et autres
Publié: (2025)
par: Han, Evans Xu, et autres
Publié: (2025)
SketchFlex: Facilitating Spatial-Semantic Coherence in Text-to-Image Generation with Region-Based Sketches
par: Lin, Haichuan, et autres
Publié: (2025)
par: Lin, Haichuan, et autres
Publié: (2025)
DIG In: Evaluating Disparities in Image Generations with Indicators for Geographic Diversity
par: Hall, Melissa, et autres
Publié: (2023)
par: Hall, Melissa, et autres
Publié: (2023)
EIT-1M: One Million EEG-Image-Text Pairs for Human Visual-textual Recognition and More
par: Zheng, Xu, et autres
Publié: (2024)
par: Zheng, Xu, et autres
Publié: (2024)
"It's trained by non-disabled people": Evaluating How Image Quality Affects Product Captioning with Vision-Language Models
par: Garg, Kapil, et autres
Publié: (2025)
par: Garg, Kapil, et autres
Publié: (2025)
GLIMPSE : Real-Time Text Recognition and Contextual Understanding for VQA in Wearables
par: Ramachandran, Akhil, et autres
Publié: (2026)
par: Ramachandran, Akhil, et autres
Publié: (2026)
Using Text-to-Image Generation for Architectural Design Ideation
par: Paananen, Ville, et autres
Publié: (2023)
par: Paananen, Ville, et autres
Publié: (2023)
Alt4Blind: A User Interface to Simplify Charts Alt-Text Creation
par: Moured, Omar, et autres
Publié: (2024)
par: Moured, Omar, et autres
Publié: (2024)
QuizRank: Picking Images by Quizzing VLMs
par: Ji, Tenghao, et autres
Publié: (2025)
par: Ji, Tenghao, et autres
Publié: (2025)
SCHEMA for Gemini 3 Pro Image: A Structured Methodology for Controlled AI Image Generation on Google's Native Multimodal Model
par: Cazzaniga, Luca
Publié: (2026)
par: Cazzaniga, Luca
Publié: (2026)
VisionCAD: An Integration-Free Radiology Copilot Framework
par: Li, Jiaming, et autres
Publié: (2025)
par: Li, Jiaming, et autres
Publié: (2025)
Design and Evaluation of Camera-Centric Mobile Crowdsourcing Applications
par: Stylianou, Abby, et autres
Publié: (2024)
par: Stylianou, Abby, et autres
Publié: (2024)
Real-Time Cellist Postural Evaluation With On-Device Computer Vision
par: Wang, Paolo, et autres
Publié: (2026)
par: Wang, Paolo, et autres
Publié: (2026)
Extended Reality for Mental Health Evaluation -A Scoping Review
par: Olatunji, Omisore, et autres
Publié: (2022)
par: Olatunji, Omisore, et autres
Publié: (2022)
VIBE: Annotation-Free Video-to-Text Information Bottleneck Evaluation for TL;DR
par: Chen, Shenghui, et autres
Publié: (2025)
par: Chen, Shenghui, et autres
Publié: (2025)
Steering Generative Models for Accessibility: EasyRead Image Generation
par: Dickenmann, Nicolas, et autres
Publié: (2026)
par: Dickenmann, Nicolas, et autres
Publié: (2026)
A CNN Based Framework for Unistroke Numeral Recognition in Air-Writing
par: Roy, Prasun, et autres
Publié: (2023)
par: Roy, Prasun, et autres
Publié: (2023)
Investigating Disability Representations in Text-to-Image Models
par: Tian, Yang, et autres
Publié: (2026)
par: Tian, Yang, et autres
Publié: (2026)
ImageTalk: Designing a Multimodal AAC Text Generation System Driven by Image Recognition and Natural Language Generation
par: Yang, Boyin, et autres
Publié: (2025)
par: Yang, Boyin, et autres
Publié: (2025)
A Multimodal Dataset of Student Oral Presentations with Sensors and Evaluation Data
par: Becerra, Alvaro, et autres
Publié: (2026)
par: Becerra, Alvaro, et autres
Publié: (2026)
Development of a Mobile Application for at-Home Analysis of Retinal Fundus Images
par: Reid, Mattea, et autres
Publié: (2025)
par: Reid, Mattea, et autres
Publié: (2025)
MetaRanker: Human-in-the-loop Active Ranking for Metalens Image Quality
par: Park, Yujin, et autres
Publié: (2026)
par: Park, Yujin, et autres
Publié: (2026)
A Deep Learning Framework for Visual Attention Prediction and Analysis of News Interfaces
par: Kenely, Matthew, et autres
Publié: (2025)
par: Kenely, Matthew, et autres
Publié: (2025)
Night Eyes: A Reproducible Framework for Constellation-Based Corneal Reflection Matching
par: Maquiling, Virmarie, et autres
Publié: (2026)
par: Maquiling, Virmarie, et autres
Publié: (2026)
Shifts in Doctors' Eye Movements Between Real and AI-Generated Medical Images
par: Wong, David C, et autres
Publié: (2025)
par: Wong, David C, et autres
Publié: (2025)
Visual Affect Analysis: Predicting Emotions of Image Viewers with Vision-Language Models
par: Nowicki, Filip, et autres
Publié: (2026)
par: Nowicki, Filip, et autres
Publié: (2026)
mEBAL2 Database and Benchmark: Image-based Multispectral Eyeblink Detection
par: Daza, Roberto, et autres
Publié: (2023)
par: Daza, Roberto, et autres
Publié: (2023)
ProTAL: A Drag-and-Link Video Programming Framework for Temporal Action Localization
par: He, Yuchen, et autres
Publié: (2025)
par: He, Yuchen, et autres
Publié: (2025)
A Survey of Body and Face Motion: Datasets, Performance Evaluation Metrics and Generative Techniques
par: Sookha, Lownish Rai, et autres
Publié: (2025)
par: Sookha, Lownish Rai, et autres
Publié: (2025)
The Truth, the Whole Truth, and Nothing but the Truth: Automatic Visualization Evaluation from Reconstruction Quality
par: Bujack, Roxana, et autres
Publié: (2026)
par: Bujack, Roxana, et autres
Publié: (2026)
DiffGaze: A Diffusion Model for Continuous Gaze Sequence Generation on 360° Images
par: Jiao, Chuhan, et autres
Publié: (2024)
par: Jiao, Chuhan, et autres
Publié: (2024)
SwipeGANSpace: Swipe-to-Compare Image Generation via Efficient Latent Space Exploration
par: Nakashima, Yuto, et autres
Publié: (2024)
par: Nakashima, Yuto, et autres
Publié: (2024)
PromptArtisan: Multi-instruction Image Editing in Single Pass with Complete Attention Control
par: Swami, Kunal, et autres
Publié: (2025)
par: Swami, Kunal, et autres
Publié: (2025)
Foundation Models for Zero-Shot Segmentation of Scientific Images without AI-Ready Data
par: Mukherjee, Shubhabrata, et autres
Publié: (2025)
par: Mukherjee, Shubhabrata, et autres
Publié: (2025)
Clinically Aware Synthetic Image Generation for Concept Coverage in Chest X-ray Models
par: Rafferty, Amy, et autres
Publié: (2026)
par: Rafferty, Amy, et autres
Publié: (2026)
ChildCI Framework: Analysis of Motor and Cognitive Development in Children-Computer Interaction for Age Detection
par: Ruiz-Garcia, Juan Carlos, et autres
Publié: (2022)
par: Ruiz-Garcia, Juan Carlos, et autres
Publié: (2022)
Documents similaires
-
Establishing Heuristics for Improving the Usability of GUI Machine Learning Tools for Novice Users
par: Yamani, Asma, et autres
Publié: (2024) -
Towards Geographic Inclusion in the Evaluation of Text-to-Image Models
par: Hall, Melissa, et autres
Publié: (2024) -
Semantic Draw Engineering for Text-to-Image Creation
par: Li, Yang, et autres
Publié: (2023) -
Bridging Text and Image for Artist Style Transfer via Contrastive Learning
par: Liu, Zhi-Song, et autres
Publié: (2024) -
POET: Supporting Prompting Creativity and Personalization with Automated Expansion of Text-to-Image Generation
par: Han, Evans Xu, et autres
Publié: (2025)