Measuring Diversity in Co-creative Image Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ibarrola, Francisco, Grace, Kazjon |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Generation of Complex 3D Human Motion by Temporal and Spatial Composition of Diffusion Models
par: Mandelli, Lorenzo, et autres
Publié: (2024)
par: Mandelli, Lorenzo, et autres
Publié: (2024)
High-Entropy Tokens as Multimodal Failure Points in Vision-Language Models
par: He, Mengqi, et autres
Publié: (2025)
par: He, Mengqi, et autres
Publié: (2025)
MAR-MAER: Metric-Aware and Ambiguity-Adaptive Autoregressive Image Generation
par: Dong, Kai, et autres
Publié: (2026)
par: Dong, Kai, et autres
Publié: (2026)
A Review of Pseudo-Labeling for Computer Vision
par: Kage, Patrick, et autres
Publié: (2024)
par: Kage, Patrick, et autres
Publié: (2024)
Sparse vs Contiguous Adversarial Pixel Perturbations in Multimodal Models: An Empirical Analysis
par: Botocan, Cristian-Alexandru, et autres
Publié: (2024)
par: Botocan, Cristian-Alexandru, et autres
Publié: (2024)
Towards Infusing Auxiliary Knowledge for Distracted Driver Detection
par: Balappanawar, Ishwar B, et autres
Publié: (2024)
par: Balappanawar, Ishwar B, et autres
Publié: (2024)
FUTURE-AI: International consensus guideline for trustworthy and deployable artificial intelligence in healthcare
par: Lekadir, Karim, et autres
Publié: (2023)
par: Lekadir, Karim, et autres
Publié: (2023)
Convolutional Neural Networks Can (Meta-)Learn the Same-Different Relation
par: Gupta, Max, et autres
Publié: (2025)
par: Gupta, Max, et autres
Publié: (2025)
Visual Language Models show widespread visual deficits on neuropsychological tests
par: Tangtartharakul, Gene, et autres
Publié: (2025)
par: Tangtartharakul, Gene, et autres
Publié: (2025)
Measuring proximity to standard planes during fetal brain ultrasound scanning
par: Di Vece, Chiara, et autres
Publié: (2024)
par: Di Vece, Chiara, et autres
Publié: (2024)
Domain Generalized Stereo Matching with Uncertainty-guided Data Augmentation
par: Du, Shuangli, et autres
Publié: (2025)
par: Du, Shuangli, et autres
Publié: (2025)
Generating Image Adversarial Examples by Embedding Digital Watermarks
par: Xiang, Yuexin, et autres
Publié: (2020)
par: Xiang, Yuexin, et autres
Publié: (2020)
Efficient Diffusion Training through Parallelization with Truncated Karhunen-Loève Expansion
par: Ren, Yumeng, et autres
Publié: (2025)
par: Ren, Yumeng, et autres
Publié: (2025)
Beyond Specialization: Assessing the Capabilities of MLLMs in Age and Gender Estimation
par: Kuprashevich, Maksim, et autres
Publié: (2024)
par: Kuprashevich, Maksim, et autres
Publié: (2024)
Fine-Grained Open-Vocabulary Object Detection with Fined-Grained Prompts: Task, Dataset and Benchmark
par: Liu, Ying, et autres
Publié: (2025)
par: Liu, Ying, et autres
Publié: (2025)
EncQA: Benchmarking Vision-Language Models on Visual Encodings for Charts
par: Mukherjee, Kushin, et autres
Publié: (2025)
par: Mukherjee, Kushin, et autres
Publié: (2025)
STRICT: Stress Test of Rendering Images Containing Text
par: Zhang, Tianyu, et autres
Publié: (2025)
par: Zhang, Tianyu, et autres
Publié: (2025)
Context-Aware Full Body Anonymization using Text-to-Image Diffusion Models
par: Zwick, Pascal, et autres
Publié: (2024)
par: Zwick, Pascal, et autres
Publié: (2024)
Mechanistically Interpretable Neural Encoding Reveals Fine-Grained Functional Selectivity in Human Visual Cortex
par: Grosbard, Idan Daniel, et autres
Publié: (2026)
par: Grosbard, Idan Daniel, et autres
Publié: (2026)
Eye-gaze Guided Multi-modal Alignment for Medical Representation Learning
par: Ma, Chong, et autres
Publié: (2024)
par: Ma, Chong, et autres
Publié: (2024)
Synthetic Photography Detection: A Visual Guidance for Identifying Synthetic Images Created by AI
par: Mathys, Melanie, et autres
Publié: (2024)
par: Mathys, Melanie, et autres
Publié: (2024)
Synthetic Image Generation in Cyber Influence Operations: An Emergent Threat?
par: Mathys, Melanie, et autres
Publié: (2024)
par: Mathys, Melanie, et autres
Publié: (2024)
Paging Dr. GPT: Extracting Information from Clinical Notes to Enhance Patient Predictions
par: Anderson, David, et autres
Publié: (2025)
par: Anderson, David, et autres
Publié: (2025)
CoMA: Complementary Masking and Hierarchical Dynamic Multi-Window Self-Attention in a Unified Pre-training Framework
par: Li, Jiaxuan, et autres
Publié: (2025)
par: Li, Jiaxuan, et autres
Publié: (2025)
Vision Transformer-based Model for Severity Quantification of Lung Pneumonia Using Chest X-ray Images
par: Slika, Bouthaina, et autres
Publié: (2023)
par: Slika, Bouthaina, et autres
Publié: (2023)
LightMover: Generative Light Movement with Color and Intensity Controls
par: Zhou, Gengze, et autres
Publié: (2026)
par: Zhou, Gengze, et autres
Publié: (2026)
Statistical Analysis of the Impact of Quaternion Components in Convolutional Neural Networks
par: Altamirano-Gómez, Gerardo, et autres
Publié: (2024)
par: Altamirano-Gómez, Gerardo, et autres
Publié: (2024)
DIsoN: Decentralized Isolation Networks for Out-of-Distribution Detection in Medical Imaging
par: Wagner, Felix, et autres
Publié: (2025)
par: Wagner, Felix, et autres
Publié: (2025)
Exploring Transfer Learning for Deep Learning Polyp Detection in Colonoscopy Images Using YOLOv8
par: Vazquez, Fabian, et autres
Publié: (2025)
par: Vazquez, Fabian, et autres
Publié: (2025)
ACCORD: Closing the Commonsense Measurability Gap
par: Roewer-Després, François, et autres
Publié: (2024)
par: Roewer-Després, François, et autres
Publié: (2024)
Object-centric proto-symbolic behavioural reasoning from pixels
par: van Bergen, Ruben, et autres
Publié: (2024)
par: van Bergen, Ruben, et autres
Publié: (2024)
Efficient Estimation of Regularized Tyler's M-Estimator Using Approximate LOOCV
par: Abou-Moustafa, Karim
Publié: (2025)
par: Abou-Moustafa, Karim
Publié: (2025)
SeNeDiF-OOD: Semantic Nested Dichotomy Fusion for Out-of-Distribution Detection Methodology in Open-World Classification. A Case Study on Monument Style Classification
par: Antequera-Sánchez, Ignacio, et autres
Publié: (2026)
par: Antequera-Sánchez, Ignacio, et autres
Publié: (2026)
Can phones, syllables, and words emerge as side-products of cross-situational audiovisual learning? -- A computational investigation
par: Khorrami, Khazar, et autres
Publié: (2021)
par: Khorrami, Khazar, et autres
Publié: (2021)
Generative inpainting of incomplete Euclidean distance matrices of trajectories generated by a fractional Brownian motion
par: Lobashev, Alexander, et autres
Publié: (2024)
par: Lobashev, Alexander, et autres
Publié: (2024)
CerberusDet: Unified Multi-Dataset Object Detection
par: Tolstykh, Irina, et autres
Publié: (2024)
par: Tolstykh, Irina, et autres
Publié: (2024)
Generative AI for Synthetic Data Generation: Methods, Challenges and the Future
par: Guo, Xu, et autres
Publié: (2024)
par: Guo, Xu, et autres
Publié: (2024)
Sample as You Infer: Predictive Coding With Langevin Dynamics
par: Zahid, Umais, et autres
Publié: (2023)
par: Zahid, Umais, et autres
Publié: (2023)
Diverse LLMs or Diverse Question Interpretations? That is the Ensembling Question
par: Rosales, Rafael, et autres
Publié: (2025)
par: Rosales, Rafael, et autres
Publié: (2025)
Diffusion Lens: Interpreting Text Encoders in Text-to-Image Pipelines
par: Toker, Michael, et autres
Publié: (2024)
par: Toker, Michael, et autres
Publié: (2024)
Documents similaires
-
Generation of Complex 3D Human Motion by Temporal and Spatial Composition of Diffusion Models
par: Mandelli, Lorenzo, et autres
Publié: (2024) -
High-Entropy Tokens as Multimodal Failure Points in Vision-Language Models
par: He, Mengqi, et autres
Publié: (2025) -
MAR-MAER: Metric-Aware and Ambiguity-Adaptive Autoregressive Image Generation
par: Dong, Kai, et autres
Publié: (2026) -
A Review of Pseudo-Labeling for Computer Vision
par: Kage, Patrick, et autres
Publié: (2024) -
Sparse vs Contiguous Adversarial Pixel Perturbations in Multimodal Models: An Empirical Analysis
par: Botocan, Cristian-Alexandru, et autres
Publié: (2024)