ConceptBed: Evaluating Concept Learning Abilities of Text-to-Image Diffusion Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Patel, Maitreya, Gokhale, Tejas, Baral, Chitta, Yang, Yezhou |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
$λ$-ECLIPSE: Multi-Concept Personalized Text-to-Image Diffusion Models by Leveraging CLIP Latent Space
par: Patel, Maitreya, et autres
Publié: (2024)
par: Patel, Maitreya, et autres
Publié: (2024)
TripletCLIP: Improving Compositional Reasoning of CLIP via Synthetic Vision-Language Negatives
par: Patel, Maitreya, et autres
Publié: (2024)
par: Patel, Maitreya, et autres
Publié: (2024)
VOILA: Evaluation of MLLMs For Perceptual Understanding and Analogical Reasoning
par: Yilmaz, Nilay, et autres
Publié: (2025)
par: Yilmaz, Nilay, et autres
Publié: (2025)
EraseFlow: Learning Concept Erasure Policies via GFlowNet-Driven Alignment
par: Kusumba, Abhiram, et autres
Publié: (2025)
par: Kusumba, Abhiram, et autres
Publié: (2025)
Help Me Identify: Is an LLM+VQA System All We Need to Identify Visual Concepts?
par: Sampat, Shailaja Keyur, et autres
Publié: (2024)
par: Sampat, Shailaja Keyur, et autres
Publié: (2024)
AcT2I: Evaluating and Improving Action Depiction in Text-to-Image Models
par: Malaviya, Vatsal, et autres
Publié: (2025)
par: Malaviya, Vatsal, et autres
Publié: (2025)
TextInVision: Text and Prompt Complexity Driven Visual Text Generation Benchmark
par: Fallah, Forouzan, et autres
Publié: (2025)
par: Fallah, Forouzan, et autres
Publié: (2025)
Precision or Recall? An Analysis of Image Captions for Training Text-to-Image Generation Model
par: Cheng, Sheng, et autres
Publié: (2024)
par: Cheng, Sheng, et autres
Publié: (2024)
On the Robustness of Language Guidance for Low-Level Vision Tasks: Findings from Depth Estimation
par: Chatterjee, Agneet, et autres
Publié: (2024)
par: Chatterjee, Agneet, et autres
Publié: (2024)
RefEdit: A Benchmark and Method for Improving Instruction-based Image Editing Model on Referring Expressions
par: Pathiraja, Bimsara, et autres
Publié: (2025)
par: Pathiraja, Bimsara, et autres
Publié: (2025)
ActionCOMET: A Zero-shot Approach to Learn Image-specific Commonsense Concepts about Actions
par: Sampat, Shailaja Keyur, et autres
Publié: (2024)
par: Sampat, Shailaja Keyur, et autres
Publié: (2024)
REVISION: Rendering Tools Enable Spatial Fidelity in Vision-Language Models
par: Chatterjee, Agneet, et autres
Publié: (2024)
par: Chatterjee, Agneet, et autres
Publié: (2024)
Lost in Translation? Translation Errors and Challenges for Fair Assessment of Text-to-Image Models on Multilingual Concepts
par: Saxon, Michael, et autres
Publié: (2024)
par: Saxon, Michael, et autres
Publié: (2024)
Grounding Stylistic Domain Generalization with Quantitative Domain Shift Measures and Synthetic Scene Images
par: Luo, Yiran, et autres
Publié: (2024)
par: Luo, Yiran, et autres
Publié: (2024)
Side Effects of Erasing Concepts from Diffusion Models
par: Saha, Shaswati, et autres
Publié: (2025)
par: Saha, Shaswati, et autres
Publié: (2025)
Harnessing Synthetic Preference Data for Enhancing Temporal Understanding of Video-LLMs
par: Vani, Sameep, et autres
Publié: (2025)
par: Vani, Sameep, et autres
Publié: (2025)
Investigating VLM Hallucination from a Cognitive Psychology Perspective: A First Step Toward Interpretation with Intriguing Observations
par: Liu, Xiangrui, et autres
Publié: (2025)
par: Liu, Xiangrui, et autres
Publié: (2025)
WOUAF: Weight Modulation for User Attribution and Fingerprinting in Text-to-Image Diffusion Models
par: Kim, Changhoon, et autres
Publié: (2023)
par: Kim, Changhoon, et autres
Publié: (2023)
Chimera: Compositional Image Generation using Part-based Concepting
par: Singh, Shivam, et autres
Publié: (2025)
par: Singh, Shivam, et autres
Publié: (2025)
Steering Rectified Flow Models in the Vector Field for Controlled Image Generation
par: Patel, Maitreya, et autres
Publié: (2024)
par: Patel, Maitreya, et autres
Publié: (2024)
Getting it Right: Improving Spatial Consistency in Text-to-Image Models
par: Chatterjee, Agneet, et autres
Publié: (2024)
par: Chatterjee, Agneet, et autres
Publié: (2024)
VibeToken: Scaling 1D Image Tokenizers and Autoregressive Models for Dynamic Resolution Generations
par: Patel, Maitreya, et autres
Publié: (2026)
par: Patel, Maitreya, et autres
Publié: (2026)
Lego: Learning to Disentangle and Invert Personalized Concepts Beyond Object Appearance in Text-to-Image Diffusion Models
par: Motamed, Saman, et autres
Publié: (2023)
par: Motamed, Saman, et autres
Publié: (2023)
R.A.C.E.: Robust Adversarial Concept Erasure for Secure Text-to-Image Diffusion Model
par: Kim, Changhoon, et autres
Publié: (2024)
par: Kim, Changhoon, et autres
Publié: (2024)
CRCE: Coreference-Retention Concept Erasure in Text-to-Image Diffusion Models
par: Xue, Yuyang, et autres
Publié: (2025)
par: Xue, Yuyang, et autres
Publié: (2025)
Scaling Concept With Text-Guided Diffusion Models
par: Huang, Chao, et autres
Publié: (2024)
par: Huang, Chao, et autres
Publié: (2024)
VL-GLUE: A Suite of Fundamental yet Challenging Visuo-Linguistic Reasoning Tasks
par: Sampat, Shailaja Keyur, et autres
Publié: (2024)
par: Sampat, Shailaja Keyur, et autres
Publié: (2024)
MentalBlackboard: Evaluating Spatial Visualization via Mathematical Transformations
par: Yilmaz, Nilay, et autres
Publié: (2026)
par: Yilmaz, Nilay, et autres
Publié: (2026)
Erasing with Precision: Evaluating Specific Concept Erasure from Text-to-Image Generative Models
par: Fuchi, Masane, et autres
Publié: (2025)
par: Fuchi, Masane, et autres
Publié: (2025)
GETReason: Enhancing Image Context Extraction through Hierarchical Multi-Agent Reasoning
par: Siingh, Shikhhar, et autres
Publié: (2025)
par: Siingh, Shikhhar, et autres
Publié: (2025)
ColorConceptBench: A Benchmark for Probabilistic Color-Concept Understanding in Text-to-Image Models
par: Ruan, Chenxi, et autres
Publié: (2026)
par: Ruan, Chenxi, et autres
Publié: (2026)
CoMat: Aligning Text-to-Image Diffusion Model with Image-to-Text Concept Matching
par: Jiang, Dongzhi, et autres
Publié: (2024)
par: Jiang, Dongzhi, et autres
Publié: (2024)
Dual Caption Preference Optimization for Diffusion Models
par: Saeidi, Amir, et autres
Publié: (2025)
par: Saeidi, Amir, et autres
Publié: (2025)
Don't Blame the Annotator: Bias Already Starts in the Annotation Instructions
par: Parmar, Mihir, et autres
Publié: (2022)
par: Parmar, Mihir, et autres
Publié: (2022)
Improving Shift Invariance in Convolutional Neural Networks with Translation Invariant Polyphase Sampling
par: Saha, Sourajit, et autres
Publié: (2024)
par: Saha, Sourajit, et autres
Publié: (2024)
TROPE: TRaining-Free Object-Part Enhancement for Seamlessly Improving Fine-Grained Zero-Shot Image Captioning
par: Feinglass, Joshua, et autres
Publié: (2024)
par: Feinglass, Joshua, et autres
Publié: (2024)
DraCo: Draft as CoT for Text-to-Image Preview and Rare Concept Generation
par: Jiang, Dongzhi, et autres
Publié: (2025)
par: Jiang, Dongzhi, et autres
Publié: (2025)
Tables as Texts or Images: Evaluating the Table Reasoning Ability of LLMs and MLLMs
par: Deng, Naihao, et autres
Publié: (2024)
par: Deng, Naihao, et autres
Publié: (2024)
Meta-Unlearning on Diffusion Models: Preventing Relearning Unlearned Concepts
par: Gao, Hongcheng, et autres
Publié: (2024)
par: Gao, Hongcheng, et autres
Publié: (2024)
Receler: Reliable Concept Erasing of Text-to-Image Diffusion Models via Lightweight Erasers
par: Huang, Chi-Pin, et autres
Publié: (2023)
par: Huang, Chi-Pin, et autres
Publié: (2023)
Documents similaires
-
$λ$-ECLIPSE: Multi-Concept Personalized Text-to-Image Diffusion Models by Leveraging CLIP Latent Space
par: Patel, Maitreya, et autres
Publié: (2024) -
TripletCLIP: Improving Compositional Reasoning of CLIP via Synthetic Vision-Language Negatives
par: Patel, Maitreya, et autres
Publié: (2024) -
VOILA: Evaluation of MLLMs For Perceptual Understanding and Analogical Reasoning
par: Yilmaz, Nilay, et autres
Publié: (2025) -
EraseFlow: Learning Concept Erasure Policies via GFlowNet-Driven Alignment
par: Kusumba, Abhiram, et autres
Publié: (2025) -
Help Me Identify: Is an LLM+VQA System All We Need to Identify Visual Concepts?
par: Sampat, Shailaja Keyur, et autres
Publié: (2024)