Visual Concept-driven Image Generation with Text-to-Image Diffusion Model
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Rahman, Tanzila, Mahajan, Shweta, Lee, Hsin-Ying, Ren, Jian, Tulyakov, Sergey, Sigal, Leonid |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
All in One: A Unified Synthetic Data Pipeline for Multimodal Video Understanding
par: Rahman, Tanzila, et autres
Publié: (2026)
par: Rahman, Tanzila, et autres
Publié: (2026)
Scalable Ranked Preference Optimization for Text-to-Image Generation
par: Karthik, Shyamgopal, et autres
Publié: (2024)
par: Karthik, Shyamgopal, et autres
Publié: (2024)
MMFactory: A Universal Solution Search Engine for Vision-Language Tasks
par: Fan, Wan-Cyuan, et autres
Publié: (2024)
par: Fan, Wan-Cyuan, et autres
Publié: (2024)
Joint Generative Modeling of Grounded Scene Graphs and Images via Diffusion Models
par: Xu, Bicheng, et autres
Publié: (2024)
par: Xu, Bicheng, et autres
Publié: (2024)
To Sink or Not to Sink: Visual Information Pathways in Large Vision-Language Models
par: Luo, Jiayun, et autres
Publié: (2025)
par: Luo, Jiayun, et autres
Publié: (2025)
On the Fairness, Diversity and Reliability of Text-to-Image Generative Models
par: Vice, Jordan, et autres
Publié: (2024)
par: Vice, Jordan, et autres
Publié: (2024)
UpFusion: Novel View Diffusion from Unposed Sparse View Observations
par: Kani, Bharath Raj Nagoor, et autres
Publié: (2023)
par: Kani, Bharath Raj Nagoor, et autres
Publié: (2023)
TIBET: Identifying and Evaluating Biases in Text-to-Image Generative Models
par: Chinchure, Aditya, et autres
Publié: (2023)
par: Chinchure, Aditya, et autres
Publié: (2023)
Prompt2Perturb (P2P): Text-Guided Diffusion-Based Adversarial Attacks on Breast Ultrasound Images
par: Medghalchi, Yasamin, et autres
Publié: (2024)
par: Medghalchi, Yasamin, et autres
Publié: (2024)
Free Lunch Alignment of Text-to-Image Diffusion Models without Preference Image Pairs
par: Xian, Jia Jun Cheng, et autres
Publié: (2025)
par: Xian, Jia Jun Cheng, et autres
Publié: (2025)
Blending Concepts with Text-to-Image Diffusion Models
par: Olearo, Lorenzo, et autres
Publié: (2025)
par: Olearo, Lorenzo, et autres
Publié: (2025)
Diffusion Priors for Dynamic View Synthesis from Monocular Videos
par: Wang, Chaoyang, et autres
Publié: (2024)
par: Wang, Chaoyang, et autres
Publié: (2024)
4Real: Towards Photorealistic 4D Scene Generation via Video Diffusion Models
par: Yu, Heng, et autres
Publié: (2024)
par: Yu, Heng, et autres
Publié: (2024)
Hierarchical Patch Diffusion Models for High-Resolution Video Generation
par: Skorokhodov, Ivan, et autres
Publié: (2024)
par: Skorokhodov, Ivan, et autres
Publié: (2024)
Isolated Diffusion: Optimizing Multi-Concept Text-to-Image Generation Training-Freely with Isolated Diffusion Guidance
par: Zhu, Jingyuan, et autres
Publié: (2024)
par: Zhu, Jingyuan, et autres
Publié: (2024)
AToM: Amortized Text-to-Mesh using 2D Diffusion
par: Qian, Guocheng, et autres
Publié: (2024)
par: Qian, Guocheng, et autres
Publié: (2024)
Reliable and Efficient Concept Erasure of Text-to-Image Diffusion Models
par: Gong, Chao, et autres
Publié: (2024)
par: Gong, Chao, et autres
Publié: (2024)
SINE: SINgle Image Editing with Text-to-Image Diffusion Models
par: Zhang, Zhixing, et autres
Publié: (2022)
par: Zhang, Zhixing, et autres
Publié: (2022)
Mitigate One, Skew Another? Tackling Intersectional Biases in Text-to-Image Models
par: Shukla, Pushkar, et autres
Publié: (2025)
par: Shukla, Pushkar, et autres
Publié: (2025)
GrOCE:Graph-Guided Online Concept Erasure for Text-to-Image Diffusion Models
par: Han, Ning, et autres
Publié: (2025)
par: Han, Ning, et autres
Publié: (2025)
TextCraftor: Your Text Encoder Can be Image Quality Controller
par: Li, Yanyu, et autres
Publié: (2024)
par: Li, Yanyu, et autres
Publié: (2024)
Financial Models in Generative Art: Black-Scholes-Inspired Concept Blending in Text-to-Image Diffusion
par: Kothandaraman, Divya, et autres
Publié: (2024)
par: Kothandaraman, Divya, et autres
Publié: (2024)
VAR-CLIP: Text-to-Image Generator with Visual Auto-Regressive Modeling
par: Zhang, Qian, et autres
Publié: (2024)
par: Zhang, Qian, et autres
Publié: (2024)
Erasing Thousands of Concepts: Towards Scalable and Practical Concept Erasure for Text-to-Image Diffusion Models
par: Seo, Hoigi, et autres
Publié: (2026)
par: Seo, Hoigi, et autres
Publié: (2026)
HyperHuman: Hyper-Realistic Human Generation with Latent Structural Diffusion
par: Liu, Xian, et autres
Publié: (2023)
par: Liu, Xian, et autres
Publié: (2023)
ComposeMe: Attribute-Specific Image Prompts for Controllable Human Image Generation
par: Qian, Guocheng Gordon, et autres
Publié: (2025)
par: Qian, Guocheng Gordon, et autres
Publié: (2025)
Comprehensive Evaluation and Analysis for NSFW Concept Erasure in Text-to-Image Diffusion Models
par: Chen, Die, et autres
Publié: (2025)
par: Chen, Die, et autres
Publié: (2025)
Exploiting Text-Image Latent Spaces for the Description of Visual Concepts
par: Schmalwasser, Laines, et autres
Publié: (2024)
par: Schmalwasser, Laines, et autres
Publié: (2024)
Canvas-to-Image: Compositional Image Generation with Multimodal Controls
par: Dalva, Yusuf, et autres
Publié: (2025)
par: Dalva, Yusuf, et autres
Publié: (2025)
CoMat: Aligning Text-to-Image Diffusion Model with Image-to-Text Concept Matching
par: Jiang, Dongzhi, et autres
Publié: (2024)
par: Jiang, Dongzhi, et autres
Publié: (2024)
VSC: Visual Search Compositional Text-to-Image Diffusion Model
par: Dat, Do Huu, et autres
Publié: (2025)
par: Dat, Do Huu, et autres
Publié: (2025)
Factorized Video Autoencoders for Efficient Generative Modelling
par: Suhail, Mohammed, et autres
Publié: (2024)
par: Suhail, Mohammed, et autres
Publié: (2024)
Context Diffusion: In-Context Aware Image Generation
par: Najdenkoska, Ivona, et autres
Publié: (2023)
par: Najdenkoska, Ivona, et autres
Publié: (2023)
Wonderland: Navigating 3D Scenes from a Single Image
par: Liang, Hanwen, et autres
Publié: (2024)
par: Liang, Hanwen, et autres
Publié: (2024)
Learning What Matters: Prioritized Concept Learning via Relative Error-driven Sample Selection
par: Chandhok, Shivam, et autres
Publié: (2025)
par: Chandhok, Shivam, et autres
Publié: (2025)
Can Text-to-Video Generation help Video-Language Alignment?
par: Zanella, Luca, et autres
Publié: (2025)
par: Zanella, Luca, et autres
Publié: (2025)
Personalized Residuals for Concept-Driven Text-to-Image Generation
par: Ham, Cusuh, et autres
Publié: (2024)
par: Ham, Cusuh, et autres
Publié: (2024)
A Single Neuron Works: Precise Concept Erasure in Text-to-Image Diffusion Models
par: He, Qinqin, et autres
Publié: (2025)
par: He, Qinqin, et autres
Publié: (2025)
BiasConnect: Investigating Bias Interactions in Text-to-Image Models
par: Shukla, Pushkar, et autres
Publié: (2025)
par: Shukla, Pushkar, et autres
Publié: (2025)
Localized Concept Erasure in Text-to-Image Diffusion Models via High-Level Representation Misdirection
par: Lee, Uichan, et autres
Publié: (2026)
par: Lee, Uichan, et autres
Publié: (2026)
Documents similaires
-
All in One: A Unified Synthetic Data Pipeline for Multimodal Video Understanding
par: Rahman, Tanzila, et autres
Publié: (2026) -
Scalable Ranked Preference Optimization for Text-to-Image Generation
par: Karthik, Shyamgopal, et autres
Publié: (2024) -
MMFactory: A Universal Solution Search Engine for Vision-Language Tasks
par: Fan, Wan-Cyuan, et autres
Publié: (2024) -
Joint Generative Modeling of Grounded Scene Graphs and Images via Diffusion Models
par: Xu, Bicheng, et autres
Publié: (2024) -
To Sink or Not to Sink: Visual Information Pathways in Large Vision-Language Models
par: Luo, Jiayun, et autres
Publié: (2025)