Versatile Diffusion: Text, Images and Variations All in One Diffusion Model
Fuente:
arXiv
Guardado en:
| Autores principales: | Xu, Xingqian, Wang, Zhangyang, Zhang, Eric, Wang, Kai, Shi, Humphrey |
|---|---|
| Formato: | Preprint |
| Publicado: |
2022
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
IMG: Calibrating Diffusion Models via Implicit Multimodal Guidance
por: Guo, Jiayi, et al.
Publicado: (2025)
por: Guo, Jiayi, et al.
Publicado: (2025)
Efficient Image Generation with Variadic Attention Heads
por: Walton, Steven, et al.
Publicado: (2022)
por: Walton, Steven, et al.
Publicado: (2022)
HD-Painter: High-Resolution and Prompt-Faithful Text-Guided Image Inpainting with Diffusion Models
por: Manukyan, Hayk, et al.
Publicado: (2023)
por: Manukyan, Hayk, et al.
Publicado: (2023)
PAIR-Diffusion: A Comprehensive Multimodal Object-Level Image Editor
por: Goel, Vidit, et al.
Publicado: (2023)
por: Goel, Vidit, et al.
Publicado: (2023)
OpenBias: Open-set Bias Detection in Text-to-Image Generative Models
por: D'Incà, Moreno, et al.
Publicado: (2024)
por: D'Incà, Moreno, et al.
Publicado: (2024)
GradBias: Unveiling Word Influence on Bias in Text-to-Image Generative Models
por: D'Incà, Moreno, et al.
Publicado: (2024)
por: D'Incà, Moreno, et al.
Publicado: (2024)
Zero-Painter: Training-Free Layout Control for Text-to-Image Synthesis
por: Ohanyan, Marianna, et al.
Publicado: (2024)
por: Ohanyan, Marianna, et al.
Publicado: (2024)
VASE: Object-Centric Appearance and Shape Manipulation of Real Videos
por: Peruzzo, Elia, et al.
Publicado: (2024)
por: Peruzzo, Elia, et al.
Publicado: (2024)
Frequency-Controlled Diffusion Model for Versatile Text-Guided Image-to-Image Translation
por: Gao, Xiang, et al.
Publicado: (2024)
por: Gao, Xiang, et al.
Publicado: (2024)
RAGME: Retrieval Augmented Video Generation for Enhanced Motion Realism
por: Peruzzo, Elia, et al.
Publicado: (2025)
por: Peruzzo, Elia, et al.
Publicado: (2025)
Diffusion for Natural Image Matting
por: Hu, Yihan, et al.
Publicado: (2023)
por: Hu, Yihan, et al.
Publicado: (2023)
Detecting Origin Attribution for Text-to-Image Diffusion Models
por: Xu, Katherine, et al.
Publicado: (2024)
por: Xu, Katherine, et al.
Publicado: (2024)
SwiftBrush: One-Step Text-to-Image Diffusion Model with Variational Score Distillation
por: Nguyen, Thuan Hoang, et al.
Publicado: (2023)
por: Nguyen, Thuan Hoang, et al.
Publicado: (2023)
PICD: Versatile Perceptual Image Compression with Diffusion Rendering
por: Xu, Tongda, et al.
Publicado: (2025)
por: Xu, Tongda, et al.
Publicado: (2025)
UVMap-ID: A Controllable and Personalized UV Map Generative Model
por: Wang, Weijie, et al.
Publicado: (2024)
por: Wang, Weijie, et al.
Publicado: (2024)
All-in-One Slider for Attribute Manipulation in Diffusion Models
por: Ye, Weixin, et al.
Publicado: (2025)
por: Ye, Weixin, et al.
Publicado: (2025)
MAD: Makeup All-in-One with Cross-Domain Diffusion Model
por: Ruan, Bo-Kai, et al.
Publicado: (2025)
por: Ruan, Bo-Kai, et al.
Publicado: (2025)
One-Way Ticket:Time-Independent Unified Encoder for Distilling Text-to-Image Diffusion Models
por: Li, Senmao, et al.
Publicado: (2025)
por: Li, Senmao, et al.
Publicado: (2025)
VideoElevator: Elevating Video Generation Quality with Versatile Text-to-Image Diffusion Models
por: Zhang, Yabo, et al.
Publicado: (2024)
por: Zhang, Yabo, et al.
Publicado: (2024)
SVG-T2I: Scaling Up Text-to-Image Latent Diffusion Model Without Variational Autoencoder
por: Shi, Minglei, et al.
Publicado: (2025)
por: Shi, Minglei, et al.
Publicado: (2025)
Diffusion in Diffusion: Cyclic One-Way Diffusion for Text-Vision-Conditioned Generation
por: Wang, Ruoyu, et al.
Publicado: (2023)
por: Wang, Ruoyu, et al.
Publicado: (2023)
One Stone with Two Birds: A Null-Text-Null Frequency-Aware Diffusion Models for Text-Guided Image Inpainting
por: Liu, Haipeng, et al.
Publicado: (2025)
por: Liu, Haipeng, et al.
Publicado: (2025)
Safe Vision-Language Models via Unsafe Weights Manipulation
por: D'Incà, Moreno, et al.
Publicado: (2025)
por: D'Incà, Moreno, et al.
Publicado: (2025)
One-Step Diffusion Model for Image Motion-Deblurring
por: Liu, Xiaoyang, et al.
Publicado: (2025)
por: Liu, Xiaoyang, et al.
Publicado: (2025)
AutoDIR: Automatic All-in-One Image Restoration with Latent Diffusion
por: Jiang, Yitong, et al.
Publicado: (2023)
por: Jiang, Yitong, et al.
Publicado: (2023)
Social Reward: Evaluating and Enhancing Generative AI through Million-User Feedback from an Online Creative Community
por: Isajanyan, Arman, et al.
Publicado: (2024)
por: Isajanyan, Arman, et al.
Publicado: (2024)
Versatile Transition Generation with Image-to-Video Diffusion
por: Yang, Zuhao, et al.
Publicado: (2025)
por: Yang, Zuhao, et al.
Publicado: (2025)
Supercharged One-step Text-to-Image Diffusion Models with Negative Prompts
por: Nguyen, Viet, et al.
Publicado: (2024)
por: Nguyen, Viet, et al.
Publicado: (2024)
Diffusion As Self-Distillation: End-to-End Latent Diffusion In One Model
por: Wang, Xiyuan, et al.
Publicado: (2025)
por: Wang, Xiyuan, et al.
Publicado: (2025)
Scaling Down Text Encoders of Text-to-Image Diffusion Models
por: Wang, Lifu, et al.
Publicado: (2025)
por: Wang, Lifu, et al.
Publicado: (2025)
Good Seed Makes a Good Crop: Discovering Secret Seeds in Text-to-Image Diffusion Models
por: Xu, Katherine, et al.
Publicado: (2024)
por: Xu, Katherine, et al.
Publicado: (2024)
TINA: Text-Free Inversion Attack for Unlearned Text-to-Image Diffusion Models
por: Xiang, Qianlong, et al.
Publicado: (2026)
por: Xiang, Qianlong, et al.
Publicado: (2026)
Enabling Versatile Controls for Video Diffusion Models
por: Zhang, Xu, et al.
Publicado: (2025)
por: Zhang, Xu, et al.
Publicado: (2025)
All-in-One Medical Image Restoration with Latent Diffusion-Enhanced Vector-Quantized Codebook Prior
por: Chen, Haowei, et al.
Publicado: (2025)
por: Chen, Haowei, et al.
Publicado: (2025)
Debiasing Text-to-Image Diffusion Models
por: He, Ruifei, et al.
Publicado: (2024)
por: He, Ruifei, et al.
Publicado: (2024)
LADR: Locality-Aware Dynamic Rescue for Efficient Text-to-Image Generation with Diffusion Large Language Models
por: Wang, Chenglin, et al.
Publicado: (2026)
por: Wang, Chenglin, et al.
Publicado: (2026)
DesignDiffusion: High-Quality Text-to-Design Image Generation with Diffusion Models
por: Wang, Zhendong, et al.
Publicado: (2025)
por: Wang, Zhendong, et al.
Publicado: (2025)
Text-Driven Diffusion Model for Sign Language Production
por: He, Jiayi, et al.
Publicado: (2025)
por: He, Jiayi, et al.
Publicado: (2025)
Dynamic Attention Analysis for Backdoor Detection in Text-to-Image Diffusion Models
por: Wang, Zhongqi, et al.
Publicado: (2025)
por: Wang, Zhongqi, et al.
Publicado: (2025)
T2IShield: Defending Against Backdoors on Text-to-Image Diffusion Models
por: Wang, Zhongqi, et al.
Publicado: (2024)
por: Wang, Zhongqi, et al.
Publicado: (2024)
Ejemplares similares
-
IMG: Calibrating Diffusion Models via Implicit Multimodal Guidance
por: Guo, Jiayi, et al.
Publicado: (2025) -
Efficient Image Generation with Variadic Attention Heads
por: Walton, Steven, et al.
Publicado: (2022) -
HD-Painter: High-Resolution and Prompt-Faithful Text-Guided Image Inpainting with Diffusion Models
por: Manukyan, Hayk, et al.
Publicado: (2023) -
PAIR-Diffusion: A Comprehensive Multimodal Object-Level Image Editor
por: Goel, Vidit, et al.
Publicado: (2023) -
OpenBias: Open-set Bias Detection in Text-to-Image Generative Models
por: D'Incà, Moreno, et al.
Publicado: (2024)