Injecting Image Guidance into Text-Conditioned Diffusion Models at Inference
Fuente:
arXiv
Guardado en:
| Autores principales: | Żywot, Agata, Skylitsis, Iason, Nijdam, Thijmen, Tzifa-Kratira, Zoe, Prinzhorn, Derck, Szewczyk, Konrad, Bhowmik, Aritra |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Morpheus: Benchmarking Physical Reasoning of Video Generative Models with Real Physical Experiments
por: Zhang, Chenyu, et al.
Publicado: (2025)
por: Zhang, Chenyu, et al.
Publicado: (2025)
Conformal time series decomposition with component-wise exchangeability
por: Prinzhorn, Derck W. E., et al.
Publicado: (2024)
por: Prinzhorn, Derck W. E., et al.
Publicado: (2024)
Disentangling Sampling from Training Budget in Class-Imbalanced CT Body Composition Segmentation
por: Skylitsis, Iason, et al.
Publicado: (2026)
por: Skylitsis, Iason, et al.
Publicado: (2026)
Superposition as Lossy Compression: Measure with Sparse Autoencoders and Connect to Adversarial Vulnerability
por: Bereska, Leonard, et al.
Publicado: (2025)
por: Bereska, Leonard, et al.
Publicado: (2025)
StyleInject: Parameter Efficient Tuning of Text-to-Image Diffusion Models
por: Zhou, Mohan, et al.
Publicado: (2024)
por: Zhou, Mohan, et al.
Publicado: (2024)
Diffusion-Based Conditional Image Editing through Optimized Inference with Guidance
por: Lee, Hyunsoo, et al.
Publicado: (2024)
por: Lee, Hyunsoo, et al.
Publicado: (2024)
DreamView: Injecting View-specific Text Guidance into Text-to-3D Generation
por: Yan, Junkai, et al.
Publicado: (2024)
por: Yan, Junkai, et al.
Publicado: (2024)
Segmentation-Free Guidance for Text-to-Image Diffusion Models
por: Azarian, Kambiz, et al.
Publicado: (2024)
por: Azarian, Kambiz, et al.
Publicado: (2024)
Conditional Text-to-Image Generation with Reference Guidance
por: Kim, Taewook, et al.
Publicado: (2024)
por: Kim, Taewook, et al.
Publicado: (2024)
Steering Guidance for Personalized Text-to-Image Diffusion Models
por: Park, Sunghyun, et al.
Publicado: (2025)
por: Park, Sunghyun, et al.
Publicado: (2025)
Semantic Guidance Tuning for Text-To-Image Diffusion Models
por: Kang, Hyun, et al.
Publicado: (2023)
por: Kang, Hyun, et al.
Publicado: (2023)
MoAlign: Motion-Centric Representation Alignment for Video Diffusion Models
por: Bhowmik, Aritra, et al.
Publicado: (2025)
por: Bhowmik, Aritra, et al.
Publicado: (2025)
Membership Inference on Text-to-Image Diffusion Models via Conditional Likelihood Discrepancy
por: Zhai, Shengfang, et al.
Publicado: (2024)
por: Zhai, Shengfang, et al.
Publicado: (2024)
AsyncDiff: Asynchronous Timestep Conditioning for Enhanced Text-to-Image Diffusion Inference
por: Xu, Longhuan, et al.
Publicado: (2025)
por: Xu, Longhuan, et al.
Publicado: (2025)
Predicated Diffusion: Predicate Logic-Based Attention Guidance for Text-to-Image Diffusion Models
por: Sueyoshi, Kota, et al.
Publicado: (2023)
por: Sueyoshi, Kota, et al.
Publicado: (2023)
Local Conditional Controlling for Text-to-Image Diffusion Models
por: Zhao, Yibo, et al.
Publicado: (2023)
por: Zhao, Yibo, et al.
Publicado: (2023)
CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion
por: Li, Yanyu, et al.
Publicado: (2025)
por: Li, Yanyu, et al.
Publicado: (2025)
Self-Cross Diffusion Guidance for Text-to-Image Synthesis of Similar Subjects
por: Qiu, Weimin, et al.
Publicado: (2024)
por: Qiu, Weimin, et al.
Publicado: (2024)
Rectified Diffusion Guidance for Conditional Generation
por: Xia, Mengfei, et al.
Publicado: (2024)
por: Xia, Mengfei, et al.
Publicado: (2024)
Text-Anchored Score Composition: Tackling Condition Misalignment in Text-to-Image Diffusion Models
por: Wang, Luozhou, et al.
Publicado: (2023)
por: Wang, Luozhou, et al.
Publicado: (2023)
Exploring the Capability of Text-to-Image Diffusion Models with Structural Edge Guidance for Multi-Spectral Satellite Image Inpainting
por: Czerkawski, Mikolaj, et al.
Publicado: (2023)
por: Czerkawski, Mikolaj, et al.
Publicado: (2023)
Test-time Conditional Text-to-Image Synthesis Using Diffusion Models
por: Shukla, Tripti, et al.
Publicado: (2024)
por: Shukla, Tripti, et al.
Publicado: (2024)
Devil is in the Detail: Towards Injecting Fine Details of Image Prompt in Image Generation via Conflict-free Guidance and Stratified Attention
por: Jo, Kyungmin, et al.
Publicado: (2025)
por: Jo, Kyungmin, et al.
Publicado: (2025)
Unified Diffusion-Based Rigid and Non-Rigid Editing with Text and Image Guidance
por: Wang, Jiacheng, et al.
Publicado: (2024)
por: Wang, Jiacheng, et al.
Publicado: (2024)
Cross-View Meets Diffusion: Aerial Image Synthesis with Geometry and Text Guidance
por: Arrabi, Ahmad, et al.
Publicado: (2024)
por: Arrabi, Ahmad, et al.
Publicado: (2024)
Tortoise and Hare Guidance: Accelerating Diffusion Model Inference with Multirate Integration
por: Lee, Yunghee, et al.
Publicado: (2025)
por: Lee, Yunghee, et al.
Publicado: (2025)
Isolated Diffusion: Optimizing Multi-Concept Text-to-Image Generation Training-Freely with Isolated Diffusion Guidance
por: Zhu, Jingyuan, et al.
Publicado: (2024)
por: Zhu, Jingyuan, et al.
Publicado: (2024)
Compress Guidance in Conditional Diffusion Sampling
por: Dinh, Anh-Dung, et al.
Publicado: (2024)
por: Dinh, Anh-Dung, et al.
Publicado: (2024)
Prompt-Based Safety Guidance Is Ineffective for Unlearned Text-to-Image Diffusion Models
por: Shin, Jiwoo, et al.
Publicado: (2025)
por: Shin, Jiwoo, et al.
Publicado: (2025)
Inject Where It Matters: Training-Free Spatially-Adaptive Identity Preservation for Text-to-Image Personalization
por: Li, Guandong, et al.
Publicado: (2026)
por: Li, Guandong, et al.
Publicado: (2026)
Unified Control for Inference-Time Guidance of Denoising Diffusion Models
por: Goyal, Maurya, et al.
Publicado: (2025)
por: Goyal, Maurya, et al.
Publicado: (2025)
Tuning-Free Image Customization with Image and Text Guidance
por: Li, Pengzhi, et al.
Publicado: (2024)
por: Li, Pengzhi, et al.
Publicado: (2024)
Unveiling Structural Memorization: Structural Membership Inference Attack for Text-to-Image Diffusion Models
por: Li, Qiao, et al.
Publicado: (2024)
por: Li, Qiao, et al.
Publicado: (2024)
Object-Conditioned Energy-Based Attention Map Alignment in Text-to-Image Diffusion Models
por: Zhang, Yasi, et al.
Publicado: (2024)
por: Zhang, Yasi, et al.
Publicado: (2024)
Training-free Dense-Aligned Diffusion Guidance for Modular Conditional Image Synthesis
por: Wang, Zixuan, et al.
Publicado: (2025)
por: Wang, Zixuan, et al.
Publicado: (2025)
Guidance-base Diffusion Models for Improving Photoacoustic Image Quality
por: Eguchi, Tatsuhiro, et al.
Publicado: (2025)
por: Eguchi, Tatsuhiro, et al.
Publicado: (2025)
Unbiased Image Synthesis via Manifold Guidance in Diffusion Models
por: Su, Xingzhe, et al.
Publicado: (2023)
por: Su, Xingzhe, et al.
Publicado: (2023)
REG: Rectified Gradient Guidance for Conditional Diffusion Models
por: Gao, Zhengqi, et al.
Publicado: (2025)
por: Gao, Zhengqi, et al.
Publicado: (2025)
Enhancing Text-to-Image Diffusion Transformer via Split-Text Conditioning
por: Zhang, Yu, et al.
Publicado: (2025)
por: Zhang, Yu, et al.
Publicado: (2025)
TextCtrl: Diffusion-based Scene Text Editing with Prior Guidance Control
por: Zeng, Weichao, et al.
Publicado: (2024)
por: Zeng, Weichao, et al.
Publicado: (2024)
Ejemplares similares
-
Morpheus: Benchmarking Physical Reasoning of Video Generative Models with Real Physical Experiments
por: Zhang, Chenyu, et al.
Publicado: (2025) -
Conformal time series decomposition with component-wise exchangeability
por: Prinzhorn, Derck W. E., et al.
Publicado: (2024) -
Disentangling Sampling from Training Budget in Class-Imbalanced CT Body Composition Segmentation
por: Skylitsis, Iason, et al.
Publicado: (2026) -
Superposition as Lossy Compression: Measure with Sparse Autoencoders and Connect to Adversarial Vulnerability
por: Bereska, Leonard, et al.
Publicado: (2025) -
StyleInject: Parameter Efficient Tuning of Text-to-Image Diffusion Models
por: Zhou, Mohan, et al.
Publicado: (2024)