Fast Personalized Text-to-Image Syntheses With Attention Injection
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Yuxuan, Song, Yiren, Yu, Jinpeng, Pan, Han, Jing, Zhongliang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
SSR-Encoder: Encoding Selective Subject Representation for Subject-Driven Generation
di: Zhang, Yuxuan, et al.
Pubblicazione: (2023)
di: Zhang, Yuxuan, et al.
Pubblicazione: (2023)
EasyText: Controllable Diffusion Transformer for Multilingual Text Rendering
di: Lu, Runnan, et al.
Pubblicazione: (2025)
di: Lu, Runnan, et al.
Pubblicazione: (2025)
Attention Calibration for Disentangled Text-to-Image Personalization
di: Zhang, Yanbing, et al.
Pubblicazione: (2024)
di: Zhang, Yanbing, et al.
Pubblicazione: (2024)
DCoAR: Deep Concept Injection into Unified Autoregressive Models for Personalized Text-to-Image Generation
di: Wu, Fangtai, et al.
Pubblicazione: (2025)
di: Wu, Fangtai, et al.
Pubblicazione: (2025)
Stable-Makeup: When Real-World Makeup Transfer Meets Diffusion Model
di: Zhang, Yuxuan, et al.
Pubblicazione: (2024)
di: Zhang, Yuxuan, et al.
Pubblicazione: (2024)
EasyControl: Adding Efficient and Flexible Control for Diffusion Transformer
di: Zhang, Yuxuan, et al.
Pubblicazione: (2025)
di: Zhang, Yuxuan, et al.
Pubblicazione: (2025)
AMNS: Attention-Weighted Selective Mask and Noise Label Suppression for Text-to-Image Person Retrieval
di: Zhang, Runqing, et al.
Pubblicazione: (2024)
di: Zhang, Runqing, et al.
Pubblicazione: (2024)
FreeText: Training-Free Text Rendering in Diffusion Transformers via Attention Localization and Spectral Glyph Injection
di: Zhang, Ruiqiang, et al.
Pubblicazione: (2026)
di: Zhang, Ruiqiang, et al.
Pubblicazione: (2026)
PhotoDoodle: Learning Artistic Image Editing from Few-Shot Pairwise Data
di: Huang, Shijie, et al.
Pubblicazione: (2025)
di: Huang, Shijie, et al.
Pubblicazione: (2025)
Data Attribution for Text-to-Image Models by Unlearning Synthesized Images
di: Wang, Sheng-Yu, et al.
Pubblicazione: (2024)
di: Wang, Sheng-Yu, et al.
Pubblicazione: (2024)
Tailored Visions: Enhancing Text-to-Image Generation with Personalized Prompt Rewriting
di: Chen, Zijie, et al.
Pubblicazione: (2023)
di: Chen, Zijie, et al.
Pubblicazione: (2023)
Pretrained Image-Text Models are Secretly Video Captioners
di: Zhang, Chunhui, et al.
Pubblicazione: (2025)
di: Zhang, Chunhui, et al.
Pubblicazione: (2025)
MINDiff: Mask-Integrated Negative Attention for Controlling Overfitting in Text-to-Image Personalization
di: Jeong, Seulgi, et al.
Pubblicazione: (2025)
di: Jeong, Seulgi, et al.
Pubblicazione: (2025)
Stable-Hair: Real-World Hair Transfer via Diffusion Model
di: Zhang, Yuxuan, et al.
Pubblicazione: (2024)
di: Zhang, Yuxuan, et al.
Pubblicazione: (2024)
DRDM: A Disentangled Representations Diffusion Model for Synthesizing Realistic Person Images
di: Huang, Enbo, et al.
Pubblicazione: (2024)
di: Huang, Enbo, et al.
Pubblicazione: (2024)
DDAP: Dual-Domain Anti-Personalization against Text-to-Image Diffusion Models
di: Yang, Jing, et al.
Pubblicazione: (2024)
di: Yang, Jing, et al.
Pubblicazione: (2024)
View-consistent Object Removal in Radiance Fields
di: Lu, Yiren, et al.
Pubblicazione: (2024)
di: Lu, Yiren, et al.
Pubblicazione: (2024)
DreamMatcher: Appearance Matching Self-Attention for Semantically-Consistent Text-to-Image Personalization
di: Nam, Jisu, et al.
Pubblicazione: (2024)
di: Nam, Jisu, et al.
Pubblicazione: (2024)
Rethinking Attention-Based Multiple Instance Learning for Whole-Slide Pathological Image Classification: An Instance Attribute Viewpoint
di: Cai, Linghan, et al.
Pubblicazione: (2024)
di: Cai, Linghan, et al.
Pubblicazione: (2024)
Edit2Perceive: Image Editing Diffusion Models Are Strong Dense Perceivers
di: Shi, Yiqing, et al.
Pubblicazione: (2025)
di: Shi, Yiqing, et al.
Pubblicazione: (2025)
TPA3D: Triplane Attention for Fast Text-to-3D Generation
di: Wu, Bin-Shih, et al.
Pubblicazione: (2023)
di: Wu, Bin-Shih, et al.
Pubblicazione: (2023)
Skeletons Speak Louder than Text: A Motion-Aware Pretraining Paradigm for Video-Based Person Re-Identification
di: Lin, Rifen, et al.
Pubblicazione: (2025)
di: Lin, Rifen, et al.
Pubblicazione: (2025)
CLIP-SCGI: Synthesized Caption-Guided Inversion for Person Re-Identification
di: Han, Qianru, et al.
Pubblicazione: (2024)
di: Han, Qianru, et al.
Pubblicazione: (2024)
WordCon: Word-level Typography Control in Scene Text Rendering
di: Shi, Wenda, et al.
Pubblicazione: (2025)
di: Shi, Wenda, et al.
Pubblicazione: (2025)
Graph-Based Cross-Domain Knowledge Distillation for Cross-Dataset Text-to-Image Person Retrieval
di: Luo, Bingjun, et al.
Pubblicazione: (2025)
di: Luo, Bingjun, et al.
Pubblicazione: (2025)
PaRa: Personalizing Text-to-Image Diffusion via Parameter Rank Reduction
di: Chen, Shangyu, et al.
Pubblicazione: (2024)
di: Chen, Shangyu, et al.
Pubblicazione: (2024)
SerialGen: Personalized Image Generation by First Standardization Then Personalization
di: Xie, Cong, et al.
Pubblicazione: (2024)
di: Xie, Cong, et al.
Pubblicazione: (2024)
MoMA: Multimodal LLM Adapter for Fast Personalized Image Generation
di: Song, Kunpeng, et al.
Pubblicazione: (2024)
di: Song, Kunpeng, et al.
Pubblicazione: (2024)
TextAtlas5M: A Large-scale Dataset for Dense Text Image Generation
di: Wang, Alex Jinpeng, et al.
Pubblicazione: (2025)
di: Wang, Alex Jinpeng, et al.
Pubblicazione: (2025)
LLM-Enabled Style and Content Regularization for Personalized Text-to-Image Generation
di: Yu, Anran, et al.
Pubblicazione: (2025)
di: Yu, Anran, et al.
Pubblicazione: (2025)
Unlocking the Latent Canvas: Eliciting and Benchmarking Symbolic Visual Expression in LLMs
di: Zheng, Yiren, et al.
Pubblicazione: (2026)
di: Zheng, Yiren, et al.
Pubblicazione: (2026)
Object-Conditioned Energy-Based Attention Map Alignment in Text-to-Image Diffusion Models
di: Zhang, Yasi, et al.
Pubblicazione: (2024)
di: Zhang, Yasi, et al.
Pubblicazione: (2024)
Setting the Stage: Text-Driven Scene-Consistent Image Generation
di: Xie, Cong, et al.
Pubblicazione: (2025)
di: Xie, Cong, et al.
Pubblicazione: (2025)
TextBoost: Boosting Text Encoder for Personalized Text-to-Image Generation
di: Park, NaHyeon, et al.
Pubblicazione: (2024)
di: Park, NaHyeon, et al.
Pubblicazione: (2024)
IDProtector: An Adversarial Noise Encoder to Protect Against ID-Preserving Image Generation
di: Song, Yiren, et al.
Pubblicazione: (2024)
di: Song, Yiren, et al.
Pubblicazione: (2024)
Learning Flow Fields in Attention for Controllable Person Image Generation
di: Zhou, Zijian, et al.
Pubblicazione: (2024)
di: Zhou, Zijian, et al.
Pubblicazione: (2024)
Personalized Image Descriptions from Attention Sequences
di: Xue, Ruoyu, et al.
Pubblicazione: (2025)
di: Xue, Ruoyu, et al.
Pubblicazione: (2025)
Personalized Residuals for Concept-Driven Text-to-Image Generation
di: Ham, Cusuh, et al.
Pubblicazione: (2024)
di: Ham, Cusuh, et al.
Pubblicazione: (2024)
Personalize Your Gaussian: Consistent 3D Scene Personalization from a Single Image
di: Wang, Yuxuan, et al.
Pubblicazione: (2025)
di: Wang, Yuxuan, et al.
Pubblicazione: (2025)
GroundingBooth: Grounding Text-to-Image Customization
di: Xiong, Zhexiao, et al.
Pubblicazione: (2024)
di: Xiong, Zhexiao, et al.
Pubblicazione: (2024)
Documenti analoghi
-
SSR-Encoder: Encoding Selective Subject Representation for Subject-Driven Generation
di: Zhang, Yuxuan, et al.
Pubblicazione: (2023) -
EasyText: Controllable Diffusion Transformer for Multilingual Text Rendering
di: Lu, Runnan, et al.
Pubblicazione: (2025) -
Attention Calibration for Disentangled Text-to-Image Personalization
di: Zhang, Yanbing, et al.
Pubblicazione: (2024) -
DCoAR: Deep Concept Injection into Unified Autoregressive Models for Personalized Text-to-Image Generation
di: Wu, Fangtai, et al.
Pubblicazione: (2025) -
Stable-Makeup: When Real-World Makeup Transfer Meets Diffusion Model
di: Zhang, Yuxuan, et al.
Pubblicazione: (2024)