Geometric Disentanglement of Text Embeddings for Subject-Consistent Text-to-Image Generation using A Single Prompt
Fuente:
arXiv
Guardado en:
| Autores principales: | Li, Shangxun, Uh, Youngjung |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
ASemConsist: Adaptive Semantic Feature Control for Training-Free Identity-Consistent Generation
por: Kim, Shin Seong, et al.
Publicado: (2025)
por: Kim, Shin Seong, et al.
Publicado: (2025)
Training-free Content Injection using h-space in Diffusion Models
por: Jeong, Jaeseok, et al.
Publicado: (2023)
por: Jeong, Jaeseok, et al.
Publicado: (2023)
Frequency-Adaptive Sharpness Regularization for Improving 3D Gaussian Splatting Generalization
por: Yun, Youngsik, et al.
Publicado: (2025)
por: Yun, Youngsik, et al.
Publicado: (2025)
Semantic Image Synthesis with Unconditional Generator
por: Chae, Jungwoo, et al.
Publicado: (2024)
por: Chae, Jungwoo, et al.
Publicado: (2024)
Attribute Based Interpretable Evaluation Metrics for Generative Models
por: Kim, Dongkyun, et al.
Publicado: (2023)
por: Kim, Dongkyun, et al.
Publicado: (2023)
Visual Style Prompting with Swapping Self-Attention
por: Jeong, Jaeseok, et al.
Publicado: (2024)
por: Jeong, Jaeseok, et al.
Publicado: (2024)
Syncphony: Synchronized Audio-to-Video Generation with Diffusion Transformers
por: Song, Jibin, et al.
Publicado: (2025)
por: Song, Jibin, et al.
Publicado: (2025)
HARIVO: Harnessing Text-to-Image Models for Video Generation
por: Kwon, Mingi, et al.
Publicado: (2024)
por: Kwon, Mingi, et al.
Publicado: (2024)
FlowBlending: Stage-Aware Multi-Model Sampling for Fast and High-Fidelity Video Generation
por: Song, Jibin, et al.
Publicado: (2025)
por: Song, Jibin, et al.
Publicado: (2025)
TetraSDF: Precise Mesh Extraction with Multi-resolution Tetrahedral Grid
por: Oh, Seonghun, et al.
Publicado: (2025)
por: Oh, Seonghun, et al.
Publicado: (2025)
Per-Gaussian Embedding-Based Deformation for Deformable 3D Gaussian Splatting
por: Bae, Jeongmin, et al.
Publicado: (2024)
por: Bae, Jeongmin, et al.
Publicado: (2024)
StyleKeeper: Prevent Content Leakage using Negative Visual Query Guidance
por: Jeong, Jaeseok, et al.
Publicado: (2025)
por: Jeong, Jaeseok, et al.
Publicado: (2025)
MVCustom: Multi-View Customized Diffusion via Geometric Latent Rendering and Completion
por: Shin, Minjung, et al.
Publicado: (2025)
por: Shin, Minjung, et al.
Publicado: (2025)
CoDi: Subject-Consistent and Pose-Diverse Text-to-Image Generation
por: Gao, Zhanxin, et al.
Publicado: (2025)
por: Gao, Zhanxin, et al.
Publicado: (2025)
DisenBooth: Identity-Preserving Disentangled Tuning for Subject-Driven Text-to-Image Generation
por: Chen, Hong, et al.
Publicado: (2023)
por: Chen, Hong, et al.
Publicado: (2023)
Disentangling to Re-couple: Resolving the Similarity-Controllability Paradox in Subject-Driven Text-to-Image Generation
por: Li, Shuang, et al.
Publicado: (2026)
por: Li, Shuang, et al.
Publicado: (2026)
Eye-for-an-eye: Appearance Transfer with Semantic Correspondence in Diffusion Models
por: Go, Sooyeon, et al.
Publicado: (2024)
por: Go, Sooyeon, et al.
Publicado: (2024)
Contrastive Prompts Improve Disentanglement in Text-to-Image Diffusion Models
por: Wu, Chen, et al.
Publicado: (2024)
por: Wu, Chen, et al.
Publicado: (2024)
Sync-NeRF: Generalizing Dynamic NeRFs to Unsynchronized Videos
por: Kim, Seoha, et al.
Publicado: (2023)
por: Kim, Seoha, et al.
Publicado: (2023)
Rethinking Open-Vocabulary Segmentation of Radiance Fields in 3D Space
por: Lee, Hyunjee, et al.
Publicado: (2024)
por: Lee, Hyunjee, et al.
Publicado: (2024)
TIT-Score: Evaluating Long-Prompt Based Text-to-Image Alignment via Text-to-Image-to-Text Consistency
por: Wang, Juntong, et al.
Publicado: (2025)
por: Wang, Juntong, et al.
Publicado: (2025)
Prompt-Softbox-Prompt: A Free-Text Embedding Control for Image Editing
por: Yang, Yitong, et al.
Publicado: (2024)
por: Yang, Yitong, et al.
Publicado: (2024)
Geometrical Properties of Text Token Embeddings for Strong Semantic Binding in Text-to-Image Generation
por: Seo, Hoigi, et al.
Publicado: (2025)
por: Seo, Hoigi, et al.
Publicado: (2025)
Optimizing Prompts for Text-to-Image Generation
por: Hao, Yaru, et al.
Publicado: (2022)
por: Hao, Yaru, et al.
Publicado: (2022)
AnyStory: Towards Unified Single and Multiple Subject Personalization in Text-to-Image Generation
por: He, Junjie, et al.
Publicado: (2025)
por: He, Junjie, et al.
Publicado: (2025)
One-Prompt-One-Story: Free-Lunch Consistent Text-to-Image Generation Using a Single Prompt
por: Liu, Tao, et al.
Publicado: (2025)
por: Liu, Tao, et al.
Publicado: (2025)
Improving Text-to-Image Consistency via Automatic Prompt Optimization
por: Mañas, Oscar, et al.
Publicado: (2024)
por: Mañas, Oscar, et al.
Publicado: (2024)
TCFG: Tangential Damping Classifier-free Guidance
por: Kwon, Mingi, et al.
Publicado: (2025)
por: Kwon, Mingi, et al.
Publicado: (2025)
Learning Disentangled Identifiers for Action-Customized Text-to-Image Generation
por: Huang, Siteng, et al.
Publicado: (2023)
por: Huang, Siteng, et al.
Publicado: (2023)
PromptSafe: Gated Prompt Tuning for Safe Text-to-Image Generation
por: Jing, Zonglei, et al.
Publicado: (2025)
por: Jing, Zonglei, et al.
Publicado: (2025)
TIPO: Text to Image with Text Presampling for Prompt Optimization
por: Yeh, Shih-Ying, et al.
Publicado: (2024)
por: Yeh, Shih-Ying, et al.
Publicado: (2024)
Prompt Refinement with Image Pivot for Text-to-Image Generation
por: Zhan, Jingtao, et al.
Publicado: (2024)
por: Zhan, Jingtao, et al.
Publicado: (2024)
TextTIGER: Text-based Intelligent Generation with Entity Prompt Refinement for Text-to-Image Generation
por: Ozaki, Shintaro, et al.
Publicado: (2025)
por: Ozaki, Shintaro, et al.
Publicado: (2025)
End-to-end Training for Text-to-Image Synthesis using Dual-Text Embeddings
por: Ahmed, Yeruru Asrar, et al.
Publicado: (2025)
por: Ahmed, Yeruru Asrar, et al.
Publicado: (2025)
Deep Geometric Moments Promote Shape Consistency in Text-to-3D Generation
por: Nath, Utkarsh, et al.
Publicado: (2024)
por: Nath, Utkarsh, et al.
Publicado: (2024)
SceneBooth: Diffusion-based Framework for Subject-preserved Text-to-Image Generation
por: Chai, Shang, et al.
Publicado: (2025)
por: Chai, Shang, et al.
Publicado: (2025)
Attention Calibration for Disentangled Text-to-Image Personalization
por: Zhang, Yanbing, et al.
Publicado: (2024)
por: Zhang, Yanbing, et al.
Publicado: (2024)
StorySync: Training-Free Subject Consistency in Text-to-Image Generation via Region Harmonization
por: Gaur, Gopalji, et al.
Publicado: (2025)
por: Gaur, Gopalji, et al.
Publicado: (2025)
JEPA-T: Joint-Embedding Predictive Architecture with Text Fusion for Image Generation
por: Wan, Siheng, et al.
Publicado: (2025)
por: Wan, Siheng, et al.
Publicado: (2025)
Iterative Prompt Refinement for Safer Text-to-Image Generation
por: Jeon, Jinwoo, et al.
Publicado: (2025)
por: Jeon, Jinwoo, et al.
Publicado: (2025)
Ejemplares similares
-
ASemConsist: Adaptive Semantic Feature Control for Training-Free Identity-Consistent Generation
por: Kim, Shin Seong, et al.
Publicado: (2025) -
Training-free Content Injection using h-space in Diffusion Models
por: Jeong, Jaeseok, et al.
Publicado: (2023) -
Frequency-Adaptive Sharpness Regularization for Improving 3D Gaussian Splatting Generalization
por: Yun, Youngsik, et al.
Publicado: (2025) -
Semantic Image Synthesis with Unconditional Generator
por: Chae, Jungwoo, et al.
Publicado: (2024) -
Attribute Based Interpretable Evaluation Metrics for Generative Models
por: Kim, Dongkyun, et al.
Publicado: (2023)