CoCoNO: Attention Contrast-and-Complete for Initial Noise Optimization in Text-to-Image Synthesis
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Sundaram, Aravindan, Pal, Ujjayan, Chauhan, Abhimanyu, Agarwal, Aishwarya, Karanam, Srikrishna |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Training-free Color-Style Disentanglement for Constrained Text-to-Image Synthesis
par: Agarwal, Aishwarya, et autres
Publié: (2024)
par: Agarwal, Aishwarya, et autres
Publié: (2024)
AlignIT: Enhancing Prompt Alignment in Customization of Text-to-Image Models
par: Agarwal, Aishwarya, et autres
Publié: (2024)
par: Agarwal, Aishwarya, et autres
Publié: (2024)
Concept Regions Matter: Benchmarking CLIP with a New Cluster-Importance Approach
par: Agarwal, Aishwarya, et autres
Publié: (2025)
par: Agarwal, Aishwarya, et autres
Publié: (2025)
TIDE: Training Locally Interpretable Domain Generalization Models Enables Test-time Correction
par: Agarwal, Aishwarya, et autres
Publié: (2024)
par: Agarwal, Aishwarya, et autres
Publié: (2024)
LiteEmbed: Adapting CLIP to Rare Classes
par: Agarwal, Aishwarya, et autres
Publié: (2026)
par: Agarwal, Aishwarya, et autres
Publié: (2026)
Test-time Conditional Text-to-Image Synthesis Using Diffusion Models
par: Shukla, Tripti, et autres
Publié: (2024)
par: Shukla, Tripti, et autres
Publié: (2024)
Composing Parts for Expressive Object Generation
par: Rangwani, Harsh, et autres
Publié: (2024)
par: Rangwani, Harsh, et autres
Publié: (2024)
Learning 3D Texture-Aware Representations for Parsing Diverse Human Clothing and Body Parts
par: Chhatre, Kiran, et autres
Publié: (2025)
par: Chhatre, Kiran, et autres
Publié: (2025)
SafaRi:Adaptive Sequence Transformer for Weakly Supervised Referring Expression Segmentation
par: Nag, Sayan, et autres
Publié: (2024)
par: Nag, Sayan, et autres
Publié: (2024)
InitNO: Boosting Text-to-Image Diffusion Models via Initial Noise Optimization
par: Guo, Xiefan, et autres
Publié: (2024)
par: Guo, Xiefan, et autres
Publié: (2024)
CoRe: Joint Optimization with Contrastive Learning for Medical Image Registration
par: Kats, Eytan, et autres
Publié: (2026)
par: Kats, Eytan, et autres
Publié: (2026)
Adjusting Initial Noise to Mitigate Memorization in Text-to-Image Diffusion Models
par: Han, Hyeonggeun, et autres
Publié: (2025)
par: Han, Hyeonggeun, et autres
Publié: (2025)
Few Shot Class Incremental Learning using Vision-Language models
par: Kumar, Anurag, et autres
Publié: (2024)
par: Kumar, Anurag, et autres
Publié: (2024)
Restoring Initial Noise Sensitivity in Text-to-Image Distillation via Geometric Alignment
par: Huang, Huayang, et autres
Publié: (2026)
par: Huang, Huayang, et autres
Publié: (2026)
Image-to-Text for Medical Reports Using Adaptive Co-Attention and Triple-LSTM Module
par: Liu, Yishen
Publié: (2025)
par: Liu, Yishen
Publié: (2025)
PiCo: Enhancing Text-Image Alignment with Improved Noise Selection and Precise Mask Control in Diffusion Models
par: Xie, Chang, et autres
Publié: (2025)
par: Xie, Chang, et autres
Publié: (2025)
Spatial Transport Optimization by Repositioning Attention Map for Training-Free Text-to-Image Synthesis
par: Han, Woojung, et autres
Publié: (2025)
par: Han, Woojung, et autres
Publié: (2025)
ParCo: Part-Coordinating Text-to-Motion Synthesis
par: Zou, Qiran, et autres
Publié: (2024)
par: Zou, Qiran, et autres
Publié: (2024)
CoCoT: Contrastive Chain-of-Thought Prompting for Large Multimodal Models with Multiple Image Inputs
par: Zhang, Daoan, et autres
Publié: (2024)
par: Zhang, Daoan, et autres
Publié: (2024)
Image-Text Co-Decomposition for Text-Supervised Semantic Segmentation
par: Wu, Ji-Jia, et autres
Publié: (2024)
par: Wu, Ji-Jia, et autres
Publié: (2024)
Sparse CLIP: Co-Optimizing Interpretability and Performance in Contrastive Learning
par: Qin, Chuan, et autres
Publié: (2026)
par: Qin, Chuan, et autres
Publié: (2026)
Noise Diffusion for Enhancing Semantic Faithfulness in Text-to-Image Synthesis
par: Miao, Boming, et autres
Publié: (2024)
par: Miao, Boming, et autres
Publié: (2024)
DeCoTR: Enhancing Depth Completion with 2D and 3D Attentions
par: Shi, Yunxiao, et autres
Publié: (2024)
par: Shi, Yunxiao, et autres
Publié: (2024)
Diverse Text-to-Image Generation via Contrastive Noise Optimization
par: Kim, Byungjun, et autres
Publié: (2025)
par: Kim, Byungjun, et autres
Publié: (2025)
CoRLD: Contrastive Representation Learning Of Deformable Shapes In Images
par: Hossain, Tonmoy, et autres
Publié: (2025)
par: Hossain, Tonmoy, et autres
Publié: (2025)
TextCoT: Zoom In for Enhanced Multimodal Text-Rich Image Understanding
par: Luan, Bozhi, et autres
Publié: (2024)
par: Luan, Bozhi, et autres
Publié: (2024)
CoRe: Context-Regularized Text Embedding Learning for Text-to-Image Personalization
par: Wu, Feize, et autres
Publié: (2024)
par: Wu, Feize, et autres
Publié: (2024)
CACE-Net: Co-guidance Attention and Contrastive Enhancement for Effective Audio-Visual Event Localization
par: He, Xiang, et autres
Publié: (2024)
par: He, Xiang, et autres
Publié: (2024)
CoCoNet: Coupled Contrastive Learning Network with Multi-level Feature Ensemble for Multi-modality Image Fusion
par: Liu, Jinyuan, et autres
Publié: (2022)
par: Liu, Jinyuan, et autres
Publié: (2022)
AR-CoPO: Align Autoregressive Video Generation with Contrastive Policy Optimization
par: He, Dailan, et autres
Publié: (2026)
par: He, Dailan, et autres
Publié: (2026)
CoLVR: Enhancing Exploratory Latent Visual Reasoning via Contrastive Optimization
par: Ding, Ziyang, et autres
Publié: (2026)
par: Ding, Ziyang, et autres
Publié: (2026)
AMNS: Attention-Weighted Selective Mask and Noise Label Suppression for Text-to-Image Person Retrieval
par: Zhang, Runqing, et autres
Publié: (2024)
par: Zhang, Runqing, et autres
Publié: (2024)
CoCoIns: Consistent Subject Generation via Contrastive Instantiated Concepts
par: Hsin-Ying, Lee, et autres
Publié: (2025)
par: Hsin-Ying, Lee, et autres
Publié: (2025)
LGTM: Training-Free Light-Guided Text-to-Image Diffusion Model via Initial Noise Manipulation
par: Morita, Ryugo, et autres
Publié: (2026)
par: Morita, Ryugo, et autres
Publié: (2026)
Safeguarding Text-to-Image Generation via Inference-Time Prompt-Noise Optimization
par: Peng, Jiangweizhi, et autres
Publié: (2024)
par: Peng, Jiangweizhi, et autres
Publié: (2024)
CoDi: Subject-Consistent and Pose-Diverse Text-to-Image Generation
par: Gao, Zhanxin, et autres
Publié: (2025)
par: Gao, Zhanxin, et autres
Publié: (2025)
CoCoCo: Improving Text-Guided Video Inpainting for Better Consistency, Controllability and Compatibility
par: Zi, Bojia, et autres
Publié: (2024)
par: Zi, Bojia, et autres
Publié: (2024)
Improving Text-to-Image Consistency via Automatic Prompt Optimization
par: Mañas, Oscar, et autres
Publié: (2024)
par: Mañas, Oscar, et autres
Publié: (2024)
TAI++: Text as Image for Multi-Label Image Classification by Co-Learning Transferable Prompt
par: Wu, Xiangyu, et autres
Publié: (2024)
par: Wu, Xiangyu, et autres
Publié: (2024)
ImageGen-CoT: Enhancing Text-to-Image In-context Learning with Chain-of-Thought Reasoning
par: Liao, Jiaqi, et autres
Publié: (2025)
par: Liao, Jiaqi, et autres
Publié: (2025)
Documents similaires
-
Training-free Color-Style Disentanglement for Constrained Text-to-Image Synthesis
par: Agarwal, Aishwarya, et autres
Publié: (2024) -
AlignIT: Enhancing Prompt Alignment in Customization of Text-to-Image Models
par: Agarwal, Aishwarya, et autres
Publié: (2024) -
Concept Regions Matter: Benchmarking CLIP with a New Cluster-Importance Approach
par: Agarwal, Aishwarya, et autres
Publié: (2025) -
TIDE: Training Locally Interpretable Domain Generalization Models Enables Test-time Correction
par: Agarwal, Aishwarya, et autres
Publié: (2024) -
LiteEmbed: Adapting CLIP to Rare Classes
par: Agarwal, Aishwarya, et autres
Publié: (2026)