CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion
Fuente:
arXiv
Salvato in:
| Autori principali: | Li, Yanyu, Wan, Pencheng, Han, Liang, Wang, Yaowei, Nie, Liqiang, Zhang, Min |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Counting Guidance for High Fidelity Text-to-Image Synthesis
di: Kang, Wonjun, et al.
Pubblicazione: (2023)
di: Kang, Wonjun, et al.
Pubblicazione: (2023)
TINA: Text-Free Inversion Attack for Unlearned Text-to-Image Diffusion Models
di: Xiang, Qianlong, et al.
Pubblicazione: (2026)
di: Xiang, Qianlong, et al.
Pubblicazione: (2026)
CountCluster: Training-Free Object Quantity Guidance with Cross-Attention Map Clustering for Text-to-Image Generation
di: Lee, Joohyeon, et al.
Pubblicazione: (2025)
di: Lee, Joohyeon, et al.
Pubblicazione: (2025)
Embodied Crowd Counting
di: Long, Runling, et al.
Pubblicazione: (2025)
di: Long, Runling, et al.
Pubblicazione: (2025)
Diffusion-based Data Augmentation for Object Counting Problems
di: Wang, Zhen, et al.
Pubblicazione: (2024)
di: Wang, Zhen, et al.
Pubblicazione: (2024)
DAgger Diffusion Navigation: DAgger Boosted Diffusion Policy for Vision-Language Navigation
di: Shi, Haoxiang, et al.
Pubblicazione: (2025)
di: Shi, Haoxiang, et al.
Pubblicazione: (2025)
YOLO-Count: Differentiable Object Counting for Text-to-Image Generation
di: Zeng, Guanning, et al.
Pubblicazione: (2025)
di: Zeng, Guanning, et al.
Pubblicazione: (2025)
Segmentation-Free Guidance for Text-to-Image Diffusion Models
di: Azarian, Kambiz, et al.
Pubblicazione: (2024)
di: Azarian, Kambiz, et al.
Pubblicazione: (2024)
CountLoop: Training-Free High-Instance Image Generation via Iterative Agent Guidance
di: Mondal, Anindya, et al.
Pubblicazione: (2025)
di: Mondal, Anindya, et al.
Pubblicazione: (2025)
Self-Cross Diffusion Guidance for Text-to-Image Synthesis of Similar Subjects
di: Qiu, Weimin, et al.
Pubblicazione: (2024)
di: Qiu, Weimin, et al.
Pubblicazione: (2024)
Counting Hallucinations in Diffusion Models
di: Fu, Shuai, et al.
Pubblicazione: (2025)
di: Fu, Shuai, et al.
Pubblicazione: (2025)
CountSteer: Steering Attention for Object Counting in Diffusion Models
di: Boo, Hyemin, et al.
Pubblicazione: (2025)
di: Boo, Hyemin, et al.
Pubblicazione: (2025)
Text-to-Image Diffusion Models Cannot Count, and Prompt Refinement Cannot Help
di: Guo, Xuyang, et al.
Pubblicazione: (2025)
di: Guo, Xuyang, et al.
Pubblicazione: (2025)
Cross-View Meets Diffusion: Aerial Image Synthesis with Geometry and Text Guidance
di: Arrabi, Ahmad, et al.
Pubblicazione: (2024)
di: Arrabi, Ahmad, et al.
Pubblicazione: (2024)
How Much To Guide: Revisiting Adaptive Guidance in Classifier-Free Guidance Text-to-Vision Diffusion Models
di: Zhang, Huixuan, et al.
Pubblicazione: (2025)
di: Zhang, Huixuan, et al.
Pubblicazione: (2025)
Tuning-Free Image Customization with Image and Text Guidance
di: Li, Pengzhi, et al.
Pubblicazione: (2024)
di: Li, Pengzhi, et al.
Pubblicazione: (2024)
Isolated Diffusion: Optimizing Multi-Concept Text-to-Image Generation Training-Freely with Isolated Diffusion Guidance
di: Zhu, Jingyuan, et al.
Pubblicazione: (2024)
di: Zhu, Jingyuan, et al.
Pubblicazione: (2024)
PEO: Training-Free Aesthetic Quality Enhancement in Pre-Trained Text-to-Image Diffusion Models with Prompt Embedding Optimization
di: Margaryan, Hovhannes, et al.
Pubblicazione: (2025)
di: Margaryan, Hovhannes, et al.
Pubblicazione: (2025)
Stochastic Self-Guidance for Training-Free Enhancement of Diffusion Models
di: Chen, Chubin, et al.
Pubblicazione: (2025)
di: Chen, Chubin, et al.
Pubblicazione: (2025)
Regressor-Segmenter Mutual Prompt Learning for Crowd Counting
di: Guo, Mingyue, et al.
Pubblicazione: (2023)
di: Guo, Mingyue, et al.
Pubblicazione: (2023)
DiffuseHigh: Training-free Progressive High-Resolution Image Synthesis through Structure Guidance
di: Kim, Younghyun, et al.
Pubblicazione: (2024)
di: Kim, Younghyun, et al.
Pubblicazione: (2024)
One-Shot Crowd Counting With Density Guidance For Scene Adaptation
di: Chen, Jiwei, et al.
Pubblicazione: (2026)
di: Chen, Jiwei, et al.
Pubblicazione: (2026)
TFCounter:Polishing Gems for Training-Free Object Counting
di: Ting, Pan, et al.
Pubblicazione: (2024)
di: Ting, Pan, et al.
Pubblicazione: (2024)
Diffusion-DRF: Free, Rich, and Differentiable Reward for Video Diffusion Fine-Tuning
di: Wang, Yifan, et al.
Pubblicazione: (2026)
di: Wang, Yifan, et al.
Pubblicazione: (2026)
Dual-Channel Attention Guidance for Training-Free Image Editing Control in Diffusion Transformers
di: Li, Guandong
Pubblicazione: (2026)
di: Li, Guandong
Pubblicazione: (2026)
Training-free Dense-Aligned Diffusion Guidance for Modular Conditional Image Synthesis
di: Wang, Zixuan, et al.
Pubblicazione: (2025)
di: Wang, Zixuan, et al.
Pubblicazione: (2025)
From Competition to Coopetition: Coopetitive Training-Free Image Editing Based on Text Guidance
di: Shen, Jinhao, et al.
Pubblicazione: (2026)
di: Shen, Jinhao, et al.
Pubblicazione: (2026)
Detection-Driven Object Count Optimization for Text-to-Image Diffusion Models
di: Zafar, Oz, et al.
Pubblicazione: (2024)
di: Zafar, Oz, et al.
Pubblicazione: (2024)
Detail++: Training-Free Detail Enhancer for Text-to-Image Diffusion Models
di: Chen, Lifeng, et al.
Pubblicazione: (2025)
di: Chen, Lifeng, et al.
Pubblicazione: (2025)
CoDA: From Text-to-Image Diffusion Models to Training-Free Dataset Distillation
di: Zhou, Letian, et al.
Pubblicazione: (2025)
di: Zhou, Letian, et al.
Pubblicazione: (2025)
Noise Diffusion for Enhancing Semantic Faithfulness in Text-to-Image Synthesis
di: Miao, Boming, et al.
Pubblicazione: (2024)
di: Miao, Boming, et al.
Pubblicazione: (2024)
FreeText: Training-Free Text Rendering in Diffusion Transformers via Attention Localization and Spectral Glyph Injection
di: Zhang, Ruiqiang, et al.
Pubblicazione: (2026)
di: Zhang, Ruiqiang, et al.
Pubblicazione: (2026)
Predicated Diffusion: Predicate Logic-Based Attention Guidance for Text-to-Image Diffusion Models
di: Sueyoshi, Kota, et al.
Pubblicazione: (2023)
di: Sueyoshi, Kota, et al.
Pubblicazione: (2023)
Virtual Classification: Modulating Domain-Specific Knowledge for Multidomain Crowd Counting
di: Guo, Mingyue, et al.
Pubblicazione: (2024)
di: Guo, Mingyue, et al.
Pubblicazione: (2024)
Injecting Image Guidance into Text-Conditioned Diffusion Models at Inference
di: Żywot, Agata, et al.
Pubblicazione: (2026)
di: Żywot, Agata, et al.
Pubblicazione: (2026)
PixArt-$α$: Fast Training of Diffusion Transformer for Photorealistic Text-to-Image Synthesis
di: Chen, Junsong, et al.
Pubblicazione: (2023)
di: Chen, Junsong, et al.
Pubblicazione: (2023)
Unified Diffusion-Based Rigid and Non-Rigid Editing with Text and Image Guidance
di: Wang, Jiacheng, et al.
Pubblicazione: (2024)
di: Wang, Jiacheng, et al.
Pubblicazione: (2024)
Pick-and-Draw: Training-free Semantic Guidance for Text-to-Image Personalization
di: Lv, Henglei, et al.
Pubblicazione: (2024)
di: Lv, Henglei, et al.
Pubblicazione: (2024)
ExpertGen: Training-Free Expert Guidance for Controllable Text-to-Face Generation
di: Shi, Liang, et al.
Pubblicazione: (2025)
di: Shi, Liang, et al.
Pubblicazione: (2025)
Training-Free Style Consistent Image Synthesis with Condition and Mask Guidance in E-Commerce
di: Li, Guandong
Pubblicazione: (2024)
di: Li, Guandong
Pubblicazione: (2024)
Documenti analoghi
-
Counting Guidance for High Fidelity Text-to-Image Synthesis
di: Kang, Wonjun, et al.
Pubblicazione: (2023) -
TINA: Text-Free Inversion Attack for Unlearned Text-to-Image Diffusion Models
di: Xiang, Qianlong, et al.
Pubblicazione: (2026) -
CountCluster: Training-Free Object Quantity Guidance with Cross-Attention Map Clustering for Text-to-Image Generation
di: Lee, Joohyeon, et al.
Pubblicazione: (2025) -
Embodied Crowd Counting
di: Long, Runling, et al.
Pubblicazione: (2025) -
Diffusion-based Data Augmentation for Object Counting Problems
di: Wang, Zhen, et al.
Pubblicazione: (2024)