CountCluster: Training-Free Object Quantity Guidance with Cross-Attention Map Clustering for Text-to-Image Generation
Fuente:
arXiv
Salvato in:
| Autori principali: | Lee, Joohyeon, Lee, Jin-Seop, Lee, Jee-Hyong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
DomCLP: Domain-wise Contrastive Learning with Prototype Mixup for Unsupervised Domain Generalization
di: Lee, Jin-Seop, et al.
Pubblicazione: (2024)
di: Lee, Jin-Seop, et al.
Pubblicazione: (2024)
Stabilizing Open-Set Test-Time Adaptation via Primary-Auxiliary Filtering and Knowledge-Integrated Prediction
di: Lee, Byung-Joon, et al.
Pubblicazione: (2025)
di: Lee, Byung-Joon, et al.
Pubblicazione: (2025)
TAG: A Simple Yet Effective Temporal-Aware Approach for Zero-Shot Video Temporal Grounding
di: Lee, Jin-Seop, et al.
Pubblicazione: (2025)
di: Lee, Jin-Seop, et al.
Pubblicazione: (2025)
Learning to Refuse: Refusal-Aware Reinforcement Fine-Tuning for Hard-Irrelevant Queries in Video Temporal Grounding
di: Lee, Jin-Seop, et al.
Pubblicazione: (2025)
di: Lee, Jin-Seop, et al.
Pubblicazione: (2025)
BD-Net: Has Depth-Wise Convolution Ever Been Applied in Binary Neural Networks?
di: Kim, DoYoung, et al.
Pubblicazione: (2025)
di: Kim, DoYoung, et al.
Pubblicazione: (2025)
G-MIXER: Geodesic Mixup-based Implicit Semantic Expansion and Explicit Semantic Re-ranking for Zero-Shot Composed Image Retrieval
di: Lim, Jiyoung, et al.
Pubblicazione: (2026)
di: Lim, Jiyoung, et al.
Pubblicazione: (2026)
TextGuider: Training-Free Guidance for Text Rendering via Attention Alignment
di: Baek, Kanghyun, et al.
Pubblicazione: (2025)
di: Baek, Kanghyun, et al.
Pubblicazione: (2025)
CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion
di: Li, Yanyu, et al.
Pubblicazione: (2025)
di: Li, Yanyu, et al.
Pubblicazione: (2025)
Spatial Transport Optimization by Repositioning Attention Map for Training-Free Text-to-Image Synthesis
di: Han, Woojung, et al.
Pubblicazione: (2025)
di: Han, Woojung, et al.
Pubblicazione: (2025)
CountSteer: Steering Attention for Object Counting in Diffusion Models
di: Boo, Hyemin, et al.
Pubblicazione: (2025)
di: Boo, Hyemin, et al.
Pubblicazione: (2025)
Orthogonal Negative Guidance in Attention Feature Space for Text-to-Image Generation
di: Ko, Jungmin, et al.
Pubblicazione: (2026)
di: Ko, Jungmin, et al.
Pubblicazione: (2026)
Text-promptable Object Counting via Quantity Awareness Enhancement
di: Shi, Miaojing, et al.
Pubblicazione: (2025)
di: Shi, Miaojing, et al.
Pubblicazione: (2025)
MonoCLUE : Object-Aware Clustering Enhances Monocular 3D Object Detection
di: Yang, Sunghun, et al.
Pubblicazione: (2025)
di: Yang, Sunghun, et al.
Pubblicazione: (2025)
ISAC: Training-Free Instance-to-Semantic Attention Control for Improving Multi-Instance Generation
di: Jo, Sanghyun, et al.
Pubblicazione: (2025)
di: Jo, Sanghyun, et al.
Pubblicazione: (2025)
Fair Generation without Unfair Distortions: Debiasing Text-to-Image Generation with Entanglement-Free Attention
di: Park, Jeonghoon, et al.
Pubblicazione: (2025)
di: Park, Jeonghoon, et al.
Pubblicazione: (2025)
On-device Sora: Enabling Training-Free Diffusion-based Text-to-Video Generation for Mobile Devices
di: Kim, Bosung, et al.
Pubblicazione: (2025)
di: Kim, Bosung, et al.
Pubblicazione: (2025)
On-device Sora: Enabling Training-Free Diffusion-based Text-to-Video Generation for Mobile Devices
di: Kim, Bosung, et al.
Pubblicazione: (2025)
di: Kim, Bosung, et al.
Pubblicazione: (2025)
CountLoop: Training-Free High-Instance Image Generation via Iterative Agent Guidance
di: Mondal, Anindya, et al.
Pubblicazione: (2025)
di: Mondal, Anindya, et al.
Pubblicazione: (2025)
YOLO-Count: Differentiable Object Counting for Text-to-Image Generation
di: Zeng, Guanning, et al.
Pubblicazione: (2025)
di: Zeng, Guanning, et al.
Pubblicazione: (2025)
Neural Clustering for Prefractured Mesh Generation in Real-time Object Destruction
di: Kim, Seunghwan, et al.
Pubblicazione: (2025)
di: Kim, Seunghwan, et al.
Pubblicazione: (2025)
Image Clustering Conditioned on Text Criteria
di: Kwon, Sehyun, et al.
Pubblicazione: (2023)
di: Kwon, Sehyun, et al.
Pubblicazione: (2023)
Semantic Guidance Tuning for Text-To-Image Diffusion Models
di: Kang, Hyun, et al.
Pubblicazione: (2023)
di: Kang, Hyun, et al.
Pubblicazione: (2023)
Controllable 3D Object Generation with Single Image Prompt
di: Lee, Jaeseok, et al.
Pubblicazione: (2025)
di: Lee, Jaeseok, et al.
Pubblicazione: (2025)
Infinite-Story: A Training-Free Consistent Text-to-Image Generation
di: Park, Jihun, et al.
Pubblicazione: (2025)
di: Park, Jihun, et al.
Pubblicazione: (2025)
From Street to Orbit: Training-Free Cross-View Retrieval via Location Semantics and LLM Guidance
di: Min, Jeongho, et al.
Pubblicazione: (2025)
di: Min, Jeongho, et al.
Pubblicazione: (2025)
Counting Guidance for High Fidelity Text-to-Image Synthesis
di: Kang, Wonjun, et al.
Pubblicazione: (2023)
di: Kang, Wonjun, et al.
Pubblicazione: (2023)
UNCAGE: Contrastive Attention Guidance for Masked Generative Transformers in Text-to-Image Generation
di: Kang, Wonjun, et al.
Pubblicazione: (2025)
di: Kang, Wonjun, et al.
Pubblicazione: (2025)
Harnessing the Power of Training-Free Techniques in Text-to-2D Generation for Text-to-3D Generation via Score Distillation Sampling
di: Lee, Junhong, et al.
Pubblicazione: (2025)
di: Lee, Junhong, et al.
Pubblicazione: (2025)
Guided Slot Attention for Unsupervised Video Object Segmentation
di: Lee, Minhyeok, et al.
Pubblicazione: (2023)
di: Lee, Minhyeok, et al.
Pubblicazione: (2023)
Transforming Static Images Using Generative Models for Video Salient Object Detection
di: Cho, Suhwan, et al.
Pubblicazione: (2024)
di: Cho, Suhwan, et al.
Pubblicazione: (2024)
FreeGraftor: Training-Free Cross-Image Feature Grafting for Subject-Driven Text-to-Image Generation
di: Yao, Zebin, et al.
Pubblicazione: (2025)
di: Yao, Zebin, et al.
Pubblicazione: (2025)
Map2World: Segment Map Conditioned Text to 3D World Generation
di: Chung, Jaeyoung, et al.
Pubblicazione: (2026)
di: Chung, Jaeyoung, et al.
Pubblicazione: (2026)
Training-free Subject-Enhanced Attention Guidance for Compositional Text-to-image Generation
di: Liu, Shengyuan, et al.
Pubblicazione: (2024)
di: Liu, Shengyuan, et al.
Pubblicazione: (2024)
Dual Prototype Attention for Unsupervised Video Object Segmentation
di: Cho, Suhwan, et al.
Pubblicazione: (2022)
di: Cho, Suhwan, et al.
Pubblicazione: (2022)
Scribble-Guided Diffusion for Training-free Text-to-Image Generation
di: Lee, Seonho, et al.
Pubblicazione: (2024)
di: Lee, Seonho, et al.
Pubblicazione: (2024)
GATE3D: Generalized Attention-based Task-synergized Estimation in 3D*
di: Im, Eunsoo, et al.
Pubblicazione: (2025)
di: Im, Eunsoo, et al.
Pubblicazione: (2025)
Adaptively Clustering Neighbor Elements for Image-Text Generation
di: Wang, Zihua, et al.
Pubblicazione: (2023)
di: Wang, Zihua, et al.
Pubblicazione: (2023)
Identity-Preserving Text-to-Video Generation via Training-Free Prompt, Image, and Guidance Enhancement
di: Gao, Jiayi, et al.
Pubblicazione: (2025)
di: Gao, Jiayi, et al.
Pubblicazione: (2025)
ExpertGen: Training-Free Expert Guidance for Controllable Text-to-Face Generation
di: Shi, Liang, et al.
Pubblicazione: (2025)
di: Shi, Liang, et al.
Pubblicazione: (2025)
Tuning-Free Image Customization with Image and Text Guidance
di: Li, Pengzhi, et al.
Pubblicazione: (2024)
di: Li, Pengzhi, et al.
Pubblicazione: (2024)
Documenti analoghi
-
DomCLP: Domain-wise Contrastive Learning with Prototype Mixup for Unsupervised Domain Generalization
di: Lee, Jin-Seop, et al.
Pubblicazione: (2024) -
Stabilizing Open-Set Test-Time Adaptation via Primary-Auxiliary Filtering and Knowledge-Integrated Prediction
di: Lee, Byung-Joon, et al.
Pubblicazione: (2025) -
TAG: A Simple Yet Effective Temporal-Aware Approach for Zero-Shot Video Temporal Grounding
di: Lee, Jin-Seop, et al.
Pubblicazione: (2025) -
Learning to Refuse: Refusal-Aware Reinforcement Fine-Tuning for Hard-Irrelevant Queries in Video Temporal Grounding
di: Lee, Jin-Seop, et al.
Pubblicazione: (2025) -
BD-Net: Has Depth-Wise Convolution Ever Been Applied in Binary Neural Networks?
di: Kim, DoYoung, et al.
Pubblicazione: (2025)