Scribble-Guided Diffusion for Training-free Text-to-Image Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Lee, Seonho, Choi, Jiho, Lim, Seohyun, Kim, Jiwook, Shim, Hyunjung |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
DreamCatalyst: Fast and High-Quality 3D Editing via Controlling Editability and Identity Preservation
par: Kim, Jiwook, et autres
Publié: (2024)
par: Kim, Jiwook, et autres
Publié: (2024)
3D-Aware Vision-Language Models Fine-Tuning with Geometric Distillation
par: Lee, Seonho, et autres
Publié: (2025)
par: Lee, Seonho, et autres
Publié: (2025)
Fine-Grained Image-Text Correspondence with Cost Aggregation for Open-Vocabulary Part Segmentation
par: Choi, Jiho, et autres
Publié: (2025)
par: Choi, Jiho, et autres
Publié: (2025)
Understanding Multi-Granularity for Open-Vocabulary Part Segmentation
par: Choi, Jiho, et autres
Publié: (2024)
par: Choi, Jiho, et autres
Publié: (2024)
Memory-Efficient Fine-Tuning for Quantized Diffusion Model
par: Ryu, Hyogon, et autres
Publié: (2024)
par: Ryu, Hyogon, et autres
Publié: (2024)
Representation Alignment for Just Image Transformers is not Easier than You Think
par: Shin, Jaeyo, et autres
Publié: (2026)
par: Shin, Jaeyo, et autres
Publié: (2026)
What "Not" to Detect: Negation-Aware VLMs via Structured Reasoning and Token Merging
par: Kang, Inha, et autres
Publié: (2025)
par: Kang, Inha, et autres
Publié: (2025)
Rethinking Direct Preference Optimization in Diffusion Models
par: Kang, Junyong, et autres
Publié: (2025)
par: Kang, Junyong, et autres
Publié: (2025)
Evaluating Image Hallucination in Text-to-Image Generation with Question-Answering
par: Lim, Youngsun, et autres
Publié: (2024)
par: Lim, Youngsun, et autres
Publié: (2024)
Addressing Image Hallucination in Text-to-Image Generation through Factual Image Retrieval
par: Lim, Youngsun, et autres
Publié: (2024)
par: Lim, Youngsun, et autres
Publié: (2024)
TextBoost: Boosting Text Encoder for Personalized Text-to-Image Generation
par: Park, NaHyeon, et autres
Publié: (2024)
par: Park, NaHyeon, et autres
Publié: (2024)
MomentMix Augmentation with Length-Aware DETR for Temporally Robust Moment Retrieval
par: Park, Seojeong, et autres
Publié: (2024)
par: Park, Seojeong, et autres
Publié: (2024)
DGQ: Distribution-Aware Group Quantization for Text-to-Image Diffusion Models
par: Ryu, Hyogon, et autres
Publié: (2025)
par: Ryu, Hyogon, et autres
Publié: (2025)
Directional Textual Inversion for Personalized Text-to-Image Generation
par: Kim, Kunhee, et autres
Publié: (2025)
par: Kim, Kunhee, et autres
Publié: (2025)
ScribbleEdit: Synthetic Data for Image Editing with Scribbles and Text
par: Ji, Anya, et autres
Publié: (2026)
par: Ji, Anya, et autres
Publié: (2026)
CoT-PL: Chain-of-Thought Pseudo-Labeling for Open-Vocabulary Object Detection
par: Choi, Hojun, et autres
Publié: (2025)
par: Choi, Hojun, et autres
Publié: (2025)
ScribbleLight: Single Image Indoor Relighting with Scribbles
par: Choi, Jun Myeong, et autres
Publié: (2024)
par: Choi, Jun Myeong, et autres
Publié: (2024)
Latent Inversion with Timestep-aware Sampling for Training-free Non-rigid Editing
par: Jung, Yunji, et autres
Publié: (2024)
par: Jung, Yunji, et autres
Publié: (2024)
ODPG: Outfitting Diffusion with Pose Guided Condition
par: Lee, Seohyun, et autres
Publié: (2025)
par: Lee, Seohyun, et autres
Publié: (2025)
Class-Continuous Conditional Generative Neural Radiance Field
par: Kim, Jiwook, et autres
Publié: (2023)
par: Kim, Jiwook, et autres
Publié: (2023)
ScribbleDose: Scribble-Guided Dose Prediction in Radiotherapy
par: Zhang, Zhenxi, et autres
Publié: (2026)
par: Zhang, Zhenxi, et autres
Publié: (2026)
Classifier-guided CLIP Distillation for Unsupervised Multi-label Classification
par: Kim, Dongseob, et autres
Publié: (2025)
par: Kim, Dongseob, et autres
Publié: (2025)
Learning from Spatio-temporal Correlation for Semi-Supervised LiDAR Semantic Segmentation
par: Lee, Seungho, et autres
Publié: (2024)
par: Lee, Seungho, et autres
Publié: (2024)
Label-Augmented Dataset Distillation
par: Kang, Seoungyoon, et autres
Publié: (2024)
par: Kang, Seoungyoon, et autres
Publié: (2024)
WaymoQA: A Multi-View Visual Question Answering Dataset for Safety-Critical Reasoning in Autonomous Driving
par: Yu, Seungjun, et autres
Publié: (2025)
par: Yu, Seungjun, et autres
Publié: (2025)
Weakly Supervised Semantic Segmentation for Driving Scenes
par: Kim, Dongseob, et autres
Publié: (2023)
par: Kim, Dongseob, et autres
Publié: (2023)
Self-Supervised Vision Transformers Are Efficient Segmentation Learners for Imperfect Labels
par: Lee, Seungho, et autres
Publié: (2024)
par: Lee, Seungho, et autres
Publié: (2024)
Rethinking the Use of Vision Transformers for AI-Generated Image Detection
par: Park, NaHyeon, et autres
Publié: (2025)
par: Park, NaHyeon, et autres
Publié: (2025)
SeiT++: Masked Token Modeling Improves Storage-efficient Training
par: Lee, Minhyun, et autres
Publié: (2023)
par: Lee, Minhyun, et autres
Publié: (2023)
Rethinking Scribble-Guided Image Editing: Generalization, Instruction Adherence, and Multi-Tasking
par: Xu, Mingyi, et autres
Publié: (2026)
par: Xu, Mingyi, et autres
Publié: (2026)
SGSoft: Learning Fused Semantic-Geometric Features for 3D Shape Correspondence via Template-Guided Soft Signals
par: Yoon, Soyeon, et autres
Publié: (2026)
par: Yoon, Soyeon, et autres
Publié: (2026)
Sampling Bag of Views for Open-Vocabulary Object Detection
par: Choi, Hojun, et autres
Publié: (2024)
par: Choi, Hojun, et autres
Publié: (2024)
EVIDENT: Routing MLLM Adaptation through Entity-Grounded Visual Evidence for Cross-Domain Video Temporal Grounding
par: Ahn, Geo, et autres
Publié: (2026)
par: Ahn, Geo, et autres
Publié: (2026)
ScribbleSense: Generative Scribble-Based Texture Editing with Intent Prediction
par: Zhang, Yudi, et autres
Publié: (2026)
par: Zhang, Yudi, et autres
Publié: (2026)
SlotVTG: Object-Centric Adapter for Generalizable Video Temporal Grounding
par: Han, Jiwook, et autres
Publié: (2026)
par: Han, Jiwook, et autres
Publié: (2026)
Improving Video Diffusion Transformer Training by Multi-Feature Fusion and Alignment from Self-Supervised Vision Encoders
par: Lee, Dohun, et autres
Publié: (2025)
par: Lee, Dohun, et autres
Publié: (2025)
A Diffusion-Based Framework for Configurable and Realistic Multi-Storage Trace Generation
par: Kim, Seohyun, et autres
Publié: (2025)
par: Kim, Seohyun, et autres
Publié: (2025)
Aligned but Stereotypical? The Hidden Influence of System Prompts on Social Bias in LVLM-Based Text-to-Image Models
par: Park, NaHyeon, et autres
Publié: (2025)
par: Park, NaHyeon, et autres
Publié: (2025)
Rethinking Data Augmentation for Robust LiDAR Semantic Segmentation in Adverse Weather
par: Park, Junsung, et autres
Publié: (2024)
par: Park, Junsung, et autres
Publié: (2024)
Precision matters: Precision-aware ensemble for weakly supervised semantic segmentation
par: Park, Junsung, et autres
Publié: (2024)
par: Park, Junsung, et autres
Publié: (2024)
Documents similaires
-
DreamCatalyst: Fast and High-Quality 3D Editing via Controlling Editability and Identity Preservation
par: Kim, Jiwook, et autres
Publié: (2024) -
3D-Aware Vision-Language Models Fine-Tuning with Geometric Distillation
par: Lee, Seonho, et autres
Publié: (2025) -
Fine-Grained Image-Text Correspondence with Cost Aggregation for Open-Vocabulary Part Segmentation
par: Choi, Jiho, et autres
Publié: (2025) -
Understanding Multi-Granularity for Open-Vocabulary Part Segmentation
par: Choi, Jiho, et autres
Publié: (2024) -
Memory-Efficient Fine-Tuning for Quantized Diffusion Model
par: Ryu, Hyogon, et autres
Publié: (2024)