Layout-and-Retouch: A Dual-stage Framework for Improving Diversity in Personalized Image Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kim, Kangyeol, Seo, Wooseok, Nam, Sehyun, Kim, Bodam, Jeong, Suhyeon, Cho, Wonwoo, Choo, Jaegul, Yu, Youngjae |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Training Spatial-Frequency Visual Prompts and Probabilistic Clusters for Accurate Black-Box Transfer Learning
par: Cho, Wonwoo, et autres
Publié: (2024)
par: Cho, Wonwoo, et autres
Publié: (2024)
OPRO: Orthogonal Panel-Relative Operators for Panel-Aware In-Context Image Generation
par: Lee, Sanghyeon, et autres
Publié: (2026)
par: Lee, Sanghyeon, et autres
Publié: (2026)
Scaling Up Personalized Image Aesthetic Assessment via Task Vector Customization
par: Yun, Jooyeol, et autres
Publié: (2024)
par: Yun, Jooyeol, et autres
Publié: (2024)
Skip-and-Play: Depth-Driven Pose-Preserved Image Generation for Any Objects
par: Jo, Kyungmin, et autres
Publié: (2024)
par: Jo, Kyungmin, et autres
Publié: (2024)
PromptDresser: Improving the Quality and Controllability of Virtual Try-On via Generative Textual Prompt and Prompt-aware Mask
par: Kim, Jeongho, et autres
Publié: (2024)
par: Kim, Jeongho, et autres
Publié: (2024)
EPIC: Effective Prompting for Imbalanced-Class Data Synthesis in Tabular Data Classification via Large Language Models
par: Kim, Jinhee, et autres
Publié: (2024)
par: Kim, Jinhee, et autres
Publié: (2024)
Bones Can't Be Triangles: Accurate and Efficient Vertebrae Keypoint Estimation through Collaborative Error Revision
par: Kim, Jinhee, et autres
Publié: (2024)
par: Kim, Jinhee, et autres
Publié: (2024)
V.I.P. : Iterative Online Preference Distillation for Efficient Video Diffusion Models
par: Kim, Jisoo, et autres
Publié: (2025)
par: Kim, Jisoo, et autres
Publié: (2025)
Good Noise Makes Good Edits: A Training-Free Diffusion-Based Video Editing with Image and Text Prompts
par: Choi, Saemee, et autres
Publié: (2025)
par: Choi, Saemee, et autres
Publié: (2025)
TCAN: Animating Human Images with Temporally Consistent Pose Guidance using Diffusion Models
par: Kim, Jeongho, et autres
Publié: (2024)
par: Kim, Jeongho, et autres
Publié: (2024)
Temporal In-Context Fine-Tuning with Temporal Reasoning for Versatile Control of Video Diffusion Models
par: Kim, Kinam, et autres
Publié: (2025)
par: Kim, Kinam, et autres
Publié: (2025)
When Model Meets New Normals: Test-time Adaptation for Unsupervised Time-series Anomaly Detection
par: Kim, Dongmin, et autres
Publié: (2023)
par: Kim, Dongmin, et autres
Publié: (2023)
Devil is in the Detail: Towards Injecting Fine Details of Image Prompt in Image Generation via Conflict-free Guidance and Stratified Attention
par: Jo, Kyungmin, et autres
Publié: (2025)
par: Jo, Kyungmin, et autres
Publié: (2025)
NeuVolEx: Implicit Neural Features for Volume Exploration
par: An, Haill, et autres
Publié: (2026)
par: An, Haill, et autres
Publié: (2026)
Retrieve Only Relevant Tables Whether Few or Many: Adaptive Table Retrieval Method
par: Kim, Taehee, et autres
Publié: (2026)
par: Kim, Taehee, et autres
Publié: (2026)
A formal synthesis of (−)‐rotundone
par: Terim Seo, et autres
Publié: (2026)
par: Terim Seo, et autres
Publié: (2026)
Is user feedback always informative? Retrieval Latent Defending for Semi-Supervised Domain Adaptation without Source Data
par: Song, Junha, et autres
Publié: (2024)
par: Song, Junha, et autres
Publié: (2024)
Optimal Transport Audio Distance with Learned Riemannian Ground Metrics
par: Jeong, Wonwoo
Publié: (2026)
par: Jeong, Wonwoo
Publié: (2026)
An Empirical Analysis of Task-Induced Encoder Bias in Fréchet Audio Distance
par: Jeong, Wonwoo
Publié: (2026)
par: Jeong, Wonwoo
Publié: (2026)
Infinite-Homography as Robust Conditioning for Camera-Controlled Video Generation
par: Kim, Min-Jung, et autres
Publié: (2025)
par: Kim, Min-Jung, et autres
Publié: (2025)
Evaluating Automatic Speech Recognition Systems for Korean Meteorological Experts
par: Park, ChaeHun, et autres
Publié: (2024)
par: Park, ChaeHun, et autres
Publié: (2024)
TV-LiVE: Training-Free, Text-Guided Video Editing via Layer Informed Vitality Exploitation
par: Kim, Min-Jung, et autres
Publié: (2025)
par: Kim, Min-Jung, et autres
Publié: (2025)
Real-Time Person Image Synthesis Using a Flow Matching Model
par: Jeong, Jiwoo, et autres
Publié: (2025)
par: Jeong, Jiwoo, et autres
Publié: (2025)
Simultaneous Embedding and Welding of Silver Nanowires Into the Surface of Polymer Networks for Mechanically Robust and Highly Conductive Three‐Dimensional Flexible Transparent Electrodes
par: Sangmok Kim, et autres
Publié: (2026)
par: Sangmok Kim, et autres
Publié: (2026)
An Empirical Framework for Discrete Games with Costly Information Acquisition
par: Jeong, Youngjae
Publié: (2025)
par: Jeong, Youngjae
Publié: (2025)
InstantRetouch: Personalized Image Retouching without Test-time Fine-tuning Using an Asymmetric Auto-Encoder
par: Weldengus, Temesgen Muruts, et autres
Publié: (2025)
par: Weldengus, Temesgen Muruts, et autres
Publié: (2025)
Agentic Retoucher for Text-To-Image Generation
par: Shen, Shaocheng, et autres
Publié: (2026)
par: Shen, Shaocheng, et autres
Publié: (2026)
From Wardrobe to Canvas: Wardrobe Polyptych LoRA for Part-level Controllable Human Image Generation
par: Kim, Jeongho, et autres
Publié: (2025)
par: Kim, Jeongho, et autres
Publié: (2025)
Vector Prism: Animating Vector Graphics by Stratifying Semantic Structure
par: Yun, Jooyeol, et autres
Publié: (2025)
par: Yun, Jooyeol, et autres
Publié: (2025)
Pacer and Runner: Cooperative Learning Framework between Single- and Cross-Domain Sequential Recommendation
par: Park, Chung, et autres
Publié: (2024)
par: Park, Chung, et autres
Publié: (2024)
Break the Breakout: Reinventing LM Defense Against Jailbreak Attacks with Self-Refinement
par: Kim, Heegyu, et autres
Publié: (2024)
par: Kim, Heegyu, et autres
Publié: (2024)
Investigating Pre-Training Objectives for Generalization in Vision-Based Reinforcement Learning
par: Kim, Donghu, et autres
Publié: (2024)
par: Kim, Donghu, et autres
Publié: (2024)
Don't Let Bandit Feedback Pull Continual LLM-Recommender Updates Off Target
par: Kim, Taesan, et autres
Publié: (2026)
par: Kim, Taesan, et autres
Publié: (2026)
BankMathBench: A Benchmark for Numerical Reasoning in Banking Scenarios
par: Lee, Yunseung, et autres
Publié: (2026)
par: Lee, Yunseung, et autres
Publié: (2026)
What to Preserve and What to Transfer: Faithful, Identity-Preserving Diffusion-based Hairstyle Transfer
par: Chung, Chaeyeon, et autres
Publié: (2024)
par: Chung, Chaeyeon, et autres
Publié: (2024)
EgoX: Egocentric Video Generation from a Single Exocentric Video
par: Kang, Taewoong, et autres
Publié: (2025)
par: Kang, Taewoong, et autres
Publié: (2025)
Slow and Steady Wins the Race: Maintaining Plasticity with Hare and Tortoise Networks
par: Lee, Hojoon, et autres
Publié: (2024)
par: Lee, Hojoon, et autres
Publié: (2024)
Zero-Shot Head Swapping in Real-World Scenarios
par: Kang, Taewoong, et autres
Publié: (2025)
par: Kang, Taewoong, et autres
Publié: (2025)
SelfSwapper: Self-Supervised Face Swapping via Shape Agnostic Masked AutoEncoder
par: Lee, Jaeseong, et autres
Publié: (2024)
par: Lee, Jaeseong, et autres
Publié: (2024)
Building Resource-Constrained Language Agents: A Korean Case Study on Chemical Toxicity Information
par: Cho, Hojun, et autres
Publié: (2025)
par: Cho, Hojun, et autres
Publié: (2025)
Documents similaires
-
Training Spatial-Frequency Visual Prompts and Probabilistic Clusters for Accurate Black-Box Transfer Learning
par: Cho, Wonwoo, et autres
Publié: (2024) -
OPRO: Orthogonal Panel-Relative Operators for Panel-Aware In-Context Image Generation
par: Lee, Sanghyeon, et autres
Publié: (2026) -
Scaling Up Personalized Image Aesthetic Assessment via Task Vector Customization
par: Yun, Jooyeol, et autres
Publié: (2024) -
Skip-and-Play: Depth-Driven Pose-Preserved Image Generation for Any Objects
par: Jo, Kyungmin, et autres
Publié: (2024) -
PromptDresser: Improving the Quality and Controllability of Virtual Try-On via Generative Textual Prompt and Prompt-aware Mask
par: Kim, Jeongho, et autres
Publié: (2024)