Diffusion-driven GAN Inversion for Multi-Modal Face Image Generation
Fuente:
arXiv
Guardado en:
| Autores principales: | Kim, Jihyun, Oh, Changjae, Do, Hoseok, Kim, Soohyun, Sohn, Kwanghoon |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
EBDM: Exemplar-guided Image Translation with Brownian-bridge Diffusion Models
por: Lee, Eungbean, et al.
Publicado: (2024)
por: Lee, Eungbean, et al.
Publicado: (2024)
Descriptive Image-Text Matching with Graded Contextual Similarity
por: Jang, Jinhyun, et al.
Publicado: (2025)
por: Jang, Jinhyun, et al.
Publicado: (2025)
Improving Visual Recognition with Hyperbolical Visual Hierarchy Mapping
por: Kwon, Hyeongjun, et al.
Publicado: (2024)
por: Kwon, Hyeongjun, et al.
Publicado: (2024)
In-N-Out: Faithful 3D GAN Inversion with Volumetric Decomposition for Face Editing
por: Xu, Yiran, et al.
Publicado: (2023)
por: Xu, Yiran, et al.
Publicado: (2023)
Faster Parameter-Efficient Tuning with Token Redundancy Reduction
por: Kim, Kwonyoung, et al.
Publicado: (2025)
por: Kim, Kwonyoung, et al.
Publicado: (2025)
Improving Image De-raining Using Reference-Guided Transformers
por: Ye, Zihao, et al.
Publicado: (2024)
por: Ye, Zihao, et al.
Publicado: (2024)
The Detector Teaches Itself: Lightweight Self-Supervised Adaptation for Open-Vocabulary Object Detection
por: Wan, Yazhe, et al.
Publicado: (2026)
por: Wan, Yazhe, et al.
Publicado: (2026)
Exploiting Diffusion Prior for Task-driven Image Restoration
por: Kim, Jaeha, et al.
Publicado: (2025)
por: Kim, Jaeha, et al.
Publicado: (2025)
Bridging the Skeleton-Text Modality Gap: Diffusion-Powered Modality Alignment for Zero-shot Skeleton-based Action Recognition
por: Do, Jeonghyeok, et al.
Publicado: (2024)
por: Do, Jeonghyeok, et al.
Publicado: (2024)
FlowOVD: Learning Generative Latent Flows for Zero-shot Open-vocabulary Detection
por: Wei, Yao, et al.
Publicado: (2026)
por: Wei, Yao, et al.
Publicado: (2026)
Click-Gaussian: Interactive Segmentation to Any 3D Gaussians
por: Choi, Seokhun, et al.
Publicado: (2024)
por: Choi, Seokhun, et al.
Publicado: (2024)
Bridging Vision and Language Spaces with Assignment Prediction
por: Park, Jungin, et al.
Publicado: (2024)
por: Park, Jungin, et al.
Publicado: (2024)
Saliency-Aware Model Merging
por: Park, Jungin, et al.
Publicado: (2026)
por: Park, Jungin, et al.
Publicado: (2026)
Language-guided Recursive Spatiotemporal Graph Modeling for Video Summarization
por: Park, Jungin, et al.
Publicado: (2025)
por: Park, Jungin, et al.
Publicado: (2025)
Bootstrap Your Own Views: Masked Ego-Exo Modeling for Fine-grained View-invariant Video Representations
por: Park, Jungin, et al.
Publicado: (2025)
por: Park, Jungin, et al.
Publicado: (2025)
V-LynX: Token Interface Alignment for Video+X LLMs
por: Park, Jungin, et al.
Publicado: (2026)
por: Park, Jungin, et al.
Publicado: (2026)
PointFix: Learning to Fix Domain Bias for Robust Online Stereo Adaptation
por: Kim, Kwonyoung, et al.
Publicado: (2022)
por: Kim, Kwonyoung, et al.
Publicado: (2022)
Chain-of-Caption: Training-free improvement of multimodal large language model on referring expression comprehension
por: Pang, Yik Lung, et al.
Publicado: (2026)
por: Pang, Yik Lung, et al.
Publicado: (2026)
Adaptive Multi-Modal Control of Digital Human Hand Synthesis Using a Region-Aware Cycle Loss
por: Fu, Qifan, et al.
Publicado: (2024)
por: Fu, Qifan, et al.
Publicado: (2024)
SteeringTTA: Guiding Diffusion Trajectories for Robust Test-Time-Adaptation
por: Yu, Jihyun, et al.
Publicado: (2025)
por: Yu, Jihyun, et al.
Publicado: (2025)
Oneta: Multi-Style Image Enhancement Using Eigentransformation Functions
por: Kim, Jiwon, et al.
Publicado: (2025)
por: Kim, Jiwon, et al.
Publicado: (2025)
Difference Inversion: Interpolate and Isolate the Difference with Token Consistency for Image Analogy Generation
por: Kim, Hyunsoo, et al.
Publicado: (2025)
por: Kim, Hyunsoo, et al.
Publicado: (2025)
MMPB: It's Time for Multi-Modal Personalization
por: Kim, Jaeik, et al.
Publicado: (2025)
por: Kim, Jaeik, et al.
Publicado: (2025)
IF-MDM: Implicit Face Motion Diffusion Model for High-Fidelity Realtime Talking Head Generation
por: Yang, Sejong, et al.
Publicado: (2024)
por: Yang, Sejong, et al.
Publicado: (2024)
E4S: Fine-grained Face Swapping via Editing With Regional GAN Inversion
por: Li, Maomao, et al.
Publicado: (2023)
por: Li, Maomao, et al.
Publicado: (2023)
High-Fidelity GAN Inversion for Image Attribute Editing
por: Wang, Tengfei, et al.
Publicado: (2021)
por: Wang, Tengfei, et al.
Publicado: (2021)
Improving Generalization of Language-Conditioned Robot Manipulation
por: Cui, Chenglin, et al.
Publicado: (2025)
por: Cui, Chenglin, et al.
Publicado: (2025)
Enhancing Source-Free Domain Adaptive Object Detection with Low-confidence Pseudo Label Distillation
por: Yoon, Ilhoon, et al.
Publicado: (2024)
por: Yoon, Ilhoon, et al.
Publicado: (2024)
ID-EA: Identity-driven Text Enhancement and Adaptation with Textual Inversion for Personalized Text-to-Image Generation
por: Jin, Hyun-Jun, et al.
Publicado: (2025)
por: Jin, Hyun-Jun, et al.
Publicado: (2025)
IdentiFace: Multi-Modal Iterative Diffusion Framework for Identifiable Suspect Face Generation in Crime Investigations
por: Liu, Weichen, et al.
Publicado: (2026)
por: Liu, Weichen, et al.
Publicado: (2026)
Rethinking Open-World Semi-Supervised Learning: Distribution Mismatch and Inductive Inference
por: Park, Seongheon, et al.
Publicado: (2024)
por: Park, Seongheon, et al.
Publicado: (2024)
Sparse multi-view hand-object reconstruction for unseen environments
por: Pang, Yik Lung, et al.
Publicado: (2024)
por: Pang, Yik Lung, et al.
Publicado: (2024)
TTD: Text-Tag Self-Distillation Enhancing Image-Text Alignment in CLIP to Alleviate Single Tag Bias
por: Jo, Sanghyun, et al.
Publicado: (2024)
por: Jo, Sanghyun, et al.
Publicado: (2024)
GAN Inversion for Image Editing via Unsupervised Domain Adaptation
por: Xing, Siyu, et al.
Publicado: (2022)
por: Xing, Siyu, et al.
Publicado: (2022)
High-Fidelity Image Inpainting with Multimodal Guided GAN Inversion
por: Zhang, Libo, et al.
Publicado: (2025)
por: Zhang, Libo, et al.
Publicado: (2025)
Comparison Reveals Commonality: Customized Image Generation through Contrastive Inversion
por: Kim, Minseo, et al.
Publicado: (2025)
por: Kim, Minseo, et al.
Publicado: (2025)
PoseSyn: Synthesizing Diverse 3D Pose Data from In-the-Wild 2D Data
por: Yang, ChangHee, et al.
Publicado: (2025)
por: Yang, ChangHee, et al.
Publicado: (2025)
LADIMO: Face Morph Generation through Biometric Template Inversion with Latent Diffusion
por: Grimmer, Marcel, et al.
Publicado: (2024)
por: Grimmer, Marcel, et al.
Publicado: (2024)
InvertAvatar: Incremental GAN Inversion for Generalized Head Avatars
por: Zhao, Xiaochen, et al.
Publicado: (2023)
por: Zhao, Xiaochen, et al.
Publicado: (2023)
Learning by Erasing: Conditional Entropy based Transferable Out-Of-Distribution Detection
por: Xing, Meng, et al.
Publicado: (2022)
por: Xing, Meng, et al.
Publicado: (2022)
Ejemplares similares
-
EBDM: Exemplar-guided Image Translation with Brownian-bridge Diffusion Models
por: Lee, Eungbean, et al.
Publicado: (2024) -
Descriptive Image-Text Matching with Graded Contextual Similarity
por: Jang, Jinhyun, et al.
Publicado: (2025) -
Improving Visual Recognition with Hyperbolical Visual Hierarchy Mapping
por: Kwon, Hyeongjun, et al.
Publicado: (2024) -
In-N-Out: Faithful 3D GAN Inversion with Volumetric Decomposition for Face Editing
por: Xu, Yiran, et al.
Publicado: (2023) -
Faster Parameter-Efficient Tuning with Token Redundancy Reduction
por: Kim, Kwonyoung, et al.
Publicado: (2025)