Diff-PC: Identity-preserving and 3D-aware Controllable Diffusion for Zero-shot Portrait Customization
Fuente:
arXiv
Guardado en:
| Autores principales: | Xu, Yifang, Zhai, Benxiang, Zhang, Chenyu, Li, Ming, Li, Yang, Du, Sidan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
HiFi-Portrait: Zero-shot Identity-preserved Portrait Generation with High-fidelity Multi-face Fusion
por: Xu, Yifang, et al.
Publicado: (2025)
por: Xu, Yifang, et al.
Publicado: (2025)
FaceSnap: Enhanced ID-fidelity Network for Tuning-free Portrait Customization
por: Zhai, Benxiang, et al.
Publicado: (2026)
por: Zhai, Benxiang, et al.
Publicado: (2026)
Zero-shot Video Moment Retrieval via Off-the-shelf Multimodal Large Language Models
por: Xu, Yifang, et al.
Publicado: (2025)
por: Xu, Yifang, et al.
Publicado: (2025)
VTG-GPT: Tuning-Free Zero-Shot Video Temporal Grounding with GPT
por: Xu, Yifang, et al.
Publicado: (2024)
por: Xu, Yifang, et al.
Publicado: (2024)
Multi-modal Fusion and Query Refinement Network for Video Moment Retrieval and Highlight Detection
por: Xu, Yifang, et al.
Publicado: (2025)
por: Xu, Yifang, et al.
Publicado: (2025)
DiffPortrait3D: Controllable Diffusion for Zero-Shot Portrait View Synthesis
por: Gu, Yuming, et al.
Publicado: (2023)
por: Gu, Yuming, et al.
Publicado: (2023)
Pyramid Feature Attention Network for Monocular Depth Prediction
por: Xu, Yifang, et al.
Publicado: (2024)
por: Xu, Yifang, et al.
Publicado: (2024)
DiffPortrait360: Consistent Portrait Diffusion for 360 View Synthesis
por: Gu, Yuming, et al.
Publicado: (2025)
por: Gu, Yuming, et al.
Publicado: (2025)
EmojiDiff: Advanced Facial Expression Control with High Identity Preservation in Portrait Generation
por: Jiang, Liangwei, et al.
Publicado: (2024)
por: Jiang, Liangwei, et al.
Publicado: (2024)
Real3D-Portrait: One-shot Realistic 3D Talking Portrait Synthesis
por: Ye, Zhenhui, et al.
Publicado: (2024)
por: Ye, Zhenhui, et al.
Publicado: (2024)
Tex4D: Zero-shot 4D Scene Texturing with Video Diffusion Models
por: Bao, Jingzhi, et al.
Publicado: (2024)
por: Bao, Jingzhi, et al.
Publicado: (2024)
GroupDiff: Diffusion-based Group Portrait Editing
por: Jiang, Yuming, et al.
Publicado: (2024)
por: Jiang, Yuming, et al.
Publicado: (2024)
GenPC: Zero-shot Point Cloud Completion via 3D Generative Priors
por: Li, An, et al.
Publicado: (2025)
por: Li, An, et al.
Publicado: (2025)
ZeroDiff++: Substantial Unseen Visual-semantic Correlation in Zero-shot Learning
por: Ye, Zihan, et al.
Publicado: (2026)
por: Ye, Zihan, et al.
Publicado: (2026)
GPTSee: Enhancing Moment Retrieval and Highlight Detection via Description-Based Similarity Features
por: Sun, Yunzhuo, et al.
Publicado: (2024)
por: Sun, Yunzhuo, et al.
Publicado: (2024)
DiffSwap++: 3D Latent-Controlled Diffusion for Identity-Preserving Face Swapping
por: Bondurant, Weston, et al.
Publicado: (2025)
por: Bondurant, Weston, et al.
Publicado: (2025)
LaxMotion: Rethinking Supervision Granularity for 3D Human Motion Generation
por: Liu, Sheng, et al.
Publicado: (2025)
por: Liu, Sheng, et al.
Publicado: (2025)
MaTe3D: Mask-guided Text-based 3D-aware Portrait Editing
por: Zhou, Kangneng, et al.
Publicado: (2023)
por: Zhou, Kangneng, et al.
Publicado: (2023)
VideoMaker: Zero-shot Customized Video Generation with the Inherent Force of Video Diffusion Models
por: Wu, Tao, et al.
Publicado: (2024)
por: Wu, Tao, et al.
Publicado: (2024)
DiffAge3D: Diffusion-based 3D-aware Face Aging
por: Wahid, Junaid, et al.
Publicado: (2024)
por: Wahid, Junaid, et al.
Publicado: (2024)
IM-Portrait: Learning 3D-aware Video Diffusion for Photorealistic Talking Heads from Monocular Videos
por: Li, Yuan, et al.
Publicado: (2025)
por: Li, Yuan, et al.
Publicado: (2025)
MotionDiff: Training-free Zero-shot Interactive Motion Editing via Flow-assisted Multi-view Diffusion
por: Ma, Yikun, et al.
Publicado: (2025)
por: Ma, Yikun, et al.
Publicado: (2025)
MegaPortrait: Revisiting Diffusion Control for High-fidelity Portrait Generation
por: Yang, Han, et al.
Publicado: (2024)
por: Yang, Han, et al.
Publicado: (2024)
InstantID: Zero-shot Identity-Preserving Generation in Seconds
por: Wang, Qixun, et al.
Publicado: (2024)
por: Wang, Qixun, et al.
Publicado: (2024)
DiffTF++: 3D-aware Diffusion Transformer for Large-Vocabulary 3D Generation
por: Cao, Ziang, et al.
Publicado: (2024)
por: Cao, Ziang, et al.
Publicado: (2024)
Perception-as-Control: Fine-grained Controllable Image Animation with 3D-aware Motion Representation
por: Chen, Yingjie, et al.
Publicado: (2025)
por: Chen, Yingjie, et al.
Publicado: (2025)
Robust and Flexible Omnidirectional Depth Estimation with Multiple 360-degree Cameras
por: Li, Ming, et al.
Publicado: (2024)
por: Li, Ming, et al.
Publicado: (2024)
Reference-Free Omnidirectional Stereo Matching via Multi-View Consistency Maximization
por: Xu, Lehuai, et al.
Publicado: (2026)
por: Xu, Lehuai, et al.
Publicado: (2026)
Real-time 3D-aware Portrait Editing from a Single Image
por: Bai, Qingyan, et al.
Publicado: (2024)
por: Bai, Qingyan, et al.
Publicado: (2024)
Real-time 3D-aware Portrait Video Relighting
por: Cai, Ziqi, et al.
Publicado: (2024)
por: Cai, Ziqi, et al.
Publicado: (2024)
PIDiff: Image Customization for Personalized Identities with Diffusion Models
por: Gu, Jinyu, et al.
Publicado: (2025)
por: Gu, Jinyu, et al.
Publicado: (2025)
SPF-Portrait: Towards Pure Text-to-Portrait Customization with Semantic Pollution-Free Fine-Tuning
por: Xian, Xiaole, et al.
Publicado: (2025)
por: Xian, Xiaole, et al.
Publicado: (2025)
StructDiff: Structure-aware Diffusion Model for 3D Fine-grained Medical Image Synthesis
por: Xia, Jiahao, et al.
Publicado: (2025)
por: Xia, Jiahao, et al.
Publicado: (2025)
Uni-Inter: Unifying 3D Human Motion Synthesis Across Diverse Interaction Contexts
por: Liu, Sheng, et al.
Publicado: (2025)
por: Liu, Sheng, et al.
Publicado: (2025)
AnyDoor: Zero-shot Object-level Image Customization
por: Chen, Xi, et al.
Publicado: (2023)
por: Chen, Xi, et al.
Publicado: (2023)
EmoDiffTalk:Emotion-aware Diffusion for Editable 3D Gaussian Talking Head
por: Liu, Chang, et al.
Publicado: (2025)
por: Liu, Chang, et al.
Publicado: (2025)
DiffSensei: Bridging Multi-Modal LLMs and Diffusion Models for Customized Manga Generation
por: Wu, Jianzong, et al.
Publicado: (2024)
por: Wu, Jianzong, et al.
Publicado: (2024)
Magic-Me: Identity-Specific Video Customized Diffusion
por: Ma, Ze, et al.
Publicado: (2024)
por: Ma, Ze, et al.
Publicado: (2024)
CustomVideoX: 3D Reference Attention Driven Dynamic Adaptation for Zero-Shot Customized Video Diffusion Transformers
por: She, D., et al.
Publicado: (2025)
por: She, D., et al.
Publicado: (2025)
DiffCLIP: Few-shot Language-driven Multimodal Classifier
por: Zhang, Jiaqing, et al.
Publicado: (2024)
por: Zhang, Jiaqing, et al.
Publicado: (2024)
Ejemplares similares
-
HiFi-Portrait: Zero-shot Identity-preserved Portrait Generation with High-fidelity Multi-face Fusion
por: Xu, Yifang, et al.
Publicado: (2025) -
FaceSnap: Enhanced ID-fidelity Network for Tuning-free Portrait Customization
por: Zhai, Benxiang, et al.
Publicado: (2026) -
Zero-shot Video Moment Retrieval via Off-the-shelf Multimodal Large Language Models
por: Xu, Yifang, et al.
Publicado: (2025) -
VTG-GPT: Tuning-Free Zero-Shot Video Temporal Grounding with GPT
por: Xu, Yifang, et al.
Publicado: (2024) -
Multi-modal Fusion and Query Refinement Network for Video Moment Retrieval and Highlight Detection
por: Xu, Yifang, et al.
Publicado: (2025)