Text-Driven Diverse Facial Texture Generation via Progressive Latent-Space Refinement
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Chi, Huang, Junming, Zhang, Rong, Wang, Qi, Yang, Haotian, Huang, Haibin, Ma, Chongyang, Xu, Weiwei |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
InterFusion: Text-Driven Generation of 3D Human-Object Interaction
di: Dai, Sisi, et al.
Pubblicazione: (2024)
di: Dai, Sisi, et al.
Pubblicazione: (2024)
LGTM: Local-to-Global Text-Driven Human Motion Diffusion Model
di: Sun, Haowen, et al.
Pubblicazione: (2024)
di: Sun, Haowen, et al.
Pubblicazione: (2024)
HetScene: Heterogeneity-Aware Diffusion for Dense Indoor Scene Generation
di: Chen, Zini, et al.
Pubblicazione: (2026)
di: Chen, Zini, et al.
Pubblicazione: (2026)
ATI: Any Trajectory Instruction for Controllable Video Generation
di: Wang, Angtian, et al.
Pubblicazione: (2025)
di: Wang, Angtian, et al.
Pubblicazione: (2025)
CG-MLLM: Captioning and Generating 3D content via Multi-modal Large Language Models
di: Huang, Junming, et al.
Pubblicazione: (2026)
di: Huang, Junming, et al.
Pubblicazione: (2026)
VRMM: A Volumetric Relightable Morphable Head Model
di: Yang, Haotian, et al.
Pubblicazione: (2024)
di: Yang, Haotian, et al.
Pubblicazione: (2024)
VividAnimator: An End-to-End Audio and Pose-driven Half-Body Human Animation Framework
di: Huang, Donglin, et al.
Pubblicazione: (2025)
di: Huang, Donglin, et al.
Pubblicazione: (2025)
UniTransfer: Video Concept Transfer via Progressive Spatial and Timestep Decomposition
di: Lei, Guojun, et al.
Pubblicazione: (2025)
di: Lei, Guojun, et al.
Pubblicazione: (2025)
Spatial and Surface Correspondence Field for Interaction Transfer
di: Huang, Zeyu, et al.
Pubblicazione: (2024)
di: Huang, Zeyu, et al.
Pubblicazione: (2024)
NaTex: Seamless Texture Generation as Latent Color Diffusion
di: Lai, Zeqiang, et al.
Pubblicazione: (2025)
di: Lai, Zeqiang, et al.
Pubblicazione: (2025)
IP-Prompter: Training-Free Theme-Specific Image Generation via Dynamic Visual Prompting
di: Zhang, Yuxin, et al.
Pubblicazione: (2025)
di: Zhang, Yuxin, et al.
Pubblicazione: (2025)
FaceRefiner: High-Fidelity Facial Texture Refinement with Differentiable Rendering-based Style Transfer
di: Li, Chengyang, et al.
Pubblicazione: (2026)
di: Li, Chengyang, et al.
Pubblicazione: (2026)
CINEMA: Coherent Multi-Subject Video Generation via MLLM-Based Guidance
di: Deng, Yufan, et al.
Pubblicazione: (2025)
di: Deng, Yufan, et al.
Pubblicazione: (2025)
MotionCrafter: One-Shot Motion Customization of Diffusion Models
di: Zhang, Yuxin, et al.
Pubblicazione: (2023)
di: Zhang, Yuxin, et al.
Pubblicazione: (2023)
Generalize Polyp Segmentation via Inpainting across Diverse Backgrounds and Pseudo-Mask Refinement
di: Ma, Jiajian, et al.
Pubblicazione: (2024)
di: Ma, Jiajian, et al.
Pubblicazione: (2024)
FSVideo: Fast Speed Video Diffusion Model in a Highly-Compressed Latent Space
di: FSVideo Team, et al.
Pubblicazione: (2026)
di: FSVideo Team, et al.
Pubblicazione: (2026)
MatLat: Material Latent Space for PBR Texture Generation
di: Yeo, Kyeongmin, et al.
Pubblicazione: (2025)
di: Yeo, Kyeongmin, et al.
Pubblicazione: (2025)
Latent Harmony: Synergistic Unified UHD Image Restoration via Latent Space Regularization and Controllable Refinement
di: Liu, Yidi, et al.
Pubblicazione: (2025)
di: Liu, Yidi, et al.
Pubblicazione: (2025)
Boosting Point-supervised Temporal Action Localization via Text Refinement and Alignment
di: Ma, Yunchuan, et al.
Pubblicazione: (2026)
di: Ma, Yunchuan, et al.
Pubblicazione: (2026)
Refaçade: Editing Object with Given Reference Texture
di: Huang, Youze, et al.
Pubblicazione: (2025)
di: Huang, Youze, et al.
Pubblicazione: (2025)
Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models
di: Guo, Jiayi, et al.
Pubblicazione: (2026)
di: Guo, Jiayi, et al.
Pubblicazione: (2026)
BeautyBank: Encoding Facial Makeup in Latent Space
di: Lu, Qianwen, et al.
Pubblicazione: (2024)
di: Lu, Qianwen, et al.
Pubblicazione: (2024)
Direct-a-Video: Customized Video Generation with User-Directed Camera Movement and Object Motion
di: Yang, Shiyuan, et al.
Pubblicazione: (2024)
di: Yang, Shiyuan, et al.
Pubblicazione: (2024)
TGT: Text-Grounded Trajectories for Locally Controlled Video Generation
di: Zhang, Guofeng, et al.
Pubblicazione: (2025)
di: Zhang, Guofeng, et al.
Pubblicazione: (2025)
Image Inpainting via Conditional Texture and Structure Dual Generation
di: Guo, Xiefan, et al.
Pubblicazione: (2021)
di: Guo, Xiefan, et al.
Pubblicazione: (2021)
ReactDiff: Latent Diffusion for Facial Reaction Generation
di: Li, Jiaming, et al.
Pubblicazione: (2025)
di: Li, Jiaming, et al.
Pubblicazione: (2025)
Stability-Driven Motion Generation for Object-Guided Human-Human Co-Manipulation
di: Xu, Jiahao, et al.
Pubblicazione: (2026)
di: Xu, Jiahao, et al.
Pubblicazione: (2026)
High-Fidelity Facial Albedo Estimation via Texture Quantization
di: Ran, Zimin, et al.
Pubblicazione: (2024)
di: Ran, Zimin, et al.
Pubblicazione: (2024)
TempoMaster: Efficient Long Video Generation via Next-Frame-Rate Prediction
di: Ma, Yukuo, et al.
Pubblicazione: (2025)
di: Ma, Yukuo, et al.
Pubblicazione: (2025)
AnimateAnything: Consistent and Controllable Animation for Video Generation
di: Lei, Guojun, et al.
Pubblicazione: (2024)
di: Lei, Guojun, et al.
Pubblicazione: (2024)
GLDiTalker: Speech-Driven 3D Facial Animation with Graph Latent Diffusion Transformer
di: Lin, Yihong, et al.
Pubblicazione: (2024)
di: Lin, Yihong, et al.
Pubblicazione: (2024)
When Words Smile: Generating Diverse Emotional Facial Expressions from Text
di: Xu, Haidong, et al.
Pubblicazione: (2024)
di: Xu, Haidong, et al.
Pubblicazione: (2024)
SwapTalk: Audio-Driven Talking Face Generation with One-Shot Customization in Latent Space
di: Zhang, Zeren, et al.
Pubblicazione: (2024)
di: Zhang, Zeren, et al.
Pubblicazione: (2024)
Nodule-Aligned Latent Space Learning with LLM-Driven Multimodal Diffusion for Lung Nodule Progression Prediction
di: Song, James, et al.
Pubblicazione: (2026)
di: Song, James, et al.
Pubblicazione: (2026)
ViMo: Generating Motions from Casual Videos
di: Qiu, Liangdong, et al.
Pubblicazione: (2024)
di: Qiu, Liangdong, et al.
Pubblicazione: (2024)
HECTOR: Hybrid Editable Compositional Object References for Video Generation
di: Zhang, Guofeng, et al.
Pubblicazione: (2026)
di: Zhang, Guofeng, et al.
Pubblicazione: (2026)
TKFNet: Learning Texture Key Factor Driven Feature for Facial Expression Recognition
di: Deng, Liqian
Pubblicazione: (2025)
di: Deng, Liqian
Pubblicazione: (2025)
Fine-Grained Controllable Apparel Showcase Image Generation via Garment-Centric Outpainting
di: Zhang, Rong, et al.
Pubblicazione: (2025)
di: Zhang, Rong, et al.
Pubblicazione: (2025)
Creating a Microstructure Latent Space with Rich Material Information for Multiphase Alloy Design
di: Ma, Xudong, et al.
Pubblicazione: (2024)
di: Ma, Xudong, et al.
Pubblicazione: (2024)
VIVA: VLM-Guided Instruction-Based Video Editing with Reward Optimization
di: Cong, Xiaoyan, et al.
Pubblicazione: (2025)
di: Cong, Xiaoyan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
InterFusion: Text-Driven Generation of 3D Human-Object Interaction
di: Dai, Sisi, et al.
Pubblicazione: (2024) -
LGTM: Local-to-Global Text-Driven Human Motion Diffusion Model
di: Sun, Haowen, et al.
Pubblicazione: (2024) -
HetScene: Heterogeneity-Aware Diffusion for Dense Indoor Scene Generation
di: Chen, Zini, et al.
Pubblicazione: (2026) -
ATI: Any Trajectory Instruction for Controllable Video Generation
di: Wang, Angtian, et al.
Pubblicazione: (2025) -
CG-MLLM: Captioning and Generating 3D content via Multi-modal Large Language Models
di: Huang, Junming, et al.
Pubblicazione: (2026)