Audio-driven High-resolution Seamless Talking Head Video Editing via StyleGAN
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Su, Jiacheng, Liu, Kunhong, Chen, Liyan, Yao, Junfeng, Liu, Qingsong, Lv, Dongdong |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
GaussianStyle: Gaussian Head Avatar via StyleGAN
par: Liu, Pinxin, et autres
Publié: (2024)
par: Liu, Pinxin, et autres
Publié: (2024)
VidStyleODE: Disentangled Video Editing via StyleGAN and NeuralODEs
par: Ali, Moayed Haji, et autres
Publié: (2023)
par: Ali, Moayed Haji, et autres
Publié: (2023)
Face Generation and Editing with StyleGAN: A Survey
par: Melnik, Andrew, et autres
Publié: (2022)
par: Melnik, Andrew, et autres
Publié: (2022)
The Devil is in the Details: StyleFeatureEditor for Detail-Rich StyleGAN Inversion and High Quality Image Editing
par: Bobkov, Denis, et autres
Publié: (2024)
par: Bobkov, Denis, et autres
Publié: (2024)
RefineStyle: Dynamic Convolution Refinement for StyleGAN
par: Xia, Siwei, et autres
Publié: (2024)
par: Xia, Siwei, et autres
Publié: (2024)
Diversity-aware Channel Pruning for StyleGAN Compression
par: Chung, Jiwoo, et autres
Publié: (2024)
par: Chung, Jiwoo, et autres
Publié: (2024)
ToonifyGB: StyleGAN-based Gaussian Blendshapes for 3D Stylized Head Avatars
par: Ju, Rui-Yang, et autres
Publié: (2025)
par: Ju, Rui-Yang, et autres
Publié: (2025)
Language-Guided Face Animation by Recurrent StyleGAN-based Generator
par: Hang, Tiankai, et autres
Publié: (2022)
par: Hang, Tiankai, et autres
Publié: (2022)
MambaStyle: Efficient StyleGAN Inversion for Real Image Editing with State-Space Models
par: Lopez, Jhon, et autres
Publié: (2025)
par: Lopez, Jhon, et autres
Publié: (2025)
Pose and Facial Expression Transfer by using StyleGAN
par: Jahoda, Petr, et autres
Publié: (2025)
par: Jahoda, Petr, et autres
Publié: (2025)
StyleHumanCLIP: Text-guided Garment Manipulation for StyleGAN-Human
par: Yoshikawa, Takato, et autres
Publié: (2023)
par: Yoshikawa, Takato, et autres
Publié: (2023)
StyleCineGAN: Landscape Cinemagraph Generation using a Pre-trained StyleGAN
par: Choi, Jongwoo, et autres
Publié: (2024)
par: Choi, Jongwoo, et autres
Publié: (2024)
PS-StyleGAN: Illustrative Portrait Sketching using Attention-Based Style Adaptation
par: Jain, Kushal Kumar, et autres
Publié: (2024)
par: Jain, Kushal Kumar, et autres
Publié: (2024)
StyleTalker: One-shot Style-based Audio-driven Talking Head Video Generation
par: Min, Dongchan, et autres
Publié: (2022)
par: Min, Dongchan, et autres
Publié: (2022)
Rethinking Image Skip Connections in StyleGAN2
par: Park, Seung, et autres
Publié: (2024)
par: Park, Seung, et autres
Publié: (2024)
StyleAutoEncoder for manipulating image attributes using pre-trained StyleGAN
par: Bedychaj, Andrzej, et autres
Publié: (2024)
par: Bedychaj, Andrzej, et autres
Publié: (2024)
Identity-Preserving Aging and De-Aging of Faces in the StyleGAN Latent Space
par: Luevano, Luis S., et autres
Publié: (2025)
par: Luevano, Luis S., et autres
Publié: (2025)
One-for-All: Towards Universal Domain Translation with a Single StyleGAN
par: Du, Yong, et autres
Publié: (2023)
par: Du, Yong, et autres
Publié: (2023)
Generative Fields: Uncovering Hierarchical Feature Control for StyleGAN via Inverted Receptive Fields
par: He, Zhuo, et autres
Publié: (2025)
par: He, Zhuo, et autres
Publié: (2025)
StyleGAN3: Generative Networks for Improving the Equivariance of Translation and Rotation
par: Zhu, Tianlei, et autres
Publié: (2023)
par: Zhu, Tianlei, et autres
Publié: (2023)
StyleTalk++: A Unified Framework for Controlling the Speaking Styles of Talking Heads
par: Wang, Suzhen, et autres
Publié: (2024)
par: Wang, Suzhen, et autres
Publié: (2024)
E2F-Net: Eyes-to-Face Inpainting via StyleGAN Latent Space
par: Hassanpour, Ahmad, et autres
Publié: (2024)
par: Hassanpour, Ahmad, et autres
Publié: (2024)
Motion Transfer-Enhanced StyleGAN for Generating Diverse Macaque Facial Expressions
par: Igaue, Takuya, et autres
Publié: (2025)
par: Igaue, Takuya, et autres
Publié: (2025)
A Multi-domain Image Translative Diffusion StyleGAN for Iris Presentation Attack Detection
par: Yadav, Shivangi, et autres
Publié: (2025)
par: Yadav, Shivangi, et autres
Publié: (2025)
A Comparative Study of Perceptual Quality Metrics for Audio-driven Talking Head Videos
par: Zhang, Weixia, et autres
Publié: (2024)
par: Zhang, Weixia, et autres
Publié: (2024)
LatentForensics: Towards frugal deepfake detection in the StyleGAN latent space
par: Delmas, Matthieu, et autres
Publié: (2023)
par: Delmas, Matthieu, et autres
Publié: (2023)
Deep Learning for Cancer Prognosis Prediction Using Portrait Photos by StyleGAN Embedding
par: Hagag, Amr, et autres
Publié: (2023)
par: Hagag, Amr, et autres
Publié: (2023)
TalkCLIP: Talking Head Generation with Text-Guided Expressive Speaking Styles
par: Ma, Yifeng, et autres
Publié: (2023)
par: Ma, Yifeng, et autres
Publié: (2023)
JoyGen: Audio-Driven 3D Depth-Aware Talking-Face Video Editing
par: Wang, Qili, et autres
Publié: (2025)
par: Wang, Qili, et autres
Publié: (2025)
Dimitra: Audio-driven Diffusion model for Expressive Talking Head Generation
par: Chopin, Baptiste, et autres
Publié: (2025)
par: Chopin, Baptiste, et autres
Publié: (2025)
Style2Talker: High-Resolution Talking Head Generation with Emotion Style and Art Style
par: Tan, Shuai, et autres
Publié: (2024)
par: Tan, Shuai, et autres
Publié: (2024)
InfiniteTalk: Audio-driven Video Generation for Sparse-Frame Video Dubbing
par: Yang, Shaoshu, et autres
Publié: (2025)
par: Yang, Shaoshu, et autres
Publié: (2025)
EmotiveTalk: Expressive Talking Head Generation through Audio Information Decoupling and Emotional Video Diffusion
par: Wang, Haotian, et autres
Publié: (2024)
par: Wang, Haotian, et autres
Publié: (2024)
Tackling fake images in cybersecurity -- Interpretation of a StyleGAN and lifting its black-box
par: Laubmann, Julia, et autres
Publié: (2025)
par: Laubmann, Julia, et autres
Publié: (2025)
Controlling Face's Frame generation in StyleGAN's latent space operations: Modifying faces to deceive our memory
par: Roca, Agustín, et autres
Publié: (2024)
par: Roca, Agustín, et autres
Publié: (2024)
GPSwap: High‐resolution face swapping based on StyleGAN prior
par: Dongjin Huang, et autres
Publié: (2024)
par: Dongjin Huang, et autres
Publié: (2024)
READ: Real-time and Efficient Asynchronous Diffusion for Audio-driven Talking Head Generation
par: Wang, Haotian, et autres
Publié: (2025)
par: Wang, Haotian, et autres
Publié: (2025)
Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling
par: Zhang, Min, et autres
Publié: (2024)
par: Zhang, Min, et autres
Publié: (2024)
GaussianHeadTalk: Wobble-Free 3D Talking Heads with Audio Driven Gaussian Splatting
par: Agarwal, Madhav, et autres
Publié: (2025)
par: Agarwal, Madhav, et autres
Publié: (2025)
Audio-Visual Driven Compression for Low-Bitrate Talking Head Videos
par: Takahashi, Riku, et autres
Publié: (2025)
par: Takahashi, Riku, et autres
Publié: (2025)
Documents similaires
-
GaussianStyle: Gaussian Head Avatar via StyleGAN
par: Liu, Pinxin, et autres
Publié: (2024) -
VidStyleODE: Disentangled Video Editing via StyleGAN and NeuralODEs
par: Ali, Moayed Haji, et autres
Publié: (2023) -
Face Generation and Editing with StyleGAN: A Survey
par: Melnik, Andrew, et autres
Publié: (2022) -
The Devil is in the Details: StyleFeatureEditor for Detail-Rich StyleGAN Inversion and High Quality Image Editing
par: Bobkov, Denis, et autres
Publié: (2024) -
RefineStyle: Dynamic Convolution Refinement for StyleGAN
par: Xia, Siwei, et autres
Publié: (2024)