DH-FaceVid-1K: A Large-Scale High-Quality Dataset for Face Video Generation
Fuente:
arXiv
Salvato in:
| Autori principali: | Di, Donglin, Feng, He, Sun, Wenzhang, Ma, Yongjia, Li, Hao, Chen, Wei, Fan, Lei, Su, Tonghua, Yang, Xun |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
One-Shot Pose-Driving Face Animation Platform
di: Feng, He, et al.
Pubblicazione: (2024)
di: Feng, He, et al.
Pubblicazione: (2024)
Real Face Video Animation Platform
di: Chen, Xiaokai, et al.
Pubblicazione: (2024)
di: Chen, Xiaokai, et al.
Pubblicazione: (2024)
DiTalker: A Unified DiT-based Framework for High-Quality and Speaking Styles Controllable Portrait Animation
di: Feng, He, et al.
Pubblicazione: (2025)
di: Feng, He, et al.
Pubblicazione: (2025)
CogPortrait: Fine-Grained Eye-Region Control in Portrait Animation via Hierarchical Agent Planning
di: Feng, He, et al.
Pubblicazione: (2026)
di: Feng, He, et al.
Pubblicazione: (2026)
UniCP: A Unified Caching and Pruning Framework for Efficient Video Generation
di: Sun, Wenzhang, et al.
Pubblicazione: (2025)
di: Sun, Wenzhang, et al.
Pubblicazione: (2025)
Adams Bashforth Moulton Solver for Inversion and Editing in Rectified Flow
di: Ma, Yongjia, et al.
Pubblicazione: (2025)
di: Ma, Yongjia, et al.
Pubblicazione: (2025)
EFDiT: Efficient Fine-grained Image Generation Using Diffusion Transformer Models
di: Wang, Kun, et al.
Pubblicazione: (2025)
di: Wang, Kun, et al.
Pubblicazione: (2025)
MoCA: Identity-Preserving Text-to-Video Generation via Mixture of Cross Attention
di: Xie, Qi, et al.
Pubblicazione: (2025)
di: Xie, Qi, et al.
Pubblicazione: (2025)
FVQ: A Large-Scale Dataset and an LMM-based Method for Face Video Quality Assessment
di: Wu, Sijing, et al.
Pubblicazione: (2025)
di: Wu, Sijing, et al.
Pubblicazione: (2025)
OpenHumanVid: A Large-Scale High-Quality Dataset for Enhancing Human-Centric Video Generation
di: Li, Hui, et al.
Pubblicazione: (2024)
di: Li, Hui, et al.
Pubblicazione: (2024)
Spatially Gene Expression Prediction using Dual-Scale Contrastive Learning
di: Qu, Mingcheng, et al.
Pubblicazione: (2025)
di: Qu, Mingcheng, et al.
Pubblicazione: (2025)
Tuning-Free Long Video Generation via Global-Local Collaborative Diffusion
di: Ma, Yongjia, et al.
Pubblicazione: (2025)
di: Ma, Yongjia, et al.
Pubblicazione: (2025)
Efficient, Validation-Free Intrinsic Quality Estimation for Large-Scale Face Recognition Datasets
di: Chen, Zhichao, et al.
Pubblicazione: (2026)
di: Chen, Zhichao, et al.
Pubblicazione: (2026)
OpenVid-1M: A Large-Scale High-Quality Dataset for Text-to-video Generation
di: Nan, Kepan, et al.
Pubblicazione: (2024)
di: Nan, Kepan, et al.
Pubblicazione: (2024)
FOCA: Frequency-Oriented Cross-Domain Forgery Detection, Localization and Explanation via Multi-Modal Large Language Model
di: Liu, Zhou, et al.
Pubblicazione: (2026)
di: Liu, Zhou, et al.
Pubblicazione: (2026)
TV-3DG: Mastering Text-to-3D Customized Generation with Visual Prompt
di: Yang, Jiahui, et al.
Pubblicazione: (2024)
di: Yang, Jiahui, et al.
Pubblicazione: (2024)
EgoVid-5M: A Large-Scale Video-Action Dataset for Egocentric Video Generation
di: Wang, Xiaofeng, et al.
Pubblicazione: (2024)
di: Wang, Xiaofeng, et al.
Pubblicazione: (2024)
VividFace: A Diffusion-Based Hybrid Framework for High-Fidelity Video Face Swapping
di: Shao, Hao, et al.
Pubblicazione: (2024)
di: Shao, Hao, et al.
Pubblicazione: (2024)
VividFace: High-Quality and Efficient One-Step Diffusion For Video Face Enhancement
di: Zhang, Shulian, et al.
Pubblicazione: (2025)
di: Zhang, Shulian, et al.
Pubblicazione: (2025)
FaceID-6M: A Large-Scale, Open-Source FaceID Customization Dataset
di: Wang, Shuhe, et al.
Pubblicazione: (2025)
di: Wang, Shuhe, et al.
Pubblicazione: (2025)
Boundary-Guided Learning for Gene Expression Prediction in Spatial Transcriptomics
di: Qu, Mingcheng, et al.
Pubblicazione: (2024)
di: Qu, Mingcheng, et al.
Pubblicazione: (2024)
UniVid: Pyramid Diffusion Model for High Quality Video Generation
di: Xiao, Xinyu, et al.
Pubblicazione: (2026)
di: Xiao, Xinyu, et al.
Pubblicazione: (2026)
BlockVid: Block Diffusion for High-Quality and Consistent Minute-Long Video Generation
di: Zhang, Zeyu, et al.
Pubblicazione: (2025)
di: Zhang, Zeyu, et al.
Pubblicazione: (2025)
Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality
di: Luo, Zekai, et al.
Pubblicazione: (2025)
di: Luo, Zekai, et al.
Pubblicazione: (2025)
VidEvent: A Large Dataset for Understanding Dynamic Evolution of Events in Videos
di: Liang, Baoyu, et al.
Pubblicazione: (2025)
di: Liang, Baoyu, et al.
Pubblicazione: (2025)
Face-MLLM: A Large Face Perception Model
di: Sun, Haomiao, et al.
Pubblicazione: (2024)
di: Sun, Haomiao, et al.
Pubblicazione: (2024)
Face-to-Face: A Video Dataset for Multi-Person Interaction Modeling
di: Chu, Ernie, et al.
Pubblicazione: (2026)
di: Chu, Ernie, et al.
Pubblicazione: (2026)
DynamicFace: High-Quality and Consistent Face Swapping for Image and Video using Composable 3D Facial Priors
di: Wang, Runqi, et al.
Pubblicazione: (2025)
di: Wang, Runqi, et al.
Pubblicazione: (2025)
RepFace: Refining Closed-Set Noise with Progressive Label Correction for Face Recognition
di: Zhang, Jie, et al.
Pubblicazione: (2024)
di: Zhang, Jie, et al.
Pubblicazione: (2024)
Global-Local Aware Scene Text Editing
di: Yang, Fuxiang, et al.
Pubblicazione: (2025)
di: Yang, Fuxiang, et al.
Pubblicazione: (2025)
Multimodal Cancer Survival Analysis via Hypergraph Learning with Cross-Modality Rebalance
di: Qu, Mingcheng, et al.
Pubblicazione: (2025)
di: Qu, Mingcheng, et al.
Pubblicazione: (2025)
Memory-Augmented Incomplete Multimodal Survival Prediction via Cross-Slide and Gene-Attentive Hypergraph Learning
di: Qu, Mingcheng, et al.
Pubblicazione: (2025)
di: Qu, Mingcheng, et al.
Pubblicazione: (2025)
Chain of World: World Model Thinking in Latent Motion
di: Yang, Fuxiang, et al.
Pubblicazione: (2026)
di: Yang, Fuxiang, et al.
Pubblicazione: (2026)
InternVid: A Large-scale Video-Text Dataset for Multimodal Understanding and Generation
di: Wang, Yi, et al.
Pubblicazione: (2023)
di: Wang, Yi, et al.
Pubblicazione: (2023)
FaceShield: Explainable Face Anti-Spoofing with Multimodal Large Language Models
di: Wang, Hongyang, et al.
Pubblicazione: (2025)
di: Wang, Hongyang, et al.
Pubblicazione: (2025)
Vec2Face: Scaling Face Dataset Generation with Loosely Constrained Vectors
di: Wu, Haiyu, et al.
Pubblicazione: (2024)
di: Wu, Haiyu, et al.
Pubblicazione: (2024)
Hi-VAE: Efficient Video Autoencoding with Global and Detailed Motion
di: Liu, Huaize, et al.
Pubblicazione: (2025)
di: Liu, Huaize, et al.
Pubblicazione: (2025)
VidGen-1M: A Large-Scale Dataset for Text-to-video Generation
di: Tan, Zhiyu, et al.
Pubblicazione: (2024)
di: Tan, Zhiyu, et al.
Pubblicazione: (2024)
RealFace -- Pedestrian Face Dataset
di: Thomas, Leonardo Ramos
Pubblicazione: (2024)
di: Thomas, Leonardo Ramos
Pubblicazione: (2024)
VidLA: Video-Language Alignment at Scale
di: Rizve, Mamshad Nayeem, et al.
Pubblicazione: (2024)
di: Rizve, Mamshad Nayeem, et al.
Pubblicazione: (2024)
Documenti analoghi
-
One-Shot Pose-Driving Face Animation Platform
di: Feng, He, et al.
Pubblicazione: (2024) -
Real Face Video Animation Platform
di: Chen, Xiaokai, et al.
Pubblicazione: (2024) -
DiTalker: A Unified DiT-based Framework for High-Quality and Speaking Styles Controllable Portrait Animation
di: Feng, He, et al.
Pubblicazione: (2025) -
CogPortrait: Fine-Grained Eye-Region Control in Portrait Animation via Hierarchical Agent Planning
di: Feng, He, et al.
Pubblicazione: (2026) -
UniCP: A Unified Caching and Pruning Framework for Efficient Video Generation
di: Sun, Wenzhang, et al.
Pubblicazione: (2025)