Efficient Video Face Enhancement with Enhanced Spatial-Temporal Consistency
Fuente:
arXiv
Saved in:
| Main Authors: | Wang, Yutong, Teng, Jiajie, Cao, Jiajiong, Li, Yuming, Ma, Chenguang, Xu, Hongteng, Luo, Dixin |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Generalizable Face Landmarking Guided by Conditional Face Warping
by: Liang, Jiayi, et al.
Published: (2024)
by: Liang, Jiayi, et al.
Published: (2024)
Self-Paced and Self-Corrective Masked Prediction for Movie Trailer Generation
by: Zhu, Sidan, et al.
Published: (2025)
by: Zhu, Sidan, et al.
Published: (2025)
EchoMimic: Lifelike Audio-Driven Portrait Animations through Editable Landmark Conditions
by: Chen, Zhiyuan, et al.
Published: (2024)
by: Chen, Zhiyuan, et al.
Published: (2024)
Low-Light Video Enhancement via Spatial-Temporal Consistent Decomposition
by: Xu, Xiaogang, et al.
Published: (2024)
by: Xu, Xiaogang, et al.
Published: (2024)
SpeedUpNet: A Plug-and-Play Adapter Network for Accelerating Text-to-Image Diffusion Models
by: Chai, Weilong, et al.
Published: (2023)
by: Chai, Weilong, et al.
Published: (2023)
EchoTorrent: Towards Swift, Sustained, and Streaming Multi-Modal Video Generation
by: Meng, Rang, et al.
Published: (2026)
by: Meng, Rang, et al.
Published: (2026)
Collaborative Face Experts Fusion in Video Generation: Boosting Identity Consistency Across Large Face Poses
by: Wang, Yuji, et al.
Published: (2025)
by: Wang, Yuji, et al.
Published: (2025)
VividFace: High-Quality and Efficient One-Step Diffusion For Video Face Enhancement
by: Zhang, Shulian, et al.
Published: (2025)
by: Zhang, Shulian, et al.
Published: (2025)
Low-Light Video Enhancement with An Effective Spatial-Temporal Decomposition Paradigm
by: Xu, Xiaogang, et al.
Published: (2026)
by: Xu, Xiaogang, et al.
Published: (2026)
Spatial-Temporal Decoupled Reference Conditioning for Identity-Preserving Text-to-Video Generation
by: Chen, Yuheng, et al.
Published: (2026)
by: Chen, Yuheng, et al.
Published: (2026)
V-CAST: Video Curvature-Aware Spatio-Temporal Pruning for Efficient Video Large Language Models
by: Lin, Xinying, et al.
Published: (2026)
by: Lin, Xinying, et al.
Published: (2026)
PNeRV: Enhancing Spatial Consistency via Pyramidal Neural Representation for Videos
by: Zhao, Qi, et al.
Published: (2024)
by: Zhao, Qi, et al.
Published: (2024)
T2SGrid: Temporal-to-Spatial Gridification for Video Temporal Grounding
by: Guo, Chaohong, et al.
Published: (2026)
by: Guo, Chaohong, et al.
Published: (2026)
Video Forgery Detection with Optical Flow Residuals and Spatial-Temporal Consistency
by: Xue, Xi, et al.
Published: (2025)
by: Xue, Xi, et al.
Published: (2025)
EchoMimicV2: Towards Striking, Simplified, and Semi-Body Human Animation
by: Meng, Rang, et al.
Published: (2024)
by: Meng, Rang, et al.
Published: (2024)
Self-Supervised Class-Agnostic Motion Prediction with Spatial and Temporal Consistency Regularizations
by: Wang, Kewei, et al.
Published: (2024)
by: Wang, Kewei, et al.
Published: (2024)
Spatial Degradation-Aware and Temporal Consistent Diffusion Model for Compressed Video Super-Resolution
by: An, Hongyu, et al.
Published: (2025)
by: An, Hongyu, et al.
Published: (2025)
DiffMagicFace: Identity Consistent Facial Editing of Real Videos
by: Yin, Huanghao, et al.
Published: (2026)
by: Yin, Huanghao, et al.
Published: (2026)
FastInit: Fast Noise Initialization for Temporally Consistent Video Generation
by: Bai, Chengyu, et al.
Published: (2025)
by: Bai, Chengyu, et al.
Published: (2025)
Stereo Any Video: Temporally Consistent Stereo Matching
by: Jing, Junpeng, et al.
Published: (2025)
by: Jing, Junpeng, et al.
Published: (2025)
Face Consistency Benchmark for GenAI Video
by: Podstawski, Michal, et al.
Published: (2025)
by: Podstawski, Michal, et al.
Published: (2025)
Splat4D: Diffusion-Enhanced 4D Gaussian Splatting for Temporally and Spatially Consistent Content Creation
by: Yin, Minghao, et al.
Published: (2025)
by: Yin, Minghao, et al.
Published: (2025)
VideoCompressa: Data-Efficient Video Understanding via Joint Temporal Compression and Spatial Reconstruction
by: Wang, Shaobo, et al.
Published: (2025)
by: Wang, Shaobo, et al.
Published: (2025)
PosMLP-Video: Spatial and Temporal Relative Position Encoding for Efficient Video Recognition
by: Hao, Yanbin, et al.
Published: (2024)
by: Hao, Yanbin, et al.
Published: (2024)
Consistent Human Image and Video Generation with Spatially Conditioned Diffusion
by: Cao, Mingdeng, et al.
Published: (2024)
by: Cao, Mingdeng, et al.
Published: (2024)
TROPHIES: Temporal Reconstruction of Places, Humans, and Cameras from Multi-view Videos
by: Liu, Jinpeng, et al.
Published: (2026)
by: Liu, Jinpeng, et al.
Published: (2026)
Standardizing Generative Face Video Compression using Supplemental Enhancement Information
by: Chen, Bolin, et al.
Published: (2024)
by: Chen, Bolin, et al.
Published: (2024)
Learning Natural Consistency Representation for Face Forgery Video Detection
by: Zhang, Daichi, et al.
Published: (2024)
by: Zhang, Daichi, et al.
Published: (2024)
CoInteract: Physically-Consistent Human-Object Interaction Video Synthesis via Spatially-Structured Co-Generation
by: Luo, Xiangyang, et al.
Published: (2026)
by: Luo, Xiangyang, et al.
Published: (2026)
Efficient Temporal Consistency in Diffusion-Based Video Editing with Adaptor Modules: A Theoretical Framework
by: Song, Xinyuan, et al.
Published: (2025)
by: Song, Xinyuan, et al.
Published: (2025)
Light Up Your Face: A Physically Consistent Dataset and Diffusion Model for Face Fill-Light Enhancement
by: Gong, Jue, et al.
Published: (2026)
by: Gong, Jue, et al.
Published: (2026)
Video Consistency Distance: Enhancing Temporal Consistency for Image-to-Video Generation via Reward-Based Fine-Tuning
by: Aoshima, Takehiro, et al.
Published: (2025)
by: Aoshima, Takehiro, et al.
Published: (2025)
InstaVSR: Taming Diffusion for Efficient and Temporally Consistent Video Super-Resolution
by: Hu, Jintong, et al.
Published: (2026)
by: Hu, Jintong, et al.
Published: (2026)
DynamicFace: High-Quality and Consistent Face Swapping for Image and Video using Composable 3D Facial Priors
by: Wang, Runqi, et al.
Published: (2025)
by: Wang, Runqi, et al.
Published: (2025)
Video Face Re-Aging: Toward Temporally Consistent Face Re-Aging
by: Muqeet, Abdul, et al.
Published: (2023)
by: Muqeet, Abdul, et al.
Published: (2023)
Video Quality Assessment for Online Processing: From Spatial to Temporal Sampling
by: Yan, Jiebin, et al.
Published: (2025)
by: Yan, Jiebin, et al.
Published: (2025)
Efficient One-stage Video Object Detection by Exploiting Temporal Consistency
by: Sun, Guanxiong, et al.
Published: (2024)
by: Sun, Guanxiong, et al.
Published: (2024)
Enhancing Temporal Consistency in Video Editing by Reconstructing Videos with 3D Gaussian Splatting
by: Shin, Inkyu, et al.
Published: (2024)
by: Shin, Inkyu, et al.
Published: (2024)
DRFusion: Drift-Resilient Temporally Consistent Infrared-Visible Video Fusion
by: Li, Xingyuan, et al.
Published: (2026)
by: Li, Xingyuan, et al.
Published: (2026)
Efficient Face Super-Resolution via Wavelet-based Feature Enhancement Network
by: Li, Wenjie, et al.
Published: (2024)
by: Li, Wenjie, et al.
Published: (2024)
Similar Items
-
Generalizable Face Landmarking Guided by Conditional Face Warping
by: Liang, Jiayi, et al.
Published: (2024) -
Self-Paced and Self-Corrective Masked Prediction for Movie Trailer Generation
by: Zhu, Sidan, et al.
Published: (2025) -
EchoMimic: Lifelike Audio-Driven Portrait Animations through Editable Landmark Conditions
by: Chen, Zhiyuan, et al.
Published: (2024) -
Low-Light Video Enhancement via Spatial-Temporal Consistent Decomposition
by: Xu, Xiaogang, et al.
Published: (2024) -
SpeedUpNet: A Plug-and-Play Adapter Network for Accelerating Text-to-Image Diffusion Models
by: Chai, Weilong, et al.
Published: (2023)