Detecting Lip-Syncing Deepfakes: Vision Temporal Transformer for Analyzing Mouth Inconsistencies
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Datta, Soumyya Kanti, Jia, Shan, Lyu, Siwei |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Exposing Lip-syncing Deepfakes from Mouth Inconsistencies
par: Datta, Soumyya Kanti, et autres
Publié: (2024)
par: Datta, Soumyya Kanti, et autres
Publié: (2024)
PIA: Deepfake Detection Using Phoneme-Temporal and Identity-Dynamic Analysis
par: Datta, Soumyya Kanti, et autres
Publié: (2025)
par: Datta, Soumyya Kanti, et autres
Publié: (2025)
Lips Are Lying: Spotting the Temporal Inconsistency between Audio and Visual in Lip-Syncing DeepFakes
par: Liu, Weifeng, et autres
Publié: (2024)
par: Liu, Weifeng, et autres
Publié: (2024)
DeepfakeBench-MM: A Comprehensive Benchmark for Multimodal Deepfake Detection
par: Zhao, Kangran, et autres
Publié: (2025)
par: Zhao, Kangran, et autres
Publié: (2025)
BioLip: Language-Generalizable Lip-Sync Deepfake Detection via Biomechanical Constraint Violation Modeling
par: Chen, Hao, et autres
Publié: (2026)
par: Chen, Hao, et autres
Publié: (2026)
DeepFake-O-Meter v2.0: An Open Platform for DeepFake Detection
par: Ju, Yan, et autres
Publié: (2024)
par: Ju, Yan, et autres
Publié: (2024)
Exposing Text-Image Inconsistency Using Diffusion Models
par: Huang, Mingzhen, et autres
Publié: (2024)
par: Huang, Mingzhen, et autres
Publié: (2024)
AV-Lip-Sync+: Leveraging AV-HuBERT to Exploit Multimodal Inconsistency for Deepfake Detection of Frontal Face Videos
par: Shahzad, Sahibzada Adil, et autres
Publié: (2023)
par: Shahzad, Sahibzada Adil, et autres
Publié: (2023)
OmniSync: Towards Universal Lip Synchronization via Diffusion Transformers
par: Peng, Ziqiao, et autres
Publié: (2025)
par: Peng, Ziqiao, et autres
Publié: (2025)
LatentSync: Taming Audio-Conditioned Latent Diffusion Models for Lip Sync with SyncNet Supervision
par: Li, Chunyu, et autres
Publié: (2024)
par: Li, Chunyu, et autres
Publié: (2024)
SyncAnyone: Implicit Disentanglement via Progressive Self-Correction for Lip-Syncing in the wild
par: Zhang, Xindi, et autres
Publié: (2025)
par: Zhang, Xindi, et autres
Publié: (2025)
Transcending Forgery Specificity with Latent Space Augmentation for Generalizable Deepfake Detection
par: Yan, Zhiyuan, et autres
Publié: (2023)
par: Yan, Zhiyuan, et autres
Publié: (2023)
FlashLips: 100-FPS Mask-Free Latent Lip-Sync using Reconstruction Instead of Diffusion or GANs
par: Zinonos, Andreas, et autres
Publié: (2025)
par: Zinonos, Andreas, et autres
Publié: (2025)
Explicit Correlation Learning for Generalizable Cross-Modal Deepfake Detection
par: Yu, Cai, et autres
Publié: (2024)
par: Yu, Cai, et autres
Publié: (2024)
HMGIE: Hierarchical and Multi-Grained Inconsistency Evaluation for Vision-Language Data Cleansing
par: Zhu, Zihao, et autres
Publié: (2024)
par: Zhu, Zihao, et autres
Publié: (2024)
Beyond Flicker: Detecting Kinematic Inconsistencies for Generalizable Deepfake Video Detection
par: Cobo, Alejandro, et autres
Publié: (2025)
par: Cobo, Alejandro, et autres
Publié: (2025)
Removing Averaging: Personalized Lip-Sync Driven Characters Based on Identity Adapter
par: Zhu, Yanyu, et autres
Publié: (2025)
par: Zhu, Yanyu, et autres
Publié: (2025)
HighSync: High-Quality Lip Synchronization via Latent Diffusion Models
par: Daghigh, Saeed Firouzi, et autres
Publié: (2026)
par: Daghigh, Saeed Firouzi, et autres
Publié: (2026)
UniSync: Towards Generalizable and High-Fidelity Lip Synchronization for Challenging Scenarios
par: Fan, Ruidi, et autres
Publié: (2026)
par: Fan, Ruidi, et autres
Publié: (2026)
StyleLipSync: Style-based Personalized Lip-sync Video Generation
par: Ki, Taekyung, et autres
Publié: (2023)
par: Ki, Taekyung, et autres
Publié: (2023)
Audio-Visual Deepfake Detection With Local Temporal Inconsistencies
par: Astrid, Marcella, et autres
Publié: (2025)
par: Astrid, Marcella, et autres
Publié: (2025)
Learning Spatiotemporal Inconsistency via Thumbnail Layout for Face Deepfake Detection
par: Xu, Yuting, et autres
Publié: (2024)
par: Xu, Yuting, et autres
Publié: (2024)
Unsupervised Multimodal Deepfake Detection Using Intra- and Cross-Modal Inconsistencies
par: Tian, Mulin, et autres
Publié: (2023)
par: Tian, Mulin, et autres
Publié: (2023)
A Timely Survey on Vision Transformer for Deepfake Detection
par: Wang, Zhikan, et autres
Publié: (2024)
par: Wang, Zhikan, et autres
Publié: (2024)
KeySync: A Robust Approach for Leakage-free Lip Synchronization in High Resolution
par: Bigata, Antoni, et autres
Publié: (2025)
par: Bigata, Antoni, et autres
Publié: (2025)
X2-DFD: A framework for eXplainable and eXtendable Deepfake Detection
par: Chen, Yize, et autres
Publié: (2024)
par: Chen, Yize, et autres
Publié: (2024)
GenSync: A Generalized Talking Head Framework for Audio-driven Multi-Subject Lip-Sync using 3D Gaussian Splatting
par: Agarwal, Anushka, et autres
Publié: (2025)
par: Agarwal, Anushka, et autres
Publié: (2025)
Make Your Actor Talk: Generalizable and High-Fidelity Lip Sync with Motion and Appearance Disentanglement
par: Yu, Runyi, et autres
Publié: (2024)
par: Yu, Runyi, et autres
Publié: (2024)
Dense Feature Interaction Network for Image Inpainting Localization
par: Yao, Ye, et autres
Publié: (2024)
par: Yao, Ye, et autres
Publié: (2024)
CrossDF: Improving Cross-Domain Deepfake Detection with Deep Information Decomposition
par: Yang, Shanmin, et autres
Publié: (2023)
par: Yang, Shanmin, et autres
Publié: (2023)
Text2Lip: Progressive Lip-Synced Talking Face Generation from Text via Viseme-Guided Rendering
par: Wang, Xu, et autres
Publié: (2025)
par: Wang, Xu, et autres
Publié: (2025)
Inconsistency-aware Multimodal Schrödinger Bridge for Deepfake Localization
par: Xiong, Jiayu, et autres
Publié: (2026)
par: Xiong, Jiayu, et autres
Publié: (2026)
JOLT3D: Joint Learning of Talking Heads and 3DMM Parameters with Application to Lip-Sync
par: Park, Sungjoon, et autres
Publié: (2025)
par: Park, Sungjoon, et autres
Publié: (2025)
Style-Preserving Lip Sync via Audio-Aware Style Reference
par: Zhong, Weizhi, et autres
Publié: (2024)
par: Zhong, Weizhi, et autres
Publié: (2024)
PASE: Phoneme-Aware Speech Encoder to Improve Lip Sync Accuracy for Talking Head Synthesis
par: Huang, Yihuan, et autres
Publié: (2025)
par: Huang, Yihuan, et autres
Publié: (2025)
3DXTalker: Unifying Identity, Lip Sync, Emotion, and Spatial Dynamics in Expressive 3D Talking Avatars
par: Wang, Zhongju, et autres
Publié: (2026)
par: Wang, Zhongju, et autres
Publié: (2026)
Exploring Self-Supervised Vision Transformers for Deepfake Detection: A Comparative Analysis
par: Nguyen, Huy H., et autres
Publié: (2024)
par: Nguyen, Huy H., et autres
Publié: (2024)
Deepfake Detection with Spatio-Temporal Consistency and Attention
par: Chen, Yunzhuo, et autres
Publié: (2025)
par: Chen, Yunzhuo, et autres
Publié: (2025)
Analyzing and Improving Fast Sampling of Text-to-Image Diffusion Models
par: Zhou, Zhenyu, et autres
Publié: (2026)
par: Zhou, Zhenyu, et autres
Publié: (2026)
GenConViT: Deepfake Video Detection Using Generative Convolutional Vision Transformer
par: Deressa, Deressa Wodajo, et autres
Publié: (2023)
par: Deressa, Deressa Wodajo, et autres
Publié: (2023)
Documents similaires
-
Exposing Lip-syncing Deepfakes from Mouth Inconsistencies
par: Datta, Soumyya Kanti, et autres
Publié: (2024) -
PIA: Deepfake Detection Using Phoneme-Temporal and Identity-Dynamic Analysis
par: Datta, Soumyya Kanti, et autres
Publié: (2025) -
Lips Are Lying: Spotting the Temporal Inconsistency between Audio and Visual in Lip-Syncing DeepFakes
par: Liu, Weifeng, et autres
Publié: (2024) -
DeepfakeBench-MM: A Comprehensive Benchmark for Multimodal Deepfake Detection
par: Zhao, Kangran, et autres
Publié: (2025) -
BioLip: Language-Generalizable Lip-Sync Deepfake Detection via Biomechanical Constraint Violation Modeling
par: Chen, Hao, et autres
Publié: (2026)