Inconsistency-aware Multimodal Schrödinger Bridge for Deepfake Localization
Fuente:
arXiv
Guardado en:
| Autores principales: | Xiong, Jiayu, Wang, Jing, Zhang, Qi, Wang, Wanlong, Xue, Jun |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Multimodal Fusion via Self-Consistent Task-Gradient Fields
por: Xiong, Jiayu, et al.
Publicado: (2024)
por: Xiong, Jiayu, et al.
Publicado: (2024)
Unsupervised Multimodal Deepfake Detection Using Intra- and Cross-Modal Inconsistencies
por: Tian, Mulin, et al.
Publicado: (2023)
por: Tian, Mulin, et al.
Publicado: (2023)
Exposing Lip-syncing Deepfakes from Mouth Inconsistencies
por: Datta, Soumyya Kanti, et al.
Publicado: (2024)
por: Datta, Soumyya Kanti, et al.
Publicado: (2024)
Geometry-based Schrödinger Bridges for Trustworthy Multimodal Fusion
por: Xiong, Jiayu, et al.
Publicado: (2026)
por: Xiong, Jiayu, et al.
Publicado: (2026)
Learning Spatiotemporal Inconsistency via Thumbnail Layout for Face Deepfake Detection
por: Xu, Yuting, et al.
Publicado: (2024)
por: Xu, Yuting, et al.
Publicado: (2024)
Finding Local Diffusion Schrödinger Bridge using Kolmogorov-Arnold Network
por: Qiu, Xingyu, et al.
Publicado: (2025)
por: Qiu, Xingyu, et al.
Publicado: (2025)
Beyond Flicker: Detecting Kinematic Inconsistencies for Generalizable Deepfake Video Detection
por: Cobo, Alejandro, et al.
Publicado: (2025)
por: Cobo, Alejandro, et al.
Publicado: (2025)
Detecting Lip-Syncing Deepfakes: Vision Temporal Transformer for Analyzing Mouth Inconsistencies
por: Datta, Soumyya Kanti, et al.
Publicado: (2025)
por: Datta, Soumyya Kanti, et al.
Publicado: (2025)
Audio-Visual Deepfake Detection With Local Temporal Inconsistencies
por: Astrid, Marcella, et al.
Publicado: (2025)
por: Astrid, Marcella, et al.
Publicado: (2025)
RIGI: Rectifying Image-to-3D Generation Inconsistency via Uncertainty-aware Learning
por: Wang, Jiacheng, et al.
Publicado: (2024)
por: Wang, Jiacheng, et al.
Publicado: (2024)
Bridging Cross-task Protocol Inconsistency for Distillation in Dense Object Detection
por: Yang, Longrong, et al.
Publicado: (2023)
por: Yang, Longrong, et al.
Publicado: (2023)
Next-Frame Feature Prediction for Multimodal Deepfake Detection and Temporal Localization
por: Anshul, Ashutosh, et al.
Publicado: (2025)
por: Anshul, Ashutosh, et al.
Publicado: (2025)
CUNSB-RFIE: Context-aware Unpaired Neural Schrödinger Bridge in Retinal Fundus Image Enhancement
por: Dong, Xuanzhao, et al.
Publicado: (2024)
por: Dong, Xuanzhao, et al.
Publicado: (2024)
CogniVerse: Revolutionizing Multi-Modal Retrieval-Augmented Generation with Cognitive Reflection and Geometric Reasoning
por: Fang, Xiang, et al.
Publicado: (2026)
por: Fang, Xiang, et al.
Publicado: (2026)
Investigating and Enhancing the Robustness of Large Multimodal Models Against Temporal Inconsistency
por: Liang, Jiafeng, et al.
Publicado: (2025)
por: Liang, Jiafeng, et al.
Publicado: (2025)
Object-level Copy-Move Forgery Image Detection based on Inconsistency Mining
por: Wang, Jingyu, et al.
Publicado: (2024)
por: Wang, Jingyu, et al.
Publicado: (2024)
GeoBridge: A Semantic-Anchored Multi-View Foundation Model Bridging Images and Text for Geo-Localization
por: Song, Zixuan, et al.
Publicado: (2025)
por: Song, Zixuan, et al.
Publicado: (2025)
AsyncDSB: Schedule-Asynchronous Diffusion Schrödinger Bridge for Image Inpainting
por: Han, Zihao, et al.
Publicado: (2024)
por: Han, Zihao, et al.
Publicado: (2024)
SLAP: The Semantic Least Action Principle for Variational Video-Language Modeling
por: Fang, Xiang, et al.
Publicado: (2026)
por: Fang, Xiang, et al.
Publicado: (2026)
Diffusion Deepfake
por: Bhattacharyya, Chaitali, et al.
Publicado: (2024)
por: Bhattacharyya, Chaitali, et al.
Publicado: (2024)
Referee: Reference-aware Audiovisual Deepfake Detection
por: Boo, Hyemin, et al.
Publicado: (2025)
por: Boo, Hyemin, et al.
Publicado: (2025)
Hierarchical Semantic-Augmented Navigation: Optimal Transport and Graph-Driven Reasoning for Vision-Language Navigation
por: Fang, Xiang, et al.
Publicado: (2026)
por: Fang, Xiang, et al.
Publicado: (2026)
DFBench: Benchmarking Deepfake Image Detection Capability of Large Multimodal Models
por: Wang, Jiarui, et al.
Publicado: (2025)
por: Wang, Jiarui, et al.
Publicado: (2025)
FractalForensics: Proactive Deepfake Detection and Localization via Fractal Watermarks
por: Wang, Tianyi, et al.
Publicado: (2025)
por: Wang, Tianyi, et al.
Publicado: (2025)
Detecting Audio-Visual Deepfakes with Fine-Grained Inconsistencies
por: Astrid, Marcella, et al.
Publicado: (2024)
por: Astrid, Marcella, et al.
Publicado: (2024)
Can We Leave Deepfake Data Behind in Training Deepfake Detector?
por: Cheng, Jikang, et al.
Publicado: (2024)
por: Cheng, Jikang, et al.
Publicado: (2024)
Age-Diverse Deepfake Dataset: Bridging the Age Gap in Deepfake Detection
por: Joshi, Unisha
Publicado: (2025)
por: Joshi, Unisha
Publicado: (2025)
SegLocNet: Multimodal Localization Network for Autonomous Driving via Bird's-Eye-View Segmentation
por: Zhou, Zijie, et al.
Publicado: (2025)
por: Zhou, Zijie, et al.
Publicado: (2025)
DGM4+: Dataset Extension for Global Scene Inconsistency
por: Singh, Gagandeep, et al.
Publicado: (2025)
por: Singh, Gagandeep, et al.
Publicado: (2025)
When Schrödinger Bridge Meets Real-World Image Dehazing with Unpaired Training
por: Lan, Yunwei, et al.
Publicado: (2025)
por: Lan, Yunwei, et al.
Publicado: (2025)
A Timely Survey on Vision Transformer for Deepfake Detection
por: Wang, Zhikan, et al.
Publicado: (2024)
por: Wang, Zhikan, et al.
Publicado: (2024)
SchröMind: Mitigating Hallucinations in Multimodal Large Language Models via Solving the Schrödinger Bridge Problem
por: Shi, Ziqiang, et al.
Publicado: (2026)
por: Shi, Ziqiang, et al.
Publicado: (2026)
DREAM: A Benchmark Study for Deepfake photoREalism AssessMent
por: Peng, Bo, et al.
Publicado: (2025)
por: Peng, Bo, et al.
Publicado: (2025)
PRISMM-Bench: A Benchmark of Peer-Review Grounded Multimodal Inconsistencies
por: Selch, Lukas, et al.
Publicado: (2025)
por: Selch, Lukas, et al.
Publicado: (2025)
Mining Forgery Traces from Reconstruction Error: A Weakly Supervised Framework for Multimodal Deepfake Temporal Localization
por: Guo, Midou, et al.
Publicado: (2026)
por: Guo, Midou, et al.
Publicado: (2026)
Training-Free Multimodal Deepfake Detection via Graph Reasoning
por: Liu, Yuxin, et al.
Publicado: (2025)
por: Liu, Yuxin, et al.
Publicado: (2025)
Defending Deepfake via Texture Feature Perturbation
por: Zhang, Xiao, et al.
Publicado: (2025)
por: Zhang, Xiao, et al.
Publicado: (2025)
Linguistic Profiling of Deepfakes: An Open Database for Next-Generation Deepfake Detection
por: Wang, Yabin, et al.
Publicado: (2024)
por: Wang, Yabin, et al.
Publicado: (2024)
Attribution-Guided Multimodal Deepfake Detection via Cross-Modal Forensic Fingerprints
por: Ahmad, Wasim, et al.
Publicado: (2026)
por: Ahmad, Wasim, et al.
Publicado: (2026)
Scaling Laws for Deepfake Detection
por: Wang, Wenhao, et al.
Publicado: (2025)
por: Wang, Wenhao, et al.
Publicado: (2025)
Ejemplares similares
-
Multimodal Fusion via Self-Consistent Task-Gradient Fields
por: Xiong, Jiayu, et al.
Publicado: (2024) -
Unsupervised Multimodal Deepfake Detection Using Intra- and Cross-Modal Inconsistencies
por: Tian, Mulin, et al.
Publicado: (2023) -
Exposing Lip-syncing Deepfakes from Mouth Inconsistencies
por: Datta, Soumyya Kanti, et al.
Publicado: (2024) -
Geometry-based Schrödinger Bridges for Trustworthy Multimodal Fusion
por: Xiong, Jiayu, et al.
Publicado: (2026) -
Learning Spatiotemporal Inconsistency via Thumbnail Layout for Face Deepfake Detection
por: Xu, Yuting, et al.
Publicado: (2024)