Multi-modal Deepfake Detection and Localization with FPN-Transformer
Fuente:
arXiv
Guardado en:
| Autores principales: | Zheng, Chende, Suo, Ruiqi, Ji, Zhoulin, Deng, Jingyi, Yi, Fangbin, Lin, Chenhao, Shen, Chao |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Towards Benchmarking and Evaluating Deepfake Detection
por: Lin, Chenhao, et al.
Publicado: (2022)
por: Lin, Chenhao, et al.
Publicado: (2022)
D3: Training-Free AI-Generated Video Detection Using Second-Order Features
por: Zheng, Chende, et al.
Publicado: (2025)
por: Zheng, Chende, et al.
Publicado: (2025)
HS-FPN: High Frequency and Spatial Perception FPN for Tiny Object Detection
por: Shi, Zican, et al.
Publicado: (2024)
por: Shi, Zican, et al.
Publicado: (2024)
DDNet: Deformable Convolution and Dense FPN for Surface Defect Detection in Recycled Books
por: Yu, Jun, et al.
Publicado: (2024)
por: Yu, Jun, et al.
Publicado: (2024)
PUDD: Towards Robust Multi-modal Prototype-based Deepfake Detection
por: Pellcier, Alvaro Lopez, et al.
Publicado: (2024)
por: Pellcier, Alvaro Lopez, et al.
Publicado: (2024)
A Survey of Defenses Against AI-Generated Visual Media: Detection,Disruption, and Authentication
por: Deng, Jingyi, et al.
Publicado: (2024)
por: Deng, Jingyi, et al.
Publicado: (2024)
A DeNoising FPN With Transformer R-CNN for Tiny Object Detection
por: Liu, Hou-I, et al.
Publicado: (2024)
por: Liu, Hou-I, et al.
Publicado: (2024)
Towards General Deepfake Detection with Dynamic Curriculum
por: Song, Wentang, et al.
Publicado: (2024)
por: Song, Wentang, et al.
Publicado: (2024)
Evolving from Single-modal to Multi-modal Facial Deepfake Detection: Progress and Challenges
por: Liu, Ping, et al.
Publicado: (2024)
por: Liu, Ping, et al.
Publicado: (2024)
Lightweight Deepfake Detection Based on Multi-Feature Fusion
por: Yasir, Siddiqui Muhammad, et al.
Publicado: (2025)
por: Yasir, Siddiqui Muhammad, et al.
Publicado: (2025)
Hierarchical Multi-modal Transformer for Cross-modal Long Document Classification
por: Liu, Tengfei, et al.
Publicado: (2024)
por: Liu, Tengfei, et al.
Publicado: (2024)
Morphology-optimized Multi-Scale Fusion: Combining Local Artifacts and Mesoscopic Semantics for Deepfake Detection and Localization
por: Shuai, Chao, et al.
Publicado: (2025)
por: Shuai, Chao, et al.
Publicado: (2025)
LR-FPN: Enhancing Remote Sensing Object Detection with Location Refined Feature Pyramid Network
por: Li, Hanqian, et al.
Publicado: (2024)
por: Li, Hanqian, et al.
Publicado: (2024)
Seeing It or Not? Interpretable Vision-aware Latent Steering to Mitigate Object Hallucinations
por: Chen, Boxu, et al.
Publicado: (2025)
por: Chen, Boxu, et al.
Publicado: (2025)
HAMLET-FFD: Hierarchical Adaptive Multi-modal Learning Embeddings Transformation for Face Forgery Detection
por: Cui, Jialei, et al.
Publicado: (2025)
por: Cui, Jialei, et al.
Publicado: (2025)
LIRA: Inferring Segmentation in Large Multi-modal Models with Local Interleaved Region Assistance
por: Li, Zhang, et al.
Publicado: (2025)
por: Li, Zhang, et al.
Publicado: (2025)
Fusion-Mamba for Cross-modality Object Detection
por: Dong, Wenhao, et al.
Publicado: (2024)
por: Dong, Wenhao, et al.
Publicado: (2024)
FakeChain: Exposing Shallow Cues in Multi-Step Deepfake Detection
por: Heo, Minji, et al.
Publicado: (2025)
por: Heo, Minji, et al.
Publicado: (2025)
SIDA: Social Media Image Deepfake Detection, Localization and Explanation with Large Multimodal Model
por: Huang, Zhenglin, et al.
Publicado: (2024)
por: Huang, Zhenglin, et al.
Publicado: (2024)
S$^2$-FPN: Scale-ware Strip Attention Guided Feature Pyramid Network for Real-time Semantic Segmentation
por: Elhassan, Mohammed A. M., et al.
Publicado: (2022)
por: Elhassan, Mohammed A. M., et al.
Publicado: (2022)
FakeShield: Explainable Image Forgery Detection and Localization via Multi-modal Large Language Models
por: Xu, Zhipei, et al.
Publicado: (2024)
por: Xu, Zhipei, et al.
Publicado: (2024)
Deepfake Detection without Deepfakes: Generalization via Synthetic Frequency Patterns Injection
por: Coccomini, Davide Alessandro, et al.
Publicado: (2024)
por: Coccomini, Davide Alessandro, et al.
Publicado: (2024)
Seeing Through Deepfakes: A Human-Inspired Framework for Multi-Face Detection
por: Hu, Juan, et al.
Publicado: (2025)
por: Hu, Juan, et al.
Publicado: (2025)
Frequency Masking for Universal Deepfake Detection
por: Doloriel, Chandler Timm, et al.
Publicado: (2024)
por: Doloriel, Chandler Timm, et al.
Publicado: (2024)
Detecting Deepfakes via Hamiltonian Dynamics
por: Cheng, Harry, et al.
Publicado: (2026)
por: Cheng, Harry, et al.
Publicado: (2026)
From Specificity to Generality: Revisiting Generalizable Artifacts in Detecting Face Deepfakes
por: Ma, Long, et al.
Publicado: (2025)
por: Ma, Long, et al.
Publicado: (2025)
AI-Powered Deepfake Detection Using CNN and Vision Transformer Architectures
por: Urmi, Sifatullah Sheikh, et al.
Publicado: (2026)
por: Urmi, Sifatullah Sheikh, et al.
Publicado: (2026)
SparseFormer: Detecting Objects in HRW Shots via Sparse Vision Transformer
por: Li, Wenxi, et al.
Publicado: (2025)
por: Li, Wenxi, et al.
Publicado: (2025)
A Lightweight and Interpretable Deepfakes Detection Framework
por: Farooq, Muhammad Umar, et al.
Publicado: (2025)
por: Farooq, Muhammad Umar, et al.
Publicado: (2025)
A3-FPN: Asymptotic Content-Aware Pyramid Attention Network for Dense Visual Prediction
por: Qin, Meng'en, et al.
Publicado: (2026)
por: Qin, Meng'en, et al.
Publicado: (2026)
Passive Deepfake Detection Across Multi-modalities: A Comprehensive Survey
por: Nguyen-Le, Hong-Hanh, et al.
Publicado: (2024)
por: Nguyen-Le, Hong-Hanh, et al.
Publicado: (2024)
RSVP: Reasoning Segmentation via Visual Prompting and Multi-modal Chain-of-Thought
por: Lu, Yi, et al.
Publicado: (2025)
por: Lu, Yi, et al.
Publicado: (2025)
SeLIP: Similarity Enhanced Contrastive Language Image Pretraining for Multi-modal Head MRI
por: Liu, Zhiyang, et al.
Publicado: (2025)
por: Liu, Zhiyang, et al.
Publicado: (2025)
FakeOut: Leveraging Out-of-domain Self-supervision for Multi-modal Video Deepfake Detection
por: Knafo, Gil, et al.
Publicado: (2022)
por: Knafo, Gil, et al.
Publicado: (2022)
Multi-modal Spatio-Temporal Transformer for High-resolution Land Subsidence Prediction
por: Yao, Wendong, et al.
Publicado: (2025)
por: Yao, Wendong, et al.
Publicado: (2025)
Hierarchical Deep Fusion Framework for Multi-dimensional Facial Forgery Detection -- The 2024 Global Deepfake Image Detection Challenge
por: Wang, Kohou, et al.
Publicado: (2025)
por: Wang, Kohou, et al.
Publicado: (2025)
Hybrid Spiking Vision Transformer for Object Detection with Event Cameras
por: Xu, Qi, et al.
Publicado: (2025)
por: Xu, Qi, et al.
Publicado: (2025)
Convolutional Feature Enhancement and Attention Fusion BiFPN for Ship Detection in SAR Images
por: Meng, Liangjie, et al.
Publicado: (2025)
por: Meng, Liangjie, et al.
Publicado: (2025)
M4-BLIP: Advancing Multi-Modal Media Manipulation Detection through Face-Enhanced Local Analysis
por: Wu, Hang, et al.
Publicado: (2025)
por: Wu, Hang, et al.
Publicado: (2025)
Multi-modal Generative AI: Multi-modal LLMs, Diffusions, and the Unification
por: Wang, Xin, et al.
Publicado: (2024)
por: Wang, Xin, et al.
Publicado: (2024)
Ejemplares similares
-
Towards Benchmarking and Evaluating Deepfake Detection
por: Lin, Chenhao, et al.
Publicado: (2022) -
D3: Training-Free AI-Generated Video Detection Using Second-Order Features
por: Zheng, Chende, et al.
Publicado: (2025) -
HS-FPN: High Frequency and Spatial Perception FPN for Tiny Object Detection
por: Shi, Zican, et al.
Publicado: (2024) -
DDNet: Deformable Convolution and Dense FPN for Surface Defect Detection in Recycled Books
por: Yu, Jun, et al.
Publicado: (2024) -
PUDD: Towards Robust Multi-modal Prototype-based Deepfake Detection
por: Pellcier, Alvaro Lopez, et al.
Publicado: (2024)