Identity-Aware Vision-Language Model for Explainable Face Forgery Detection
Fuente:
arXiv
Salvato in:
| Autori principali: | Xu, Junhao, Chen, Jingjing, Jiao, Yang, Zhang, Jiacheng, Tan, Zhiyu, Li, Hao, Jiang, Yu-Gang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Identity-Driven Multimedia Forgery Detection via Reference Assistance
di: Xu, Junhao, et al.
Pubblicazione: (2024)
di: Xu, Junhao, et al.
Pubblicazione: (2024)
Generalized Face Forgery Detection via Adaptive Learning for Pre-trained Vision Transformer
di: Luo, Anwei, et al.
Pubblicazione: (2023)
di: Luo, Anwei, et al.
Pubblicazione: (2023)
AC^2-VLA: Action-Context-Aware Adaptive Computation in Vision-Language-Action Models for Efficient Robotic Manipulation
di: Yu, Wenda, et al.
Pubblicazione: (2026)
di: Yu, Wenda, et al.
Pubblicazione: (2026)
Band-Attention Modulated RetNet for Face Forgery Detection
di: Zhang, Zhida, et al.
Pubblicazione: (2024)
di: Zhang, Zhida, et al.
Pubblicazione: (2024)
Inclusion 2024 Global Multimedia Deepfake Detection Challenge: Towards Multi-dimensional Face Forgery Detection
di: Zhang, Yi, et al.
Pubblicazione: (2024)
di: Zhang, Yi, et al.
Pubblicazione: (2024)
Challenging Dataset and Multi-modal Gated Mixture of Experts Model for Remote Sensing Copy-Move Forgery Understanding
di: Zhang, Ze, et al.
Pubblicazione: (2025)
di: Zhang, Ze, et al.
Pubblicazione: (2025)
Optimization-Free Universal Watermark Forgery with Regenerative Diffusion Models
di: Zhu, Chaoyi, et al.
Pubblicazione: (2025)
di: Zhu, Chaoyi, et al.
Pubblicazione: (2025)
Navigating Weight Prediction with Diet Diary
di: Gui, Yinxuan, et al.
Pubblicazione: (2024)
di: Gui, Yinxuan, et al.
Pubblicazione: (2024)
ConvBench: A Multi-Turn Conversation Evaluation Benchmark with Hierarchical Capability for Large Vision-Language Models
di: Liu, Shuo, et al.
Pubblicazione: (2024)
di: Liu, Shuo, et al.
Pubblicazione: (2024)
DA-PTQ: Drift-Aware Post-Training Quantization for Efficient Vision-Language-Action Models
di: Xu, Siyuan, et al.
Pubblicazione: (2026)
di: Xu, Siyuan, et al.
Pubblicazione: (2026)
An Effective Image Copy-Move Forgery Detection Using Entropy Information
di: Jiang, Li, et al.
Pubblicazione: (2023)
di: Jiang, Li, et al.
Pubblicazione: (2023)
Structure-Aware Residual-Center Representation for Self-Supervised Open-Set 3D Cross-Modal Retrieval
di: Xu, Yang, et al.
Pubblicazione: (2024)
di: Xu, Yang, et al.
Pubblicazione: (2024)
Dual-Stream Decoupled Learning for Temporal Consistency and Speaker Interaction in AVSD
di: Xiao, Junhao, et al.
Pubblicazione: (2025)
di: Xiao, Junhao, et al.
Pubblicazione: (2025)
Hearing from Silence: Reasoning Audio Descriptions from Silent Videos via Vision-Language Model
di: Ren, Yong, et al.
Pubblicazione: (2025)
di: Ren, Yong, et al.
Pubblicazione: (2025)
Generalizable Deepfake Detection Based on Forgery-aware Layer Masking and Multi-artifact Subspace Decomposition
di: Zhang, Xiang, et al.
Pubblicazione: (2026)
di: Zhang, Xiang, et al.
Pubblicazione: (2026)
Cross-modal Proxy Evolving for OOD Detection with Vision-Language Models
di: Tang, Hao, et al.
Pubblicazione: (2026)
di: Tang, Hao, et al.
Pubblicazione: (2026)
SOMONITOR: Combining Explainable AI & Large Language Models for Marketing Analytics
di: Farseev, Aleksandr, et al.
Pubblicazione: (2024)
di: Farseev, Aleksandr, et al.
Pubblicazione: (2024)
COPA: Efficient Vision-Language Pre-training Through Collaborative Object- and Patch-Text Alignment
di: Jiang, Chaoya, et al.
Pubblicazione: (2023)
di: Jiang, Chaoya, et al.
Pubblicazione: (2023)
PureKV: Plug-and-Play KV Cache Optimization with Spatial-Temporal Sparse Attention for Vision-Language Large Models
di: Jiang, Zhonghua, et al.
Pubblicazione: (2025)
di: Jiang, Zhonghua, et al.
Pubblicazione: (2025)
InstructFLIP: Exploring Unified Vision-Language Model for Face Anti-spoofing
di: Lin, Kun-Hsiang, et al.
Pubblicazione: (2025)
di: Lin, Kun-Hsiang, et al.
Pubblicazione: (2025)
Rethinking Vision Transformer for Large-Scale Fine-Grained Image Retrieval
di: Jiang, Xin, et al.
Pubblicazione: (2025)
di: Jiang, Xin, et al.
Pubblicazione: (2025)
Physics-Aware Novel-View Acoustic Synthesis with Vision-Language Priors and 3D Acoustic Environment Modeling
di: Fan, Congyi, et al.
Pubblicazione: (2026)
di: Fan, Congyi, et al.
Pubblicazione: (2026)
HumanVLM: Foundation for Human-Scene Vision-Language Model
di: Dai, Dawei, et al.
Pubblicazione: (2024)
di: Dai, Dawei, et al.
Pubblicazione: (2024)
Improving Multi-modal Large Language Model through Boosting Vision Capabilities
di: Sun, Yanpeng, et al.
Pubblicazione: (2024)
di: Sun, Yanpeng, et al.
Pubblicazione: (2024)
Copy-Move Forgery Detection and Question Answering for Remote Sensing Image
di: Zhang, Ze, et al.
Pubblicazione: (2024)
di: Zhang, Ze, et al.
Pubblicazione: (2024)
Content-Adaptive Rate-Quality Curve Prediction Model in Media Processing System
di: Yin, Shibo, et al.
Pubblicazione: (2024)
di: Yin, Shibo, et al.
Pubblicazione: (2024)
When Top-ranked Recommendations Fail: Modeling Multi-Granular Negative Feedback for Explainable and Robust Video Recommendation
di: Chen, Siran, et al.
Pubblicazione: (2025)
di: Chen, Siran, et al.
Pubblicazione: (2025)
AxiomVision: Accuracy-Guaranteed Adaptive Visual Model Selection for Perspective-Aware Video Analytics
di: Dai, Xiangxiang, et al.
Pubblicazione: (2024)
di: Dai, Xiangxiang, et al.
Pubblicazione: (2024)
Towards Generalizable Deepfake Detection via Forgery-aware Audio-Visual Adaptation: A Variational Bayesian Approach
di: Nie, Fan, et al.
Pubblicazione: (2025)
di: Nie, Fan, et al.
Pubblicazione: (2025)
Rethinking Fusion: Disentangled Learning of Shared and Modality-Specific Information for Stance Detection
di: Xie, Zhiyu, et al.
Pubblicazione: (2026)
di: Xie, Zhiyu, et al.
Pubblicazione: (2026)
DAE-Talker: High Fidelity Speech-Driven Talking Face Generation with Diffusion Autoencoder
di: Du, Chenpeng, et al.
Pubblicazione: (2023)
di: Du, Chenpeng, et al.
Pubblicazione: (2023)
Lightweight Complementary-Cue Fusion for Robust Video Face Forgery Detection
di: Baek, Sunghwan, et al.
Pubblicazione: (2026)
di: Baek, Sunghwan, et al.
Pubblicazione: (2026)
Collaborative Evolution: Multi-Round Learning Between Large and Small Language Models for Emergent Fake News Detection
di: Zhou, Ziyi, et al.
Pubblicazione: (2025)
di: Zhou, Ziyi, et al.
Pubblicazione: (2025)
Enhanced Quality Aware-Scalable Underwater Image Compression
di: Zhu, Linwei, et al.
Pubblicazione: (2025)
di: Zhu, Linwei, et al.
Pubblicazione: (2025)
TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning
di: Xie, Jingjing, et al.
Pubblicazione: (2024)
di: Xie, Jingjing, et al.
Pubblicazione: (2024)
Reference-Guided Identity Preserving Face Restoration
di: Zhou, Mo, et al.
Pubblicazione: (2025)
di: Zhou, Mo, et al.
Pubblicazione: (2025)
Differential Mental Disorder Detection with Psychology-Inspired Multimodal Stimuli
di: Zhou, Zhiyuan, et al.
Pubblicazione: (2026)
di: Zhou, Zhiyuan, et al.
Pubblicazione: (2026)
Explainable Multimodal Emotion Recognition
di: Lian, Zheng, et al.
Pubblicazione: (2023)
di: Lian, Zheng, et al.
Pubblicazione: (2023)
Modality-Aware Identity Construction and Counterfactual Structure Learning for ID-Free Multimodal Recommendation
di: Ma, Hongjian, et al.
Pubblicazione: (2026)
di: Ma, Hongjian, et al.
Pubblicazione: (2026)
E2LVLM:Evidence-Enhanced Large Vision-Language Model for Multimodal Out-of-Context Misinformation Detection
di: Wu, Junjie, et al.
Pubblicazione: (2025)
di: Wu, Junjie, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Identity-Driven Multimedia Forgery Detection via Reference Assistance
di: Xu, Junhao, et al.
Pubblicazione: (2024) -
Generalized Face Forgery Detection via Adaptive Learning for Pre-trained Vision Transformer
di: Luo, Anwei, et al.
Pubblicazione: (2023) -
AC^2-VLA: Action-Context-Aware Adaptive Computation in Vision-Language-Action Models for Efficient Robotic Manipulation
di: Yu, Wenda, et al.
Pubblicazione: (2026) -
Band-Attention Modulated RetNet for Face Forgery Detection
di: Zhang, Zhida, et al.
Pubblicazione: (2024) -
Inclusion 2024 Global Multimedia Deepfake Detection Challenge: Towards Multi-dimensional Face Forgery Detection
di: Zhang, Yi, et al.
Pubblicazione: (2024)