FOCA: Frequency-Oriented Cross-Domain Forgery Detection, Localization and Explanation via Multi-Modal Large Language Model
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Liu, Zhou, Su, Tonghua, Zhang, Hongshi, Yang, Fuxiang, Di, Donglin, Song, Yang, Fan, Lei |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Multimodal Cancer Survival Analysis via Hypergraph Learning with Cross-Modality Rebalance
par: Qu, Mingcheng, et autres
Publié: (2025)
par: Qu, Mingcheng, et autres
Publié: (2025)
Global-Local Aware Scene Text Editing
par: Yang, Fuxiang, et autres
Publié: (2025)
par: Yang, Fuxiang, et autres
Publié: (2025)
Memory-Augmented Incomplete Multimodal Survival Prediction via Cross-Slide and Gene-Attentive Hypergraph Learning
par: Qu, Mingcheng, et autres
Publié: (2025)
par: Qu, Mingcheng, et autres
Publié: (2025)
EFDiT: Efficient Fine-grained Image Generation Using Diffusion Transformer Models
par: Wang, Kun, et autres
Publié: (2025)
par: Wang, Kun, et autres
Publié: (2025)
CogPortrait: Fine-Grained Eye-Region Control in Portrait Animation via Hierarchical Agent Planning
par: Feng, He, et autres
Publié: (2026)
par: Feng, He, et autres
Publié: (2026)
Boundary-Guided Learning for Gene Expression Prediction in Spatial Transcriptomics
par: Qu, Mingcheng, et autres
Publié: (2024)
par: Qu, Mingcheng, et autres
Publié: (2024)
Chain of World: World Model Thinking in Latent Motion
par: Yang, Fuxiang, et autres
Publié: (2026)
par: Yang, Fuxiang, et autres
Publié: (2026)
Spatially Gene Expression Prediction using Dual-Scale Contrastive Learning
par: Qu, Mingcheng, et autres
Publié: (2025)
par: Qu, Mingcheng, et autres
Publié: (2025)
ADNet: A Large-Scale and Extensible Multi-Domain Benchmark for Anomaly Detection Across 380 Real-World Categories
par: Ling, Hai, et autres
Publié: (2025)
par: Ling, Hai, et autres
Publié: (2025)
FOCA: Multimodal Malware Classification via Hyperbolic Cross-Attention
par: Choudhury, Nitin, et autres
Publié: (2026)
par: Choudhury, Nitin, et autres
Publié: (2026)
Hypergraph Tversky-Aware Domain Incremental Learning for Brain Tumor Segmentation with Missing Modalities
par: Wang, Junze, et autres
Publié: (2025)
par: Wang, Junze, et autres
Publié: (2025)
Salvaging the Overlooked: Leveraging Class-Aware Contrastive Learning for Multi-Class Anomaly Detection
par: Fan, Lei, et autres
Publié: (2024)
par: Fan, Lei, et autres
Publié: (2024)
Counterfactual Explanations for Face Forgery Detection via Adversarial Removal of Artifacts
par: Li, Yang, et autres
Publié: (2024)
par: Li, Yang, et autres
Publié: (2024)
DiTalker: A Unified DiT-based Framework for High-Quality and Speaking Styles Controllable Portrait Animation
par: Feng, He, et autres
Publié: (2025)
par: Feng, He, et autres
Publié: (2025)
On Learning Multi-Modal Forgery Representation for Diffusion Generated Video Detection
par: Song, Xiufeng, et autres
Publié: (2024)
par: Song, Xiufeng, et autres
Publié: (2024)
DH-FaceVid-1K: A Large-Scale High-Quality Dataset for Face Video Generation
par: Di, Donglin, et autres
Publié: (2024)
par: Di, Donglin, et autres
Publié: (2024)
MANTA: A Large-Scale Multi-View and Visual-Text Anomaly Detection Dataset for Tiny Objects
par: Fan, Lei, et autres
Publié: (2024)
par: Fan, Lei, et autres
Publié: (2024)
SAGE: A Visual Language Model for Anomaly Detection via Fact Enhancement and Entropy-aware Alignment
par: Zang, Guoxin, et autres
Publié: (2025)
par: Zang, Guoxin, et autres
Publié: (2025)
Adams Bashforth Moulton Solver for Inversion and Editing in Rectified Flow
par: Ma, Yongjia, et autres
Publié: (2025)
par: Ma, Yongjia, et autres
Publié: (2025)
FakeShield: Explainable Image Forgery Detection and Localization via Multi-modal Large Language Models
par: Xu, Zhipei, et autres
Publié: (2024)
par: Xu, Zhipei, et autres
Publié: (2024)
One-Shot Pose-Driving Face Animation Platform
par: Feng, He, et autres
Publié: (2024)
par: Feng, He, et autres
Publié: (2024)
CBDiff:Conditional Bernoulli Diffusion Models for Image Forgery Localization
par: Lei, Zhou, et autres
Publié: (2025)
par: Lei, Zhou, et autres
Publié: (2025)
Gradient Harmonization in Unsupervised Domain Adaptation
par: Huang, Fuxiang, et autres
Publié: (2024)
par: Huang, Fuxiang, et autres
Publié: (2024)
ForensicFormer: Hierarchical Multi-Scale Reasoning for Cross-Domain Image Forgery Detection
par: Samson, Hema Hariharan
Publié: (2026)
par: Samson, Hema Hariharan
Publié: (2026)
Contrastive Desensitization Learning for Cross Domain Face Forgery Detection
par: Qiu, Lingyu, et autres
Publié: (2025)
par: Qiu, Lingyu, et autres
Publié: (2025)
Image Forgery Localization via Guided Noise and Multi-Scale Feature Aggregation
par: Niu, Yakun, et autres
Publié: (2024)
par: Niu, Yakun, et autres
Publié: (2024)
Cross-Modal Unlearning via Influential Neuron Path Editing in Multimodal Large Language Models
par: Li, Kunhao, et autres
Publié: (2025)
par: Li, Kunhao, et autres
Publié: (2025)
A Local Perturbation Theory for Cross-Domain Interference and Recovery in Multi-Domain RL
par: Yang, Lei, et autres
Publié: (2026)
par: Yang, Lei, et autres
Publié: (2026)
Cross-Modal Watermarking for Authentic Audio Recovery and Tamper Localization in Synthesized Audiovisual Forgeries
par: Kim, Minyoung, et autres
Publié: (2025)
par: Kim, Minyoung, et autres
Publié: (2025)
SDiFL: Stable Diffusion-Driven Framework for Image Forgery Localization
par: Su, Yang, et autres
Publié: (2025)
par: Su, Yang, et autres
Publié: (2025)
Cross-Stain Contrastive Learning for Paired Immunohistochemistry and Histopathology Slide Representation Learning
par: Zhang, Yizhi, et autres
Publié: (2025)
par: Zhang, Yizhi, et autres
Publié: (2025)
SFNet: Fusion of Spatial and Frequency-Domain Features for Remote Sensing Image Forgery Detection
par: Qi, Ji, et autres
Publié: (2025)
par: Qi, Ji, et autres
Publié: (2025)
Real Face Video Animation Platform
par: Chen, Xiaokai, et autres
Publié: (2024)
par: Chen, Xiaokai, et autres
Publié: (2024)
Multi-omic Prognosis of Alzheimer's Disease with Asymmetric Cross-Modal Cross-Attention Network
par: Ming, Yang, et autres
Publié: (2025)
par: Ming, Yang, et autres
Publié: (2025)
DA-HFNet: Progressive Fine-Grained Forgery Image Detection and Localization Based on Dual Attention
par: Liu, Yang, et autres
Publié: (2024)
par: Liu, Yang, et autres
Publié: (2024)
Band-Attention Modulated RetNet for Face Forgery Detection
par: Zhang, Zhida, et autres
Publié: (2024)
par: Zhang, Zhida, et autres
Publié: (2024)
Visual-Oriented Fine-Grained Knowledge Editing for MultiModal Large Language Models
par: Zeng, Zhen, et autres
Publié: (2024)
par: Zeng, Zhen, et autres
Publié: (2024)
Preserving Forgery Artifacts: AI-Generated Video Detection at Native Scale
par: Li, Zhengcen, et autres
Publié: (2026)
par: Li, Zhengcen, et autres
Publié: (2026)
Generalizable Face Forgery Detection via Separable Prompt Learning
par: Yang, Enrui, et autres
Publié: (2026)
par: Yang, Enrui, et autres
Publié: (2026)
Rethinking Cross-Generator Image Forgery Detection through DINOv3
par: Huang, Zhenglin, et autres
Publié: (2025)
par: Huang, Zhenglin, et autres
Publié: (2025)
Documents similaires
-
Multimodal Cancer Survival Analysis via Hypergraph Learning with Cross-Modality Rebalance
par: Qu, Mingcheng, et autres
Publié: (2025) -
Global-Local Aware Scene Text Editing
par: Yang, Fuxiang, et autres
Publié: (2025) -
Memory-Augmented Incomplete Multimodal Survival Prediction via Cross-Slide and Gene-Attentive Hypergraph Learning
par: Qu, Mingcheng, et autres
Publié: (2025) -
EFDiT: Efficient Fine-grained Image Generation Using Diffusion Transformer Models
par: Wang, Kun, et autres
Publié: (2025) -
CogPortrait: Fine-Grained Eye-Region Control in Portrait Animation via Hierarchical Agent Planning
par: Feng, He, et autres
Publié: (2026)