ForensicZip: More Tokens are Better but Not Necessary in Forensic Vision-Language Models
Fuente:
arXiv
Saved in:
| Main Authors: | Lai, Yingxin, Yu, Zitong, Wang, Jun, Shen, Linlin, Xu, Yong, Cao, Xiaochun |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Agent4FaceForgery: Multi-Agent LLM Framework for Realistic Face Forgery Detection
by: Lai, Yingxin, et al.
Published: (2025)
by: Lai, Yingxin, et al.
Published: (2025)
VisionZip: Longer is Better but Not Necessary in Vision Language Models
by: Yang, Senqiao, et al.
Published: (2024)
by: Yang, Senqiao, et al.
Published: (2024)
Multi-modal Document Presentation Attack Detection With Forensics Trace Disentanglement
by: Chen, Changsheng, et al.
Published: (2024)
by: Chen, Changsheng, et al.
Published: (2024)
SHIELD : An Evaluation Benchmark for Face Spoofing and Forgery Detection with Multimodal Large Language Models
by: Shi, Yichen, et al.
Published: (2024)
by: Shi, Yichen, et al.
Published: (2024)
GM-DF: Generalized Multi-Scenario Deepfake Detection
by: Lai, Yingxin, et al.
Published: (2024)
by: Lai, Yingxin, et al.
Published: (2024)
Mitigating Group-Level Fairness Disparities in Federated Visual Language Models
by: Chen, Chaomeng, et al.
Published: (2025)
by: Chen, Chaomeng, et al.
Published: (2025)
ZipVL: Efficient Large Vision-Language Models with Dynamic Token Sparsification
by: He, Yefei, et al.
Published: (2024)
by: He, Yefei, et al.
Published: (2024)
OmniZip: Audio-Guided Dynamic Token Compression for Fast Omnimodal Large Language Models
by: Tao, Keda, et al.
Published: (2025)
by: Tao, Keda, et al.
Published: (2025)
Forensics-Bench: A Comprehensive Forgery Detection Benchmark Suite for Large Vision Language Models
by: Wang, Jin, et al.
Published: (2025)
by: Wang, Jin, et al.
Published: (2025)
DDAP: Dual-Domain Anti-Personalization against Text-to-Image Diffusion Models
by: Yang, Jing, et al.
Published: (2024)
by: Yang, Jing, et al.
Published: (2024)
JECA^2: Judgment-Explanation Consistent Adversarial Attack against Forensic Vision-Language Models
by: Qian, Jiachen
Published: (2026)
by: Qian, Jiachen
Published: (2026)
Rethinking Vision-Language Model in Face Forensics: Multi-Modal Interpretable Forged Face Detector
by: Guo, Xiao, et al.
Published: (2025)
by: Guo, Xiao, et al.
Published: (2025)
MVFNet: Multipurpose Video Forensics Network using Multiple Forms of Forensic Evidence
by: Nguyen, Tai D., et al.
Published: (2025)
by: Nguyen, Tai D., et al.
Published: (2025)
OmniVL-Guard Pro: A Tool-Augmented Agent for Omnibus Vision-Language Forensics
by: Shen, Jinjie, et al.
Published: (2026)
by: Shen, Jinjie, et al.
Published: (2026)
Beyond Static Artifacts: A Forensic Benchmark for Video Deepfake Reasoning in Vision Language Models
by: Gu, Zheyuan, et al.
Published: (2026)
by: Gu, Zheyuan, et al.
Published: (2026)
CAT: Enhancing Multimodal Large Language Model to Answer Questions in Dynamic Audio-Visual Scenarios
by: Ye, Qilang, et al.
Published: (2024)
by: Ye, Qilang, et al.
Published: (2024)
Better Tokens for Better 3D: Advancing Vision-Language Modeling in 3D Medical Imaging
by: Hamamci, Ibrahim Ethem, et al.
Published: (2025)
by: Hamamci, Ibrahim Ethem, et al.
Published: (2025)
Hand Biometrics in Digital Forensics
by: Bera, Asish, et al.
Published: (2024)
by: Bera, Asish, et al.
Published: (2024)
Explainable Forensics of Manipulated Segments in Untrimmed Long Videos
by: Feng, Yue, et al.
Published: (2026)
by: Feng, Yue, et al.
Published: (2026)
IAD-GPT: Advancing Visual Knowledge in Multimodal Large Language Model for Industrial Anomaly Detection
by: Li, Zewen, et al.
Published: (2025)
by: Li, Zewen, et al.
Published: (2025)
GazeCLIP: Gaze-Guided CLIP with Adaptive-Enhanced Fine-Grained Language Prompt for Deepfake Attribution and Detection
by: Zhang, Yaning, et al.
Published: (2026)
by: Zhang, Yaning, et al.
Published: (2026)
Distilled Transformers with Locally Enhanced Global Representations for Face Forgery Detection
by: Zhang, Yaning, et al.
Published: (2024)
by: Zhang, Yaning, et al.
Published: (2024)
DINOv3 Beats Specialized Detectors: A Simple Foundation Model Baseline for Image Forensics
by: Yu, Jieming, et al.
Published: (2026)
by: Yu, Jieming, et al.
Published: (2026)
SGHA-Attack: Semantic-Guided Hierarchical Alignment for Transferable Targeted Attacks on Vision-Language Models
by: Wang, Haobo, et al.
Published: (2026)
by: Wang, Haobo, et al.
Published: (2026)
Can GPT tell us why these images are synthesized? Empowering Multimodal Large Language Models for Forensics
by: He, Yiran, et al.
Published: (2025)
by: He, Yiran, et al.
Published: (2025)
FakeScope: Large Multimodal Expert Model for Transparent AI-Generated Image Forensics
by: Li, Yixuan, et al.
Published: (2025)
by: Li, Yixuan, et al.
Published: (2025)
HalluCXR: Benchmarking and Mitigating Hallucinations in Medical Vision-Language Models for Chest Radiograph Interpretation
by: Wang, Haoyu, et al.
Published: (2026)
by: Wang, Haoyu, et al.
Published: (2026)
FaceShield: Explainable Face Anti-Spoofing with Multimodal Large Language Models
by: Wang, Hongyang, et al.
Published: (2025)
by: Wang, Hongyang, et al.
Published: (2025)
Cultivating Forensic Reasoning for Generalizable Multimodal Manipulation Detection
by: Zhang, Yuchen, et al.
Published: (2026)
by: Zhang, Yuchen, et al.
Published: (2026)
Forensic Video Analytic Software
by: Ratnarajah, Anton Jeran, et al.
Published: (2023)
by: Ratnarajah, Anton Jeran, et al.
Published: (2023)
Three Forensic Cues for JPEG AI Images
by: Bergmann, Sandra, et al.
Published: (2025)
by: Bergmann, Sandra, et al.
Published: (2025)
Disharmony: Forensics using Reverse Lighting Harmonization
by: Shin, Philip Wootaek, et al.
Published: (2025)
by: Shin, Philip Wootaek, et al.
Published: (2025)
Deep Image Restoration For Image Anti-Forensics
by: Tahir, Eren, et al.
Published: (2024)
by: Tahir, Eren, et al.
Published: (2024)
VAAS: Vision-Attention Anomaly Scoring for Image Manipulation Detection in Digital Forensics
by: Bamigbade, Opeyemi, et al.
Published: (2025)
by: Bamigbade, Opeyemi, et al.
Published: (2025)
Flow of Truth: Proactive Temporal Forensics for Image-to-Video Generation
by: Chen, Yuzhuo, et al.
Published: (2026)
by: Chen, Yuzhuo, et al.
Published: (2026)
UniForensics: Face Forgery Detection via General Facial Representation
by: Fang, Ziyuan, et al.
Published: (2024)
by: Fang, Ziyuan, et al.
Published: (2024)
IDRetracor: Towards Visual Forensics Against Malicious Face Swapping
by: Cheng, Jikang, et al.
Published: (2024)
by: Cheng, Jikang, et al.
Published: (2024)
FlowID : Enhancing Forensic Identification with Latent Flow-Matching Models
by: Ripoll, Jules, et al.
Published: (2026)
by: Ripoll, Jules, et al.
Published: (2026)
Nearly Solved? Robust Deepfake Detection Requires More than Visual Forensics
by: Levy, Guy, et al.
Published: (2024)
by: Levy, Guy, et al.
Published: (2024)
Beyond Semantic Priors: Mitigating Optimization Collapse for Generalizable Visual Forensics
by: Liu, Jipeng, et al.
Published: (2026)
by: Liu, Jipeng, et al.
Published: (2026)
Similar Items
-
Agent4FaceForgery: Multi-Agent LLM Framework for Realistic Face Forgery Detection
by: Lai, Yingxin, et al.
Published: (2025) -
VisionZip: Longer is Better but Not Necessary in Vision Language Models
by: Yang, Senqiao, et al.
Published: (2024) -
Multi-modal Document Presentation Attack Detection With Forensics Trace Disentanglement
by: Chen, Changsheng, et al.
Published: (2024) -
SHIELD : An Evaluation Benchmark for Face Spoofing and Forgery Detection with Multimodal Large Language Models
by: Shi, Yichen, et al.
Published: (2024) -
GM-DF: Generalized Multi-Scenario Deepfake Detection
by: Lai, Yingxin, et al.
Published: (2024)