ThinkFake: Reasoning in Multimodal Large Language Models for AI-Generated Image Detection
Fuente:
arXiv
Guardado en:
| Autores principales: | Huang, Tai-Ming, Lin, Wei-Tung, Hua, Kai-Lung, Cheng, Wen-Huang, Yamagishi, Junichi, Chen, Jun-Cheng |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Towards More General Video-based Deepfake Detection through Facial Component Guided Adaptation for Foundation Model
por: Han, Yue-Hua, et al.
Publicado: (2024)
por: Han, Yue-Hua, et al.
Publicado: (2024)
Zero-Day Audio DeepFake Detection via Retrieval Augmentation and Profile Matching
por: Liu, Xuechen, et al.
Publicado: (2025)
por: Liu, Xuechen, et al.
Publicado: (2025)
DirectDrag: High-Fidelity, Mask-Free, Prompt-Free Drag-based Image Editing via Readout-Guided Feature Alignment
por: Liao, Sheng-Hao, et al.
Publicado: (2025)
por: Liao, Sheng-Hao, et al.
Publicado: (2025)
Investigating Thinking Behaviours of Reasoning-Based Language Models for Social Bias Mitigation
por: Luo, Guoqing, et al.
Publicado: (2025)
por: Luo, Guoqing, et al.
Publicado: (2025)
FakeMark: Deepfake Speech Attribution With Watermarked Artifacts
por: Ge, Wanying, et al.
Publicado: (2025)
por: Ge, Wanying, et al.
Publicado: (2025)
FakeScope: Large Multimodal Expert Model for Transparent AI-Generated Image Forensics
por: Li, Yixuan, et al.
Publicado: (2025)
por: Li, Yixuan, et al.
Publicado: (2025)
From Sharpness to Better Generalization for Speech Deepfake Detection
por: Huang, Wen, et al.
Publicado: (2025)
por: Huang, Wen, et al.
Publicado: (2025)
FakeGPT: Fake News Generation, Explanation and Detection of Large Language Models
por: Huang, Yue, et al.
Publicado: (2023)
por: Huang, Yue, et al.
Publicado: (2023)
PixMamba: Leveraging State Space Models in a Dual-Level Architecture for Underwater Image Enhancement
por: Lin, Wei-Tung, et al.
Publicado: (2024)
por: Lin, Wei-Tung, et al.
Publicado: (2024)
Attribute-Grounded Selective Reasoning for Artwork Emotion Understanding with Multimodal Large Language Models
por: Zhang, Cheng, et al.
Publicado: (2026)
por: Zhang, Cheng, et al.
Publicado: (2026)
SimTube: Generating Simulated Video Comments through Multimodal AI and User Personas
por: Hung, Yu-Kai, et al.
Publicado: (2024)
por: Hung, Yu-Kai, et al.
Publicado: (2024)
Unleashing Spatial Reasoning in Multimodal Large Language Models via Textual Representation Guided Reasoning
por: Hua, Jiacheng, et al.
Publicado: (2026)
por: Hua, Jiacheng, et al.
Publicado: (2026)
Does Fine-tuning by Reinforcement Learning Improve Generalization in Binary Speech Deepfake Detection?
por: Wang, Xin, et al.
Publicado: (2026)
por: Wang, Xin, et al.
Publicado: (2026)
When Bigger Isn't Better: A Comprehensive Fairness Evaluation of Political Bias in Multi-News Summarisation
por: Huang, Nannan, et al.
Publicado: (2026)
por: Huang, Nannan, et al.
Publicado: (2026)
Mitigating Language Mismatch in SSL-Based Speaker Anonymization
por: Zhang, Zhe, et al.
Publicado: (2025)
por: Zhang, Zhe, et al.
Publicado: (2025)
FakeBench: Probing Explainable Fake Image Detection via Large Multimodal Models
por: Li, Yixuan, et al.
Publicado: (2024)
por: Li, Yixuan, et al.
Publicado: (2024)
LACE: Exploring Turn-Taking and Parallel Interaction Modes in Human-AI Co-Creation for Iterative Image Generation
por: Huang, YenKai, et al.
Publicado: (2025)
por: Huang, YenKai, et al.
Publicado: (2025)
ThinkSound: Chain-of-Thought Reasoning in Multimodal Large Language Models for Audio Generation and Editing
por: Liu, Huadai, et al.
Publicado: (2025)
por: Liu, Huadai, et al.
Publicado: (2025)
ForenX: Towards Explainable AI-Generated Image Detection with Multimodal Large Language Models
por: Tan, Chuangchuang, et al.
Publicado: (2025)
por: Tan, Chuangchuang, et al.
Publicado: (2025)
Towards Data Drift Monitoring for Speech Deepfake Detection in the context of MLOps
por: Wang, Xin, et al.
Publicado: (2025)
por: Wang, Xin, et al.
Publicado: (2025)
A Preliminary Case Study on Long-Form In-the-Wild Audio Spoofing Detection
por: Liu, Xuechen, et al.
Publicado: (2024)
por: Liu, Xuechen, et al.
Publicado: (2024)
So-Fake: Benchmarking and Explaining Social Media Image Forgery Detection
por: Huang, Zhenglin, et al.
Publicado: (2025)
por: Huang, Zhenglin, et al.
Publicado: (2025)
Spot the Fake: Large Multimodal Model-Based Synthetic Image Detection with Artifact Explanation
por: Wen, Siwei, et al.
Publicado: (2025)
por: Wen, Siwei, et al.
Publicado: (2025)
SEER: Semantic Enhancement and Emotional Reasoning Network for Multimodal Fake News Detection
por: Zhu, Peican, et al.
Publicado: (2025)
por: Zhu, Peican, et al.
Publicado: (2025)
Fake News Detection and Manipulation Reasoning via Large Vision-Language Models
por: Jin, Ruihan, et al.
Publicado: (2024)
por: Jin, Ruihan, et al.
Publicado: (2024)
FlueBricks: A Construction Kit of Flute-like Instruments for Acoustic Reasoning
por: Chen, Bo-Yu, et al.
Publicado: (2026)
por: Chen, Bo-Yu, et al.
Publicado: (2026)
Why We Feel: Breaking Boundaries in Emotional Reasoning with Multimodal Large Language Models
por: Lin, Yuxiang, et al.
Publicado: (2025)
por: Lin, Yuxiang, et al.
Publicado: (2025)
Debunk and Infer: Multimodal Fake News Detection via Diffusion-Generated Evidence and LLM Reasoning
por: Yan, Kaiying, et al.
Publicado: (2025)
por: Yan, Kaiying, et al.
Publicado: (2025)
Omni-Fake: Benchmarking Unified Multimodal Social Media Deepfake Detection
por: Li, Tianxiao, et al.
Publicado: (2026)
por: Li, Tianxiao, et al.
Publicado: (2026)
Deconfounded Reasoning for Multimodal Fake News Detection via Causal Intervention
por: Liu, Moyang, et al.
Publicado: (2025)
por: Liu, Moyang, et al.
Publicado: (2025)
Exploring Self-Supervised Vision Transformers for Deepfake Detection: A Comparative Analysis
por: Nguyen, Huy H., et al.
Publicado: (2024)
por: Nguyen, Huy H., et al.
Publicado: (2024)
Thinking with Video: Video Generation as a Promising Multimodal Reasoning Paradigm
por: Tong, Jingqi, et al.
Publicado: (2025)
por: Tong, Jingqi, et al.
Publicado: (2025)
Structure-aware Propagation Generation with Large Language Models for Fake News Detection
por: Chen, Mengyang, et al.
Publicado: (2025)
por: Chen, Mengyang, et al.
Publicado: (2025)
Post-training for Deepfake Speech Detection
por: Ge, Wanying, et al.
Publicado: (2025)
por: Ge, Wanying, et al.
Publicado: (2025)
WildFake: A Large-scale Challenging Dataset for AI-Generated Images Detection
por: Hong, Yan, et al.
Publicado: (2024)
por: Hong, Yan, et al.
Publicado: (2024)
Thinking in Dynamics: How Multimodal Large Language Models Perceive, Track, and Reason Dynamics in Physical 4D World
por: Huang, Yuzhi, et al.
Publicado: (2026)
por: Huang, Yuzhi, et al.
Publicado: (2026)
Multimodal Large Language Model is a Human-Aligned Annotator for Text-to-Image Generation
por: Wu, Xun, et al.
Publicado: (2024)
por: Wu, Xun, et al.
Publicado: (2024)
Fake-HR1: Rethinking Reasoning of Vision Language Model for Synthetic Image Detection
por: Jiang, Changjiang, et al.
Publicado: (2026)
por: Jiang, Changjiang, et al.
Publicado: (2026)
LENS-DF: Deepfake Detection and Temporal Localization for Long-Form Noisy Speech
por: Liu, Xuechen, et al.
Publicado: (2025)
por: Liu, Xuechen, et al.
Publicado: (2025)
Make It Up: Fake Images, Real Gains in Generalized Few-shot Semantic Segmentation
por: Xie, Guohuan, et al.
Publicado: (2026)
por: Xie, Guohuan, et al.
Publicado: (2026)
Ejemplares similares
-
Towards More General Video-based Deepfake Detection through Facial Component Guided Adaptation for Foundation Model
por: Han, Yue-Hua, et al.
Publicado: (2024) -
Zero-Day Audio DeepFake Detection via Retrieval Augmentation and Profile Matching
por: Liu, Xuechen, et al.
Publicado: (2025) -
DirectDrag: High-Fidelity, Mask-Free, Prompt-Free Drag-based Image Editing via Readout-Guided Feature Alignment
por: Liao, Sheng-Hao, et al.
Publicado: (2025) -
Investigating Thinking Behaviours of Reasoning-Based Language Models for Social Bias Mitigation
por: Luo, Guoqing, et al.
Publicado: (2025) -
FakeMark: Deepfake Speech Attribution With Watermarked Artifacts
por: Ge, Wanying, et al.
Publicado: (2025)