BusterX++: Towards Unified Cross-Modal AI-Generated Content Detection and Explanation with MLLM
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wen, Haiquan, Li, Tianxiao, Huang, Zhenglin, He, Yiwei, Cheng, Guangliang |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
BusterX: MLLM-Powered AI-Generated Video Forgery Detection and Explanation
par: Wen, Haiquan, et autres
Publié: (2025)
par: Wen, Haiquan, et autres
Publié: (2025)
Towards Explainable Bilingual Multimodal Misinformation Detection and Localization
par: He, Yiwei, et autres
Publié: (2025)
par: He, Yiwei, et autres
Publié: (2025)
RAIDX: A Retrieval-Augmented Generation and GRPO Reinforcement Learning Framework for Explainable Deepfake Detection
par: Li, Tianxiao, et autres
Publié: (2025)
par: Li, Tianxiao, et autres
Publié: (2025)
Rethinking Cross-Generator Image Forgery Detection through DINOv3
par: Huang, Zhenglin, et autres
Publié: (2025)
par: Huang, Zhenglin, et autres
Publié: (2025)
Omni-Fake: Benchmarking Unified Multimodal Social Media Deepfake Detection
par: Li, Tianxiao, et autres
Publié: (2026)
par: Li, Tianxiao, et autres
Publié: (2026)
So-Fake: Benchmarking and Explaining Social Media Image Forgery Detection
par: Huang, Zhenglin, et autres
Publié: (2025)
par: Huang, Zhenglin, et autres
Publié: (2025)
SIDA: Social Media Image Deepfake Detection, Localization and Explanation with Large Multimodal Model
par: Huang, Zhenglin, et autres
Publié: (2024)
par: Huang, Zhenglin, et autres
Publié: (2024)
Spatial-DISE: A Unified Benchmark for Evaluating Spatial Reasoning in Vision-Language Models
par: Huang, Xinmiao, et autres
Publié: (2025)
par: Huang, Xinmiao, et autres
Publié: (2025)
Survey on AI-Generated Media Detection: From Non-MLLM to MLLM
par: Zou, Yueying, et autres
Publié: (2025)
par: Zou, Yueying, et autres
Publié: (2025)
InstructX: Towards Unified Visual Editing with MLLM Guidance
par: Mou, Chong, et autres
Publié: (2025)
par: Mou, Chong, et autres
Publié: (2025)
CAD-MLLM: Unifying Multimodality-Conditioned CAD Generation With MLLM
par: Xu, Jingwei, et autres
Publié: (2024)
par: Xu, Jingwei, et autres
Publié: (2024)
Guiding Cross-Modal Representations with MLLM Priors via Preference Alignment
par: Zhao, Pengfei, et autres
Publié: (2025)
par: Zhao, Pengfei, et autres
Publié: (2025)
Buster: Implanting Semantic Backdoor into Text Encoder to Mitigate NSFW Content Generation
par: Zhao, Xin, et autres
Publié: (2024)
par: Zhao, Xin, et autres
Publié: (2024)
Think and Answer ME: Benchmarking and Exploring Multi-Entity Reasoning Grounding in Remote Sensing
par: Lyu, Shuchang, et autres
Publié: (2026)
par: Lyu, Shuchang, et autres
Publié: (2026)
The Evolution of Video Anomaly Detection: A Unified Framework from DNN to MLLM
par: Gao, Shibo, et autres
Publié: (2025)
par: Gao, Shibo, et autres
Publié: (2025)
OracleSage: Towards Unified Visual-Linguistic Understanding of Oracle Bone Scripts through Cross-Modal Knowledge Fusion
par: Jiang, Hanqi, et autres
Publié: (2024)
par: Jiang, Hanqi, et autres
Publié: (2024)
Modality-Fair Preference Optimization for Trustworthy MLLM Alignment
par: Jiang, Songtao, et autres
Publié: (2024)
par: Jiang, Songtao, et autres
Publié: (2024)
Open-set Cross Modal Generalization via Multimodal Unified Representation
par: Huang, Hai, et autres
Publié: (2025)
par: Huang, Hai, et autres
Publié: (2025)
PUMA: Empowering Unified MLLM with Multi-granular Visual Generation
par: Fang, Rongyao, et autres
Publié: (2024)
par: Fang, Rongyao, et autres
Publié: (2024)
Enhancing Multimodal Unified Representations for Cross Modal Generalization
par: Huang, Hai, et autres
Publié: (2024)
par: Huang, Hai, et autres
Publié: (2024)
DiffX: Guide Your Layout to Cross-Modal Generative Modeling
par: Wang, Zeyu, et autres
Publié: (2024)
par: Wang, Zeyu, et autres
Publié: (2024)
Scalable Framework for Classifying AI-Generated Content Across Modalities
par: Duong, Anh-Kiet, et autres
Publié: (2025)
par: Duong, Anh-Kiet, et autres
Publié: (2025)
X2-DFD: A framework for eXplainable and eXtendable Deepfake Detection
par: Chen, Yize, et autres
Publié: (2024)
par: Chen, Yize, et autres
Publié: (2024)
Joint-Optimized Unsupervised Adversarial Domain Adaptation in Remote Sensing Segmentation with Prompted Foundation Model
par: Lyu, Shuchang, et autres
Publié: (2024)
par: Lyu, Shuchang, et autres
Publié: (2024)
MLLM as Video Narrator: Mitigating Modality Imbalance in Video Moment Retrieval
par: Cai, Weitong, et autres
Publié: (2024)
par: Cai, Weitong, et autres
Publié: (2024)
MLLM-based Textual Explanations for Face Comparison
par: Sony, Redwan, et autres
Publié: (2026)
par: Sony, Redwan, et autres
Publié: (2026)
Continual Cross-Modal Generalization
par: Xia, Yan, et autres
Publié: (2025)
par: Xia, Yan, et autres
Publié: (2025)
Segmentation, Detection and Explanation: A Unified Framework for CT Appearance Reasoning
par: Liu, Yuyuan, et autres
Publié: (2026)
par: Liu, Yuyuan, et autres
Publié: (2026)
AI-Generated Content (AIGC) for Various Data Modalities: A Survey
par: Foo, Lin Geng, et autres
Publié: (2023)
par: Foo, Lin Geng, et autres
Publié: (2023)
HAMMER: Harnessing MLLM via Cross-Modal Integration for Intention-Driven 3D Affordance Grounding
par: Yao, Lei, et autres
Publié: (2026)
par: Yao, Lei, et autres
Publié: (2026)
PO3AD: Predicting Point Offsets toward Better 3D Point Cloud Anomaly Detection
par: Ye, Jianan, et autres
Publié: (2024)
par: Ye, Jianan, et autres
Publié: (2024)
Adversarial Versus Federated: An Adversarial Learning based Multi-Modality Cross-Domain Federated Medical Segmentation
par: Zhou, You, et autres
Publié: (2025)
par: Zhou, You, et autres
Publié: (2025)
UniAVGen: Unified Audio and Video Generation with Asymmetric Cross-Modal Interactions
par: Zhang, Guozhen, et autres
Publié: (2025)
par: Zhang, Guozhen, et autres
Publié: (2025)
Large Motion Model for Unified Multi-Modal Motion Generation
par: Zhang, Mingyuan, et autres
Publié: (2024)
par: Zhang, Mingyuan, et autres
Publié: (2024)
ILLUME+: Illuminating Unified MLLM with Dual Visual Tokenization and Diffusion Refinement
par: Huang, Runhui, et autres
Publié: (2025)
par: Huang, Runhui, et autres
Publié: (2025)
Omni-Video 2: Scaling MLLM-Conditioned Diffusion for Unified Video Generation and Editing
par: Yang, Hao, et autres
Publié: (2026)
par: Yang, Hao, et autres
Publié: (2026)
Combating Pattern and Content Bias: Adversarial Feature Learning for Generalized AI-Generated Image Detection
par: Zhang, Haifeng, et autres
Publié: (2026)
par: Zhang, Haifeng, et autres
Publié: (2026)
X-MIC: Cross-Modal Instance Conditioning for Egocentric Action Generalization
par: Kukleva, Anna, et autres
Publié: (2024)
par: Kukleva, Anna, et autres
Publié: (2024)
UI-UG: A Unified MLLM for UI Understanding and Generation
par: Yang, Hao, et autres
Publié: (2025)
par: Yang, Hao, et autres
Publié: (2025)
XM-ALIGN: Unified Cross-Modal Embedding Alignment for Face-Voice Association
par: Fang, Zhihua, et autres
Publié: (2025)
par: Fang, Zhihua, et autres
Publié: (2025)
Documents similaires
-
BusterX: MLLM-Powered AI-Generated Video Forgery Detection and Explanation
par: Wen, Haiquan, et autres
Publié: (2025) -
Towards Explainable Bilingual Multimodal Misinformation Detection and Localization
par: He, Yiwei, et autres
Publié: (2025) -
RAIDX: A Retrieval-Augmented Generation and GRPO Reinforcement Learning Framework for Explainable Deepfake Detection
par: Li, Tianxiao, et autres
Publié: (2025) -
Rethinking Cross-Generator Image Forgery Detection through DINOv3
par: Huang, Zhenglin, et autres
Publié: (2025) -
Omni-Fake: Benchmarking Unified Multimodal Social Media Deepfake Detection
par: Li, Tianxiao, et autres
Publié: (2026)