BusterX++: Towards Unified Cross-Modal AI-Generated Content Detection and Explanation with MLLM
Fuente:
arXiv
Salvato in:
| Autori principali: | Wen, Haiquan, Li, Tianxiao, Huang, Zhenglin, He, Yiwei, Cheng, Guangliang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
BusterX: MLLM-Powered AI-Generated Video Forgery Detection and Explanation
di: Wen, Haiquan, et al.
Pubblicazione: (2025)
di: Wen, Haiquan, et al.
Pubblicazione: (2025)
Towards Explainable Bilingual Multimodal Misinformation Detection and Localization
di: He, Yiwei, et al.
Pubblicazione: (2025)
di: He, Yiwei, et al.
Pubblicazione: (2025)
RAIDX: A Retrieval-Augmented Generation and GRPO Reinforcement Learning Framework for Explainable Deepfake Detection
di: Li, Tianxiao, et al.
Pubblicazione: (2025)
di: Li, Tianxiao, et al.
Pubblicazione: (2025)
Rethinking Cross-Generator Image Forgery Detection through DINOv3
di: Huang, Zhenglin, et al.
Pubblicazione: (2025)
di: Huang, Zhenglin, et al.
Pubblicazione: (2025)
Omni-Fake: Benchmarking Unified Multimodal Social Media Deepfake Detection
di: Li, Tianxiao, et al.
Pubblicazione: (2026)
di: Li, Tianxiao, et al.
Pubblicazione: (2026)
So-Fake: Benchmarking and Explaining Social Media Image Forgery Detection
di: Huang, Zhenglin, et al.
Pubblicazione: (2025)
di: Huang, Zhenglin, et al.
Pubblicazione: (2025)
SIDA: Social Media Image Deepfake Detection, Localization and Explanation with Large Multimodal Model
di: Huang, Zhenglin, et al.
Pubblicazione: (2024)
di: Huang, Zhenglin, et al.
Pubblicazione: (2024)
Spatial-DISE: A Unified Benchmark for Evaluating Spatial Reasoning in Vision-Language Models
di: Huang, Xinmiao, et al.
Pubblicazione: (2025)
di: Huang, Xinmiao, et al.
Pubblicazione: (2025)
Survey on AI-Generated Media Detection: From Non-MLLM to MLLM
di: Zou, Yueying, et al.
Pubblicazione: (2025)
di: Zou, Yueying, et al.
Pubblicazione: (2025)
InstructX: Towards Unified Visual Editing with MLLM Guidance
di: Mou, Chong, et al.
Pubblicazione: (2025)
di: Mou, Chong, et al.
Pubblicazione: (2025)
CAD-MLLM: Unifying Multimodality-Conditioned CAD Generation With MLLM
di: Xu, Jingwei, et al.
Pubblicazione: (2024)
di: Xu, Jingwei, et al.
Pubblicazione: (2024)
Guiding Cross-Modal Representations with MLLM Priors via Preference Alignment
di: Zhao, Pengfei, et al.
Pubblicazione: (2025)
di: Zhao, Pengfei, et al.
Pubblicazione: (2025)
Buster: Implanting Semantic Backdoor into Text Encoder to Mitigate NSFW Content Generation
di: Zhao, Xin, et al.
Pubblicazione: (2024)
di: Zhao, Xin, et al.
Pubblicazione: (2024)
Think and Answer ME: Benchmarking and Exploring Multi-Entity Reasoning Grounding in Remote Sensing
di: Lyu, Shuchang, et al.
Pubblicazione: (2026)
di: Lyu, Shuchang, et al.
Pubblicazione: (2026)
The Evolution of Video Anomaly Detection: A Unified Framework from DNN to MLLM
di: Gao, Shibo, et al.
Pubblicazione: (2025)
di: Gao, Shibo, et al.
Pubblicazione: (2025)
OracleSage: Towards Unified Visual-Linguistic Understanding of Oracle Bone Scripts through Cross-Modal Knowledge Fusion
di: Jiang, Hanqi, et al.
Pubblicazione: (2024)
di: Jiang, Hanqi, et al.
Pubblicazione: (2024)
Modality-Fair Preference Optimization for Trustworthy MLLM Alignment
di: Jiang, Songtao, et al.
Pubblicazione: (2024)
di: Jiang, Songtao, et al.
Pubblicazione: (2024)
Open-set Cross Modal Generalization via Multimodal Unified Representation
di: Huang, Hai, et al.
Pubblicazione: (2025)
di: Huang, Hai, et al.
Pubblicazione: (2025)
PUMA: Empowering Unified MLLM with Multi-granular Visual Generation
di: Fang, Rongyao, et al.
Pubblicazione: (2024)
di: Fang, Rongyao, et al.
Pubblicazione: (2024)
Enhancing Multimodal Unified Representations for Cross Modal Generalization
di: Huang, Hai, et al.
Pubblicazione: (2024)
di: Huang, Hai, et al.
Pubblicazione: (2024)
DiffX: Guide Your Layout to Cross-Modal Generative Modeling
di: Wang, Zeyu, et al.
Pubblicazione: (2024)
di: Wang, Zeyu, et al.
Pubblicazione: (2024)
Scalable Framework for Classifying AI-Generated Content Across Modalities
di: Duong, Anh-Kiet, et al.
Pubblicazione: (2025)
di: Duong, Anh-Kiet, et al.
Pubblicazione: (2025)
X2-DFD: A framework for eXplainable and eXtendable Deepfake Detection
di: Chen, Yize, et al.
Pubblicazione: (2024)
di: Chen, Yize, et al.
Pubblicazione: (2024)
Joint-Optimized Unsupervised Adversarial Domain Adaptation in Remote Sensing Segmentation with Prompted Foundation Model
di: Lyu, Shuchang, et al.
Pubblicazione: (2024)
di: Lyu, Shuchang, et al.
Pubblicazione: (2024)
MLLM as Video Narrator: Mitigating Modality Imbalance in Video Moment Retrieval
di: Cai, Weitong, et al.
Pubblicazione: (2024)
di: Cai, Weitong, et al.
Pubblicazione: (2024)
MLLM-based Textual Explanations for Face Comparison
di: Sony, Redwan, et al.
Pubblicazione: (2026)
di: Sony, Redwan, et al.
Pubblicazione: (2026)
Continual Cross-Modal Generalization
di: Xia, Yan, et al.
Pubblicazione: (2025)
di: Xia, Yan, et al.
Pubblicazione: (2025)
Segmentation, Detection and Explanation: A Unified Framework for CT Appearance Reasoning
di: Liu, Yuyuan, et al.
Pubblicazione: (2026)
di: Liu, Yuyuan, et al.
Pubblicazione: (2026)
AI-Generated Content (AIGC) for Various Data Modalities: A Survey
di: Foo, Lin Geng, et al.
Pubblicazione: (2023)
di: Foo, Lin Geng, et al.
Pubblicazione: (2023)
HAMMER: Harnessing MLLM via Cross-Modal Integration for Intention-Driven 3D Affordance Grounding
di: Yao, Lei, et al.
Pubblicazione: (2026)
di: Yao, Lei, et al.
Pubblicazione: (2026)
PO3AD: Predicting Point Offsets toward Better 3D Point Cloud Anomaly Detection
di: Ye, Jianan, et al.
Pubblicazione: (2024)
di: Ye, Jianan, et al.
Pubblicazione: (2024)
Adversarial Versus Federated: An Adversarial Learning based Multi-Modality Cross-Domain Federated Medical Segmentation
di: Zhou, You, et al.
Pubblicazione: (2025)
di: Zhou, You, et al.
Pubblicazione: (2025)
UniAVGen: Unified Audio and Video Generation with Asymmetric Cross-Modal Interactions
di: Zhang, Guozhen, et al.
Pubblicazione: (2025)
di: Zhang, Guozhen, et al.
Pubblicazione: (2025)
Large Motion Model for Unified Multi-Modal Motion Generation
di: Zhang, Mingyuan, et al.
Pubblicazione: (2024)
di: Zhang, Mingyuan, et al.
Pubblicazione: (2024)
ILLUME+: Illuminating Unified MLLM with Dual Visual Tokenization and Diffusion Refinement
di: Huang, Runhui, et al.
Pubblicazione: (2025)
di: Huang, Runhui, et al.
Pubblicazione: (2025)
Omni-Video 2: Scaling MLLM-Conditioned Diffusion for Unified Video Generation and Editing
di: Yang, Hao, et al.
Pubblicazione: (2026)
di: Yang, Hao, et al.
Pubblicazione: (2026)
Combating Pattern and Content Bias: Adversarial Feature Learning for Generalized AI-Generated Image Detection
di: Zhang, Haifeng, et al.
Pubblicazione: (2026)
di: Zhang, Haifeng, et al.
Pubblicazione: (2026)
X-MIC: Cross-Modal Instance Conditioning for Egocentric Action Generalization
di: Kukleva, Anna, et al.
Pubblicazione: (2024)
di: Kukleva, Anna, et al.
Pubblicazione: (2024)
UI-UG: A Unified MLLM for UI Understanding and Generation
di: Yang, Hao, et al.
Pubblicazione: (2025)
di: Yang, Hao, et al.
Pubblicazione: (2025)
XM-ALIGN: Unified Cross-Modal Embedding Alignment for Face-Voice Association
di: Fang, Zhihua, et al.
Pubblicazione: (2025)
di: Fang, Zhihua, et al.
Pubblicazione: (2025)
Documenti analoghi
-
BusterX: MLLM-Powered AI-Generated Video Forgery Detection and Explanation
di: Wen, Haiquan, et al.
Pubblicazione: (2025) -
Towards Explainable Bilingual Multimodal Misinformation Detection and Localization
di: He, Yiwei, et al.
Pubblicazione: (2025) -
RAIDX: A Retrieval-Augmented Generation and GRPO Reinforcement Learning Framework for Explainable Deepfake Detection
di: Li, Tianxiao, et al.
Pubblicazione: (2025) -
Rethinking Cross-Generator Image Forgery Detection through DINOv3
di: Huang, Zhenglin, et al.
Pubblicazione: (2025) -
Omni-Fake: Benchmarking Unified Multimodal Social Media Deepfake Detection
di: Li, Tianxiao, et al.
Pubblicazione: (2026)