The Evolution of Video Anomaly Detection: A Unified Framework from DNN to MLLM
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Gao, Shibo, Yang, Peipei, Guo, Haiyang, Liu, Yangyang, Chen, Yi, Li, Shuai, Zhu, Han, Xu, Jian, Zhang, Xu-Yao, Huang, Linlin |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
VAGU & GtS: LLM-Based Benchmark and Framework for Joint Video Anomaly Grounding and Understanding
par: Gao, Shibo, et autres
Publié: (2025)
par: Gao, Shibo, et autres
Publié: (2025)
CAD-MLLM: Unifying Multimodality-Conditioned CAD Generation With MLLM
par: Xu, Jingwei, et autres
Publié: (2024)
par: Xu, Jingwei, et autres
Publié: (2024)
No Need For Real Anomaly: MLLM Empowered Zero-Shot Video Anomaly Detection
par: Dai, Zunkai, et autres
Publié: (2026)
par: Dai, Zunkai, et autres
Publié: (2026)
Survey on AI-Generated Media Detection: From Non-MLLM to MLLM
par: Zou, Yueying, et autres
Publié: (2025)
par: Zou, Yueying, et autres
Publié: (2025)
ALARM: Automated MLLM-Based Anomaly Detection in Complex-EnviRonment Monitoring with Uncertainty Quantification
par: Zhang, Congjing, et autres
Publié: (2025)
par: Zhang, Congjing, et autres
Publié: (2025)
BridgeNet: A Unified Multimodal Framework for Bridging 2D and 3D Industrial Anomaly Detection
par: Xiang, An, et autres
Publié: (2025)
par: Xiang, An, et autres
Publié: (2025)
Rethinking Metrics and Benchmarks of Video Anomaly Detection
par: Liu, Zihao, et autres
Publié: (2025)
par: Liu, Zihao, et autres
Publié: (2025)
Absolute-Unified Multi-Class Anomaly Detection via Class-Agnostic Distribution Alignment
par: Guo, Jia, et autres
Publié: (2024)
par: Guo, Jia, et autres
Publié: (2024)
Technical Report for ICML 2024 TiFA Workshop MLLM Attack Challenge: Suffix Injection and Projected Gradient Descent Can Easily Fool An MLLM
par: Guo, Yangyang, et autres
Publié: (2024)
par: Guo, Yangyang, et autres
Publié: (2024)
Text-Guided Multimodal Unified Industrial Anomaly Detection
par: Li, Zewen, et autres
Publié: (2026)
par: Li, Zewen, et autres
Publié: (2026)
One Dinomaly2 Detect Them All: A Unified Framework for Full-Spectrum Unsupervised Anomaly Detection
par: Guo, Jia, et autres
Publié: (2025)
par: Guo, Jia, et autres
Publié: (2025)
UniADC: A Unified Framework for Anomaly Detection and Classification
par: Zhang, Ximiao, et autres
Publié: (2025)
par: Zhang, Ximiao, et autres
Publié: (2025)
HeadHunt-VAD: Hunting Robust Anomaly-Sensitive Heads in MLLM for Tuning-Free Video Anomaly Detection
par: Cai, Zhaolin, et autres
Publié: (2025)
par: Cai, Zhaolin, et autres
Publié: (2025)
FedMLLM: Federated Fine-tuning MLLM on Multimodal Heterogeneity Data
par: Xu, Binqian, et autres
Publié: (2024)
par: Xu, Binqian, et autres
Publié: (2024)
Omni-Video 2: Scaling MLLM-Conditioned Diffusion for Unified Video Generation and Editing
par: Yang, Hao, et autres
Publié: (2026)
par: Yang, Hao, et autres
Publié: (2026)
ILLUME+: Illuminating Unified MLLM with Dual Visual Tokenization and Diffusion Refinement
par: Huang, Runhui, et autres
Publié: (2025)
par: Huang, Runhui, et autres
Publié: (2025)
Language-guided Open-world Video Anomaly Detection under Weak Supervision
par: Liu, Zihao, et autres
Publié: (2025)
par: Liu, Zihao, et autres
Publié: (2025)
Place-it-R1: Unlocking Environment-aware Reasoning Potential of MLLM for Video Object Insertion
par: Gu, Bohai, et autres
Publié: (2026)
par: Gu, Bohai, et autres
Publié: (2026)
Retrv-R1: A Reasoning-Driven MLLM Framework for Universal and Efficient Multimodal Retrieval
par: Zhu, Lanyun, et autres
Publié: (2025)
par: Zhu, Lanyun, et autres
Publié: (2025)
PatchEAD: Unifying Industrial Visual Prompting Frameworks for Patch-Exclusive Anomaly Detection
par: Huang, Po-Han, et autres
Publié: (2025)
par: Huang, Po-Han, et autres
Publié: (2025)
GlanceVAD: Exploring Glance Supervision for Label-efficient Video Anomaly Detection
par: Zhang, Huaxin, et autres
Publié: (2024)
par: Zhang, Huaxin, et autres
Publié: (2024)
A Unified Framework for Human-centric Point Cloud Video Understanding
par: Xu, Yiteng, et autres
Publié: (2024)
par: Xu, Yiteng, et autres
Publié: (2024)
A Unified Reasoning Framework for Holistic Zero-Shot Video Anomaly Analysis
par: Lin, Dongheng, et autres
Publié: (2025)
par: Lin, Dongheng, et autres
Publié: (2025)
Holmes-VAD: Towards Unbiased and Explainable Video Anomaly Detection via Multi-modal LLM
par: Zhang, Huaxin, et autres
Publié: (2024)
par: Zhang, Huaxin, et autres
Publié: (2024)
AnomalyR1: A GRPO-based End-to-end MLLM for Industrial Anomaly Detection
par: Chao, Yuhao, et autres
Publié: (2025)
par: Chao, Yuhao, et autres
Publié: (2025)
A Lightweight 3D Anomaly Detection Method with Rotationally Invariant Features
par: Liang, Hanzhe, et autres
Publié: (2025)
par: Liang, Hanzhe, et autres
Publié: (2025)
Elysium: Exploring Object-level Perception in Videos via MLLM
par: Wang, Han, et autres
Publié: (2024)
par: Wang, Han, et autres
Publié: (2024)
MLLM as Video Narrator: Mitigating Modality Imbalance in Video Moment Retrieval
par: Cai, Weitong, et autres
Publié: (2024)
par: Cai, Weitong, et autres
Publié: (2024)
Sparse Reasoning is Enough: Biological-Inspired Framework for Video Anomaly Detection with Large Pre-trained Models
par: Huang, He, et autres
Publié: (2025)
par: Huang, He, et autres
Publié: (2025)
Video Motion Graphs
par: Liu, Haiyang, et autres
Publié: (2025)
par: Liu, Haiyang, et autres
Publié: (2025)
BusterX: MLLM-Powered AI-Generated Video Forgery Detection and Explanation
par: Wen, Haiquan, et autres
Publié: (2025)
par: Wen, Haiquan, et autres
Publié: (2025)
UI-UG: A Unified MLLM for UI Understanding and Generation
par: Yang, Hao, et autres
Publié: (2025)
par: Yang, Hao, et autres
Publié: (2025)
IADGPT: Unified LVLM for Few-Shot Industrial Anomaly Detection, Localization, and Reasoning via In-Context Learning
par: Zhao, Mengyang, et autres
Publié: (2025)
par: Zhao, Mengyang, et autres
Publié: (2025)
Efficient Motion-Aware Video MLLM
par: Zhao, Zijia, et autres
Publié: (2025)
par: Zhao, Zijia, et autres
Publié: (2025)
UniShield: An Adaptive Multi-Agent Framework for Unified Forgery Image Detection and Localization
par: Huang, Qing, et autres
Publié: (2025)
par: Huang, Qing, et autres
Publié: (2025)
VRAG-DFD: Verifiable Retrieval-Augmentation for MLLM-based Deepfake Detection
par: Han, Hui, et autres
Publié: (2026)
par: Han, Hui, et autres
Publié: (2026)
AnomalyCLIP: Object-agnostic Prompt Learning for Zero-shot Anomaly Detection
par: Zhou, Qihang, et autres
Publié: (2023)
par: Zhou, Qihang, et autres
Publié: (2023)
MLLM-CL: Continual Learning for Multimodal Large Language Models
par: Zhao, Hongbo, et autres
Publié: (2025)
par: Zhao, Hongbo, et autres
Publié: (2025)
Cross-Domain Learning for Video Anomaly Detection with Limited Supervision
par: Jain, Yashika, et autres
Publié: (2024)
par: Jain, Yashika, et autres
Publié: (2024)
BusterX++: Towards Unified Cross-Modal AI-Generated Content Detection and Explanation with MLLM
par: Wen, Haiquan, et autres
Publié: (2025)
par: Wen, Haiquan, et autres
Publié: (2025)
Documents similaires
-
VAGU & GtS: LLM-Based Benchmark and Framework for Joint Video Anomaly Grounding and Understanding
par: Gao, Shibo, et autres
Publié: (2025) -
CAD-MLLM: Unifying Multimodality-Conditioned CAD Generation With MLLM
par: Xu, Jingwei, et autres
Publié: (2024) -
No Need For Real Anomaly: MLLM Empowered Zero-Shot Video Anomaly Detection
par: Dai, Zunkai, et autres
Publié: (2026) -
Survey on AI-Generated Media Detection: From Non-MLLM to MLLM
par: Zou, Yueying, et autres
Publié: (2025) -
ALARM: Automated MLLM-Based Anomaly Detection in Complex-EnviRonment Monitoring with Uncertainty Quantification
par: Zhang, Congjing, et autres
Publié: (2025)