Advancing Adaptive Multi-Stage Video Anomaly Reasoning: A Benchmark Dataset and Method
Fuente:
arXiv
Guardado en:
| Autores principales: | Huang, Chao, Wang, Benfeng, Wang, Wei, Wen, Jie, Shen, Li, Ren, Wenqi, Xu, Yong, Cao, Xiaochun |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Vad-R1: Towards Video Anomaly Reasoning via Perception-to-Cognition Chain-of-Thought
por: Huang, Chao, et al.
Publicado: (2025)
por: Huang, Chao, et al.
Publicado: (2025)
SphereVAD: Training-Free Video Anomaly Detection via Geodesic Inference on the Unit Hypersphere
por: Huang, Chao, et al.
Publicado: (2026)
por: Huang, Chao, et al.
Publicado: (2026)
Towards Explainable Industrial Anomaly Detection via Knowledge-Guided Latent Reasoning
por: Chen, Peng, et al.
Publicado: (2026)
por: Chen, Peng, et al.
Publicado: (2026)
M3-AD: Reflection-aware Multi-modal, Multi-category, and Multi-dimensional Benchmark and Framework for Industrial Anomaly Detection
por: Huang, Chao, et al.
Publicado: (2026)
por: Huang, Chao, et al.
Publicado: (2026)
UMDATrack: Unified Multi-Domain Adaptive Tracking Under Adverse Weather Conditions
por: Yao, Siyuan, et al.
Publicado: (2025)
por: Yao, Siyuan, et al.
Publicado: (2025)
Semi-Supervised State-Space Model with Dynamic Stacking Filter for Real-World Video Deraining
por: Sun, Shangquan, et al.
Publicado: (2025)
por: Sun, Shangquan, et al.
Publicado: (2025)
SurgCoT: Advancing Spatiotemporal Reasoning in Surgical Videos through a Chain-of-Thought Benchmark
por: Wang, Gui, et al.
Publicado: (2026)
por: Wang, Gui, et al.
Publicado: (2026)
CueBench: Advancing Unified Understanding of Context-Aware Video Anomalies in Real-World
por: Yu, Yating, et al.
Publicado: (2025)
por: Yu, Yating, et al.
Publicado: (2025)
CAMotion: A High-Quality Benchmark for Camouflaged Moving Object Detection in the Wild
por: Yao, Siyuan, et al.
Publicado: (2026)
por: Yao, Siyuan, et al.
Publicado: (2026)
Logit Standardization in Knowledge Distillation
por: Sun, Shangquan, et al.
Publicado: (2024)
por: Sun, Shangquan, et al.
Publicado: (2024)
Restoring Images in Adverse Weather Conditions via Histogram Transformer
por: Sun, Shangquan, et al.
Publicado: (2024)
por: Sun, Shangquan, et al.
Publicado: (2024)
RAD: A Comprehensive Dataset for Benchmarking the Robustness of Image Anomaly Detection
por: Cheng, Yuqi, et al.
Publicado: (2024)
por: Cheng, Yuqi, et al.
Publicado: (2024)
Agent4FaceForgery: Multi-Agent LLM Framework for Realistic Face Forgery Detection
por: Lai, Yingxin, et al.
Publicado: (2025)
por: Lai, Yingxin, et al.
Publicado: (2025)
Towards Real-World HDR Video Reconstruction: A Large-Scale Benchmark Dataset and A Two-Stage Alignment Network
por: Shu, Yong, et al.
Publicado: (2024)
por: Shu, Yong, et al.
Publicado: (2024)
Advancing Video Anomaly Detection: A Concise Review and a New Dataset
por: Zhu, Liyun, et al.
Publicado: (2024)
por: Zhu, Liyun, et al.
Publicado: (2024)
A Hybrid Transformer-Mamba Network for Single Image Deraining
por: Sun, Shangquan, et al.
Publicado: (2024)
por: Sun, Shangquan, et al.
Publicado: (2024)
EnsIR: An Ensemble Algorithm for Image Restoration via Gaussian Mixture Models
por: Sun, Shangquan, et al.
Publicado: (2024)
por: Sun, Shangquan, et al.
Publicado: (2024)
How Powerful Potential of Attention on Image Restoration?
por: Wang, Cong, et al.
Publicado: (2024)
por: Wang, Cong, et al.
Publicado: (2024)
Degradation-Guided One-Step Image Super-Resolution with Diffusion Priors
por: Zhang, Aiping, et al.
Publicado: (2024)
por: Zhang, Aiping, et al.
Publicado: (2024)
UncTrack: Reliable Visual Object Tracking with Uncertainty-Aware Prototype Memory Network
por: Yao, Siyuan, et al.
Publicado: (2025)
por: Yao, Siyuan, et al.
Publicado: (2025)
Towards Video Anomaly Detection from Event Streams: A Baseline and Benchmark Datasets
por: Wu, Peng, et al.
Publicado: (2026)
por: Wu, Peng, et al.
Publicado: (2026)
Texture-AD: An Anomaly Detection Dataset and Benchmark for Real Algorithm Development
por: Lei, Tianwu, et al.
Publicado: (2024)
por: Lei, Tianwu, et al.
Publicado: (2024)
Pistachio: Towards Synthetic, Balanced, and Long-Form Video Anomaly Benchmarks
por: Li, Jie, et al.
Publicado: (2025)
por: Li, Jie, et al.
Publicado: (2025)
ClimateIQA: A New Dataset and Benchmark to Advance Vision-Language Models in Meteorology Anomalies Analysis
por: Chen, Jian, et al.
Publicado: (2024)
por: Chen, Jian, et al.
Publicado: (2024)
DI-Retinex: Digital-Imaging Retinex Theory for Low-Light Image Enhancement
por: Sun, Shangquan, et al.
Publicado: (2024)
por: Sun, Shangquan, et al.
Publicado: (2024)
VRBench: A Benchmark for Multi-Step Reasoning in Long Narrative Videos
por: Yu, Jiashuo, et al.
Publicado: (2025)
por: Yu, Jiashuo, et al.
Publicado: (2025)
Video-MSR: Benchmarking Multi-hop Spatial Reasoning Capabilities of MLLMs
por: Zhu, Rui, et al.
Publicado: (2026)
por: Zhu, Rui, et al.
Publicado: (2026)
Weakly Supervised Video Anomaly Detection with Anomaly-Connected Components and Intention Reasoning
por: Wang, Yu, et al.
Publicado: (2026)
por: Wang, Yu, et al.
Publicado: (2026)
LOVE-R1: Advancing Long Video Understanding with an Adaptive Zoom-in Mechanism via Multi-Step Reasoning
por: Fu, Shenghao, et al.
Publicado: (2025)
por: Fu, Shenghao, et al.
Publicado: (2025)
Visual CoT: Advancing Multi-Modal Language Models with a Comprehensive Dataset and Benchmark for Chain-of-Thought Reasoning
por: Shao, Hao, et al.
Publicado: (2024)
por: Shao, Hao, et al.
Publicado: (2024)
Multi-Scale Distillation for RGB-D Anomaly Detection on the PD-REAL Dataset
por: Qin, Jianjian, et al.
Publicado: (2023)
por: Qin, Jianjian, et al.
Publicado: (2023)
ForensicZip: More Tokens are Better but Not Necessary in Forensic Vision-Language Models
por: Lai, Yingxin, et al.
Publicado: (2026)
por: Lai, Yingxin, et al.
Publicado: (2026)
Customizing Visual-Language Foundation Models for Multi-modal Anomaly Detection and Reasoning
por: Xu, Xiaohao, et al.
Publicado: (2024)
por: Xu, Xiaohao, et al.
Publicado: (2024)
Towards Scalable Video Anomaly Retrieval: A Synthetic Video-Text Benchmark
por: Yang, Shuyu, et al.
Publicado: (2025)
por: Yang, Shuyu, et al.
Publicado: (2025)
UAGLNet: Uncertainty-Aggregated Global-Local Fusion Network with Cooperative CNN-Transformer for Building Extraction
por: Yao, Siyuan, et al.
Publicado: (2025)
por: Yao, Siyuan, et al.
Publicado: (2025)
TIME: Temporal-Sensitive Multi-Dimensional Instruction Tuning and Robust Benchmarking for Video-LLMs
por: Wang, Yunxiao, et al.
Publicado: (2025)
por: Wang, Yunxiao, et al.
Publicado: (2025)
Towards Video Anomaly Retrieval from Video Anomaly Detection: New Benchmarks and Model
por: Wu, Peng, et al.
Publicado: (2023)
por: Wu, Peng, et al.
Publicado: (2023)
M4-SAR: A Multi-Resolution, Multi-Polarization, Multi-Scene, Multi-Source Dataset and Benchmark for optical-SAR Object Detection
por: Wang, Chao, et al.
Publicado: (2025)
por: Wang, Chao, et al.
Publicado: (2025)
Top-K Pairwise Ranking: Bridging the Gap Among Ranking-Based Measures for Multi-Label Classification
por: Wang, Zitai, et al.
Publicado: (2024)
por: Wang, Zitai, et al.
Publicado: (2024)
EgoEsportsQA: An Egocentric Video Benchmark for Perception and Reasoning in Esports
por: Ma, Jianzhe, et al.
Publicado: (2026)
por: Ma, Jianzhe, et al.
Publicado: (2026)
Ejemplares similares
-
Vad-R1: Towards Video Anomaly Reasoning via Perception-to-Cognition Chain-of-Thought
por: Huang, Chao, et al.
Publicado: (2025) -
SphereVAD: Training-Free Video Anomaly Detection via Geodesic Inference on the Unit Hypersphere
por: Huang, Chao, et al.
Publicado: (2026) -
Towards Explainable Industrial Anomaly Detection via Knowledge-Guided Latent Reasoning
por: Chen, Peng, et al.
Publicado: (2026) -
M3-AD: Reflection-aware Multi-modal, Multi-category, and Multi-dimensional Benchmark and Framework for Industrial Anomaly Detection
por: Huang, Chao, et al.
Publicado: (2026) -
UMDATrack: Unified Multi-Domain Adaptive Tracking Under Adverse Weather Conditions
por: Yao, Siyuan, et al.
Publicado: (2025)