Enhancing Weakly Supervised Multimodal Video Anomaly Detection through Text Guidance
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Sun, Shengyang, Hua, Jiashen, Feng, Junyi, Gong, Xiaojin |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Multi-scale Bottleneck Transformer for Weakly Supervised Multimodal Violence Detection
par: Sun, Shengyang, et autres
Publié: (2024)
par: Sun, Shengyang, et autres
Publié: (2024)
GV-VAD : Exploring Video Generation for Weakly-Supervised Video Anomaly Detection
par: Cai, Suhang, et autres
Publié: (2025)
par: Cai, Suhang, et autres
Publié: (2025)
Weakly Supervised Video Anomaly Detection and Localization with Spatio-Temporal Prompts
par: Wu, Peng, et autres
Publié: (2024)
par: Wu, Peng, et autres
Publié: (2024)
Weakly-Supervised Spatiotemporal Anomaly Detection
par: Gianchandani, Urvi, et autres
Publié: (2026)
par: Gianchandani, Urvi, et autres
Publié: (2026)
Injecting Explainability and Lightweight Design into Weakly Supervised Video Anomaly Detection Systems
par: Jiang, Wen-Dong, et autres
Publié: (2024)
par: Jiang, Wen-Dong, et autres
Publié: (2024)
Text Prompt with Normality Guidance for Weakly Supervised Video Anomaly Detection
par: Yang, Zhiwei, et autres
Publié: (2024)
par: Yang, Zhiwei, et autres
Publié: (2024)
A Lightweight Dual-Branch System for Weakly-Supervised Video Anomaly Detection on Consumer Edge Devices
par: Jiang, Wen-Dong, et autres
Publié: (2024)
par: Jiang, Wen-Dong, et autres
Publié: (2024)
Weakly Supervised Camouflaged Object Detection Based on the SAM Model and Mask Guidance
par: Li, Xia, et autres
Publié: (2026)
par: Li, Xia, et autres
Publié: (2026)
Mixture of Experts Guided by Gaussian Splatters Matters: A new Approach to Weakly-Supervised Video Anomaly Detection
par: D'Amicantonio, Giacomo, et autres
Publié: (2025)
par: D'Amicantonio, Giacomo, et autres
Publié: (2025)
ConceptGuard: Proactive Safety in Text-and-Image-to-Video Generation through Multimodal Risk Detection
par: Ma, Ruize, et autres
Publié: (2025)
par: Ma, Ruize, et autres
Publié: (2025)
Weakly Supervised Gaussian Contrastive Grounding with Large Multimodal Models for Video Question Answering
par: Wang, Haibo, et autres
Publié: (2024)
par: Wang, Haibo, et autres
Publié: (2024)
SAIL: Similarity-Aware Guidance and Inter-Caption Augmentation-based Learning for Weakly-Supervised Dense Video Captioning
par: Kim, Ye-Chan, et autres
Publié: (2026)
par: Kim, Ye-Chan, et autres
Publié: (2026)
Re-purposing SAM into Efficient Visual Projectors for MLLM-Based Referring Image Segmentation
par: Yang, Xiaobo, et autres
Publié: (2025)
par: Yang, Xiaobo, et autres
Publié: (2025)
Weak to Strong: VLM-Based Pseudo-Labeling as a Weakly Supervised Training Strategy in Multimodal Video-based Hidden Emotion Understanding Tasks
par: Wang, Yufei, et autres
Publié: (2026)
par: Wang, Yufei, et autres
Publié: (2026)
Entropy Bootstrapping for Weakly Supervised Nuclei Detection
par: Willoughby, James, et autres
Publié: (2024)
par: Willoughby, James, et autres
Publié: (2024)
Adaptive Guidance Semantically Enhanced via Multimodal LLM for Edge-Cloud Object Detection
par: Hu, Yunqing, et autres
Publié: (2025)
par: Hu, Yunqing, et autres
Publié: (2025)
Debate-Enhanced Pseudo Labeling and Frequency-Aware Progressive Debiasing for Weakly-Supervised Camouflaged Object Detection with Scribble Annotations
par: Ge, Jiawei, et autres
Publié: (2025)
par: Ge, Jiawei, et autres
Publié: (2025)
Training-free Guidance in Text-to-Video Generation via Multimodal Planning and Structured Noise Initialization
par: Li, Jialu, et autres
Publié: (2025)
par: Li, Jialu, et autres
Publié: (2025)
MMVIAD: Multi-view Multi-task Video Understanding for Industrial Anomaly Detection
par: Zhao, Xiran, et autres
Publié: (2026)
par: Zhao, Xiran, et autres
Publié: (2026)
Text-guided Weakly Supervised Framework for Dynamic Facial Expression Recognition
par: Jung, Gunho, et autres
Publié: (2025)
par: Jung, Gunho, et autres
Publié: (2025)
Reasoning-Guided Grounding: Elevating Video Anomaly Detection through Multimodal Large Language Models
par: Agarwal, Sakshi, et autres
Publié: (2026)
par: Agarwal, Sakshi, et autres
Publié: (2026)
Towards Video Anomaly Retrieval from Video Anomaly Detection: New Benchmarks and Model
par: Wu, Peng, et autres
Publié: (2023)
par: Wu, Peng, et autres
Publié: (2023)
TOGA: Temporally Grounded Open-Ended Video QA with Weak Supervision
par: Gupta, Ayush, et autres
Publié: (2025)
par: Gupta, Ayush, et autres
Publié: (2025)
Dynamic Distinction Learning: Adaptive Pseudo Anomalies for Video Anomaly Detection
par: Lappas, Demetris, et autres
Publié: (2024)
par: Lappas, Demetris, et autres
Publié: (2024)
Remote Sensing Change Detection via Weak Temporal Supervision
par: Bou, Xavier, et autres
Publié: (2026)
par: Bou, Xavier, et autres
Publié: (2026)
Context-Aware Weakly Supervised Image Manipulation Localization with SAM Refinement
par: Wang, Xinghao, et autres
Publié: (2025)
par: Wang, Xinghao, et autres
Publié: (2025)
WeCromCL: Weakly Supervised Cross-Modality Contrastive Learning for Transcription-only Supervised Text Spotting
par: Wu, Jingjing, et autres
Publié: (2024)
par: Wu, Jingjing, et autres
Publié: (2024)
Weakly Supervised Point Clouds Transformer for 3D Object Detection
par: Tang, Zuojin, et autres
Publié: (2023)
par: Tang, Zuojin, et autres
Publié: (2023)
TMUAD: Enhancing Logical Capabilities in Unified Anomaly Detection Models with a Text Memory Bank
par: Liu, Jiawei, et autres
Publié: (2025)
par: Liu, Jiawei, et autres
Publié: (2025)
Rethinking Metrics and Benchmarks of Video Anomaly Detection
par: Liu, Zihao, et autres
Publié: (2025)
par: Liu, Zihao, et autres
Publié: (2025)
An Exploratory Study on Human-Centric Video Anomaly Detection through Variational Autoencoders and Trajectory Prediction
par: Noghre, Ghazal Alinezhad, et autres
Publié: (2024)
par: Noghre, Ghazal Alinezhad, et autres
Publié: (2024)
VirPro: Visual-referred Probabilistic Prompt Learning for Weakly-Supervised Monocular 3D Detection
par: Liu, Chupeng, et autres
Publié: (2026)
par: Liu, Chupeng, et autres
Publié: (2026)
No Need For Real Anomaly: MLLM Empowered Zero-Shot Video Anomaly Detection
par: Dai, Zunkai, et autres
Publié: (2026)
par: Dai, Zunkai, et autres
Publié: (2026)
HiProbe-VAD: Video Anomaly Detection via Hidden States Probing in Tuning-Free Multimodal LLMs
par: Cai, Zhaolin, et autres
Publié: (2025)
par: Cai, Zhaolin, et autres
Publié: (2025)
Normal-Abnormal Guided Generalist Anomaly Detection
par: Wang, Yuexin, et autres
Publié: (2025)
par: Wang, Yuexin, et autres
Publié: (2025)
UniCorn: Towards Self-Improving Unified Multimodal Models through Self-Generated Supervision
par: Han, Ruiyan, et autres
Publié: (2026)
par: Han, Ruiyan, et autres
Publié: (2026)
Deep Learning for Video Anomaly Detection: A Review
par: Wu, Peng, et autres
Publié: (2024)
par: Wu, Peng, et autres
Publié: (2024)
MMAD: A Comprehensive Benchmark for Multimodal Large Language Models in Industrial Anomaly Detection
par: Jiang, Xi, et autres
Publié: (2024)
par: Jiang, Xi, et autres
Publié: (2024)
Just Dance with $π$! A Poly-modal Inductor for Weakly-supervised Video Anomaly Detection
par: Majhi, Snehashis, et autres
Publié: (2025)
par: Majhi, Snehashis, et autres
Publié: (2025)
Image-Feature Weak-to-Strong Consistency: An Enhanced Paradigm for Semi-Supervised Learning
par: Wu, Zhiyu, et autres
Publié: (2024)
par: Wu, Zhiyu, et autres
Publié: (2024)
Documents similaires
-
Multi-scale Bottleneck Transformer for Weakly Supervised Multimodal Violence Detection
par: Sun, Shengyang, et autres
Publié: (2024) -
GV-VAD : Exploring Video Generation for Weakly-Supervised Video Anomaly Detection
par: Cai, Suhang, et autres
Publié: (2025) -
Weakly Supervised Video Anomaly Detection and Localization with Spatio-Temporal Prompts
par: Wu, Peng, et autres
Publié: (2024) -
Weakly-Supervised Spatiotemporal Anomaly Detection
par: Gianchandani, Urvi, et autres
Publié: (2026) -
Injecting Explainability and Lightweight Design into Weakly Supervised Video Anomaly Detection Systems
par: Jiang, Wen-Dong, et autres
Publié: (2024)