Dual Branch VideoMamba with Gated Class Token Fusion for Violence Detection
Fuente:
arXiv
Saved in:
| Main Authors: | Senadeera, Damith Chamalke, Yang, Xiaoyun, Li, Shibo, Awais, Muhammad, Kollias, Dimitrios, Slabaugh, Gregory |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
CoLoRSMamba: Conditional LoRA-Steered Mamba for Supervised Multimodal Violence Detection
by: Senadeera, Damith Chamalke, et al.
Published: (2026)
by: Senadeera, Damith Chamalke, et al.
Published: (2026)
CUE-Net: Violence Detection Video Analytics with Spatial Cropping, Enhanced UniformerV2 and Modified Efficient Additive Attention
by: Senadeera, Damith Chamalke, et al.
Published: (2024)
by: Senadeera, Damith Chamalke, et al.
Published: (2024)
DVD: A Comprehensive Dataset for Advancing Violence Detection in Real-World Scenarios
by: Kollias, Dimitrios, et al.
Published: (2025)
by: Kollias, Dimitrios, et al.
Published: (2025)
Snakes and Ladders: Two Steps Up for VideoMamba
by: Lu, Hui, et al.
Published: (2024)
by: Lu, Hui, et al.
Published: (2024)
VideoMamba: State Space Model for Efficient Video Understanding
by: Li, Kunchang, et al.
Published: (2024)
by: Li, Kunchang, et al.
Published: (2024)
VideoMamba: Spatio-Temporal Selective State Space Model
by: Park, Jinyoung, et al.
Published: (2024)
by: Park, Jinyoung, et al.
Published: (2024)
CAMS: Convolution and Attention-Free Mamba-based Cardiac Image Segmentation
by: Khan, Abbas, et al.
Published: (2024)
by: Khan, Abbas, et al.
Published: (2024)
UAVD-Mamba: Deformable Token Fusion Vision Mamba for Multimodal UAV Detection
by: Li, Wei, et al.
Published: (2025)
by: Li, Wei, et al.
Published: (2025)
XFMamba: Cross-Fusion Mamba for Multi-View Medical Image Classification
by: Zheng, Xiaoyu, et al.
Published: (2025)
by: Zheng, Xiaoyu, et al.
Published: (2025)
SAM2CLIP2SAM: Vision Language Model for Segmentation of 3D CT Scans for Covid-19 Detection
by: Kollias, Dimitrios, et al.
Published: (2024)
by: Kollias, Dimitrios, et al.
Published: (2024)
Domain adaptation, Explainability & Fairness in AI for Medical Image Analysis: Diagnosis of COVID-19 based on 3-D Chest CT-scans
by: Kollias, Dimitrios, et al.
Published: (2024)
by: Kollias, Dimitrios, et al.
Published: (2024)
Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC
by: Hu, Guanyu, et al.
Published: (2025)
by: Hu, Guanyu, et al.
Published: (2025)
Gait Recognition via Deep Residual Networks and Multi-Branch Feature Fusion
by: Luo, Yabo, et al.
Published: (2026)
by: Luo, Yabo, et al.
Published: (2026)
Common Corruptions for Enhancing and Evaluating Robustness in Air-to-Air Visual Object Detection
by: Arsenos, Anastasios, et al.
Published: (2024)
by: Arsenos, Anastasios, et al.
Published: (2024)
Uncertainty-guided Contrastive Learning for Single Source Domain Generalisation
by: Arsenos, Anastasios, et al.
Published: (2024)
by: Arsenos, Anastasios, et al.
Published: (2024)
MOAB: Multi-Modal Outer Arithmetic Block For Fusion Of Histopathological Images And Genetic Data For Brain Tumor Grading
by: Alwazzan, Omnia, et al.
Published: (2024)
by: Alwazzan, Omnia, et al.
Published: (2024)
Multimodal Outer Arithmetic Block Dual Fusion of Whole Slide Images and Omics Data for Precision Oncology
by: Alwazzan, Omnia, et al.
Published: (2024)
by: Alwazzan, Omnia, et al.
Published: (2024)
Distribution Matching for Multi-Task Learning of Classification Tasks: a Large-Scale Study on Faces & Beyond
by: Kollias, Dimitrios, et al.
Published: (2024)
by: Kollias, Dimitrios, et al.
Published: (2024)
FOAA: Flattened Outer Arithmetic Attention For Multimodal Tumor Classification
by: Alwazzan, Omnia, et al.
Published: (2024)
by: Alwazzan, Omnia, et al.
Published: (2024)
MambaSOD: Dual Mamba-Driven Cross-Modal Fusion Network for RGB-D Salient Object Detection
by: Zhan, Yue, et al.
Published: (2024)
by: Zhan, Yue, et al.
Published: (2024)
MambaVideo for Discrete Video Tokenization with Channel-Split Quantization
by: Argaw, Dawit Mureja, et al.
Published: (2025)
by: Argaw, Dawit Mureja, et al.
Published: (2025)
DB-MSMUNet:Dual Branch Multi-scale Mamba UNet for Pancreatic CT Scans Segmentation
by: Guan, Qiu, et al.
Published: (2026)
by: Guan, Qiu, et al.
Published: (2026)
Adaptive Multi-Modal Control of Digital Human Hand Synthesis Using a Region-Aware Cycle Loss
by: Fu, Qifan, et al.
Published: (2024)
by: Fu, Qifan, et al.
Published: (2024)
COVID-19 Computer-aided Diagnosis through AI-assisted CT Imaging Analysis: Deploying a Medical AI System
by: Gerogiannis, Demetris, et al.
Published: (2024)
by: Gerogiannis, Demetris, et al.
Published: (2024)
RAVE: Residual Vector Embedding for CLIP-Guided Backlit Image Enhancement
by: Gaintseva, Tatiana, et al.
Published: (2024)
by: Gaintseva, Tatiana, et al.
Published: (2024)
WaveMamba: Wavelet-Driven Mamba Fusion for RGB-Infrared Object Detection
by: Zhu, Haodong, et al.
Published: (2025)
by: Zhu, Haodong, et al.
Published: (2025)
GateFusion: Hierarchical Gated Cross-Modal Fusion for Active Speaker Detection
by: Wang, Yu, et al.
Published: (2025)
by: Wang, Yu, et al.
Published: (2025)
Feature-Space Oversampling for Addressing Class Imbalance in SAR Ship Classification
by: Awais, Ch Muhammad, et al.
Published: (2025)
by: Awais, Ch Muhammad, et al.
Published: (2025)
MDDFNet: Mamba-based Dynamic Dual Fusion Network for Traffic Sign Detection
by: Yu, TianYi
Published: (2025)
by: Yu, TianYi
Published: (2025)
STaR: Seamless Spatial-Temporal Aware Motion Retargeting with Penetration and Consistency Constraints
by: Yang, Xiaohang, et al.
Published: (2025)
by: Yang, Xiaohang, et al.
Published: (2025)
Ensuring UAV Safety: A Vision-only and Real-time Framework for Collision Avoidance Through Object Detection, Tracking, and Distance Estimation
by: Karampinis, Vasileios, et al.
Published: (2024)
by: Karampinis, Vasileios, et al.
Published: (2024)
MambaDFuse: A Mamba-based Dual-phase Model for Multi-modality Image Fusion
by: Li, Zhe, et al.
Published: (2024)
by: Li, Zhe, et al.
Published: (2024)
Beyond Euclidean: Dual-Space Representation Learning for Weakly Supervised Video Violence Detection
by: Leng, Jiaxu, et al.
Published: (2024)
by: Leng, Jiaxu, et al.
Published: (2024)
PiercingEye: Dual-Space Video Violence Detection with Hyperbolic Vision-Language Guidance
by: Leng, Jiaxu, et al.
Published: (2025)
by: Leng, Jiaxu, et al.
Published: (2025)
DAMS:Dual-Branch Adaptive Multiscale Spatiotemporal Framework for Video Anomaly Detection
by: An, Dezhi, et al.
Published: (2025)
by: An, Dezhi, et al.
Published: (2025)
Behaviour4All: in-the-wild Facial Behaviour Analysis Toolkit
by: Kollias, Dimitrios, et al.
Published: (2024)
by: Kollias, Dimitrios, et al.
Published: (2024)
MamFusion: Multi-Mamba with Temporal Fusion for Partially Relevant Video Retrieval
by: Ying, Xinru, et al.
Published: (2025)
by: Ying, Xinru, et al.
Published: (2025)
S2WMamba: A Wavelet-Assisted Mamba-Based Dual-Branch Network For Pansharpening
by: Zhang, Haoyu, et al.
Published: (2025)
by: Zhang, Haoyu, et al.
Published: (2025)
SuperCap: Multi-resolution Superpixel-based Image Captioning
by: Senior, Henry, et al.
Published: (2025)
by: Senior, Henry, et al.
Published: (2025)
HanDrawer: Leveraging Spatial Information to Render Realistic Hands Using a Conditional Diffusion Model in Single Stage
by: Fu, Qifan, et al.
Published: (2025)
by: Fu, Qifan, et al.
Published: (2025)
Similar Items
-
CoLoRSMamba: Conditional LoRA-Steered Mamba for Supervised Multimodal Violence Detection
by: Senadeera, Damith Chamalke, et al.
Published: (2026) -
CUE-Net: Violence Detection Video Analytics with Spatial Cropping, Enhanced UniformerV2 and Modified Efficient Additive Attention
by: Senadeera, Damith Chamalke, et al.
Published: (2024) -
DVD: A Comprehensive Dataset for Advancing Violence Detection in Real-World Scenarios
by: Kollias, Dimitrios, et al.
Published: (2025) -
Snakes and Ladders: Two Steps Up for VideoMamba
by: Lu, Hui, et al.
Published: (2024) -
VideoMamba: State Space Model for Efficient Video Understanding
by: Li, Kunchang, et al.
Published: (2024)