STAA: Spatio-Temporal Attention Attribution for Real-Time Interpreting Transformer-based Video Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Zerui, Liu, Yan |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Spatio-Temporal Side Tuning Pre-trained Foundation Models for Video-based Pedestrian Attribute Recognition
par: Wang, Xiao, et autres
Publié: (2024)
par: Wang, Xiao, et autres
Publié: (2024)
Interpretable Motion-Attentive Maps: Spatio-Temporally Localizing Concepts in Video Diffusion Transformers
par: Jun, Youngjun, et autres
Publié: (2026)
par: Jun, Youngjun, et autres
Publié: (2026)
Knowing Your Target: Target-Aware Transformer Makes Better Spatio-Temporal Video Grounding
par: Gu, Xin, et autres
Publié: (2025)
par: Gu, Xin, et autres
Publié: (2025)
SAM-PM: Enhancing Video Camouflaged Object Detection using Spatio-Temporal Attention
par: Meeran, Muhammad Nawfal, et autres
Publié: (2024)
par: Meeran, Muhammad Nawfal, et autres
Publié: (2024)
TimeBlind: A Spatio-Temporal Compositionality Benchmark for Video LLMs
par: Li, Baiqi, et autres
Publié: (2026)
par: Li, Baiqi, et autres
Publié: (2026)
UST-SSM: Unified Spatio-Temporal State Space Models for Point Cloud Video Modeling
par: Li, Peiming, et autres
Publié: (2025)
par: Li, Peiming, et autres
Publié: (2025)
Weakly Supervised Video Anomaly Detection and Localization with Spatio-Temporal Prompts
par: Wu, Peng, et autres
Publié: (2024)
par: Wu, Peng, et autres
Publié: (2024)
Human-Centric Video Anomaly Detection Through Spatio-Temporal Pose Tokenization and Transformer
par: Noghre, Ghazal Alinezhad, et autres
Publié: (2024)
par: Noghre, Ghazal Alinezhad, et autres
Publié: (2024)
Context-based Interpretable Spatio-Temporal Graph Convolutional Network for Human Motion Forecasting
par: Medina, Edgar, et autres
Publié: (2024)
par: Medina, Edgar, et autres
Publié: (2024)
Cross Space and Time: A Spatio-Temporal Unitized Model for Traffic Flow Forecasting
par: Ruan, Weilin, et autres
Publié: (2024)
par: Ruan, Weilin, et autres
Publié: (2024)
VideoStir: Understanding Long Videos via Spatio-Temporally Structured and Intent-Aware RAG
par: Fu, Honghao, et autres
Publié: (2026)
par: Fu, Honghao, et autres
Publié: (2026)
Tracking the Truth: Object-Centric Spatio-Temporal Monitoring for Video Large Language Models
par: Cao, Tri, et autres
Publié: (2026)
par: Cao, Tri, et autres
Publié: (2026)
STAA-SNN: Spatial-Temporal Attention Aggregator for Spiking Neural Networks
par: Zhang, Tianqing, et autres
Publié: (2025)
par: Zhang, Tianqing, et autres
Publié: (2025)
LiteFat: Lightweight Spatio-Temporal Graph Learning for Real-Time Driver Fatigue Detection
par: Ren, Jing, et autres
Publié: (2025)
par: Ren, Jing, et autres
Publié: (2025)
DropletVideo: A Dataset and Approach to Explore Integral Spatio-Temporal Consistent Video Generation
par: Zhang, Runze, et autres
Publié: (2025)
par: Zhang, Runze, et autres
Publié: (2025)
Real-Time Visual Attribution Streaming in Thinking Model
par: Kang, Seil, et autres
Publié: (2026)
par: Kang, Seil, et autres
Publié: (2026)
Mining Multi-Modality Spatio-Temporal Cues for Video Important Person Identification
par: Wang, Xiao, et autres
Publié: (2026)
par: Wang, Xiao, et autres
Publié: (2026)
GATS: Gaussian Aware Temporal Scaling Transformer for Invariant 4D Spatio-Temporal Point Cloud Representation
par: Tian, Jiayi, et autres
Publié: (2026)
par: Tian, Jiayi, et autres
Publié: (2026)
Faster Image2Video Generation: A Closer Look at CLIP Image Embedding's Impact on Spatio-Temporal Cross-Attentions
par: Taghipour, Ashkan, et autres
Publié: (2024)
par: Taghipour, Ashkan, et autres
Publié: (2024)
Reprogramming Vision Foundation Models for Spatio-Temporal Forecasting
par: Chen, Changlu, et autres
Publié: (2025)
par: Chen, Changlu, et autres
Publié: (2025)
Open-o3-Video: Grounded Video Reasoning with Explicit Spatio-Temporal Evidence
par: Meng, Jiahao, et autres
Publié: (2025)
par: Meng, Jiahao, et autres
Publié: (2025)
ToG-Bench: Task-Oriented Spatio-Temporal Grounding in Egocentric Videos
par: Xu, Qi'ao, et autres
Publié: (2025)
par: Xu, Qi'ao, et autres
Publié: (2025)
CubeComposer: Spatio-Temporal Autoregressive 4K 360° Video Generation from Perspective Video
par: Li, Lingen, et autres
Publié: (2026)
par: Li, Lingen, et autres
Publié: (2026)
Interpretable and Sparse Linear Attention with Decoupled Membership-Subspace Modeling via MCR2 Objective
par: Liu, Tianyuan, et autres
Publié: (2026)
par: Liu, Tianyuan, et autres
Publié: (2026)
LiteAttention: A Temporal Sparse Attention for Diffusion Transformers
par: Shmilovich, Dor, et autres
Publié: (2025)
par: Shmilovich, Dor, et autres
Publié: (2025)
B-VLLM: A Vision Large Language Model with Balanced Spatio-Temporal Tokens
par: Lu, Zhuqiang, et autres
Publié: (2024)
par: Lu, Zhuqiang, et autres
Publié: (2024)
Multi-modal Spatio-Temporal Transformer for High-resolution Land Subsidence Prediction
par: Yao, Wendong, et autres
Publié: (2025)
par: Yao, Wendong, et autres
Publié: (2025)
STACT-Time: Spatio-Temporal Cross Attention for Cine Thyroid Ultrasound Time Series Classification
par: Adam, Irsyad, et autres
Publié: (2025)
par: Adam, Irsyad, et autres
Publié: (2025)
Benchmarking Pretrained Attention-based Models for Real-Time Recognition in Robot-Assisted Esophagectomy
par: de Jong, Ronald L. P. D., et autres
Publié: (2024)
par: de Jong, Ronald L. P. D., et autres
Publié: (2024)
TimeScope: Towards Task-Oriented Temporal Grounding In Long Videos
par: Liu, Xiangrui, et autres
Publié: (2025)
par: Liu, Xiangrui, et autres
Publié: (2025)
Interpreting Video Representations with Spatio-Temporal Sparse Autoencoders
par: Dokme, Atahan, et autres
Publié: (2026)
par: Dokme, Atahan, et autres
Publié: (2026)
SalM$^{2}$: An Extremely Lightweight Saliency Mamba Model for Real-Time Cognitive Awareness of Driver Attention
par: Zhao, Chunyu, et autres
Publié: (2025)
par: Zhao, Chunyu, et autres
Publié: (2025)
Multi-Granular Spatio-Temporal Token Merging for Training-Free Acceleration of Video LLMs
par: Hyun, Jeongseok, et autres
Publié: (2025)
par: Hyun, Jeongseok, et autres
Publié: (2025)
STR-Match: Matching SpatioTemporal Relevance Score for Training-Free Video Editing
par: Lee, Junsung, et autres
Publié: (2025)
par: Lee, Junsung, et autres
Publié: (2025)
DETACH : Decomposed Spatio-Temporal Alignment for Exocentric Video and Ambient Sensors with Staged Learning
par: Yoon, Junho, et autres
Publié: (2025)
par: Yoon, Junho, et autres
Publié: (2025)
VMonarch: Efficient Video Diffusion Transformers with Structured Attention
par: Liang, Cheng, et autres
Publié: (2026)
par: Liang, Cheng, et autres
Publié: (2026)
Attribute Based Interpretable Evaluation Metrics for Generative Models
par: Kim, Dongkyun, et autres
Publié: (2023)
par: Kim, Dongkyun, et autres
Publié: (2023)
EventAug: Multifaceted Spatio-Temporal Data Augmentation Methods for Event-based Learning
par: Tian, Yukun, et autres
Publié: (2024)
par: Tian, Yukun, et autres
Publié: (2024)
Multi-scale Spatio-temporal Transformer-based Imbalanced Longitudinal Learning for Glaucoma Forecasting from Irregular Time Series Images
par: Yang, Xikai, et autres
Publié: (2024)
par: Yang, Xikai, et autres
Publié: (2024)
OmniGround: A Comprehensive Spatio-Temporal Grounding Benchmark for Real-World Complex Scenarios
par: Gao, Hong, et autres
Publié: (2025)
par: Gao, Hong, et autres
Publié: (2025)
Documents similaires
-
Spatio-Temporal Side Tuning Pre-trained Foundation Models for Video-based Pedestrian Attribute Recognition
par: Wang, Xiao, et autres
Publié: (2024) -
Interpretable Motion-Attentive Maps: Spatio-Temporally Localizing Concepts in Video Diffusion Transformers
par: Jun, Youngjun, et autres
Publié: (2026) -
Knowing Your Target: Target-Aware Transformer Makes Better Spatio-Temporal Video Grounding
par: Gu, Xin, et autres
Publié: (2025) -
SAM-PM: Enhancing Video Camouflaged Object Detection using Spatio-Temporal Attention
par: Meeran, Muhammad Nawfal, et autres
Publié: (2024) -
TimeBlind: A Spatio-Temporal Compositionality Benchmark for Video LLMs
par: Li, Baiqi, et autres
Publié: (2026)