SVFormer: A Direct Training Spiking Transformer for Efficient Video Action Recognition
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yu, Liutao, Huang, Liwei, Zhou, Chenlin, Zhang, Han, Ma, Zhengyu, Zhou, Huihui, Tian, Yonghong |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
QKFormer: Hierarchical Spiking Transformer using Q-K Attention
par: Zhou, Chenlin, et autres
Publié: (2024)
par: Zhou, Chenlin, et autres
Publié: (2024)
Direct Training High-Performance Deep Spiking Neural Networks: A Review of Theories and Methods
par: Zhou, Chenlin, et autres
Publié: (2024)
par: Zhou, Chenlin, et autres
Publié: (2024)
Long-Range Feedback Spiking Network Captures Dynamic and Static Representations of the Visual Cortex under Movie Stimuli
par: Huang, Liwei, et autres
Publié: (2023)
par: Huang, Liwei, et autres
Publié: (2023)
Spikingformer: A Key Foundation Model for Spiking Neural Networks
par: Zhou, Chenlin, et autres
Publié: (2023)
par: Zhou, Chenlin, et autres
Publié: (2023)
SpikePoint: An Efficient Point-based Spiking Neural Network for Event Cameras Action Recognition
par: Ren, Hongwei, et autres
Publié: (2023)
par: Ren, Hongwei, et autres
Publié: (2023)
High-speed and High-quality Vision Reconstruction of Spike Camera with Spike Stability Theorem
par: Zhang, Wei, et autres
Publié: (2024)
par: Zhang, Wei, et autres
Publié: (2024)
Parallel Spiking Neurons with High Efficiency and Ability to Learn Long-term Dependencies
par: Fang, Wei, et autres
Publié: (2023)
par: Fang, Wei, et autres
Publié: (2023)
Fire on Motion: Optimizing Video Pass-bands for Efficient Spiking Action Recognition
par: Ye, Shuhan, et autres
Publié: (2026)
par: Ye, Shuhan, et autres
Publié: (2026)
MSVIT: Improving Spiking Vision Transformer Using Multi-scale Attention Fusion
par: Hua, Wei, et autres
Publié: (2025)
par: Hua, Wei, et autres
Publié: (2025)
Scaling Spike-driven Transformer with Efficient Spike Firing Approximation Training
par: Yao, Man, et autres
Publié: (2024)
par: Yao, Man, et autres
Publié: (2024)
Efficient Speech Command Recognition Leveraging Spiking Neural Network and Curriculum Learning-based Knowledge Distillation
par: Wang, Jiaqi, et autres
Publié: (2024)
par: Wang, Jiaqi, et autres
Publié: (2024)
MoCrop: Training Free Motion Guided Cropping for Efficient Video Action Recognition
par: Huang, Binhua, et autres
Publié: (2025)
par: Huang, Binhua, et autres
Publié: (2025)
Human-Centric Transformer for Domain Adaptive Action Recognition
par: Lin, Kun-Yu, et autres
Publié: (2024)
par: Lin, Kun-Yu, et autres
Publié: (2024)
ActionHub: A Large-scale Action Video Description Dataset for Zero-shot Action Recognition
par: Zhou, Jiaming, et autres
Publié: (2024)
par: Zhou, Jiaming, et autres
Publié: (2024)
Multi-Timescale Motion-Decoupled Spiking Transformer for Audio-Visual Zero-Shot Learning
par: Li, Wenrui, et autres
Publié: (2025)
par: Li, Wenrui, et autres
Publié: (2025)
Dark Transformer: A Video Transformer for Action Recognition in the Dark
par: Ulhaq, Anwaar
Publié: (2024)
par: Ulhaq, Anwaar
Publié: (2024)
Spike-driven Transformer V2: Meta Spiking Neural Network Architecture Inspiring the Design of Next-generation Neuromorphic Chips
par: Yao, Man, et autres
Publié: (2024)
par: Yao, Man, et autres
Publié: (2024)
Leveraging Temporal Contextualization for Video Action Recognition
par: Kim, Minji, et autres
Publié: (2024)
par: Kim, Minji, et autres
Publié: (2024)
SSTFormer: Bridging Spiking Neural Network and Memory Support Transformer for Frame-Event based Recognition
par: Wang, Xiao, et autres
Publié: (2023)
par: Wang, Xiao, et autres
Publié: (2023)
Efficient 3D Recognition with Event-driven Spike Sparse Convolution
par: Qiu, Xuerui, et autres
Publié: (2024)
par: Qiu, Xuerui, et autres
Publié: (2024)
TP-Spikformer: Token Pruned Spiking Transformer
par: Wei, Wenjie, et autres
Publié: (2026)
par: Wei, Wenjie, et autres
Publié: (2026)
ReSpike: Residual Frames-based Hybrid Spiking Neural Networks for Efficient Action Recognition
par: Xiao, Shiting, et autres
Publié: (2024)
par: Xiao, Shiting, et autres
Publié: (2024)
Unleashing the Power of CNN and Transformer for Balanced RGB-Event Video Recognition
par: Wang, Xiao, et autres
Publié: (2023)
par: Wang, Xiao, et autres
Publié: (2023)
Binary Event-Driven Spiking Transformer
par: Cao, Honglin, et autres
Publié: (2025)
par: Cao, Honglin, et autres
Publié: (2025)
HoloTime: Taming Video Diffusion Models for Panoramic 4D Scene Generation
par: Zhou, Haiyang, et autres
Publié: (2025)
par: Zhou, Haiyang, et autres
Publié: (2025)
Adversarial Robustness in RGB-Skeleton Action Recognition: Leveraging Attention Modality Reweighter
par: Liu, Chao, et autres
Publié: (2024)
par: Liu, Chao, et autres
Publié: (2024)
Efficient-VLN: A Training-Efficient Vision-Language Navigation Model
par: Zheng, Duo, et autres
Publié: (2025)
par: Zheng, Duo, et autres
Publié: (2025)
Towards Scalable Modeling of Compressed Videos for Efficient Action Recognition
par: Biswas, Shristi Das, et autres
Publié: (2025)
par: Biswas, Shristi Das, et autres
Publié: (2025)
Enhancing Video Transformers for Action Understanding with VLM-aided Training
par: Lu, Hui, et autres
Publié: (2024)
par: Lu, Hui, et autres
Publié: (2024)
TDS-CLIP: Temporal Difference Side Network for Efficient VideoAction Recognition
par: Wang, Bin, et autres
Publié: (2024)
par: Wang, Bin, et autres
Publié: (2024)
Spiking Transformer:Introducing Accurate Addition-Only Spiking Self-Attention for Transformer
par: Guo, Yufei, et autres
Publié: (2025)
par: Guo, Yufei, et autres
Publié: (2025)
CT-SDM: A Sampling Diffusion Model for Sparse-View CT Reconstruction across All Sampling Rates
par: Yang, Liutao, et autres
Publié: (2024)
par: Yang, Liutao, et autres
Publié: (2024)
Masked Video and Body-worn IMU Autoencoder for Egocentric Action Recognition
par: Zhang, Mingfang, et autres
Publié: (2024)
par: Zhang, Mingfang, et autres
Publié: (2024)
Rethinking CLIP-based Video Learners in Cross-Domain Open-Vocabulary Action Recognition
par: Lin, Kun-Yu, et autres
Publié: (2024)
par: Lin, Kun-Yu, et autres
Publié: (2024)
SMTrack: End-to-End Trained Spiking Neural Networks for Multi-Object Tracking in RGB Videos
par: Zhong, Pengzhi, et autres
Publié: (2025)
par: Zhong, Pengzhi, et autres
Publié: (2025)
PruneVid: Visual Token Pruning for Efficient Video Large Language Models
par: Huang, Xiaohu, et autres
Publié: (2024)
par: Huang, Xiaohu, et autres
Publié: (2024)
View while Moving: Efficient Video Recognition in Long-untrimmed Videos
par: Tian, Ye, et autres
Publié: (2023)
par: Tian, Ye, et autres
Publié: (2023)
Enhanced Self-Distillation Framework for Efficient Spiking Neural Network Training
par: Zhao, Xiaochen, et autres
Publié: (2025)
par: Zhao, Xiaochen, et autres
Publié: (2025)
StegaVAR: Privacy-Preserving Video Action Recognition via Steganographic Domain Analysis
par: Chen, Lixin, et autres
Publié: (2025)
par: Chen, Lixin, et autres
Publié: (2025)
FROSTER: Frozen CLIP Is A Strong Teacher for Open-Vocabulary Action Recognition
par: Huang, Xiaohu, et autres
Publié: (2024)
par: Huang, Xiaohu, et autres
Publié: (2024)
Documents similaires
-
QKFormer: Hierarchical Spiking Transformer using Q-K Attention
par: Zhou, Chenlin, et autres
Publié: (2024) -
Direct Training High-Performance Deep Spiking Neural Networks: A Review of Theories and Methods
par: Zhou, Chenlin, et autres
Publié: (2024) -
Long-Range Feedback Spiking Network Captures Dynamic and Static Representations of the Visual Cortex under Movie Stimuli
par: Huang, Liwei, et autres
Publié: (2023) -
Spikingformer: A Key Foundation Model for Spiking Neural Networks
par: Zhou, Chenlin, et autres
Publié: (2023) -
SpikePoint: An Efficient Point-based Spiking Neural Network for Event Cameras Action Recognition
par: Ren, Hongwei, et autres
Publié: (2023)