MVAFormer: RGB-based Multi-View Spatio-Temporal Action Recognition with Transformer
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yamane, Taiga, Suzuki, Satoshi, Masumura, Ryo, Tora, Shotaro |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MVTrajecter: Multi-View Pedestrian Tracking with Trajectory Motion Cost and Trajectory Appearance Cost
par: Yamane, Taiga, et autres
Publié: (2025)
par: Yamane, Taiga, et autres
Publié: (2025)
MSMVD: Exploiting Multi-scale Image Features via Multi-scale BEV Features for Multi-view Pedestrian Detection
par: Yamane, Taiga, et autres
Publié: (2025)
par: Yamane, Taiga, et autres
Publié: (2025)
Joint Modeling of Big Five and HEXACO for Multimodal Apparent Personality-trait Recognition
par: Masumura, Ryo, et autres
Publié: (2025)
par: Masumura, Ryo, et autres
Publié: (2025)
Difference Vector Equalization for Robust Fine-tuning of Vision-Language Models
par: Suzuki, Satoshi, et autres
Publié: (2025)
par: Suzuki, Satoshi, et autres
Publié: (2025)
MSSTNet: A Multi-Scale Spatio-Temporal CNN-Transformer Network for Dynamic Facial Expression Recognition
par: Wang, Linhuang, et autres
Publié: (2024)
par: Wang, Linhuang, et autres
Publié: (2024)
Modelling Spatio-Temporal Interactions For Compositional Action Recognition
par: Rajendiran, Ramanathan, et autres
Publié: (2023)
par: Rajendiran, Ramanathan, et autres
Publié: (2023)
UniSTFormer: Unified Spatio-Temporal Lightweight Transformer for Efficient Skeleton-Based Action Recognition
par: Wu, Wenhan, et autres
Publié: (2025)
par: Wu, Wenhan, et autres
Publié: (2025)
Spatio-Temporal Similarity Volume Aggregation for Open-Vocabulary Action Recognition
par: So, Yerim, et autres
Publié: (2026)
par: So, Yerim, et autres
Publié: (2026)
Spatio-Temporal Joint Density Driven Learning for Skeleton-Based Action Recognition
par: Gunasekara, Shanaka Ramesh, et autres
Publié: (2025)
par: Gunasekara, Shanaka Ramesh, et autres
Publié: (2025)
Flexible and Efficient Spatio-Temporal Transformer for Sequential Visual Place Recognition
par: Kiu, Yu, et autres
Publié: (2025)
par: Kiu, Yu, et autres
Publié: (2025)
Enhancing Spatio-Temporal Zero-shot Action Recognition with Language-driven Description Attributes
par: Kim, Yehna, et autres
Publié: (2025)
par: Kim, Yehna, et autres
Publié: (2025)
Transformer-based Fusion of 2D-pose and Spatio-temporal Embeddings for Distracted Driver Action Recognition
par: Akdag, Erkut, et autres
Publié: (2024)
par: Akdag, Erkut, et autres
Publié: (2024)
Multi-View Video Diffusion Policy: A 3D Spatio-Temporal-Aware Video Action Model
par: Li, Peiyan, et autres
Publié: (2026)
par: Li, Peiyan, et autres
Publié: (2026)
MambaVT: Spatio-Temporal Contextual Modeling for robust RGB-T Tracking
par: Lai, Simiao, et autres
Publié: (2024)
par: Lai, Simiao, et autres
Publié: (2024)
VIFSS: View-Invariant and Figure Skating-Specific Pose Representation Learning for Temporal Action Segmentation
par: Tanaka, Ryota, et autres
Publié: (2025)
par: Tanaka, Ryota, et autres
Publié: (2025)
StretchySnake: Flexible SSM Training Unlocks Action Recognition Across Spatio-Temporal Scales
par: Siddiqui, Nyle, et autres
Publié: (2025)
par: Siddiqui, Nyle, et autres
Publié: (2025)
LiDAR Prompted Spatio-Temporal Multi-View Stereo for Autonomous Driving
par: Sun, Qihao, et autres
Publié: (2026)
par: Sun, Qihao, et autres
Publié: (2026)
Open-Vocabulary Spatio-Temporal Action Detection
par: Wu, Tao, et autres
Publié: (2024)
par: Wu, Tao, et autres
Publié: (2024)
SkateFormer: Skeletal-Temporal Transformer for Human Action Recognition
par: Do, Jeonghyeok, et autres
Publié: (2024)
par: Do, Jeonghyeok, et autres
Publié: (2024)
DVFL-Net: A Lightweight Distilled Video Focal Modulation Network for Spatio-Temporal Action Recognition
par: Ullah, Hayat, et autres
Publié: (2025)
par: Ullah, Hayat, et autres
Publié: (2025)
D$^2$ST-Adapter: Disentangled-and-Deformable Spatio-Temporal Adapter for Few-shot Action Recognition
par: Pei, Wenjie, et autres
Publié: (2023)
par: Pei, Wenjie, et autres
Publié: (2023)
Heatmap Pooling Network for Action Recognition from RGB Videos
par: Liu, Mengyuan, et autres
Publié: (2025)
par: Liu, Mengyuan, et autres
Publié: (2025)
Learning Sequence Descriptor based on Spatio-Temporal Attention for Visual Place Recognition
par: Zhao, Junqiao, et autres
Publié: (2023)
par: Zhao, Junqiao, et autres
Publié: (2023)
Multimodal Cross-Domain Few-Shot Learning for Egocentric Action Recognition
par: Hatano, Masashi, et autres
Publié: (2024)
par: Hatano, Masashi, et autres
Publié: (2024)
View-aware Cross-modal Distillation for Multi-view Action Recognition
par: Nguyen, Trung Thanh, et autres
Publié: (2025)
par: Nguyen, Trung Thanh, et autres
Publié: (2025)
MV-GMN: State Space Model for Multi-View Action Recognition
par: Lin, Yuhui, et autres
Publié: (2025)
par: Lin, Yuhui, et autres
Publié: (2025)
MAVR-Net: Robust Multi-View Learning for MAV Action Recognition with Cross-View Attention
par: Zhang, Nengbo, et autres
Publié: (2025)
par: Zhang, Nengbo, et autres
Publié: (2025)
Micro-DualNet: Dual-Path Spatio-Temporal Network for Micro-Action Recognition
par: Chappa, Naga VS Raviteja, et autres
Publié: (2026)
par: Chappa, Naga VS Raviteja, et autres
Publié: (2026)
SpotFormer: Multi-Scale Spatio-Temporal Transformer for Facial Expression Spotting
par: Deng, Yicheng, et autres
Publié: (2024)
par: Deng, Yicheng, et autres
Publié: (2024)
Joint Temporal Pooling for Improving Skeleton-based Action Recognition
par: Gunasekara, Shanaka Ramesh, et autres
Publié: (2024)
par: Gunasekara, Shanaka Ramesh, et autres
Publié: (2024)
Dynamic Subframe Splitting and Spatio-Temporal Motion Entangled Sparse Attention for RGB-E Tracking
par: Shao, Pengcheng, et autres
Publié: (2024)
par: Shao, Pengcheng, et autres
Publié: (2024)
Human Action Recognition (HAR) Using Skeleton-based Spatial Temporal Relative Transformer Network: ST-RTR
par: Mehmood, Faisal, et autres
Publié: (2024)
par: Mehmood, Faisal, et autres
Publié: (2024)
Resource-Efficient RGB-Only Action Recognition for Edge Deployment
par: Yoon, Dongsik, et autres
Publié: (2026)
par: Yoon, Dongsik, et autres
Publié: (2026)
MultiTSF: Transformer-based Sensor Fusion for Human-Centric Multi-view and Multi-modal Action Recognition
par: Nguyen, Trung Thanh, et autres
Publié: (2025)
par: Nguyen, Trung Thanh, et autres
Publié: (2025)
USTEP: Spatio-Temporal Predictive Learning under A Unified View
par: Tan, Cheng, et autres
Publié: (2023)
par: Tan, Cheng, et autres
Publié: (2023)
SOAP: Enhancing Spatio-Temporal Relation and Motion Information Capturing for Few-Shot Action Recognition
par: Huang, Wenbo, et autres
Publié: (2024)
par: Huang, Wenbo, et autres
Publié: (2024)
Spatio-temporal Decoupled Knowledge Compensator for Few-Shot Action Recognition
par: Qu, Hongyu, et autres
Publié: (2026)
par: Qu, Hongyu, et autres
Publié: (2026)
Adversarial Robustness in RGB-Skeleton Action Recognition: Leveraging Attention Modality Reweighter
par: Liu, Chao, et autres
Publié: (2024)
par: Liu, Chao, et autres
Publié: (2024)
STMT: A Spatial-Temporal Mesh Transformer for MoCap-Based Action Recognition
par: Zhu, Xiaoyu, et autres
Publié: (2023)
par: Zhu, Xiaoyu, et autres
Publié: (2023)
Transformer RGBT Tracking with Spatio-Temporal Multimodal Tokens
par: Sun, Dengdi, et autres
Publié: (2024)
par: Sun, Dengdi, et autres
Publié: (2024)
Documents similaires
-
MVTrajecter: Multi-View Pedestrian Tracking with Trajectory Motion Cost and Trajectory Appearance Cost
par: Yamane, Taiga, et autres
Publié: (2025) -
MSMVD: Exploiting Multi-scale Image Features via Multi-scale BEV Features for Multi-view Pedestrian Detection
par: Yamane, Taiga, et autres
Publié: (2025) -
Joint Modeling of Big Five and HEXACO for Multimodal Apparent Personality-trait Recognition
par: Masumura, Ryo, et autres
Publié: (2025) -
Difference Vector Equalization for Robust Fine-tuning of Vision-Language Models
par: Suzuki, Satoshi, et autres
Publié: (2025) -
MSSTNet: A Multi-Scale Spatio-Temporal CNN-Transformer Network for Dynamic Facial Expression Recognition
par: Wang, Linhuang, et autres
Publié: (2024)