When Spatial meets Temporal in Action Recognition
Fuente:
arXiv
Salvato in:
| Autori principali: | Chen, Huilin, Wang, Lei, Chen, Yifan, Gedeon, Tom, Koniusz, Piotr |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Motion meets Attention: Video Motion Prompts
di: Chen, Qixiang, et al.
Pubblicazione: (2024)
di: Chen, Qixiang, et al.
Pubblicazione: (2024)
Feature Hallucination for Self-supervised Action Recognition
di: Wang, Lei, et al.
Pubblicazione: (2025)
di: Wang, Lei, et al.
Pubblicazione: (2025)
Meet JEANIE: a Similarity Measure for 3D Skeleton Sequences via Temporal-Viewpoint Alignment
di: Wang, Lei, et al.
Pubblicazione: (2024)
di: Wang, Lei, et al.
Pubblicazione: (2024)
Adaptive Multi-head Contrastive Learning
di: Wang, Lei, et al.
Pubblicazione: (2023)
di: Wang, Lei, et al.
Pubblicazione: (2023)
Taylor Videos for Action Recognition
di: Wang, Lei, et al.
Pubblicazione: (2024)
di: Wang, Lei, et al.
Pubblicazione: (2024)
Learnable Expansion of Graph Operators for Multi-Modal Feature Fusion
di: Ding, Dexuan, et al.
Pubblicazione: (2024)
di: Ding, Dexuan, et al.
Pubblicazione: (2024)
CHAIN: Enhancing Generalization in Data-Efficient GANs via lipsCHitz continuity constrAIned Normalization
di: Ni, Yao, et al.
Pubblicazione: (2024)
di: Ni, Yao, et al.
Pubblicazione: (2024)
Video Understanding by Design: How Datasets Shape Architectures and Insights
di: Wang, Lei, et al.
Pubblicazione: (2025)
di: Wang, Lei, et al.
Pubblicazione: (2025)
PACE: Marrying generalization in PArameter-efficient fine-tuning with Consistency rEgularization
di: Ni, Yao, et al.
Pubblicazione: (2024)
di: Ni, Yao, et al.
Pubblicazione: (2024)
Subspace Kernel Learning on Tensor Sequences
di: Wang, Lei, et al.
Pubblicazione: (2026)
di: Wang, Lei, et al.
Pubblicazione: (2026)
Graph Your Own Prompt
di: Ding, Xi, et al.
Pubblicazione: (2025)
di: Ding, Xi, et al.
Pubblicazione: (2025)
Learning Time in Static Classifiers
di: Ding, Xi, et al.
Pubblicazione: (2025)
di: Ding, Xi, et al.
Pubblicazione: (2025)
TrackNetV4: Enhancing Fast Sports Object Tracking with Motion Attention Maps
di: Raj, Arjun, et al.
Pubblicazione: (2024)
di: Raj, Arjun, et al.
Pubblicazione: (2024)
Uncertainty-DTW for Sequences and Visual Tokens
di: Wang, Lei, et al.
Pubblicazione: (2026)
di: Wang, Lei, et al.
Pubblicazione: (2026)
A Closer Look at the Robustness of Contrastive Language-Image Pre-Training (CLIP)
di: Tu, Weijie, et al.
Pubblicazione: (2024)
di: Tu, Weijie, et al.
Pubblicazione: (2024)
Pre-training with Random Orthogonal Projection Image Modeling
di: Haghighat, Maryam, et al.
Pubblicazione: (2023)
di: Haghighat, Maryam, et al.
Pubblicazione: (2023)
What Does Softmax Probability Tell Us about Classifiers Ranking Across Diverse Test Conditions?
di: Tu, Weijie, et al.
Pubblicazione: (2024)
di: Tu, Weijie, et al.
Pubblicazione: (2024)
SeFAR: Semi-supervised Fine-grained Action Recognition with Temporal Perturbation and Learning Stabilization
di: Huang, Yongle, et al.
Pubblicazione: (2025)
di: Huang, Yongle, et al.
Pubblicazione: (2025)
How Does the Spatial Distribution of Pre-training Data Affect Geospatial Foundation Models?
di: Purohit, Mirali, et al.
Pubblicazione: (2025)
di: Purohit, Mirali, et al.
Pubblicazione: (2025)
Possibilistic Predictive Uncertainty for Deep Learning
di: Ni, Yao, et al.
Pubblicazione: (2026)
di: Ni, Yao, et al.
Pubblicazione: (2026)
Benchmarking Sensitivity of Continual Graph Learning for Skeleton-Based Action Recognition
di: Wei, Wei, et al.
Pubblicazione: (2024)
di: Wei, Wei, et al.
Pubblicazione: (2024)
Spatial Action Unit Cues for Interpretable Deep Facial Expression Recognition
di: Belharbi, Soufiane, et al.
Pubblicazione: (2024)
di: Belharbi, Soufiane, et al.
Pubblicazione: (2024)
An Empirical Study Into What Matters for Calibrating Vision-Language Models
di: Tu, Weijie, et al.
Pubblicazione: (2024)
di: Tu, Weijie, et al.
Pubblicazione: (2024)
Gems: Group Emotion Profiling Through Multimodal Situational Understanding
di: Kataria, Anubhav, et al.
Pubblicazione: (2025)
di: Kataria, Anubhav, et al.
Pubblicazione: (2025)
CSGaze: Context-aware Social Gaze Prediction
di: Madan, Surbhi, et al.
Pubblicazione: (2025)
di: Madan, Surbhi, et al.
Pubblicazione: (2025)
ICED: Concept-level Machine Unlearning via Interpretable Concept Decomposition
di: Lin, Shen, et al.
Pubblicazione: (2026)
di: Lin, Shen, et al.
Pubblicazione: (2026)
Evolving Skeletons: Motion Dynamics in Action Recognition
di: Qiu, Jushang, et al.
Pubblicazione: (2025)
di: Qiu, Jushang, et al.
Pubblicazione: (2025)
Prototypical Calibrating Ambiguous Samples for Micro-Action Recognition
di: Li, Kun, et al.
Pubblicazione: (2024)
di: Li, Kun, et al.
Pubblicazione: (2024)
Hierarchically Robust Zero-shot Vision-language Models
di: Dong, Junhao, et al.
Pubblicazione: (2026)
di: Dong, Junhao, et al.
Pubblicazione: (2026)
Action-slot: Visual Action-centric Representations for Multi-label Atomic Activity Recognition in Traffic Scenes
di: Kung, Chi-Hsi, et al.
Pubblicazione: (2023)
di: Kung, Chi-Hsi, et al.
Pubblicazione: (2023)
CM2-Net: Continual Cross-Modal Mapping Network for Driver Action Recognition
di: Wang, Ruoyu, et al.
Pubblicazione: (2024)
di: Wang, Ruoyu, et al.
Pubblicazione: (2024)
Inference Attacks Against Face Recognition Model without Classification Layers
di: Huang, Yuanqing, et al.
Pubblicazione: (2024)
di: Huang, Yuanqing, et al.
Pubblicazione: (2024)
FinePseudo: Improving Pseudo-Labelling through Temporal-Alignablity for Semi-Supervised Fine-Grained Action Recognition
di: Dave, Ishan Rajendrakumar, et al.
Pubblicazione: (2024)
di: Dave, Ishan Rajendrakumar, et al.
Pubblicazione: (2024)
LookWhen? Fast Video Recognition by Learning When, Where, and What to Compute
di: Salamatian, Ali, et al.
Pubblicazione: (2026)
di: Salamatian, Ali, et al.
Pubblicazione: (2026)
From Spatial to Actions: Grounding Vision-Language-Action Model in Spatial Foundation Priors
di: Zhang, Zhengshen, et al.
Pubblicazione: (2025)
di: Zhang, Zhengshen, et al.
Pubblicazione: (2025)
Noise Consistency Regularization for Improved Subject-Driven Image Synthesis
di: Ni, Yao, et al.
Pubblicazione: (2025)
di: Ni, Yao, et al.
Pubblicazione: (2025)
On the Utility of 3D Hand Poses for Action Recognition
di: Shamil, Md Salman, et al.
Pubblicazione: (2024)
di: Shamil, Md Salman, et al.
Pubblicazione: (2024)
Video RWKV:Video Action Recognition Based RWKV
di: Yin, Zhuowen, et al.
Pubblicazione: (2024)
di: Yin, Zhuowen, et al.
Pubblicazione: (2024)
Modular Retrieval-Augmented Generalization for Human Action Recognition
di: Liao, Peng, et al.
Pubblicazione: (2026)
di: Liao, Peng, et al.
Pubblicazione: (2026)
When Graph meets Multimodal: Benchmarking and Meditating on Multimodal Attributed Graphs Learning
di: Yan, Hao, et al.
Pubblicazione: (2024)
di: Yan, Hao, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Motion meets Attention: Video Motion Prompts
di: Chen, Qixiang, et al.
Pubblicazione: (2024) -
Feature Hallucination for Self-supervised Action Recognition
di: Wang, Lei, et al.
Pubblicazione: (2025) -
Meet JEANIE: a Similarity Measure for 3D Skeleton Sequences via Temporal-Viewpoint Alignment
di: Wang, Lei, et al.
Pubblicazione: (2024) -
Adaptive Multi-head Contrastive Learning
di: Wang, Lei, et al.
Pubblicazione: (2023) -
Taylor Videos for Action Recognition
di: Wang, Lei, et al.
Pubblicazione: (2024)