Flatten: Video Action Recognition is an Image Classification task
Fuente:
arXiv
Salvato in:
| Autori principali: | Chen, Junlin, Xu, Chengcheng, Xu, Yangfan, Yang, Jian, Li, Jun, Shi, Zhiping |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
FlattenGPT: Depth Compression for Transformer with Layer Flattening
di: Xu, Ruihan, et al.
Pubblicazione: (2026)
di: Xu, Ruihan, et al.
Pubblicazione: (2026)
SkateboardAI: The Coolest Video Action Recognition for Skateboarding
di: Chen, Hanxiao
Pubblicazione: (2023)
di: Chen, Hanxiao
Pubblicazione: (2023)
Reflective Human-Machine Co-adaptation for Enhanced Text-to-Image Generation Dialogue System
di: Feng, Yuheng, et al.
Pubblicazione: (2024)
di: Feng, Yuheng, et al.
Pubblicazione: (2024)
Exploring Explainability in Video Action Recognition
di: Saha, Avinab, et al.
Pubblicazione: (2024)
di: Saha, Avinab, et al.
Pubblicazione: (2024)
Temporal Alignment-Free Video Matching for Few-shot Action Recognition
di: Lee, SuBeen, et al.
Pubblicazione: (2025)
di: Lee, SuBeen, et al.
Pubblicazione: (2025)
Fire on Motion: Optimizing Video Pass-bands for Efficient Spiking Action Recognition
di: Ye, Shuhan, et al.
Pubblicazione: (2026)
di: Ye, Shuhan, et al.
Pubblicazione: (2026)
InstrAct: Towards Action-Centric Understanding in Instructional Videos
di: Yang, Zhuoyi, et al.
Pubblicazione: (2026)
di: Yang, Zhuoyi, et al.
Pubblicazione: (2026)
A Survey on Backbones for Deep Video Action Recognition
di: Tang, Zixuan, et al.
Pubblicazione: (2024)
di: Tang, Zixuan, et al.
Pubblicazione: (2024)
Exploring Ordinal Bias in Action Recognition for Instructional Videos
di: Kim, Joochan, et al.
Pubblicazione: (2025)
di: Kim, Joochan, et al.
Pubblicazione: (2025)
Are Video Reasoning Models Ready to Go Outside?
di: He, Yangfan, et al.
Pubblicazione: (2026)
di: He, Yangfan, et al.
Pubblicazione: (2026)
Align before Adapt: Leveraging Entity-to-Region Alignments for Generalizable Video Action Recognition
di: Chen, Yifei, et al.
Pubblicazione: (2023)
di: Chen, Yifei, et al.
Pubblicazione: (2023)
Representation Learning for Compressed Video Action Recognition via Attentive Cross-modal Interaction with Motion Enhancement
di: Li, Bing, et al.
Pubblicazione: (2022)
di: Li, Bing, et al.
Pubblicazione: (2022)
Flatten Long-Range Loss Landscapes for Cross-Domain Few-Shot Learning
di: Zou, Yixiong, et al.
Pubblicazione: (2024)
di: Zou, Yixiong, et al.
Pubblicazione: (2024)
Enhanced Convolutional Neural Networks for Improved Image Classification
di: Yang, Xiaoran, et al.
Pubblicazione: (2025)
di: Yang, Xiaoran, et al.
Pubblicazione: (2025)
Fine-grained Action Analysis: A Multi-modality and Multi-task Dataset of Figure Skating
di: Liu, Sheng-Lan, et al.
Pubblicazione: (2023)
di: Liu, Sheng-Lan, et al.
Pubblicazione: (2023)
Concept Complement Bottleneck Model for Interpretable Medical Image Diagnosis
di: Wang, Hongmei, et al.
Pubblicazione: (2024)
di: Wang, Hongmei, et al.
Pubblicazione: (2024)
BIVDiff: A Training-Free Framework for General-Purpose Video Synthesis via Bridging Image and Video Diffusion Models
di: Shi, Fengyuan, et al.
Pubblicazione: (2023)
di: Shi, Fengyuan, et al.
Pubblicazione: (2023)
Action-Based ADHD Diagnosis in Video
di: Li, Yichun, et al.
Pubblicazione: (2024)
di: Li, Yichun, et al.
Pubblicazione: (2024)
Topological Symmetry Enhanced Graph Convolution for Skeleton-Based Action Recognition
di: Liang, Zeyu, et al.
Pubblicazione: (2024)
di: Liang, Zeyu, et al.
Pubblicazione: (2024)
Rethinking Gradient-based Adversarial Attacks on Point Cloud Classification
di: Chen, Jun, et al.
Pubblicazione: (2025)
di: Chen, Jun, et al.
Pubblicazione: (2025)
Enhancing Multimodal In-Context Learning for Image Classification through Coreset Optimization
di: Chen, Huiyi, et al.
Pubblicazione: (2025)
di: Chen, Huiyi, et al.
Pubblicazione: (2025)
Multi-Agent Image Restoration
di: Jiang, Xu, et al.
Pubblicazione: (2025)
di: Jiang, Xu, et al.
Pubblicazione: (2025)
DDPM-MoCo: Advancing Industrial Surface Defect Generation and Detection with Generative and Contrastive Learning
di: He, Yangfan, et al.
Pubblicazione: (2024)
di: He, Yangfan, et al.
Pubblicazione: (2024)
Dual-Model Distillation for Efficient Action Classification with Hybrid Edge-Cloud Solution
di: Wei, Timothy, et al.
Pubblicazione: (2024)
di: Wei, Timothy, et al.
Pubblicazione: (2024)
Image-to-Video Transfer Learning based on Image-Language Foundation Models: A Comprehensive Survey
di: Li, Jinxuan, et al.
Pubblicazione: (2025)
di: Li, Jinxuan, et al.
Pubblicazione: (2025)
E3AD: An Emotion-Aware Vision-Language-Action Model for Human-Centric End-to-End Autonomous Driving
di: Tang, Yihong, et al.
Pubblicazione: (2025)
di: Tang, Yihong, et al.
Pubblicazione: (2025)
Active Generation for Image Classification
di: Huang, Tao, et al.
Pubblicazione: (2024)
di: Huang, Tao, et al.
Pubblicazione: (2024)
Multi-task Visual Grounding with Coarse-to-Fine Consistency Constraints
di: Dai, Ming, et al.
Pubblicazione: (2025)
di: Dai, Ming, et al.
Pubblicazione: (2025)
Stochastic Human Motion Prediction with Memory of Action Transition and Action Characteristic
di: Tang, Jianwei, et al.
Pubblicazione: (2025)
di: Tang, Jianwei, et al.
Pubblicazione: (2025)
One-Shot Action Recognition via Multi-Scale Spatial-Temporal Skeleton Matching
di: Yang, Siyuan, et al.
Pubblicazione: (2023)
di: Yang, Siyuan, et al.
Pubblicazione: (2023)
Interpretable Action Recognition on Hard to Classify Actions
di: Anichenko, Anastasia, et al.
Pubblicazione: (2024)
di: Anichenko, Anastasia, et al.
Pubblicazione: (2024)
SV3.3B: A Sports Video Understanding Model for Action Recognition
di: Kodathala, Sai Varun, et al.
Pubblicazione: (2025)
di: Kodathala, Sai Varun, et al.
Pubblicazione: (2025)
Multimodal Video Emotion Recognition with Reliable Reasoning Priors
di: Wang, Zhepeng, et al.
Pubblicazione: (2025)
di: Wang, Zhepeng, et al.
Pubblicazione: (2025)
Free-Mask: A Novel Paradigm of Integration Between the Segmentation Diffusion Model and Image Editing
di: Gao, Bo, et al.
Pubblicazione: (2024)
di: Gao, Bo, et al.
Pubblicazione: (2024)
Multi-Knowledge-oriented Nighttime Haze Imaging Enhancer for Vision-driven Intelligent Systems
di: Chen, Ai, et al.
Pubblicazione: (2025)
di: Chen, Ai, et al.
Pubblicazione: (2025)
KGS-GCN: Enhancing Sparse Skeleton Sensing via Kinematics-Driven Gaussian Splatting and Probabilistic Topology for Action Recognition
di: Chen, Yuhan, et al.
Pubblicazione: (2026)
di: Chen, Yuhan, et al.
Pubblicazione: (2026)
RAAP: Retrieval-Augmented Affordance Prediction with Cross-Image Action Alignment
di: Zhuang, Qiyuan, et al.
Pubblicazione: (2026)
di: Zhuang, Qiyuan, et al.
Pubblicazione: (2026)
Interpretable Geoscience Artificial Intelligence (XGeoS-AI): Application to Demystify Image Recognition
di: Xu, Jin-Jian, et al.
Pubblicazione: (2023)
di: Xu, Jin-Jian, et al.
Pubblicazione: (2023)
EPAM-Net: An Efficient Pose-driven Attention-guided Multimodal Network for Video Action Recognition
di: Abdelkawy, Ahmed, et al.
Pubblicazione: (2024)
di: Abdelkawy, Ahmed, et al.
Pubblicazione: (2024)
Semi-Supervised Audio-Visual Video Action Recognition with Audio Source Localization Guided Mixup
di: Kang, Seokun, et al.
Pubblicazione: (2025)
di: Kang, Seokun, et al.
Pubblicazione: (2025)
Documenti analoghi
-
FlattenGPT: Depth Compression for Transformer with Layer Flattening
di: Xu, Ruihan, et al.
Pubblicazione: (2026) -
SkateboardAI: The Coolest Video Action Recognition for Skateboarding
di: Chen, Hanxiao
Pubblicazione: (2023) -
Reflective Human-Machine Co-adaptation for Enhanced Text-to-Image Generation Dialogue System
di: Feng, Yuheng, et al.
Pubblicazione: (2024) -
Exploring Explainability in Video Action Recognition
di: Saha, Avinab, et al.
Pubblicazione: (2024) -
Temporal Alignment-Free Video Matching for Few-shot Action Recognition
di: Lee, SuBeen, et al.
Pubblicazione: (2025)