Real-Time Fitness Exercise Classification and Counting from Video Frames
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Riccio, Riccardo |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Real Time Multi Organ Classification on Computed Tomography Images
par: Yerebakan, Halid Ziya, et autres
Publié: (2024)
par: Yerebakan, Halid Ziya, et autres
Publié: (2024)
FrameBridge: Improving Image-to-Video Generation with Bridge Models
par: Wang, Yuji, et autres
Publié: (2024)
par: Wang, Yuji, et autres
Publié: (2024)
Autoregressive Adversarial Post-Training for Real-Time Interactive Video Generation
par: Lin, Shanchuan, et autres
Publié: (2025)
par: Lin, Shanchuan, et autres
Publié: (2025)
Can You Count to Nine? A Human Evaluation Benchmark for Counting Limits in Modern Text-to-Video Models
par: Guo, Xuyang, et autres
Publié: (2025)
par: Guo, Xuyang, et autres
Publié: (2025)
Thinking in Frames: How Visual Context and Test-Time Scaling Empower Video Reasoning
par: Li, Chengzu, et autres
Publié: (2026)
par: Li, Chengzu, et autres
Publié: (2026)
Analysis of Hyperparameter Optimization Effects on Lightweight Deep Models for Real-Time Image Classification
par: Rakesh, Vineet Kumar, et autres
Publié: (2025)
par: Rakesh, Vineet Kumar, et autres
Publié: (2025)
OVR: A Dataset for Open Vocabulary Temporal Repetition Counting in Videos
par: Dwibedi, Debidatta, et autres
Publié: (2024)
par: Dwibedi, Debidatta, et autres
Publié: (2024)
Style-Based Neural Architectures for Real-Time Weather Classification
par: Ouattara, Hamed, et autres
Publié: (2026)
par: Ouattara, Hamed, et autres
Publié: (2026)
A Short Note on Evaluating RepNet for Temporal Repetition Counting in Videos
par: Dwibedi, Debidatta, et autres
Publié: (2024)
par: Dwibedi, Debidatta, et autres
Publié: (2024)
Divide, then Ground: Adapting Frame Selection to Query Types for Long-Form Video Understanding
par: Li, Jialuo, et autres
Publié: (2025)
par: Li, Jialuo, et autres
Publié: (2025)
ATHENA: Adaptive Test-Time Steering for Improving Count Fidelity in Diffusion Models
par: Sepehri, Mohammad Shahab, et autres
Publié: (2026)
par: Sepehri, Mohammad Shahab, et autres
Publié: (2026)
Look Every Frame All at Once: Video-Ma$^2$mba for Efficient Long-form Video Understanding with Multi-Axis Gradient Checkpointing
par: Lee, Hosu, et autres
Publié: (2024)
par: Lee, Hosu, et autres
Publié: (2024)
SVFSearch: A Multimodal Knowledge-Intensive Benchmark for Short-Video Frame Search in the Gaming Vertical Domain
par: Mao, Lingtao, et autres
Publié: (2026)
par: Mao, Lingtao, et autres
Publié: (2026)
Seeing Beyond Frames: Zero-Shot Pedestrian Intention Prediction with Raw Temporal Video and Multimodal Cues
par: Zambare, Pallavi, et autres
Publié: (2025)
par: Zambare, Pallavi, et autres
Publié: (2025)
CountCLIP -- [Re] Teaching CLIP to Count to Ten
par: Mestha, Harshvardhan, et autres
Publié: (2024)
par: Mestha, Harshvardhan, et autres
Publié: (2024)
ECRTime: Ensemble Integration of Classification and Retrieval for Time Series Classification
par: Zhao, Fan, et autres
Publié: (2024)
par: Zhao, Fan, et autres
Publié: (2024)
Visual-TCAV: Concept-based Attribution and Saliency Maps for Post-hoc Explainability in Image Classification
par: De Santis, Antonio, et autres
Publié: (2024)
par: De Santis, Antonio, et autres
Publié: (2024)
SortScrews: A Dataset and Baseline for Real-time Screw Classification
par: Fu, Tianhao, et autres
Publié: (2026)
par: Fu, Tianhao, et autres
Publié: (2026)
DGS-LRM: Real-Time Deformable 3D Gaussian Reconstruction From Monocular Videos
par: Lin, Chieh Hubert, et autres
Publié: (2025)
par: Lin, Chieh Hubert, et autres
Publié: (2025)
Diffusion Models Are Real-Time Game Engines
par: Valevski, Dani, et autres
Publié: (2024)
par: Valevski, Dani, et autres
Publié: (2024)
Learning Traffic Anomalies from Generative Models on Real-Time Observations
par: Giasemis, Fotis I., et autres
Publié: (2025)
par: Giasemis, Fotis I., et autres
Publié: (2025)
RayDer: Scalable Self-Supervised Novel View Synthesis from Real-World Video
par: Prestel, Ulrich, et autres
Publié: (2026)
par: Prestel, Ulrich, et autres
Publié: (2026)
Learning to Find Missing Video Frames with Synthetic Data Augmentation: A General Framework and Application in Generating Thermal Images Using RGB Cameras
par: Andersen, Mathias Viborg, et autres
Publié: (2024)
par: Andersen, Mathias Viborg, et autres
Publié: (2024)
Real-Time Human Action Recognition on Embedded Platforms
par: Wang, Ruiqi, et autres
Publié: (2024)
par: Wang, Ruiqi, et autres
Publié: (2024)
TinyBayes: Closed-Form Bayesian Inference via Jacobi Prior for Real-Time Image Classification on Edge Devices
par: Sardar, Shouvik, et autres
Publié: (2026)
par: Sardar, Shouvik, et autres
Publié: (2026)
Leveraging GANs For Active Appearance Models Optimized Model Fitting
par: Awasthi, Anurag
Publié: (2025)
par: Awasthi, Anurag
Publié: (2025)
Low-Resource Crop Classification from Multi-Spectral Time Series Using Lossless Compressors
par: Cheng, Wei, et autres
Publié: (2024)
par: Cheng, Wei, et autres
Publié: (2024)
Time Series Representations for Classification Lie Hidden in Pretrained Vision Transformers
par: Roschmann, Simon, et autres
Publié: (2025)
par: Roschmann, Simon, et autres
Publié: (2025)
Integer-Only Operations on Extreme Learning Machine Test Time Classification
par: Machadoa, Emerson Lopes, et autres
Publié: (2026)
par: Machadoa, Emerson Lopes, et autres
Publié: (2026)
Self-Supervised Multi-Frame Neural Scene Flow
par: Liu, Dongrui, et autres
Publié: (2024)
par: Liu, Dongrui, et autres
Publié: (2024)
Real-Time Pill Identification for the Visually Impaired Using Deep Learning
par: Dang, Bo, et autres
Publié: (2024)
par: Dang, Bo, et autres
Publié: (2024)
EITNet: An IoT-Enhanced Framework for Real-Time Basketball Action Recognition
par: Liu, Jingyu, et autres
Publié: (2024)
par: Liu, Jingyu, et autres
Publié: (2024)
DARDA: Domain-Aware Real-Time Dynamic Neural Network Adaptation
par: Rifat, Shahriar, et autres
Publié: (2024)
par: Rifat, Shahriar, et autres
Publié: (2024)
VRScout: Towards Real-Time, Autonomous Testing of Virtual Reality Games
par: Wu, Yurun, et autres
Publié: (2025)
par: Wu, Yurun, et autres
Publié: (2025)
Exploiting Test-Time Augmentation in Federated Learning for Brain Tumor MRI Classification
par: Melo, Thamara Leandra de Deus, et autres
Publié: (2026)
par: Melo, Thamara Leandra de Deus, et autres
Publié: (2026)
Computer Vision Approaches for Automated Bee Counting Application
par: Bilik, Simon, et autres
Publié: (2024)
par: Bilik, Simon, et autres
Publié: (2024)
TALC: Time-Aligned Captions for Multi-Scene Text-to-Video Generation
par: Bansal, Hritik, et autres
Publié: (2024)
par: Bansal, Hritik, et autres
Publié: (2024)
TurboDiffusion: Accelerating Video Diffusion Models by 100-200 Times
par: Zhang, Jintao, et autres
Publié: (2025)
par: Zhang, Jintao, et autres
Publié: (2025)
Scaling Image and Video Generation via Test-Time Evolutionary Search
par: He, Haoran, et autres
Publié: (2025)
par: He, Haoran, et autres
Publié: (2025)
WildFit: Autonomous In-situ Model Adaptation for Resource-Constrained IoT Systems
par: Rastikerdar, Mohammad Mehdi, et autres
Publié: (2024)
par: Rastikerdar, Mohammad Mehdi, et autres
Publié: (2024)
Documents similaires
-
Real Time Multi Organ Classification on Computed Tomography Images
par: Yerebakan, Halid Ziya, et autres
Publié: (2024) -
FrameBridge: Improving Image-to-Video Generation with Bridge Models
par: Wang, Yuji, et autres
Publié: (2024) -
Autoregressive Adversarial Post-Training for Real-Time Interactive Video Generation
par: Lin, Shanchuan, et autres
Publié: (2025) -
Can You Count to Nine? A Human Evaluation Benchmark for Counting Limits in Modern Text-to-Video Models
par: Guo, Xuyang, et autres
Publié: (2025) -
Thinking in Frames: How Visual Context and Test-Time Scaling Empower Video Reasoning
par: Li, Chengzu, et autres
Publié: (2026)