Localization-Aware Multi-Scale Representation Learning for Repetitive Action Counting
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Sujia, Shen, Xiangwei, Tang, Yansong, Dong, Xin, Geng, Wenjia, Chen, Lei |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
CoSTL: Comprehensive Spatial-Temporal Representation Learning for Moment Retrieval and Highlight Detection
di: Dong, Xin, et al.
Pubblicazione: (2026)
di: Dong, Xin, et al.
Pubblicazione: (2026)
LOGO: A Long-Form Video Dataset for Group Action Quality Assessment
di: Zhang, Shiyi, et al.
Pubblicazione: (2024)
di: Zhang, Shiyi, et al.
Pubblicazione: (2024)
MultiCounter: Multiple Action Agnostic Repetition Counting in Untrimmed Videos
di: Tang, Yin, et al.
Pubblicazione: (2024)
di: Tang, Yin, et al.
Pubblicazione: (2024)
CountLLM: Towards Generalizable Repetitive Action Counting via Large Language Model
di: Yao, Ziyu, et al.
Pubblicazione: (2025)
di: Yao, Ziyu, et al.
Pubblicazione: (2025)
Repetitive Action Counting with Hybrid Temporal Relation Modeling
di: Li, Kun, et al.
Pubblicazione: (2024)
di: Li, Kun, et al.
Pubblicazione: (2024)
GMFL-Net: A Global Multi-geometric Feature Learning Network for Repetitive Action Counting
di: Li, Jun, et al.
Pubblicazione: (2024)
di: Li, Jun, et al.
Pubblicazione: (2024)
FCA-RAC: First Cycle Annotated Repetitive Action Counting
di: Lu, Jiada, et al.
Pubblicazione: (2024)
di: Lu, Jiada, et al.
Pubblicazione: (2024)
Skim then Focus: Integrating Contextual and Fine-grained Views for Repetitive Action Counting
di: Zhao, Zhengqi, et al.
Pubblicazione: (2024)
di: Zhao, Zhengqi, et al.
Pubblicazione: (2024)
Advancements in Repetitive Action Counting: Joint-Based PoseRAC Model With Improved Performance
di: Chen, Haodong, et al.
Pubblicazione: (2023)
di: Chen, Haodong, et al.
Pubblicazione: (2023)
Learning Dual-Level Deformable Implicit Representation for Real-World Scale Arbitrary Super-Resolution
di: Li, Zhiheng, et al.
Pubblicazione: (2024)
di: Li, Zhiheng, et al.
Pubblicazione: (2024)
IVAC-P2L: Leveraging Irregular Repetition Priors for Improving Video Action Counting
di: Wang, Hang, et al.
Pubblicazione: (2024)
di: Wang, Hang, et al.
Pubblicazione: (2024)
Narrative Action Evaluation with Prompt-Guided Multimodal Interaction
di: Zhang, Shiyi, et al.
Pubblicazione: (2024)
di: Zhang, Shiyi, et al.
Pubblicazione: (2024)
Multi-Granularity Reasoning for Image Quality Assessment via Attribute-Aware Reinforcement Learning to Rank
di: Chen, Xiangyong, et al.
Pubblicazione: (2026)
di: Chen, Xiangyong, et al.
Pubblicazione: (2026)
TAIHRI: Task-Aware 3D Human Keypoints Localization for Close-Range Human-Robot Interaction
di: Li, Ao, et al.
Pubblicazione: (2026)
di: Li, Ao, et al.
Pubblicazione: (2026)
Boosting Zero-Shot 3D Style Transfer with 2D Pre-trained Priors
di: Dong, Xin, et al.
Pubblicazione: (2026)
di: Dong, Xin, et al.
Pubblicazione: (2026)
MultiMatch: Multi-task Learning for Semi-supervised Domain Generalization
di: Qi, Lei, et al.
Pubblicazione: (2022)
di: Qi, Lei, et al.
Pubblicazione: (2022)
SAFE-Pruner: Semantic Attention-Guided Future-Aware Token Pruning for Efficient Vision-Language-Action Manipulation
di: Ma, Shilin, et al.
Pubblicazione: (2026)
di: Ma, Shilin, et al.
Pubblicazione: (2026)
TS-SatMVSNet: Slope Aware Height Estimation for Large-Scale Earth Terrain Multi-view Stereo
di: Zhang, Song, et al.
Pubblicazione: (2025)
di: Zhang, Song, et al.
Pubblicazione: (2025)
Every Shot Counts: Using Exemplars for Repetition Counting in Videos
di: Sinha, Saptarshi, et al.
Pubblicazione: (2024)
di: Sinha, Saptarshi, et al.
Pubblicazione: (2024)
CountFormer: A Transformer Framework for Learning Visual Repetition and Structure in Class-Agnostic Object Counting
di: Hossain, Md Tanvir, et al.
Pubblicazione: (2025)
di: Hossain, Md Tanvir, et al.
Pubblicazione: (2025)
Enhancing Visual Forced Alignment with Local Context-Aware Feature Extraction and Multi-Task Learning
di: He, Yi, et al.
Pubblicazione: (2025)
di: He, Yi, et al.
Pubblicazione: (2025)
Bidirectional Multi-Scale Implicit Neural Representations for Image Deraining
di: Chen, Xiang, et al.
Pubblicazione: (2024)
di: Chen, Xiang, et al.
Pubblicazione: (2024)
Multi-Grained Contrast for Data-Efficient Unsupervised Representation Learning
di: Shen, Chengchao, et al.
Pubblicazione: (2024)
di: Shen, Chengchao, et al.
Pubblicazione: (2024)
SQLNet: Scale-Modulated Query and Localization Network for Few-Shot Class-Agnostic Counting
di: Wu, Hefeng, et al.
Pubblicazione: (2023)
di: Wu, Hefeng, et al.
Pubblicazione: (2023)
Language-free Compositional Action Generation via Decoupling Refinement
di: Liu, Xiao, et al.
Pubblicazione: (2023)
di: Liu, Xiao, et al.
Pubblicazione: (2023)
Neuron: Learning Context-Aware Evolving Representations for Zero-Shot Skeleton Action Recognition
di: Chen, Yang, et al.
Pubblicazione: (2024)
di: Chen, Yang, et al.
Pubblicazione: (2024)
GaussianCube: A Structured and Explicit Radiance Representation for 3D Generative Modeling
di: Zhang, Bowen, et al.
Pubblicazione: (2024)
di: Zhang, Bowen, et al.
Pubblicazione: (2024)
CLAP: Contrastive Latent Action Pretraining for Learning Vision-Language-Action Models from Human Videos
di: Zhang, Chubin, et al.
Pubblicazione: (2026)
di: Zhang, Chubin, et al.
Pubblicazione: (2026)
Chirality in Action: Time-Aware Video Representation Learning by Latent Straightening
di: Bagad, Piyush, et al.
Pubblicazione: (2025)
di: Bagad, Piyush, et al.
Pubblicazione: (2025)
Multi-Scale Representation Learning for Image Restoration with State-Space Model
di: He, Yuhong, et al.
Pubblicazione: (2024)
di: He, Yuhong, et al.
Pubblicazione: (2024)
M2SFormer: Multi-Spectral and Multi-Scale Attention with Edge-Aware Difficulty Guidance for Image Forgery Localization
di: Nam, Ju-Hyeon, et al.
Pubblicazione: (2025)
di: Nam, Ju-Hyeon, et al.
Pubblicazione: (2025)
HOI-aware Adaptive Network for Weakly-supervised Action Segmentation
di: Zhang, Runzhong, et al.
Pubblicazione: (2026)
di: Zhang, Runzhong, et al.
Pubblicazione: (2026)
Hierarchical Multi-Stage Transformer Architecture for Context-Aware Temporal Action Localization
di: Ullah, Hayat, et al.
Pubblicazione: (2025)
di: Ullah, Hayat, et al.
Pubblicazione: (2025)
VA-AR: Learning Velocity-Aware Action Representations with Mixture of Window Attention
di: Wei, Jiangning, et al.
Pubblicazione: (2025)
di: Wei, Jiangning, et al.
Pubblicazione: (2025)
Locally Grouped and Scale-Guided Attention for Dense Pest Counting
di: Son, Chang-Hwan
Pubblicazione: (2024)
di: Son, Chang-Hwan
Pubblicazione: (2024)
Efficient Action Counting with Dynamic Queries
di: Ma, Xiaoxuan, et al.
Pubblicazione: (2024)
di: Ma, Xiaoxuan, et al.
Pubblicazione: (2024)
FADE: Frequency-Aware Diffusion Model Factorization for Video Editing
di: Zhu, Yixuan, et al.
Pubblicazione: (2025)
di: Zhu, Yixuan, et al.
Pubblicazione: (2025)
Semantic-Aware Representation Learning via Conditional Transport for Multi-Label Image Classification
di: Xie, Ren-Dong, et al.
Pubblicazione: (2025)
di: Xie, Ren-Dong, et al.
Pubblicazione: (2025)
LEAR: Learning Edge-Aware Representations for Event-to-LiDAR Localization
di: Chen, Kuangyi, et al.
Pubblicazione: (2026)
di: Chen, Kuangyi, et al.
Pubblicazione: (2026)
Learning Disentangled Representations for Generalized Multi-view Clustering
di: Zou, Xin, et al.
Pubblicazione: (2026)
di: Zou, Xin, et al.
Pubblicazione: (2026)
Documenti analoghi
-
CoSTL: Comprehensive Spatial-Temporal Representation Learning for Moment Retrieval and Highlight Detection
di: Dong, Xin, et al.
Pubblicazione: (2026) -
LOGO: A Long-Form Video Dataset for Group Action Quality Assessment
di: Zhang, Shiyi, et al.
Pubblicazione: (2024) -
MultiCounter: Multiple Action Agnostic Repetition Counting in Untrimmed Videos
di: Tang, Yin, et al.
Pubblicazione: (2024) -
CountLLM: Towards Generalizable Repetitive Action Counting via Large Language Model
di: Yao, Ziyu, et al.
Pubblicazione: (2025) -
Repetitive Action Counting with Hybrid Temporal Relation Modeling
di: Li, Kun, et al.
Pubblicazione: (2024)