Action Quality Assessment via Hierarchical Pose-guided Multi-stage Contrastive Regression
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Qi, Mengshi, Ye, Hao, Peng, Jiaxuan, Ma, Huadong |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Multi-Stage Contrastive Regression for Action Quality Assessment
par: An, Qi, et autres
Publié: (2024)
par: An, Qi, et autres
Publié: (2024)
Towards Balanced Multi-Modal Learning in 3D Human Pose Estimation
par: Qi, Mengshi, et autres
Publié: (2025)
par: Qi, Mengshi, et autres
Publié: (2025)
Semi-Supervised Teacher-Reference-Student Architecture for Action Quality Assessment
par: Yun, Wulian, et autres
Publié: (2024)
par: Yun, Wulian, et autres
Publié: (2024)
Chain-of-Evidence Multimodal Reasoning for Few-shot Temporal Action Localization
par: Qi, Mengshi, et autres
Publié: (2025)
par: Qi, Mengshi, et autres
Publié: (2025)
Towards Robust Unsupervised Attention Prediction in Autonomous Driving
par: Qi, Mengshi, et autres
Publié: (2025)
par: Qi, Mengshi, et autres
Publié: (2025)
Explainable Action Form Assessment by Exploiting Multimodal Chain-of-Thoughts Reasoning
par: Qi, Mengshi, et autres
Publié: (2025)
par: Qi, Mengshi, et autres
Publié: (2025)
A New Teacher-Reviewer-Student Framework for Semi-supervised 2D Human Pose Estimation
par: Yun, Wulian, et autres
Publié: (2025)
par: Yun, Wulian, et autres
Publié: (2025)
Learning Group Interactions and Semantic Intentions for Multi-Object Trajectory Prediction
par: Qi, Mengshi, et autres
Publié: (2024)
par: Qi, Mengshi, et autres
Publié: (2024)
Question-Aware Evidence Ledgers for Video Relational Reasoning
par: Ou, Yilin, et autres
Publié: (2026)
par: Ou, Yilin, et autres
Publié: (2026)
Robust Disentangled Counterfactual Learning for Physical Audiovisual Commonsense Reasoning
par: Qi, Mengshi, et autres
Publié: (2025)
par: Qi, Mengshi, et autres
Publié: (2025)
Decomposed Vector-Quantized Variational Autoencoder for Human Grasp Generation
par: Zhao, Zhe, et autres
Publié: (2024)
par: Zhao, Zhe, et autres
Publié: (2024)
Robo-SGG: Exploiting Layout-Oriented Normalization and Restitution Can Improve Robust Scene Graph Generation
par: Lv, Changsheng, et autres
Publié: (2025)
par: Lv, Changsheng, et autres
Publié: (2025)
TruePose: Human-Parsing-guided Attention Diffusion for Full-ID Preserving Pose Transfer
par: Xu, Zhihong, et autres
Publié: (2025)
par: Xu, Zhihong, et autres
Publié: (2025)
EPAM-Net: An Efficient Pose-driven Attention-guided Multimodal Network for Video Action Recognition
par: Abdelkawy, Ahmed, et autres
Publié: (2024)
par: Abdelkawy, Ahmed, et autres
Publié: (2024)
Global-Local Tree Search in VLMs for 3D Indoor Scene Generation
par: Deng, Wei, et autres
Publié: (2025)
par: Deng, Wei, et autres
Publié: (2025)
HieraFashDiff: Hierarchical Fashion Design with Multi-stage Diffusion Models
par: Xie, Zhifeng, et autres
Publié: (2024)
par: Xie, Zhifeng, et autres
Publié: (2024)
Multi-Modal Parameter-Efficient Fine-tuning via Graph Neural Network
par: Cheng, Bin, et autres
Publié: (2024)
par: Cheng, Bin, et autres
Publié: (2024)
Hierarchical NeuroSymbolic Approach for Comprehensive and Explainable Action Quality Assessment
par: Okamoto, Lauren, et autres
Publié: (2024)
par: Okamoto, Lauren, et autres
Publié: (2024)
A Decade of Action Quality Assessment: Largest Systematic Survey of Trends, Challenges, and Future Directions
par: Yin, Hao, et autres
Publié: (2025)
par: Yin, Hao, et autres
Publié: (2025)
VidPrism: Heterogeneous Mixture of Experts for Image-to-Video Transfer
par: Lin, Rui, et autres
Publié: (2026)
par: Lin, Rui, et autres
Publié: (2026)
TIER: Text-Image Encoder-based Regression for AIGC Image Quality Assessment
par: Yuan, Jiquan, et autres
Publié: (2024)
par: Yuan, Jiquan, et autres
Publié: (2024)
Location-guided Head Pose Estimation for Fisheye Image
par: Li, Bing, et autres
Publié: (2024)
par: Li, Bing, et autres
Publié: (2024)
FLEX: A Largescale Multimodal, Multiview Dataset for Learning Structured Representations for Fitness Action Quality Assessment
par: Yin, Hao, et autres
Publié: (2025)
par: Yin, Hao, et autres
Publié: (2025)
T2SG: Traffic Topology Scene Graph for Topology Reasoning in Autonomous Driving
par: Lv, Changsheng, et autres
Publié: (2024)
par: Lv, Changsheng, et autres
Publié: (2024)
Towards Efficient Object Re-Identification with A Novel Cloud-Edge Collaborative Framework
par: Wang, Chuanming, et autres
Publié: (2024)
par: Wang, Chuanming, et autres
Publié: (2024)
Improving Batch Normalization with TTA for Robust Object Detection in Self-Driving
par: Liao, Dacheng, et autres
Publié: (2024)
par: Liao, Dacheng, et autres
Publié: (2024)
VLM-Assisted Continual learning for Visual Question Answering in Self-Driving
par: Lin, Yuxin, et autres
Publié: (2025)
par: Lin, Yuxin, et autres
Publié: (2025)
Uncovering the human motion pattern: Pattern Memory-based Diffusion Model for Trajectory Prediction
par: Yang, Yuxin, et autres
Publié: (2024)
par: Yang, Yuxin, et autres
Publié: (2024)
GS2Pose: Two-stage 6D Object Pose Estimation Guided by Gaussian Splatting
par: Mei, Jilan, et autres
Publié: (2024)
par: Mei, Jilan, et autres
Publié: (2024)
DynaPose4D: High-Quality 4D Dynamic Content Generation via Pose Alignment Loss
par: Yang, Jing, et autres
Publié: (2025)
par: Yang, Jing, et autres
Publié: (2025)
GenVP: Generating Visual Puzzles with Contrastive Hierarchical VAEs
par: Basioti, Kalliopi, et autres
Publié: (2025)
par: Basioti, Kalliopi, et autres
Publié: (2025)
Bridging Spectral-wise and Multi-spectral Depth Estimation via Geometry-guided Contrastive Learning
par: Shin, Ukcheol, et autres
Publié: (2025)
par: Shin, Ukcheol, et autres
Publié: (2025)
ConDo: Continual Domain Expansion for Absolute Pose Regression
par: Li, Zijun, et autres
Publié: (2024)
par: Li, Zijun, et autres
Publié: (2024)
DOR3D-Net: Dense Ordinal Regression Network for 3D Hand Pose Estimation
par: Mao, Yamin, et autres
Publié: (2024)
par: Mao, Yamin, et autres
Publié: (2024)
Dog-IQA: Standard-guided Zero-shot MLLM for Mix-grained Image Quality Assessment
par: Liu, Kai, et autres
Publié: (2024)
par: Liu, Kai, et autres
Publié: (2024)
Mutual Information guided Visual Contrastive Learning
par: Chen, Hanyang, et autres
Publié: (2025)
par: Chen, Hanyang, et autres
Publié: (2025)
M3GCLR: Multi-View Mini-Max Infinite Skeleton-Data Game Contrastive Learning For Skeleton-Based Action Recognition
par: Li, Yanshan, et autres
Publié: (2026)
par: Li, Yanshan, et autres
Publié: (2026)
Feature Identification for Hierarchical Contrastive Learning
par: Ott, Julius, et autres
Publié: (2025)
par: Ott, Julius, et autres
Publié: (2025)
Synthetic Human Action Video Data Generation with Pose Transfer
par: Knapp, Vaclav, et autres
Publié: (2025)
par: Knapp, Vaclav, et autres
Publié: (2025)
Enhancing Action Recognition by Leveraging the Hierarchical Structure of Actions and Textual Context
par: Benavent-Lledo, Manuel, et autres
Publié: (2024)
par: Benavent-Lledo, Manuel, et autres
Publié: (2024)
Documents similaires
-
Multi-Stage Contrastive Regression for Action Quality Assessment
par: An, Qi, et autres
Publié: (2024) -
Towards Balanced Multi-Modal Learning in 3D Human Pose Estimation
par: Qi, Mengshi, et autres
Publié: (2025) -
Semi-Supervised Teacher-Reference-Student Architecture for Action Quality Assessment
par: Yun, Wulian, et autres
Publié: (2024) -
Chain-of-Evidence Multimodal Reasoning for Few-shot Temporal Action Localization
par: Qi, Mengshi, et autres
Publié: (2025) -
Towards Robust Unsupervised Attention Prediction in Autonomous Driving
par: Qi, Mengshi, et autres
Publié: (2025)