FineParser: A Fine-grained Spatio-temporal Action Parser for Human-centric Action Quality Assessment
Fuente:
arXiv
Guardado en:
| Autores principales: | Xu, Jinglin, Yin, Sibo, Zhao, Guohao, Wang, Zishuo, Peng, Yuxin |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
FinePOSE: Fine-Grained Prompt-Driven 3D Human Pose Estimation via Diffusion Models
por: Xu, Jinglin, et al.
Publicado: (2024)
por: Xu, Jinglin, et al.
Publicado: (2024)
Uni-Parser Technical Report
por: Fang, Xi, et al.
Publicado: (2025)
por: Fang, Xi, et al.
Publicado: (2025)
FineSkiing: A Fine-grained Benchmark for Skiing Action Quality Assessment
por: Zhang, Yongji, et al.
Publicado: (2025)
por: Zhang, Yongji, et al.
Publicado: (2025)
UniParser: Multi-Human Parsing with Unified Correlation Representation Learning
por: Chu, Jiaming, et al.
Publicado: (2023)
por: Chu, Jiaming, et al.
Publicado: (2023)
DyFo: A Training-Free Dynamic Focus Visual Search for Enhancing LMMs in Fine-Grained Visual Understanding
por: Li, Geng, et al.
Publicado: (2025)
por: Li, Geng, et al.
Publicado: (2025)
OmniParser: A Unified Framework for Text Spotting, Key Information Extraction and Table Recognition
por: Wan, Jianqiang, et al.
Publicado: (2024)
por: Wan, Jianqiang, et al.
Publicado: (2024)
Towards an Effective Action-Region Tracking Framework for Fine-grained Video Action Recognition
por: Sun, Baoli, et al.
Publicado: (2025)
por: Sun, Baoli, et al.
Publicado: (2025)
Intra and Inter Parser-Prompted Transformers for Effective Image Restoration
por: Wang, Cong, et al.
Publicado: (2025)
por: Wang, Cong, et al.
Publicado: (2025)
FineCausal: A Causal-Based Framework for Interpretable Fine-Grained Action Quality Assessment
por: Han, Ruisheng, et al.
Publicado: (2025)
por: Han, Ruisheng, et al.
Publicado: (2025)
SceneParser: Hierarchical Scene Parsing for Visual Semantics Understanding
por: Xu, Pengxin, et al.
Publicado: (2026)
por: Xu, Pengxin, et al.
Publicado: (2026)
FinePhys: Fine-grained Human Action Generation by Explicitly Incorporating Physical Laws for Effective Skeletal Guidance
por: Shao, Dian, et al.
Publicado: (2025)
por: Shao, Dian, et al.
Publicado: (2025)
CREPE: Coordinate-Aware End-to-End Document Parser
por: Okamoto, Yamato, et al.
Publicado: (2024)
por: Okamoto, Yamato, et al.
Publicado: (2024)
CausalFSFG: Rethinking Few-Shot Fine-Grained Visual Categorization from Causal Perspective
por: Yang, Zhiwen, et al.
Publicado: (2025)
por: Yang, Zhiwen, et al.
Publicado: (2025)
MA-Bench: Towards Fine-grained Micro-Action Understanding
por: Li, Kun, et al.
Publicado: (2026)
por: Li, Kun, et al.
Publicado: (2026)
MCMoE: Completing Missing Modalities with Mixture of Experts for Incomplete Multimodal Action Quality Assessment
por: Xu, Huangbiao, et al.
Publicado: (2025)
por: Xu, Huangbiao, et al.
Publicado: (2025)
SIA-OVD: Shape-Invariant Adapter for Bridging the Image-Region Gap in Open-Vocabulary Detection
por: Wang, Zishuo, et al.
Publicado: (2024)
por: Wang, Zishuo, et al.
Publicado: (2024)
Skim then Focus: Integrating Contextual and Fine-grained Views for Repetitive Action Counting
por: Zhao, Zhengqi, et al.
Publicado: (2024)
por: Zhao, Zhengqi, et al.
Publicado: (2024)
CoFInAl: Enhancing Action Quality Assessment with Coarse-to-Fine Instruction Alignment
por: Zhou, Kanglei, et al.
Publicado: (2024)
por: Zhou, Kanglei, et al.
Publicado: (2024)
MolParser: End-to-end Visual Recognition of Molecule Structures in the Wild
por: Fang, Xi, et al.
Publicado: (2024)
por: Fang, Xi, et al.
Publicado: (2024)
Storyboard guided Alignment for Fine-grained Video Action Recognition
por: Liu, Enqi, et al.
Publicado: (2024)
por: Liu, Enqi, et al.
Publicado: (2024)
Human Stone Toolmaking Action Grammar (HSTAG): A Challenging Benchmark for Fine-grained Motor Behavior Recognition
por: Liu, Cheng, et al.
Publicado: (2024)
por: Liu, Cheng, et al.
Publicado: (2024)
Learnable Earth Parser: Discovering 3D Prototypes in Aerial Scans
por: Loiseau, Romain, et al.
Publicado: (2023)
por: Loiseau, Romain, et al.
Publicado: (2023)
PFDM: Parser-Free Virtual Try-on via Diffusion Model
por: Niu, Yunfang, et al.
Publicado: (2024)
por: Niu, Yunfang, et al.
Publicado: (2024)
Parser-Oriented Structural Refinement for a Stable Layout Interface in Document Parsing
por: Liu, Fuyuan, et al.
Publicado: (2026)
por: Liu, Fuyuan, et al.
Publicado: (2026)
Bidirectional Long-Range Parser for Sequential Data Understanding
por: Leotescu, George, et al.
Publicado: (2024)
por: Leotescu, George, et al.
Publicado: (2024)
OmniParser V2: Structured-Points-of-Thought for Unified Visual Text Parsing and Its Generality to Multimodal Large Language Models
por: Yu, Wenwen, et al.
Publicado: (2025)
por: Yu, Wenwen, et al.
Publicado: (2025)
CreatiParser: Generative Image Parsing of Raster Graphic Designs into Editable Layers
por: Chen, Weidong, et al.
Publicado: (2026)
por: Chen, Weidong, et al.
Publicado: (2026)
Decoupling Spatio-Temporal Adapter for Fine-Grained Badminton Action Localization
por: Wang, Tianyu, et al.
Publicado: (2026)
por: Wang, Tianyu, et al.
Publicado: (2026)
Spatio-temporal Decoupled Knowledge Compensator for Few-Shot Action Recognition
por: Qu, Hongyu, et al.
Publicado: (2026)
por: Qu, Hongyu, et al.
Publicado: (2026)
Spatio-temporal Transformers for Action Unit Classification with Event Cameras
por: Cultrera, Luca, et al.
Publicado: (2024)
por: Cultrera, Luca, et al.
Publicado: (2024)
OmniParser for Pure Vision Based GUI Agent
por: Lu, Yadong, et al.
Publicado: (2024)
por: Lu, Yadong, et al.
Publicado: (2024)
HieroAction: Hierarchically Guided VLM for Fine-Grained Action Analysis
por: Wu, Junhao, et al.
Publicado: (2025)
por: Wu, Junhao, et al.
Publicado: (2025)
MM-SEAL: A Large-scale Video Dataset of Multi-person Multi-grained Spatio-temporally Action Localization
por: Chen, Shimin, et al.
Publicado: (2022)
por: Chen, Shimin, et al.
Publicado: (2022)
Caption Anything in Video: Fine-grained Object-centric Captioning via Spatiotemporal Multimodal Prompting
por: Tang, Yunlong, et al.
Publicado: (2025)
por: Tang, Yunlong, et al.
Publicado: (2025)
BEAR: A Video Dataset For Fine-grained Behaviors Recognition Oriented with Action and Environment Factors
por: Hu, Chengyang, et al.
Publicado: (2025)
por: Hu, Chengyang, et al.
Publicado: (2025)
Body-Hand Modality Expertized Networks with Cross-attention for Fine-grained Skeleton Action Recognition
por: Cho, Seungyeon, et al.
Publicado: (2025)
por: Cho, Seungyeon, et al.
Publicado: (2025)
ActionArt: Advancing Multimodal Large Models for Fine-Grained Human-Centric Video Understanding
por: Peng, Yi-Xing, et al.
Publicado: (2025)
por: Peng, Yi-Xing, et al.
Publicado: (2025)
Benchmarking Document Parsers on Mathematical Formula Extraction from PDFs
por: Horn, Pius, et al.
Publicado: (2025)
por: Horn, Pius, et al.
Publicado: (2025)
Interpretable Long-term Action Quality Assessment
por: Dong, Xu, et al.
Publicado: (2024)
por: Dong, Xu, et al.
Publicado: (2024)
FACTS: Fine-Grained Action Classification for Tactical Sports
por: Lai, Christopher, et al.
Publicado: (2024)
por: Lai, Christopher, et al.
Publicado: (2024)
Ejemplares similares
-
FinePOSE: Fine-Grained Prompt-Driven 3D Human Pose Estimation via Diffusion Models
por: Xu, Jinglin, et al.
Publicado: (2024) -
Uni-Parser Technical Report
por: Fang, Xi, et al.
Publicado: (2025) -
FineSkiing: A Fine-grained Benchmark for Skiing Action Quality Assessment
por: Zhang, Yongji, et al.
Publicado: (2025) -
UniParser: Multi-Human Parsing with Unified Correlation Representation Learning
por: Chu, Jiaming, et al.
Publicado: (2023) -
DyFo: A Training-Free Dynamic Focus Visual Search for Enhancing LMMs in Fine-Grained Visual Understanding
por: Li, Geng, et al.
Publicado: (2025)