PIDNet: Progressive Implicit Decouple Network for Multimodal Action Quality Assessment
Fuente:
arXiv
Salvato in:
| Autori principali: | Li, Qiqi, Wang, Pengfei, Zheng, Nenggan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
DeepBranchTracer: A Generally-Applicable Approach to Curvilinear Structure Reconstruction Using Multi-Feature Learning
di: Liu, Chao, et al.
Pubblicazione: (2024)
di: Liu, Chao, et al.
Pubblicazione: (2024)
MCA: Moment Channel Attention Networks
di: Jiang, Yangbo, et al.
Pubblicazione: (2024)
di: Jiang, Yangbo, et al.
Pubblicazione: (2024)
Attention-Driven Multimodal Alignment for Long-term Action Quality Assessment
di: Wang, Xin, et al.
Pubblicazione: (2025)
di: Wang, Xin, et al.
Pubblicazione: (2025)
Multimodal Action Quality Assessment
di: Zeng, Ling-An, et al.
Pubblicazione: (2024)
di: Zeng, Ling-An, et al.
Pubblicazione: (2024)
PHI: Bridging Domain Shift in Long-Term Action Quality Assessment via Progressive Hierarchical Instruction
di: Zhou, Kanglei, et al.
Pubblicazione: (2025)
di: Zhou, Kanglei, et al.
Pubblicazione: (2025)
Interpretable Long-term Action Quality Assessment
di: Dong, Xu, et al.
Pubblicazione: (2024)
di: Dong, Xu, et al.
Pubblicazione: (2024)
Uncertainty-Driven Action Quality Assessment
di: Zhou, Caixia, et al.
Pubblicazione: (2022)
di: Zhou, Caixia, et al.
Pubblicazione: (2022)
DPC-VQA: Decoupling Quality Perception and Residual Calibration for Video Quality Assessment
di: Li, Xinyue, et al.
Pubblicazione: (2026)
di: Li, Xinyue, et al.
Pubblicazione: (2026)
MCMoE: Completing Missing Modalities with Mixture of Experts for Incomplete Multimodal Action Quality Assessment
di: Xu, Huangbiao, et al.
Pubblicazione: (2025)
di: Xu, Huangbiao, et al.
Pubblicazione: (2025)
Exploring Implicit Visual Misunderstandings in Multimodal Large Language Models through Attention Analysis
di: Wang, Pengfei, et al.
Pubblicazione: (2025)
di: Wang, Pengfei, et al.
Pubblicazione: (2025)
DVLTA-VQA: Decoupled Vision-Language Modeling with Text-Guided Adaptation for Blind Video Quality Assessment
di: Yu, Li, et al.
Pubblicazione: (2025)
di: Yu, Li, et al.
Pubblicazione: (2025)
MAGR: Manifold-Aligned Graph Regularization for Continual Action Quality Assessment
di: Zhou, Kanglei, et al.
Pubblicazione: (2024)
di: Zhou, Kanglei, et al.
Pubblicazione: (2024)
A Comprehensive Survey of Action Quality Assessment: Method and Benchmark
di: Zhou, Kanglei, et al.
Pubblicazione: (2024)
di: Zhou, Kanglei, et al.
Pubblicazione: (2024)
BriMA: Bridged Modality Adaptation for Multi-Modal Continual Action Quality Assessment
di: Zhou, Kanglei, et al.
Pubblicazione: (2026)
di: Zhou, Kanglei, et al.
Pubblicazione: (2026)
Grounding-IQA: Grounding Multimodal Language Model for Image Quality Assessment
di: Chen, Zheng, et al.
Pubblicazione: (2024)
di: Chen, Zheng, et al.
Pubblicazione: (2024)
Temporal Action Localization with Cross Layer Task Decoupling and Refinement
di: Li, Qiang, et al.
Pubblicazione: (2024)
di: Li, Qiang, et al.
Pubblicazione: (2024)
Progressive Feature Fusion Network for Enhancing Image Quality Assessment
di: Wu, Kaiqun, et al.
Pubblicazione: (2024)
di: Wu, Kaiqun, et al.
Pubblicazione: (2024)
GAIA: Rethinking Action Quality Assessment for AI-Generated Videos
di: Chen, Zijian, et al.
Pubblicazione: (2024)
di: Chen, Zijian, et al.
Pubblicazione: (2024)
GT-PCQA: Geometry-Texture Decoupled Point Cloud Quality Assessment with MLLM
di: Zhang, Guohua, et al.
Pubblicazione: (2026)
di: Zhang, Guohua, et al.
Pubblicazione: (2026)
Analytic Score Optimization for Multi Dimension Video Quality Assessment
di: Lin, Boda, et al.
Pubblicazione: (2026)
di: Lin, Boda, et al.
Pubblicazione: (2026)
FLEX: A Largescale Multimodal, Multiview Dataset for Learning Structured Representations for Fitness Action Quality Assessment
di: Yin, Hao, et al.
Pubblicazione: (2025)
di: Yin, Hao, et al.
Pubblicazione: (2025)
Multi-Stage Contrastive Regression for Action Quality Assessment
di: An, Qi, et al.
Pubblicazione: (2024)
di: An, Qi, et al.
Pubblicazione: (2024)
Continual Action Quality Assessment via Adaptive Manifold-Aligned Graph Regularization
di: Zhou, Kanglei, et al.
Pubblicazione: (2025)
di: Zhou, Kanglei, et al.
Pubblicazione: (2025)
CoFInAl: Enhancing Action Quality Assessment with Coarse-to-Fine Instruction Alignment
di: Zhou, Kanglei, et al.
Pubblicazione: (2024)
di: Zhou, Kanglei, et al.
Pubblicazione: (2024)
Decoupled Hierarchical Distillation for Multimodal Emotion Recognition
di: Li, Yong, et al.
Pubblicazione: (2026)
di: Li, Yong, et al.
Pubblicazione: (2026)
Towards Multiple Character Image Animation Through Enhancing Implicit Decoupling
di: Xue, Jingyun, et al.
Pubblicazione: (2024)
di: Xue, Jingyun, et al.
Pubblicazione: (2024)
AIA: Rethinking Architecture Decoupling Strategy In Unified Multimodal Model
di: Zheng, Dian, et al.
Pubblicazione: (2025)
di: Zheng, Dian, et al.
Pubblicazione: (2025)
FineParser: A Fine-grained Spatio-temporal Action Parser for Human-centric Action Quality Assessment
di: Xu, Jinglin, et al.
Pubblicazione: (2024)
di: Xu, Jinglin, et al.
Pubblicazione: (2024)
Progressive Depth Decoupling and Modulating for Flexible Depth Completion
di: Yang, Zhiwen, et al.
Pubblicazione: (2024)
di: Yang, Zhiwen, et al.
Pubblicazione: (2024)
Visual Implicit Autoregressive Modeling
di: Jiang, Pengfei, et al.
Pubblicazione: (2026)
di: Jiang, Pengfei, et al.
Pubblicazione: (2026)
Decoupled Doubly Contrastive Learning for Cross Domain Facial Action Unit Detection
di: Li, Yong, et al.
Pubblicazione: (2025)
di: Li, Yong, et al.
Pubblicazione: (2025)
Decoupling Perception and Calibration: Label-Efficient Image Quality Assessment Framework
di: Li, Xinyue, et al.
Pubblicazione: (2026)
di: Li, Xinyue, et al.
Pubblicazione: (2026)
Evolving from Single-modal to Multi-modal Facial Deepfake Detection: Progress and Challenges
di: Liu, Ping, et al.
Pubblicazione: (2024)
di: Liu, Ping, et al.
Pubblicazione: (2024)
LOGO: A Long-Form Video Dataset for Group Action Quality Assessment
di: Zhang, Shiyi, et al.
Pubblicazione: (2024)
di: Zhang, Shiyi, et al.
Pubblicazione: (2024)
Unlabeled Action Quality Assessment Based on Multi-dimensional Adaptive Constrained Dynamic Time Warping
di: Chen, Renguang, et al.
Pubblicazione: (2024)
di: Chen, Renguang, et al.
Pubblicazione: (2024)
Language-Guided Visual Perception Disentanglement for Image Quality Assessment and Conditional Image Generation
di: Yang, Zhichao, et al.
Pubblicazione: (2025)
di: Yang, Zhichao, et al.
Pubblicazione: (2025)
ProVG: Progressive Visual Grounding via Language Decoupling for Remote Sensing Imagery
di: Li, Ke, et al.
Pubblicazione: (2026)
di: Li, Ke, et al.
Pubblicazione: (2026)
The Worse The Better: Content-Aware Viewpoint Generation Network for Projection-related Point Cloud Quality Assessment
di: Su, Zhiyong, et al.
Pubblicazione: (2025)
di: Su, Zhiyong, et al.
Pubblicazione: (2025)
Pose-Aware Multi-Level Motion Parsing for Action Quality Assessment
di: Zhu, Shuaikang, et al.
Pubblicazione: (2025)
di: Zhu, Shuaikang, et al.
Pubblicazione: (2025)
Semi-Supervised Teacher-Reference-Student Architecture for Action Quality Assessment
di: Yun, Wulian, et al.
Pubblicazione: (2024)
di: Yun, Wulian, et al.
Pubblicazione: (2024)
Documenti analoghi
-
DeepBranchTracer: A Generally-Applicable Approach to Curvilinear Structure Reconstruction Using Multi-Feature Learning
di: Liu, Chao, et al.
Pubblicazione: (2024) -
MCA: Moment Channel Attention Networks
di: Jiang, Yangbo, et al.
Pubblicazione: (2024) -
Attention-Driven Multimodal Alignment for Long-term Action Quality Assessment
di: Wang, Xin, et al.
Pubblicazione: (2025) -
Multimodal Action Quality Assessment
di: Zeng, Ling-An, et al.
Pubblicazione: (2024) -
PHI: Bridging Domain Shift in Long-Term Action Quality Assessment via Progressive Hierarchical Instruction
di: Zhou, Kanglei, et al.
Pubblicazione: (2025)