MGCA-Net: Multi-Grained Category-Aware Network for Open-Vocabulary Temporal Action Localization
Fuente:
arXiv
Salvato in:
| Autori principali: | Fang, Zhenying, Hong, Richang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Boundary Discretization and Reliable Classification Network for Temporal Action Detection
di: Fang, Zhenying, et al.
Pubblicazione: (2023)
di: Fang, Zhenying, et al.
Pubblicazione: (2023)
MGCA-Net: Multi-Graph Contextual Attention Network for Two-View Correspondence Learning
di: Lin, Shuyuan, et al.
Pubblicazione: (2025)
di: Lin, Shuyuan, et al.
Pubblicazione: (2025)
Open-Vocabulary Temporal Action Localization using Multimodal Guidance
di: Gupta, Akshita, et al.
Pubblicazione: (2024)
di: Gupta, Akshita, et al.
Pubblicazione: (2024)
Open-Vocabulary Spatio-Temporal Action Detection
di: Wu, Tao, et al.
Pubblicazione: (2024)
di: Wu, Tao, et al.
Pubblicazione: (2024)
One-Stage Open-Vocabulary Temporal Action Detection Leveraging Temporal Multi-scale and Action Label Features
di: Nguyen, Trung Thanh, et al.
Pubblicazione: (2024)
di: Nguyen, Trung Thanh, et al.
Pubblicazione: (2024)
Exploring Scalability of Self-Training for Open-Vocabulary Temporal Action Localization
di: Hyun, Jeongseok, et al.
Pubblicazione: (2024)
di: Hyun, Jeongseok, et al.
Pubblicazione: (2024)
Spatio-Temporal Similarity Volume Aggregation for Open-Vocabulary Action Recognition
di: So, Yerim, et al.
Pubblicazione: (2026)
di: So, Yerim, et al.
Pubblicazione: (2026)
Scaling Open-Vocabulary Action Detection
di: Sia, Zhen Hao, et al.
Pubblicazione: (2025)
di: Sia, Zhen Hao, et al.
Pubblicazione: (2025)
Category-Adaptive Cross-Modal Semantic Refinement and Transfer for Open-Vocabulary Multi-Label Recognition
di: Liu, Haijing, et al.
Pubblicazione: (2024)
di: Liu, Haijing, et al.
Pubblicazione: (2024)
Open-Vocabulary Action Localization with Iterative Visual Prompting
di: Wake, Naoki, et al.
Pubblicazione: (2024)
di: Wake, Naoki, et al.
Pubblicazione: (2024)
Denoise and Align: Diffusion-Driven Foreground Knowledge Prompting for Open-Vocabulary Temporal Action Detection
di: Zhu, Sa, et al.
Pubblicazione: (2026)
di: Zhu, Sa, et al.
Pubblicazione: (2026)
Hierarchical Multi-Stage Transformer Architecture for Context-Aware Temporal Action Localization
di: Ullah, Hayat, et al.
Pubblicazione: (2025)
di: Ullah, Hayat, et al.
Pubblicazione: (2025)
SGC-Net: Stratified Granular Comparison Network for Open-Vocabulary HOI Detection
di: Lin, Xin, et al.
Pubblicazione: (2025)
di: Lin, Xin, et al.
Pubblicazione: (2025)
Novel Category Discovery with X-Agent Attention for Open-Vocabulary Semantic Segmentation
di: Li, Jiahao, et al.
Pubblicazione: (2025)
di: Li, Jiahao, et al.
Pubblicazione: (2025)
Decompose and Transfer: CoT-Prompting Enhanced Alignment for Open-Vocabulary Temporal Action Detection
di: Zhu, Sa, et al.
Pubblicazione: (2026)
di: Zhu, Sa, et al.
Pubblicazione: (2026)
NoOVD: Novel Category Discovery and Embedding for Open-Vocabulary Object Detection
di: Zhang, Yupeng, et al.
Pubblicazione: (2026)
di: Zhang, Yupeng, et al.
Pubblicazione: (2026)
SynSeg: Feature Synergy for Multi-Category Contrastive Learning in End-to-End Open-Vocabulary Semantic Segmentation
di: Zhang, Weichen, et al.
Pubblicazione: (2025)
di: Zhang, Weichen, et al.
Pubblicazione: (2025)
Technical Report for ActivityNet Challenge 2022 -- Temporal Action Localization
di: Chen, Shimin, et al.
Pubblicazione: (2024)
di: Chen, Shimin, et al.
Pubblicazione: (2024)
DENOISER: Rethinking the Robustness for Open-Vocabulary Action Recognition
di: Cheng, Haozhe, et al.
Pubblicazione: (2024)
di: Cheng, Haozhe, et al.
Pubblicazione: (2024)
Unsupervised Open-Vocabulary Object Localization in Videos
di: Fan, Ke, et al.
Pubblicazione: (2023)
di: Fan, Ke, et al.
Pubblicazione: (2023)
Video-STAR: Reinforcing Open-Vocabulary Action Recognition with Tools
di: Yuan, Zhenlong, et al.
Pubblicazione: (2025)
di: Yuan, Zhenlong, et al.
Pubblicazione: (2025)
Learning to Generalize without Bias for Open-Vocabulary Action Recognition
di: Yu, Yating, et al.
Pubblicazione: (2025)
di: Yu, Yating, et al.
Pubblicazione: (2025)
Exploiting VLM Localizability and Semantics for Open Vocabulary Action Detection
di: Bao, Wentao, et al.
Pubblicazione: (2024)
di: Bao, Wentao, et al.
Pubblicazione: (2024)
Multi-task Learning with Extended Temporal Shift Module for Temporal Action Localization
di: Duong, Anh-Kiet, et al.
Pubblicazione: (2025)
di: Duong, Anh-Kiet, et al.
Pubblicazione: (2025)
Enhancing Open-Vocabulary Object Detection through Multi-Level Fine-Grained Visual-Language Alignment
di: Zhang, Tianyi, et al.
Pubblicazione: (2026)
di: Zhang, Tianyi, et al.
Pubblicazione: (2026)
Video Self-Stitching Graph Network for Temporal Action Localization
di: Zhao, Chen, et al.
Pubblicazione: (2020)
di: Zhao, Chen, et al.
Pubblicazione: (2020)
Open Vocabulary Multi-Label Video Classification
di: Gupta, Rohit, et al.
Pubblicazione: (2024)
di: Gupta, Rohit, et al.
Pubblicazione: (2024)
Prototype-Aware Multimodal Alignment for Open-Vocabulary Visual Grounding
di: Xie, Jiangnan, et al.
Pubblicazione: (2025)
di: Xie, Jiangnan, et al.
Pubblicazione: (2025)
SLAck: Semantic, Location, and Appearance Aware Open-Vocabulary Tracking
di: Li, Siyuan, et al.
Pubblicazione: (2024)
di: Li, Siyuan, et al.
Pubblicazione: (2024)
Exploring Vision-Language Models for Open-Vocabulary Zero-Shot Action Segmentation
di: Unmesh, Asim, et al.
Pubblicazione: (2026)
di: Unmesh, Asim, et al.
Pubblicazione: (2026)
FGAseg: Fine-Grained Pixel-Text Alignment for Open-Vocabulary Semantic Segmentation
di: Li, Bingyu, et al.
Pubblicazione: (2025)
di: Li, Bingyu, et al.
Pubblicazione: (2025)
Fine-Grained Open-Vocabulary Object Recognition via User-Guided Segmentation
di: Ahn, Jinwoo, et al.
Pubblicazione: (2024)
di: Ahn, Jinwoo, et al.
Pubblicazione: (2024)
Improving Weakly Supervised Temporal Action Localization by Exploiting Multi-resolution Information in Temporal Domain
di: Su, Rui, et al.
Pubblicazione: (2025)
di: Su, Rui, et al.
Pubblicazione: (2025)
Towards Open-Vocabulary Audio-Visual Event Localization
di: Zhou, Jinxing, et al.
Pubblicazione: (2024)
di: Zhou, Jinxing, et al.
Pubblicazione: (2024)
Understanding Multi-Granularity for Open-Vocabulary Part Segmentation
di: Choi, Jiho, et al.
Pubblicazione: (2024)
di: Choi, Jiho, et al.
Pubblicazione: (2024)
OVMR: Open-Vocabulary Recognition with Multi-Modal References
di: Ma, Zehong, et al.
Pubblicazione: (2024)
di: Ma, Zehong, et al.
Pubblicazione: (2024)
Video-GroundingDINO: Towards Open-Vocabulary Spatio-Temporal Video Grounding
di: Wasim, Syed Talal, et al.
Pubblicazione: (2023)
di: Wasim, Syed Talal, et al.
Pubblicazione: (2023)
HERO: Hierarchical Embedding-Refinement for Open-Vocabulary Temporal Sentence Grounding in Videos
di: Han, Tingting, et al.
Pubblicazione: (2026)
di: Han, Tingting, et al.
Pubblicazione: (2026)
From Static to Dynamic: Adapting Landmark-Aware Image Models for Facial Expression Recognition in Videos
di: Chen, Yin, et al.
Pubblicazione: (2023)
di: Chen, Yin, et al.
Pubblicazione: (2023)
OV9D: Open-Vocabulary Category-Level 9D Object Pose and Size Estimation
di: Cai, Junhao, et al.
Pubblicazione: (2024)
di: Cai, Junhao, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Boundary Discretization and Reliable Classification Network for Temporal Action Detection
di: Fang, Zhenying, et al.
Pubblicazione: (2023) -
MGCA-Net: Multi-Graph Contextual Attention Network for Two-View Correspondence Learning
di: Lin, Shuyuan, et al.
Pubblicazione: (2025) -
Open-Vocabulary Temporal Action Localization using Multimodal Guidance
di: Gupta, Akshita, et al.
Pubblicazione: (2024) -
Open-Vocabulary Spatio-Temporal Action Detection
di: Wu, Tao, et al.
Pubblicazione: (2024) -
One-Stage Open-Vocabulary Temporal Action Detection Leveraging Temporal Multi-scale and Action Label Features
di: Nguyen, Trung Thanh, et al.
Pubblicazione: (2024)