An Effective-Efficient Approach for Dense Multi-Label Action Detection
Fuente:
arXiv
Salvato in:
| Autori principali: | Sardari, Faegheh, Mustafa, Armin, Jackson, Philip J. B., Hilton, Adrian |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Reframing Dense Action Detection (RefDense): A Paradigm Shift in Problem Solving & a Novel Optimization Strategy
di: Sardari, Faegheh, et al.
Pubblicazione: (2025)
di: Sardari, Faegheh, et al.
Pubblicazione: (2025)
CoLeaF: A Contrastive-Collaborative Learning Framework for Weakly Supervised Audio-Visual Video Parsing
di: Sardari, Faegheh, et al.
Pubblicazione: (2024)
di: Sardari, Faegheh, et al.
Pubblicazione: (2024)
NarrativeBridge: Enhancing Video Captioning with Causal-Temporal Narrative
di: Nadeem, Asmar, et al.
Pubblicazione: (2024)
di: Nadeem, Asmar, et al.
Pubblicazione: (2024)
Unsupervised View-Invariant Human Posture Representation
di: Sardari, Faegheh, et al.
Pubblicazione: (2021)
di: Sardari, Faegheh, et al.
Pubblicazione: (2021)
Catalogue Grounded Multimodal Attribution for Museum Video under Resource and Regulatory Constraints
di: Nanang, Minsak, et al.
Pubblicazione: (2026)
di: Nanang, Minsak, et al.
Pubblicazione: (2026)
Realistic Clothed Human and Object Joint Reconstruction from a Single Image
di: Dutta, Ayushi, et al.
Pubblicazione: (2025)
di: Dutta, Ayushi, et al.
Pubblicazione: (2025)
TEn-CATG:Text-Enriched Audio-Visual Video Parsing with Multi-Scale Category-Aware Temporal Graph
di: Chen, Yaru, et al.
Pubblicazione: (2025)
di: Chen, Yaru, et al.
Pubblicazione: (2025)
Enhanced Multi-View Pedestrian Detection Using Probabilistic Occupancy Volume
di: Alturki, Reef, et al.
Pubblicazione: (2025)
di: Alturki, Reef, et al.
Pubblicazione: (2025)
DocSLM: A Small Vision-Language Model for Long Multimodal Document Understanding
di: Hannan, Tanveer, et al.
Pubblicazione: (2025)
di: Hannan, Tanveer, et al.
Pubblicazione: (2025)
Dual DETRs for Multi-Label Temporal Action Detection
di: Zhu, Yuhan, et al.
Pubblicazione: (2024)
di: Zhu, Yuhan, et al.
Pubblicazione: (2024)
Efficient Audio-Visual Fusion for Video Classification
di: Awan, Mahrukh, et al.
Pubblicazione: (2024)
di: Awan, Mahrukh, et al.
Pubblicazione: (2024)
Attention-Aware Multi-View Pedestrian Tracking
di: Alturki, Reef, et al.
Pubblicazione: (2025)
di: Alturki, Reef, et al.
Pubblicazione: (2025)
Risk Estimation of Knee Osteoarthritis Progression via Predictive Multi-task Modelling from Efficient Diffusion Model using X-ray Images
di: Butler, David, et al.
Pubblicazione: (2025)
di: Butler, David, et al.
Pubblicazione: (2025)
One-Stage Open-Vocabulary Temporal Action Detection Leveraging Temporal Multi-scale and Action Label Features
di: Nguyen, Trung Thanh, et al.
Pubblicazione: (2024)
di: Nguyen, Trung Thanh, et al.
Pubblicazione: (2024)
RFAssigner: A Generic Label Assignment Strategy for Dense Object Detection
di: Guan, Ziqian, et al.
Pubblicazione: (2026)
di: Guan, Ziqian, et al.
Pubblicazione: (2026)
Benchmarking Monocular 3D Dog Pose Estimation Using In-The-Wild Motion Capture Data
di: Shooter, Moira, et al.
Pubblicazione: (2024)
di: Shooter, Moira, et al.
Pubblicazione: (2024)
COSMU: Complete 3D human shape from monocular unconstrained images
di: Pesavento, Marco, et al.
Pubblicazione: (2024)
di: Pesavento, Marco, et al.
Pubblicazione: (2024)
Are Dense Labels Always Necessary for 3D Object Detection from Point Cloud?
di: Gao, Chenqiang, et al.
Pubblicazione: (2024)
di: Gao, Chenqiang, et al.
Pubblicazione: (2024)
Density-Guided Dense Pseudo Label Selection For Semi-supervised Oriented Object Detection
di: Zhao, Tong, et al.
Pubblicazione: (2023)
di: Zhao, Tong, et al.
Pubblicazione: (2023)
MANTA: Diffusion Mamba for Efficient and Effective Stochastic Long-Term Dense Anticipation
di: Zatsarynna, Olga, et al.
Pubblicazione: (2025)
di: Zatsarynna, Olga, et al.
Pubblicazione: (2025)
Active Label Cleaning for Reliable Detection of Electron Dense Deposits in Transmission Electron Microscopy Images
di: Tan, Jieyun, et al.
Pubblicazione: (2026)
di: Tan, Jieyun, et al.
Pubblicazione: (2026)
Multi-Task Label Discovery via Hierarchical Task Tokens for Partially Annotated Dense Predictions
di: Zhang, Jingdong, et al.
Pubblicazione: (2024)
di: Zhang, Jingdong, et al.
Pubblicazione: (2024)
HDR Environment Map Estimation with Latent Diffusion Models
di: Hilliard, Jack, et al.
Pubblicazione: (2025)
di: Hilliard, Jack, et al.
Pubblicazione: (2025)
Guided SAM: Label-Efficient Part Segmentation
di: van Rooij, S. B., et al.
Pubblicazione: (2025)
di: van Rooij, S. B., et al.
Pubblicazione: (2025)
Robust and Label-Efficient Deep Waste Detection
di: Abid, Hassan, et al.
Pubblicazione: (2025)
di: Abid, Hassan, et al.
Pubblicazione: (2025)
Efficient and Effective Weakly-Supervised Action Segmentation via Action-Transition-Aware Boundary Alignment
di: Xu, Angchi, et al.
Pubblicazione: (2024)
di: Xu, Angchi, et al.
Pubblicazione: (2024)
MTPano: Multi-Task Panoramic Scene Understanding via Label-Free Integration of Dense Prediction Priors
di: Zhang, Jingdong, et al.
Pubblicazione: (2026)
di: Zhang, Jingdong, et al.
Pubblicazione: (2026)
Towards Micro-Action Recognition with Limited Annotations: An Asynchronous Pseudo Labeling and Training Approach
di: Zhang, Yan, et al.
Pubblicazione: (2025)
di: Zhang, Yan, et al.
Pubblicazione: (2025)
Multi-Granularity Hand Action Detection
di: Zhe, Ting, et al.
Pubblicazione: (2023)
di: Zhe, Ting, et al.
Pubblicazione: (2023)
LEOD: Label-Efficient Object Detection for Event Cameras
di: Wu, Ziyi, et al.
Pubblicazione: (2023)
di: Wu, Ziyi, et al.
Pubblicazione: (2023)
S3R-Net: A Single-Stage Approach to Self-Supervised Shadow Removal
di: Kubiak, Nikolina, et al.
Pubblicazione: (2024)
di: Kubiak, Nikolina, et al.
Pubblicazione: (2024)
Cefdet: Cognitive Effectiveness Network Based on Fuzzy Inference for Action Detection
di: Luo, Zhe, et al.
Pubblicazione: (2024)
di: Luo, Zhe, et al.
Pubblicazione: (2024)
MUSE: Multi-Scale Dense Self-Distillation for Nucleus Detection and Classification
di: Yang, Zijiang, et al.
Pubblicazione: (2025)
di: Yang, Zijiang, et al.
Pubblicazione: (2025)
360U-Former: HDR Illumination Estimation with Panoramic Adapted Vision Transformers
di: Hilliard, Jack, et al.
Pubblicazione: (2024)
di: Hilliard, Jack, et al.
Pubblicazione: (2024)
Towards Efficient Pixel Labeling for Industrial Anomaly Detection and Localization
di: Li, Hanxi, et al.
Pubblicazione: (2024)
di: Li, Hanxi, et al.
Pubblicazione: (2024)
DeGMix: Efficient Multi-Task Dense Prediction with Deformable and Gating Mixer
di: Xu, Yangyang, et al.
Pubblicazione: (2023)
di: Xu, Yangyang, et al.
Pubblicazione: (2023)
EfficientViT: Multi-Scale Linear Attention for High-Resolution Dense Prediction
di: Cai, Han, et al.
Pubblicazione: (2022)
di: Cai, Han, et al.
Pubblicazione: (2022)
Efficient Domain-Adaptive Multi-Task Dense Prediction with Vision Foundation Models
di: Kang, Beomseok, et al.
Pubblicazione: (2025)
di: Kang, Beomseok, et al.
Pubblicazione: (2025)
BridgeNet: Comprehensive and Effective Feature Interactions via Bridge Feature for Multi-task Dense Predictions
di: Zhang, Jingdong, et al.
Pubblicazione: (2023)
di: Zhang, Jingdong, et al.
Pubblicazione: (2023)
Enhancing, Refining, and Fusing: Towards Robust Multi-Scale and Dense Ship Detection
di: Zhao, Congxia, et al.
Pubblicazione: (2025)
di: Zhao, Congxia, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Reframing Dense Action Detection (RefDense): A Paradigm Shift in Problem Solving & a Novel Optimization Strategy
di: Sardari, Faegheh, et al.
Pubblicazione: (2025) -
CoLeaF: A Contrastive-Collaborative Learning Framework for Weakly Supervised Audio-Visual Video Parsing
di: Sardari, Faegheh, et al.
Pubblicazione: (2024) -
NarrativeBridge: Enhancing Video Captioning with Causal-Temporal Narrative
di: Nadeem, Asmar, et al.
Pubblicazione: (2024) -
Unsupervised View-Invariant Human Posture Representation
di: Sardari, Faegheh, et al.
Pubblicazione: (2021) -
Catalogue Grounded Multimodal Attribution for Museum Video under Resource and Regulatory Constraints
di: Nanang, Minsak, et al.
Pubblicazione: (2026)