PVUW 2024 Challenge on Complex Video Understanding: Methods and Results
Fuente:
arXiv
Guardado en:
| Autores principales: | Ding, Henghui, Liu, Chang, Wei, Yunchao, Ravi, Nikhila, He, Shuting, Bai, Song, Torr, Philip, Miao, Deshui, Li, Xin, He, Zhenyu, Wang, Yaowei, Yang, Ming-Hsuan, Xu, Zhensong, Yao, Jiangtao, Wu, Chengjing, Liu, Ting, Liu, Luoqi, Liu, Xinyu, Zhang, Jing, Zhang, Kexin, Yang, Yuting, Jiao, Licheng, Yang, Shuyuan, Gao, Mingqi, Luo, Jingnan, Yang, Jinyu, Han, Jungong, Zheng, Feng, Cao, Bin, Zhang, Yisi, Lin, Xuanxu, He, Xingjian, Zhao, Bo, Liu, Jing, Pan, Feiyu, Fang, Hao, Lu, Xiankai |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
2nd Place Solution for MeViS Track in CVPR 2024 PVUW Workshop: Motion Expression guided Video Segmentation
por: Cao, Bin, et al.
Publicado: (2024)
por: Cao, Bin, et al.
Publicado: (2024)
2nd Place Solution for MOSE Track in CVPR 2024 PVUW workshop: Complex Video Object Segmentation
por: Xu, Zhensong, et al.
Publicado: (2024)
por: Xu, Zhensong, et al.
Publicado: (2024)
3rd Place Solution for MOSE Track in CVPR 2024 PVUW workshop: Complex Video Object Segmentation
por: Liu, Xinyu, et al.
Publicado: (2024)
por: Liu, Xinyu, et al.
Publicado: (2024)
1st Place Solution for MeViS Track in CVPR 2024 PVUW Workshop: Motion Expression guided Video Segmentation
por: Gao, Mingqi, et al.
Publicado: (2024)
por: Gao, Mingqi, et al.
Publicado: (2024)
3rd Place Solution for PVUW Challenge 2024: Video Panoptic Segmentation
por: Wu, Ruipu, et al.
Publicado: (2024)
por: Wu, Ruipu, et al.
Publicado: (2024)
1st Place Solution for MOSE Track in CVPR 2024 PVUW Workshop: Complex Video Object Segmentation
por: Miao, Deshui, et al.
Publicado: (2024)
por: Miao, Deshui, et al.
Publicado: (2024)
PVUW 2025 Challenge Report: Advances in Pixel-level Understanding of Complex Videos in the Wild
por: Ding, Henghui, et al.
Publicado: (2025)
por: Ding, Henghui, et al.
Publicado: (2025)
The Instance-centric Transformer for the RVOS Track of LSVOS Challenge: 3rd Place Solution
por: Cao, Bin, et al.
Publicado: (2024)
por: Cao, Bin, et al.
Publicado: (2024)
Report of the 5th PVUW Challenge: Towards More Diverse Modalities in Pixel-Level Understanding
por: Liu, Chang, et al.
Publicado: (2026)
por: Liu, Chang, et al.
Publicado: (2026)
Re-Prompting SAM 3 via Object Retrieval: 3rd of the 5th PVUW MOSE Track
por: Gao, Mingqi, et al.
Publicado: (2026)
por: Gao, Mingqi, et al.
Publicado: (2026)
STSeg-Complex Video Object Segmentation: The 1st Solution for 4th PVUW MOSE Challenge
por: Song, Kehuan, et al.
Publicado: (2025)
por: Song, Kehuan, et al.
Publicado: (2025)
LSVOS Challenge Report: Large-scale Complex and Long Video Object Segmentation
por: Ding, Henghui, et al.
Publicado: (2024)
por: Ding, Henghui, et al.
Publicado: (2024)
APRVOS: 1st Place Winner of 5th PVUW MeViS-Audio Track
por: Miao, Deshui, et al.
Publicado: (2026)
por: Miao, Deshui, et al.
Publicado: (2026)
Decoupling Static and Hierarchical Motion Perception for Referring Video Segmentation
por: He, Shuting, et al.
Publicado: (2024)
por: He, Shuting, et al.
Publicado: (2024)
RefMask3D: Language-Guided Transformer for 3D Referring Segmentation
por: He, Shuting, et al.
Publicado: (2024)
por: He, Shuting, et al.
Publicado: (2024)
Unveiling Parts Beyond Objects:Towards Finer-Granularity Referring Expression Segmentation
por: Wang, Wenxuan, et al.
Publicado: (2023)
por: Wang, Wenxuan, et al.
Publicado: (2023)
Beyond Literal Descriptions: Understanding and Locating Open-World Objects Aligned with Human Intentions
por: Wang, Wenxuan, et al.
Publicado: (2024)
por: Wang, Wenxuan, et al.
Publicado: (2024)
CM-MaskSD: Cross-Modality Masked Self-Distillation for Referring Image Segmentation
por: Wang, Wenxuan, et al.
Publicado: (2023)
por: Wang, Wenxuan, et al.
Publicado: (2023)
OAMVOS:2nd Report for 5th PVUW MOSE Track
por: Miao, Deshui, et al.
Publicado: (2026)
por: Miao, Deshui, et al.
Publicado: (2026)
Towards Unified Referring Expression Segmentation Across Omni-Level Visual Target Granularities
por: Liu, Jing, et al.
Publicado: (2025)
por: Liu, Jing, et al.
Publicado: (2025)
AgentRVOS for MeViS-Text Track of 5th PVUW Challenge: 3rd Method
por: Miao, Deshui, et al.
Publicado: (2026)
por: Miao, Deshui, et al.
Publicado: (2026)
GlyphMastero: A Glyph Encoder for High-Fidelity Scene Text Editing
por: Wang, Tong, et al.
Publicado: (2025)
por: Wang, Tong, et al.
Publicado: (2025)
EVPGS: Enhanced View Prior Guidance for Splatting-based Extrapolated View Synthesis
por: Li, Jiahe, et al.
Publicado: (2025)
por: Li, Jiahe, et al.
Publicado: (2025)
Semantic Segmentation on VSPW Dataset through Masked Video Consistency
por: Liang, Chen, et al.
Publicado: (2024)
por: Liang, Chen, et al.
Publicado: (2024)
FVOS for MOSE Track of 4th PVUW Challenge: 3rd Place Solution
por: Wang, Mengjiao, et al.
Publicado: (2025)
por: Wang, Mengjiao, et al.
Publicado: (2025)
Prompt-Softbox-Prompt: A Free-Text Embedding Control for Image Editing
por: Yang, Yitong, et al.
Publicado: (2024)
por: Yang, Yitong, et al.
Publicado: (2024)
Calibration & Reconstruction: Deep Integrated Language for Referring Image Segmentation
por: Yan, Yichen, et al.
Publicado: (2024)
por: Yan, Yichen, et al.
Publicado: (2024)
Learning Spatial-Semantic Features for Robust Video Object Segmentation
por: Li, Xin, et al.
Publicado: (2024)
por: Li, Xin, et al.
Publicado: (2024)
Discriminative Spatial-Semantic VOS Solution: 1st Place Solution for 6th LSVOS
por: Miao, Deshui, et al.
Publicado: (2024)
por: Miao, Deshui, et al.
Publicado: (2024)
GREx: Generalized Referring Expression Segmentation, Comprehension, and Generation
por: Ding, Henghui, et al.
Publicado: (2026)
por: Ding, Henghui, et al.
Publicado: (2026)
Renormalized Connection for Scale-preferred Object Detection in Satellite Imagery
por: Zhang, Fan, et al.
Publicado: (2024)
por: Zhang, Fan, et al.
Publicado: (2024)
Deciphering Hydrothermal Cues for the Wintering Migration of Endemic Fish in Cryospheric Headwaters: A 3‐Year Monitoring on the Tibetan Plateau
por: Chenyu Liu, et al.
Publicado: (2025)
por: Chenyu Liu, et al.
Publicado: (2025)
Show Me When and Where: Towards Referring Video Object Segmentation in the Wild
por: Gao, Mingqi, et al.
Publicado: (2026)
por: Gao, Mingqi, et al.
Publicado: (2026)
Improving the Balance of Unobserved Covariates From Information Theory in Multi-Arm Randomization with Unequal Allocation Ratio
por: Ma, Xingjian, et al.
Publicado: (2023)
por: Ma, Xingjian, et al.
Publicado: (2023)
Geometric Prior Guided Feature Representation Learning for Long-Tailed Classification
por: Ma, Yanbiao, et al.
Publicado: (2024)
por: Ma, Yanbiao, et al.
Publicado: (2024)
Exploring Beyond Logits: Hierarchical Dynamic Labeling Based on Embeddings for Semi-Supervised Classification
por: Ma, Yanbiao, et al.
Publicado: (2024)
por: Ma, Yanbiao, et al.
Publicado: (2024)
MOSEv2: A More Challenging Dataset for Video Object Segmentation in Complex Scenes
por: Ding, Henghui, et al.
Publicado: (2025)
por: Ding, Henghui, et al.
Publicado: (2025)
Hierarchical Alignment-enhanced Adaptive Grounding Network for Generalized Referring Expression Comprehension
por: Wang, Yaxian, et al.
Publicado: (2025)
por: Wang, Yaxian, et al.
Publicado: (2025)
MiVE: Multiscale Vision-language features for reference-guided video Editing
por: Wang, Tong, et al.
Publicado: (2026)
por: Wang, Tong, et al.
Publicado: (2026)
SAM-REF: Introducing Image-Prompt Synergy during Interaction for Detail Enhancement in the Segment Anything Model
por: Yu, Chongkai, et al.
Publicado: (2024)
por: Yu, Chongkai, et al.
Publicado: (2024)
Ejemplares similares
-
2nd Place Solution for MeViS Track in CVPR 2024 PVUW Workshop: Motion Expression guided Video Segmentation
por: Cao, Bin, et al.
Publicado: (2024) -
2nd Place Solution for MOSE Track in CVPR 2024 PVUW workshop: Complex Video Object Segmentation
por: Xu, Zhensong, et al.
Publicado: (2024) -
3rd Place Solution for MOSE Track in CVPR 2024 PVUW workshop: Complex Video Object Segmentation
por: Liu, Xinyu, et al.
Publicado: (2024) -
1st Place Solution for MeViS Track in CVPR 2024 PVUW Workshop: Motion Expression guided Video Segmentation
por: Gao, Mingqi, et al.
Publicado: (2024) -
3rd Place Solution for PVUW Challenge 2024: Video Panoptic Segmentation
por: Wu, Ruipu, et al.
Publicado: (2024)