Unified Embedding Alignment for Open-Vocabulary Video Instance Segmentation
Fuente:
arXiv
Guardado en:
| Autores principales: | Fang, Hao, Wu, Peng, Li, Yawei, Zhang, Xinxin, Lu, Xiankai |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Towards Real-Time Open-Vocabulary Video Instance Segmentation
por: Yan, Bin, et al.
Publicado: (2024)
por: Yan, Bin, et al.
Publicado: (2024)
3rd Place Solution for MeViS Track in CVPR 2024 PVUW workshop: Motion Expression guided Video Segmentation
por: Pan, Feiyu, et al.
Publicado: (2024)
por: Pan, Feiyu, et al.
Publicado: (2024)
MARIS: Marine Open-Vocabulary Instance Segmentation with Geometric Enhancement and Semantic Alignment
por: Li, Bingyu, et al.
Publicado: (2025)
por: Li, Bingyu, et al.
Publicado: (2025)
CLIP-VIS: Adapting CLIP for Open-Vocabulary Video Instance Segmentation
por: Zhu, Wenqi, et al.
Publicado: (2024)
por: Zhu, Wenqi, et al.
Publicado: (2024)
Instance Brownian Bridge as Texts for Open-vocabulary Video Instance Segmentation
por: Cheng, Zesen, et al.
Publicado: (2024)
por: Cheng, Zesen, et al.
Publicado: (2024)
Video Object Segmentation via SAM 2: The 4th Solution for LSVOS Challenge VOS Track
por: Pan, Feiyu, et al.
Publicado: (2024)
por: Pan, Feiyu, et al.
Publicado: (2024)
The 1st Solution for 4th PVUW MeViS Challenge: Unleashing the Potential of Large Multimodal Models for Referring Video Segmentation
por: Fang, Hao, et al.
Publicado: (2025)
por: Fang, Hao, et al.
Publicado: (2025)
Open-Vocabulary Semantic Segmentation with Image Embedding Balancing
por: Shan, Xiangheng, et al.
Publicado: (2024)
por: Shan, Xiangheng, et al.
Publicado: (2024)
Open-Vocabulary Video Anomaly Detection
por: Wu, Peng, et al.
Publicado: (2023)
por: Wu, Peng, et al.
Publicado: (2023)
USE: Universal Segment Embeddings for Open-Vocabulary Image Segmentation
por: Wang, Xiaoqi, et al.
Publicado: (2024)
por: Wang, Xiaoqi, et al.
Publicado: (2024)
OpenVIS: Open-vocabulary Video Instance Segmentation
por: Guo, Pinxue, et al.
Publicado: (2023)
por: Guo, Pinxue, et al.
Publicado: (2023)
FGAseg: Fine-Grained Pixel-Text Alignment for Open-Vocabulary Semantic Segmentation
por: Li, Bingyu, et al.
Publicado: (2025)
por: Li, Bingyu, et al.
Publicado: (2025)
Segment then Splat: Unified 3D Open-Vocabulary Segmentation via Gaussian Splatting
por: Lu, Yiren, et al.
Publicado: (2025)
por: Lu, Yiren, et al.
Publicado: (2025)
Open-Vocabulary Camouflaged Object Segmentation
por: Pang, Youwei, et al.
Publicado: (2023)
por: Pang, Youwei, et al.
Publicado: (2023)
NVSMask3D: Hard Visual Prompting with Camera Pose Interpolation for 3D Open Vocabulary Instance Segmentation
por: Fang, Junyuan, et al.
Publicado: (2025)
por: Fang, Junyuan, et al.
Publicado: (2025)
SCORE: Scene Context Matters in Open-Vocabulary Remote Sensing Instance Segmentation
por: Huang, Shiqi, et al.
Publicado: (2025)
por: Huang, Shiqi, et al.
Publicado: (2025)
Renovating Names in Open-Vocabulary Segmentation Benchmarks
por: Huang, Haiwen, et al.
Publicado: (2024)
por: Huang, Haiwen, et al.
Publicado: (2024)
Leveraging Vision-Language Models for Open-Vocabulary Instance Segmentation and Tracking
por: Pätzold, Bastian, et al.
Publicado: (2025)
por: Pätzold, Bastian, et al.
Publicado: (2025)
Lost in Translation? Vocabulary Alignment for Source-Free Adaptation in Open-Vocabulary Semantic Segmentation
por: Mazzucco, Silvio, et al.
Publicado: (2025)
por: Mazzucco, Silvio, et al.
Publicado: (2025)
ExpAlign: Expectation-Guided Vision-Language Alignment for Open-Vocabulary Grounding
por: Hu, Junyi, et al.
Publicado: (2026)
por: Hu, Junyi, et al.
Publicado: (2026)
Semantic Alignment in Hyperbolic Space for Open-Vocabulary Semantic Segmentation
por: Truong, Hoang M., et al.
Publicado: (2026)
por: Truong, Hoang M., et al.
Publicado: (2026)
FOLK: Fast Open-Vocabulary 3D Instance Segmentation via Label-guided Knowledge Distillation
por: Wu, Hongrui, et al.
Publicado: (2025)
por: Wu, Hongrui, et al.
Publicado: (2025)
Open-YOLO 3D: Towards Fast and Accurate Open-Vocabulary 3D Instance Segmentation
por: Boudjoghra, Mohamed El Amine, et al.
Publicado: (2024)
por: Boudjoghra, Mohamed El Amine, et al.
Publicado: (2024)
OpenTrack3D: Towards Accurate and Generalizable Open-Vocabulary 3D Instance Segmentation
por: Zhou, Zhishan, et al.
Publicado: (2025)
por: Zhou, Zhishan, et al.
Publicado: (2025)
OpenSplat3D: Open-Vocabulary 3D Instance Segmentation using Gaussian Splatting
por: Piekenbrinck, Jens, et al.
Publicado: (2025)
por: Piekenbrinck, Jens, et al.
Publicado: (2025)
Open3DIS: Open-Vocabulary 3D Instance Segmentation with 2D Mask Guidance
por: Nguyen, Phuc D. A., et al.
Publicado: (2023)
por: Nguyen, Phuc D. A., et al.
Publicado: (2023)
Local2Global query Alignment for Video Instance Segmentation
por: Koner, Rajat, et al.
Publicado: (2025)
por: Koner, Rajat, et al.
Publicado: (2025)
Zero-Shot Dual-Path Integration Framework for Open-Vocabulary 3D Instance Segmentation
por: Ton, Tri, et al.
Publicado: (2024)
por: Ton, Tri, et al.
Publicado: (2024)
YOLOE-26: Integrating YOLO26 with YOLOE for Real-Time Open-Vocabulary Instance Segmentation
por: Sapkota, Ranjan, et al.
Publicado: (2026)
por: Sapkota, Ranjan, et al.
Publicado: (2026)
Retrieving Objects from 3D Scenes with Box-Guided Open-Vocabulary Instance Segmentation
por: Nguyen, Khanh, et al.
Publicado: (2025)
por: Nguyen, Khanh, et al.
Publicado: (2025)
MaskClustering: View Consensus based Mask Graph Clustering for Open-Vocabulary 3D Instance Segmentation
por: Yan, Mi, et al.
Publicado: (2024)
por: Yan, Mi, et al.
Publicado: (2024)
UniVid: The Open-Source Unified Video Model
por: Luo, Jiabin, et al.
Publicado: (2025)
por: Luo, Jiabin, et al.
Publicado: (2025)
OVI-MAP:Open-Vocabulary Instance-Semantic Mapping
por: Deng, Zilong, et al.
Publicado: (2026)
por: Deng, Zilong, et al.
Publicado: (2026)
Incorporating Feature Pyramid Tokenization and Open Vocabulary Semantic Segmentation
por: Zhang, Jianyu, et al.
Publicado: (2024)
por: Zhang, Jianyu, et al.
Publicado: (2024)
Direct Segmentation without Logits Optimization for Training-Free Open-Vocabulary Semantic Segmentation
por: Li, Jiahao, et al.
Publicado: (2026)
por: Li, Jiahao, et al.
Publicado: (2026)
Generalization Boosted Adapter for Open-Vocabulary Segmentation
por: Xu, Wenhao, et al.
Publicado: (2024)
por: Xu, Wenhao, et al.
Publicado: (2024)
Prompt-Guided Mask Proposal for Two-Stage Open-Vocabulary Segmentation
por: Li, Yu-Jhe, et al.
Publicado: (2024)
por: Li, Yu-Jhe, et al.
Publicado: (2024)
Open-Vocabulary Object Detection via Neighboring Region Attention Alignment
por: Qiang, Sunyuan, et al.
Publicado: (2024)
por: Qiang, Sunyuan, et al.
Publicado: (2024)
From Open-Vocabulary to Vocabulary-Free Semantic Segmentation
por: Reichard, Klara, et al.
Publicado: (2025)
por: Reichard, Klara, et al.
Publicado: (2025)
InstanceBEV: Unifying Instance and BEV Representation for 3D Panoptic Segmentation
por: Li, Feng, et al.
Publicado: (2025)
por: Li, Feng, et al.
Publicado: (2025)
Ejemplares similares
-
Towards Real-Time Open-Vocabulary Video Instance Segmentation
por: Yan, Bin, et al.
Publicado: (2024) -
3rd Place Solution for MeViS Track in CVPR 2024 PVUW workshop: Motion Expression guided Video Segmentation
por: Pan, Feiyu, et al.
Publicado: (2024) -
MARIS: Marine Open-Vocabulary Instance Segmentation with Geometric Enhancement and Semantic Alignment
por: Li, Bingyu, et al.
Publicado: (2025) -
CLIP-VIS: Adapting CLIP for Open-Vocabulary Video Instance Segmentation
por: Zhu, Wenqi, et al.
Publicado: (2024) -
Instance Brownian Bridge as Texts for Open-vocabulary Video Instance Segmentation
por: Cheng, Zesen, et al.
Publicado: (2024)