Enregistré dans:
| Auteurs principaux: | Xiao, Zihao, Jing, Longlong, Wu, Shangxuan, Zhu, Alex Zihao, Ji, Jingwei, Jiang, Chiyu Max, Hung, Wei-Chih, Funkhouser, Thomas, Kuo, Weicheng, Angelova, Anelia, Zhou, Yin, Sheng, Shiwei |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2401.02402 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Region-centric Image-Language Pretraining for Open-Vocabulary Detection
par: Kim, Dahun, et autres
Publié: (2023)
par: Kim, Dahun, et autres
Publié: (2023)
Context-Adaptive Multi-Prompt Embedding with Large Language Models for Vision-Language Alignment
par: Kim, Dahun, et autres
Publié: (2025)
par: Kim, Dahun, et autres
Publié: (2025)
PanoGS: Gaussian-based Panoptic Segmentation for 3D Open Vocabulary Scene Understanding
par: Zhai, Hongjia, et autres
Publié: (2025)
par: Zhai, Hongjia, et autres
Publié: (2025)
Cues3D: Unleashing the Power of Sole NeRF for Consistent and Unique Instances in Open-Vocabulary 3D Panoptic Segmentation
par: Xue, Feng, et autres
Publié: (2025)
par: Xue, Feng, et autres
Publié: (2025)
OnlinePG: Online Open-Vocabulary Panoptic Mapping with 3D Gaussian Splatting
par: Zhai, Hongjia, et autres
Publié: (2026)
par: Zhai, Hongjia, et autres
Publié: (2026)
Open Vocabulary Panoptic Segmentation With Retrieval Augmentation
par: Sadeq, Nafis, et autres
Publié: (2026)
par: Sadeq, Nafis, et autres
Publié: (2026)
COS3D: Collaborative Open-Vocabulary 3D Segmentation
par: Zhu, Runsong, et autres
Publié: (2025)
par: Zhu, Runsong, et autres
Publié: (2025)
Search3D: Hierarchical Open-Vocabulary 3D Segmentation
par: Takmaz, Ayca, et autres
Publié: (2024)
par: Takmaz, Ayca, et autres
Publié: (2024)
Unlocking Multi-Spectral Data for Multi-Modal Models with Guided Inputs and Chain-of-Thought Reasoning
par: Kim, Dahun, et autres
Publié: (2026)
par: Kim, Dahun, et autres
Publié: (2026)
EOV-Seg: Efficient Open-Vocabulary Panoptic Segmentation
par: Niu, Hongwei, et autres
Publié: (2024)
par: Niu, Hongwei, et autres
Publié: (2024)
FutureHuman3D: Forecasting Complex Long-Term 3D Human Behavior from Video Observations
par: Diller, Christian, et autres
Publié: (2022)
par: Diller, Christian, et autres
Publié: (2022)
3D Annotation-Free Learning by Distilling 2D Open-Vocabulary Segmentation Models for Autonomous Driving
par: Sun, Boyi, et autres
Publié: (2024)
par: Sun, Boyi, et autres
Publié: (2024)
OpenDAS: Open-Vocabulary Domain Adaptation for 2D and 3D Segmentation
par: Yilmaz, Gonca, et autres
Publié: (2024)
par: Yilmaz, Gonca, et autres
Publié: (2024)
VideoComp: Advancing Fine-Grained Compositional and Temporal Alignment in Video-Text Models
par: Kim, Dahun, et autres
Publié: (2025)
par: Kim, Dahun, et autres
Publié: (2025)
Mosaic3D: Foundation Dataset and Model for Open-Vocabulary 3D Segmentation
par: Lee, Junha, et autres
Publié: (2025)
par: Lee, Junha, et autres
Publié: (2025)
Multimodal Panoptic Segmentation of 3D Point Clouds
par: Dürr, Fabian
Publié: (2023)
par: Dürr, Fabian
Publié: (2023)
PartDistill: 3D Shape Part Segmentation by Vision-Language Model Distillation
par: Umam, Ardian, et autres
Publié: (2023)
par: Umam, Ardian, et autres
Publié: (2023)
OpenTrack3D: Towards Accurate and Generalizable Open-Vocabulary 3D Instance Segmentation
par: Zhou, Zhishan, et autres
Publié: (2025)
par: Zhou, Zhishan, et autres
Publié: (2025)
Open-YOLO 3D: Towards Fast and Accurate Open-Vocabulary 3D Instance Segmentation
par: Boudjoghra, Mohamed El Amine, et autres
Publié: (2024)
par: Boudjoghra, Mohamed El Amine, et autres
Publié: (2024)
OpenSplat3D: Open-Vocabulary 3D Instance Segmentation using Gaussian Splatting
par: Piekenbrinck, Jens, et autres
Publié: (2025)
par: Piekenbrinck, Jens, et autres
Publié: (2025)
Open3DIS: Open-Vocabulary 3D Instance Segmentation with 2D Mask Guidance
par: Nguyen, Phuc D. A., et autres
Publié: (2023)
par: Nguyen, Phuc D. A., et autres
Publié: (2023)
RAZER: Robust Accelerated Zero-Shot 3D Open-Vocabulary Panoptic Reconstruction with Spatio-Temporal Aggregation
par: Patel, Naman, et autres
Publié: (2025)
par: Patel, Naman, et autres
Publié: (2025)
OVGaussian: Generalizable 3D Gaussian Segmentation with Open Vocabularies
par: Chen, Runnan, et autres
Publié: (2024)
par: Chen, Runnan, et autres
Publié: (2024)
Open-Vocabulary Semantic Part Segmentation of 3D Human
par: Suzuki, Keito, et autres
Publié: (2025)
par: Suzuki, Keito, et autres
Publié: (2025)
FOLK: Fast Open-Vocabulary 3D Instance Segmentation via Label-guided Knowledge Distillation
par: Wu, Hongrui, et autres
Publié: (2025)
par: Wu, Hongrui, et autres
Publié: (2025)
GeoPurify: A Data-Efficient Geometric Distillation Framework for Open-Vocabulary 3D Segmentation
par: Dou, Weijia, et autres
Publié: (2025)
par: Dou, Weijia, et autres
Publié: (2025)
PGOV3D: Open-Vocabulary 3D Semantic Segmentation with Partial-to-Global Curriculum
par: Zhang, Shiqi, et autres
Publié: (2025)
par: Zhang, Shiqi, et autres
Publié: (2025)
Reasoning3D -- Grounding and Reasoning in 3D: Fine-Grained Zero-Shot Open-Vocabulary 3D Reasoning Part Segmentation via Large Vision-Language Models
par: Chen, Tianrun, et autres
Publié: (2024)
par: Chen, Tianrun, et autres
Publié: (2024)
Global dynamics of Kato's solutions for the 3D incompressible micropolar system
par: Song, Zihao
Publié: (2024)
par: Song, Zihao
Publié: (2024)
Scalable 3D Panoptic Segmentation As Superpoint Graph Clustering
par: Robert, Damien, et autres
Publié: (2024)
par: Robert, Damien, et autres
Publié: (2024)
Time-Scaling State-Space Models for Dense Video Captioning
par: Piergiovanni, AJ, et autres
Publié: (2025)
par: Piergiovanni, AJ, et autres
Publié: (2025)
Open-Vocabulary Panoptic Segmentation Using BERT Pre-Training of Vision-Language Multiway Transformer Model
par: Chen, Yi-Chia, et autres
Publié: (2024)
par: Chen, Yi-Chia, et autres
Publié: (2024)
Mirasol3B: A Multimodal Autoregressive model for time-aligned and contextual modalities
par: Piergiovanni, AJ, et autres
Publié: (2023)
par: Piergiovanni, AJ, et autres
Publié: (2023)
XMask3D: Cross-modal Mask Reasoning for Open Vocabulary 3D Semantic Segmentation
par: Wang, Ziyi, et autres
Publié: (2024)
par: Wang, Ziyi, et autres
Publié: (2024)
Open-Vocabulary High-Resolution 3D (OVHR3D) Data Segmentation and Annotation Framework
par: Xu, Jiuyi, et autres
Publié: (2024)
par: Xu, Jiuyi, et autres
Publié: (2024)
Rethinking Open-Vocabulary Segmentation of Radiance Fields in 3D Space
par: Lee, Hyunjee, et autres
Publié: (2024)
par: Lee, Hyunjee, et autres
Publié: (2024)
Open-Vocabulary SAM3D: Towards Training-free Open-Vocabulary 3D Scene Understanding
par: Tai, Hanchen, et autres
Publié: (2024)
par: Tai, Hanchen, et autres
Publié: (2024)
Vocabulary-Free 3D Instance Segmentation with Vision and Language Assistant
par: Mei, Guofeng, et autres
Publié: (2024)
par: Mei, Guofeng, et autres
Publié: (2024)
Zero-Shot Dual-Path Integration Framework for Open-Vocabulary 3D Instance Segmentation
par: Ton, Tri, et autres
Publié: (2024)
par: Ton, Tri, et autres
Publié: (2024)
Mitigating Objectness Bias and Region-to-Text Misalignment for Open-Vocabulary Panoptic Segmentation
par: Kormushev, Nikolay, et autres
Publié: (2026)
par: Kormushev, Nikolay, et autres
Publié: (2026)
Documents similaires
-
Region-centric Image-Language Pretraining for Open-Vocabulary Detection
par: Kim, Dahun, et autres
Publié: (2023) -
Context-Adaptive Multi-Prompt Embedding with Large Language Models for Vision-Language Alignment
par: Kim, Dahun, et autres
Publié: (2025) -
PanoGS: Gaussian-based Panoptic Segmentation for 3D Open Vocabulary Scene Understanding
par: Zhai, Hongjia, et autres
Publié: (2025) -
Cues3D: Unleashing the Power of Sole NeRF for Consistent and Unique Instances in Open-Vocabulary 3D Panoptic Segmentation
par: Xue, Feng, et autres
Publié: (2025) -
OnlinePG: Online Open-Vocabulary Panoptic Mapping with 3D Gaussian Splatting
par: Zhai, Hongjia, et autres
Publié: (2026)