Open-Vocabulary SAM3D: Towards Training-free Open-Vocabulary 3D Scene Understanding
Fuente:
arXiv
Salvato in:
| Autori principali: | Tai, Hanchen, He, Qingdong, Zhang, Jiangning, Qian, Yijie, Zhang, Zhenyu, Hu, Xiaobin, Li, Xiangtai, Wang, Yabiao, Liu, Yong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
UniM-OV3D: Uni-Modality Open-Vocabulary 3D Scene Understanding with Fine-Grained Feature Representation
di: He, Qingdong, et al.
Pubblicazione: (2024)
di: He, Qingdong, et al.
Pubblicazione: (2024)
PointSeg: A Training-Free Paradigm for 3D Scene Segmentation via Foundation Models
di: He, Qingdong, et al.
Pubblicazione: (2024)
di: He, Qingdong, et al.
Pubblicazione: (2024)
Dense Multimodal Alignment for Open-Vocabulary 3D Scene Understanding
di: Li, Ruihuang, et al.
Pubblicazione: (2024)
di: Li, Ruihuang, et al.
Pubblicazione: (2024)
Open-Vocabulary Octree-Graph for 3D Scene Understanding
di: Wang, Zhigang, et al.
Pubblicazione: (2024)
di: Wang, Zhigang, et al.
Pubblicazione: (2024)
Mamba-YOLO-World: Marrying YOLO-World with Mamba for Open-Vocabulary Detection
di: Wang, Haoxuan, et al.
Pubblicazione: (2024)
di: Wang, Haoxuan, et al.
Pubblicazione: (2024)
OpenVoxel: Training-Free Grouping and Captioning Voxels for Open-Vocabulary 3D Scene Understanding
di: Huang, Sheng-Yu, et al.
Pubblicazione: (2026)
di: Huang, Sheng-Yu, et al.
Pubblicazione: (2026)
Towards Open Vocabulary Learning: A Survey
di: Wu, Jianzong, et al.
Pubblicazione: (2023)
di: Wu, Jianzong, et al.
Pubblicazione: (2023)
Open Vocabulary 3D Scene Understanding via Geometry Guided Self-Distillation
di: Wang, Pengfei, et al.
Pubblicazione: (2024)
di: Wang, Pengfei, et al.
Pubblicazione: (2024)
OpenScan: A Benchmark for Generalized Open-Vocabulary 3D Scene Understanding
di: Zhao, Youjun, et al.
Pubblicazione: (2024)
di: Zhao, Youjun, et al.
Pubblicazione: (2024)
PanoGS: Gaussian-based Panoptic Segmentation for 3D Open Vocabulary Scene Understanding
di: Zhai, Hongjia, et al.
Pubblicazione: (2025)
di: Zhai, Hongjia, et al.
Pubblicazione: (2025)
OpenSUN3D: 1st Workshop Challenge on Open-Vocabulary 3D Scene Understanding
di: Engelmann, Francis, et al.
Pubblicazione: (2024)
di: Engelmann, Francis, et al.
Pubblicazione: (2024)
OpenOcc: Open Vocabulary 3D Scene Reconstruction via Occupancy Representation
di: Jiang, Haochen, et al.
Pubblicazione: (2024)
di: Jiang, Haochen, et al.
Pubblicazione: (2024)
Semantic Gaussians: Open-Vocabulary Scene Understanding with 3D Gaussian Splatting
di: Guo, Jun, et al.
Pubblicazione: (2024)
di: Guo, Jun, et al.
Pubblicazione: (2024)
Masked Point-Entity Contrast for Open-Vocabulary 3D Scene Understanding
di: Wang, Yan, et al.
Pubblicazione: (2025)
di: Wang, Yan, et al.
Pubblicazione: (2025)
Open-Vocabulary SAM: Segment and Recognize Twenty-thousand Classes Interactively
di: Yuan, Haobo, et al.
Pubblicazione: (2024)
di: Yuan, Haobo, et al.
Pubblicazione: (2024)
OpenGaussian: Towards Point-Level 3D Gaussian-based Open Vocabulary Understanding
di: Wu, Yanmin, et al.
Pubblicazione: (2024)
di: Wu, Yanmin, et al.
Pubblicazione: (2024)
Hierarchical and Holistic Open-Vocabulary Functional 3D Scene Graphs for Indoor Spaces
di: Hu, Xinggang, et al.
Pubblicazione: (2026)
di: Hu, Xinggang, et al.
Pubblicazione: (2026)
Open-Vocabulary Functional 3D Human-Scene Interaction Generation
di: Liu, Jie, et al.
Pubblicazione: (2026)
di: Liu, Jie, et al.
Pubblicazione: (2026)
CAGS: Open-Vocabulary 3D Scene Understanding with Context-Aware Gaussian Splatting
di: Sun, Wei, et al.
Pubblicazione: (2025)
di: Sun, Wei, et al.
Pubblicazione: (2025)
Cross-Modal and Uncertainty-Aware Agglomeration for Open-Vocabulary 3D Scene Understanding
di: Li, Jinlong, et al.
Pubblicazione: (2025)
di: Li, Jinlong, et al.
Pubblicazione: (2025)
SPNeRF: Open Vocabulary 3D Neural Scene Segmentation with Superpoints
di: Hu, Weiwen, et al.
Pubblicazione: (2025)
di: Hu, Weiwen, et al.
Pubblicazione: (2025)
GeoSAM-3D: Geodesic Prompt Propagation for Open-Vocabulary 3D Scene Segmentation from Monocular Video
di: Sharma, Arun
Pubblicazione: (2026)
di: Sharma, Arun
Pubblicazione: (2026)
Textual Decomposition Then Sub-motion-space Scattering for Open-Vocabulary Motion Generation
di: Fan, Ke, et al.
Pubblicazione: (2024)
di: Fan, Ke, et al.
Pubblicazione: (2024)
Open-Vocabulary Functional 3D Scene Graphs for Real-World Indoor Spaces
di: Zhang, Chenyangguang, et al.
Pubblicazione: (2025)
di: Zhang, Chenyangguang, et al.
Pubblicazione: (2025)
Open Vocabulary Semantic Scene Sketch Understanding
di: Bourouis, Ahmed, et al.
Pubblicazione: (2023)
di: Bourouis, Ahmed, et al.
Pubblicazione: (2023)
Towards Open-Vocabulary Multimodal 3D Object Detection with Attributes
di: Xiang, Xinhao, et al.
Pubblicazione: (2025)
di: Xiang, Xinhao, et al.
Pubblicazione: (2025)
ShelfGaussian: Shelf-Supervised Open-Vocabulary Gaussian-based 3D Scene Understanding
di: Zhao, Lingjun, et al.
Pubblicazione: (2025)
di: Zhao, Lingjun, et al.
Pubblicazione: (2025)
Beyond Averages: Open-Vocabulary 3D Scene Understanding with Gaussian Splatting and Bag of Embeddings
di: Arafa, Abdalla, et al.
Pubblicazione: (2025)
di: Arafa, Abdalla, et al.
Pubblicazione: (2025)
OpenLex3D: A Tiered Evaluation Benchmark for Open-Vocabulary 3D Scene Representations
di: Kassab, Christina, et al.
Pubblicazione: (2025)
di: Kassab, Christina, et al.
Pubblicazione: (2025)
Ilov3Splat: Instance-Level Open-Vocabulary 3D Scene Understanding in Gaussian Splatting
di: Nguyen, Binh Long, et al.
Pubblicazione: (2026)
di: Nguyen, Binh Long, et al.
Pubblicazione: (2026)
Open3DTrack: Towards Open-Vocabulary 3D Multi-Object Tracking
di: Ishaq, Ayesha, et al.
Pubblicazione: (2024)
di: Ishaq, Ayesha, et al.
Pubblicazione: (2024)
OpenTrack3D: Towards Accurate and Generalizable Open-Vocabulary 3D Instance Segmentation
di: Zhou, Zhishan, et al.
Pubblicazione: (2025)
di: Zhou, Zhishan, et al.
Pubblicazione: (2025)
Open-YOLO 3D: Towards Fast and Accurate Open-Vocabulary 3D Instance Segmentation
di: Boudjoghra, Mohamed El Amine, et al.
Pubblicazione: (2024)
di: Boudjoghra, Mohamed El Amine, et al.
Pubblicazione: (2024)
OmniOVCD: Streamlining Open-Vocabulary Change Detection with SAM 3
di: Zhang, Xu, et al.
Pubblicazione: (2026)
di: Zhang, Xu, et al.
Pubblicazione: (2026)
DST-Det: Simple Dynamic Self-Training for Open-Vocabulary Object Detection
di: Xu, Shilin, et al.
Pubblicazione: (2023)
di: Xu, Shilin, et al.
Pubblicazione: (2023)
Open-Vocabulary Indoor Object Grounding with 3D Hierarchical Scene Graph
di: Linok, Sergey, et al.
Pubblicazione: (2025)
di: Linok, Sergey, et al.
Pubblicazione: (2025)
EmbodiedSplat: Online Feed-Forward Semantic 3DGS for Open-Vocabulary 3D Scene Understanding
di: Lee, Seungjun, et al.
Pubblicazione: (2026)
di: Lee, Seungjun, et al.
Pubblicazione: (2026)
LightSplat: Fast and Memory-Efficient Open-Vocabulary 3D Scene Understanding in Five Seconds
di: Bang, Jaehun, et al.
Pubblicazione: (2026)
di: Bang, Jaehun, et al.
Pubblicazione: (2026)
EgoSplat: Open-Vocabulary Egocentric Scene Understanding with Language Embedded 3D Gaussian Splatting
di: Li, Di, et al.
Pubblicazione: (2025)
di: Li, Di, et al.
Pubblicazione: (2025)
PointRWKV: Efficient RWKV-Like Model for Hierarchical Point Cloud Learning
di: He, Qingdong, et al.
Pubblicazione: (2024)
di: He, Qingdong, et al.
Pubblicazione: (2024)
Documenti analoghi
-
UniM-OV3D: Uni-Modality Open-Vocabulary 3D Scene Understanding with Fine-Grained Feature Representation
di: He, Qingdong, et al.
Pubblicazione: (2024) -
PointSeg: A Training-Free Paradigm for 3D Scene Segmentation via Foundation Models
di: He, Qingdong, et al.
Pubblicazione: (2024) -
Dense Multimodal Alignment for Open-Vocabulary 3D Scene Understanding
di: Li, Ruihuang, et al.
Pubblicazione: (2024) -
Open-Vocabulary Octree-Graph for 3D Scene Understanding
di: Wang, Zhigang, et al.
Pubblicazione: (2024) -
Mamba-YOLO-World: Marrying YOLO-World with Mamba for Open-Vocabulary Detection
di: Wang, Haoxuan, et al.
Pubblicazione: (2024)