CoSMo3D: Open-World Promptable 3D Semantic Part Segmentation through LLM-Guided Canonical Spatial Modeling
Fuente:
arXiv
Salvato in:
| Autori principali: | Jin, Li, Chen, Weikai, Wang, Yujie, Yin, Yingda, Hu, Zeyu, Zhang, Runze, Luo, Keyang, Qian, Shengju, Wang, Xin, Qin, Xueying |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
CoSMo: A Multimodal Transformer for Page Stream Segmentation in Comic Books
di: Ortega, Marc Serra, et al.
Pubblicazione: (2025)
di: Ortega, Marc Serra, et al.
Pubblicazione: (2025)
CanoVerse: 3D Object Scalable Canonicalization and Dataset for Generation and Pose
di: Jin, Li, et al.
Pubblicazione: (2026)
di: Jin, Li, et al.
Pubblicazione: (2026)
CoSMo: a Framework to Instantiate Conditioned Process Simulation Models
di: Oyamada, Rafael S., et al.
Pubblicazione: (2023)
di: Oyamada, Rafael S., et al.
Pubblicazione: (2023)
CaliTex: Geometry-Calibrated Attention for View-Coherent 3D Texture Generation
di: Liu, Chenyu, et al.
Pubblicazione: (2025)
di: Liu, Chenyu, et al.
Pubblicazione: (2025)
ReVSeg: Incentivizing the Reasoning Chain for Video Segmentation with Reinforcement Learning
di: Li, Yifan, et al.
Pubblicazione: (2025)
di: Li, Yifan, et al.
Pubblicazione: (2025)
MuMA: 3D PBR Texturing via Multi-Channel Multi-View Generation and Agentic Post-Processing
di: Zhu, Lingting, et al.
Pubblicazione: (2025)
di: Zhu, Lingting, et al.
Pubblicazione: (2025)
SAP: Segment Any 4K Panorama
di: Jiang, Lutao, et al.
Pubblicazione: (2026)
di: Jiang, Lutao, et al.
Pubblicazione: (2026)
MAR-3D: Progressive Masked Auto-regressor for High-Resolution 3D Generation
di: Chen, Jinnan, et al.
Pubblicazione: (2025)
di: Chen, Jinnan, et al.
Pubblicazione: (2025)
PartSAM: A Scalable Promptable Part Segmentation Model Trained on Native 3D Data
di: Zhu, Zhe, et al.
Pubblicazione: (2025)
di: Zhu, Zhe, et al.
Pubblicazione: (2025)
nnInteractive: Redefining 3D Promptable Segmentation
di: Isensee, Fabian, et al.
Pubblicazione: (2025)
di: Isensee, Fabian, et al.
Pubblicazione: (2025)
TagCLIP: Improving Discrimination Ability of Open-Vocabulary Semantic Segmentation
di: Li, Jingyao, et al.
Pubblicazione: (2023)
di: Li, Jingyao, et al.
Pubblicazione: (2023)
WildDet3D: Scaling Promptable 3D Detection in the Wild
di: Huang, Weikai, et al.
Pubblicazione: (2026)
di: Huang, Weikai, et al.
Pubblicazione: (2026)
Open-Vocabulary Semantic Part Segmentation of 3D Human
di: Suzuki, Keito, et al.
Pubblicazione: (2025)
di: Suzuki, Keito, et al.
Pubblicazione: (2025)
Opportunistic Promptable Segmentation: Leveraging Routine Radiological Annotations to Guide 3D CT Lesion Segmentation
di: Church, Samuel, et al.
Pubblicazione: (2026)
di: Church, Samuel, et al.
Pubblicazione: (2026)
Large Material Gaussian Model for Relightable 3D Generation
di: Ye, Jingrui, et al.
Pubblicazione: (2025)
di: Ye, Jingrui, et al.
Pubblicazione: (2025)
Point-SAM: Promptable 3D Segmentation Model for Point Clouds
di: Zhou, Yuchen, et al.
Pubblicazione: (2024)
di: Zhou, Yuchen, et al.
Pubblicazione: (2024)
CLIP-Guided SAM: Parameter-Efficient Semantic Conditioning for Promptable Segmentation
di: Jalilian, Shayan, et al.
Pubblicazione: (2026)
di: Jalilian, Shayan, et al.
Pubblicazione: (2026)
Skill-Evolving Grounded Reasoning for Free-Text Promptable 3D Medical Image Segmentation
di: Zhang, Tongrui, et al.
Pubblicazione: (2026)
di: Zhang, Tongrui, et al.
Pubblicazione: (2026)
GeoGuide: Hierarchical Geometric Guidance for Open-Vocabulary 3D Semantic Segmentation
di: Tao, Xujing, et al.
Pubblicazione: (2026)
di: Tao, Xujing, et al.
Pubblicazione: (2026)
SAI3D: Segment Any Instance in 3D Scenes
di: Yin, Yingda, et al.
Pubblicazione: (2023)
di: Yin, Yingda, et al.
Pubblicazione: (2023)
SurgTPGS: Semantic 3D Surgical Scene Understanding with Text Promptable Gaussian Splatting
di: Huang, Yiming, et al.
Pubblicazione: (2025)
di: Huang, Yiming, et al.
Pubblicazione: (2025)
XMask3D: Cross-modal Mask Reasoning for Open Vocabulary 3D Semantic Segmentation
di: Wang, Ziyi, et al.
Pubblicazione: (2024)
di: Wang, Ziyi, et al.
Pubblicazione: (2024)
3x2: 3D Object Part Segmentation by 2D Semantic Correspondences
di: Thai, Anh, et al.
Pubblicazione: (2024)
di: Thai, Anh, et al.
Pubblicazione: (2024)
LumiTex: Towards High-Fidelity PBR Texture Generation with Illumination Context
di: Bao, Jingzhi, et al.
Pubblicazione: (2025)
di: Bao, Jingzhi, et al.
Pubblicazione: (2025)
CUS3D :CLIP-based Unsupervised 3D Segmentation via Object-level Denoise
di: Yu, Fuyang, et al.
Pubblicazione: (2024)
di: Yu, Fuyang, et al.
Pubblicazione: (2024)
VoxTell: Free-Text Promptable Universal 3D Medical Image Segmentation
di: Rokuss, Maximilian, et al.
Pubblicazione: (2025)
di: Rokuss, Maximilian, et al.
Pubblicazione: (2025)
3D CoCa: Contrastive Learners are 3D Captioners
di: Huang, Ting, et al.
Pubblicazione: (2025)
di: Huang, Ting, et al.
Pubblicazione: (2025)
D3S2: Diffusion-Guided Dataset Distillation for Semantic Segmentation
di: Zheng, Wenjie, et al.
Pubblicazione: (2026)
di: Zheng, Wenjie, et al.
Pubblicazione: (2026)
Light-SQ: Structure-aware Shape Abstraction with Superquadrics for Generated Meshes
di: Wang, Yuhan, et al.
Pubblicazione: (2025)
di: Wang, Yuhan, et al.
Pubblicazione: (2025)
SAM2Point: Segment Any 3D as Videos in Zero-shot and Promptable Manners
di: Guo, Ziyu, et al.
Pubblicazione: (2024)
di: Guo, Ziyu, et al.
Pubblicazione: (2024)
CoCo-SAM3: Harnessing Concept Conflict in Open-Vocabulary Semantic Segmentation
di: Chen, Yanhui, et al.
Pubblicazione: (2026)
di: Chen, Yanhui, et al.
Pubblicazione: (2026)
SAM 3D Animal: Promptable Animal 3D Reconstruction from Images in the Wild
di: Hu, Xuyi, et al.
Pubblicazione: (2026)
di: Hu, Xuyi, et al.
Pubblicazione: (2026)
PGOV3D: Open-Vocabulary 3D Semantic Segmentation with Partial-to-Global Curriculum
di: Zhang, Shiqi, et al.
Pubblicazione: (2025)
di: Zhang, Shiqi, et al.
Pubblicazione: (2025)
OpenUrban3D: Annotation-Free Open-Vocabulary Semantic Segmentation of Large-Scale Urban Point Clouds
di: Wang, Chongyu, et al.
Pubblicazione: (2025)
di: Wang, Chongyu, et al.
Pubblicazione: (2025)
PDF: A Probability-Driven Framework for Open World 3D Point Cloud Semantic Segmentation
di: Xu, Jinfeng, et al.
Pubblicazione: (2024)
di: Xu, Jinfeng, et al.
Pubblicazione: (2024)
SegEarth-OV3: Exploring SAM 3 for Open-Vocabulary Semantic Segmentation in Remote Sensing Images
di: Li, Kaiyu, et al.
Pubblicazione: (2025)
di: Li, Kaiyu, et al.
Pubblicazione: (2025)
OpenTrack3D: Towards Accurate and Generalizable Open-Vocabulary 3D Instance Segmentation
di: Zhou, Zhishan, et al.
Pubblicazione: (2025)
di: Zhou, Zhishan, et al.
Pubblicazione: (2025)
3D Gaussian Splatting with Deferred Reflection
di: Ye, Keyang, et al.
Pubblicazione: (2024)
di: Ye, Keyang, et al.
Pubblicazione: (2024)
Multimodal 3D Reasoning Segmentation with Complex Scenes
di: Jiang, Xueying, et al.
Pubblicazione: (2024)
di: Jiang, Xueying, et al.
Pubblicazione: (2024)
Unifying 3D Vision-Language Understanding via Promptable Queries
di: Zhu, Ziyu, et al.
Pubblicazione: (2024)
di: Zhu, Ziyu, et al.
Pubblicazione: (2024)
Documenti analoghi
-
CoSMo: A Multimodal Transformer for Page Stream Segmentation in Comic Books
di: Ortega, Marc Serra, et al.
Pubblicazione: (2025) -
CanoVerse: 3D Object Scalable Canonicalization and Dataset for Generation and Pose
di: Jin, Li, et al.
Pubblicazione: (2026) -
CoSMo: a Framework to Instantiate Conditioned Process Simulation Models
di: Oyamada, Rafael S., et al.
Pubblicazione: (2023) -
CaliTex: Geometry-Calibrated Attention for View-Coherent 3D Texture Generation
di: Liu, Chenyu, et al.
Pubblicazione: (2025) -
ReVSeg: Incentivizing the Reasoning Chain for Video Segmentation with Reinforcement Learning
di: Li, Yifan, et al.
Pubblicazione: (2025)