CoSMo3D: Open-World Promptable 3D Semantic Part Segmentation through LLM-Guided Canonical Spatial Modeling
Fuente:
arXiv
Guardado en:
| Autores principales: | Jin, Li, Chen, Weikai, Wang, Yujie, Yin, Yingda, Hu, Zeyu, Zhang, Runze, Luo, Keyang, Qian, Shengju, Wang, Xin, Qin, Xueying |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
CoSMo: A Multimodal Transformer for Page Stream Segmentation in Comic Books
por: Ortega, Marc Serra, et al.
Publicado: (2025)
por: Ortega, Marc Serra, et al.
Publicado: (2025)
CanoVerse: 3D Object Scalable Canonicalization and Dataset for Generation and Pose
por: Jin, Li, et al.
Publicado: (2026)
por: Jin, Li, et al.
Publicado: (2026)
CoSMo: a Framework to Instantiate Conditioned Process Simulation Models
por: Oyamada, Rafael S., et al.
Publicado: (2023)
por: Oyamada, Rafael S., et al.
Publicado: (2023)
CaliTex: Geometry-Calibrated Attention for View-Coherent 3D Texture Generation
por: Liu, Chenyu, et al.
Publicado: (2025)
por: Liu, Chenyu, et al.
Publicado: (2025)
ReVSeg: Incentivizing the Reasoning Chain for Video Segmentation with Reinforcement Learning
por: Li, Yifan, et al.
Publicado: (2025)
por: Li, Yifan, et al.
Publicado: (2025)
MuMA: 3D PBR Texturing via Multi-Channel Multi-View Generation and Agentic Post-Processing
por: Zhu, Lingting, et al.
Publicado: (2025)
por: Zhu, Lingting, et al.
Publicado: (2025)
SAP: Segment Any 4K Panorama
por: Jiang, Lutao, et al.
Publicado: (2026)
por: Jiang, Lutao, et al.
Publicado: (2026)
MAR-3D: Progressive Masked Auto-regressor for High-Resolution 3D Generation
por: Chen, Jinnan, et al.
Publicado: (2025)
por: Chen, Jinnan, et al.
Publicado: (2025)
PartSAM: A Scalable Promptable Part Segmentation Model Trained on Native 3D Data
por: Zhu, Zhe, et al.
Publicado: (2025)
por: Zhu, Zhe, et al.
Publicado: (2025)
nnInteractive: Redefining 3D Promptable Segmentation
por: Isensee, Fabian, et al.
Publicado: (2025)
por: Isensee, Fabian, et al.
Publicado: (2025)
TagCLIP: Improving Discrimination Ability of Open-Vocabulary Semantic Segmentation
por: Li, Jingyao, et al.
Publicado: (2023)
por: Li, Jingyao, et al.
Publicado: (2023)
WildDet3D: Scaling Promptable 3D Detection in the Wild
por: Huang, Weikai, et al.
Publicado: (2026)
por: Huang, Weikai, et al.
Publicado: (2026)
Open-Vocabulary Semantic Part Segmentation of 3D Human
por: Suzuki, Keito, et al.
Publicado: (2025)
por: Suzuki, Keito, et al.
Publicado: (2025)
Opportunistic Promptable Segmentation: Leveraging Routine Radiological Annotations to Guide 3D CT Lesion Segmentation
por: Church, Samuel, et al.
Publicado: (2026)
por: Church, Samuel, et al.
Publicado: (2026)
Large Material Gaussian Model for Relightable 3D Generation
por: Ye, Jingrui, et al.
Publicado: (2025)
por: Ye, Jingrui, et al.
Publicado: (2025)
Point-SAM: Promptable 3D Segmentation Model for Point Clouds
por: Zhou, Yuchen, et al.
Publicado: (2024)
por: Zhou, Yuchen, et al.
Publicado: (2024)
CLIP-Guided SAM: Parameter-Efficient Semantic Conditioning for Promptable Segmentation
por: Jalilian, Shayan, et al.
Publicado: (2026)
por: Jalilian, Shayan, et al.
Publicado: (2026)
Skill-Evolving Grounded Reasoning for Free-Text Promptable 3D Medical Image Segmentation
por: Zhang, Tongrui, et al.
Publicado: (2026)
por: Zhang, Tongrui, et al.
Publicado: (2026)
GeoGuide: Hierarchical Geometric Guidance for Open-Vocabulary 3D Semantic Segmentation
por: Tao, Xujing, et al.
Publicado: (2026)
por: Tao, Xujing, et al.
Publicado: (2026)
SAI3D: Segment Any Instance in 3D Scenes
por: Yin, Yingda, et al.
Publicado: (2023)
por: Yin, Yingda, et al.
Publicado: (2023)
SurgTPGS: Semantic 3D Surgical Scene Understanding with Text Promptable Gaussian Splatting
por: Huang, Yiming, et al.
Publicado: (2025)
por: Huang, Yiming, et al.
Publicado: (2025)
XMask3D: Cross-modal Mask Reasoning for Open Vocabulary 3D Semantic Segmentation
por: Wang, Ziyi, et al.
Publicado: (2024)
por: Wang, Ziyi, et al.
Publicado: (2024)
3x2: 3D Object Part Segmentation by 2D Semantic Correspondences
por: Thai, Anh, et al.
Publicado: (2024)
por: Thai, Anh, et al.
Publicado: (2024)
LumiTex: Towards High-Fidelity PBR Texture Generation with Illumination Context
por: Bao, Jingzhi, et al.
Publicado: (2025)
por: Bao, Jingzhi, et al.
Publicado: (2025)
CUS3D :CLIP-based Unsupervised 3D Segmentation via Object-level Denoise
por: Yu, Fuyang, et al.
Publicado: (2024)
por: Yu, Fuyang, et al.
Publicado: (2024)
VoxTell: Free-Text Promptable Universal 3D Medical Image Segmentation
por: Rokuss, Maximilian, et al.
Publicado: (2025)
por: Rokuss, Maximilian, et al.
Publicado: (2025)
3D CoCa: Contrastive Learners are 3D Captioners
por: Huang, Ting, et al.
Publicado: (2025)
por: Huang, Ting, et al.
Publicado: (2025)
D3S2: Diffusion-Guided Dataset Distillation for Semantic Segmentation
por: Zheng, Wenjie, et al.
Publicado: (2026)
por: Zheng, Wenjie, et al.
Publicado: (2026)
Light-SQ: Structure-aware Shape Abstraction with Superquadrics for Generated Meshes
por: Wang, Yuhan, et al.
Publicado: (2025)
por: Wang, Yuhan, et al.
Publicado: (2025)
SAM2Point: Segment Any 3D as Videos in Zero-shot and Promptable Manners
por: Guo, Ziyu, et al.
Publicado: (2024)
por: Guo, Ziyu, et al.
Publicado: (2024)
CoCo-SAM3: Harnessing Concept Conflict in Open-Vocabulary Semantic Segmentation
por: Chen, Yanhui, et al.
Publicado: (2026)
por: Chen, Yanhui, et al.
Publicado: (2026)
SAM 3D Animal: Promptable Animal 3D Reconstruction from Images in the Wild
por: Hu, Xuyi, et al.
Publicado: (2026)
por: Hu, Xuyi, et al.
Publicado: (2026)
PGOV3D: Open-Vocabulary 3D Semantic Segmentation with Partial-to-Global Curriculum
por: Zhang, Shiqi, et al.
Publicado: (2025)
por: Zhang, Shiqi, et al.
Publicado: (2025)
OpenUrban3D: Annotation-Free Open-Vocabulary Semantic Segmentation of Large-Scale Urban Point Clouds
por: Wang, Chongyu, et al.
Publicado: (2025)
por: Wang, Chongyu, et al.
Publicado: (2025)
PDF: A Probability-Driven Framework for Open World 3D Point Cloud Semantic Segmentation
por: Xu, Jinfeng, et al.
Publicado: (2024)
por: Xu, Jinfeng, et al.
Publicado: (2024)
SegEarth-OV3: Exploring SAM 3 for Open-Vocabulary Semantic Segmentation in Remote Sensing Images
por: Li, Kaiyu, et al.
Publicado: (2025)
por: Li, Kaiyu, et al.
Publicado: (2025)
OpenTrack3D: Towards Accurate and Generalizable Open-Vocabulary 3D Instance Segmentation
por: Zhou, Zhishan, et al.
Publicado: (2025)
por: Zhou, Zhishan, et al.
Publicado: (2025)
3D Gaussian Splatting with Deferred Reflection
por: Ye, Keyang, et al.
Publicado: (2024)
por: Ye, Keyang, et al.
Publicado: (2024)
Multimodal 3D Reasoning Segmentation with Complex Scenes
por: Jiang, Xueying, et al.
Publicado: (2024)
por: Jiang, Xueying, et al.
Publicado: (2024)
Unifying 3D Vision-Language Understanding via Promptable Queries
por: Zhu, Ziyu, et al.
Publicado: (2024)
por: Zhu, Ziyu, et al.
Publicado: (2024)
Ejemplares similares
-
CoSMo: A Multimodal Transformer for Page Stream Segmentation in Comic Books
por: Ortega, Marc Serra, et al.
Publicado: (2025) -
CanoVerse: 3D Object Scalable Canonicalization and Dataset for Generation and Pose
por: Jin, Li, et al.
Publicado: (2026) -
CoSMo: a Framework to Instantiate Conditioned Process Simulation Models
por: Oyamada, Rafael S., et al.
Publicado: (2023) -
CaliTex: Geometry-Calibrated Attention for View-Coherent 3D Texture Generation
por: Liu, Chenyu, et al.
Publicado: (2025) -
ReVSeg: Incentivizing the Reasoning Chain for Video Segmentation with Reinforcement Learning
por: Li, Yifan, et al.
Publicado: (2025)