OnlineAnySeg: Online Zero-Shot 3D Segmentation by Visual Foundation Model Guided 2D Mask Merging
Fuente:
arXiv
Salvato in:
| Autori principali: | Tang, Yijie, Zhang, Jiazhao, Lan, Yuqing, Guo, Yulan, Dong, Dezun, Zhu, Chenyang, Xu, Kai |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
RemixFusion: Residual-based Mixed Representation for Large-scale Online RGB-D Reconstruction
di: Lan, Yuqing, et al.
Pubblicazione: (2025)
di: Lan, Yuqing, et al.
Pubblicazione: (2025)
MoonSeg3R: Monocular Online Zero-Shot Segment Anything in 3D with Reconstructive Foundation Priors
di: Du, Zhipeng, et al.
Pubblicazione: (2025)
di: Du, Zhipeng, et al.
Pubblicazione: (2025)
BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion
di: Lan, Yuqing, et al.
Pubblicazione: (2025)
di: Lan, Yuqing, et al.
Pubblicazione: (2025)
BoxFusion: Reconstruction‐Free Open‐Vocabulary 3D Object Detection via Real‐Time Multi‐View Box Fusion
di: Yuqing Lan, et al.
Pubblicazione: (2025)
di: Yuqing Lan, et al.
Pubblicazione: (2025)
MaskClustering: View Consensus based Mask Graph Clustering for Open-Vocabulary 3D Instance Segmentation
di: Yan, Mi, et al.
Pubblicazione: (2024)
di: Yan, Mi, et al.
Pubblicazione: (2024)
MonoMobility: Zero-Shot 3D Mobility Analysis from Monocular Videos
di: Zhou, Hongyi, et al.
Pubblicazione: (2025)
di: Zhou, Hongyi, et al.
Pubblicazione: (2025)
Online Segment Any 3D Thing as Instance Tracking
di: Wang, Hanshi, et al.
Pubblicazione: (2025)
di: Wang, Hanshi, et al.
Pubblicazione: (2025)
Pathological Primitive Segmentation Based on Visual Foundation Model with Zero-Shot Mask Generation
di: Arnob, Abu Bakor Hayat, et al.
Pubblicazione: (2024)
di: Arnob, Abu Bakor Hayat, et al.
Pubblicazione: (2024)
WildSeg3D: Segment Any 3D Objects in the Wild from 2D Images
di: Guo, Yansong, et al.
Pubblicazione: (2025)
di: Guo, Yansong, et al.
Pubblicazione: (2025)
ReplicateAnyScene: Zero-Shot Video-to-3D Composition via Textual-Visual-Spatial Alignment
di: Dong, Mingyu, et al.
Pubblicazione: (2026)
di: Dong, Mingyu, et al.
Pubblicazione: (2026)
SAGOnline: Segment Any Gaussians Online
di: Sun, Wentao, et al.
Pubblicazione: (2025)
di: Sun, Wentao, et al.
Pubblicazione: (2025)
EmbodiedSAM: Online Segment Any 3D Thing in Real Time
di: Xu, Xiuwei, et al.
Pubblicazione: (2024)
di: Xu, Xiuwei, et al.
Pubblicazione: (2024)
Text2Seg: Remote Sensing Image Semantic Segmentation via Text-Guided Visual Foundation Models
di: Zhang, Jielu, et al.
Pubblicazione: (2023)
di: Zhang, Jielu, et al.
Pubblicazione: (2023)
SegGrasp: Zero-Shot Task-Oriented Grasping via Semantic and Geometric Guided Segmentation
di: Li, Haosheng, et al.
Pubblicazione: (2024)
di: Li, Haosheng, et al.
Pubblicazione: (2024)
MV3DIS: Multi-View Mask Matching via 3D Guides for Zero-Shot 3D Instance Segmentation
di: Zhao, Yibo, et al.
Pubblicazione: (2026)
di: Zhao, Yibo, et al.
Pubblicazione: (2026)
RSRefSeg: Referring Remote Sensing Image Segmentation with Foundation Models
di: Chen, Keyan, et al.
Pubblicazione: (2025)
di: Chen, Keyan, et al.
Pubblicazione: (2025)
Seg2Any: Open-set Segmentation-Mask-to-Image Generation with Precise Shape and Semantic Control
di: Li, Danfeng, et al.
Pubblicazione: (2025)
di: Li, Danfeng, et al.
Pubblicazione: (2025)
ARM3D: Attention-based relation module for indoor 3D object detection
di: Lan, Yuqing, et al.
Pubblicazione: (2022)
di: Lan, Yuqing, et al.
Pubblicazione: (2022)
SAM2Point: Segment Any 3D as Videos in Zero-shot and Promptable Manners
di: Guo, Ziyu, et al.
Pubblicazione: (2024)
di: Guo, Ziyu, et al.
Pubblicazione: (2024)
Online Zero-Shot Classification with CLIP
di: Qian, Qi, et al.
Pubblicazione: (2024)
di: Qian, Qi, et al.
Pubblicazione: (2024)
SegGraph: Leveraging Graphs of SAM Segments for Few-Shot 3D Part Segmentation
di: Hu, Yueyang, et al.
Pubblicazione: (2025)
di: Hu, Yueyang, et al.
Pubblicazione: (2025)
Lift3D: Zero-Shot Lifting of Any 2D Vision Model to 3D
di: T, Mukund Varma, et al.
Pubblicazione: (2024)
di: T, Mukund Varma, et al.
Pubblicazione: (2024)
Model Merging Improves Zero-Shot Generalization in Bioacoustic Foundation Models
di: Marincione, Davide, et al.
Pubblicazione: (2025)
di: Marincione, Davide, et al.
Pubblicazione: (2025)
BrainSegFounder: Towards 3D Foundation Models for Neuroimage Segmentation
di: Cox, Joseph, et al.
Pubblicazione: (2024)
di: Cox, Joseph, et al.
Pubblicazione: (2024)
RSRefSeg 2: Decoupling Referring Remote Sensing Image Segmentation with Foundation Models
di: Chen, Keyan, et al.
Pubblicazione: (2025)
di: Chen, Keyan, et al.
Pubblicazione: (2025)
Segment Any RGB-Thermal Model with Language-aided Distillation
di: Xing, Dong, et al.
Pubblicazione: (2025)
di: Xing, Dong, et al.
Pubblicazione: (2025)
Merging Context Clustering with Visual State Space Models for Medical Image Segmentation
di: Zhu, Yun, et al.
Pubblicazione: (2025)
di: Zhu, Yun, et al.
Pubblicazione: (2025)
Any3DIS: Class-Agnostic 3D Instance Segmentation by 2D Mask Tracking
di: Nguyen, Phuc, et al.
Pubblicazione: (2024)
di: Nguyen, Phuc, et al.
Pubblicazione: (2024)
Depth Any Camera: Zero-Shot Metric Depth Estimation from Any Camera
di: Guo, Yuliang, et al.
Pubblicazione: (2025)
di: Guo, Yuliang, et al.
Pubblicazione: (2025)
TokenSeg: Efficient 3D Medical Image Segmentation via Hierarchical Visual Token Compression
di: Zeng, Sen, et al.
Pubblicazione: (2026)
di: Zeng, Sen, et al.
Pubblicazione: (2026)
TerraSeg: Self-Supervised Ground Segmentation for Any LiDAR
di: Lentsch, Ted, et al.
Pubblicazione: (2026)
di: Lentsch, Ted, et al.
Pubblicazione: (2026)
SegTTA: Training-Free Test-Time Augmentation for Zero-Shot Medical Imaging Segmentation
di: Yao, Yihong, et al.
Pubblicazione: (2026)
di: Yao, Yihong, et al.
Pubblicazione: (2026)
Zero-Shot 4D Lidar Panoptic Segmentation
di: Zhang, Yushan, et al.
Pubblicazione: (2025)
di: Zhang, Yushan, et al.
Pubblicazione: (2025)
MGMap: Mask-Guided Learning for Online Vectorized HD Map Construction
di: Liu, Xiaolu, et al.
Pubblicazione: (2024)
di: Liu, Xiaolu, et al.
Pubblicazione: (2024)
Boosting Zero-Shot 3D Style Transfer with 2D Pre-trained Priors
di: Dong, Xin, et al.
Pubblicazione: (2026)
di: Dong, Xin, et al.
Pubblicazione: (2026)
Language-Driven Visual Consensus for Zero-Shot Semantic Segmentation
di: Zhang, Zicheng, et al.
Pubblicazione: (2024)
di: Zhang, Zicheng, et al.
Pubblicazione: (2024)
F2M-Reg: Unsupervised RGB-D Point Cloud Registration with Frame-to-Model Optimization
di: Yu, Zhinan, et al.
Pubblicazione: (2024)
di: Yu, Zhinan, et al.
Pubblicazione: (2024)
GradiSeg: Gradient-Guided Gaussian Segmentation with Enhanced 3D Boundary Precision
di: Li, Zehao, et al.
Pubblicazione: (2024)
di: Li, Zehao, et al.
Pubblicazione: (2024)
Progressive Confident Masking Attention Network for Audio-Visual Segmentation
di: Wang, Yuxuan, et al.
Pubblicazione: (2024)
di: Wang, Yuxuan, et al.
Pubblicazione: (2024)
MedSegFactory: Text-Guided Generation of Medical Image-Mask Pairs
di: Mao, Jiawei, et al.
Pubblicazione: (2025)
di: Mao, Jiawei, et al.
Pubblicazione: (2025)
Documenti analoghi
-
RemixFusion: Residual-based Mixed Representation for Large-scale Online RGB-D Reconstruction
di: Lan, Yuqing, et al.
Pubblicazione: (2025) -
MoonSeg3R: Monocular Online Zero-Shot Segment Anything in 3D with Reconstructive Foundation Priors
di: Du, Zhipeng, et al.
Pubblicazione: (2025) -
BoxFusion: Reconstruction-Free Open-Vocabulary 3D Object Detection via Real-Time Multi-View Box Fusion
di: Lan, Yuqing, et al.
Pubblicazione: (2025) -
BoxFusion: Reconstruction‐Free Open‐Vocabulary 3D Object Detection via Real‐Time Multi‐View Box Fusion
di: Yuqing Lan, et al.
Pubblicazione: (2025) -
MaskClustering: View Consensus based Mask Graph Clustering for Open-Vocabulary 3D Instance Segmentation
di: Yan, Mi, et al.
Pubblicazione: (2024)