PointSeg: A Training-Free Paradigm for 3D Scene Segmentation via Foundation Models
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | He, Qingdong, Peng, Jinlong, Jiang, Zhengkai, Hu, Xiaobin, Zhang, Jiangning |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
UniM-OV3D: Uni-Modality Open-Vocabulary 3D Scene Understanding with Fine-Grained Feature Representation
von: He, Qingdong, et al.
Veröffentlicht: (2024)
von: He, Qingdong, et al.
Veröffentlicht: (2024)
Open-Vocabulary SAM3D: Towards Training-free Open-Vocabulary 3D Scene Understanding
von: Tai, Hanchen, et al.
Veröffentlicht: (2024)
von: Tai, Hanchen, et al.
Veröffentlicht: (2024)
PointRWKV: Efficient RWKV-Like Model for Hierarchical Point Cloud Learning
von: He, Qingdong, et al.
Veröffentlicht: (2024)
von: He, Qingdong, et al.
Veröffentlicht: (2024)
TokenAR: Multiple Subject Generation via Autoregressive Token-level enhancement
von: Sun, Haiyue, et al.
Veröffentlicht: (2025)
von: Sun, Haiyue, et al.
Veröffentlicht: (2025)
Boosting Reasoning in Large Multimodal Models via Activation Replay
von: Xing, Yun, et al.
Veröffentlicht: (2025)
von: Xing, Yun, et al.
Veröffentlicht: (2025)
SegPoint: Segment Any Point Cloud via Large Language Model
von: He, Shuting, et al.
Veröffentlicht: (2024)
von: He, Shuting, et al.
Veröffentlicht: (2024)
FitDiT: Advancing the Authentic Garment Details for High-fidelity Virtual Try-on
von: Jiang, Boyuan, et al.
Veröffentlicht: (2024)
von: Jiang, Boyuan, et al.
Veröffentlicht: (2024)
CLEAR: Context-Aware Learning with End-to-End Mask-Free Inference for Adaptive Video Subtitle Removal
von: He, Qingdong, et al.
Veröffentlicht: (2026)
von: He, Qingdong, et al.
Veröffentlicht: (2026)
DynamicControl: Adaptive Condition Selection for Improved Text-to-Image Generation
von: He, Qingdong, et al.
Veröffentlicht: (2024)
von: He, Qingdong, et al.
Veröffentlicht: (2024)
DiffuMatting: Synthesizing Arbitrary Objects with Matting-level Annotation
von: Hu, Xiaobin, et al.
Veröffentlicht: (2024)
von: Hu, Xiaobin, et al.
Veröffentlicht: (2024)
Few-Shot Adaptation of Training-Free Foundation Model for 3D Medical Image Segmentation
von: He, Xingxin, et al.
Veröffentlicht: (2025)
von: He, Xingxin, et al.
Veröffentlicht: (2025)
FreeSeg-Diff: Training-Free Open-Vocabulary Segmentation with Diffusion Models
von: Corradini, Barbara Toniella, et al.
Veröffentlicht: (2024)
von: Corradini, Barbara Toniella, et al.
Veröffentlicht: (2024)
The devil is in the details: Enhancing Video Virtual Try-On via Keyframe-Driven Details Injection
von: He, Qingdong, et al.
Veröffentlicht: (2025)
von: He, Qingdong, et al.
Veröffentlicht: (2025)
Towards Generalized Multi-Image Editing for Unified Multimodal Models
von: Xu, Pengcheng, et al.
Veröffentlicht: (2026)
von: Xu, Pengcheng, et al.
Veröffentlicht: (2026)
SegRAG: Training-Free Retrieval-Augmented Semantic Segmentation
von: Boudiaf, Abderrahmene, et al.
Veröffentlicht: (2026)
von: Boudiaf, Abderrahmene, et al.
Veröffentlicht: (2026)
AdapNet: Adaptive Noise-Based Network for Low-Quality Image Retrieval
von: Zhang, Sihe, et al.
Veröffentlicht: (2024)
von: Zhang, Sihe, et al.
Veröffentlicht: (2024)
Learning Unified Reference Representation for Unsupervised Multi-class Anomaly Detection
von: He, Liren, et al.
Veröffentlicht: (2024)
von: He, Liren, et al.
Veröffentlicht: (2024)
SegGraph: Leveraging Graphs of SAM Segments for Few-Shot 3D Part Segmentation
von: Hu, Yueyang, et al.
Veröffentlicht: (2025)
von: Hu, Yueyang, et al.
Veröffentlicht: (2025)
ModuSeg: Decoupling Object Discovery and Semantic Retrieval for Training-Free Weakly Supervised Segmentation
von: He, Qingze, et al.
Veröffentlicht: (2026)
von: He, Qingze, et al.
Veröffentlicht: (2026)
B$^3$-Seg: Camera-Free, Training-Free 3DGS Segmentation via Analytic EIG and Beta-Bernoulli Bayesian Updates
von: Kamata, Hiromichi, et al.
Veröffentlicht: (2026)
von: Kamata, Hiromichi, et al.
Veröffentlicht: (2026)
SegTTA: Training-Free Test-Time Augmentation for Zero-Shot Medical Imaging Segmentation
von: Yao, Yihong, et al.
Veröffentlicht: (2026)
von: Yao, Yihong, et al.
Veröffentlicht: (2026)
BrainSegFounder: Towards 3D Foundation Models for Neuroimage Segmentation
von: Cox, Joseph, et al.
Veröffentlicht: (2024)
von: Cox, Joseph, et al.
Veröffentlicht: (2024)
Human-MME: A Holistic Evaluation Benchmark for Human-Centric Multimodal Large Language Models
von: Liu, Yuansen, et al.
Veröffentlicht: (2025)
von: Liu, Yuansen, et al.
Veröffentlicht: (2025)
Foundation Cures Personalization: Improving Personalized Models' Prompt Consistency via Hidden Foundation Knowledge
von: Cai, Yiyang, et al.
Veröffentlicht: (2024)
von: Cai, Yiyang, et al.
Veröffentlicht: (2024)
MureObjectStitch: Multi-reference Image Composition
von: Chen, Jiaxuan, et al.
Veröffentlicht: (2024)
von: Chen, Jiaxuan, et al.
Veröffentlicht: (2024)
CareCom: Generative Image Composition with Calibrated Reference Features
von: Chen, Jiaxuan, et al.
Veröffentlicht: (2025)
von: Chen, Jiaxuan, et al.
Veröffentlicht: (2025)
FugSeg: Fast Uncertainty-aware Ground Segmentation for 3D Point Cloud
von: Li, Yu, et al.
Veröffentlicht: (2026)
von: Li, Yu, et al.
Veröffentlicht: (2026)
PixelPonder: Dynamic Patch Adaptation for Enhanced Multi-Conditional Text-to-Image Generation
von: Pan, Yanjie, et al.
Veröffentlicht: (2025)
von: Pan, Yanjie, et al.
Veröffentlicht: (2025)
IVEBench: Modern Benchmark Suite for Instruction-Guided Video Editing Assessment
von: Chen, Yinan, et al.
Veröffentlicht: (2025)
von: Chen, Yinan, et al.
Veröffentlicht: (2025)
Spatial-Temporal Decoupled Reference Conditioning for Identity-Preserving Text-to-Video Generation
von: Chen, Yuheng, et al.
Veröffentlicht: (2026)
von: Chen, Yuheng, et al.
Veröffentlicht: (2026)
SegFly: A 2D-3D-2D Paradigm for Aerial RGB-Thermal Semantic Segmentation at Scale
von: Gross, Markus, et al.
Veröffentlicht: (2026)
von: Gross, Markus, et al.
Veröffentlicht: (2026)
GeoSeg: Training-Free Reasoning-Driven Segmentation in Remote Sensing Imagery
von: Jiang, Lifan, et al.
Veröffentlicht: (2026)
von: Jiang, Lifan, et al.
Veröffentlicht: (2026)
UniGeoSeg: Towards Unified Open-World Segmentation for Geospatial Scenes
von: Ni, Shuo, et al.
Veröffentlicht: (2025)
von: Ni, Shuo, et al.
Veröffentlicht: (2025)
Training-Free Out-Of-Distribution Segmentation With Foundation Models
von: Nayal, Laith, et al.
Veröffentlicht: (2025)
von: Nayal, Laith, et al.
Veröffentlicht: (2025)
Towards Training-free Open-world Segmentation via Image Prompt Foundation Models
von: Tang, Lv, et al.
Veröffentlicht: (2023)
von: Tang, Lv, et al.
Veröffentlicht: (2023)
CitySeg: A 3D Open Vocabulary Semantic Segmentation Foundation Model in City-scale Scenarios
von: Xu, Jialei, et al.
Veröffentlicht: (2025)
von: Xu, Jialei, et al.
Veröffentlicht: (2025)
P2Seg: Pointly-supervised Segmentation via Mutual Distillation
von: Wang, Zipeng, et al.
Veröffentlicht: (2024)
von: Wang, Zipeng, et al.
Veröffentlicht: (2024)
SCL: Towards Domain Generalization via Single-Temporal Multimodal Contrastive Learning for Remote Sensing Change Detection
von: Du, Qiangang, et al.
Veröffentlicht: (2024)
von: Du, Qiangang, et al.
Veröffentlicht: (2024)
RSRefSeg: Referring Remote Sensing Image Segmentation with Foundation Models
von: Chen, Keyan, et al.
Veröffentlicht: (2025)
von: Chen, Keyan, et al.
Veröffentlicht: (2025)
FrozenSeg: Harmonizing Frozen Foundation Models for Open-Vocabulary Segmentation
von: Chen, Xi, et al.
Veröffentlicht: (2024)
von: Chen, Xi, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
UniM-OV3D: Uni-Modality Open-Vocabulary 3D Scene Understanding with Fine-Grained Feature Representation
von: He, Qingdong, et al.
Veröffentlicht: (2024) -
Open-Vocabulary SAM3D: Towards Training-free Open-Vocabulary 3D Scene Understanding
von: Tai, Hanchen, et al.
Veröffentlicht: (2024) -
PointRWKV: Efficient RWKV-Like Model for Hierarchical Point Cloud Learning
von: He, Qingdong, et al.
Veröffentlicht: (2024) -
TokenAR: Multiple Subject Generation via Autoregressive Token-level enhancement
von: Sun, Haiyue, et al.
Veröffentlicht: (2025) -
Boosting Reasoning in Large Multimodal Models via Activation Replay
von: Xing, Yun, et al.
Veröffentlicht: (2025)