3D Part Segmentation via Geometric Aggregation of 2D Visual Features
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Garosi, Marco, Tedoldi, Riccardo, Boscaini, Davide, Mancini, Massimiliano, Sebe, Nicu, Poiesi, Fabio |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Accurate and efficient zero-shot 6D pose estimation with frozen foundation models
par: Caraffa, Andrea, et autres
Publié: (2025)
par: Caraffa, Andrea, et autres
Publié: (2025)
Distilling 3D distinctive local descriptors for 6D pose estimation
par: Hamza, Amir, et autres
Publié: (2025)
par: Hamza, Amir, et autres
Publié: (2025)
Cross-Modal and Uncertainty-Aware Agglomeration for Open-Vocabulary 3D Scene Understanding
par: Li, Jinlong, et autres
Publié: (2025)
par: Li, Jinlong, et autres
Publié: (2025)
Functionality understanding and segmentation in 3D scenes
par: Corsetti, Jaime, et autres
Publié: (2024)
par: Corsetti, Jaime, et autres
Publié: (2024)
FreeZe: Training-free zero-shot 6D pose estimation with geometric and vision foundation models
par: Caraffa, Andrea, et autres
Publié: (2023)
par: Caraffa, Andrea, et autres
Publié: (2023)
Generative 6D Pose Estimation via Conditional Flow Matching
par: Hamza, Amir, et autres
Publié: (2026)
par: Hamza, Amir, et autres
Publié: (2026)
Leveraging Confident Image Regions for Source-Free Domain-Adaptive Object Detection
par: Mekhalfi, Mohamed Lamine, et autres
Publié: (2025)
par: Mekhalfi, Mohamed Lamine, et autres
Publié: (2025)
Open-vocabulary object 6D pose estimation
par: Corsetti, Jaime, et autres
Publié: (2023)
par: Corsetti, Jaime, et autres
Publié: (2023)
Fully-Geometric Cross-Attention for Point Cloud Registration
par: Wang, Weijie, et autres
Publié: (2025)
par: Wang, Weijie, et autres
Publié: (2025)
High-resolution open-vocabulary object 6D pose estimation
par: Corsetti, Jaime, et autres
Publié: (2024)
par: Corsetti, Jaime, et autres
Publié: (2024)
Geometrically-driven Aggregation for Zero-shot 3D Point Cloud Understanding
par: Mei, Guofeng, et autres
Publié: (2023)
par: Mei, Guofeng, et autres
Publié: (2023)
Action-guided generation of 3D functionality segmentation data
par: Corsetti, Jaime, et autres
Publié: (2025)
par: Corsetti, Jaime, et autres
Publié: (2025)
AI-driven visual monitoring of industrial assembly tasks
par: Nardon, Mattia, et autres
Publié: (2025)
par: Nardon, Mattia, et autres
Publié: (2025)
Large Multimodal Models as General In-Context Classifiers
par: Garosi, Marco, et autres
Publié: (2026)
par: Garosi, Marco, et autres
Publié: (2026)
Compositional Caching for Training-free Open-vocabulary Attribute Detection
par: Garosi, Marco, et autres
Publié: (2025)
par: Garosi, Marco, et autres
Publié: (2025)
Cues3D: Unleashing the Power of Sole NeRF for Consistent and Unique Instances in Open-Vocabulary 3D Panoptic Segmentation
par: Xue, Feng, et autres
Publié: (2025)
par: Xue, Feng, et autres
Publié: (2025)
Self-Supervised and Generalizable Tokenization for CLIP-Based 3D Understanding
par: Mei, Guofeng, et autres
Publié: (2025)
par: Mei, Guofeng, et autres
Publié: (2025)
Masked Clustering Prediction for Unsupervised Point Cloud Pre-training
par: Ren, Bin, et autres
Publié: (2025)
par: Ren, Bin, et autres
Publié: (2025)
Revisiting Fully Convolutional Geometric Features for Object 6D Pose Estimation
par: Jaime Corsetti Davide Boscaini Fabio Poiesi
Publié: (2026)
par: Jaime Corsetti Davide Boscaini Fabio Poiesi
Publié: (2026)
Safe Vision-Language Models via Unsafe Weights Manipulation
par: D'Incà, Moreno, et autres
Publié: (2025)
par: D'Incà, Moreno, et autres
Publié: (2025)
GradBias: Unveiling Word Influence on Bias in Text-to-Image Generative Models
par: D'Incà, Moreno, et autres
Publié: (2024)
par: D'Incà, Moreno, et autres
Publié: (2024)
3D Weakly Supervised Semantic Segmentation with 2D Vision-Language Guidance
par: Xu, Xiaoxu, et autres
Publié: (2024)
par: Xu, Xiaoxu, et autres
Publié: (2024)
Vocabulary-Free 3D Instance Segmentation with Vision and Language Assistant
par: Mei, Guofeng, et autres
Publié: (2024)
par: Mei, Guofeng, et autres
Publié: (2024)
LESS: Label-Efficient and Single-Stage Referring 3D Segmentation
par: Liu, Xuexun, et autres
Publié: (2024)
par: Liu, Xuexun, et autres
Publié: (2024)
ZeroReg: Zero-Shot Point Cloud Registration with Foundation Models
par: Wang, Weijie, et autres
Publié: (2023)
par: Wang, Weijie, et autres
Publié: (2023)
Exploring Fine-grained Retail Product Discrimination with Zero-shot Object Classification Using Vision-Language Models
par: Tur, Anil Osman, et autres
Publié: (2024)
par: Tur, Anil Osman, et autres
Publié: (2024)
High-Fidelity 3D Facial Avatar Synthesis with Controllable Fine-Grained Expressions
par: He, Yikang, et autres
Publié: (2026)
par: He, Yikang, et autres
Publié: (2026)
RankFeat&RankWeight: Rank-1 Feature/Weight Removal for Out-of-distribution Detection
par: Song, Yue, et autres
Publié: (2023)
par: Song, Yue, et autres
Publié: (2023)
3D Weakly Supervised Semantic Segmentation via Class-Aware and Geometry-Guided Pseudo-Label Refinement
par: Xu, Xiaoxu, et autres
Publié: (2025)
par: Xu, Xiaoxu, et autres
Publié: (2025)
CHIP: A multi-sensor dataset for 6D pose estimation of chairs in industrial settings
par: Nardon, Mattia, et autres
Publié: (2025)
par: Nardon, Mattia, et autres
Publié: (2025)
AlignCAT: Visual-Linguistic Alignment of Category and Attribute for Weakly Supervised Visual Grounding
par: Wang, Yidan, et autres
Publié: (2025)
par: Wang, Yidan, et autres
Publié: (2025)
Novel class discovery meets foundation models for 3D semantic segmentation
par: Riz, Luigi, et autres
Publié: (2023)
par: Riz, Luigi, et autres
Publié: (2023)
CLIP is Strong Enough to Fight Back: Test-time Counterattacks towards Zero-shot Adversarial Robustness of CLIP
par: Xing, Songlong, et autres
Publié: (2025)
par: Xing, Songlong, et autres
Publié: (2025)
FreeInsert: Disentangled Text-Guided Object Insertion in 3D Gaussian Scene without Spatial Priors
par: Li, Chenxi, et autres
Publié: (2025)
par: Li, Chenxi, et autres
Publié: (2025)
Hierarchical Visual Prompt Learning for Continual Video Instance Segmentation
par: Dong, Jiahua, et autres
Publié: (2025)
par: Dong, Jiahua, et autres
Publié: (2025)
PoInit-of-View: Poisoning Initialization of Views Transfers Across Multiple 3D Reconstruction Systems
par: Wang, Weijie, et autres
Publié: (2026)
par: Wang, Weijie, et autres
Publié: (2026)
Orthogonal Projection Subspace to Aggregate Online Prior-knowledge for Continual Test-time Adaptation
par: Li, Jinlong, et autres
Publié: (2025)
par: Li, Jinlong, et autres
Publié: (2025)
6DGS: 6D Pose Estimation from a Single Image and a 3D Gaussian Splatting Model
par: Bortolon, Matteo, et autres
Publié: (2024)
par: Bortolon, Matteo, et autres
Publié: (2024)
3D Face Reconstruction with the Geometric Guidance of Facial Part Segmentation
par: Wang, Zidu, et autres
Publié: (2023)
par: Wang, Zidu, et autres
Publié: (2023)
Token Reduction via Local and Global Contexts Optimization for Efficient Video Large Language Models
par: Li, Jinlong, et autres
Publié: (2026)
par: Li, Jinlong, et autres
Publié: (2026)
Documents similaires
-
Accurate and efficient zero-shot 6D pose estimation with frozen foundation models
par: Caraffa, Andrea, et autres
Publié: (2025) -
Distilling 3D distinctive local descriptors for 6D pose estimation
par: Hamza, Amir, et autres
Publié: (2025) -
Cross-Modal and Uncertainty-Aware Agglomeration for Open-Vocabulary 3D Scene Understanding
par: Li, Jinlong, et autres
Publié: (2025) -
Functionality understanding and segmentation in 3D scenes
par: Corsetti, Jaime, et autres
Publié: (2024) -
FreeZe: Training-free zero-shot 6D pose estimation with geometric and vision foundation models
par: Caraffa, Andrea, et autres
Publié: (2023)