High-resolution open-vocabulary object 6D pose estimation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Corsetti, Jaime, Boscaini, Davide, Giuliari, Francesco, Oh, Changjae, Cavallaro, Andrea, Poiesi, Fabio |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Open-vocabulary object 6D pose estimation
par: Corsetti, Jaime, et autres
Publié: (2023)
par: Corsetti, Jaime, et autres
Publié: (2023)
Functionality understanding and segmentation in 3D scenes
par: Corsetti, Jaime, et autres
Publié: (2024)
par: Corsetti, Jaime, et autres
Publié: (2024)
Accurate and efficient zero-shot 6D pose estimation with frozen foundation models
par: Caraffa, Andrea, et autres
Publié: (2025)
par: Caraffa, Andrea, et autres
Publié: (2025)
Distilling 3D distinctive local descriptors for 6D pose estimation
par: Hamza, Amir, et autres
Publié: (2025)
par: Hamza, Amir, et autres
Publié: (2025)
FreeZe: Training-free zero-shot 6D pose estimation with geometric and vision foundation models
par: Caraffa, Andrea, et autres
Publié: (2023)
par: Caraffa, Andrea, et autres
Publié: (2023)
Action-guided generation of 3D functionality segmentation data
par: Corsetti, Jaime, et autres
Publié: (2025)
par: Corsetti, Jaime, et autres
Publié: (2025)
FlowOVD: Learning Generative Latent Flows for Zero-shot Open-vocabulary Detection
par: Wei, Yao, et autres
Publié: (2026)
par: Wei, Yao, et autres
Publié: (2026)
Generative 6D Pose Estimation via Conditional Flow Matching
par: Hamza, Amir, et autres
Publié: (2026)
par: Hamza, Amir, et autres
Publié: (2026)
Leveraging Confident Image Regions for Source-Free Domain-Adaptive Object Detection
par: Mekhalfi, Mohamed Lamine, et autres
Publié: (2025)
par: Mekhalfi, Mohamed Lamine, et autres
Publié: (2025)
CHIP: A multi-sensor dataset for 6D pose estimation of chairs in industrial settings
par: Nardon, Mattia, et autres
Publié: (2025)
par: Nardon, Mattia, et autres
Publié: (2025)
Sparse multi-view hand-object reconstruction for unseen environments
par: Pang, Yik Lung, et autres
Publié: (2024)
par: Pang, Yik Lung, et autres
Publié: (2024)
3D Part Segmentation via Geometric Aggregation of 2D Visual Features
par: Garosi, Marco, et autres
Publié: (2024)
par: Garosi, Marco, et autres
Publié: (2024)
An analysis of vision-language models for fabric retrieval
par: Giuliari, Francesco, et autres
Publié: (2025)
par: Giuliari, Francesco, et autres
Publié: (2025)
Learning human-to-robot handovers through 3D scene reconstruction
par: Wu, Yuekun, et autres
Publié: (2025)
par: Wu, Yuekun, et autres
Publié: (2025)
Improving Generalization of Language-Conditioned Robot Manipulation
par: Cui, Chenglin, et autres
Publié: (2025)
par: Cui, Chenglin, et autres
Publié: (2025)
Revisiting Fully Convolutional Geometric Features for Object 6D Pose Estimation
par: Jaime Corsetti Davide Boscaini Fabio Poiesi
Publié: (2026)
par: Jaime Corsetti Davide Boscaini Fabio Poiesi
Publié: (2026)
AI-driven visual monitoring of industrial assembly tasks
par: Nardon, Mattia, et autres
Publié: (2025)
par: Nardon, Mattia, et autres
Publié: (2025)
Toward Human-Robot Teaming: Learning Handover Behaviors from 3D Scenes
par: Wu, Yuekun, et autres
Publié: (2025)
par: Wu, Yuekun, et autres
Publié: (2025)
Stereo Hand-Object Reconstruction for Human-to-Robot Handover
par: Pang, Yik Lung, et autres
Publié: (2024)
par: Pang, Yik Lung, et autres
Publié: (2024)
IFFNeRF: Initialisation Free and Fast 6DoF pose estimation from a single image and a NeRF model
par: Bortolon, Matteo, et autres
Publié: (2024)
par: Bortolon, Matteo, et autres
Publié: (2024)
Exploring Fine-grained Retail Product Discrimination with Zero-shot Object Classification Using Vision-Language Models
par: Tur, Anil Osman, et autres
Publié: (2024)
par: Tur, Anil Osman, et autres
Publié: (2024)
The Detector Teaches Itself: Lightweight Self-Supervised Adaptation for Open-Vocabulary Object Detection
par: Wan, Yazhe, et autres
Publié: (2026)
par: Wan, Yazhe, et autres
Publié: (2026)
Chain-of-Caption: Training-free improvement of multimodal large language model on referring expression comprehension
par: Pang, Yik Lung, et autres
Publié: (2026)
par: Pang, Yik Lung, et autres
Publié: (2026)
Free-form language-based robotic reasoning and grasping
par: Jiao, Runyu, et autres
Publié: (2025)
par: Jiao, Runyu, et autres
Publié: (2025)
Obstruction reasoning for robotic grasping
par: Jiao, Runyu, et autres
Publié: (2025)
par: Jiao, Runyu, et autres
Publié: (2025)
6DGS: 6D Pose Estimation from a Single Image and a 3D Gaussian Splatting Model
par: Bortolon, Matteo, et autres
Publié: (2024)
par: Bortolon, Matteo, et autres
Publié: (2024)
Improving Image De-raining Using Reference-Guided Transformers
par: Ye, Zihao, et autres
Publié: (2024)
par: Ye, Zihao, et autres
Publié: (2024)
DiffAssemble: A Unified Graph-Diffusion Model for 2D and 3D Reassembly
par: Scarpellini, Gianluca, et autres
Publié: (2024)
par: Scarpellini, Gianluca, et autres
Publié: (2024)
The impact of abstract and object tags on image privacy classification
par: Baranouskaya, Darya, et autres
Publié: (2025)
par: Baranouskaya, Darya, et autres
Publié: (2025)
Geometrically-driven Aggregation for Zero-shot 3D Point Cloud Understanding
par: Mei, Guofeng, et autres
Publié: (2023)
par: Mei, Guofeng, et autres
Publié: (2023)
Cross-Modal and Uncertainty-Aware Agglomeration for Open-Vocabulary 3D Scene Understanding
par: Li, Jinlong, et autres
Publié: (2025)
par: Li, Jinlong, et autres
Publié: (2025)
Learning by Erasing: Conditional Entropy based Transferable Out-Of-Distribution Detection
par: Xing, Meng, et autres
Publié: (2022)
par: Xing, Meng, et autres
Publié: (2022)
Monocular pose estimation of articulated open surgery tools -- in the wild
par: Spektor, Robert, et autres
Publié: (2024)
par: Spektor, Robert, et autres
Publié: (2024)
IndustryShapes: An RGB-D Benchmark dataset for 6D object pose estimation of industrial assembly components and tools
par: Sapoutzoglou, Panagiotis, et autres
Publié: (2026)
par: Sapoutzoglou, Panagiotis, et autres
Publié: (2026)
Novel class discovery meets foundation models for 3D semantic segmentation
par: Riz, Luigi, et autres
Publié: (2023)
par: Riz, Luigi, et autres
Publié: (2023)
Few-shot target-driven instance detection based on open-vocabulary object detection models
par: Crulis, Ben, et autres
Publié: (2024)
par: Crulis, Ben, et autres
Publié: (2024)
YCB-Ev 1.1: Event-vision dataset for 6DoF object pose estimation
par: Rojtberg, Pavel, et autres
Publié: (2023)
par: Rojtberg, Pavel, et autres
Publié: (2023)
YCB-Ev SD: Synthetic event-vision dataset for 6DoF object pose estimation
par: Rojtberg, Pavel, et autres
Publié: (2025)
par: Rojtberg, Pavel, et autres
Publié: (2025)
VERNIER: an open-source software pushing marker pose estimation down to the micrometer and nanometer scales
par: Sandoz, Patrick, et autres
Publié: (2025)
par: Sandoz, Patrick, et autres
Publié: (2025)
Spiking monocular event based 6D pose estimation for space application
par: Courtois, Jonathan, et autres
Publié: (2025)
par: Courtois, Jonathan, et autres
Publié: (2025)
Documents similaires
-
Open-vocabulary object 6D pose estimation
par: Corsetti, Jaime, et autres
Publié: (2023) -
Functionality understanding and segmentation in 3D scenes
par: Corsetti, Jaime, et autres
Publié: (2024) -
Accurate and efficient zero-shot 6D pose estimation with frozen foundation models
par: Caraffa, Andrea, et autres
Publié: (2025) -
Distilling 3D distinctive local descriptors for 6D pose estimation
par: Hamza, Amir, et autres
Publié: (2025) -
FreeZe: Training-free zero-shot 6D pose estimation with geometric and vision foundation models
par: Caraffa, Andrea, et autres
Publié: (2023)