Object-X: Learning to Reconstruct Multi-Modal 3D Object Representations
Fuente:
arXiv
Salvato in:
| Autori principali: | Di Lorenzo, Gaia, Tombari, Federico, Pollefeys, Marc, Barath, Daniel |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
SegSplat: Feed-forward Gaussian Splatting and Open-Set Semantic Segmentation
di: Siegel, Peter, et al.
Pubblicazione: (2025)
di: Siegel, Peter, et al.
Pubblicazione: (2025)
SceneGraphLoc: Cross-Modal Coarse Visual Localization on 3D Scene Graphs
di: Miao, Yang, et al.
Pubblicazione: (2024)
di: Miao, Yang, et al.
Pubblicazione: (2024)
OVI-MAP:Open-Vocabulary Instance-Semantic Mapping
di: Deng, Zilong, et al.
Pubblicazione: (2026)
di: Deng, Zilong, et al.
Pubblicazione: (2026)
UniSDF: Unifying Neural Representations for High-Fidelity 3D Reconstruction of Complex Scenes with Reflections
di: Wang, Fangjinhua, et al.
Pubblicazione: (2023)
di: Wang, Fangjinhua, et al.
Pubblicazione: (2023)
CrossOver: 3D Scene Cross-Modal Alignment
di: Sarkar, Sayan Deb, et al.
Pubblicazione: (2025)
di: Sarkar, Sayan Deb, et al.
Pubblicazione: (2025)
Learning to Make Keypoints Sub-Pixel Accurate
di: Kim, Shinjeong, et al.
Pubblicazione: (2024)
di: Kim, Shinjeong, et al.
Pubblicazione: (2024)
Volumetric Semantically Consistent 3D Panoptic Mapping
di: Miao, Yang, et al.
Pubblicazione: (2023)
di: Miao, Yang, et al.
Pubblicazione: (2023)
Gravity-aligned Rotation Averaging with Circular Regression
di: Pan, Linfei, et al.
Pubblicazione: (2024)
di: Pan, Linfei, et al.
Pubblicazione: (2024)
ReSplat: Learning Recurrent Gaussian Splatting
di: Xu, Haofei, et al.
Pubblicazione: (2025)
di: Xu, Haofei, et al.
Pubblicazione: (2025)
YoNoSplat: You Only Need One Model for Feedforward 3D Gaussian Splatting
di: Ye, Botao, et al.
Pubblicazione: (2025)
di: Ye, Botao, et al.
Pubblicazione: (2025)
Memory Over Maps: 3D Object Localization Without Reconstruction
di: Zhou, Rui, et al.
Pubblicazione: (2026)
di: Zhou, Rui, et al.
Pubblicazione: (2026)
Multiway Point Cloud Mosaicking with Diffusion and Global Optimization
di: Jin, Shengze, et al.
Pubblicazione: (2024)
di: Jin, Shengze, et al.
Pubblicazione: (2024)
MOHO: Learning Single-view Hand-held Object Reconstruction with Multi-view Occlusion-Aware Supervision
di: Zhang, Chenyangguang, et al.
Pubblicazione: (2023)
di: Zhang, Chenyangguang, et al.
Pubblicazione: (2023)
OpenNeRF: Open Set 3D Neural Scene Segmentation with Pixel-Wise Features and Rendered Novel Views
di: Engelmann, Francis, et al.
Pubblicazione: (2024)
di: Engelmann, Francis, et al.
Pubblicazione: (2024)
D-SCo: Dual-Stream Conditional Diffusion for Monocular Hand-Held Object Reconstruction
di: Fu, Bowen, et al.
Pubblicazione: (2023)
di: Fu, Bowen, et al.
Pubblicazione: (2023)
Know Your Neighbors: Improving Single-View Reconstruction via Spatial Vision-Language Reasoning
di: Li, Rui, et al.
Pubblicazione: (2024)
di: Li, Rui, et al.
Pubblicazione: (2024)
HouseTour: A Virtual Real Estate A(I)gent
di: Çelen, Ata, et al.
Pubblicazione: (2025)
di: Çelen, Ata, et al.
Pubblicazione: (2025)
P2P-Bridge: Diffusion Bridges for 3D Point Cloud Denoising
di: Vogel, Mathias, et al.
Pubblicazione: (2024)
di: Vogel, Mathias, et al.
Pubblicazione: (2024)
Retrieval Robust to Object Motion Blur
di: Zou, Rong, et al.
Pubblicazione: (2024)
di: Zou, Rong, et al.
Pubblicazione: (2024)
DROID-SLAM in the Wild
di: Li, Moyang, et al.
Pubblicazione: (2026)
di: Li, Moyang, et al.
Pubblicazione: (2026)
Global Structure-from-Motion Revisited
di: Pan, Linfei, et al.
Pubblicazione: (2024)
di: Pan, Linfei, et al.
Pubblicazione: (2024)
FunRec: Reconstructing Functional 3D Scenes from Egocentric Interaction Videos
di: Delitzas, Alexandros, et al.
Pubblicazione: (2026)
di: Delitzas, Alexandros, et al.
Pubblicazione: (2026)
SG-Tailor: Inter-Object Commonsense Relationship Reasoning for Scene Graph Manipulation
di: Shang, Haoliang, et al.
Pubblicazione: (2025)
di: Shang, Haoliang, et al.
Pubblicazione: (2025)
Learning Where to Look: Self-supervised Viewpoint Selection for Active Localization using Geometrical Information
di: Di Giammarino, Luca, et al.
Pubblicazione: (2024)
di: Di Giammarino, Luca, et al.
Pubblicazione: (2024)
Robust Human Registration with Body Part Segmentation on Noisy Point Clouds
di: Lascheit, Kai, et al.
Pubblicazione: (2025)
di: Lascheit, Kai, et al.
Pubblicazione: (2025)
UnLoc: Leveraging Depth Uncertainties for Floorplan Localization
di: Wüest, Matthias, et al.
Pubblicazione: (2025)
di: Wüest, Matthias, et al.
Pubblicazione: (2025)
"Where am I?" Scene Retrieval with Language
di: Chen, Jiaqi, et al.
Pubblicazione: (2024)
di: Chen, Jiaqi, et al.
Pubblicazione: (2024)
Video Perception Models for 3D Scene Synthesis
di: Huang, Rui, et al.
Pubblicazione: (2025)
di: Huang, Rui, et al.
Pubblicazione: (2025)
UNOPose: Unseen Object Pose Estimation with an Unposed RGB-D Reference Image
di: Liu, Xingyu, et al.
Pubblicazione: (2024)
di: Liu, Xingyu, et al.
Pubblicazione: (2024)
SIGHT: Synthesizing Image-Text Conditioned and Geometry-Guided 3D Hand-Object Trajectories
di: Gavryushin, Alexey, et al.
Pubblicazione: (2025)
di: Gavryushin, Alexey, et al.
Pubblicazione: (2025)
Learning Implicit Representation for Reconstructing Articulated Objects
di: Zhang, Hao, et al.
Pubblicazione: (2024)
di: Zhang, Hao, et al.
Pubblicazione: (2024)
Text-to-3D by Stitching a Multi-view Reconstruction Network to a Video Generator
di: Go, Hyojun, et al.
Pubblicazione: (2025)
di: Go, Hyojun, et al.
Pubblicazione: (2025)
One2Any: One-Reference 6D Pose Estimation for Any Object
di: Liu, Mengya, et al.
Pubblicazione: (2025)
di: Liu, Mengya, et al.
Pubblicazione: (2025)
3D-MOOD: Lifting 2D to 3D for Monocular Open-Set Object Detection
di: Yang, Yung-Hsu, et al.
Pubblicazione: (2025)
di: Yang, Yung-Hsu, et al.
Pubblicazione: (2025)
R-CoV: Region-Aware Chain-of-Verification for Alleviating Object Hallucinations in LVLMs
di: Xie, Jiahao, et al.
Pubblicazione: (2026)
di: Xie, Jiahao, et al.
Pubblicazione: (2026)
Progressive Multi-Modal Fusion for Robust 3D Object Detection
di: Mohan, Rohit, et al.
Pubblicazione: (2024)
di: Mohan, Rohit, et al.
Pubblicazione: (2024)
CausNVS: Autoregressive Multi-view Diffusion for Flexible 3D Novel View Synthesis
di: Kong, Xin, et al.
Pubblicazione: (2025)
di: Kong, Xin, et al.
Pubblicazione: (2025)
VIGS-SLAM: Visual Inertial Gaussian Splatting SLAM
di: Zhu, Zihan, et al.
Pubblicazione: (2025)
di: Zhu, Zihan, et al.
Pubblicazione: (2025)
Modality-Agnostic Prompt Learning for Multi-Modal Camouflaged Object Detection
di: Wang, Hao, et al.
Pubblicazione: (2026)
di: Wang, Hao, et al.
Pubblicazione: (2026)
M^3Detection: Multi-Frame Multi-Level Feature Fusion for Multi-Modal 3D Object Detection with Camera and 4D Imaging Radar
di: Li, Xiaozhi, et al.
Pubblicazione: (2025)
di: Li, Xiaozhi, et al.
Pubblicazione: (2025)
Documenti analoghi
-
SegSplat: Feed-forward Gaussian Splatting and Open-Set Semantic Segmentation
di: Siegel, Peter, et al.
Pubblicazione: (2025) -
SceneGraphLoc: Cross-Modal Coarse Visual Localization on 3D Scene Graphs
di: Miao, Yang, et al.
Pubblicazione: (2024) -
OVI-MAP:Open-Vocabulary Instance-Semantic Mapping
di: Deng, Zilong, et al.
Pubblicazione: (2026) -
UniSDF: Unifying Neural Representations for High-Fidelity 3D Reconstruction of Complex Scenes with Reflections
di: Wang, Fangjinhua, et al.
Pubblicazione: (2023) -
CrossOver: 3D Scene Cross-Modal Alignment
di: Sarkar, Sayan Deb, et al.
Pubblicazione: (2025)