Open-Vocabulary Functional 3D Scene Graphs for Real-World Indoor Spaces
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Chenyangguang, Delitzas, Alexandros, Wang, Fangjinhua, Zhang, Ruida, Ji, Xiangyang, Pollefeys, Marc, Engelmann, Francis |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Hierarchical and Holistic Open-Vocabulary Functional 3D Scene Graphs for Indoor Spaces
di: Hu, Xinggang, et al.
Pubblicazione: (2026)
di: Hu, Xinggang, et al.
Pubblicazione: (2026)
Controllable Egocentric Video Generation via Occlusion-Aware Sparse 3D Hand Joints
di: Zhang, Chenyangguang, et al.
Pubblicazione: (2026)
di: Zhang, Chenyangguang, et al.
Pubblicazione: (2026)
FunRec: Reconstructing Functional 3D Scenes from Egocentric Interaction Videos
di: Delitzas, Alexandros, et al.
Pubblicazione: (2026)
di: Delitzas, Alexandros, et al.
Pubblicazione: (2026)
Search3D: Hierarchical Open-Vocabulary 3D Segmentation
di: Takmaz, Ayca, et al.
Pubblicazione: (2024)
di: Takmaz, Ayca, et al.
Pubblicazione: (2024)
REACT3D: Recovering Articulations for Interactive Physical 3D Scenes
di: Huang, Zhao, et al.
Pubblicazione: (2025)
di: Huang, Zhao, et al.
Pubblicazione: (2025)
From Indoor to Open World: Revealing the Spatial Reasoning Gap in MLLMs
di: Wu, Mingrui, et al.
Pubblicazione: (2025)
di: Wu, Mingrui, et al.
Pubblicazione: (2025)
ARKit LabelMaker: A New Scale for Indoor 3D Scene Understanding
di: Ji, Guangda, et al.
Pubblicazione: (2024)
di: Ji, Guangda, et al.
Pubblicazione: (2024)
RaSim: A Range-aware High-fidelity RGB-D Data Simulation Pipeline for Real-world Applications
di: Liu, Xingyu, et al.
Pubblicazione: (2024)
di: Liu, Xingyu, et al.
Pubblicazione: (2024)
OpenDAS: Open-Vocabulary Domain Adaptation for 2D and 3D Segmentation
di: Yilmaz, Gonca, et al.
Pubblicazione: (2024)
di: Yilmaz, Gonca, et al.
Pubblicazione: (2024)
SceneGraphLoc: Cross-Modal Coarse Visual Localization on 3D Scene Graphs
di: Miao, Yang, et al.
Pubblicazione: (2024)
di: Miao, Yang, et al.
Pubblicazione: (2024)
UNOPose: Unseen Object Pose Estimation with an Unposed RGB-D Reference Image
di: Liu, Xingyu, et al.
Pubblicazione: (2024)
di: Liu, Xingyu, et al.
Pubblicazione: (2024)
KP-RED: Exploiting Semantic Keypoints for Joint 3D Shape Retrieval and Deformation
di: Zhang, Ruida, et al.
Pubblicazione: (2024)
di: Zhang, Ruida, et al.
Pubblicazione: (2024)
OpenNeRF: Open Set 3D Neural Scene Segmentation with Pixel-Wise Features and Rendered Novel Views
di: Engelmann, Francis, et al.
Pubblicazione: (2024)
di: Engelmann, Francis, et al.
Pubblicazione: (2024)
SuperDec: 3D Scene Decomposition with Superquadric Primitives
di: Fedele, Elisabetta, et al.
Pubblicazione: (2025)
di: Fedele, Elisabetta, et al.
Pubblicazione: (2025)
SIGHT: Synthesizing Image-Text Conditioned and Geometry-Guided 3D Hand-Object Trajectories
di: Gavryushin, Alexey, et al.
Pubblicazione: (2025)
di: Gavryushin, Alexey, et al.
Pubblicazione: (2025)
GIVEPose: Gradual Intra-class Variation Elimination for RGB-based Category-Level Object Pose Estimation
di: Huang, Zinqin, et al.
Pubblicazione: (2025)
di: Huang, Zinqin, et al.
Pubblicazione: (2025)
Open-Vocabulary Indoor Object Grounding with 3D Hierarchical Scene Graph
di: Linok, Sergey, et al.
Pubblicazione: (2025)
di: Linok, Sergey, et al.
Pubblicazione: (2025)
Street Gaussians without 3D Object Tracker
di: Zhang, Ruida, et al.
Pubblicazione: (2024)
di: Zhang, Ruida, et al.
Pubblicazione: (2024)
UniSDF: Unifying Neural Representations for High-Fidelity 3D Reconstruction of Complex Scenes with Reflections
di: Wang, Fangjinhua, et al.
Pubblicazione: (2023)
di: Wang, Fangjinhua, et al.
Pubblicazione: (2023)
MegaFlow: Zero-Shot Large Displacement Optical Flow
di: Zhang, Dingxi, et al.
Pubblicazione: (2026)
di: Zhang, Dingxi, et al.
Pubblicazione: (2026)
R-SCoRe: Revisiting Scene Coordinate Regression for Robust Large-Scale Visual Localization
di: Jiang, Xudong, et al.
Pubblicazione: (2025)
di: Jiang, Xudong, et al.
Pubblicazione: (2025)
Articulated 3D Scene Graphs for Open-World Mobile Manipulation
di: Büchner, Martin, et al.
Pubblicazione: (2026)
di: Büchner, Martin, et al.
Pubblicazione: (2026)
Monocular Open Vocabulary Occupancy Prediction for Indoor Scenes
di: Zhou, Changqing, et al.
Pubblicazione: (2026)
di: Zhou, Changqing, et al.
Pubblicazione: (2026)
GDRNPP: A Geometry-guided and Fully Learning-based Object Pose Estimator
di: Liu, Xingyu, et al.
Pubblicazione: (2021)
di: Liu, Xingyu, et al.
Pubblicazione: (2021)
Video Perception Models for 3D Scene Synthesis
di: Huang, Rui, et al.
Pubblicazione: (2025)
di: Huang, Rui, et al.
Pubblicazione: (2025)
SpaceControl: Introducing Test-Time Spatial Control to 3D Generative Modeling
di: Fedele, Elisabetta, et al.
Pubblicazione: (2025)
di: Fedele, Elisabetta, et al.
Pubblicazione: (2025)
Spot-Compose: A Framework for Open-Vocabulary Object Retrieval and Drawer Manipulation in Point Clouds
di: Lemke, Oliver, et al.
Pubblicazione: (2024)
di: Lemke, Oliver, et al.
Pubblicazione: (2024)
LaPose: Laplacian Mixture Shape Modeling for RGB-Based Category-Level Object Pose Estimation
di: Zhang, Ruida, et al.
Pubblicazione: (2024)
di: Zhang, Ruida, et al.
Pubblicazione: (2024)
SG-Tailor: Inter-Object Commonsense Relationship Reasoning for Scene Graph Manipulation
di: Shang, Haoliang, et al.
Pubblicazione: (2025)
di: Shang, Haoliang, et al.
Pubblicazione: (2025)
OpenSUN3D: 1st Workshop Challenge on Open-Vocabulary 3D Scene Understanding
di: Engelmann, Francis, et al.
Pubblicazione: (2024)
di: Engelmann, Francis, et al.
Pubblicazione: (2024)
Action-guided generation of 3D functionality segmentation data
di: Corsetti, Jaime, et al.
Pubblicazione: (2025)
di: Corsetti, Jaime, et al.
Pubblicazione: (2025)
No Pose, No Problem in 4D: Feed-Forward Dynamic Gaussians from Unposed Multi-View Videos
di: Balice, Matteo, et al.
Pubblicazione: (2026)
di: Balice, Matteo, et al.
Pubblicazione: (2026)
Lightweight and Accurate Multi-View Stereo with Confidence-Aware Diffusion Model
di: Wang, Fangjinhua, et al.
Pubblicazione: (2025)
di: Wang, Fangjinhua, et al.
Pubblicazione: (2025)
Open-Vocabulary Octree-Graph for 3D Scene Understanding
di: Wang, Zhigang, et al.
Pubblicazione: (2024)
di: Wang, Zhigang, et al.
Pubblicazione: (2024)
Open-Vocabulary SAM3D: Towards Training-free Open-Vocabulary 3D Scene Understanding
di: Tai, Hanchen, et al.
Pubblicazione: (2024)
di: Tai, Hanchen, et al.
Pubblicazione: (2024)
FunFact: Building Probabilistic Functional 3D Scene Graphs via Factor-Graph Reasoning
di: Fu, Zhengyu, et al.
Pubblicazione: (2026)
di: Fu, Zhengyu, et al.
Pubblicazione: (2026)
Open-Vocabulary Functional 3D Human-Scene Interaction Generation
di: Liu, Jie, et al.
Pubblicazione: (2026)
di: Liu, Jie, et al.
Pubblicazione: (2026)
ShapeMatcher: Self-Supervised Joint Shape Canonicalization, Segmentation, Retrieval and Deformation
di: Di, Yan, et al.
Pubblicazione: (2023)
di: Di, Yan, et al.
Pubblicazione: (2023)
GLACE: Global Local Accelerated Coordinate Encoding
di: Wang, Fangjinhua, et al.
Pubblicazione: (2024)
di: Wang, Fangjinhua, et al.
Pubblicazione: (2024)
ImLoc: Revisiting Visual Localization with Image-based Representation
di: Jiang, Xudong, et al.
Pubblicazione: (2026)
di: Jiang, Xudong, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Hierarchical and Holistic Open-Vocabulary Functional 3D Scene Graphs for Indoor Spaces
di: Hu, Xinggang, et al.
Pubblicazione: (2026) -
Controllable Egocentric Video Generation via Occlusion-Aware Sparse 3D Hand Joints
di: Zhang, Chenyangguang, et al.
Pubblicazione: (2026) -
FunRec: Reconstructing Functional 3D Scenes from Egocentric Interaction Videos
di: Delitzas, Alexandros, et al.
Pubblicazione: (2026) -
Search3D: Hierarchical Open-Vocabulary 3D Segmentation
di: Takmaz, Ayca, et al.
Pubblicazione: (2024) -
REACT3D: Recovering Articulations for Interactive Physical 3D Scenes
di: Huang, Zhao, et al.
Pubblicazione: (2025)