PanoGrounder: Bridging 2D and 3D with Panoramic Scene Representations for VLM-based 3D Visual Grounding
Fuente:
arXiv
Salvato in:
| Autori principali: | Jung, Seongmin, Choi, Seongho, Jeon, Gunwoo, Cho, Minsu, Lim, Jongwoo |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
VLM-Grounder: A VLM Agent for Zero-Shot 3D Visual Grounding
di: Xu, Runsen, et al.
Pubblicazione: (2024)
di: Xu, Runsen, et al.
Pubblicazione: (2024)
LC-Flow: Learning Local Continuous Optical Flow and Confidence from events
di: Jeon, Gunwoo, et al.
Pubblicazione: (2026)
di: Jeon, Gunwoo, et al.
Pubblicazione: (2026)
PanoPlane: Plane-Aware Panoramic Completion for Sparse-View Indoor 3D Gaussian Splatting
di: Qureshi, Adil, et al.
Pubblicazione: (2026)
di: Qureshi, Adil, et al.
Pubblicazione: (2026)
SceneGraphGrounder: Zero-Shot 3D Visual Grounding via Structured Scene Graph Matching
di: Sun, Xuefei, et al.
Pubblicazione: (2026)
di: Sun, Xuefei, et al.
Pubblicazione: (2026)
Integrating Meshes and 3D Gaussians for Indoor Scene Reconstruction with SAM Mask Guidance
di: Kim, Jiyeop, et al.
Pubblicazione: (2024)
di: Kim, Jiyeop, et al.
Pubblicazione: (2024)
Pano3DComposer: Feed-Forward Compositional 3D Scene Generation from Single Panoramic Image
di: Qiu, Zidian, et al.
Pubblicazione: (2026)
di: Qiu, Zidian, et al.
Pubblicazione: (2026)
PanoVGGT: Feed-Forward 3D Reconstruction from Panoramic Imagery
di: Guo, Yijing, et al.
Pubblicazione: (2026)
di: Guo, Yijing, et al.
Pubblicazione: (2026)
Affostruction: 3D Affordance Grounding with Generative Reconstruction
di: Park, Chunghyun, et al.
Pubblicazione: (2026)
di: Park, Chunghyun, et al.
Pubblicazione: (2026)
ExploreGS: Explorable 3D Scene Reconstruction with Virtual Camera Samplings and Diffusion Priors
di: Kim, Minsu, et al.
Pubblicazione: (2025)
di: Kim, Minsu, et al.
Pubblicazione: (2025)
PanoEnv: Exploring 3D Spatial Intelligence in Panoramic Environments with Reinforcement Learning
di: Lin, Zekai, et al.
Pubblicazione: (2026)
di: Lin, Zekai, et al.
Pubblicazione: (2026)
HyDAR-Pano3D: A Hybrid Disentangled Anatomical Recovery Framework for Panoramic-to-3D Reconstruction
di: Yue, Yaoyao, et al.
Pubblicazione: (2026)
di: Yue, Yaoyao, et al.
Pubblicazione: (2026)
AgentGrounder: Zero-Shot 3D Visual Pointcloud Grounding using Multimodal Language Models
di: Huynh, Cuong, et al.
Pubblicazione: (2026)
di: Huynh, Cuong, et al.
Pubblicazione: (2026)
ReasonGrounder: LVLM-Guided Hierarchical Feature Splatting for Open-Vocabulary 3D Visual Grounding and Reasoning
di: Liu, Zhenyang, et al.
Pubblicazione: (2025)
di: Liu, Zhenyang, et al.
Pubblicazione: (2025)
Grasp-and-Lift: Executable 3D Hand-Object Interaction Reconstruction via Physics-in-the-Loop Optimization
di: Choi, Byeonggyeol, et al.
Pubblicazione: (2026)
di: Choi, Byeonggyeol, et al.
Pubblicazione: (2026)
SceneTeract: Agentic Functional Affordances and VLM Grounding in 3D Scenes
di: Maillard, Léopold, et al.
Pubblicazione: (2026)
di: Maillard, Léopold, et al.
Pubblicazione: (2026)
Leveraging 3D Geometric Priors in 2D Rotation Symmetry Detection
di: Seo, Ahyun, et al.
Pubblicazione: (2025)
di: Seo, Ahyun, et al.
Pubblicazione: (2025)
LayerPano3D: Layered 3D Panorama for Hyper-Immersive Scene Generation
di: Yang, Shuai, et al.
Pubblicazione: (2024)
di: Yang, Shuai, et al.
Pubblicazione: (2024)
HeightLane: BEV Heightmap guided 3D Lane Detection
di: Park, Chaesong, et al.
Pubblicazione: (2024)
di: Park, Chaesong, et al.
Pubblicazione: (2024)
PanoGS: Gaussian-based Panoptic Segmentation for 3D Open Vocabulary Scene Understanding
di: Zhai, Hongjia, et al.
Pubblicazione: (2025)
di: Zhai, Hongjia, et al.
Pubblicazione: (2025)
ChangingGrounding: 3D Visual Grounding in Changing Scenes
di: Hu, Miao, et al.
Pubblicazione: (2025)
di: Hu, Miao, et al.
Pubblicazione: (2025)
R3DS: Reality-linked 3D Scenes for Panoramic Scene Understanding
di: Wu, Qirui, et al.
Pubblicazione: (2024)
di: Wu, Qirui, et al.
Pubblicazione: (2024)
PanoSLAM: Panoptic 3D Scene Reconstruction via Gaussian SLAM
di: Chen, Runnan, et al.
Pubblicazione: (2024)
di: Chen, Runnan, et al.
Pubblicazione: (2024)
Hybrid 3D-4D Gaussian Splatting for Fast Dynamic Scene Representation
di: Oh, Seungjun, et al.
Pubblicazione: (2025)
di: Oh, Seungjun, et al.
Pubblicazione: (2025)
PanoSSC: Exploring Monocular Panoptic 3D Scene Reconstruction for Autonomous Driving
di: Shi, Yining, et al.
Pubblicazione: (2024)
di: Shi, Yining, et al.
Pubblicazione: (2024)
PanoVOS: Bridging Non-panoramic and Panoramic Views with Transformer for Video Segmentation
di: Yan, Shilin, et al.
Pubblicazione: (2023)
di: Yan, Shilin, et al.
Pubblicazione: (2023)
Rein3D: Reinforced 3D Indoor Scene Generation with Panoramic Video Diffusion Models
di: Wang, Dehui, et al.
Pubblicazione: (2026)
di: Wang, Dehui, et al.
Pubblicazione: (2026)
Cog3DMap: Multi-View Vision-Language Reasoning with 3D Cognitive Maps
di: Gwak, Chanyoung, et al.
Pubblicazione: (2026)
di: Gwak, Chanyoung, et al.
Pubblicazione: (2026)
Selectively Dilated Convolution for Accuracy-Preserving Sparse Pillar-based Embedded 3D Object Detection
di: Park, Seongmin, et al.
Pubblicazione: (2024)
di: Park, Seongmin, et al.
Pubblicazione: (2024)
PanoDreamer: Optimization-Based Single Image to 360 3D Scene With Diffusion
di: Paliwal, Avinash, et al.
Pubblicazione: (2024)
di: Paliwal, Avinash, et al.
Pubblicazione: (2024)
3D Equivariant Pose Regression via Direct Wigner-D Harmonics Prediction
di: Lee, Jongmin, et al.
Pubblicazione: (2024)
di: Lee, Jongmin, et al.
Pubblicazione: (2024)
In Defense of Lazy Visual Grounding for Open-Vocabulary Semantic Segmentation
di: Kang, Dahyun, et al.
Pubblicazione: (2024)
di: Kang, Dahyun, et al.
Pubblicazione: (2024)
DreamAnywhere: Object-Centric Panoramic 3D Scene Generation
di: Dominici, Edoardo Alberto, et al.
Pubblicazione: (2025)
di: Dominici, Edoardo Alberto, et al.
Pubblicazione: (2025)
Unified Representation Space for 3D Visual Grounding
di: Zheng, Yinuo, et al.
Pubblicazione: (2025)
di: Zheng, Yinuo, et al.
Pubblicazione: (2025)
PanoLora: Bridging Perspective and Panoramic Video Generation with LoRA Adaptation
di: Dong, Zeyu, et al.
Pubblicazione: (2025)
di: Dong, Zeyu, et al.
Pubblicazione: (2025)
Harnessing the Power of Training-Free Techniques in Text-to-2D Generation for Text-to-3D Generation via Score Distillation Sampling
di: Lee, Junhong, et al.
Pubblicazione: (2025)
di: Lee, Junhong, et al.
Pubblicazione: (2025)
PanopticNeRF-360: Panoramic 3D-to-2D Label Transfer in Urban Scenes
di: Fu, Xiao, et al.
Pubblicazione: (2023)
di: Fu, Xiao, et al.
Pubblicazione: (2023)
Move to Understand a 3D Scene: Bridging Visual Grounding and Exploration for Efficient and Versatile Embodied Navigation
di: Zhu, Ziyu, et al.
Pubblicazione: (2025)
di: Zhu, Ziyu, et al.
Pubblicazione: (2025)
Any 3D Scene is Worth 1K Tokens: 3D-Grounded Representation for Scene Generation at Scale
di: Wei, Dongxu, et al.
Pubblicazione: (2026)
di: Wei, Dongxu, et al.
Pubblicazione: (2026)
Pano360: Perspective to Panoramic Vision with Geometric Consistency
di: Zhu, Zhengdong, et al.
Pubblicazione: (2026)
di: Zhu, Zhengdong, et al.
Pubblicazione: (2026)
SC-Lane: Slope-aware and Consistent Road Height Estimation Framework for 3D Lane Detection
di: Park, Chaesong, et al.
Pubblicazione: (2025)
di: Park, Chaesong, et al.
Pubblicazione: (2025)
Documenti analoghi
-
VLM-Grounder: A VLM Agent for Zero-Shot 3D Visual Grounding
di: Xu, Runsen, et al.
Pubblicazione: (2024) -
LC-Flow: Learning Local Continuous Optical Flow and Confidence from events
di: Jeon, Gunwoo, et al.
Pubblicazione: (2026) -
PanoPlane: Plane-Aware Panoramic Completion for Sparse-View Indoor 3D Gaussian Splatting
di: Qureshi, Adil, et al.
Pubblicazione: (2026) -
SceneGraphGrounder: Zero-Shot 3D Visual Grounding via Structured Scene Graph Matching
di: Sun, Xuefei, et al.
Pubblicazione: (2026) -
Integrating Meshes and 3D Gaussians for Indoor Scene Reconstruction with SAM Mask Guidance
di: Kim, Jiyeop, et al.
Pubblicazione: (2024)