Unposed Sparse Views Room Layout Reconstruction in the Age of Pretrain Model
Fuente:
arXiv
Salvato in:
| Autori principali: | Huang, Yaxuan, Dai, Xili, Wang, Jianan, Qi, Xianbiao, Yuan, Yixing, Yue, Xiangyu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MVBoost: Boost 3D Reconstruction with Multi-View Refinement
di: Liu, Xiangyu, et al.
Pubblicazione: (2024)
di: Liu, Xiangyu, et al.
Pubblicazione: (2024)
Pseudo-View Enhancement via Confidence Fusion for Unposed Sparse-View Reconstruction
di: Zhao, Beizhen, et al.
Pubblicazione: (2026)
di: Zhao, Beizhen, et al.
Pubblicazione: (2026)
Implicit Neural Representations for Robust Joint Sparse-View CT Reconstruction
di: Shi, Jiayang, et al.
Pubblicazione: (2024)
di: Shi, Jiayang, et al.
Pubblicazione: (2024)
Self-training Room Layout Estimation via Geometry-aware Ray-casting
di: Solarte, Bolivar, et al.
Pubblicazione: (2024)
di: Solarte, Bolivar, et al.
Pubblicazione: (2024)
Uncertainty-guided Optimal Transport in Depth Supervised Sparse-View 3D Gaussian
di: Sun, Wei, et al.
Pubblicazione: (2024)
di: Sun, Wei, et al.
Pubblicazione: (2024)
ReconX: Reconstruct Any Scene from Sparse Views with Video Diffusion Model
di: Liu, Fangfu, et al.
Pubblicazione: (2024)
di: Liu, Fangfu, et al.
Pubblicazione: (2024)
Beyond Random Augmentations: Pretraining with Hard Views
di: Ferreira, Fabio, et al.
Pubblicazione: (2023)
di: Ferreira, Fabio, et al.
Pubblicazione: (2023)
PanoTPS-Net: Panoramic Room Layout Estimation via Thin Plate Spline Transformation
di: Ibrahem, Hatem, et al.
Pubblicazione: (2025)
di: Ibrahem, Hatem, et al.
Pubblicazione: (2025)
CrashChat: A Multimodal Large Language Model for Multitask Traffic Crash Video Analysis
di: Liang, Kaidi, et al.
Pubblicazione: (2025)
di: Liang, Kaidi, et al.
Pubblicazione: (2025)
MV-DUSt3R+: Single-Stage Scene Reconstruction from Sparse Views In 2 Seconds
di: Tang, Zhenggang, et al.
Pubblicazione: (2024)
di: Tang, Zhenggang, et al.
Pubblicazione: (2024)
Grounded Compositional and Diverse Text-to-3D with Pretrained Multi-View Diffusion Model
di: Li, Xiaolong, et al.
Pubblicazione: (2024)
di: Li, Xiaolong, et al.
Pubblicazione: (2024)
Explore the Limits of Omni-modal Pretraining at Scale
di: Zhang, Yiyuan, et al.
Pubblicazione: (2024)
di: Zhang, Yiyuan, et al.
Pubblicazione: (2024)
Sparfels: Fast Reconstruction from Sparse Unposed Imagery
di: Jena, Shubhendu, et al.
Pubblicazione: (2025)
di: Jena, Shubhendu, et al.
Pubblicazione: (2025)
Latent Space Consistency for Sparse-View CT Reconstruction
di: Chen, Duoyou, et al.
Pubblicazione: (2025)
di: Chen, Duoyou, et al.
Pubblicazione: (2025)
Efficient Flow Matching for Sparse-View CT Reconstruction
di: Shi, Jiayang, et al.
Pubblicazione: (2026)
di: Shi, Jiayang, et al.
Pubblicazione: (2026)
Pragmatist: Multiview Conditional Diffusion Models for High-Fidelity 3D Reconstruction from Unposed Sparse Views
di: Zhang, Songchun, et al.
Pubblicazione: (2024)
di: Zhang, Songchun, et al.
Pubblicazione: (2024)
PanoSplatt3R: Leveraging Perspective Pretraining for Generalized Unposed Wide-Baseline Panorama Reconstruction
di: Ren, Jiahui, et al.
Pubblicazione: (2025)
di: Ren, Jiahui, et al.
Pubblicazione: (2025)
CHRIS: Clothed Human Reconstruction with Side View Consistency
di: Liu, Dong, et al.
Pubblicazione: (2025)
di: Liu, Dong, et al.
Pubblicazione: (2025)
Spatial Transcriptomics as Images for Large-Scale Pretraining
di: Zhu, Yishun, et al.
Pubblicazione: (2026)
di: Zhu, Yishun, et al.
Pubblicazione: (2026)
LayoutVLM: Differentiable Optimization of 3D Layout via Vision-Language Models
di: Sun, Fan-Yun, et al.
Pubblicazione: (2024)
di: Sun, Fan-Yun, et al.
Pubblicazione: (2024)
UpFusion: Novel View Diffusion from Unposed Sparse View Observations
di: Kani, Bharath Raj Nagoor, et al.
Pubblicazione: (2023)
di: Kani, Bharath Raj Nagoor, et al.
Pubblicazione: (2023)
SpaRP: Fast 3D Object Reconstruction and Pose Estimation from Sparse Views
di: Xu, Chao, et al.
Pubblicazione: (2024)
di: Xu, Chao, et al.
Pubblicazione: (2024)
Sketch-to-Layout: Sketch-Guided Multimodal Layout Generation
di: Brioschi, Riccardo, et al.
Pubblicazione: (2025)
di: Brioschi, Riccardo, et al.
Pubblicazione: (2025)
Sparse BEV Fusion with Self-View Consistency for Multi-View Detection and Tracking
di: Toida, Keisuke, et al.
Pubblicazione: (2025)
di: Toida, Keisuke, et al.
Pubblicazione: (2025)
SSMG: Spatial-Semantic Map Guided Diffusion Model for Free-form Layout-to-Image Generation
di: Jia, Chengyou, et al.
Pubblicazione: (2023)
di: Jia, Chengyou, et al.
Pubblicazione: (2023)
VQ-Map: Bird's-Eye-View Map Layout Estimation in Tokenized Discrete Space via Vector Quantization
di: Zhang, Yiwei, et al.
Pubblicazione: (2024)
di: Zhang, Yiwei, et al.
Pubblicazione: (2024)
ILDiff: Generate Transparent Animated Stickers by Implicit Layout Distillation
di: Zhang, Ting, et al.
Pubblicazione: (2024)
di: Zhang, Ting, et al.
Pubblicazione: (2024)
PP-DocLayout: A Unified Document Layout Detection Model to Accelerate Large-Scale Data Construction
di: Sun, Ting, et al.
Pubblicazione: (2025)
di: Sun, Ting, et al.
Pubblicazione: (2025)
UC-NeRF: Uncertainty-aware Conditional Neural Radiance Fields from Endoscopic Sparse Views
di: Guo, Jiaxin, et al.
Pubblicazione: (2024)
di: Guo, Jiaxin, et al.
Pubblicazione: (2024)
EditRoom: LLM-parameterized Graph Diffusion for Composable 3D Room Layout Editing
di: Zheng, Kaizhi, et al.
Pubblicazione: (2024)
di: Zheng, Kaizhi, et al.
Pubblicazione: (2024)
Training-Free Text-Guided Color Editing with Multi-Modal Diffusion Transformer
di: Yin, Zixin, et al.
Pubblicazione: (2025)
di: Yin, Zixin, et al.
Pubblicazione: (2025)
Training-free Composite Scene Generation for Layout-to-Image Synthesis
di: Liu, Jiaqi, et al.
Pubblicazione: (2024)
di: Liu, Jiaqi, et al.
Pubblicazione: (2024)
Speed3R: Sparse Feed-forward 3D Reconstruction Models
di: Ren, Weining, et al.
Pubblicazione: (2026)
di: Ren, Weining, et al.
Pubblicazione: (2026)
An Optimization Framework to Enforce Multi-View Consistency for Texturing 3D Meshes
di: Zhao, Zhengyi, et al.
Pubblicazione: (2024)
di: Zhao, Zhengyi, et al.
Pubblicazione: (2024)
BiasICL: In-Context Learning and Demographic Biases of Vision Language Models
di: Xu, Sonnet, et al.
Pubblicazione: (2025)
di: Xu, Sonnet, et al.
Pubblicazione: (2025)
Direct Numerical Layout Generation for 3D Indoor Scene Synthesis via Spatial Reasoning
di: Ran, Xingjian, et al.
Pubblicazione: (2025)
di: Ran, Xingjian, et al.
Pubblicazione: (2025)
Improving Multi-View Reconstruction via Texture-Guided Gaussian-Mesh Joint Optimization
di: Cai, Zhejia, et al.
Pubblicazione: (2025)
di: Cai, Zhejia, et al.
Pubblicazione: (2025)
LIRM: Large Inverse Rendering Model for Progressive Reconstruction of Shape, Materials and View-dependent Radiance Fields
di: Li, Zhengqin, et al.
Pubblicazione: (2025)
di: Li, Zhengqin, et al.
Pubblicazione: (2025)
MeshSplat: Generalizable Sparse-View Surface Reconstruction via Gaussian Splatting
di: Chang, Hanzhi, et al.
Pubblicazione: (2025)
di: Chang, Hanzhi, et al.
Pubblicazione: (2025)
Robo-SGG: Exploiting Layout-Oriented Normalization and Restitution Can Improve Robust Scene Graph Generation
di: Lv, Changsheng, et al.
Pubblicazione: (2025)
di: Lv, Changsheng, et al.
Pubblicazione: (2025)
Documenti analoghi
-
MVBoost: Boost 3D Reconstruction with Multi-View Refinement
di: Liu, Xiangyu, et al.
Pubblicazione: (2024) -
Pseudo-View Enhancement via Confidence Fusion for Unposed Sparse-View Reconstruction
di: Zhao, Beizhen, et al.
Pubblicazione: (2026) -
Implicit Neural Representations for Robust Joint Sparse-View CT Reconstruction
di: Shi, Jiayang, et al.
Pubblicazione: (2024) -
Self-training Room Layout Estimation via Geometry-aware Ray-casting
di: Solarte, Bolivar, et al.
Pubblicazione: (2024) -
Uncertainty-guided Optimal Transport in Depth Supervised Sparse-View 3D Gaussian
di: Sun, Wei, et al.
Pubblicazione: (2024)