Can These Views Be One Scene? Evaluating Multiview 3D Consistency when 3D Foundation Models Hallucinate
Fuente:
arXiv
Salvato in:
| Autori principali: | Paul, Soumava, Kaushik, Prakhar, Yuille, Alan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Gaussian Scenes: Pose-Free Sparse-View Scene Reconstruction using Depth-Enhanced Diffusion Priors
di: Paul, Soumava, et al.
Pubblicazione: (2024)
di: Paul, Soumava, et al.
Pubblicazione: (2024)
Name That Part: 3D Part Segmentation and Naming
di: Paul, Soumava, et al.
Pubblicazione: (2025)
di: Paul, Soumava, et al.
Pubblicazione: (2025)
A Bayesian Approach to OOD Robustness in Image Classification
di: Kaushik, Prakhar, et al.
Pubblicazione: (2024)
di: Kaushik, Prakhar, et al.
Pubblicazione: (2024)
Two Views Are Better than One: Monocular 3D Pose Estimation with Multiview Consistency
di: Ingwersen, Christian Keilstrup, et al.
Pubblicazione: (2023)
di: Ingwersen, Christian Keilstrup, et al.
Pubblicazione: (2023)
TriDiff-4D: Fast 4D Generation through Diffusion-based Triplane Re-posing
di: Sheung, Eddie Pokming, et al.
Pubblicazione: (2025)
di: Sheung, Eddie Pokming, et al.
Pubblicazione: (2025)
Source-Free and Image-Only Unsupervised Domain Adaptation for Category Level Object Pose Estimation
di: Kaushik, Prakhar, et al.
Pubblicazione: (2024)
di: Kaushik, Prakhar, et al.
Pubblicazione: (2024)
MCGS: Multiview Consistency Enhancement for Sparse-View 3D Gaussian Radiance Fields
di: Xiao, Yuru, et al.
Pubblicazione: (2024)
di: Xiao, Yuru, et al.
Pubblicazione: (2024)
Dragen3D: Multiview Geometry Consistent 3D Gaussian Generation with Drag-Based Control
di: Yan, Jinbo, et al.
Pubblicazione: (2025)
di: Yan, Jinbo, et al.
Pubblicazione: (2025)
3D Scene Change Modeling With Consistent Multi-View Aggregation
di: Zhou, Zirui, et al.
Pubblicazione: (2025)
di: Zhou, Zirui, et al.
Pubblicazione: (2025)
Perceptual Taxonomy: Evaluating and Guiding Hierarchical Scene Reasoning in Vision-Language Models
di: Lee, Jonathan, et al.
Pubblicazione: (2025)
di: Lee, Jonathan, et al.
Pubblicazione: (2025)
DisCo3D: Distilling Multi-View Consistency for 3D Scene Editing
di: Chi, Yufeng, et al.
Pubblicazione: (2025)
di: Chi, Yufeng, et al.
Pubblicazione: (2025)
Sp2360: Sparse-view 360 Scene Reconstruction using Cascaded 2D Diffusion Priors
di: Paul, Soumava, et al.
Pubblicazione: (2024)
di: Paul, Soumava, et al.
Pubblicazione: (2024)
DIRECT-3D: Learning Direct Text-to-3D Generation on Massive Noisy 3D Data
di: Liu, Qihao, et al.
Pubblicazione: (2024)
di: Liu, Qihao, et al.
Pubblicazione: (2024)
PASR: Pose-Aware 3D Shape Retrieval from Occluded Single Views
di: Shi, Jiaxin, et al.
Pubblicazione: (2026)
di: Shi, Jiaxin, et al.
Pubblicazione: (2026)
DINeMo: Learning Neural Mesh Models with no 3D Annotations
di: Guo, Weijie, et al.
Pubblicazione: (2025)
di: Guo, Weijie, et al.
Pubblicazione: (2025)
Shared LoRA Subspaces for almost Strict Continual Learning
di: Kaushik, Prakhar, et al.
Pubblicazione: (2026)
di: Kaushik, Prakhar, et al.
Pubblicazione: (2026)
The Universal Weight Subspace Hypothesis
di: Kaushik, Prakhar, et al.
Pubblicazione: (2025)
di: Kaushik, Prakhar, et al.
Pubblicazione: (2025)
Foundation VAEs for 3D CT Reconstruction, Augmentation, and Generation
di: Chen, Qi, et al.
Pubblicazione: (2026)
di: Chen, Qi, et al.
Pubblicazione: (2026)
Dehallu3D: Hallucination-Mitigated 3D Generation from Single Image via Cyclic View Consistency Refinement
di: Wang, Xiwen, et al.
Pubblicazione: (2026)
di: Wang, Xiwen, et al.
Pubblicazione: (2026)
WonderFree: Enhancing Novel View Quality and Cross-View Consistency for 3D Scene Exploration
di: Ni, Chaojun, et al.
Pubblicazione: (2025)
di: Ni, Chaojun, et al.
Pubblicazione: (2025)
Structure-Aware Sparse-View X-ray 3D Reconstruction
di: Cai, Yuanhao, et al.
Pubblicazione: (2023)
di: Cai, Yuanhao, et al.
Pubblicazione: (2023)
Evaluating Multiview Object Consistency in Humans and Image Models
di: Bonnen, Tyler, et al.
Pubblicazione: (2024)
di: Bonnen, Tyler, et al.
Pubblicazione: (2024)
PhyScene3D: Physically Consistent Interactive 3D Tabletop Scene Generation
di: Chen, Weixing, et al.
Pubblicazione: (2026)
di: Chen, Weixing, et al.
Pubblicazione: (2026)
MVD$^2$: Efficient Multiview 3D Reconstruction for Multiview Diffusion
di: Zheng, Xin-Yang, et al.
Pubblicazione: (2024)
di: Zheng, Xin-Yang, et al.
Pubblicazione: (2024)
Omni-View: Unlocking How Generation Facilitates Understanding in Unified 3D Model based on Multiview images
di: Hu, JiaKui, et al.
Pubblicazione: (2025)
di: Hu, JiaKui, et al.
Pubblicazione: (2025)
Pragmatist: Multiview Conditional Diffusion Models for High-Fidelity 3D Reconstruction from Unposed Sparse Views
di: Zhang, Songchun, et al.
Pubblicazione: (2024)
di: Zhang, Songchun, et al.
Pubblicazione: (2024)
One2Scene: Geometric Consistent Explorable 3D Scene Generation from a Single Image
di: Wang, Pengfei, et al.
Pubblicazione: (2026)
di: Wang, Pengfei, et al.
Pubblicazione: (2026)
Scene123: One Prompt to 3D Scene Generation via Video-Assisted and Consistency-Enhanced MAE
di: Yang, Yiying, et al.
Pubblicazione: (2024)
di: Yang, Yiying, et al.
Pubblicazione: (2024)
Illusion3D: 3D Multiview Illusion with 2D Diffusion Priors
di: Feng, Yue, et al.
Pubblicazione: (2024)
di: Feng, Yue, et al.
Pubblicazione: (2024)
How Well Do Supervised 3D Models Transfer to Medical Imaging Tasks?
di: Li, Wenxuan, et al.
Pubblicazione: (2025)
di: Li, Wenxuan, et al.
Pubblicazione: (2025)
ReVision: Refining Video Diffusion with Explicit 3D Motion Modeling
di: Liu, Qihao, et al.
Pubblicazione: (2025)
di: Liu, Qihao, et al.
Pubblicazione: (2025)
Argus: Leveraging Multiview Images for Improved 3-D Scene Understanding With Large Language Models
di: Xu, Yifan, et al.
Pubblicazione: (2025)
di: Xu, Yifan, et al.
Pubblicazione: (2025)
Multiview Scene Graph
di: Zhang, Juexiao, et al.
Pubblicazione: (2024)
di: Zhang, Juexiao, et al.
Pubblicazione: (2024)
Consistent View Alignment Improves Foundation Models for 3D Medical Image Segmentation
di: Vaish, Puru, et al.
Pubblicazione: (2025)
di: Vaish, Puru, et al.
Pubblicazione: (2025)
Finding 3D Scene Analogies with Multimodal Foundation Models
di: Kim, Junho, et al.
Pubblicazione: (2025)
di: Kim, Junho, et al.
Pubblicazione: (2025)
3D-MVP: 3D Multiview Pretraining for Robotic Manipulation
di: Qian, Shengyi, et al.
Pubblicazione: (2024)
di: Qian, Shengyi, et al.
Pubblicazione: (2024)
ViewCraft3D: High-Fidelity and View-Consistent 3D Vector Graphics Synthesis
di: Wang, Chuang, et al.
Pubblicazione: (2025)
di: Wang, Chuang, et al.
Pubblicazione: (2025)
Sparse Multiview Open-Vocabulary 3D Detection
di: Moliner, Olivier, et al.
Pubblicazione: (2025)
di: Moliner, Olivier, et al.
Pubblicazione: (2025)
Emergent Extreme-View Geometry in 3D Foundation Models
di: Zhang, Yiwen, et al.
Pubblicazione: (2025)
di: Zhang, Yiwen, et al.
Pubblicazione: (2025)
View-Consistent Diffusion Representations for 3D-Consistent Video Generation
di: Danier, Duolikun, et al.
Pubblicazione: (2025)
di: Danier, Duolikun, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Gaussian Scenes: Pose-Free Sparse-View Scene Reconstruction using Depth-Enhanced Diffusion Priors
di: Paul, Soumava, et al.
Pubblicazione: (2024) -
Name That Part: 3D Part Segmentation and Naming
di: Paul, Soumava, et al.
Pubblicazione: (2025) -
A Bayesian Approach to OOD Robustness in Image Classification
di: Kaushik, Prakhar, et al.
Pubblicazione: (2024) -
Two Views Are Better than One: Monocular 3D Pose Estimation with Multiview Consistency
di: Ingwersen, Christian Keilstrup, et al.
Pubblicazione: (2023) -
TriDiff-4D: Fast 4D Generation through Diffusion-based Triplane Re-posing
di: Sheung, Eddie Pokming, et al.
Pubblicazione: (2025)