Can These Views Be One Scene? Evaluating Multiview 3D Consistency when 3D Foundation Models Hallucinate
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Paul, Soumava, Kaushik, Prakhar, Yuille, Alan |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Gaussian Scenes: Pose-Free Sparse-View Scene Reconstruction using Depth-Enhanced Diffusion Priors
par: Paul, Soumava, et autres
Publié: (2024)
par: Paul, Soumava, et autres
Publié: (2024)
Name That Part: 3D Part Segmentation and Naming
par: Paul, Soumava, et autres
Publié: (2025)
par: Paul, Soumava, et autres
Publié: (2025)
A Bayesian Approach to OOD Robustness in Image Classification
par: Kaushik, Prakhar, et autres
Publié: (2024)
par: Kaushik, Prakhar, et autres
Publié: (2024)
Two Views Are Better than One: Monocular 3D Pose Estimation with Multiview Consistency
par: Ingwersen, Christian Keilstrup, et autres
Publié: (2023)
par: Ingwersen, Christian Keilstrup, et autres
Publié: (2023)
TriDiff-4D: Fast 4D Generation through Diffusion-based Triplane Re-posing
par: Sheung, Eddie Pokming, et autres
Publié: (2025)
par: Sheung, Eddie Pokming, et autres
Publié: (2025)
Source-Free and Image-Only Unsupervised Domain Adaptation for Category Level Object Pose Estimation
par: Kaushik, Prakhar, et autres
Publié: (2024)
par: Kaushik, Prakhar, et autres
Publié: (2024)
MCGS: Multiview Consistency Enhancement for Sparse-View 3D Gaussian Radiance Fields
par: Xiao, Yuru, et autres
Publié: (2024)
par: Xiao, Yuru, et autres
Publié: (2024)
Dragen3D: Multiview Geometry Consistent 3D Gaussian Generation with Drag-Based Control
par: Yan, Jinbo, et autres
Publié: (2025)
par: Yan, Jinbo, et autres
Publié: (2025)
3D Scene Change Modeling With Consistent Multi-View Aggregation
par: Zhou, Zirui, et autres
Publié: (2025)
par: Zhou, Zirui, et autres
Publié: (2025)
Perceptual Taxonomy: Evaluating and Guiding Hierarchical Scene Reasoning in Vision-Language Models
par: Lee, Jonathan, et autres
Publié: (2025)
par: Lee, Jonathan, et autres
Publié: (2025)
DisCo3D: Distilling Multi-View Consistency for 3D Scene Editing
par: Chi, Yufeng, et autres
Publié: (2025)
par: Chi, Yufeng, et autres
Publié: (2025)
Sp2360: Sparse-view 360 Scene Reconstruction using Cascaded 2D Diffusion Priors
par: Paul, Soumava, et autres
Publié: (2024)
par: Paul, Soumava, et autres
Publié: (2024)
DIRECT-3D: Learning Direct Text-to-3D Generation on Massive Noisy 3D Data
par: Liu, Qihao, et autres
Publié: (2024)
par: Liu, Qihao, et autres
Publié: (2024)
PASR: Pose-Aware 3D Shape Retrieval from Occluded Single Views
par: Shi, Jiaxin, et autres
Publié: (2026)
par: Shi, Jiaxin, et autres
Publié: (2026)
DINeMo: Learning Neural Mesh Models with no 3D Annotations
par: Guo, Weijie, et autres
Publié: (2025)
par: Guo, Weijie, et autres
Publié: (2025)
Shared LoRA Subspaces for almost Strict Continual Learning
par: Kaushik, Prakhar, et autres
Publié: (2026)
par: Kaushik, Prakhar, et autres
Publié: (2026)
The Universal Weight Subspace Hypothesis
par: Kaushik, Prakhar, et autres
Publié: (2025)
par: Kaushik, Prakhar, et autres
Publié: (2025)
Foundation VAEs for 3D CT Reconstruction, Augmentation, and Generation
par: Chen, Qi, et autres
Publié: (2026)
par: Chen, Qi, et autres
Publié: (2026)
Dehallu3D: Hallucination-Mitigated 3D Generation from Single Image via Cyclic View Consistency Refinement
par: Wang, Xiwen, et autres
Publié: (2026)
par: Wang, Xiwen, et autres
Publié: (2026)
WonderFree: Enhancing Novel View Quality and Cross-View Consistency for 3D Scene Exploration
par: Ni, Chaojun, et autres
Publié: (2025)
par: Ni, Chaojun, et autres
Publié: (2025)
Structure-Aware Sparse-View X-ray 3D Reconstruction
par: Cai, Yuanhao, et autres
Publié: (2023)
par: Cai, Yuanhao, et autres
Publié: (2023)
Evaluating Multiview Object Consistency in Humans and Image Models
par: Bonnen, Tyler, et autres
Publié: (2024)
par: Bonnen, Tyler, et autres
Publié: (2024)
PhyScene3D: Physically Consistent Interactive 3D Tabletop Scene Generation
par: Chen, Weixing, et autres
Publié: (2026)
par: Chen, Weixing, et autres
Publié: (2026)
MVD$^2$: Efficient Multiview 3D Reconstruction for Multiview Diffusion
par: Zheng, Xin-Yang, et autres
Publié: (2024)
par: Zheng, Xin-Yang, et autres
Publié: (2024)
Omni-View: Unlocking How Generation Facilitates Understanding in Unified 3D Model based on Multiview images
par: Hu, JiaKui, et autres
Publié: (2025)
par: Hu, JiaKui, et autres
Publié: (2025)
Pragmatist: Multiview Conditional Diffusion Models for High-Fidelity 3D Reconstruction from Unposed Sparse Views
par: Zhang, Songchun, et autres
Publié: (2024)
par: Zhang, Songchun, et autres
Publié: (2024)
One2Scene: Geometric Consistent Explorable 3D Scene Generation from a Single Image
par: Wang, Pengfei, et autres
Publié: (2026)
par: Wang, Pengfei, et autres
Publié: (2026)
Scene123: One Prompt to 3D Scene Generation via Video-Assisted and Consistency-Enhanced MAE
par: Yang, Yiying, et autres
Publié: (2024)
par: Yang, Yiying, et autres
Publié: (2024)
Illusion3D: 3D Multiview Illusion with 2D Diffusion Priors
par: Feng, Yue, et autres
Publié: (2024)
par: Feng, Yue, et autres
Publié: (2024)
How Well Do Supervised 3D Models Transfer to Medical Imaging Tasks?
par: Li, Wenxuan, et autres
Publié: (2025)
par: Li, Wenxuan, et autres
Publié: (2025)
ReVision: Refining Video Diffusion with Explicit 3D Motion Modeling
par: Liu, Qihao, et autres
Publié: (2025)
par: Liu, Qihao, et autres
Publié: (2025)
Argus: Leveraging Multiview Images for Improved 3-D Scene Understanding With Large Language Models
par: Xu, Yifan, et autres
Publié: (2025)
par: Xu, Yifan, et autres
Publié: (2025)
Multiview Scene Graph
par: Zhang, Juexiao, et autres
Publié: (2024)
par: Zhang, Juexiao, et autres
Publié: (2024)
Consistent View Alignment Improves Foundation Models for 3D Medical Image Segmentation
par: Vaish, Puru, et autres
Publié: (2025)
par: Vaish, Puru, et autres
Publié: (2025)
Finding 3D Scene Analogies with Multimodal Foundation Models
par: Kim, Junho, et autres
Publié: (2025)
par: Kim, Junho, et autres
Publié: (2025)
3D-MVP: 3D Multiview Pretraining for Robotic Manipulation
par: Qian, Shengyi, et autres
Publié: (2024)
par: Qian, Shengyi, et autres
Publié: (2024)
ViewCraft3D: High-Fidelity and View-Consistent 3D Vector Graphics Synthesis
par: Wang, Chuang, et autres
Publié: (2025)
par: Wang, Chuang, et autres
Publié: (2025)
Sparse Multiview Open-Vocabulary 3D Detection
par: Moliner, Olivier, et autres
Publié: (2025)
par: Moliner, Olivier, et autres
Publié: (2025)
Emergent Extreme-View Geometry in 3D Foundation Models
par: Zhang, Yiwen, et autres
Publié: (2025)
par: Zhang, Yiwen, et autres
Publié: (2025)
View-Consistent Diffusion Representations for 3D-Consistent Video Generation
par: Danier, Duolikun, et autres
Publié: (2025)
par: Danier, Duolikun, et autres
Publié: (2025)
Documents similaires
-
Gaussian Scenes: Pose-Free Sparse-View Scene Reconstruction using Depth-Enhanced Diffusion Priors
par: Paul, Soumava, et autres
Publié: (2024) -
Name That Part: 3D Part Segmentation and Naming
par: Paul, Soumava, et autres
Publié: (2025) -
A Bayesian Approach to OOD Robustness in Image Classification
par: Kaushik, Prakhar, et autres
Publié: (2024) -
Two Views Are Better than One: Monocular 3D Pose Estimation with Multiview Consistency
par: Ingwersen, Christian Keilstrup, et autres
Publié: (2023) -
TriDiff-4D: Fast 4D Generation through Diffusion-based Triplane Re-posing
par: Sheung, Eddie Pokming, et autres
Publié: (2025)