Constructing a 3D Scene from a Single Image
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zheng, Kaizhi, Zha, Ruijian, Xu, Zishuo, Gu, Jing, Yang, Jie, Wang, Xin Eric |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Self-Evolving 3D Scene Generation from a Single Image
par: Zheng, Kaizhi, et autres
Publié: (2025)
par: Zheng, Kaizhi, et autres
Publié: (2025)
MiniGPT-5: Interleaved Vision-and-Language Generation via Generative Vokens
par: Zheng, Kaizhi, et autres
Publié: (2023)
par: Zheng, Kaizhi, et autres
Publié: (2023)
BEVTrack: A Simple and Strong Baseline for 3D Single Object Tracking in Bird's-Eye View
par: Yang, Yuxiang, et autres
Publié: (2023)
par: Yang, Yuxiang, et autres
Publié: (2023)
Scene Splatter: Momentum 3D Scene Generation from Single Image with Video Diffusion Model
par: Zhang, Shengjun, et autres
Publié: (2025)
par: Zhang, Shengjun, et autres
Publié: (2025)
Grounding 3D Scene Affordance From Egocentric Interactions
par: Liu, Cuiyu, et autres
Publié: (2024)
par: Liu, Cuiyu, et autres
Publié: (2024)
NavCrafter: Exploring 3D Scenes from a Single Image
par: Duan, Hongbo, et autres
Publié: (2026)
par: Duan, Hongbo, et autres
Publié: (2026)
GEN3D: Generating Domain-Free 3D Scenes from a Single Image
par: Zhang, Yuxin, et autres
Publié: (2025)
par: Zhang, Yuxin, et autres
Publié: (2025)
SceneGen: Single-Image 3D Scene Generation in One Feedforward Pass
par: Meng, Yanxu, et autres
Publié: (2025)
par: Meng, Yanxu, et autres
Publié: (2025)
EditRoom: LLM-parameterized Graph Diffusion for Composable 3D Room Layout Editing
par: Zheng, Kaizhi, et autres
Publié: (2024)
par: Zheng, Kaizhi, et autres
Publié: (2024)
ArtiScene: Language-Driven Artistic 3D Scene Generation Through Image Intermediary
par: Gu, Zeqi, et autres
Publié: (2025)
par: Gu, Zeqi, et autres
Publié: (2025)
WonderPlay: Dynamic 3D Scene Generation from a Single Image and Actions
par: Li, Zizhang, et autres
Publié: (2025)
par: Li, Zizhang, et autres
Publié: (2025)
3D-SceneDreamer: Text-Driven 3D-Consistent Scene Generation
par: Zhang, Frank, et autres
Publié: (2024)
par: Zhang, Frank, et autres
Publié: (2024)
JARVIS: A Neuro-Symbolic Commonsense Reasoning Framework for Conversational Embodied Agents
par: Zheng, Kaizhi, et autres
Publié: (2022)
par: Zheng, Kaizhi, et autres
Publié: (2022)
InteractMove: Text-Controlled Human-Object Interaction Generation in 3D Scenes with Movable Objects
par: Cai, Xinhao, et autres
Publié: (2025)
par: Cai, Xinhao, et autres
Publié: (2025)
Sat3DGen: Comprehensive Street-Level 3D Scene Generation from Single Satellite Image
par: Qian, Ming, et autres
Publié: (2026)
par: Qian, Ming, et autres
Publié: (2026)
GRIT: Teaching MLLMs to Think with Images
par: Fan, Yue, et autres
Publié: (2025)
par: Fan, Yue, et autres
Publié: (2025)
Feature-Optimized Vision for Adaptive 3D Scene Reconstruction
par: Liang, Eric
Publié: (2026)
par: Liang, Eric
Publié: (2026)
Elucidating and Endowing the Diffusion Training Paradigm for General Image Restoration
par: Lu, Xin, et autres
Publié: (2025)
par: Lu, Xin, et autres
Publié: (2025)
MorphoSim: An Interactive, Controllable, and Editable Language-guided 4D World Simulator
par: He, Xuehai, et autres
Publié: (2025)
par: He, Xuehai, et autres
Publié: (2025)
DimensionX: Create Any 3D and 4D Scenes from a Single Image with Controllable Video Diffusion
par: Sun, Wenqiang, et autres
Publié: (2024)
par: Sun, Wenqiang, et autres
Publié: (2024)
Beyond Voxel 3D Editing: Learning from 3D Masks and Self-Constructed Data
par: Xu, Yizhao, et autres
Publié: (2026)
par: Xu, Yizhao, et autres
Publié: (2026)
Compress3D: a Compressed Latent Space for 3D Generation from a Single Image
par: Zhang, Bowen, et autres
Publié: (2024)
par: Zhang, Bowen, et autres
Publié: (2024)
GaussianFormer: Scene as Gaussians for Vision-Based 3D Semantic Occupancy Prediction
par: Huang, Yuanhui, et autres
Publié: (2024)
par: Huang, Yuanhui, et autres
Publié: (2024)
LLMI3D: MLLM-based 3D Perception from a Single 2D Image
par: Yang, Fan, et autres
Publié: (2024)
par: Yang, Fan, et autres
Publié: (2024)
VASA-3D: Lifelike Audio-Driven Gaussian Head Avatars from a Single Image
par: Xu, Sicheng, et autres
Publié: (2025)
par: Xu, Sicheng, et autres
Publié: (2025)
NOVA3D: Normal Aligned Video Diffusion Model for Single Image to 3D Generation
par: Yang, Yuxiao, et autres
Publié: (2025)
par: Yang, Yuxiao, et autres
Publié: (2025)
Wonder3D++: Cross-domain Diffusion for High-fidelity 3D Generation from a Single Image
par: Yang, Yuxiao, et autres
Publié: (2025)
par: Yang, Yuxiao, et autres
Publié: (2025)
DistillNeRF: Perceiving 3D Scenes from Single-Glance Images by Distilling Neural Fields and Foundation Model Features
par: Wang, Letian, et autres
Publié: (2024)
par: Wang, Letian, et autres
Publié: (2024)
Argus: Leveraging Multiview Images for Improved 3-D Scene Understanding With Large Language Models
par: Xu, Yifan, et autres
Publié: (2025)
par: Xu, Yifan, et autres
Publié: (2025)
Hunyuan3D 1.0: A Unified Framework for Text-to-3D and Image-to-3D Generation
par: Yang, Xianghui, et autres
Publié: (2024)
par: Yang, Xianghui, et autres
Publié: (2024)
GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding
par: Shao, Yawen, et autres
Publié: (2024)
par: Shao, Yawen, et autres
Publié: (2024)
Shape2Scene: 3D Scene Representation Learning Through Pre-training on Shape Data
par: Feng, Tuo, et autres
Publié: (2024)
par: Feng, Tuo, et autres
Publié: (2024)
FurniScene: A Large-scale 3D Room Dataset with Intricate Furnishing Scenes
par: Zhang, Genghao, et autres
Publié: (2024)
par: Zhang, Genghao, et autres
Publié: (2024)
NeRFDeformer: NeRF Transformation from a Single View via 3D Scene Flows
par: Tang, Zhenggang, et autres
Publié: (2024)
par: Tang, Zhenggang, et autres
Publié: (2024)
GenXD: Generating Any 3D and 4D Scenes
par: Zhao, Yuyang, et autres
Publié: (2024)
par: Zhao, Yuyang, et autres
Publié: (2024)
DreamScene360: Unconstrained Text-to-3D Scene Generation with Panoramic Gaussian Splatting
par: Zhou, Shijie, et autres
Publié: (2024)
par: Zhou, Shijie, et autres
Publié: (2024)
LatentEditor: Text Driven Local Editing of 3D Scenes
par: Khalid, Umar, et autres
Publié: (2023)
par: Khalid, Umar, et autres
Publié: (2023)
DePT3R: Joint Dense Point Tracking and 3D Reconstruction of Dynamic Scenes in a Single Forward Pass
par: Alumootil, Vivek, et autres
Publié: (2025)
par: Alumootil, Vivek, et autres
Publié: (2025)
SceneTok: A Compressed, Diffusable Token Space for 3D Scenes
par: Asim, Mohammad, et autres
Publié: (2026)
par: Asim, Mohammad, et autres
Publié: (2026)
Human Interaction-Aware 3D Reconstruction from a Single Image
par: Kim, Gwanghyun, et autres
Publié: (2026)
par: Kim, Gwanghyun, et autres
Publié: (2026)
Documents similaires
-
Self-Evolving 3D Scene Generation from a Single Image
par: Zheng, Kaizhi, et autres
Publié: (2025) -
MiniGPT-5: Interleaved Vision-and-Language Generation via Generative Vokens
par: Zheng, Kaizhi, et autres
Publié: (2023) -
BEVTrack: A Simple and Strong Baseline for 3D Single Object Tracking in Bird's-Eye View
par: Yang, Yuxiang, et autres
Publié: (2023) -
Scene Splatter: Momentum 3D Scene Generation from Single Image with Video Diffusion Model
par: Zhang, Shengjun, et autres
Publié: (2025) -
Grounding 3D Scene Affordance From Egocentric Interactions
par: Liu, Cuiyu, et autres
Publié: (2024)