Self-Evolving 3D Scene Generation from a Single Image
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zheng, Kaizhi, Fan, Yue, Gu, Jing, Xu, Zishuo, He, Xuehai, Wang, Xin Eric |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Constructing a 3D Scene from a Single Image
par: Zheng, Kaizhi, et autres
Publié: (2025)
par: Zheng, Kaizhi, et autres
Publié: (2025)
MiniGPT-5: Interleaved Vision-and-Language Generation via Generative Vokens
par: Zheng, Kaizhi, et autres
Publié: (2023)
par: Zheng, Kaizhi, et autres
Publié: (2023)
JARVIS: A Neuro-Symbolic Commonsense Reasoning Framework for Conversational Embodied Agents
par: Zheng, Kaizhi, et autres
Publié: (2022)
par: Zheng, Kaizhi, et autres
Publié: (2022)
GRIT: Teaching MLLMs to Think with Images
par: Fan, Yue, et autres
Publié: (2025)
par: Fan, Yue, et autres
Publié: (2025)
MorphoSim: An Interactive, Controllable, and Editable Language-guided 4D World Simulator
par: He, Xuehai, et autres
Publié: (2025)
par: He, Xuehai, et autres
Publié: (2025)
EditRoom: LLM-parameterized Graph Diffusion for Composable 3D Room Layout Editing
par: Zheng, Kaizhi, et autres
Publié: (2024)
par: Zheng, Kaizhi, et autres
Publié: (2024)
Toffee: Efficient Million-Scale Dataset Construction for Subject-Driven Text-to-Image Generation
par: Zhou, Yufan, et autres
Publié: (2024)
par: Zhou, Yufan, et autres
Publié: (2024)
MSGFusion: Multimodal Scene Graph-Guided Infrared and Visible Image Fusion
par: Li, Guihui, et autres
Publié: (2025)
par: Li, Guihui, et autres
Publié: (2025)
ComCLIP: Training-Free Compositional Image and Text Matching
par: Jiang, Kenan, et autres
Publié: (2022)
par: Jiang, Kenan, et autres
Publié: (2022)
SceneTransporter: Optimal Transport-Guided Compositional Latent Diffusion for Single-Image Structured 3D Scene Generation
par: Wang, Ling, et autres
Publié: (2026)
par: Wang, Ling, et autres
Publié: (2026)
MIDI: Multi-Instance Diffusion for Single Image to 3D Scene Generation
par: Huang, Zehuan, et autres
Publié: (2024)
par: Huang, Zehuan, et autres
Publié: (2024)
Dual Attribute-Spatial Relation Alignment for 3D Visual Grounding
par: Xu, Yue, et autres
Publié: (2024)
par: Xu, Yue, et autres
Publié: (2024)
One2Scene: Geometric Consistent Explorable 3D Scene Generation from a Single Image
par: Wang, Pengfei, et autres
Publié: (2026)
par: Wang, Pengfei, et autres
Publié: (2026)
ReScene4D: Temporally Consistent Semantic Instance Segmentation of Evolving Indoor 3D Scenes
par: Steiner, Emily, et autres
Publié: (2026)
par: Steiner, Emily, et autres
Publié: (2026)
Scene Splatter: Momentum 3D Scene Generation from Single Image with Video Diffusion Model
par: Zhang, Shengjun, et autres
Publié: (2025)
par: Zhang, Shengjun, et autres
Publié: (2025)
ZeroScene: A Zero-Shot Framework for 3D Scene Generation from a Single Image and Controllable Texture Editing
par: Tang, Xiang, et autres
Publié: (2025)
par: Tang, Xiang, et autres
Publié: (2025)
FlexEControl: Flexible and Efficient Multimodal Control for Text-to-Image Generation
par: He, Xuehai, et autres
Publié: (2024)
par: He, Xuehai, et autres
Publié: (2024)
3D-Fixer: Coarse-to-Fine In-place Completion for 3D Scenes from a Single Image
par: Yin, Ze-Xin, et autres
Publié: (2026)
par: Yin, Ze-Xin, et autres
Publié: (2026)
TabletopGen: Instance-Level Interactive 3D Tabletop Scene Generation from Text or Single Image
par: Wang, Ziqian, et autres
Publié: (2025)
par: Wang, Ziqian, et autres
Publié: (2025)
3D Face Reconstruction With Geometry Details From a Single Color Image Under Occluded Scenes
par: Zhao, Dapeng, et autres
Publié: (2024)
par: Zhao, Dapeng, et autres
Publié: (2024)
CC-FMO: Camera-Conditioned Zero-Shot Single Image to 3D Scene Generation with Foundation Model Orchestration
par: Tang, Boshi, et autres
Publié: (2025)
par: Tang, Boshi, et autres
Publié: (2025)
Towards Geometric and Textural Consistency 3D Scene Generation via Single Image-guided Model Generation and Layout Optimization
par: Tang, Xiang, et autres
Publié: (2025)
par: Tang, Xiang, et autres
Publié: (2025)
DecoRec: Decomposed 3D Scene Reconstruction from Single-View Images via Object-Level Diffusion
par: Ping, Yuhan, et autres
Publié: (2026)
par: Ping, Yuhan, et autres
Publié: (2026)
GEN3D: Generating Domain-Free 3D Scenes from a Single Image
par: Zhang, Yuxin, et autres
Publié: (2025)
par: Zhang, Yuxin, et autres
Publié: (2025)
DragScene: Interactive 3D Scene Editing with Single-view Drag Instructions
par: Gu, Chenghao, et autres
Publié: (2024)
par: Gu, Chenghao, et autres
Publié: (2024)
Personalize Your Gaussian: Consistent 3D Scene Personalization from a Single Image
par: Wang, Yuxuan, et autres
Publié: (2025)
par: Wang, Yuxuan, et autres
Publié: (2025)
SceneGen: Single-Image 3D Scene Generation in One Feedforward Pass
par: Meng, Yanxu, et autres
Publié: (2025)
par: Meng, Yanxu, et autres
Publié: (2025)
Flash3D: Feed-Forward Generalisable 3D Scene Reconstruction from a Single Image
par: Szymanowicz, Stanislaw, et autres
Publié: (2024)
par: Szymanowicz, Stanislaw, et autres
Publié: (2024)
LPA3D: 3D Room-Level Scene Generation from In-the-Wild Images
par: Yang, Ming-Jia, et autres
Publié: (2025)
par: Yang, Ming-Jia, et autres
Publié: (2025)
RGM: Reconstructing High-fidelity 3D Car Assets with Relightable 3D-GS Generative Model from a Single Image
par: Chen, Xiaoxue, et autres
Publié: (2024)
par: Chen, Xiaoxue, et autres
Publié: (2024)
GenEvolve: Self-Evolving Image Generation Agents via Tool-Orchestrated Visual Experience Distillation
par: Chen, Sixiang, et autres
Publié: (2026)
par: Chen, Sixiang, et autres
Publié: (2026)
ExScene: Free-View 3D Scene Reconstruction with Gaussian Splatting from a Single Image
par: Gong, Tianyi, et autres
Publié: (2025)
par: Gong, Tianyi, et autres
Publié: (2025)
REST3D: Reconstructing Physically Stable 3D Scenes from a Single Image
par: Ma, Xiaoxuan, et autres
Publié: (2026)
par: Ma, Xiaoxuan, et autres
Publié: (2026)
Scene4U: Hierarchical Layered 3D Scene Reconstruction from Single Panoramic Image for Your Immerse Exploration
par: Huang, Zilong, et autres
Publié: (2025)
par: Huang, Zilong, et autres
Publié: (2025)
Scene123: One Prompt to 3D Scene Generation via Video-Assisted and Consistency-Enhanced MAE
par: Yang, Yiying, et autres
Publié: (2024)
par: Yang, Yiying, et autres
Publié: (2024)
AGG: Amortized Generative 3D Gaussians for Single Image to 3D
par: Xu, Dejia, et autres
Publié: (2024)
par: Xu, Dejia, et autres
Publié: (2024)
Wonderland: Navigating 3D Scenes from a Single Image
par: Liang, Hanwen, et autres
Publié: (2024)
par: Liang, Hanwen, et autres
Publié: (2024)
EvolveReason: Self-Evolving Reasoning Paradigm for Explainable Deepfake Facial Image Identification
par: Zhou, Binjia, et autres
Publié: (2026)
par: Zhou, Binjia, et autres
Publié: (2026)
ArtiScene: Language-Driven Artistic 3D Scene Generation Through Image Intermediary
par: Gu, Zeqi, et autres
Publié: (2025)
par: Gu, Zeqi, et autres
Publié: (2025)
Pano3DComposer: Feed-Forward Compositional 3D Scene Generation from Single Panoramic Image
par: Qiu, Zidian, et autres
Publié: (2026)
par: Qiu, Zidian, et autres
Publié: (2026)
Documents similaires
-
Constructing a 3D Scene from a Single Image
par: Zheng, Kaizhi, et autres
Publié: (2025) -
MiniGPT-5: Interleaved Vision-and-Language Generation via Generative Vokens
par: Zheng, Kaizhi, et autres
Publié: (2023) -
JARVIS: A Neuro-Symbolic Commonsense Reasoning Framework for Conversational Embodied Agents
par: Zheng, Kaizhi, et autres
Publié: (2022) -
GRIT: Teaching MLLMs to Think with Images
par: Fan, Yue, et autres
Publié: (2025) -
MorphoSim: An Interactive, Controllable, and Editable Language-guided 4D World Simulator
par: He, Xuehai, et autres
Publié: (2025)