PaintScene4D: Consistent 4D Scene Generation from Text Prompts
Fuente:
arXiv
Guardado en:
| Autores principales: | Gupta, Vinayak, Man, Yunze, Wang, Yu-Xiong |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
3D-SceneDreamer: Text-Driven 3D-Consistent Scene Generation
por: Zhang, Frank, et al.
Publicado: (2024)
por: Zhang, Frank, et al.
Publicado: (2024)
Instruct 4D-to-4D: Editing 4D Scenes as Pseudo-3D Scenes Using 2D Diffusion
por: Mou, Linzhan, et al.
Publicado: (2024)
por: Mou, Linzhan, et al.
Publicado: (2024)
SceneCraft: Layout-Guided 3D Scene Generation
por: Yang, Xiuyu, et al.
Publicado: (2024)
por: Yang, Xiuyu, et al.
Publicado: (2024)
Lexicon3D: Probing Visual Foundation Models for Complex 3D Scene Understanding
por: Man, Yunze, et al.
Publicado: (2024)
por: Man, Yunze, et al.
Publicado: (2024)
4D Panoptic Scene Graph Generation
por: Yang, Jingkang, et al.
Publicado: (2024)
por: Yang, Jingkang, et al.
Publicado: (2024)
GenXD: Generating Any 3D and 4D Scenes
por: Zhao, Yuyang, et al.
Publicado: (2024)
por: Zhao, Yuyang, et al.
Publicado: (2024)
ConsistDreamer: 3D-Consistent 2D Diffusion for High-Fidelity Scene Editing
por: Chen, Jun-Kun, et al.
Publicado: (2024)
por: Chen, Jun-Kun, et al.
Publicado: (2024)
DreamScene360: Unconstrained Text-to-3D Scene Generation with Panoramic Gaussian Splatting
por: Zhou, Shijie, et al.
Publicado: (2024)
por: Zhou, Shijie, et al.
Publicado: (2024)
STP4D: Spatio-Temporal-Prompt Consistent Modeling for Text-to-4D Gaussian Splatting
por: Deng, Yunze, et al.
Publicado: (2025)
por: Deng, Yunze, et al.
Publicado: (2025)
Text-Scene: A Scene-to-Language Parsing Framework for 3D Scene Understanding
por: Li, Haoyuan, et al.
Publicado: (2025)
por: Li, Haoyuan, et al.
Publicado: (2025)
FurniScene: A Large-scale 3D Room Dataset with Intricate Furnishing Scenes
por: Zhang, Genghao, et al.
Publicado: (2024)
por: Zhang, Genghao, et al.
Publicado: (2024)
Region Prompt Tuning: Fine-grained Scene Text Detection Utilizing Region Text Prompt
por: Lin, Xingtao, et al.
Publicado: (2024)
por: Lin, Xingtao, et al.
Publicado: (2024)
Situational Awareness Matters in 3D Vision Language Reasoning
por: Man, Yunze, et al.
Publicado: (2024)
por: Man, Yunze, et al.
Publicado: (2024)
PhiP-G: Physics-Guided Text-to-3D Compositional Scene Generation
por: Li, Qixuan, et al.
Publicado: (2025)
por: Li, Qixuan, et al.
Publicado: (2025)
DreamDrive: Generative 4D Scene Modeling from Street View Images
por: Mao, Jiageng, et al.
Publicado: (2024)
por: Mao, Jiageng, et al.
Publicado: (2024)
BetterScene: 3D Scene Synthesis with Representation-Aligned Generative Model
por: Han, Yuci, et al.
Publicado: (2026)
por: Han, Yuci, et al.
Publicado: (2026)
ArtiScene: Language-Driven Artistic 3D Scene Generation Through Image Intermediary
por: Gu, Zeqi, et al.
Publicado: (2025)
por: Gu, Zeqi, et al.
Publicado: (2025)
LAYOUTDREAMER: Physics-guided Layout for Text-to-3D Compositional Scene Generation
por: Zhou, Yang, et al.
Publicado: (2025)
por: Zhou, Yang, et al.
Publicado: (2025)
Hand3R: Online 4D Hand-Scene Reconstruction in the Wild
por: Hu, Wendi, et al.
Publicado: (2026)
por: Hu, Wendi, et al.
Publicado: (2026)
Genie 4D: Semantic-Prior-Guided 4D Dynamic Scene Reconstruction
por: Yang, Yiru, et al.
Publicado: (2026)
por: Yang, Yiru, et al.
Publicado: (2026)
FunGraph: Functionality Aware 3D Scene Graphs for Language-Prompted Scene Interaction
por: Rotondi, Dennis, et al.
Publicado: (2025)
por: Rotondi, Dennis, et al.
Publicado: (2025)
SceneGen: Single-Image 3D Scene Generation in One Feedforward Pass
por: Meng, Yanxu, et al.
Publicado: (2025)
por: Meng, Yanxu, et al.
Publicado: (2025)
Focus, Distinguish, and Prompt: Unleashing CLIP for Efficient and Flexible Scene Text Retrieval
por: Zeng, Gangyan, et al.
Publicado: (2024)
por: Zeng, Gangyan, et al.
Publicado: (2024)
Compositional 4D Dynamic Scenes Understanding with Physics Priors for Video Question Answering
por: Wang, Xingrui, et al.
Publicado: (2024)
por: Wang, Xingrui, et al.
Publicado: (2024)
GauU-Scene: A Scene Reconstruction Benchmark on Large Scale 3D Reconstruction Dataset Using Gaussian Splatting
por: Xiong, Butian, et al.
Publicado: (2024)
por: Xiong, Butian, et al.
Publicado: (2024)
Geometry-Guided Reinforcement Learning for Multi-view Consistent 3D Scene Editing
por: Wang, Jiyuan, et al.
Publicado: (2026)
por: Wang, Jiyuan, et al.
Publicado: (2026)
Scene Splatter: Momentum 3D Scene Generation from Single Image with Video Diffusion Model
por: Zhang, Shengjun, et al.
Publicado: (2025)
por: Zhang, Shengjun, et al.
Publicado: (2025)
PPTArena: A Benchmark for Agentic PowerPoint Editing
por: Ofengenden, Michael, et al.
Publicado: (2025)
por: Ofengenden, Michael, et al.
Publicado: (2025)
MetaFind: Scene-Aware 3D Asset Retrieval for Coherent Metaverse Scene Generation
por: Pan, Zhenyu, et al.
Publicado: (2025)
por: Pan, Zhenyu, et al.
Publicado: (2025)
LatentEditor: Text Driven Local Editing of 3D Scenes
por: Khalid, Umar, et al.
Publicado: (2023)
por: Khalid, Umar, et al.
Publicado: (2023)
Dynamic-eDiTor: Training-Free Text-Driven 4D Scene Editing with Multimodal Diffusion Transformer
por: Lee, Dong In, et al.
Publicado: (2025)
por: Lee, Dong In, et al.
Publicado: (2025)
SceneMaker: Open-set 3D Scene Generation with Decoupled De-occlusion and Pose Estimation Model
por: Shi, Yukai, et al.
Publicado: (2025)
por: Shi, Yukai, et al.
Publicado: (2025)
MVRoom: Controllable 3D Indoor Scene Generation with Multi-View Diffusion Models
por: Fang, Shaoheng, et al.
Publicado: (2025)
por: Fang, Shaoheng, et al.
Publicado: (2025)
RoomCraft: Controllable and Complete 3D Indoor Scene Generation
por: Zhou, Mengqi, et al.
Publicado: (2025)
por: Zhou, Mengqi, et al.
Publicado: (2025)
DualCross: Cross-Modality Cross-Domain Adaptation for Monocular BEV Perception
por: Man, Yunze, et al.
Publicado: (2023)
por: Man, Yunze, et al.
Publicado: (2023)
TextMamba: Scene Text Detector with Mamba
por: Zhao, Qiyan, et al.
Publicado: (2025)
por: Zhao, Qiyan, et al.
Publicado: (2025)
SIMSplat: Predictive Driving Scene Editing with Language-aligned 4D Gaussian Splatting
por: Park, Sung-Yeon, et al.
Publicado: (2025)
por: Park, Sung-Yeon, et al.
Publicado: (2025)
Open-Vocabulary Functional 3D Human-Scene Interaction Generation
por: Liu, Jie, et al.
Publicado: (2026)
por: Liu, Jie, et al.
Publicado: (2026)
SDD-4DGS: Static-Dynamic Aware Decoupling in Gaussian Splatting for 4D Scene Reconstruction
por: Sun, Dai, et al.
Publicado: (2025)
por: Sun, Dai, et al.
Publicado: (2025)
Relation-aware Hierarchical Prompt for Open-vocabulary Scene Graph Generation
por: Liu, Tao, et al.
Publicado: (2024)
por: Liu, Tao, et al.
Publicado: (2024)
Ejemplares similares
-
3D-SceneDreamer: Text-Driven 3D-Consistent Scene Generation
por: Zhang, Frank, et al.
Publicado: (2024) -
Instruct 4D-to-4D: Editing 4D Scenes as Pseudo-3D Scenes Using 2D Diffusion
por: Mou, Linzhan, et al.
Publicado: (2024) -
SceneCraft: Layout-Guided 3D Scene Generation
por: Yang, Xiuyu, et al.
Publicado: (2024) -
Lexicon3D: Probing Visual Foundation Models for Complex 3D Scene Understanding
por: Man, Yunze, et al.
Publicado: (2024) -
4D Panoptic Scene Graph Generation
por: Yang, Jingkang, et al.
Publicado: (2024)