Instruct 4D-to-4D: Editing 4D Scenes as Pseudo-3D Scenes Using 2D Diffusion
Fuente:
arXiv
Salvato in:
| Autori principali: | Mou, Linzhan, Chen, Jun-Kun, Wang, Yu-Xiong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ConsistDreamer: 3D-Consistent 2D Diffusion for High-Fidelity Scene Editing
di: Chen, Jun-Kun, et al.
Pubblicazione: (2024)
di: Chen, Jun-Kun, et al.
Pubblicazione: (2024)
2D-3D Interlaced Transformer for Point Cloud Segmentation with Scene-Level Supervision
di: Yang, Cheng-Kun, et al.
Pubblicazione: (2023)
di: Yang, Cheng-Kun, et al.
Pubblicazione: (2023)
PaintScene4D: Consistent 4D Scene Generation from Text Prompts
di: Gupta, Vinayak, et al.
Pubblicazione: (2024)
di: Gupta, Vinayak, et al.
Pubblicazione: (2024)
3D Diffuser Actor: Policy Diffusion with 3D Scene Representations
di: Ke, Tsung-Wei, et al.
Pubblicazione: (2024)
di: Ke, Tsung-Wei, et al.
Pubblicazione: (2024)
SceneTok: A Compressed, Diffusable Token Space for 3D Scenes
di: Asim, Mohammad, et al.
Pubblicazione: (2026)
di: Asim, Mohammad, et al.
Pubblicazione: (2026)
Viewpoint Textual Inversion: Discovering Scene Representations and 3D View Control in 2D Diffusion Models
di: Burgess, James, et al.
Pubblicazione: (2023)
di: Burgess, James, et al.
Pubblicazione: (2023)
Intrinsic PAPR for Point-level 3D Scene Albedo and Shading Editing
di: Moazeni, Alireza, et al.
Pubblicazione: (2024)
di: Moazeni, Alireza, et al.
Pubblicazione: (2024)
Lexicon3D: Probing Visual Foundation Models for Complex 3D Scene Understanding
di: Man, Yunze, et al.
Pubblicazione: (2024)
di: Man, Yunze, et al.
Pubblicazione: (2024)
OpenSUN3D: 1st Workshop Challenge on Open-Vocabulary 3D Scene Understanding
di: Engelmann, Francis, et al.
Pubblicazione: (2024)
di: Engelmann, Francis, et al.
Pubblicazione: (2024)
GenXD: Generating Any 3D and 4D Scenes
di: Zhao, Yuyang, et al.
Pubblicazione: (2024)
di: Zhao, Yuyang, et al.
Pubblicazione: (2024)
4D Panoptic Scene Graph Generation
di: Yang, Jingkang, et al.
Pubblicazione: (2024)
di: Yang, Jingkang, et al.
Pubblicazione: (2024)
Geometric 4D Stitching for Grounded 4D Generation
di: Park, Sunwoo, et al.
Pubblicazione: (2026)
di: Park, Sunwoo, et al.
Pubblicazione: (2026)
BloomScene: Lightweight Structured 3D Gaussian Splatting for Crossmodal Scene Generation
di: Hou, Xiaolu, et al.
Pubblicazione: (2025)
di: Hou, Xiaolu, et al.
Pubblicazione: (2025)
PhyScene: Physically Interactable 3D Scene Synthesis for Embodied AI
di: Yang, Yandan, et al.
Pubblicazione: (2024)
di: Yang, Yandan, et al.
Pubblicazione: (2024)
ED-NeRF: Efficient Text-Guided Editing of 3D Scene with Latent Space NeRF
di: Park, Jangho, et al.
Pubblicazione: (2023)
di: Park, Jangho, et al.
Pubblicazione: (2023)
SceneFoundry: Generating Interactive Infinite 3D Worlds
di: Chen, ChunTeng, et al.
Pubblicazione: (2026)
di: Chen, ChunTeng, et al.
Pubblicazione: (2026)
SceneVerse: Scaling 3D Vision-Language Learning for Grounded Scene Understanding
di: Jia, Baoxiong, et al.
Pubblicazione: (2024)
di: Jia, Baoxiong, et al.
Pubblicazione: (2024)
Neural Assets: 3D-Aware Multi-Object Scene Synthesis with Image Diffusion Models
di: Wu, Ziyi, et al.
Pubblicazione: (2024)
di: Wu, Ziyi, et al.
Pubblicazione: (2024)
GSNeRF: Generalizable Semantic Neural Radiance Fields with Enhanced 3D Scene Understanding
di: Chou, Zi-Ting, et al.
Pubblicazione: (2024)
di: Chou, Zi-Ting, et al.
Pubblicazione: (2024)
D$^3$epth: Self-Supervised Depth Estimation with Dynamic Mask in Dynamic Scenes
di: Chen, Siyu, et al.
Pubblicazione: (2024)
di: Chen, Siyu, et al.
Pubblicazione: (2024)
Curvature-Aware Captioning:Leveraging Geodesic Attention for 3D Scene Understanding
di: He, Ziyao, et al.
Pubblicazione: (2026)
di: He, Ziyao, et al.
Pubblicazione: (2026)
RealmDreamer: Text-Driven 3D Scene Generation with Inpainting and Depth Diffusion
di: Shriram, Jaidev, et al.
Pubblicazione: (2024)
di: Shriram, Jaidev, et al.
Pubblicazione: (2024)
DimensionX: Create Any 3D and 4D Scenes from a Single Image with Controllable Video Diffusion
di: Sun, Wenqiang, et al.
Pubblicazione: (2024)
di: Sun, Wenqiang, et al.
Pubblicazione: (2024)
Flame3D: Zero-shot Compositional Reasoning of 3D Scenes with Agentic Language Models
di: Bharadwaj, Sagar, et al.
Pubblicazione: (2026)
di: Bharadwaj, Sagar, et al.
Pubblicazione: (2026)
SceneCraft: An LLM Agent for Synthesizing 3D Scene as Blender Code
di: Hu, Ziniu, et al.
Pubblicazione: (2024)
di: Hu, Ziniu, et al.
Pubblicazione: (2024)
Hardness-Aware Scene Synthesis for Semi-Supervised 3D Object Detection
di: Zeng, Shuai, et al.
Pubblicazione: (2024)
di: Zeng, Shuai, et al.
Pubblicazione: (2024)
Scaling 4D Representations
di: Carreira, João, et al.
Pubblicazione: (2024)
di: Carreira, João, et al.
Pubblicazione: (2024)
Uni4D: Unifying Visual Foundation Models for 4D Modeling from a Single Video
di: Yao, David Yifan, et al.
Pubblicazione: (2025)
di: Yao, David Yifan, et al.
Pubblicazione: (2025)
Any4D: Unified Feed-Forward Metric 4D Reconstruction
di: Karhade, Jay, et al.
Pubblicazione: (2025)
di: Karhade, Jay, et al.
Pubblicazione: (2025)
RoboLayout: Differentiable 3D Scene Generation for Embodied Agents
di: Shamsaddinlou, Ali
Pubblicazione: (2026)
di: Shamsaddinlou, Ali
Pubblicazione: (2026)
PAPR in Motion: Seamless Point-level 3D Scene Interpolation
di: Peng, Shichong, et al.
Pubblicazione: (2024)
di: Peng, Shichong, et al.
Pubblicazione: (2024)
MetaScenes: Towards Automated Replica Creation for Real-world 3D Scans
di: Yu, Huangyue, et al.
Pubblicazione: (2025)
di: Yu, Huangyue, et al.
Pubblicazione: (2025)
MMGDreamer: Mixed-Modality Graph for Geometry-Controllable 3D Indoor Scene Generation
di: Yang, Zhifei, et al.
Pubblicazione: (2025)
di: Yang, Zhifei, et al.
Pubblicazione: (2025)
Genie 4D: Semantic-Prior-Guided 4D Dynamic Scene Reconstruction
di: Yang, Yiru, et al.
Pubblicazione: (2026)
di: Yang, Yiru, et al.
Pubblicazione: (2026)
Evaluating Modern Approaches in 3D Scene Reconstruction: NeRF vs Gaussian-Based Methods
di: Zhou, Yiming, et al.
Pubblicazione: (2024)
di: Zhou, Yiming, et al.
Pubblicazione: (2024)
Cross-Domain Synthetic-to-Real In-the-Wild Depth and Normal Estimation for 3D Scene Understanding
di: Bhanushali, Jay, et al.
Pubblicazione: (2022)
di: Bhanushali, Jay, et al.
Pubblicazione: (2022)
EmbodiedOcc: Embodied 3D Occupancy Prediction for Vision-based Online Scene Understanding
di: Wu, Yuqi, et al.
Pubblicazione: (2024)
di: Wu, Yuqi, et al.
Pubblicazione: (2024)
6Img-to-3D: Few-Image Large-Scale Outdoor Driving Scene Reconstruction
di: Gieruc, Théo, et al.
Pubblicazione: (2024)
di: Gieruc, Théo, et al.
Pubblicazione: (2024)
TrueCity: Real and Simulated Urban Data for Cross-Domain 3D Scene Understanding
di: Nguyen, Duc, et al.
Pubblicazione: (2025)
di: Nguyen, Duc, et al.
Pubblicazione: (2025)
LatentEditor: Text Driven Local Editing of 3D Scenes
di: Khalid, Umar, et al.
Pubblicazione: (2023)
di: Khalid, Umar, et al.
Pubblicazione: (2023)
Documenti analoghi
-
ConsistDreamer: 3D-Consistent 2D Diffusion for High-Fidelity Scene Editing
di: Chen, Jun-Kun, et al.
Pubblicazione: (2024) -
2D-3D Interlaced Transformer for Point Cloud Segmentation with Scene-Level Supervision
di: Yang, Cheng-Kun, et al.
Pubblicazione: (2023) -
PaintScene4D: Consistent 4D Scene Generation from Text Prompts
di: Gupta, Vinayak, et al.
Pubblicazione: (2024) -
3D Diffuser Actor: Policy Diffusion with 3D Scene Representations
di: Ke, Tsung-Wei, et al.
Pubblicazione: (2024) -
SceneTok: A Compressed, Diffusable Token Space for 3D Scenes
di: Asim, Mohammad, et al.
Pubblicazione: (2026)