SSEditor: Controllable Mask-to-Scene Generation with Diffusion Model
Fuente:
arXiv
Guardado en:
| Autores principales: | Zheng, Haowen, Liang, Yanyan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Distilling Future Temporal Knowledge with Masked Feature Reconstruction for 3D Object Detection
por: Zheng, Haowen, et al.
Publicado: (2025)
por: Zheng, Haowen, et al.
Publicado: (2025)
SceneRAG: Scene-level Retrieval-Augmented Generation for Video Understanding
por: Zeng, Nianbo, et al.
Publicado: (2025)
por: Zeng, Nianbo, et al.
Publicado: (2025)
MVRoom: Controllable 3D Indoor Scene Generation with Multi-View Diffusion Models
por: Fang, Shaoheng, et al.
Publicado: (2025)
por: Fang, Shaoheng, et al.
Publicado: (2025)
ReconX: Reconstruct Any Scene from Sparse Views with Video Diffusion Model
por: Liu, Fangfu, et al.
Publicado: (2024)
por: Liu, Fangfu, et al.
Publicado: (2024)
Controllable Coupled Image Generation via Diffusion Models
por: Yuan, Chenfei, et al.
Publicado: (2025)
por: Yuan, Chenfei, et al.
Publicado: (2025)
HetScene: Heterogeneity-Aware Diffusion for Dense Indoor Scene Generation
por: Chen, Zini, et al.
Publicado: (2026)
por: Chen, Zini, et al.
Publicado: (2026)
Scene Splatter: Momentum 3D Scene Generation from Single Image with Video Diffusion Model
por: Zhang, Shengjun, et al.
Publicado: (2025)
por: Zhang, Shengjun, et al.
Publicado: (2025)
Masked Scene Modeling: Narrowing the Gap Between Supervised and Self-Supervised Learning in 3D Scene Understanding
por: Hermosilla, Pedro, et al.
Publicado: (2025)
por: Hermosilla, Pedro, et al.
Publicado: (2025)
SceneX: Procedural Controllable Large-scale Scene Generation
por: Zhou, Mengqi, et al.
Publicado: (2024)
por: Zhou, Mengqi, et al.
Publicado: (2024)
SceneAdapt: Scene-aware Adaptation of Human Motion Diffusion
por: Cho, Jungbin, et al.
Publicado: (2025)
por: Cho, Jungbin, et al.
Publicado: (2025)
Multi-Style Facial Sketch Synthesis through Masked Generative Modeling
por: Sun, Bowen, et al.
Publicado: (2024)
por: Sun, Bowen, et al.
Publicado: (2024)
BeyondScene: Higher-Resolution Human-Centric Scene Generation With Pretrained Diffusion
por: Kim, Gwanghyun, et al.
Publicado: (2024)
por: Kim, Gwanghyun, et al.
Publicado: (2024)
Fast Training of Diffusion Models with Masked Transformers
por: Zheng, Hongkai, et al.
Publicado: (2023)
por: Zheng, Hongkai, et al.
Publicado: (2023)
MarDini: Masked Autoregressive Diffusion for Video Generation at Scale
por: Liu, Haozhe, et al.
Publicado: (2024)
por: Liu, Haozhe, et al.
Publicado: (2024)
Towards Realistic Scene Generation with LiDAR Diffusion Models
por: Ran, Haoxi, et al.
Publicado: (2024)
por: Ran, Haoxi, et al.
Publicado: (2024)
MacDiff: Unified Skeleton Modeling with Masked Conditional Diffusion
por: Wu, Lehong, et al.
Publicado: (2024)
por: Wu, Lehong, et al.
Publicado: (2024)
InteractMove: Text-Controlled Human-Object Interaction Generation in 3D Scenes with Movable Objects
por: Cai, Xinhao, et al.
Publicado: (2025)
por: Cai, Xinhao, et al.
Publicado: (2025)
Skip Mamba Diffusion for Monocular 3D Semantic Scene Completion
por: Liang, Li, et al.
Publicado: (2025)
por: Liang, Li, et al.
Publicado: (2025)
Paired Image Generation with Diffusion-Guided Diffusion Models
por: Zhang, Haoxuan, et al.
Publicado: (2025)
por: Zhang, Haoxuan, et al.
Publicado: (2025)
Range-Edit: Semantic Mask Guided Outdoor LiDAR Scene Editing
por: Uppur, Suchetan G., et al.
Publicado: (2025)
por: Uppur, Suchetan G., et al.
Publicado: (2025)
Promptable Game Models: Text-Guided Game Simulation via Masked Diffusion Models
por: Menapace, Willi, et al.
Publicado: (2023)
por: Menapace, Willi, et al.
Publicado: (2023)
Revisit Human-Scene Interaction via Space Occupancy
por: Liu, Xinpeng, et al.
Publicado: (2023)
por: Liu, Xinpeng, et al.
Publicado: (2023)
BetterScene: 3D Scene Synthesis with Representation-Aligned Generative Model
por: Han, Yuci, et al.
Publicado: (2026)
por: Han, Yuci, et al.
Publicado: (2026)
MCGM: Mask Conditional Text-to-Image Generative Model
por: Skaik, Rami, et al.
Publicado: (2024)
por: Skaik, Rami, et al.
Publicado: (2024)
Dynamic Entity-Masked Graph Diffusion Model for histopathological image Representation Learning
por: Zhuang, Zhenfeng, et al.
Publicado: (2024)
por: Zhuang, Zhenfeng, et al.
Publicado: (2024)
Heterogeneous Generative Knowledge Distillation with Masked Image Modeling
por: Wang, Ziming, et al.
Publicado: (2023)
por: Wang, Ziming, et al.
Publicado: (2023)
Universal Fingerprint Generation: Controllable Diffusion Model with Multimodal Conditions
por: Grosz, Steven A., et al.
Publicado: (2024)
por: Grosz, Steven A., et al.
Publicado: (2024)
Resource-Efficient Motion Control for Video Generation via Dynamic Mask Guidance
por: Feng, Sicong, et al.
Publicado: (2025)
por: Feng, Sicong, et al.
Publicado: (2025)
4D3R: Motion-Aware Neural Reconstruction and Rendering of Dynamic Scenes from Monocular Videos
por: Guo, Mengqi, et al.
Publicado: (2025)
por: Guo, Mengqi, et al.
Publicado: (2025)
PersonaCraft: Personalized and Controllable Full-Body Multi-Human Scene Generation Using Occlusion-Aware 3D-Conditioned Diffusion
por: Kim, Gwanghyun, et al.
Publicado: (2024)
por: Kim, Gwanghyun, et al.
Publicado: (2024)
3D-SceneDreamer: Text-Driven 3D-Consistent Scene Generation
por: Zhang, Frank, et al.
Publicado: (2024)
por: Zhang, Frank, et al.
Publicado: (2024)
Multivariate Diffusion Transformer with Decoupled Attention for High-Fidelity Mask-Text Collaborative Facial Generation
por: Cao, Yushe, et al.
Publicado: (2025)
por: Cao, Yushe, et al.
Publicado: (2025)
MuseFace: Text-driven Face Editing via Diffusion-based Mask Generation Approach
por: Zhang, Xin, et al.
Publicado: (2025)
por: Zhang, Xin, et al.
Publicado: (2025)
RoomCraft: Controllable and Complete 3D Indoor Scene Generation
por: Zhou, Mengqi, et al.
Publicado: (2025)
por: Zhou, Mengqi, et al.
Publicado: (2025)
S2DM: Sector-Shaped Diffusion Models for Video Generation
por: Lang, Haoran, et al.
Publicado: (2024)
por: Lang, Haoran, et al.
Publicado: (2024)
Look Beyond: Two-Stage Scene View Generation via Panorama and Video Diffusion
por: Kang, Xueyang, et al.
Publicado: (2025)
por: Kang, Xueyang, et al.
Publicado: (2025)
MOFA-Video: Controllable Image Animation via Generative Motion Field Adaptions in Frozen Image-to-Video Diffusion Model
por: Niu, Muyao, et al.
Publicado: (2024)
por: Niu, Muyao, et al.
Publicado: (2024)
CoProSketch: Controllable and Progressive Sketch Generation with Diffusion Model
por: Zhan, Ruohao, et al.
Publicado: (2025)
por: Zhan, Ruohao, et al.
Publicado: (2025)
Masking Matters: Unlocking the Spatial Reasoning Capabilities of LLMs for 3D Scene-Language Understanding
por: Jeon, Yerim, et al.
Publicado: (2025)
por: Jeon, Yerim, et al.
Publicado: (2025)
Image Synthesis with Class-Aware Semantic Diffusion Models for Surgical Scene Segmentation
por: Zhou, Yihang, et al.
Publicado: (2024)
por: Zhou, Yihang, et al.
Publicado: (2024)
Ejemplares similares
-
Distilling Future Temporal Knowledge with Masked Feature Reconstruction for 3D Object Detection
por: Zheng, Haowen, et al.
Publicado: (2025) -
SceneRAG: Scene-level Retrieval-Augmented Generation for Video Understanding
por: Zeng, Nianbo, et al.
Publicado: (2025) -
MVRoom: Controllable 3D Indoor Scene Generation with Multi-View Diffusion Models
por: Fang, Shaoheng, et al.
Publicado: (2025) -
ReconX: Reconstruct Any Scene from Sparse Views with Video Diffusion Model
por: Liu, Fangfu, et al.
Publicado: (2024) -
Controllable Coupled Image Generation via Diffusion Models
por: Yuan, Chenfei, et al.
Publicado: (2025)