DOME: Taming Diffusion Model into High-Fidelity Controllable Occupancy World Model
Fuente:
arXiv
Guardado en:
| Autores principales: | Gu, Songen, Yin, Wei, Jin, Bu, Guo, Xiaoyang, Wang, Junming, Li, Haodong, Zhang, Qian, Long, Xiaoxiao |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
OccTENS: 3D Occupancy World Model via Temporal Next-Scale Prediction
por: Jin, Bu, et al.
Publicado: (2025)
por: Jin, Bu, et al.
Publicado: (2025)
OccRWKV: Rethinking Efficient 3D Semantic Occupancy Prediction with Linear Complexity
por: Wang, Junming, et al.
Publicado: (2024)
por: Wang, Junming, et al.
Publicado: (2024)
ComDrive: Comfort-Oriented End-to-End Autonomous Driving
por: Wang, Junming, et al.
Publicado: (2024)
por: Wang, Junming, et al.
Publicado: (2024)
DrivingWorld: Constructing World Model for Autonomous Driving via Video GPT
por: Hu, Xiaotao, et al.
Publicado: (2024)
por: Hu, Xiaotao, et al.
Publicado: (2024)
Epona: Autoregressive Diffusion World Model for Autonomous Driving
por: Zhang, Kaiwen, et al.
Publicado: (2025)
por: Zhang, Kaiwen, et al.
Publicado: (2025)
MonoOcc: Digging into Monocular Semantic Occupancy Prediction
por: Zheng, Yupeng, et al.
Publicado: (2024)
por: Zheng, Yupeng, et al.
Publicado: (2024)
Occupancy World Model for Robots
por: Zhang, Zhang, et al.
Publicado: (2025)
por: Zhang, Zhang, et al.
Publicado: (2025)
FideDiff: Efficient Diffusion Model for High-Fidelity Image Motion Deblurring
por: Liu, Xiaoyang, et al.
Publicado: (2025)
por: Liu, Xiaoyang, et al.
Publicado: (2025)
OCCDiff: Occupancy Diffusion Model for High-Fidelity 3D Building Reconstruction from Noisy Point Clouds
por: Sui, Jialu, et al.
Publicado: (2025)
por: Sui, Jialu, et al.
Publicado: (2025)
ControlSR: Taming Diffusion Models for Consistent Real-World Image Super Resolution
por: Wan, Yuhao, et al.
Publicado: (2024)
por: Wan, Yuhao, et al.
Publicado: (2024)
High-Fidelity Relightable Monocular Portrait Animation with Lighting-Controllable Video Diffusion Model
por: Guo, Mingtao, et al.
Publicado: (2025)
por: Guo, Mingtao, et al.
Publicado: (2025)
Driving in the Occupancy World: Vision-Centric 4D Occupancy Forecasting and Planning via World Models for Autonomous Driving
por: Yang, Yu, et al.
Publicado: (2024)
por: Yang, Yu, et al.
Publicado: (2024)
UniArt: Unified 3D Representation for Generating 3D Articulated Objects with Open-Set Articulation
por: Jin, Bu, et al.
Publicado: (2025)
por: Jin, Bu, et al.
Publicado: (2025)
SparseWorld-TC: Trajectory-Conditioned Sparse Occupancy World Model
por: Du, Jiayuan, et al.
Publicado: (2025)
por: Du, Jiayuan, et al.
Publicado: (2025)
SynthDrive: Scalable Real2Sim2Real Sensor Simulation Pipeline for High-Fidelity Asset Generation and Driving Data Synthesis
por: Chen, Zhengqing, et al.
Publicado: (2025)
por: Chen, Zhengqing, et al.
Publicado: (2025)
COME: Adding Scene-Centric Forecasting Control to Occupancy World Model
por: Shi, Yining, et al.
Publicado: (2025)
por: Shi, Yining, et al.
Publicado: (2025)
Taming Sampling Perturbations with Variance Expansion Loss for Latent Diffusion Models
por: Li, Qifan, et al.
Publicado: (2026)
por: Li, Qifan, et al.
Publicado: (2026)
Text2Street: Controllable Text-to-image Generation for Street Views
por: Su, Jinming, et al.
Publicado: (2024)
por: Su, Jinming, et al.
Publicado: (2024)
DreamVAR: Taming Reinforced Visual Autoregressive Model for High-Fidelity Subject-Driven Image Generation
por: Jiang, Xin, et al.
Publicado: (2026)
por: Jiang, Xin, et al.
Publicado: (2026)
Taming Diffusion Probabilistic Models for Character Control
por: Chen, Rui, et al.
Publicado: (2024)
por: Chen, Rui, et al.
Publicado: (2024)
DiT4SR: Taming Diffusion Transformer for Real-World Image Super-Resolution
por: Duan, Zheng-Peng, et al.
Publicado: (2025)
por: Duan, Zheng-Peng, et al.
Publicado: (2025)
Structure-Guided Diffusion Models for High-Fidelity Portrait Shadow Removal
por: Yu, Wanchang, et al.
Publicado: (2025)
por: Yu, Wanchang, et al.
Publicado: (2025)
SGDFuse: SAM-Guided Diffusion Model for High-Fidelity Infrared and Visible Image Fusion
por: Zhang, Xiaoyang, et al.
Publicado: (2025)
por: Zhang, Xiaoyang, et al.
Publicado: (2025)
FrequencyBooster: Full-Frequency Modeling for High-Fidelity Pixel Diffusion
por: Ma, Lichen, et al.
Publicado: (2026)
por: Ma, Lichen, et al.
Publicado: (2026)
Composing Driving Worlds through Disentangled Control for Adversarial Scenario Generation
por: Zhan, Yifan, et al.
Publicado: (2026)
por: Zhan, Yifan, et al.
Publicado: (2026)
Boost 3D Reconstruction using Diffusion-based Monocular Camera Calibration
por: Deng, Junyuan, et al.
Publicado: (2024)
por: Deng, Junyuan, et al.
Publicado: (2024)
Navigating Large-Pose Challenge for High-Fidelity Face Reenactment with Video Diffusion Model
por: Guo, Mingtao, et al.
Publicado: (2025)
por: Guo, Mingtao, et al.
Publicado: (2025)
MuDG: Taming Multi-modal Diffusion with Gaussian Splatting for Urban Scene Reconstruction
por: Zou, Yingshuang, et al.
Publicado: (2025)
por: Zou, Yingshuang, et al.
Publicado: (2025)
Texture-Preserving Diffusion Models for High-Fidelity Virtual Try-On
por: Yang, Xu, et al.
Publicado: (2024)
por: Yang, Xu, et al.
Publicado: (2024)
RodinHD: High-Fidelity 3D Avatar Generation with Diffusion Models
por: Zhang, Bowen, et al.
Publicado: (2024)
por: Zhang, Bowen, et al.
Publicado: (2024)
Lotus: Diffusion-based Visual Foundation Model for High-quality Dense Prediction
por: He, Jing, et al.
Publicado: (2024)
por: He, Jing, et al.
Publicado: (2024)
Vista: A Generalizable Driving World Model with High Fidelity and Versatile Controllability
por: Gao, Shenyuan, et al.
Publicado: (2024)
por: Gao, Shenyuan, et al.
Publicado: (2024)
ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis
por: Yu, Wangbo, et al.
Publicado: (2024)
por: Yu, Wangbo, et al.
Publicado: (2024)
Taming Diffusion Models for Image Restoration: A Review
por: Luo, Ziwei, et al.
Publicado: (2024)
por: Luo, Ziwei, et al.
Publicado: (2024)
DiP: Taming Diffusion Models in Pixel Space
por: Chen, Zhennan, et al.
Publicado: (2025)
por: Chen, Zhennan, et al.
Publicado: (2025)
High-Fidelity Diffusion-based Image Editing
por: Hou, Chen, et al.
Publicado: (2023)
por: Hou, Chen, et al.
Publicado: (2023)
Semi-Supervised Vision-Centric 3D Occupancy World Model for Autonomous Driving
por: Li, Xiang, et al.
Publicado: (2025)
por: Li, Xiang, et al.
Publicado: (2025)
MoDiTalker: Motion-Disentangled Diffusion Model for High-Fidelity Talking Head Generation
por: Kim, Seyeon, et al.
Publicado: (2024)
por: Kim, Seyeon, et al.
Publicado: (2024)
Topology Sculptor, Shape Refiner: Discrete Diffusion Model for High-Fidelity 3D Meshes Generation
por: Song, Kaiyu, et al.
Publicado: (2025)
por: Song, Kaiyu, et al.
Publicado: (2025)
Zero-1-to-G: Taming Pretrained 2D Diffusion Model for Direct 3D Generation
por: Meng, Xuyi, et al.
Publicado: (2025)
por: Meng, Xuyi, et al.
Publicado: (2025)
Ejemplares similares
-
OccTENS: 3D Occupancy World Model via Temporal Next-Scale Prediction
por: Jin, Bu, et al.
Publicado: (2025) -
OccRWKV: Rethinking Efficient 3D Semantic Occupancy Prediction with Linear Complexity
por: Wang, Junming, et al.
Publicado: (2024) -
ComDrive: Comfort-Oriented End-to-End Autonomous Driving
por: Wang, Junming, et al.
Publicado: (2024) -
DrivingWorld: Constructing World Model for Autonomous Driving via Video GPT
por: Hu, Xiaotao, et al.
Publicado: (2024) -
Epona: Autoregressive Diffusion World Model for Autonomous Driving
por: Zhang, Kaiwen, et al.
Publicado: (2025)