Urban Scene Diffusion through Semantic Occupancy Map
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhang, Junge, Zhang, Qihang, Zhang, Li, Kompella, Ramana Rao, Liu, Gaowen, Zhou, Bolei |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Targeted Forgetting of Image Subgroups in CLIP Models
por: Zhang, Zeliang, et al.
Publicado: (2025)
por: Zhang, Zeliang, et al.
Publicado: (2025)
Efficient Multitask Dense Predictor via Binarization
por: Shang, Yuzhang, et al.
Publicado: (2024)
por: Shang, Yuzhang, et al.
Publicado: (2024)
Training-Free Semantic Segmentation via LLM-Supervision
por: Sun, Wenfang, et al.
Publicado: (2024)
por: Sun, Wenfang, et al.
Publicado: (2024)
Orientation-anchored Hyper-Gaussian for 4D Reconstruction from Casual Videos
por: Wu, Junyi, et al.
Publicado: (2025)
por: Wu, Junyi, et al.
Publicado: (2025)
Motion Marionette: Rethinking Rigid Motion Transfer via Prior Guidance
por: Wang, Haoxuan, et al.
Publicado: (2025)
por: Wang, Haoxuan, et al.
Publicado: (2025)
UnlearnCanvas: Stylized Image Dataset for Enhanced Machine Unlearning Evaluation in Diffusion Models
por: Zhang, Yihua, et al.
Publicado: (2024)
por: Zhang, Yihua, et al.
Publicado: (2024)
SwiftNDC: Fast Neural Depth Correction for High-Fidelity 3D Reconstruction
por: Han, Kang, et al.
Publicado: (2026)
por: Han, Kang, et al.
Publicado: (2026)
GIFSplat: Generative Prior-Guided Iterative Feed-Forward 3D Gaussian Splatting from Sparse Views
por: Chen, Tianyu, et al.
Publicado: (2026)
por: Chen, Tianyu, et al.
Publicado: (2026)
Prompt Diffusion Robustifies Any-Modality Prompt Learning
por: Du, Yingjun, et al.
Publicado: (2024)
por: Du, Yingjun, et al.
Publicado: (2024)
Vision Verification Enhanced Fusion of VLMs for Efficient Visual Reasoning
por: Tekin, Selim Furkan, et al.
Publicado: (2026)
por: Tekin, Selim Furkan, et al.
Publicado: (2026)
A Neurosymbolic Agent System for Compositional Visual Reasoning
por: Xu, Yichang, et al.
Publicado: (2025)
por: Xu, Yichang, et al.
Publicado: (2025)
3DitScene: Editing Any Scene via Language-guided Disentangled Gaussian Splatting
por: Zhang, Qihang, et al.
Publicado: (2024)
por: Zhang, Qihang, et al.
Publicado: (2024)
Occupancy Learning with Spatiotemporal Memory
por: Leng, Ziyang, et al.
Publicado: (2025)
por: Leng, Ziyang, et al.
Publicado: (2025)
Spectrally Distilled Representations Aligned with Instruction-Augmented LLMs for Satellite Imagery
por: Do, Minh Kha, et al.
Publicado: (2026)
por: Do, Minh Kha, et al.
Publicado: (2026)
Attention-aware Inference Optimizations for Large Vision-Language Models with Memory-efficient Decoding
por: Ilhan, Fatih, et al.
Publicado: (2026)
por: Ilhan, Fatih, et al.
Publicado: (2026)
Human Motion Synthesis in 3D Scenes via Unified Scene Semantic Occupancy
por: Jingyu, Gong, et al.
Publicado: (2025)
por: Jingyu, Gong, et al.
Publicado: (2025)
UniScene: Unified Occupancy-centric Driving Scene Generation
por: Li, Bohan, et al.
Publicado: (2024)
por: Li, Bohan, et al.
Publicado: (2024)
COTR: Compact Occupancy TRansformer for Vision-based 3D Occupancy Prediction
por: Ma, Qihang, et al.
Publicado: (2023)
por: Ma, Qihang, et al.
Publicado: (2023)
A Multi-Agent Perception-Action Alliance for Efficient Long Video Reasoning
por: Xu, Yichang, et al.
Publicado: (2026)
por: Xu, Yichang, et al.
Publicado: (2026)
Monocular Open Vocabulary Occupancy Prediction for Indoor Scenes
por: Zhou, Changqing, et al.
Publicado: (2026)
por: Zhou, Changqing, et al.
Publicado: (2026)
LightPure: Realtime Adversarial Image Purification for Mobile Devices Using Diffusion Models
por: Khalili, Hossein, et al.
Publicado: (2024)
por: Khalili, Hossein, et al.
Publicado: (2024)
GaussianFormer: Scene as Gaussians for Vision-Based 3D Semantic Occupancy Prediction
por: Huang, Yuanhui, et al.
Publicado: (2024)
por: Huang, Yuanhui, et al.
Publicado: (2024)
Monocular Occupancy Prediction for Scalable Indoor Scenes
por: Yu, Hongxiao, et al.
Publicado: (2024)
por: Yu, Hongxiao, et al.
Publicado: (2024)
Uncertainty-Aware Diffusion Guided Refinement of 3D Scenes
por: Bose, Sarosij, et al.
Publicado: (2025)
por: Bose, Sarosij, et al.
Publicado: (2025)
SceneStreamer: Continuous Scenario Generation as Next Token Group Prediction
por: Peng, Zhenghao, et al.
Publicado: (2025)
por: Peng, Zhenghao, et al.
Publicado: (2025)
Diffusion-Occ: 3D Point Cloud Completion via Occupancy Diffusion
por: Zhang, Guoqing, et al.
Publicado: (2024)
por: Zhang, Guoqing, et al.
Publicado: (2024)
Joint Optimization for 4D Human-Scene Reconstruction in the Wild
por: Liu, Zhizheng, et al.
Publicado: (2025)
por: Liu, Zhizheng, et al.
Publicado: (2025)
Octree Diffusion for Semantic Scene Generation and Completion
por: Zhang, Xujia, et al.
Publicado: (2025)
por: Zhang, Xujia, et al.
Publicado: (2025)
HGS-Mapping: Online Dense Mapping Using Hybrid Gaussian Representation in Urban Scenes
por: Wu, Ke, et al.
Publicado: (2024)
por: Wu, Ke, et al.
Publicado: (2024)
VEOcc: Voxel-Centric Online Semantic Occupancy Prediction For Embodied Scene Understanding
por: Wang, Ruoyu, et al.
Publicado: (2026)
por: Wang, Ruoyu, et al.
Publicado: (2026)
UrbanGS: Semantic-Guided Gaussian Splatting for Urban Scene Reconstruction
por: Li, Ziwen, et al.
Publicado: (2024)
por: Li, Ziwen, et al.
Publicado: (2024)
OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation
por: Li, Bohan, et al.
Publicado: (2024)
por: Li, Bohan, et al.
Publicado: (2024)
QuadricFormer: Scene as Superquadrics for 3D Semantic Occupancy Prediction
por: Zuo, Sicheng, et al.
Publicado: (2025)
por: Zuo, Sicheng, et al.
Publicado: (2025)
World2Minecraft: Occupancy-Driven Simulated Scenes Construction
por: Zhang, Lechao, et al.
Publicado: (2026)
por: Zhang, Lechao, et al.
Publicado: (2026)
Towards Autonomous Micromobility through Scalable Urban Simulation
por: Wu, Wayne, et al.
Publicado: (2025)
por: Wu, Wayne, et al.
Publicado: (2025)
MonoOcc: Digging into Monocular Semantic Occupancy Prediction
por: Zheng, Yupeng, et al.
Publicado: (2024)
por: Zheng, Yupeng, et al.
Publicado: (2024)
LISNeRF Mapping: LiDAR-based Implicit Mapping via Semantic Neural Fields for Large-Scale 3D Scenes
por: Zhang, Jianyuan, et al.
Publicado: (2023)
por: Zhang, Jianyuan, et al.
Publicado: (2023)
OccMamba: Semantic Occupancy Prediction with State Space Models
por: Li, Heng, et al.
Publicado: (2024)
por: Li, Heng, et al.
Publicado: (2024)
Object Style Diffusion for Generalized Object Detection in Urban Scene
por: Li, Hao, et al.
Publicado: (2024)
por: Li, Hao, et al.
Publicado: (2024)
RayMap3R: Inference-Time RayMap for Dynamic 3D Reconstruction
por: Wang, Feiran, et al.
Publicado: (2026)
por: Wang, Feiran, et al.
Publicado: (2026)
Ejemplares similares
-
Targeted Forgetting of Image Subgroups in CLIP Models
por: Zhang, Zeliang, et al.
Publicado: (2025) -
Efficient Multitask Dense Predictor via Binarization
por: Shang, Yuzhang, et al.
Publicado: (2024) -
Training-Free Semantic Segmentation via LLM-Supervision
por: Sun, Wenfang, et al.
Publicado: (2024) -
Orientation-anchored Hyper-Gaussian for 4D Reconstruction from Casual Videos
por: Wu, Junyi, et al.
Publicado: (2025) -
Motion Marionette: Rethinking Rigid Motion Transfer via Prior Guidance
por: Wang, Haoxuan, et al.
Publicado: (2025)