GaussianFormer-2: Probabilistic Gaussian Superposition for Efficient 3D Occupancy Prediction
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Huang, Yuanhui, Thammatadatrakoon, Amonnut, Zheng, Wenzhao, Zhang, Yunpeng, Du, Dalong, Lu, Jiwen |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
GaussianFormer: Scene as Gaussians for Vision-Based 3D Semantic Occupancy Prediction
par: Huang, Yuanhui, et autres
Publié: (2024)
par: Huang, Yuanhui, et autres
Publié: (2024)
GaussianWorld: Gaussian World Model for Streaming 3D Occupancy Prediction
par: Zuo, Sicheng, et autres
Publié: (2024)
par: Zuo, Sicheng, et autres
Publié: (2024)
GaussianFormer3D: Multi-Modal Gaussian-based Semantic Occupancy Prediction with 3D Deformable Attention
par: Zhao, Lingjun, et autres
Publié: (2025)
par: Zhao, Lingjun, et autres
Publié: (2025)
EmbodiedOcc: Embodied 3D Occupancy Prediction for Vision-based Online Scene Understanding
par: Wu, Yuqi, et autres
Publié: (2024)
par: Wu, Yuqi, et autres
Publié: (2024)
QuadricFormer: Scene as Superquadrics for 3D Semantic Occupancy Prediction
par: Zuo, Sicheng, et autres
Publié: (2025)
par: Zuo, Sicheng, et autres
Publié: (2025)
GaussianToken: An Effective Image Tokenizer with 2D Gaussian Splatting
par: Dong, Jiajun, et autres
Publié: (2025)
par: Dong, Jiajun, et autres
Publié: (2025)
PixelGaussian: Generalizable 3D Gaussian Reconstruction from Arbitrary Views
par: Fei, Xin, et autres
Publié: (2024)
par: Fei, Xin, et autres
Publié: (2024)
Terra: Explorable Native 3D World Model with Point Latents
par: Huang, Yuanhui, et autres
Publié: (2025)
par: Huang, Yuanhui, et autres
Publié: (2025)
DrivingRecon: Large 4D Gaussian Reconstruction Model For Autonomous Driving
par: Lu, Hao, et autres
Publié: (2024)
par: Lu, Hao, et autres
Publié: (2024)
GPD-1: Generative Pre-training for Driving
par: Xie, Zixun, et autres
Publié: (2024)
par: Xie, Zixun, et autres
Publié: (2024)
OccSora: 4D Occupancy Generation Models as World Simulators for Autonomous Driving
par: Wang, Lening, et autres
Publié: (2024)
par: Wang, Lening, et autres
Publié: (2024)
SpectralAR: Spectral Autoregressive Visual Generation
par: Huang, Yuanhui, et autres
Publié: (2025)
par: Huang, Yuanhui, et autres
Publié: (2025)
Doe-1: Closed-Loop Autonomous Driving with Large World Model
par: Zheng, Wenzhao, et autres
Publié: (2024)
par: Zheng, Wenzhao, et autres
Publié: (2024)
S2GO: Streaming Sparse Gaussian Occupancy Prediction
par: Park, Jinhyung, et autres
Publié: (2025)
par: Park, Jinhyung, et autres
Publié: (2025)
V2M: Visual 2-Dimensional Mamba for Image Representation Learning
par: Wang, Chengkun, et autres
Publié: (2024)
par: Wang, Chengkun, et autres
Publié: (2024)
Stag-1: Towards Realistic 4D Driving Simulation with Video Generation Model
par: Wang, Lening, et autres
Publié: (2024)
par: Wang, Lening, et autres
Publié: (2024)
Point3R: Streaming 3D Reconstruction with Explicit Spatial Pointer Memory
par: Wu, Yuqi, et autres
Publié: (2025)
par: Wu, Yuqi, et autres
Publié: (2025)
Hardness-Aware Scene Synthesis for Semi-Supervised 3D Object Detection
par: Zeng, Shuai, et autres
Publié: (2024)
par: Zeng, Shuai, et autres
Publié: (2024)
$\textit{S}^3$Gaussian: Self-Supervised Street Gaussians for Autonomous Driving
par: Huang, Nan, et autres
Publié: (2024)
par: Huang, Nan, et autres
Publié: (2024)
OGGSplat: Open Gaussian Growing for Generalizable Reconstruction with Expanded Field-of-View
par: Wang, Yanbo, et autres
Publié: (2025)
par: Wang, Yanbo, et autres
Publié: (2025)
GSRender: Deduplicated Occupancy Prediction via Weakly Supervised 3D Gaussian Splatting
par: Sun, Qianpu, et autres
Publié: (2024)
par: Sun, Qianpu, et autres
Publié: (2024)
UniPre3D: Unified Pre-training of 3D Point Cloud Models with Cross-Modal Gaussian Splatting
par: Wang, Ziyi, et autres
Publié: (2025)
par: Wang, Ziyi, et autres
Publié: (2025)
Owl-1: Omni World Model for Consistent Long Video Generation
par: Huang, Yuanhui, et autres
Publié: (2024)
par: Huang, Yuanhui, et autres
Publié: (2024)
SliceOcc: Indoor 3D Semantic Occupancy Prediction with Vertical Slice Representation
par: Li, Jianing, et autres
Publié: (2025)
par: Li, Jianing, et autres
Publié: (2025)
OG-Gaussian: Occupancy Based Street Gaussians for Autonomous Driving
par: Shen, Yedong, et autres
Publié: (2025)
par: Shen, Yedong, et autres
Publié: (2025)
$\bf{D^3}$QE: Learning Discrete Distribution Discrepancy-aware Quantization Error for Autoregressive-Generated Image Detection
par: Zhang, Yanran, et autres
Publié: (2025)
par: Zhang, Yanran, et autres
Publié: (2025)
SceneCompleter: Dense 3D Scene Completion for Generative Novel View Synthesis
par: Chen, Weiliang, et autres
Publié: (2025)
par: Chen, Weiliang, et autres
Publié: (2025)
Progressive Gaussian Transformer with Anisotropy-aware Sampling for Open Vocabulary Occupancy Prediction
par: Yan, Chi, et autres
Publié: (2025)
par: Yan, Chi, et autres
Publié: (2025)
NeuroGauss4D-PCI: 4D Neural Fields and Gaussian Deformation Fields for Point Cloud Interpolation
par: Jiang, Chaokang, et autres
Publié: (2024)
par: Jiang, Chaokang, et autres
Publié: (2024)
Moaw: Unleashing Motion Awareness for Video Diffusion Models
par: Zhang, Tianqi, et autres
Publié: (2026)
par: Zhang, Tianqi, et autres
Publié: (2026)
Latent Gaussian Splatting for 4D Panoptic Occupancy Tracking
par: Luz, Maximilian, et autres
Publié: (2026)
par: Luz, Maximilian, et autres
Publié: (2026)
GaussianOcc3D: A Gaussian-Based Adaptive Multi-modal 3D Occupancy Prediction
par: Doruk, A. Enes, et autres
Publié: (2026)
par: Doruk, A. Enes, et autres
Publié: (2026)
GaussianOcc: Fully Self-supervised and Efficient 3D Occupancy Estimation with Gaussian Splatting
par: Gan, Wanshui, et autres
Publié: (2024)
par: Gan, Wanshui, et autres
Publié: (2024)
ThermalGaussian: Thermal 3D Gaussian Splatting
par: Lu, Rongfeng, et autres
Publié: (2024)
par: Lu, Rongfeng, et autres
Publié: (2024)
GraphGSOcc: Semantic-Geometric Graph Transformer with Dynamic-Static Decoupling for 3D Gaussian Splatting-based Occupancy Prediction
par: Song, Ke, et autres
Publié: (2025)
par: Song, Ke, et autres
Publié: (2025)
Streaming 4D Visual Geometry Transformer
par: Zhuo, Dong, et autres
Publié: (2025)
par: Zhuo, Dong, et autres
Publié: (2025)
Driv3R: Learning Dense 4D Reconstruction for Autonomous Driving
par: Fei, Xin, et autres
Publié: (2024)
par: Fei, Xin, et autres
Publié: (2024)
Pseudo Depth Meets Gaussian: A Feed-forward RGB SLAM Baseline
par: Zhao, Linqing, et autres
Publié: (2025)
par: Zhao, Linqing, et autres
Publié: (2025)
Vega: Learning to Drive with Natural Language Instructions
par: Zuo, Sicheng, et autres
Publié: (2026)
par: Zuo, Sicheng, et autres
Publié: (2026)
Joint 3D Geometry Reconstruction and Motion Generation for 4D Synthesis from a Single Image
par: Zhang, Yanran, et autres
Publié: (2025)
par: Zhang, Yanran, et autres
Publié: (2025)
Documents similaires
-
GaussianFormer: Scene as Gaussians for Vision-Based 3D Semantic Occupancy Prediction
par: Huang, Yuanhui, et autres
Publié: (2024) -
GaussianWorld: Gaussian World Model for Streaming 3D Occupancy Prediction
par: Zuo, Sicheng, et autres
Publié: (2024) -
GaussianFormer3D: Multi-Modal Gaussian-based Semantic Occupancy Prediction with 3D Deformable Attention
par: Zhao, Lingjun, et autres
Publié: (2025) -
EmbodiedOcc: Embodied 3D Occupancy Prediction for Vision-based Online Scene Understanding
par: Wu, Yuqi, et autres
Publié: (2024) -
QuadricFormer: Scene as Superquadrics for 3D Semantic Occupancy Prediction
par: Zuo, Sicheng, et autres
Publié: (2025)