VGGT-Occ: Geometry-Grounded and Density-Aware Gated Fusion for 3D Occupancy Prediction
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Chen, Xun, Deng, Tianchen, Wang, Rui, Wang, Fangjinhua, Ma, Junyi, Shen, Hongming, Wang, Hesheng, Wang, Danwei |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
UniPR-3D: Towards Universal Visual Place Recognition with Visual Geometry Grounded Transformer
par: Deng, Tianchen, et autres
Publié: (2025)
par: Deng, Tianchen, et autres
Publié: (2025)
Mamba-VGGT: Persistent Long-Sequence Video Geometry Grounded Transformer via External Sliding Window Mamba Memory
par: Deng, Tianchen, et autres
Publié: (2026)
par: Deng, Tianchen, et autres
Publié: (2026)
Reloc-VGGT: Visual Re-localization with Geometry Grounded Transformer
par: Deng, Tianchen, et autres
Publié: (2025)
par: Deng, Tianchen, et autres
Publié: (2025)
Gau-Occ: Geometry-Completed Gaussians for Multi-Modal 3D Occupancy Prediction
par: Lv, Chengxin, et autres
Publié: (2026)
par: Lv, Chengxin, et autres
Publié: (2026)
VPGS-SLAM: Voxel-based Progressive 3D Gaussian SLAM in Large-Scale Scenes
par: Deng, Tianchen, et autres
Publié: (2025)
par: Deng, Tianchen, et autres
Publié: (2025)
DA-Occ: Direction-Aware 2D Convolution for Efficient and Geometry-Preserving 3D Occupancy Prediction in Autonomous Driving
par: Zhou, Yuchen, et autres
Publié: (2025)
par: Zhou, Yuchen, et autres
Publié: (2025)
OccGen: Generative Multi-modal 3D Occupancy Prediction for Autonomous Driving
par: Wang, Guoqing, et autres
Publié: (2024)
par: Wang, Guoqing, et autres
Publié: (2024)
MCN-SLAM: Multi-Agent Collaborative Neural SLAM with Hybrid Implicit Neural Scene Representation
par: Deng, Tianchen, et autres
Publié: (2025)
par: Deng, Tianchen, et autres
Publié: (2025)
Co-Occ: Coupling Explicit Feature Fusion with Volume Rendering Regularization for Multi-Modal 3D Semantic Occupancy Prediction
par: Pan, Jingyi, et autres
Publié: (2024)
par: Pan, Jingyi, et autres
Publié: (2024)
NeSLAM: Neural Implicit Mapping and Self-Supervised Feature Tracking With Depth Completion and Denoising
par: Deng, Tianchen, et autres
Publié: (2024)
par: Deng, Tianchen, et autres
Publié: (2024)
OccFusion: Multi-Sensor Fusion Framework for 3D Semantic Occupancy Prediction
par: Ming, Zhenxing, et autres
Publié: (2024)
par: Ming, Zhenxing, et autres
Publié: (2024)
OccLoff: Learning Optimized Feature Fusion for 3D Occupancy Prediction
par: Zhang, Ji, et autres
Publié: (2024)
par: Zhang, Ji, et autres
Publié: (2024)
VGGT: Visual Geometry Grounded Transformer
par: Wang, Jianyuan, et autres
Publié: (2025)
par: Wang, Jianyuan, et autres
Publié: (2025)
OccFusion: Depth Estimation Free Multi-sensor Fusion for 3D Occupancy Prediction
par: Zhang, Ji, et autres
Publié: (2024)
par: Zhang, Ji, et autres
Publié: (2024)
CVT-Occ: Cost Volume Temporal Fusion for 3D Occupancy Prediction
par: Ye, Zhangchen, et autres
Publié: (2024)
par: Ye, Zhangchen, et autres
Publié: (2024)
Compact 3D Gaussian Splatting For Dense Visual SLAM
par: Deng, Tianchen, et autres
Publié: (2024)
par: Deng, Tianchen, et autres
Publié: (2024)
Incremental Joint Learning of Depth, Pose and Implicit Scene Representation on Monocular Camera in Large-scale Scenes
par: Deng, Tianchen, et autres
Publié: (2024)
par: Deng, Tianchen, et autres
Publié: (2024)
AdaOcc: Adaptive-Resolution Occupancy Prediction
par: Chen, Chao, et autres
Publié: (2024)
par: Chen, Chao, et autres
Publié: (2024)
Let Occ Flow: Self-Supervised 3D Occupancy Flow Prediction
par: Liu, Yili, et autres
Publié: (2024)
par: Liu, Yili, et autres
Publié: (2024)
OctreeOcc: Efficient and Multi-Granularity Occupancy Prediction Using Octree Queries
par: Lu, Yuhang, et autres
Publié: (2023)
par: Lu, Yuhang, et autres
Publié: (2023)
SliceOcc: Indoor 3D Semantic Occupancy Prediction with Vertical Slice Representation
par: Li, Jianing, et autres
Publié: (2025)
par: Li, Jianing, et autres
Publié: (2025)
SuperOcc: Toward Cohesive Temporal Modeling for Superquadric-based 3D Occupancy Prediction
par: Yu, Zichen, et autres
Publié: (2026)
par: Yu, Zichen, et autres
Publié: (2026)
OccRWKV: Rethinking Efficient 3D Semantic Occupancy Prediction with Linear Complexity
par: Wang, Junming, et autres
Publié: (2024)
par: Wang, Junming, et autres
Publié: (2024)
OccCylindrical: Multi-Modal Fusion with Cylindrical Representation for 3D Semantic Occupancy Prediction
par: Ming, Zhenxing, et autres
Publié: (2025)
par: Ming, Zhenxing, et autres
Publié: (2025)
SparseOcc: Rethinking Sparse Latent Representation for Vision-Based Semantic Occupancy Prediction
par: Tang, Pin, et autres
Publié: (2024)
par: Tang, Pin, et autres
Publié: (2024)
SA-Occ: Satellite-Assisted 3D Occupancy Prediction in Real World
par: Chen, Chen, et autres
Publié: (2025)
par: Chen, Chen, et autres
Publié: (2025)
GaussianFusionOcc: A Seamless Sensor Fusion Approach for 3D Occupancy Prediction Using 3D Gaussians
par: Pavković, Tomislav, et autres
Publié: (2025)
par: Pavković, Tomislav, et autres
Publié: (2025)
RenderOcc: Vision-Centric 3D Occupancy Prediction with 2D Rendering Supervision
par: Pan, Mingjie, et autres
Publié: (2023)
par: Pan, Mingjie, et autres
Publié: (2023)
MS-Occ: Multi-Stage LiDAR-Camera Fusion for 3D Semantic Occupancy Prediction
par: Wei, Zhiqiang, et autres
Publié: (2025)
par: Wei, Zhiqiang, et autres
Publié: (2025)
Diff-IP2D: Diffusion-Based Hand-Object Interaction Prediction on Egocentric Videos
par: Ma, Junyi, et autres
Publié: (2024)
par: Ma, Junyi, et autres
Publié: (2024)
EmbodiedOcc++: Boosting Embodied 3D Occupancy Prediction with Plane Regularization and Uncertainty Sampler
par: Wang, Hao, et autres
Publié: (2025)
par: Wang, Hao, et autres
Publié: (2025)
OccLE: Label-Efficient 3D Semantic Occupancy Prediction
par: Fang, Naiyu, et autres
Publié: (2025)
par: Fang, Naiyu, et autres
Publié: (2025)
WeatherOcc3D: VLM-Assisted Adverse Weather Aware 3D Semantic Occupancy Prediction
par: Doruk, A. Enes, et autres
Publié: (2026)
par: Doruk, A. Enes, et autres
Publié: (2026)
4DLangVGGT: 4D Language-Visual Geometry Grounded Transformer
par: Wu, Xianfeng, et autres
Publié: (2025)
par: Wu, Xianfeng, et autres
Publié: (2025)
OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation
par: Li, Bohan, et autres
Publié: (2024)
par: Li, Bohan, et autres
Publié: (2024)
ReliOcc: Towards Reliable Semantic Occupancy Prediction via Uncertainty Learning
par: Wang, Song, et autres
Publié: (2024)
par: Wang, Song, et autres
Publié: (2024)
MUT3R: Motion-aware Updating Transformer for Dynamic 3D Reconstruction
par: Shen, Guole, et autres
Publié: (2025)
par: Shen, Guole, et autres
Publié: (2025)
MADiff: Motion-Aware Mamba Diffusion Models for Hand Trajectory Prediction on Egocentric Videos
par: Ma, Junyi, et autres
Publié: (2024)
par: Ma, Junyi, et autres
Publié: (2024)
OneOcc: Semantic Occupancy Prediction for Legged Robots with a Single Panoramic Camera
par: Shi, Hao, et autres
Publié: (2025)
par: Shi, Hao, et autres
Publié: (2025)
DIAL-GS: Dynamic Instance Aware Reconstruction for Label-free Street Scenes with 4D Gaussian Splatting
par: Su, Chenpeng, et autres
Publié: (2025)
par: Su, Chenpeng, et autres
Publié: (2025)
Documents similaires
-
UniPR-3D: Towards Universal Visual Place Recognition with Visual Geometry Grounded Transformer
par: Deng, Tianchen, et autres
Publié: (2025) -
Mamba-VGGT: Persistent Long-Sequence Video Geometry Grounded Transformer via External Sliding Window Mamba Memory
par: Deng, Tianchen, et autres
Publié: (2026) -
Reloc-VGGT: Visual Re-localization with Geometry Grounded Transformer
par: Deng, Tianchen, et autres
Publié: (2025) -
Gau-Occ: Geometry-Completed Gaussians for Multi-Modal 3D Occupancy Prediction
par: Lv, Chengxin, et autres
Publié: (2026) -
VPGS-SLAM: Voxel-based Progressive 3D Gaussian SLAM in Large-Scale Scenes
par: Deng, Tianchen, et autres
Publié: (2025)