VEON: Vocabulary-Enhanced Occupancy Prediction
Fuente:
arXiv
Salvato in:
| Autori principali: | Zheng, Jilai, Tang, Pin, Wang, Zhongdao, Wang, Guoqing, Ren, Xiangxuan, Feng, Bailan, Ma, Chao |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
SparseOcc: Rethinking Sparse Latent Representation for Vision-Based Semantic Occupancy Prediction
di: Tang, Pin, et al.
Pubblicazione: (2024)
di: Tang, Pin, et al.
Pubblicazione: (2024)
OccGen: Generative Multi-modal 3D Occupancy Prediction for Autonomous Driving
di: Wang, Guoqing, et al.
Pubblicazione: (2024)
di: Wang, Guoqing, et al.
Pubblicazione: (2024)
LiteFusion: Taming 3D Object Detectors from Vision-Based to Multi-Modal with Minimal Adaptation
di: Ren, Xiangxuan, et al.
Pubblicazione: (2025)
di: Ren, Xiangxuan, et al.
Pubblicazione: (2025)
Grounding Everything in Tokens for Multimodal Large Language Models
di: Ren, Xiangxuan, et al.
Pubblicazione: (2025)
di: Ren, Xiangxuan, et al.
Pubblicazione: (2025)
Learning Vision-Language-Action World Models for Autonomous Driving
di: Wang, Guoqing, et al.
Pubblicazione: (2026)
di: Wang, Guoqing, et al.
Pubblicazione: (2026)
ReliOcc: Towards Reliable Semantic Occupancy Prediction via Uncertainty Learning
di: Wang, Song, et al.
Pubblicazione: (2024)
di: Wang, Song, et al.
Pubblicazione: (2024)
TurboVSR: Fantastic Video Upscalers and Where to Find Them
di: Wang, Zhongdao, et al.
Pubblicazione: (2025)
di: Wang, Zhongdao, et al.
Pubblicazione: (2025)
Efficient 3D Perception on Multi-Sweep Point Cloud with Gumbel Spatial Pruning
di: Sun, Tianyu, et al.
Pubblicazione: (2024)
di: Sun, Tianyu, et al.
Pubblicazione: (2024)
Single-Model and Any-Modality for Video Object Tracking
di: Wu, Zongwei, et al.
Pubblicazione: (2023)
di: Wu, Zongwei, et al.
Pubblicazione: (2023)
AdaOcc: Adaptive-Resolution Occupancy Prediction
di: Chen, Chao, et al.
Pubblicazione: (2024)
di: Chen, Chao, et al.
Pubblicazione: (2024)
QuadMamba: Learning Quadtree-based Selective Scan for Visual State Space Model
di: Xie, Fei, et al.
Pubblicazione: (2024)
di: Xie, Fei, et al.
Pubblicazione: (2024)
Monocular Open Vocabulary Occupancy Prediction for Indoor Scenes
di: Zhou, Changqing, et al.
Pubblicazione: (2026)
di: Zhou, Changqing, et al.
Pubblicazione: (2026)
An Instance-Centric Panoptic Occupancy Prediction Benchmark for Autonomous Driving
di: Feng, Yi, et al.
Pubblicazione: (2026)
di: Feng, Yi, et al.
Pubblicazione: (2026)
FreeOcc: Training-Free Embodied Open-Vocabulary Occupancy Prediction
di: Jiang, Zeyu, et al.
Pubblicazione: (2026)
di: Jiang, Zeyu, et al.
Pubblicazione: (2026)
POP-3D: Open-Vocabulary 3D Occupancy Prediction from Images
di: Vobecky, Antonin, et al.
Pubblicazione: (2024)
di: Vobecky, Antonin, et al.
Pubblicazione: (2024)
GenieDrive: Towards Physics-Aware Driving World Model with 4D Occupancy Guided Video Generation
di: Yang, Zhenya, et al.
Pubblicazione: (2025)
di: Yang, Zhenya, et al.
Pubblicazione: (2025)
Diffusion-Occ: 3D Point Cloud Completion via Occupancy Diffusion
di: Zhang, Guoqing, et al.
Pubblicazione: (2024)
di: Zhang, Guoqing, et al.
Pubblicazione: (2024)
COTR: Compact Occupancy TRansformer for Vision-based 3D Occupancy Prediction
di: Ma, Qihang, et al.
Pubblicazione: (2023)
di: Ma, Qihang, et al.
Pubblicazione: (2023)
Progressive Gaussian Transformer with Anisotropy-aware Sampling for Open Vocabulary Occupancy Prediction
di: Yan, Chi, et al.
Pubblicazione: (2025)
di: Yan, Chi, et al.
Pubblicazione: (2025)
Segment, Lift and Fit: Automatic 3D Shape Labeling from 2D Prompts
di: Li, Jianhao, et al.
Pubblicazione: (2024)
di: Li, Jianhao, et al.
Pubblicazione: (2024)
LEGO-Motion: Learning-Enhanced Grids with Occupancy Instance Modeling for Class-Agnostic Motion Prediction
di: Qian, Kangan, et al.
Pubblicazione: (2025)
di: Qian, Kangan, et al.
Pubblicazione: (2025)
OctreeOcc: Efficient and Multi-Granularity Occupancy Prediction Using Octree Queries
di: Lu, Yuhang, et al.
Pubblicazione: (2023)
di: Lu, Yuhang, et al.
Pubblicazione: (2023)
O3N: Omnidirectional Open-Vocabulary Occupancy Prediction
di: Duan, Mengfei, et al.
Pubblicazione: (2026)
di: Duan, Mengfei, et al.
Pubblicazione: (2026)
DAOcc: 3D Object Detection Assisted Multi-Sensor Fusion for 3D Occupancy Prediction
di: Yang, Zhen, et al.
Pubblicazione: (2024)
di: Yang, Zhen, et al.
Pubblicazione: (2024)
Fully Sparse 3D Occupancy Prediction
di: Liu, Haisong, et al.
Pubblicazione: (2023)
di: Liu, Haisong, et al.
Pubblicazione: (2023)
Monocular Occupancy Prediction for Scalable Indoor Scenes
di: Yu, Hongxiao, et al.
Pubblicazione: (2024)
di: Yu, Hongxiao, et al.
Pubblicazione: (2024)
OpenOcc: Open Vocabulary 3D Scene Reconstruction via Occupancy Representation
di: Jiang, Haochen, et al.
Pubblicazione: (2024)
di: Jiang, Haochen, et al.
Pubblicazione: (2024)
STCOcc: Sparse Spatial-Temporal Cascade Renovation for 3D Occupancy and Scene Flow Prediction
di: Liao, Zhimin, et al.
Pubblicazione: (2025)
di: Liao, Zhimin, et al.
Pubblicazione: (2025)
VEOcc: Voxel-Centric Online Semantic Occupancy Prediction For Embodied Scene Understanding
di: Wang, Ruoyu, et al.
Pubblicazione: (2026)
di: Wang, Ruoyu, et al.
Pubblicazione: (2026)
VGGT-Occ: Geometry-Grounded and Density-Aware Gated Fusion for 3D Occupancy Prediction
di: Chen, Xun, et al.
Pubblicazione: (2026)
di: Chen, Xun, et al.
Pubblicazione: (2026)
Collaborative Learning of Local 3D Occupancy Prediction and Versatile Global Occupancy Mapping
di: Yuan, Shanshuai, et al.
Pubblicazione: (2025)
di: Yuan, Shanshuai, et al.
Pubblicazione: (2025)
Test-Time 3D Occupancy Prediction
di: Zhang, Fengyi, et al.
Pubblicazione: (2025)
di: Zhang, Fengyi, et al.
Pubblicazione: (2025)
MonoOcc: Digging into Monocular Semantic Occupancy Prediction
di: Zheng, Yupeng, et al.
Pubblicazione: (2024)
di: Zheng, Yupeng, et al.
Pubblicazione: (2024)
OPUS: Occupancy Prediction Using a Sparse Set
di: Wang, Jiabao, et al.
Pubblicazione: (2024)
di: Wang, Jiabao, et al.
Pubblicazione: (2024)
LangOcc: Self-Supervised Open Vocabulary Occupancy Estimation via Volume Rendering
di: Boeder, Simon, et al.
Pubblicazione: (2024)
di: Boeder, Simon, et al.
Pubblicazione: (2024)
Rebenchmarking Unsupervised Monocular 3D Occupancy Prediction
di: Guo, Zizhan, et al.
Pubblicazione: (2026)
di: Guo, Zizhan, et al.
Pubblicazione: (2026)
S2GO: Streaming Sparse Gaussian Occupancy Prediction
di: Park, Jinhyung, et al.
Pubblicazione: (2025)
di: Park, Jinhyung, et al.
Pubblicazione: (2025)
Language Driven Occupancy Prediction
di: Yu, Zhu, et al.
Pubblicazione: (2024)
di: Yu, Zhu, et al.
Pubblicazione: (2024)
Enhancing Indoor Occupancy Prediction via Sparse Query-Based Multi-Level Consistent Knowledge Distillation
di: Li, Xiang, et al.
Pubblicazione: (2026)
di: Li, Xiang, et al.
Pubblicazione: (2026)
SliceOcc: Indoor 3D Semantic Occupancy Prediction with Vertical Slice Representation
di: Li, Jianing, et al.
Pubblicazione: (2025)
di: Li, Jianing, et al.
Pubblicazione: (2025)
Documenti analoghi
-
SparseOcc: Rethinking Sparse Latent Representation for Vision-Based Semantic Occupancy Prediction
di: Tang, Pin, et al.
Pubblicazione: (2024) -
OccGen: Generative Multi-modal 3D Occupancy Prediction for Autonomous Driving
di: Wang, Guoqing, et al.
Pubblicazione: (2024) -
LiteFusion: Taming 3D Object Detectors from Vision-Based to Multi-Modal with Minimal Adaptation
di: Ren, Xiangxuan, et al.
Pubblicazione: (2025) -
Grounding Everything in Tokens for Multimodal Large Language Models
di: Ren, Xiangxuan, et al.
Pubblicazione: (2025) -
Learning Vision-Language-Action World Models for Autonomous Driving
di: Wang, Guoqing, et al.
Pubblicazione: (2026)