SDGOCC: Semantic and Depth-Guided Bird's-Eye View Transformation for 3D Multimodal Occupancy Prediction
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Duan, Zaipeng, Dang, Chenxu, Hu, Xuzhong, An, Pei, Ding, Junfeng, Zhan, Jie, Xu, Yunbiao, Ma, Jie |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Multimodal Point Cloud Semantic Segmentation With Virtual Point Enhancement
par: Duan, Zaipeng, et autres
Publié: (2025)
par: Duan, Zaipeng, et autres
Publié: (2025)
FASTer: Focal Token Acquiring-and-Scaling Transformer for Long-term 3D Object Detection
par: Dang, Chenxu, et autres
Publié: (2025)
par: Dang, Chenxu, et autres
Publié: (2025)
Dual-Domain Homogeneous Fusion with Cross-Modal Mamba and Progressive Decoder for 3D Object Detection
par: Hu, Xuzhong, et autres
Publié: (2025)
par: Hu, Xuzhong, et autres
Publié: (2025)
FastOcc: Accelerating 3D Occupancy Prediction by Fusing the 2D Bird's-Eye View and Perspective View
par: Hou, Jiawei, et autres
Publié: (2024)
par: Hou, Jiawei, et autres
Publié: (2024)
OneBEV: Using One Panoramic Image for Bird's-Eye-View Semantic Mapping
par: Wei, Jiale, et autres
Publié: (2024)
par: Wei, Jiale, et autres
Publié: (2024)
Focus on BEV: Self-calibrated Cycle View Transformation for Monocular Birds-Eye-View Segmentation
par: Zhao, Jiawei, et autres
Publié: (2024)
par: Zhao, Jiawei, et autres
Publié: (2024)
BEV-IO: Enhancing Bird's-Eye-View 3D Detection with Instance Occupancy
par: Zhang, Zaibin, et autres
Publié: (2023)
par: Zhang, Zaibin, et autres
Publié: (2023)
SparseWorld: A Flexible, Adaptive, and Efficient 4D Occupancy World Model Powered by Sparse and Dynamic Queries
par: Dang, Chenxu, et autres
Publié: (2025)
par: Dang, Chenxu, et autres
Publié: (2025)
Epipolar Attention Field Transformers for Bird's Eye View Semantic Segmentation
par: Witte, Christian, et autres
Publié: (2024)
par: Witte, Christian, et autres
Publié: (2024)
BEVLM: Distilling Semantic Knowledge from LLMs into Bird's-Eye View Representations
par: Monninger, Thomas, et autres
Publié: (2026)
par: Monninger, Thomas, et autres
Publié: (2026)
SparseOccVLA: Bridging Occupancy and Vision-Language Models via Sparse Queries for Unified 4D Scene Understanding and Planning
par: Dang, Chenxu, et autres
Publié: (2026)
par: Dang, Chenxu, et autres
Publié: (2026)
Panoramic Multimodal Semantic Occupancy Prediction for Quadruped Robots
par: Zhao, Guoqiang, et autres
Publié: (2026)
par: Zhao, Guoqiang, et autres
Publié: (2026)
MC-BEVRO: Multi-Camera Bird Eye View Road Occupancy Detection for Traffic Monitoring
par: Vaghela, Arpitsinh, et autres
Publié: (2025)
par: Vaghela, Arpitsinh, et autres
Publié: (2025)
Fast and Efficient Transformer-based Method for Bird's Eye View Instance Prediction
par: Antunes-García, Miguel, et autres
Publié: (2024)
par: Antunes-García, Miguel, et autres
Publié: (2024)
CycleBEV: Regularizing View Transformation Networks via View Cycle Consistency for Bird's-Eye-View Semantic Segmentation
par: Hong, Jeongbin, et autres
Publié: (2026)
par: Hong, Jeongbin, et autres
Publié: (2026)
Improving Bird's Eye View Semantic Segmentation by Task Decomposition
par: Zhao, Tianhao, et autres
Publié: (2024)
par: Zhao, Tianhao, et autres
Publié: (2024)
SemSight: Probabilistic Bird's-Eye-View Prediction of Multi-Level Scene Semantics for Navigation
par: He, Jiaxuan, et autres
Publié: (2025)
par: He, Jiaxuan, et autres
Publié: (2025)
Temporal Structure Matters for Efficient Test-Time Adaptation in Wearable Human Activity Recognition
par: Zhou, Zishu, et autres
Publié: (2026)
par: Zhou, Zishu, et autres
Publié: (2026)
BEV-CV: Birds-Eye-View Transform for Cross-View Geo-Localisation
par: Shore, Tavis, et autres
Publié: (2023)
par: Shore, Tavis, et autres
Publié: (2023)
Semi-Supervised Learning for Visual Bird's Eye View Semantic Segmentation
par: Zhu, Junyu, et autres
Publié: (2023)
par: Zhu, Junyu, et autres
Publié: (2023)
GaussianFormer: Scene as Gaussians for Vision-Based 3D Semantic Occupancy Prediction
par: Huang, Yuanhui, et autres
Publié: (2024)
par: Huang, Yuanhui, et autres
Publié: (2024)
Post Fusion Bird's Eye View Feature Stabilization for Robust Multimodal 3D Detection
par: Dong, Trung Tien, et autres
Publié: (2026)
par: Dong, Trung Tien, et autres
Publié: (2026)
RendBEV: Semantic Novel View Synthesis for Self-Supervised Bird's Eye View Segmentation
par: Monteagudo, Henrique Piñeiro, et autres
Publié: (2025)
par: Monteagudo, Henrique Piñeiro, et autres
Publié: (2025)
RoadBEV: Road Surface Reconstruction in Bird's Eye View
par: Zhao, Tong, et autres
Publié: (2024)
par: Zhao, Tong, et autres
Publié: (2024)
ViewFormer: Exploring Spatiotemporal Modeling for Multi-View 3D Occupancy Perception via View-Guided Transformers
par: Li, Jinke, et autres
Publié: (2024)
par: Li, Jinke, et autres
Publié: (2024)
Bird Eye-View to Street-View: A Survey
par: Bajbaa, Khawlah, et autres
Publié: (2024)
par: Bajbaa, Khawlah, et autres
Publié: (2024)
Out-of-Distribution Semantic Occupancy Prediction
par: Zhang, Yuheng, et autres
Publié: (2025)
par: Zhang, Yuheng, et autres
Publié: (2025)
DSOcc: Leveraging Depth Awareness and Semantic Aid to Boost Camera-Based 3D Semantic Occupancy Prediction
par: Fang, Naiyu, et autres
Publié: (2025)
par: Fang, Naiyu, et autres
Publié: (2025)
OccupancyDETR: Using DETR for Mixed Dense-sparse 3D Occupancy Prediction
par: Jia, Yupeng, et autres
Publié: (2023)
par: Jia, Yupeng, et autres
Publié: (2023)
An Initial Study of Bird's-Eye View Generation for Autonomous Vehicles using Cross-View Transformers
par: Santos, Felipe Carlos dos, et autres
Publié: (2025)
par: Santos, Felipe Carlos dos, et autres
Publié: (2025)
Dr.Occ: Depth- and Region-Guided 3D Occupancy from Surround-View Cameras for Autonomous Driving
par: Zhu, Xubo, et autres
Publié: (2026)
par: Zhu, Xubo, et autres
Publié: (2026)
OccFusion: Depth Estimation Free Multi-sensor Fusion for 3D Occupancy Prediction
par: Zhang, Ji, et autres
Publié: (2024)
par: Zhang, Ji, et autres
Publié: (2024)
Robust 3D Semantic Occupancy Prediction with Calibration-free Spatial Transformation
par: Zhuang, Zhuangwei, et autres
Publié: (2024)
par: Zhuang, Zhuangwei, et autres
Publié: (2024)
A Black-Box Evaluation Framework for Semantic Robustness in Bird's Eye View Detection
par: Wang, Fu, et autres
Publié: (2024)
par: Wang, Fu, et autres
Publié: (2024)
A Bird's‐Eye View of Animals in the Law
par: Visa A. J. Kurki
Publié: (2024)
par: Visa A. J. Kurki
Publié: (2024)
Lifting Multi-View Detection and Tracking to the Bird's Eye View
par: Teepe, Torben, et autres
Publié: (2024)
par: Teepe, Torben, et autres
Publié: (2024)
MIC-BEV: Multi-Infrastructure Camera Bird's-Eye-View Transformer with Relation-Aware Fusion for 3D Object Detection
par: Zhang, Yun, et autres
Publié: (2025)
par: Zhang, Yun, et autres
Publié: (2025)
Toward Unified Practices in Trajectory Prediction Research on Bird's-Eye-View Datasets
par: Westny, Theodor, et autres
Publié: (2024)
par: Westny, Theodor, et autres
Publié: (2024)
Unlocking Past Information: Temporal Embeddings in Cooperative Bird's Eye View Prediction
par: Rößle, Dominik, et autres
Publié: (2024)
par: Rößle, Dominik, et autres
Publié: (2024)
Self-Supervised Bird's Eye View Motion Prediction with Cross-Modality Signals
par: Fang, Shaoheng, et autres
Publié: (2024)
par: Fang, Shaoheng, et autres
Publié: (2024)
Documents similaires
-
Multimodal Point Cloud Semantic Segmentation With Virtual Point Enhancement
par: Duan, Zaipeng, et autres
Publié: (2025) -
FASTer: Focal Token Acquiring-and-Scaling Transformer for Long-term 3D Object Detection
par: Dang, Chenxu, et autres
Publié: (2025) -
Dual-Domain Homogeneous Fusion with Cross-Modal Mamba and Progressive Decoder for 3D Object Detection
par: Hu, Xuzhong, et autres
Publié: (2025) -
FastOcc: Accelerating 3D Occupancy Prediction by Fusing the 2D Bird's-Eye View and Perspective View
par: Hou, Jiawei, et autres
Publié: (2024) -
OneBEV: Using One Panoramic Image for Bird's-Eye-View Semantic Mapping
par: Wei, Jiale, et autres
Publié: (2024)