Context and Geometry Aware Voxel Transformer for Semantic Scene Completion
Fuente:
arXiv
Guardado en:
| Autores principales: | Yu, Zhu, Zhang, Runmin, Ying, Jiacheng, Yu, Junchen, Hu, Xiaohai, Luo, Lun, Cao, Si-Yuan, Shen, Hui-Liang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Not All Voxels Are Equal: Hardness-Aware Semantic Scene Completion with Self-Distillation
por: Wang, Song, et al.
Publicado: (2024)
por: Wang, Song, et al.
Publicado: (2024)
Rethinking Unsupervised Cross-modal Flow Estimation: Learning from Decoupled Optimization and Consistency Constraint
por: Zhang, Runmin, et al.
Publicado: (2025)
por: Zhang, Runmin, et al.
Publicado: (2025)
Sparsity-Aware Voxel Attention and Foreground Modulation for 3D Semantic Scene Completion
por: Xue, Yu, et al.
Publicado: (2026)
por: Xue, Yu, et al.
Publicado: (2026)
SGDFormer: One-stage Transformer-based Architecture for Cross-Spectral Stereo Image Guided Denoising
por: Zhang, Runmin, et al.
Publicado: (2024)
por: Zhang, Runmin, et al.
Publicado: (2024)
SSHNet: Unsupervised Cross-modal Homography Estimation via Problem Reformulation and Split Optimization
por: Yu, Junchen, et al.
Publicado: (2024)
por: Yu, Junchen, et al.
Publicado: (2024)
Large Depth Completion Model from Sparse Observations
por: Yu, Zhu, et al.
Publicado: (2026)
por: Yu, Zhu, et al.
Publicado: (2026)
SCPNet: Unsupervised Cross-modal Homography Estimation via Intra-modal Self-supervised Learning
por: Zhang, Runmin, et al.
Publicado: (2024)
por: Zhang, Runmin, et al.
Publicado: (2024)
Structure-Aware Radar-Camera Depth Estimation
por: Zhang, Fuyi, et al.
Publicado: (2025)
por: Zhang, Fuyi, et al.
Publicado: (2025)
Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction
por: Zhang, Runmin, et al.
Publicado: (2025)
por: Zhang, Runmin, et al.
Publicado: (2025)
Disentangling Instance and Scene Contexts for 3D Semantic Scene Completion
por: Liu, Enyu, et al.
Publicado: (2025)
por: Liu, Enyu, et al.
Publicado: (2025)
BVMatch: Lidar-based Place Recognition Using Bird's-eye View Images
por: Luo, Lun, et al.
Publicado: (2021)
por: Luo, Lun, et al.
Publicado: (2021)
Multi-Resolution Alignment for Voxel Sparsity in Camera-Based 3D Semantic Scene Completion
por: Yang, Zhiwen, et al.
Publicado: (2026)
por: Yang, Zhiwen, et al.
Publicado: (2026)
Three Cars Approaching within 100m! Enhancing Distant Geometry by Tri-Axis Voxel Scanning for Camera-based Semantic Scene Completion
por: Bae, Jongseong, et al.
Publicado: (2024)
por: Bae, Jongseong, et al.
Publicado: (2024)
EDFFDNet: Towards Accurate and Efficient Unsupervised Multi-Grid Image Registration
por: Zhu, Haokai, et al.
Publicado: (2025)
por: Zhu, Haokai, et al.
Publicado: (2025)
S-BEVLoc: BEV-based Self-supervised Framework for Large-scale LiDAR Global Localization
por: Zhang, Chenghao, et al.
Publicado: (2025)
por: Zhang, Chenghao, et al.
Publicado: (2025)
Hierarchical Temporal Context Learning for Camera-based Semantic Scene Completion
por: Li, Bohan, et al.
Publicado: (2024)
por: Li, Bohan, et al.
Publicado: (2024)
Language Driven Occupancy Prediction
por: Yu, Zhu, et al.
Publicado: (2024)
por: Yu, Zhu, et al.
Publicado: (2024)
Voxel-based Point Cloud Geometry Compression with Space-to-Channel Context
por: Liu, Bojun, et al.
Publicado: (2025)
por: Liu, Bojun, et al.
Publicado: (2025)
TGSFormer: Scalable Temporal Gaussian Splatting for Embodied Semantic Scene Completion
por: Qian, Rui, et al.
Publicado: (2025)
por: Qian, Rui, et al.
Publicado: (2025)
OpenVoxel: Training-Free Grouping and Captioning Voxels for Open-Vocabulary 3D Scene Understanding
por: Huang, Sheng-Yu, et al.
Publicado: (2026)
por: Huang, Sheng-Yu, et al.
Publicado: (2026)
DepthSSC: Monocular 3D Semantic Scene Completion via Depth-Spatial Alignment and Voxel Adaptation
por: Yao, Jiawei, et al.
Publicado: (2023)
por: Yao, Jiawei, et al.
Publicado: (2023)
Bridging Stereo Geometry and BEV Representation with Reliable Mutual Interaction for Semantic Scene Completion
por: Li, Bohan, et al.
Publicado: (2023)
por: Li, Bohan, et al.
Publicado: (2023)
Label-efficient Semantic Scene Completion with Scribble Annotations
por: Wang, Song, et al.
Publicado: (2024)
por: Wang, Song, et al.
Publicado: (2024)
Scene Completeness-Aware Lidar Depth Completion for Driving Scenario
por: Wu, Cho-Ying, et al.
Publicado: (2020)
por: Wu, Cho-Ying, et al.
Publicado: (2020)
Language and Geometry Grounded Sparse Voxel Representations for Holistic Scene Understanding
por: Wu, Guile, et al.
Publicado: (2026)
por: Wu, Guile, et al.
Publicado: (2026)
RestorerID: Towards Tuning-Free Face Restoration with ID Preservation
por: Ying, Jiacheng, et al.
Publicado: (2024)
por: Ying, Jiacheng, et al.
Publicado: (2024)
Hierarchical Context Transformer for Multi-level Semantic Scene Understanding
por: Hao, Luoying, et al.
Publicado: (2025)
por: Hao, Luoying, et al.
Publicado: (2025)
SplatSSC: Decoupled Depth-Guided Gaussian Splatting for Semantic Scene Completion
por: Qian, Rui, et al.
Publicado: (2025)
por: Qian, Rui, et al.
Publicado: (2025)
Global-Aware Monocular Semantic Scene Completion with State Space Models
por: Li, Shijie, et al.
Publicado: (2025)
por: Li, Shijie, et al.
Publicado: (2025)
VGGT4D: Mining Motion Cues in Visual Geometry Transformers for 4D Scene Reconstruction
por: Hu, Yu, et al.
Publicado: (2025)
por: Hu, Yu, et al.
Publicado: (2025)
AutoScape: Geometry-Consistent Long-Horizon Scene Generation
por: Chen, Jiacheng, et al.
Publicado: (2025)
por: Chen, Jiacheng, et al.
Publicado: (2025)
VEOcc: Voxel-Centric Online Semantic Occupancy Prediction For Embodied Scene Understanding
por: Wang, Ruoyu, et al.
Publicado: (2026)
por: Wang, Ruoyu, et al.
Publicado: (2026)
Rethinking Early-Fusion Strategies for Improved Multispectral Object Detection
por: Zhang, Xue, et al.
Publicado: (2024)
por: Zhang, Xue, et al.
Publicado: (2024)
Camera-based 3D Semantic Scene Completion with Sparse Guidance Network
por: Mei, Jianbiao, et al.
Publicado: (2023)
por: Mei, Jianbiao, et al.
Publicado: (2023)
VoxScene: Anchor-Conditioned Voxel Diffusion for Indoor Scene Arrangement
por: Mao, Haotian, et al.
Publicado: (2026)
por: Mao, Haotian, et al.
Publicado: (2026)
UniVoxel: Fast Inverse Rendering by Unified Voxelization of Scene Representation
por: Wu, Shuang, et al.
Publicado: (2024)
por: Wu, Shuang, et al.
Publicado: (2024)
TFDet: Target-Aware Fusion for RGB-T Pedestrian Detection
por: Zhang, Xue, et al.
Publicado: (2023)
por: Zhang, Xue, et al.
Publicado: (2023)
Context-Aware Token Selection and Packing for Enhanced Vision Transformer
por: Zhang, Tianyi, et al.
Publicado: (2024)
por: Zhang, Tianyi, et al.
Publicado: (2024)
SEM-ROVER: Semantic Voxel-Guided Diffusion for Large-Scale Driving Scene Generation
por: Dahmani, Hiba, et al.
Publicado: (2026)
por: Dahmani, Hiba, et al.
Publicado: (2026)
GAT-NeRF: Geometry-Aware-Transformer Enhanced Neural Radiance Fields for High-Fidelity 4D Facial Avatars
por: Chang, Zhe, et al.
Publicado: (2026)
por: Chang, Zhe, et al.
Publicado: (2026)
Ejemplares similares
-
Not All Voxels Are Equal: Hardness-Aware Semantic Scene Completion with Self-Distillation
por: Wang, Song, et al.
Publicado: (2024) -
Rethinking Unsupervised Cross-modal Flow Estimation: Learning from Decoupled Optimization and Consistency Constraint
por: Zhang, Runmin, et al.
Publicado: (2025) -
Sparsity-Aware Voxel Attention and Foreground Modulation for 3D Semantic Scene Completion
por: Xue, Yu, et al.
Publicado: (2026) -
SGDFormer: One-stage Transformer-based Architecture for Cross-Spectral Stereo Image Guided Denoising
por: Zhang, Runmin, et al.
Publicado: (2024) -
SSHNet: Unsupervised Cross-modal Homography Estimation via Problem Reformulation and Split Optimization
por: Yu, Junchen, et al.
Publicado: (2024)