Context and Geometry Aware Voxel Transformer for Semantic Scene Completion
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yu, Zhu, Zhang, Runmin, Ying, Jiacheng, Yu, Junchen, Hu, Xiaohai, Luo, Lun, Cao, Si-Yuan, Shen, Hui-Liang |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Not All Voxels Are Equal: Hardness-Aware Semantic Scene Completion with Self-Distillation
par: Wang, Song, et autres
Publié: (2024)
par: Wang, Song, et autres
Publié: (2024)
Rethinking Unsupervised Cross-modal Flow Estimation: Learning from Decoupled Optimization and Consistency Constraint
par: Zhang, Runmin, et autres
Publié: (2025)
par: Zhang, Runmin, et autres
Publié: (2025)
Sparsity-Aware Voxel Attention and Foreground Modulation for 3D Semantic Scene Completion
par: Xue, Yu, et autres
Publié: (2026)
par: Xue, Yu, et autres
Publié: (2026)
SGDFormer: One-stage Transformer-based Architecture for Cross-Spectral Stereo Image Guided Denoising
par: Zhang, Runmin, et autres
Publié: (2024)
par: Zhang, Runmin, et autres
Publié: (2024)
SSHNet: Unsupervised Cross-modal Homography Estimation via Problem Reformulation and Split Optimization
par: Yu, Junchen, et autres
Publié: (2024)
par: Yu, Junchen, et autres
Publié: (2024)
Large Depth Completion Model from Sparse Observations
par: Yu, Zhu, et autres
Publié: (2026)
par: Yu, Zhu, et autres
Publié: (2026)
SCPNet: Unsupervised Cross-modal Homography Estimation via Intra-modal Self-supervised Learning
par: Zhang, Runmin, et autres
Publié: (2024)
par: Zhang, Runmin, et autres
Publié: (2024)
Structure-Aware Radar-Camera Depth Estimation
par: Zhang, Fuyi, et autres
Publié: (2025)
par: Zhang, Fuyi, et autres
Publié: (2025)
Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction
par: Zhang, Runmin, et autres
Publié: (2025)
par: Zhang, Runmin, et autres
Publié: (2025)
Disentangling Instance and Scene Contexts for 3D Semantic Scene Completion
par: Liu, Enyu, et autres
Publié: (2025)
par: Liu, Enyu, et autres
Publié: (2025)
BVMatch: Lidar-based Place Recognition Using Bird's-eye View Images
par: Luo, Lun, et autres
Publié: (2021)
par: Luo, Lun, et autres
Publié: (2021)
Multi-Resolution Alignment for Voxel Sparsity in Camera-Based 3D Semantic Scene Completion
par: Yang, Zhiwen, et autres
Publié: (2026)
par: Yang, Zhiwen, et autres
Publié: (2026)
Three Cars Approaching within 100m! Enhancing Distant Geometry by Tri-Axis Voxel Scanning for Camera-based Semantic Scene Completion
par: Bae, Jongseong, et autres
Publié: (2024)
par: Bae, Jongseong, et autres
Publié: (2024)
EDFFDNet: Towards Accurate and Efficient Unsupervised Multi-Grid Image Registration
par: Zhu, Haokai, et autres
Publié: (2025)
par: Zhu, Haokai, et autres
Publié: (2025)
S-BEVLoc: BEV-based Self-supervised Framework for Large-scale LiDAR Global Localization
par: Zhang, Chenghao, et autres
Publié: (2025)
par: Zhang, Chenghao, et autres
Publié: (2025)
Hierarchical Temporal Context Learning for Camera-based Semantic Scene Completion
par: Li, Bohan, et autres
Publié: (2024)
par: Li, Bohan, et autres
Publié: (2024)
Language Driven Occupancy Prediction
par: Yu, Zhu, et autres
Publié: (2024)
par: Yu, Zhu, et autres
Publié: (2024)
Voxel-based Point Cloud Geometry Compression with Space-to-Channel Context
par: Liu, Bojun, et autres
Publié: (2025)
par: Liu, Bojun, et autres
Publié: (2025)
TGSFormer: Scalable Temporal Gaussian Splatting for Embodied Semantic Scene Completion
par: Qian, Rui, et autres
Publié: (2025)
par: Qian, Rui, et autres
Publié: (2025)
OpenVoxel: Training-Free Grouping and Captioning Voxels for Open-Vocabulary 3D Scene Understanding
par: Huang, Sheng-Yu, et autres
Publié: (2026)
par: Huang, Sheng-Yu, et autres
Publié: (2026)
DepthSSC: Monocular 3D Semantic Scene Completion via Depth-Spatial Alignment and Voxel Adaptation
par: Yao, Jiawei, et autres
Publié: (2023)
par: Yao, Jiawei, et autres
Publié: (2023)
Bridging Stereo Geometry and BEV Representation with Reliable Mutual Interaction for Semantic Scene Completion
par: Li, Bohan, et autres
Publié: (2023)
par: Li, Bohan, et autres
Publié: (2023)
Label-efficient Semantic Scene Completion with Scribble Annotations
par: Wang, Song, et autres
Publié: (2024)
par: Wang, Song, et autres
Publié: (2024)
Scene Completeness-Aware Lidar Depth Completion for Driving Scenario
par: Wu, Cho-Ying, et autres
Publié: (2020)
par: Wu, Cho-Ying, et autres
Publié: (2020)
Language and Geometry Grounded Sparse Voxel Representations for Holistic Scene Understanding
par: Wu, Guile, et autres
Publié: (2026)
par: Wu, Guile, et autres
Publié: (2026)
RestorerID: Towards Tuning-Free Face Restoration with ID Preservation
par: Ying, Jiacheng, et autres
Publié: (2024)
par: Ying, Jiacheng, et autres
Publié: (2024)
Hierarchical Context Transformer for Multi-level Semantic Scene Understanding
par: Hao, Luoying, et autres
Publié: (2025)
par: Hao, Luoying, et autres
Publié: (2025)
SplatSSC: Decoupled Depth-Guided Gaussian Splatting for Semantic Scene Completion
par: Qian, Rui, et autres
Publié: (2025)
par: Qian, Rui, et autres
Publié: (2025)
Global-Aware Monocular Semantic Scene Completion with State Space Models
par: Li, Shijie, et autres
Publié: (2025)
par: Li, Shijie, et autres
Publié: (2025)
VGGT4D: Mining Motion Cues in Visual Geometry Transformers for 4D Scene Reconstruction
par: Hu, Yu, et autres
Publié: (2025)
par: Hu, Yu, et autres
Publié: (2025)
AutoScape: Geometry-Consistent Long-Horizon Scene Generation
par: Chen, Jiacheng, et autres
Publié: (2025)
par: Chen, Jiacheng, et autres
Publié: (2025)
VEOcc: Voxel-Centric Online Semantic Occupancy Prediction For Embodied Scene Understanding
par: Wang, Ruoyu, et autres
Publié: (2026)
par: Wang, Ruoyu, et autres
Publié: (2026)
Rethinking Early-Fusion Strategies for Improved Multispectral Object Detection
par: Zhang, Xue, et autres
Publié: (2024)
par: Zhang, Xue, et autres
Publié: (2024)
Camera-based 3D Semantic Scene Completion with Sparse Guidance Network
par: Mei, Jianbiao, et autres
Publié: (2023)
par: Mei, Jianbiao, et autres
Publié: (2023)
VoxScene: Anchor-Conditioned Voxel Diffusion for Indoor Scene Arrangement
par: Mao, Haotian, et autres
Publié: (2026)
par: Mao, Haotian, et autres
Publié: (2026)
UniVoxel: Fast Inverse Rendering by Unified Voxelization of Scene Representation
par: Wu, Shuang, et autres
Publié: (2024)
par: Wu, Shuang, et autres
Publié: (2024)
TFDet: Target-Aware Fusion for RGB-T Pedestrian Detection
par: Zhang, Xue, et autres
Publié: (2023)
par: Zhang, Xue, et autres
Publié: (2023)
Context-Aware Token Selection and Packing for Enhanced Vision Transformer
par: Zhang, Tianyi, et autres
Publié: (2024)
par: Zhang, Tianyi, et autres
Publié: (2024)
SEM-ROVER: Semantic Voxel-Guided Diffusion for Large-Scale Driving Scene Generation
par: Dahmani, Hiba, et autres
Publié: (2026)
par: Dahmani, Hiba, et autres
Publié: (2026)
GAT-NeRF: Geometry-Aware-Transformer Enhanced Neural Radiance Fields for High-Fidelity 4D Facial Avatars
par: Chang, Zhe, et autres
Publié: (2026)
par: Chang, Zhe, et autres
Publié: (2026)
Documents similaires
-
Not All Voxels Are Equal: Hardness-Aware Semantic Scene Completion with Self-Distillation
par: Wang, Song, et autres
Publié: (2024) -
Rethinking Unsupervised Cross-modal Flow Estimation: Learning from Decoupled Optimization and Consistency Constraint
par: Zhang, Runmin, et autres
Publié: (2025) -
Sparsity-Aware Voxel Attention and Foreground Modulation for 3D Semantic Scene Completion
par: Xue, Yu, et autres
Publié: (2026) -
SGDFormer: One-stage Transformer-based Architecture for Cross-Spectral Stereo Image Guided Denoising
par: Zhang, Runmin, et autres
Publié: (2024) -
SSHNet: Unsupervised Cross-modal Homography Estimation via Problem Reformulation and Split Optimization
par: Yu, Junchen, et autres
Publié: (2024)