AVS-Net: Point Sampling with Adaptive Voxel Size for 3D Scene Understanding
Fuente:
arXiv
Salvato in:
| Autori principali: | Yang, Hongcheng, Liang, Dingkang, Zhang, Dingyuan, Liu, Zhe, Zou, Zhikang, Jiang, Xingyu, Zhu, Yingying |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
SAM3D: Zero-Shot 3D Object Detection via Segment Anything Model
di: Zhang, Dingyuan, et al.
Pubblicazione: (2023)
di: Zhang, Dingyuan, et al.
Pubblicazione: (2023)
You Only Look Bottom-Up for Monocular 3D Object Detection
di: Xiong, Kaixin, et al.
Pubblicazione: (2024)
di: Xiong, Kaixin, et al.
Pubblicazione: (2024)
HERMES++: Toward a Unified Driving World Model for 3D Scene Understanding and Generation
di: Zhou, Xin, et al.
Pubblicazione: (2026)
di: Zhou, Xin, et al.
Pubblicazione: (2026)
PointTPA: Dynamic Network Parameter Adaptation for 3D Scene Understanding
di: Liu, Siyuan, et al.
Pubblicazione: (2026)
di: Liu, Siyuan, et al.
Pubblicazione: (2026)
HERMES: A Unified Self-Driving World Model for Simultaneous 3D Scene Understanding and Generation
di: Zhou, Xin, et al.
Pubblicazione: (2025)
di: Zhou, Xin, et al.
Pubblicazione: (2025)
NAUTILUS: A Large Multimodal Model for Underwater Scene Understanding
di: Xu, Wei, et al.
Pubblicazione: (2025)
di: Xu, Wei, et al.
Pubblicazione: (2025)
Parameter-Efficient Fine-Tuning in Spectral Domain for Point Cloud Learning
di: Liang, Dingkang, et al.
Pubblicazione: (2024)
di: Liang, Dingkang, et al.
Pubblicazione: (2024)
PointMamba: A Simple State Space Model for Point Cloud Analysis
di: Liang, Dingkang, et al.
Pubblicazione: (2024)
di: Liang, Dingkang, et al.
Pubblicazione: (2024)
A Unified Framework for 3D Scene Understanding
di: Xu, Wei, et al.
Pubblicazione: (2024)
di: Xu, Wei, et al.
Pubblicazione: (2024)
Dynamic Adapter Meets Prompt Tuning: Parameter-Efficient Transfer Learning for Point Cloud Analysis
di: Zhou, Xin, et al.
Pubblicazione: (2024)
di: Zhou, Xin, et al.
Pubblicazione: (2024)
OpenVoxel: Training-Free Grouping and Captioning Voxels for Open-Vocabulary 3D Scene Understanding
di: Huang, Sheng-Yu, et al.
Pubblicazione: (2026)
di: Huang, Sheng-Yu, et al.
Pubblicazione: (2026)
Overview and Comparison of AVS Point Cloud Compression Standard
di: Gao, Wei, et al.
Pubblicazione: (2026)
di: Gao, Wei, et al.
Pubblicazione: (2026)
Ref-AVS: Refer and Segment Objects in Audio-Visual Scenes
di: Wang, Yaoting, et al.
Pubblicazione: (2024)
di: Wang, Yaoting, et al.
Pubblicazione: (2024)
Make Your ViT-based Multi-view 3D Detectors Faster via Token Compression
di: Zhang, Dingyuan, et al.
Pubblicazione: (2024)
di: Zhang, Dingyuan, et al.
Pubblicazione: (2024)
SOOD++: Leveraging Unlabeled Data to Boost Oriented Object Detection
di: Liang, Dingkang, et al.
Pubblicazione: (2024)
di: Liang, Dingkang, et al.
Pubblicazione: (2024)
AVS-Net: Audio-Visual Scale Net for Self-supervised Monocular Metric Depth Estimation
di: Liu, Xiaohu, et al.
Pubblicazione: (2024)
di: Liu, Xiaohu, et al.
Pubblicazione: (2024)
Generation Models Know Space: Unleashing Implicit 3D Priors for Scene Understanding
di: Wu, Xianjin, et al.
Pubblicazione: (2026)
di: Wu, Xianjin, et al.
Pubblicazione: (2026)
Dynamic Scene Understanding through Object-Centric Voxelization and Neural Rendering
di: Zhao, Yanpeng, et al.
Pubblicazione: (2024)
di: Zhao, Yanpeng, et al.
Pubblicazione: (2024)
3D-AVS: LiDAR-based 3D Auto-Vocabulary Segmentation
di: Wei, Weijie, et al.
Pubblicazione: (2024)
di: Wei, Weijie, et al.
Pubblicazione: (2024)
VoxelTrack: Exploring Voxel Representation for 3D Point Cloud Object Tracking
di: Lu, Yuxuan, et al.
Pubblicazione: (2024)
di: Lu, Yuxuan, et al.
Pubblicazione: (2024)
RegionPLC: Regional Point-Language Contrastive Learning for Open-World 3D Scene Understanding
di: Yang, Jihan, et al.
Pubblicazione: (2023)
di: Yang, Jihan, et al.
Pubblicazione: (2023)
4D Neural Voxel Splatting: Dynamic Scene Rendering with Voxelized Guassian Splatting
di: Wu, Chun-Tin, et al.
Pubblicazione: (2025)
di: Wu, Chun-Tin, et al.
Pubblicazione: (2025)
Multi-Resolution Alignment for Voxel Sparsity in Camera-Based 3D Semantic Scene Completion
di: Yang, Zhiwen, et al.
Pubblicazione: (2026)
di: Yang, Zhiwen, et al.
Pubblicazione: (2026)
Language and Geometry Grounded Sparse Voxel Representations for Holistic Scene Understanding
di: Wu, Guile, et al.
Pubblicazione: (2026)
di: Wu, Guile, et al.
Pubblicazione: (2026)
Pillar-Voxel Fusion Network for 3D Object Detection in Airborne Hyperspectral Point Clouds
di: Jiang, Yanze, et al.
Pubblicazione: (2025)
di: Jiang, Yanze, et al.
Pubblicazione: (2025)
Context and Geometry Aware Voxel Transformer for Semantic Scene Completion
di: Yu, Zhu, et al.
Pubblicazione: (2024)
di: Yu, Zhu, et al.
Pubblicazione: (2024)
Self-Supervised Scene Flow Estimation with Point-Voxel Fusion and Surface Representation
di: Xiang, Xuezhi, et al.
Pubblicazione: (2024)
di: Xiang, Xuezhi, et al.
Pubblicazione: (2024)
POMA-3D: The Point Map Way to 3D Scene Understanding
di: Mao, Ye, et al.
Pubblicazione: (2025)
di: Mao, Ye, et al.
Pubblicazione: (2025)
VEOcc: Voxel-Centric Online Semantic Occupancy Prediction For Embodied Scene Understanding
di: Wang, Ruoyu, et al.
Pubblicazione: (2026)
di: Wang, Ruoyu, et al.
Pubblicazione: (2026)
UniVoxel: Fast Inverse Rendering by Unified Voxelization of Scene Representation
di: Wu, Shuang, et al.
Pubblicazione: (2024)
di: Wu, Shuang, et al.
Pubblicazione: (2024)
Masked Point-Entity Contrast for Open-Vocabulary 3D Scene Understanding
di: Wang, Yan, et al.
Pubblicazione: (2025)
di: Wang, Yan, et al.
Pubblicazione: (2025)
GraVoS: Voxel Selection for 3D Point-Cloud Detection
di: Shrout, Oren, et al.
Pubblicazione: (2022)
di: Shrout, Oren, et al.
Pubblicazione: (2022)
PVTransformer: Point-to-Voxel Transformer for Scalable 3D Object Detection
di: Leng, Zhaoqi, et al.
Pubblicazione: (2024)
di: Leng, Zhaoqi, et al.
Pubblicazione: (2024)
Structure-Adaptive Sparse Diffusion in Voxel Space for 3D Medical Image Enhancement
di: Jiang, Hongxu, et al.
Pubblicazione: (2026)
di: Jiang, Hongxu, et al.
Pubblicazione: (2026)
PVNet: Point-Voxel Interaction LiDAR Scene Upsampling Via Diffusion Models
di: Cheng, Xianjing, et al.
Pubblicazione: (2025)
di: Cheng, Xianjing, et al.
Pubblicazione: (2025)
SparseLIF: High-Performance Sparse LiDAR-Camera Fusion for 3D Object Detection
di: Zhang, Hongcheng, et al.
Pubblicazione: (2024)
di: Zhang, Hongcheng, et al.
Pubblicazione: (2024)
Sparsity-Aware Voxel Attention and Foreground Modulation for 3D Semantic Scene Completion
di: Xue, Yu, et al.
Pubblicazione: (2026)
di: Xue, Yu, et al.
Pubblicazione: (2026)
VoxScene: Anchor-Conditioned Voxel Diffusion for Indoor Scene Arrangement
di: Mao, Haotian, et al.
Pubblicazione: (2026)
di: Mao, Haotian, et al.
Pubblicazione: (2026)
LESV: Language Embedded Sparse Voxel Fusion for Open-Vocabulary 3D Scene Understanding
di: Wang, Fusang, et al.
Pubblicazione: (2026)
di: Wang, Fusang, et al.
Pubblicazione: (2026)
A Unified Image-Dense Annotation Generation Model for Underwater Scenes
di: Lin, Hongkai, et al.
Pubblicazione: (2025)
di: Lin, Hongkai, et al.
Pubblicazione: (2025)
Documenti analoghi
-
SAM3D: Zero-Shot 3D Object Detection via Segment Anything Model
di: Zhang, Dingyuan, et al.
Pubblicazione: (2023) -
You Only Look Bottom-Up for Monocular 3D Object Detection
di: Xiong, Kaixin, et al.
Pubblicazione: (2024) -
HERMES++: Toward a Unified Driving World Model for 3D Scene Understanding and Generation
di: Zhou, Xin, et al.
Pubblicazione: (2026) -
PointTPA: Dynamic Network Parameter Adaptation for 3D Scene Understanding
di: Liu, Siyuan, et al.
Pubblicazione: (2026) -
HERMES: A Unified Self-Driving World Model for Simultaneous 3D Scene Understanding and Generation
di: Zhou, Xin, et al.
Pubblicazione: (2025)