Masked Clustering Prediction for Unsupervised Point Cloud Pre-training
Fuente:
arXiv
Salvato in:
| Autori principali: | Ren, Bin, Huang, Xiaoshui, Liu, Mengyuan, Liu, Hong, Poiesi, Fabio, Sebe, Nicu, Mei, Guofeng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ZeroReg: Zero-Shot Point Cloud Registration with Foundation Models
di: Wang, Weijie, et al.
Pubblicazione: (2023)
di: Wang, Weijie, et al.
Pubblicazione: (2023)
Fully-Geometric Cross-Attention for Point Cloud Registration
di: Wang, Weijie, et al.
Pubblicazione: (2025)
di: Wang, Weijie, et al.
Pubblicazione: (2025)
Unsupervised Point Cloud Pre-Training via Contrasting and Clustering
di: Mei, Guofeng, et al.
Pubblicazione: (2022)
di: Mei, Guofeng, et al.
Pubblicazione: (2022)
Bringing Masked Autoencoders Explicit Contrastive Properties for Point Cloud Self-Supervised Learning
di: Ren, Bin, et al.
Pubblicazione: (2024)
di: Ren, Bin, et al.
Pubblicazione: (2024)
Self-Supervised and Generalizable Tokenization for CLIP-Based 3D Understanding
di: Mei, Guofeng, et al.
Pubblicazione: (2025)
di: Mei, Guofeng, et al.
Pubblicazione: (2025)
Geometrically-driven Aggregation for Zero-shot 3D Point Cloud Understanding
di: Mei, Guofeng, et al.
Pubblicazione: (2023)
di: Mei, Guofeng, et al.
Pubblicazione: (2023)
Cross-Modal and Uncertainty-Aware Agglomeration for Open-Vocabulary 3D Scene Understanding
di: Li, Jinlong, et al.
Pubblicazione: (2025)
di: Li, Jinlong, et al.
Pubblicazione: (2025)
3D Part Segmentation via Geometric Aggregation of 2D Visual Features
di: Garosi, Marco, et al.
Pubblicazione: (2024)
di: Garosi, Marco, et al.
Pubblicazione: (2024)
PointGAC: Geometric-Aware Codebook for Masked Point Cloud Modeling
di: Li, Abiao, et al.
Pubblicazione: (2025)
di: Li, Abiao, et al.
Pubblicazione: (2025)
Point Cloud Unsupervised Pre-training via 3D Gaussian Splatting
di: Liu, Hao, et al.
Pubblicazione: (2024)
di: Liu, Hao, et al.
Pubblicazione: (2024)
Vocabulary-Free 3D Instance Segmentation with Vision and Language Assistant
di: Mei, Guofeng, et al.
Pubblicazione: (2024)
di: Mei, Guofeng, et al.
Pubblicazione: (2024)
Large-scale Pre-trained Models are Surprisingly Strong in Incremental Novel Class Discovery
di: Liu, Mingxuan, et al.
Pubblicazione: (2023)
di: Liu, Mingxuan, et al.
Pubblicazione: (2023)
A Unified Masked Jigsaw Puzzle Framework for Vision and Language Models
di: Ye, Weixin, et al.
Pubblicazione: (2026)
di: Ye, Weixin, et al.
Pubblicazione: (2026)
PVAFN: Point-Voxel Attention Fusion Network with Multi-Pooling Enhancing for 3D Object Detection
di: Li, Yidi, et al.
Pubblicazione: (2024)
di: Li, Yidi, et al.
Pubblicazione: (2024)
LAHNet: Local Attentive Hashing Network for Point Cloud Registration
di: Qu, Wentao, et al.
Pubblicazione: (2025)
di: Qu, Wentao, et al.
Pubblicazione: (2025)
Hierarchical Cross-Attention Network for Virtual Try-On
di: Tang, Hao, et al.
Pubblicazione: (2024)
di: Tang, Hao, et al.
Pubblicazione: (2024)
Cues3D: Unleashing the Power of Sole NeRF for Consistent and Unique Instances in Open-Vocabulary 3D Panoptic Segmentation
di: Xue, Feng, et al.
Pubblicazione: (2025)
di: Xue, Feng, et al.
Pubblicazione: (2025)
Hierarchical Information Flow for Generalized Efficient Image Restoration
di: Li, Yawei, et al.
Pubblicazione: (2024)
di: Li, Yawei, et al.
Pubblicazione: (2024)
Fractal-IR: A Unified Framework for Efficient and Scalable Image Restoration
di: Li, Yawei, et al.
Pubblicazione: (2025)
di: Li, Yawei, et al.
Pubblicazione: (2025)
Uni4D: A Unified Self-Supervised Learning Framework for Point Cloud Videos
di: Zuo, Zhi, et al.
Pubblicazione: (2025)
di: Zuo, Zhi, et al.
Pubblicazione: (2025)
Uncertainty-Aware Testing-Time Optimization for 3D Human Pose Estimation
di: Wang, Ti, et al.
Pubblicazione: (2024)
di: Wang, Ti, et al.
Pubblicazione: (2024)
Graph Transformer GANs with Graph Masked Modeling for Architectural Layout Generation
di: Tang, Hao, et al.
Pubblicazione: (2024)
di: Tang, Hao, et al.
Pubblicazione: (2024)
Multimodal Fusion SLAM with Fourier Attention
di: Zhou, Youjie, et al.
Pubblicazione: (2025)
di: Zhou, Youjie, et al.
Pubblicazione: (2025)
H$_{2}$OT: Hierarchical Hourglass Tokenizer for Efficient Video Pose Transformers
di: Li, Wenhao, et al.
Pubblicazione: (2025)
di: Li, Wenhao, et al.
Pubblicazione: (2025)
Hourglass Tokenizer for Efficient Transformer-Based 3D Human Pose Estimation
di: Li, Wenhao, et al.
Pubblicazione: (2023)
di: Li, Wenhao, et al.
Pubblicazione: (2023)
Loomis Painter: Reconstructing the Painting Process
di: Pobitzer, Markus, et al.
Pubblicazione: (2025)
di: Pobitzer, Markus, et al.
Pubblicazione: (2025)
Anti-Forgetting Adaptation for Unsupervised Person Re-identification
di: Chen, Hao, et al.
Pubblicazione: (2024)
di: Chen, Hao, et al.
Pubblicazione: (2024)
Efficient Vision-Language Pre-training by Cluster Masking
di: Wei, Zihao, et al.
Pubblicazione: (2024)
di: Wei, Zihao, et al.
Pubblicazione: (2024)
Rethinking Point Clouds as Sequences: A Causal Next-Token Predictive Learning Framework
di: Yao, Yumeng, et al.
Pubblicazione: (2026)
di: Yao, Yumeng, et al.
Pubblicazione: (2026)
Robust Single-Stage Fully Sparse 3D Object Detection via Detachable Latent Diffusion
di: Qu, Wentao, et al.
Pubblicazione: (2025)
di: Qu, Wentao, et al.
Pubblicazione: (2025)
A Self-Conditioned Representation Guided Diffusion Model for Realistic Text-to-LiDAR Scene Generation
di: Qu, Wentao, et al.
Pubblicazione: (2025)
di: Qu, Wentao, et al.
Pubblicazione: (2025)
Sharing Key Semantics in Transformer Makes Efficient Image Restoration
di: Ren, Bin, et al.
Pubblicazione: (2024)
di: Ren, Bin, et al.
Pubblicazione: (2024)
Multi-modal Multi-task Pre-training for Improved Point Cloud Understanding
di: Liu, Liwen, et al.
Pubblicazione: (2025)
di: Liu, Liwen, et al.
Pubblicazione: (2025)
Multi-focal Conditioned Latent Diffusion for Person Image Synthesis
di: Liu, Jiaqi, et al.
Pubblicazione: (2025)
di: Liu, Jiaqi, et al.
Pubblicazione: (2025)
Efficient Encoder-Free Fourier-based 3D Large Multimodal Model
di: Mei, Guofeng, et al.
Pubblicazione: (2026)
di: Mei, Guofeng, et al.
Pubblicazione: (2026)
BEV-MAE: Bird's Eye View Masked Autoencoders for Point Cloud Pre-training in Autonomous Driving Scenarios
di: Lin, Zhiwei, et al.
Pubblicazione: (2022)
di: Lin, Zhiwei, et al.
Pubblicazione: (2022)
GLASS: Graph and Vision-Language Assisted Semantic Shape Correspondence
di: Xiao, Qinfeng, et al.
Pubblicazione: (2026)
di: Xiao, Qinfeng, et al.
Pubblicazione: (2026)
GraphMLP: A Graph MLP-Like Architecture for 3D Human Pose Estimation
di: Li, Wenhao, et al.
Pubblicazione: (2022)
di: Li, Wenhao, et al.
Pubblicazione: (2022)
MLIP: Medical Language-Image Pre-training with Masked Local Representation Learning
di: Liu, Jiarun, et al.
Pubblicazione: (2024)
di: Liu, Jiarun, et al.
Pubblicazione: (2024)
CLIP is Strong Enough to Fight Back: Test-time Counterattacks towards Zero-shot Adversarial Robustness of CLIP
di: Xing, Songlong, et al.
Pubblicazione: (2025)
di: Xing, Songlong, et al.
Pubblicazione: (2025)
Documenti analoghi
-
ZeroReg: Zero-Shot Point Cloud Registration with Foundation Models
di: Wang, Weijie, et al.
Pubblicazione: (2023) -
Fully-Geometric Cross-Attention for Point Cloud Registration
di: Wang, Weijie, et al.
Pubblicazione: (2025) -
Unsupervised Point Cloud Pre-Training via Contrasting and Clustering
di: Mei, Guofeng, et al.
Pubblicazione: (2022) -
Bringing Masked Autoencoders Explicit Contrastive Properties for Point Cloud Self-Supervised Learning
di: Ren, Bin, et al.
Pubblicazione: (2024) -
Self-Supervised and Generalizable Tokenization for CLIP-Based 3D Understanding
di: Mei, Guofeng, et al.
Pubblicazione: (2025)