Bringing Masked Autoencoders Explicit Contrastive Properties for Point Cloud Self-Supervised Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ren, Bin, Mei, Guofeng, Paudel, Danda Pani, Wang, Weijie, Li, Yawei, Liu, Mengyuan, Cucchiara, Rita, Van Gool, Luc, Sebe, Nicu |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Masked Clustering Prediction for Unsupervised Point Cloud Pre-training
par: Ren, Bin, et autres
Publié: (2025)
par: Ren, Bin, et autres
Publié: (2025)
Key-Graph Transformer for Image Restoration
par: Ren, Bin, et autres
Publié: (2024)
par: Ren, Bin, et autres
Publié: (2024)
ShapeSplat: A Large-scale Dataset of Gaussian Splats and Their Self-Supervised Pretraining
par: Ma, Qi, et autres
Publié: (2024)
par: Ma, Qi, et autres
Publié: (2024)
CityLoc: 6DoF Pose Distributional Localization for Text Descriptions in Large-Scale Scenes with Gaussian Representation
par: Ma, Qi, et autres
Publié: (2025)
par: Ma, Qi, et autres
Publié: (2025)
Lego: Learning to Disentangle and Invert Personalized Concepts Beyond Object Appearance in Text-to-Image Diffusion Models
par: Motamed, Saman, et autres
Publié: (2023)
par: Motamed, Saman, et autres
Publié: (2023)
Autonomous Vehicle Controllers From End-to-End Differentiable Simulation
par: Nachkov, Asen, et autres
Publié: (2024)
par: Nachkov, Asen, et autres
Publié: (2024)
EvenNICER-SLAM: Event-based Neural Implicit Encoding SLAM
par: Chen, Shi, et autres
Publié: (2024)
par: Chen, Shi, et autres
Publié: (2024)
Efficient Degradation-agnostic Image Restoration via Channel-Wise Functional Decomposition and Manifold Regularization
par: Ren, Bin, et autres
Publié: (2025)
par: Ren, Bin, et autres
Publié: (2025)
Sharing Key Semantics in Transformer Makes Efficient Image Restoration
par: Ren, Bin, et autres
Publié: (2024)
par: Ren, Bin, et autres
Publié: (2024)
EarthMind: Leveraging Cross-Sensor Data for Advanced Earth Observation Interpretation with a Unified Multimodal LLM
par: Shu, Yan, et autres
Publié: (2025)
par: Shu, Yan, et autres
Publié: (2025)
StateSpaceDiffuser: Bringing Long Context to Diffusion World Models
par: Savov, Nedko, et autres
Publié: (2025)
par: Savov, Nedko, et autres
Publié: (2025)
Fully-Geometric Cross-Attention for Point Cloud Registration
par: Wang, Weijie, et autres
Publié: (2025)
par: Wang, Weijie, et autres
Publié: (2025)
Any Image Restoration via Efficient Spatial-Frequency Degradation Adaptation
par: Ren, Bin, et autres
Publié: (2025)
par: Ren, Bin, et autres
Publié: (2025)
Graph Transformer GANs with Graph Masked Modeling for Architectural Layout Generation
par: Tang, Hao, et autres
Publié: (2024)
par: Tang, Hao, et autres
Publié: (2024)
Implicit-Zoo: A Large-Scale Dataset of Neural Implicit Functions for 2D Images and 3D Scenes
par: Ma, Qi, et autres
Publié: (2024)
par: Ma, Qi, et autres
Publié: (2024)
Continuous Pose for Monocular Cameras in Neural Implicit Representation
par: Ma, Qi, et autres
Publié: (2023)
par: Ma, Qi, et autres
Publié: (2023)
From Synchrony to Sequence: Exo-to-Ego Generation via Interpolation
par: Mahdi, Mohammad, et autres
Publié: (2026)
par: Mahdi, Mohammad, et autres
Publié: (2026)
Vision encoders should be image size agnostic and task driven
par: Prisadnikov, Nedyalko, et autres
Publié: (2025)
par: Prisadnikov, Nedyalko, et autres
Publié: (2025)
Self-supervised pretraining for an iterative image size agnostic vision transformer
par: Prisadnikov, Nedyalko, et autres
Publié: (2026)
par: Prisadnikov, Nedyalko, et autres
Publié: (2026)
A Simple and Generalist Approach for Panoptic Segmentation
par: Prisadnikov, Nedyalko, et autres
Publié: (2024)
par: Prisadnikov, Nedyalko, et autres
Publié: (2024)
ZeroReg: Zero-Shot Point Cloud Registration with Foundation Models
par: Wang, Weijie, et autres
Publié: (2023)
par: Wang, Weijie, et autres
Publié: (2023)
Inferring Compositional 4D Scenes without Ever Seeing One
par: Gokmen, Ahmet Berke, et autres
Publié: (2025)
par: Gokmen, Ahmet Berke, et autres
Publié: (2025)
Taming CLIP for Fine-grained and Structured Visual Understanding of Museum Exhibits
par: Balauca, Ada-Astrid, et autres
Publié: (2024)
par: Balauca, Ada-Astrid, et autres
Publié: (2024)
RICO: Two Realistic Benchmarks and an In-Depth Analysis for Incremental Learning in Object Detection
par: Neuwirth-Trapp, Matthias, et autres
Publié: (2025)
par: Neuwirth-Trapp, Matthias, et autres
Publié: (2025)
Incremental Object Detection with Prompt-based Methods
par: Neuwirth-Trapp, Matthias, et autres
Publié: (2025)
par: Neuwirth-Trapp, Matthias, et autres
Publié: (2025)
Occam's LGS: An Efficient Approach for Language Gaussian Splatting
par: Cheng, Jiahuan, et autres
Publié: (2024)
par: Cheng, Jiahuan, et autres
Publié: (2024)
SeasonScapes: Learning Large-scale Re-lightable 3D Landscapes with Seasonal Variation from Sparse Webcams
par: Kleger, Timo, et autres
Publié: (2026)
par: Kleger, Timo, et autres
Publié: (2026)
Ternary-Type Opacity and Hybrid Odometry for RGB NeRF-SLAM
par: Lin, Junru, et autres
Publié: (2023)
par: Lin, Junru, et autres
Publié: (2023)
Cross-View Multi-Modal Segmentation @ Ego-Exo4D Challenges 2025
par: Fu, Yuqian, et autres
Publié: (2025)
par: Fu, Yuqian, et autres
Publié: (2025)
Enhanced Multi-Scale Cross-Attention for Person Image Generation
par: Tang, Hao, et autres
Publié: (2025)
par: Tang, Hao, et autres
Publié: (2025)
ReVLA: Reverting Visual Domain Limitation of Robotic Foundation Models
par: Dey, Sombit, et autres
Publié: (2024)
par: Dey, Sombit, et autres
Publié: (2024)
Autonomous Vehicle Path Planning by Searching With Differentiable Simulation
par: Nachkov, Asen, et autres
Publié: (2025)
par: Nachkov, Asen, et autres
Publié: (2025)
Unlocking Efficient Vehicle Dynamics Modeling via Analytic World Models
par: Nachkov, Asen, et autres
Publié: (2025)
par: Nachkov, Asen, et autres
Publié: (2025)
Generalist Robot Manipulation beyond Action Labeled Data
par: Spiridonov, Alexander, et autres
Publié: (2025)
par: Spiridonov, Alexander, et autres
Publié: (2025)
FireScope: Wildfire Risk Raster Prediction with a Chain-of-Thought Oracle
par: Markov, Mario, et autres
Publié: (2025)
par: Markov, Mario, et autres
Publié: (2025)
B-GRTO: Bootstrapped Group Relative Tool Optimization for Referring Segmentation
par: Markov, Mario, et autres
Publié: (2026)
par: Markov, Mario, et autres
Publié: (2026)
Chorus: Multi-Teacher Pretraining for Holistic 3D Gaussian Scene Encoding
par: Li, Yue, et autres
Publié: (2025)
par: Li, Yue, et autres
Publié: (2025)
Restore Anything Model via Efficient Degradation Adaptation
par: Ren, Bin, et autres
Publié: (2024)
par: Ren, Bin, et autres
Publié: (2024)
Retrieval Augmented Generation and Understanding in Vision: A Survey and New Outlook
par: Zheng, Xu, et autres
Publié: (2025)
par: Zheng, Xu, et autres
Publié: (2025)
Learning Generative Interactive Environments By Trained Agent Exploration
par: Kazemi, Naser, et autres
Publié: (2024)
par: Kazemi, Naser, et autres
Publié: (2024)
Documents similaires
-
Masked Clustering Prediction for Unsupervised Point Cloud Pre-training
par: Ren, Bin, et autres
Publié: (2025) -
Key-Graph Transformer for Image Restoration
par: Ren, Bin, et autres
Publié: (2024) -
ShapeSplat: A Large-scale Dataset of Gaussian Splats and Their Self-Supervised Pretraining
par: Ma, Qi, et autres
Publié: (2024) -
CityLoc: 6DoF Pose Distributional Localization for Text Descriptions in Large-Scale Scenes with Gaussian Representation
par: Ma, Qi, et autres
Publié: (2025) -
Lego: Learning to Disentangle and Invert Personalized Concepts Beyond Object Appearance in Text-to-Image Diffusion Models
par: Motamed, Saman, et autres
Publié: (2023)