Utonia: Toward One Encoder for All Point Clouds
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhang, Yujia, Wu, Xiaoyang, Yang, Yunhan, Fan, Xianzhe, Li, Han, Zhang, Yuechen, Huang, Zehao, Wang, Naiyan, Zhao, Hengshuang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Any3D-VLA: Enhancing VLA Robustness via Diverse Point Clouds
por: Fan, Xianzhe, et al.
Publicado: (2026)
por: Fan, Xianzhe, et al.
Publicado: (2026)
Concerto: Joint 2D-3D Self-Supervised Learning Emerges Spatial Representations
por: Zhang, Yujia, et al.
Publicado: (2025)
por: Zhang, Yujia, et al.
Publicado: (2025)
One for All: Multi-Domain Joint Training for Point Cloud Based 3D Object Detection
por: Wang, Zhenyu, et al.
Publicado: (2024)
por: Wang, Zhenyu, et al.
Publicado: (2024)
Learnable Graph Matching: A Practical Paradigm for Data Association
por: He, Jiawei, et al.
Publicado: (2023)
por: He, Jiawei, et al.
Publicado: (2023)
DreamAvoid: Critical-Phase Test-Time Dreaming to Avoid Failures in VLA Policies
por: Fan, Xianzhe, et al.
Publicado: (2026)
por: Fan, Xianzhe, et al.
Publicado: (2026)
Geometry-Guided 3D Visual Token Pruning for Video-Language Models
por: Li, Han, et al.
Publicado: (2026)
por: Li, Han, et al.
Publicado: (2026)
Towards Large-scale 3D Representation Learning with Multi-dataset Point Prompt Training
por: Wu, Xiaoyang, et al.
Publicado: (2023)
por: Wu, Xiaoyang, et al.
Publicado: (2023)
Fully Sparse Fusion for 3D Object Detection
por: Li, Yingyan, et al.
Publicado: (2023)
por: Li, Yingyan, et al.
Publicado: (2023)
Tailor3D: Customized 3D Assets Editing and Generation with Dual-Side Images
por: Qi, Zhangyang, et al.
Publicado: (2024)
por: Qi, Zhangyang, et al.
Publicado: (2024)
GPT4Point: A Unified Framework for Point-Language Understanding and Generation
por: Qi, Zhangyang, et al.
Publicado: (2023)
por: Qi, Zhangyang, et al.
Publicado: (2023)
Efficient 3D Perception on Multi-Sweep Point Cloud with Gumbel Spatial Pruning
por: Sun, Tianyu, et al.
Publicado: (2024)
por: Sun, Tianyu, et al.
Publicado: (2024)
Enhancing 3D Lane Detection and Topology Reasoning with 2D Lane Priors
por: Li, Han, et al.
Publicado: (2024)
por: Li, Han, et al.
Publicado: (2024)
SparseFusion: Efficient Sparse Multi-Modal Fusion Framework for Long-Range 3D Perception
por: Li, Yiheng, et al.
Publicado: (2024)
por: Li, Yiheng, et al.
Publicado: (2024)
MV2DFusion: Leveraging Modality-Specific Object Semantics for Multi-Modal 3D Detection
por: Wang, Zitian, et al.
Publicado: (2024)
por: Wang, Zitian, et al.
Publicado: (2024)
DreamComposer++: Empowering Diffusion Models with Multi-View Conditions for 3D Content Generation
por: Yang, Yunhan, et al.
Publicado: (2025)
por: Yang, Yunhan, et al.
Publicado: (2025)
DreamComposer: Controllable 3D Object Generation via Multi-View Conditions
por: Yang, Yunhan, et al.
Publicado: (2023)
por: Yang, Yunhan, et al.
Publicado: (2023)
Anchor3DLane++: 3D Lane Detection via Sample-Adaptive Sparse 3D Anchor Regression
por: Huang, Shaofei, et al.
Publicado: (2024)
por: Huang, Shaofei, et al.
Publicado: (2024)
All in One: Visual-Description-Guided Unified Point Cloud Segmentation
por: Han, Zongyan, et al.
Publicado: (2025)
por: Han, Zongyan, et al.
Publicado: (2025)
FocalClick-XL: Towards Unified and High-quality Interactive Segmentation
por: Chen, Xi, et al.
Publicado: (2025)
por: Chen, Xi, et al.
Publicado: (2025)
OpenIns3D: Snap and Lookup for 3D Open-vocabulary Instance Segmentation
por: Huang, Zhening, et al.
Publicado: (2023)
por: Huang, Zhening, et al.
Publicado: (2023)
LION: Linear Group RNN for 3D Object Detection in Point Clouds
por: Liu, Zhe, et al.
Publicado: (2024)
por: Liu, Zhe, et al.
Publicado: (2024)
3D Feature Prediction for Masked-AutoEncoder-Based Point Cloud Pretraining
por: Yan, Siming, et al.
Publicado: (2023)
por: Yan, Siming, et al.
Publicado: (2023)
Point Transformer V3 Extreme: 1st Place Solution for 2024 Waymo Open Dataset Challenge in Semantic Segmentation
por: Wu, Xiaoyang, et al.
Publicado: (2024)
por: Wu, Xiaoyang, et al.
Publicado: (2024)
FASTER: Rethinking Real-Time Flow VLAs
por: Lu, Yuxiang, et al.
Publicado: (2026)
por: Lu, Yuxiang, et al.
Publicado: (2026)
Sonata: Self-Supervised Learning of Reliable Point Representations
por: Wu, Xiaoyang, et al.
Publicado: (2025)
por: Wu, Xiaoyang, et al.
Publicado: (2025)
Point Transformer V3: Simpler, Faster, Stronger
por: Wu, Xiaoyang, et al.
Publicado: (2023)
por: Wu, Xiaoyang, et al.
Publicado: (2023)
PlayerOne: Egocentric World Simulator
por: Tu, Yuanpeng, et al.
Publicado: (2025)
por: Tu, Yuanpeng, et al.
Publicado: (2025)
One Shot Learning for Edge Detection on Point Clouds
por: Tu, Zhikun, et al.
Publicado: (2026)
por: Tu, Zhikun, et al.
Publicado: (2026)
On Exploring PDE Modeling for Point Cloud Video Representation Learning
por: Huang, Zhuoxu, et al.
Publicado: (2024)
por: Huang, Zhuoxu, et al.
Publicado: (2024)
Novel Class Discovery for Point Cloud Segmentation via Joint Learning of Causal Representation and Reasoning
por: Li, Yang, et al.
Publicado: (2025)
por: Li, Yang, et al.
Publicado: (2025)
Point2Building: Reconstructing Buildings from Airborne LiDAR Point Clouds
por: Liu, Yujia, et al.
Publicado: (2024)
por: Liu, Yujia, et al.
Publicado: (2024)
OST: Efficient One-stream Network for 3D Single Object Tracking in Point Clouds
por: Zhao, Xiantong, et al.
Publicado: (2022)
por: Zhao, Xiantong, et al.
Publicado: (2022)
CrossDiff: Diffusion Probabilistic Model With Cross-conditional Encoder-Decoder for Crack Segmentation
por: Shi, Xianglong, et al.
Publicado: (2025)
por: Shi, Xianglong, et al.
Publicado: (2025)
UniMatch V2: Pushing the Limit of Semi-Supervised Semantic Segmentation
por: Yang, Lihe, et al.
Publicado: (2024)
por: Yang, Lihe, et al.
Publicado: (2024)
LiteReality: Graphics-Ready 3D Scene Reconstruction from RGB-D Scans
por: Huang, Zhening, et al.
Publicado: (2025)
por: Huang, Zhening, et al.
Publicado: (2025)
EvoIR: Towards All-in-One Image Restoration via Evolutionary Frequency Modulation
por: Ma, Jiaqi, et al.
Publicado: (2025)
por: Ma, Jiaqi, et al.
Publicado: (2025)
Paving the Way for Point Cloud Video Representation Learning Using A PDE Model
por: Huang, Zhuoxu, et al.
Publicado: (2026)
por: Huang, Zhuoxu, et al.
Publicado: (2026)
Unlearnable 3D Point Clouds: Class-wise Transformation Is All You Need
por: Wang, Xianlong, et al.
Publicado: (2024)
por: Wang, Xianlong, et al.
Publicado: (2024)
RI-MAE: Rotation-Invariant Masked AutoEncoders for Self-Supervised Point Cloud Representation Learning
por: Su, Kunming, et al.
Publicado: (2024)
por: Su, Kunming, et al.
Publicado: (2024)
OA-CNNs: Omni-Adaptive Sparse CNNs for 3D Semantic Segmentation
por: Peng, Bohao, et al.
Publicado: (2024)
por: Peng, Bohao, et al.
Publicado: (2024)
Ejemplares similares
-
Any3D-VLA: Enhancing VLA Robustness via Diverse Point Clouds
por: Fan, Xianzhe, et al.
Publicado: (2026) -
Concerto: Joint 2D-3D Self-Supervised Learning Emerges Spatial Representations
por: Zhang, Yujia, et al.
Publicado: (2025) -
One for All: Multi-Domain Joint Training for Point Cloud Based 3D Object Detection
por: Wang, Zhenyu, et al.
Publicado: (2024) -
Learnable Graph Matching: A Practical Paradigm for Data Association
por: He, Jiawei, et al.
Publicado: (2023) -
DreamAvoid: Critical-Phase Test-Time Dreaming to Avoid Failures in VLA Policies
por: Fan, Xianzhe, et al.
Publicado: (2026)