Multimodal Foundational Models for Unsupervised 3D General Obstacle Detection
Fuente:
arXiv
Salvato in:
| Autori principali: | Matuszka, Tamás, Hajas, Péter, Szeghy, Dávid |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Accurate Automatic 3D Annotation of Traffic Lights and Signs for Autonomous Driving
di: Kunsági-Máté, Sándor, et al.
Pubblicazione: (2024)
di: Kunsági-Máté, Sándor, et al.
Pubblicazione: (2024)
Hybrid Rendering for Multimodal Autonomous Driving: Merging Neural and Physics-Based Simulation
di: Tóth, Máté, et al.
Pubblicazione: (2025)
di: Tóth, Máté, et al.
Pubblicazione: (2025)
Segment-Level Road Obstacle Detection Using Visual Foundation Model Priors and Likelihood Ratios
di: Shoeb, Youssef, et al.
Pubblicazione: (2024)
di: Shoeb, Youssef, et al.
Pubblicazione: (2024)
A Survey on RGB, 3D, and Multimodal Approaches for Unsupervised Industrial Image Anomaly Detection
di: Lin, Yuxuan, et al.
Pubblicazione: (2024)
di: Lin, Yuxuan, et al.
Pubblicazione: (2024)
Finding 3D Scene Analogies with Multimodal Foundation Models
di: Kim, Junho, et al.
Pubblicazione: (2025)
di: Kim, Junho, et al.
Pubblicazione: (2025)
Unsupervised Foundation Model-Agnostic Slide-Level Representation Learning
di: Lenz, Tim, et al.
Pubblicazione: (2024)
di: Lenz, Tim, et al.
Pubblicazione: (2024)
Visual Foundation Models Boost Cross-Modal Unsupervised Domain Adaptation for 3D Semantic Segmentation
di: Xu, Jingyi, et al.
Pubblicazione: (2024)
di: Xu, Jingyi, et al.
Pubblicazione: (2024)
Dual-Foundation Models for Unsupervised Domain Adaptation
di: Cheon, Yerin, et al.
Pubblicazione: (2026)
di: Cheon, Yerin, et al.
Pubblicazione: (2026)
Exploring Multimodal Prompts For Unsupervised Continuous Anomaly Detection
di: Zhou, Mingle, et al.
Pubblicazione: (2026)
di: Zhou, Mingle, et al.
Pubblicazione: (2026)
Commonsense Prototype for Outdoor Unsupervised 3D Object Detection
di: Wu, Hai, et al.
Pubblicazione: (2024)
di: Wu, Hai, et al.
Pubblicazione: (2024)
Generalist Foundation Models from a Multimodal Dataset for 3D Computed Tomography
di: Hamamci, Ibrahim Ethem, et al.
Pubblicazione: (2024)
di: Hamamci, Ibrahim Ethem, et al.
Pubblicazione: (2024)
Leveraging Generic Foundation Models for Multimodal Surgical Data Analysis
di: Pezold, Simon, et al.
Pubblicazione: (2025)
di: Pezold, Simon, et al.
Pubblicazione: (2025)
Unsupervised Multimodal 3D Medical Image Registration with Multilevel Correlation Balanced Optimization
di: Wang, Jiazheng, et al.
Pubblicazione: (2024)
di: Wang, Jiazheng, et al.
Pubblicazione: (2024)
UnScene3D: Unsupervised 3D Instance Segmentation for Indoor Scenes
di: Rozenberszki, David, et al.
Pubblicazione: (2023)
di: Rozenberszki, David, et al.
Pubblicazione: (2023)
Exploring the Benefits of Vision Foundation Models for Unsupervised Domain Adaptation
di: Englert, Brunó B., et al.
Pubblicazione: (2024)
di: Englert, Brunó B., et al.
Pubblicazione: (2024)
Unsupervised Multimodal Deepfake Detection Using Intra- and Cross-Modal Inconsistencies
di: Tian, Mulin, et al.
Pubblicazione: (2023)
di: Tian, Mulin, et al.
Pubblicazione: (2023)
VFMM3D: Releasing the Potential of Image by Vision Foundation Model for Monocular 3D Object Detection
di: Ding, Bonan, et al.
Pubblicazione: (2024)
di: Ding, Bonan, et al.
Pubblicazione: (2024)
PanDA: Unsupervised Domain Adaptation for Multimodal 3D Panoptic Segmentation in Autonomous Driving
di: Pan, Yining, et al.
Pubblicazione: (2026)
di: Pan, Yining, et al.
Pubblicazione: (2026)
MonoDINO-DETR: Depth-Enhanced Monocular 3D Object Detection Using a Vision Foundation Model
di: Kim, Jihyeok, et al.
Pubblicazione: (2025)
di: Kim, Jihyeok, et al.
Pubblicazione: (2025)
Emergent Extreme-View Geometry in 3D Foundation Models
di: Zhang, Yiwen, et al.
Pubblicazione: (2025)
di: Zhang, Yiwen, et al.
Pubblicazione: (2025)
Syn-to-Real Unsupervised Domain Adaptation for Indoor 3D Object Detection
di: Wang, Yunsong, et al.
Pubblicazione: (2024)
di: Wang, Yunsong, et al.
Pubblicazione: (2024)
Harnessing Uncertainty-aware Bounding Boxes for Unsupervised 3D Object Detection
di: Zhang, Ruiyang, et al.
Pubblicazione: (2024)
di: Zhang, Ruiyang, et al.
Pubblicazione: (2024)
Approaching Outside: Scaling Unsupervised 3D Object Detection from 2D Scene
di: Zhang, Ruiyang, et al.
Pubblicazione: (2024)
di: Zhang, Ruiyang, et al.
Pubblicazione: (2024)
Unsupervised Multi-Person 3D Human Pose Estimation From 2D Poses Alone
di: Hardy, Peter, et al.
Pubblicazione: (2023)
di: Hardy, Peter, et al.
Pubblicazione: (2023)
MeshXL: Neural Coordinate Field for Generative 3D Foundation Models
di: Chen, Sijin, et al.
Pubblicazione: (2024)
di: Chen, Sijin, et al.
Pubblicazione: (2024)
MS3D++: Ensemble of Experts for Multi-Source Unsupervised Domain Adaptation in 3D Object Detection
di: Tsai, Darren, et al.
Pubblicazione: (2023)
di: Tsai, Darren, et al.
Pubblicazione: (2023)
DINO in the Room: Leveraging 2D Foundation Models for 3D Segmentation
di: Knaebel, Karim, et al.
Pubblicazione: (2025)
di: Knaebel, Karim, et al.
Pubblicazione: (2025)
OWL: Unsupervised 3D Object Detection by Occupancy Guided Warm-up and Large Model Priors Reasoning
di: Guo, Xusheng, et al.
Pubblicazione: (2025)
di: Guo, Xusheng, et al.
Pubblicazione: (2025)
Spatial Autoregressive Modeling of DINOv3 Embeddings for Unsupervised Anomaly Detection
di: Erdil, Ertunc, et al.
Pubblicazione: (2026)
di: Erdil, Ertunc, et al.
Pubblicazione: (2026)
ChefFusion: Multimodal Foundation Model Integrating Recipe and Food Image Generation
di: Li, Peiyu, et al.
Pubblicazione: (2024)
di: Li, Peiyu, et al.
Pubblicazione: (2024)
A Generative Foundation Model for Multimodal Histopathology
di: Xiang, Jinxi, et al.
Pubblicazione: (2026)
di: Xiang, Jinxi, et al.
Pubblicazione: (2026)
Multimodal Generation of Animatable 3D Human Models with AvatarForge
di: Liu, Xinhang, et al.
Pubblicazione: (2025)
di: Liu, Xinhang, et al.
Pubblicazione: (2025)
Vision-Language Guidance for LiDAR-based Unsupervised 3D Object Detection
di: Fruhwirth-Reisinger, Christian, et al.
Pubblicazione: (2024)
di: Fruhwirth-Reisinger, Christian, et al.
Pubblicazione: (2024)
Key-Grid: Unsupervised 3D Keypoints Detection using Grid Heatmap Features
di: Hou, Chengkai, et al.
Pubblicazione: (2024)
di: Hou, Chengkai, et al.
Pubblicazione: (2024)
Enhancing LiDAR Point Features with Foundation Model Priors for 3D Object Detection
di: Mo, Yujian, et al.
Pubblicazione: (2025)
di: Mo, Yujian, et al.
Pubblicazione: (2025)
Multimodal 3D Object Detection on Unseen Domains
di: Hegde, Deepti, et al.
Pubblicazione: (2024)
di: Hegde, Deepti, et al.
Pubblicazione: (2024)
Tracking-Guided 4D Generation: Foundation-Tracker Motion Priors for 3D Model Animation
di: Sun, Su, et al.
Pubblicazione: (2025)
di: Sun, Su, et al.
Pubblicazione: (2025)
FOMO-3D: Using Vision Foundation Models for Long-Tailed 3D Object Detection
di: Yang, Anqi Joyce, et al.
Pubblicazione: (2026)
di: Yang, Anqi Joyce, et al.
Pubblicazione: (2026)
Unsupervised Deep Generative Models for Anomaly Detection in Neuroimaging: A Systematic Scoping Review
di: Mahé, Youwan, et al.
Pubblicazione: (2025)
di: Mahé, Youwan, et al.
Pubblicazione: (2025)
FIND: An Unsupervised Implicit 3D Model of Articulated Human Feet
di: Boyne, Oliver, et al.
Pubblicazione: (2022)
di: Boyne, Oliver, et al.
Pubblicazione: (2022)
Documenti analoghi
-
Accurate Automatic 3D Annotation of Traffic Lights and Signs for Autonomous Driving
di: Kunsági-Máté, Sándor, et al.
Pubblicazione: (2024) -
Hybrid Rendering for Multimodal Autonomous Driving: Merging Neural and Physics-Based Simulation
di: Tóth, Máté, et al.
Pubblicazione: (2025) -
Segment-Level Road Obstacle Detection Using Visual Foundation Model Priors and Likelihood Ratios
di: Shoeb, Youssef, et al.
Pubblicazione: (2024) -
A Survey on RGB, 3D, and Multimodal Approaches for Unsupervised Industrial Image Anomaly Detection
di: Lin, Yuxuan, et al.
Pubblicazione: (2024) -
Finding 3D Scene Analogies with Multimodal Foundation Models
di: Kim, Junho, et al.
Pubblicazione: (2025)