MonoSOWA: Scalable monocular 3D Object detector Without human Annotations
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Skvrna, Jan, Neumann, Lukas |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Structured Semantic 3D Reconstruction (S23DR) Challenge 2025 -- Winning solution
par: Skvrna, Jan, et autres
Publié: (2025)
par: Skvrna, Jan, et autres
Publié: (2025)
EfficientPose 6D: Scalable and Efficient 6D Object Pose Estimation
par: Fang, Zixuan, et autres
Publié: (2025)
par: Fang, Zixuan, et autres
Publié: (2025)
LeJEPA: Provable and Scalable Self-Supervised Learning Without the Heuristics
par: Balestriero, Randall, et autres
Publié: (2025)
par: Balestriero, Randall, et autres
Publié: (2025)
Scalable Object Relation Encoding for Better 3D Spatial Reasoning in Large Language Models
par: Zhou, Shengli, et autres
Publié: (2026)
par: Zhou, Shengli, et autres
Publié: (2026)
Multi-Task Learning with Multi-Annotation Triplet Loss for Improved Object Detection
par: Zhou, Meilun, et autres
Publié: (2025)
par: Zhou, Meilun, et autres
Publié: (2025)
3D Reconstruction of Objects in Hands without Real World 3D Supervision
par: Prakash, Aditya, et autres
Publié: (2023)
par: Prakash, Aditya, et autres
Publié: (2023)
MeshFleet: Filtered and Annotated 3D Vehicle Dataset for Domain Specific Generative Modeling
par: Boborzi, Damian, et autres
Publié: (2025)
par: Boborzi, Damian, et autres
Publié: (2025)
What Matters in Range View 3D Object Detection
par: Wilson, Benjamin, et autres
Publié: (2024)
par: Wilson, Benjamin, et autres
Publié: (2024)
Opportunistic Promptable Segmentation: Leveraging Routine Radiological Annotations to Guide 3D CT Lesion Segmentation
par: Church, Samuel, et autres
Publié: (2026)
par: Church, Samuel, et autres
Publié: (2026)
3D-Agent:Tri-Modal Multi-Agent Collaboration for Scalable 3D Object Annotation
par: Zhang, Jusheng, et autres
Publié: (2026)
par: Zhang, Jusheng, et autres
Publié: (2026)
Why Are You Wrong? Counterfactual Explanations for Language Grounding with 3D Objects
par: Preintner, Tobias, et autres
Publié: (2025)
par: Preintner, Tobias, et autres
Publié: (2025)
Hardness-Aware Scene Synthesis for Semi-Supervised 3D Object Detection
par: Zeng, Shuai, et autres
Publié: (2024)
par: Zeng, Shuai, et autres
Publié: (2024)
Deep Models for Multi-View 3D Object Recognition: A Review
par: Alzahrani, Mona, et autres
Publié: (2024)
par: Alzahrani, Mona, et autres
Publié: (2024)
Examining Common Paradigms in Multi-Task Learning
par: Elich, Cathrin, et autres
Publié: (2023)
par: Elich, Cathrin, et autres
Publié: (2023)
Language-Driven Active Learning for Diverse Open-Set 3D Object Detection
par: Greer, Ross, et autres
Publié: (2024)
par: Greer, Ross, et autres
Publié: (2024)
DreamComposer: Controllable 3D Object Generation via Multi-View Conditions
par: Yang, Yunhan, et autres
Publié: (2023)
par: Yang, Yunhan, et autres
Publié: (2023)
Open-CRB: Towards Open World Active Learning for 3D Object Detection
par: Chen, Zhuoxiao, et autres
Publié: (2023)
par: Chen, Zhuoxiao, et autres
Publié: (2023)
MonoCon: A general framework for learning ultra-compact high-fidelity representations using monotonicity constraints
par: Gokhale, Shreyas
Publié: (2025)
par: Gokhale, Shreyas
Publié: (2025)
Visual Generation Without Guidance
par: Chen, Huayu, et autres
Publié: (2025)
par: Chen, Huayu, et autres
Publié: (2025)
USC: Uncompromising Spatial Constraints for Safety-Oriented 3D Object Detectors in Autonomous Driving
par: Liao, Brian Hsuan-Cheng, et autres
Publié: (2022)
par: Liao, Brian Hsuan-Cheng, et autres
Publié: (2022)
Neural Assets: 3D-Aware Multi-Object Scene Synthesis with Image Diffusion Models
par: Wu, Ziyi, et autres
Publié: (2024)
par: Wu, Ziyi, et autres
Publié: (2024)
Meta 3D TextureGen: Fast and Consistent Texture Generation for 3D Objects
par: Bensadoun, Raphael, et autres
Publié: (2024)
par: Bensadoun, Raphael, et autres
Publié: (2024)
UPAQ: A Framework for Real-Time and Energy-Efficient 3D Object Detection in Autonomous Vehicles
par: Balasubramaniam, Abhishek, et autres
Publié: (2025)
par: Balasubramaniam, Abhishek, et autres
Publié: (2025)
Boosting 3D Object Generation through PBR Materials
par: Wang, Yitong, et autres
Publié: (2024)
par: Wang, Yitong, et autres
Publié: (2024)
SceneTok: A Compressed, Diffusable Token Space for 3D Scenes
par: Asim, Mohammad, et autres
Publié: (2026)
par: Asim, Mohammad, et autres
Publié: (2026)
Analytical Uncertainty-Based Loss Weighting in Multi-Task Learning
par: Kirchdorfer, Lukas, et autres
Publié: (2024)
par: Kirchdorfer, Lukas, et autres
Publié: (2024)
Synthesizing 3D Abstractions by Inverting Procedural Buildings with Transformers
par: Dax, Maximilian, et autres
Publié: (2025)
par: Dax, Maximilian, et autres
Publié: (2025)
3D Object Detection and High-Resolution Traffic Parameters Extraction Using Low-Resolution LiDAR Data
par: Zhang, Linlin, et autres
Publié: (2024)
par: Zhang, Linlin, et autres
Publié: (2024)
Empowering Urban Traffic Management: Elevated 3D LiDAR for Data Collection and Advanced Object Detection Analysis
par: Guefrachi, Nawfal, et autres
Publié: (2024)
par: Guefrachi, Nawfal, et autres
Publié: (2024)
Position: Do Not Explain Vision Models Without Context
par: Tomaszewska, Paulina, et autres
Publié: (2024)
par: Tomaszewska, Paulina, et autres
Publié: (2024)
Automatic Image Annotation for Mapped Features Detection
par: Noizet, Maxime, et autres
Publié: (2024)
par: Noizet, Maxime, et autres
Publié: (2024)
ImageNet-D: Benchmarking Neural Network Robustness on Diffusion Synthetic Object
par: Zhang, Chenshuang, et autres
Publié: (2024)
par: Zhang, Chenshuang, et autres
Publié: (2024)
Scalable GANs with Transformers
par: Hyun, Sangeek, et autres
Publié: (2025)
par: Hyun, Sangeek, et autres
Publié: (2025)
RePOPE: Impact of Annotation Errors on the POPE Benchmark
par: Neuhaus, Yannic, et autres
Publié: (2025)
par: Neuhaus, Yannic, et autres
Publié: (2025)
Quality Assured: Rethinking Annotation Strategies in Imaging AI
par: Rädsch, Tim, et autres
Publié: (2024)
par: Rädsch, Tim, et autres
Publié: (2024)
GrabS: Generative Embodied Agent for 3D Object Segmentation without Scene Supervision
par: Zhang, Zihui, et autres
Publié: (2025)
par: Zhang, Zihui, et autres
Publié: (2025)
Reconstruction by Generation: 3D Multi-Object Scene Reconstruction from Sparse Observations
par: Zadaianchuk, Andrii, et autres
Publié: (2026)
par: Zadaianchuk, Andrii, et autres
Publié: (2026)
HGSFusion: Radar-Camera Fusion with Hybrid Generation and Synchronization for 3D Object Detection
par: Gu, Zijian, et autres
Publié: (2024)
par: Gu, Zijian, et autres
Publié: (2024)
Adapting Vision-Language Models Without Labels: A Comprehensive Survey
par: Dong, Hao, et autres
Publié: (2025)
par: Dong, Hao, et autres
Publié: (2025)
Emergent Visual Grounding in Large Multimodal Models Without Grounding Supervision
par: Cao, Shengcao, et autres
Publié: (2024)
par: Cao, Shengcao, et autres
Publié: (2024)
Documents similaires
-
Structured Semantic 3D Reconstruction (S23DR) Challenge 2025 -- Winning solution
par: Skvrna, Jan, et autres
Publié: (2025) -
EfficientPose 6D: Scalable and Efficient 6D Object Pose Estimation
par: Fang, Zixuan, et autres
Publié: (2025) -
LeJEPA: Provable and Scalable Self-Supervised Learning Without the Heuristics
par: Balestriero, Randall, et autres
Publié: (2025) -
Scalable Object Relation Encoding for Better 3D Spatial Reasoning in Large Language Models
par: Zhou, Shengli, et autres
Publié: (2026) -
Multi-Task Learning with Multi-Annotation Triplet Loss for Improved Object Detection
par: Zhou, Meilun, et autres
Publié: (2025)