Open Vocabulary Monocular 3D Object Detection
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yao, Jin, Gu, Hao, Chen, Xuweiyi, Wang, Jiayun, Cheng, Zezhou |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Semantic-Free Procedural 3D Shapes Are Surprisingly Good Teachers
par: Chen, Xuweiyi, et autres
Publié: (2024)
par: Chen, Xuweiyi, et autres
Publié: (2024)
Probing the Mid-level Vision Capabilities of Self-Supervised Learning
par: Chen, Xuweiyi, et autres
Publié: (2024)
par: Chen, Xuweiyi, et autres
Publié: (2024)
WildRayZer: Self-supervised Large View Synthesis in Dynamic Environments
par: Chen, Xuweiyi, et autres
Publié: (2026)
par: Chen, Xuweiyi, et autres
Publié: (2026)
Point-MoE: Large-Scale Multi-Dataset Training with Mixture-of-Experts for 3D Semantic Segmentation
par: Chen, Xuweiyi, et autres
Publié: (2025)
par: Chen, Xuweiyi, et autres
Publié: (2025)
Frame In-N-Out: Unbounded Controllable Image-to-Video Generation
par: Wang, Boyang, et autres
Publié: (2025)
par: Wang, Boyang, et autres
Publié: (2025)
Training an Open-Vocabulary Monocular 3D Object Detection Model without 3D Data
par: Huang, Rui, et autres
Publié: (2024)
par: Huang, Rui, et autres
Publié: (2024)
SAB3R: Semantic-Augmented Backbone in 3D Reconstruction
par: Chen, Xuweiyi, et autres
Publié: (2025)
par: Chen, Xuweiyi, et autres
Publié: (2025)
OpenM3D: Open Vocabulary Multi-view Indoor 3D Object Detection without Human Annotations
par: Hsu, Peng-Hao, et autres
Publié: (2025)
par: Hsu, Peng-Hao, et autres
Publié: (2025)
LabelAny3D: Label Any Object 3D in the Wild
par: Yao, Jin, et autres
Publié: (2026)
par: Yao, Jin, et autres
Publié: (2026)
Empowering Dynamic Urban Navigation with Stereo and Mid-Level Vision
par: Zhou, Wentao, et autres
Publié: (2025)
par: Zhou, Wentao, et autres
Publié: (2025)
Towards Open-Vocabulary Multimodal 3D Object Detection with Attributes
par: Xiang, Xinhao, et autres
Publié: (2025)
par: Xiang, Xinhao, et autres
Publié: (2025)
Learning to Detect and Segment for Open Vocabulary Object Detection
par: Wang, Tao, et autres
Publié: (2022)
par: Wang, Tao, et autres
Publié: (2022)
RTGen: Generating Region-Text Pairs for Open-Vocabulary Object Detection
par: Chen, Fangyi, et autres
Publié: (2024)
par: Chen, Fangyi, et autres
Publié: (2024)
YOLO-World: Real-Time Open-Vocabulary Object Detection
par: Cheng, Tianheng, et autres
Publié: (2024)
par: Cheng, Tianheng, et autres
Publié: (2024)
V3Det Challenge 2024 on Vast Vocabulary and Open Vocabulary Object Detection: Methods and Results
par: Wang, Jiaqi, et autres
Publié: (2024)
par: Wang, Jiaqi, et autres
Publié: (2024)
Scaling Open-Vocabulary Object Detection
par: Minderer, Matthias, et autres
Publié: (2023)
par: Minderer, Matthias, et autres
Publié: (2023)
Hierarchical Cross-Modal Alignment for Open-Vocabulary 3D Object Detection
par: Zhao, Youjun, et autres
Publié: (2025)
par: Zhao, Youjun, et autres
Publié: (2025)
Monocular Open Vocabulary Occupancy Prediction for Indoor Scenes
par: Zhou, Changqing, et autres
Publié: (2026)
par: Zhou, Changqing, et autres
Publié: (2026)
OpenNav: Efficient Open Vocabulary 3D Object Detection for Smart Wheelchair Navigation
par: Rahman, Muhammad Rameez ur, et autres
Publié: (2024)
par: Rahman, Muhammad Rameez ur, et autres
Publié: (2024)
3D-MOOD: Lifting 2D to 3D for Monocular Open-Set Object Detection
par: Yang, Yung-Hsu, et autres
Publié: (2025)
par: Yang, Yung-Hsu, et autres
Publié: (2025)
OV-SCAN: Semantically Consistent Alignment for Novel Object Discovery in Open-Vocabulary 3D Object Detection
par: Chow, Adrian, et autres
Publié: (2025)
par: Chow, Adrian, et autres
Publié: (2025)
Revisiting Monocular 3D Object Detection with Depth Thickness Field
par: Zhang, Qiude, et autres
Publié: (2024)
par: Zhang, Qiude, et autres
Publié: (2024)
Generalizing Monocular 3D Object Detection
par: Kumar, Abhinav
Publié: (2025)
par: Kumar, Abhinav
Publié: (2025)
MarvelOVD: Marrying Object Recognition and Vision-Language Models for Robust Open-Vocabulary Object Detection
par: Wang, Kuo, et autres
Publié: (2024)
par: Wang, Kuo, et autres
Publié: (2024)
MonoTAKD: Teaching Assistant Knowledge Distillation for Monocular 3D Object Detection
par: Liu, Hou-I, et autres
Publié: (2024)
par: Liu, Hou-I, et autres
Publié: (2024)
Auto-Vocabulary 3D Object Detection
par: Zhang, Haomeng, et autres
Publié: (2025)
par: Zhang, Haomeng, et autres
Publié: (2025)
Retrieval-Augmented Open-Vocabulary Object Detection
par: Kim, Jooyeon, et autres
Publié: (2024)
par: Kim, Jooyeon, et autres
Publié: (2024)
Group3D: MLLM-Driven Semantic Grouping for Open-Vocabulary 3D Object Detection
par: Kim, Youbin, et autres
Publié: (2026)
par: Kim, Youbin, et autres
Publié: (2026)
SPAN: Spatial-Projection Alignment for Monocular 3D Object Detection
par: Wang, Yifan, et autres
Publié: (2025)
par: Wang, Yifan, et autres
Publié: (2025)
ODOV: Benchmark the Open-Domain Open-Vocabulary Object Detection
par: Zhang, Yupeng, et autres
Publié: (2025)
par: Zhang, Yupeng, et autres
Publié: (2025)
Aerial Monocular 3D Object Detection
par: Hu, Yue, et autres
Publié: (2022)
par: Hu, Yue, et autres
Publié: (2022)
Articulate AnyMesh: Open-Vocabulary 3D Articulated Objects Modeling
par: Qiu, Xiaowen, et autres
Publié: (2025)
par: Qiu, Xiaowen, et autres
Publié: (2025)
WeDetect: Fast Open-Vocabulary Object Detection as Retrieval
par: Fu, Shenghao, et autres
Publié: (2025)
par: Fu, Shenghao, et autres
Publié: (2025)
DeCo-DETR: Decoupled Cognition DETR for efficient Open-Vocabulary Object Detection
par: Wang, Siheng, et autres
Publié: (2026)
par: Wang, Siheng, et autres
Publié: (2026)
Taming Self-Training for Open-Vocabulary Object Detection
par: Zhao, Shiyu, et autres
Publié: (2023)
par: Zhao, Shiyu, et autres
Publié: (2023)
Streamlined Open-Vocabulary Human-Object Interaction Detection
par: Sun, Chang, et autres
Publié: (2026)
par: Sun, Chang, et autres
Publié: (2026)
Beyond Open Vocabulary: Multimodal Prompting for Object Detection in Remote Sensing Images
par: Yang, Shuai, et autres
Publié: (2026)
par: Yang, Shuai, et autres
Publié: (2026)
Exploring Hierarchical Consistency and Unbiased Objectness for Open-Vocabulary Object Detection
par: Lee, Sanghoon, et autres
Publié: (2026)
par: Lee, Sanghoon, et autres
Publié: (2026)
Sparse Multiview Open-Vocabulary 3D Detection
par: Moliner, Olivier, et autres
Publié: (2025)
par: Moliner, Olivier, et autres
Publié: (2025)
Collaborative Novel Object Discovery and Box-Guided Cross-Modal Alignment for Open-Vocabulary 3D Object Detection
par: Cao, Yang, et autres
Publié: (2024)
par: Cao, Yang, et autres
Publié: (2024)
Documents similaires
-
Semantic-Free Procedural 3D Shapes Are Surprisingly Good Teachers
par: Chen, Xuweiyi, et autres
Publié: (2024) -
Probing the Mid-level Vision Capabilities of Self-Supervised Learning
par: Chen, Xuweiyi, et autres
Publié: (2024) -
WildRayZer: Self-supervised Large View Synthesis in Dynamic Environments
par: Chen, Xuweiyi, et autres
Publié: (2026) -
Point-MoE: Large-Scale Multi-Dataset Training with Mixture-of-Experts for 3D Semantic Segmentation
par: Chen, Xuweiyi, et autres
Publié: (2025) -
Frame In-N-Out: Unbounded Controllable Image-to-Video Generation
par: Wang, Boyang, et autres
Publié: (2025)