MarvelOVD: Marrying Object Recognition and Vision-Language Models for Robust Open-Vocabulary Object Detection
Fuente:
arXiv
Guardado en:
| Autores principales: | Wang, Kuo, Cheng, Lechao, Chen, Weikai, Zhang, Pingping, Lin, Liang, Zhou, Fan, Li, Guanbin |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
GUIDED: Granular Understanding via Identification, Detection, and Discrimination for Fine-Grained Open-Vocabulary Object Detection
por: Li, Jiaming, et al.
Publicado: (2026)
por: Li, Jiaming, et al.
Publicado: (2026)
NoOVD: Novel Category Discovery and Embedding for Open-Vocabulary Object Detection
por: Zhang, Yupeng, et al.
Publicado: (2026)
por: Zhang, Yupeng, et al.
Publicado: (2026)
OVER-NAV: Elevating Iterative Vision-and-Language Navigation with Open-Vocabulary Detection and StructurEd Representation
por: Zhao, Ganlong, et al.
Publicado: (2024)
por: Zhao, Ganlong, et al.
Publicado: (2024)
Credible Teacher for Semi-Supervised Object Detection in Open Scene
por: Zhuang, Jingyu, et al.
Publicado: (2024)
por: Zhuang, Jingyu, et al.
Publicado: (2024)
Learning Background Prompts to Discover Implicit Knowledge for Open Vocabulary Object Detection
por: Li, Jiaming, et al.
Publicado: (2024)
por: Li, Jiaming, et al.
Publicado: (2024)
Open-Vocabulary Camouflaged Object Segmentation with Cascaded Vision Language Models
por: Zhao, Kai, et al.
Publicado: (2025)
por: Zhao, Kai, et al.
Publicado: (2025)
ODOV: Benchmark the Open-Domain Open-Vocabulary Object Detection
por: Zhang, Yupeng, et al.
Publicado: (2025)
por: Zhang, Yupeng, et al.
Publicado: (2025)
SIA-OVD: Shape-Invariant Adapter for Bridging the Image-Region Gap in Open-Vocabulary Detection
por: Wang, Zishuo, et al.
Publicado: (2024)
por: Wang, Zishuo, et al.
Publicado: (2024)
From Open Vocabulary to Open World: Teaching Vision Language Models to Detect Novel Objects
por: Li, Zizhao, et al.
Publicado: (2024)
por: Li, Zizhao, et al.
Publicado: (2024)
YOLO-World: Real-Time Open-Vocabulary Object Detection
por: Cheng, Tianheng, et al.
Publicado: (2024)
por: Cheng, Tianheng, et al.
Publicado: (2024)
Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection
por: Hu, Yupeng, et al.
Publicado: (2025)
por: Hu, Yupeng, et al.
Publicado: (2025)
Scaling Open-Vocabulary Object Detection
por: Minderer, Matthias, et al.
Publicado: (2023)
por: Minderer, Matthias, et al.
Publicado: (2023)
Open Vocabulary Monocular 3D Object Detection
por: Yao, Jin, et al.
Publicado: (2024)
por: Yao, Jin, et al.
Publicado: (2024)
Towards Long-Horizon Vision-Language Navigation: Platform, Benchmark and Method
por: Song, Xinshuai, et al.
Publicado: (2024)
por: Song, Xinshuai, et al.
Publicado: (2024)
Retrieval-Augmented Open-Vocabulary Object Detection
por: Kim, Jooyeon, et al.
Publicado: (2024)
por: Kim, Jooyeon, et al.
Publicado: (2024)
Exploring Hierarchical Consistency and Unbiased Objectness for Open-Vocabulary Object Detection
por: Lee, Sanghoon, et al.
Publicado: (2026)
por: Lee, Sanghoon, et al.
Publicado: (2026)
A Training-Free Guess What Vision Language Model from Snippets to Open-Vocabulary Object Detection
por: Zhu, Guiying, et al.
Publicado: (2026)
por: Zhu, Guiying, et al.
Publicado: (2026)
Adaptive Event Stream Slicing for Open-Vocabulary Event-Based Object Detection via Vision-Language Knowledge Distillation
por: Zhang, Jinchang, et al.
Publicado: (2025)
por: Zhang, Jinchang, et al.
Publicado: (2025)
Learning to Detect and Segment for Open Vocabulary Object Detection
por: Wang, Tao, et al.
Publicado: (2022)
por: Wang, Tao, et al.
Publicado: (2022)
Self-Classification Enhancement and Correction for Weakly Supervised Object Detection
por: Yin, Yufei, et al.
Publicado: (2025)
por: Yin, Yufei, et al.
Publicado: (2025)
Exploring Open-Vocabulary Object Recognition in Images using CLIP
por: Chen, Wei Yu, et al.
Publicado: (2026)
por: Chen, Wei Yu, et al.
Publicado: (2026)
Grounding DINO: Marrying DINO with Grounded Pre-Training for Open-Set Object Detection
por: Liu, Shilong, et al.
Publicado: (2023)
por: Liu, Shilong, et al.
Publicado: (2023)
Open-Vocabulary Object Detection via Language Hierarchy
por: Huang, Jiaxing, et al.
Publicado: (2024)
por: Huang, Jiaxing, et al.
Publicado: (2024)
Mamba-YOLO-World: Marrying YOLO-World with Mamba for Open-Vocabulary Detection
por: Wang, Haoxuan, et al.
Publicado: (2024)
por: Wang, Haoxuan, et al.
Publicado: (2024)
Open-Vocabulary Object Detection via Neighboring Region Attention Alignment
por: Qiang, Sunyuan, et al.
Publicado: (2024)
por: Qiang, Sunyuan, et al.
Publicado: (2024)
COVD: Continual Open-Vocabulary Object Detection with Novel Concept Injection
por: Zhang, Yupeng, et al.
Publicado: (2026)
por: Zhang, Yupeng, et al.
Publicado: (2026)
Superpowering Open-Vocabulary Object Detectors for X-ray Vision
por: Garcia-Fernandez, Pablo, et al.
Publicado: (2025)
por: Garcia-Fernandez, Pablo, et al.
Publicado: (2025)
Taming Self-Training for Open-Vocabulary Object Detection
por: Zhao, Shiyu, et al.
Publicado: (2023)
por: Zhao, Shiyu, et al.
Publicado: (2023)
Streamlined Open-Vocabulary Human-Object Interaction Detection
por: Sun, Chang, et al.
Publicado: (2026)
por: Sun, Chang, et al.
Publicado: (2026)
WeDetect: Fast Open-Vocabulary Object Detection as Retrieval
por: Fu, Shenghao, et al.
Publicado: (2025)
por: Fu, Shenghao, et al.
Publicado: (2025)
SDDF: Specificity-Driven Dynamic Focusing for Open-Vocabulary Camouflaged Object Detection
por: Liang, Jiaming, et al.
Publicado: (2026)
por: Liang, Jiaming, et al.
Publicado: (2026)
State and Scene Enhanced Prototypes for Weakly Supervised Open-Vocabulary Object Detection
por: Zhou, Jiaying, et al.
Publicado: (2025)
por: Zhou, Jiaying, et al.
Publicado: (2025)
On the Potential of Open-Vocabulary Models for Object Detection in Unusual Street Scenes
por: Ilyas, Sadia, et al.
Publicado: (2024)
por: Ilyas, Sadia, et al.
Publicado: (2024)
LV-OSD: Language-Vision-Complementary Open-Set Object Detection
por: Zhang, Yupeng, et al.
Publicado: (2026)
por: Zhang, Yupeng, et al.
Publicado: (2026)
Hierarchical Cross-Modal Alignment for Open-Vocabulary 3D Object Detection
por: Zhao, Youjun, et al.
Publicado: (2025)
por: Zhao, Youjun, et al.
Publicado: (2025)
Unsupervised Open-Vocabulary Object Localization in Videos
por: Fan, Ke, et al.
Publicado: (2023)
por: Fan, Ke, et al.
Publicado: (2023)
Open-Vocabulary Object Detection with Meta Prompt Representation and Instance Contrastive Optimization
por: Wang, Zhao, et al.
Publicado: (2024)
por: Wang, Zhao, et al.
Publicado: (2024)
Cross-View Open-Vocabulary Object Detection in Aerial Imagery
por: Kini, Jyoti, et al.
Publicado: (2025)
por: Kini, Jyoti, et al.
Publicado: (2025)
LP-OVOD: Open-Vocabulary Object Detection by Linear Probing
por: Pham, Chau, et al.
Publicado: (2023)
por: Pham, Chau, et al.
Publicado: (2023)
Boosting Open-Vocabulary Object Detection by Handling Background Samples
por: Zeng, Ruizhe, et al.
Publicado: (2024)
por: Zeng, Ruizhe, et al.
Publicado: (2024)
Ejemplares similares
-
GUIDED: Granular Understanding via Identification, Detection, and Discrimination for Fine-Grained Open-Vocabulary Object Detection
por: Li, Jiaming, et al.
Publicado: (2026) -
NoOVD: Novel Category Discovery and Embedding for Open-Vocabulary Object Detection
por: Zhang, Yupeng, et al.
Publicado: (2026) -
OVER-NAV: Elevating Iterative Vision-and-Language Navigation with Open-Vocabulary Detection and StructurEd Representation
por: Zhao, Ganlong, et al.
Publicado: (2024) -
Credible Teacher for Semi-Supervised Object Detection in Open Scene
por: Zhuang, Jingyu, et al.
Publicado: (2024) -
Learning Background Prompts to Discover Implicit Knowledge for Open Vocabulary Object Detection
por: Li, Jiaming, et al.
Publicado: (2024)