DetCLIPv3: Towards Versatile Generative Open-vocabulary Object Detection
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yao, Lewei, Pi, Renjie, Han, Jianhua, Liang, Xiaodan, Xu, Hang, Zhang, Wei, Li, Zhenguo, Xu, Dan |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
OMG: Towards Open-vocabulary Motion Generation via Mixture of Controllers
par: Liang, Han, et autres
Publié: (2023)
par: Liang, Han, et autres
Publié: (2023)
VK-Det: Visual Knowledge Guided Prototype Learning for Open-Vocabulary Aerial Object Detection
par: Yao, Jianhang, et autres
Publié: (2025)
par: Yao, Jianhang, et autres
Publié: (2025)
MagicSeg: Open-World Segmentation Pretraining via Counterfactural Diffusion-Based Auto-Generation
par: Cai, Kaixin, et autres
Publié: (2026)
par: Cai, Kaixin, et autres
Publié: (2026)
Collaborative Novel Object Discovery and Box-Guided Cross-Modal Alignment for Open-Vocabulary 3D Object Detection
par: Cao, Yang, et autres
Publié: (2024)
par: Cao, Yang, et autres
Publié: (2024)
DST-Det: Simple Dynamic Self-Training for Open-Vocabulary Object Detection
par: Xu, Shilin, et autres
Publié: (2023)
par: Xu, Shilin, et autres
Publié: (2023)
FlowOVD: Learning Generative Latent Flows for Zero-shot Open-vocabulary Detection
par: Wei, Yao, et autres
Publié: (2026)
par: Wei, Yao, et autres
Publié: (2026)
CascadeV-Det: Cascade Point Voting for 3D Object Detection
par: Liang, Yingping, et autres
Publié: (2024)
par: Liang, Yingping, et autres
Publié: (2024)
V3Det Challenge 2024 on Vast Vocabulary and Open Vocabulary Object Detection: Methods and Results
par: Wang, Jiaqi, et autres
Publié: (2024)
par: Wang, Jiaqi, et autres
Publié: (2024)
SHiNe: Semantic Hierarchy Nexus for Open-vocabulary Object Detection
par: Liu, Mingxuan, et autres
Publié: (2024)
par: Liu, Mingxuan, et autres
Publié: (2024)
RemDet: Rethinking Efficient Model Design for UAV Object Detection
par: Li, Chen, et autres
Publié: (2024)
par: Li, Chen, et autres
Publié: (2024)
VGGT-Det: Mining VGGT Internal Priors for Sensor-Geometry-Free Multi-View Indoor 3D Object Detection
par: Cao, Yang, et autres
Publié: (2026)
par: Cao, Yang, et autres
Publié: (2026)
FlowDet: Unifying Object Detection and Generative Transport Flows
par: Baty, Enis, et autres
Publié: (2025)
par: Baty, Enis, et autres
Publié: (2025)
BioDet: Boosting Industrial Object Detection with Image Preprocessing Strategies
par: Hu, Jiaqi, et autres
Publié: (2025)
par: Hu, Jiaqi, et autres
Publié: (2025)
GVSynergy-Det: Synergistic Gaussian-Voxel Representations for Multi-View 3D Object Detection
par: Zhang, Yi, et autres
Publié: (2025)
par: Zhang, Yi, et autres
Publié: (2025)
EasyControl: Transfer ControlNet to Video Diffusion for Controllable Generation and Interpolation
par: Wang, Cong, et autres
Publié: (2024)
par: Wang, Cong, et autres
Publié: (2024)
HumanRefiner: Benchmarking Abnormal Human Generation and Refining with Coarse-to-fine Pose-Reversible Guidance
par: Fang, Guian, et autres
Publié: (2024)
par: Fang, Guian, et autres
Publié: (2024)
Towards Unified Multimodal Interleaved Generation via Group Relative Policy Optimization
par: Nie, Ming, et autres
Publié: (2026)
par: Nie, Ming, et autres
Publié: (2026)
LAB-Det: Language as a Domain-Invariant Bridge for Training-Free One-Shot Domain Generalization in Object Detection
par: Zhang, Xu, et autres
Publié: (2026)
par: Zhang, Xu, et autres
Publié: (2026)
CorNav: Autonomous Agent with Self-Corrected Planning for Zero-Shot Vision-and-Language Navigation
par: Liang, Xiwen, et autres
Publié: (2023)
par: Liang, Xiwen, et autres
Publié: (2023)
DetDiffusion: Synergizing Generative and Perceptive Models for Enhanced Data Generation and Perception
par: Wang, Yibo, et autres
Publié: (2024)
par: Wang, Yibo, et autres
Publié: (2024)
Open-Det: An Efficient Learning Framework for Open-Ended Detection
par: Cao, Guiping, et autres
Publié: (2025)
par: Cao, Guiping, et autres
Publié: (2025)
Weakly Supervised 3D Open-vocabulary Segmentation
par: Liu, Kunhao, et autres
Publié: (2023)
par: Liu, Kunhao, et autres
Publié: (2023)
Thermal-Det: Language-Guided Cross-Modal Distillation for Open-Vocabulary Thermal Object Detection
par: Ranasinghe, Yasiru, et autres
Publié: (2026)
par: Ranasinghe, Yasiru, et autres
Publié: (2026)
3DGeoDet: General-purpose Geometry-aware Image-based 3D Object Detection
par: Zhang, Yi, et autres
Publié: (2025)
par: Zhang, Yi, et autres
Publié: (2025)
LayerDiff: Exploring Text-guided Multi-layered Composable Image Synthesis via Layer-Collaborative Diffusion Model
par: Huang, Runhui, et autres
Publié: (2024)
par: Huang, Runhui, et autres
Publié: (2024)
SemHiTok: A Unified Image Tokenizer via Semantic-Guided Hierarchical Codebook for Multimodal Understanding and Generation
par: Chen, Zisheng, et autres
Publié: (2025)
par: Chen, Zisheng, et autres
Publié: (2025)
ODOV: Benchmark the Open-Domain Open-Vocabulary Object Detection
par: Zhang, Yupeng, et autres
Publié: (2025)
par: Zhang, Yupeng, et autres
Publié: (2025)
VidMan: Exploiting Implicit Dynamics from Video Diffusion Model for Effective Robot Manipulation
par: Wen, Youpeng, et autres
Publié: (2024)
par: Wen, Youpeng, et autres
Publié: (2024)
LLMs Meet VLMs: Boost Open Vocabulary Object Detection with Fine-grained Descriptors
par: Jin, Sheng, et autres
Publié: (2024)
par: Jin, Sheng, et autres
Publié: (2024)
HazyDet: Open-Source Benchmark for Drone-View Object Detection with Depth-Cues in Hazy Scenes
par: Feng, Changfeng, et autres
Publié: (2024)
par: Feng, Changfeng, et autres
Publié: (2024)
ProxyDet: Synthesizing Proxy Novel Classes via Classwise Mixup for Open-Vocabulary Object Detection
par: Jeong, Joonhyun, et autres
Publié: (2023)
par: Jeong, Joonhyun, et autres
Publié: (2023)
DetVPCC: RoI-based Point Cloud Sequence Compression for 3D Object Detection
par: Yan, Mingxuan, et autres
Publié: (2025)
par: Yan, Mingxuan, et autres
Publié: (2025)
Gaussian-Det: Learning Closed-Surface Gaussians for 3D Object Detection
par: Yan, Hongru, et autres
Publié: (2024)
par: Yan, Hongru, et autres
Publié: (2024)
BadDet+: Robust Backdoor Attacks for Object Detection
par: Dunnett, Kealan, et autres
Publié: (2026)
par: Dunnett, Kealan, et autres
Publié: (2026)
UniDet3D: Multi-dataset Indoor 3D Object Detection
par: Kolodiazhnyi, Maksim, et autres
Publié: (2024)
par: Kolodiazhnyi, Maksim, et autres
Publié: (2024)
Parameter-efficient Fine-tuning in Hyperspherical Space for Open-vocabulary Semantic Segmentation
par: Peng, Zelin, et autres
Publié: (2024)
par: Peng, Zelin, et autres
Publié: (2024)
RGBX-DiffusionDet: A Framework for Multi-Modal RGB-X Object Detection Using DiffusionDet
par: Orfaig, Eliraz, et autres
Publié: (2025)
par: Orfaig, Eliraz, et autres
Publié: (2025)
AD-Det: Boosting Object Detection in UAV Images with Focused Small Objects and Balanced Tail Classes
par: Li, Zhenteng, et autres
Publié: (2025)
par: Li, Zhenteng, et autres
Publié: (2025)
FMG-Det: Foundation Model Guided Robust Object Detection
par: Hannan, Darryl, et autres
Publié: (2025)
par: Hannan, Darryl, et autres
Publié: (2025)
Towards Domain-Generalized Open-Vocabulary Object Detection: A Progressive Domain-invariant Cross-modal Alignment Method
par: Xu, Xiaoran, et autres
Publié: (2026)
par: Xu, Xiaoran, et autres
Publié: (2026)
Documents similaires
-
OMG: Towards Open-vocabulary Motion Generation via Mixture of Controllers
par: Liang, Han, et autres
Publié: (2023) -
VK-Det: Visual Knowledge Guided Prototype Learning for Open-Vocabulary Aerial Object Detection
par: Yao, Jianhang, et autres
Publié: (2025) -
MagicSeg: Open-World Segmentation Pretraining via Counterfactural Diffusion-Based Auto-Generation
par: Cai, Kaixin, et autres
Publié: (2026) -
Collaborative Novel Object Discovery and Box-Guided Cross-Modal Alignment for Open-Vocabulary 3D Object Detection
par: Cao, Yang, et autres
Publié: (2024) -
DST-Det: Simple Dynamic Self-Training for Open-Vocabulary Object Detection
par: Xu, Shilin, et autres
Publié: (2023)