Beyond Open Vocabulary: Multimodal Prompting for Object Detection in Remote Sensing Images
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yang, Shuai, Huang, Ziyue, Chen, Jiaxin, Liu, Qingjie, Wang, Yunhong |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
OpenRSD: Towards Open-prompts for Object Detection in Remote Sensing Images
par: Huang, Ziyue, et autres
Publié: (2025)
par: Huang, Ziyue, et autres
Publié: (2025)
MutDet: Mutually Optimizing Pre-training for Remote Sensing Object Detection
par: Huang, Ziyue, et autres
Publié: (2024)
par: Huang, Ziyue, et autres
Publié: (2024)
Context-Enhanced Detector For Building Detection From Remote Sensing Images
par: Huang, Ziyue, et autres
Publié: (2023)
par: Huang, Ziyue, et autres
Publié: (2023)
Generic Knowledge Boosted Pre-training For Remote Sensing Images
par: Huang, Ziyue, et autres
Publié: (2024)
par: Huang, Ziyue, et autres
Publié: (2024)
Incremental Object Detection with CLIP
par: Huang, Ziyue, et autres
Publié: (2023)
par: Huang, Ziyue, et autres
Publié: (2023)
CtxMIM: Context-Enhanced Masked Image Modeling for Remote Sensing Image Understanding
par: Zhang, Mingming, et autres
Publié: (2023)
par: Zhang, Mingming, et autres
Publié: (2023)
A Survey on Remote Sensing Foundation Models: From Vision to Multimodality
par: Huang, Ziyue, et autres
Publié: (2025)
par: Huang, Ziyue, et autres
Publié: (2025)
YOLC: You Only Look Clusters for Tiny Object Detection in Aerial Images
par: Liu, Chenguang, et autres
Publié: (2024)
par: Liu, Chenguang, et autres
Publié: (2024)
DSD-DA: Distillation-based Source Debiasing for Domain Adaptive Object Detection
par: Feng, Yongchao, et autres
Publié: (2023)
par: Feng, Yongchao, et autres
Publié: (2023)
Semantic Enhanced Few-shot Object Detection
par: Wang, Zheng, et autres
Publié: (2024)
par: Wang, Zheng, et autres
Publié: (2024)
HIPTrack: Visual Tracking with Historical Prompts
par: Cai, Wenrui, et autres
Publié: (2023)
par: Cai, Wenrui, et autres
Publié: (2023)
Locate Anything on Earth: Advancing Open-Vocabulary Object Detection for Remote Sensing Community
par: Pan, Jiancheng, et autres
Publié: (2024)
par: Pan, Jiancheng, et autres
Publié: (2024)
AttriPrompt: Dynamic Prompt Composition Learning for CLIP
par: Zhan, Qiqi, et autres
Publié: (2025)
par: Zhan, Qiqi, et autres
Publié: (2025)
Annotation-Free Open-Vocabulary Segmentation for Remote-Sensing Images
par: Li, Kaiyu, et autres
Publié: (2025)
par: Li, Kaiyu, et autres
Publié: (2025)
Open-Vocabulary Remote Sensing Image Semantic Segmentation
par: Cao, Qinglong, et autres
Publié: (2024)
par: Cao, Qinglong, et autres
Publié: (2024)
PACF: Prototype Augmented Compact Features for Improving Domain Adaptive Object Detection
par: Liu, Chenguang, et autres
Publié: (2025)
par: Liu, Chenguang, et autres
Publié: (2025)
De-Simplifying Pseudo Labels to Enhancing Domain Adaptive Object Detection
par: Fu, Zehua, et autres
Publié: (2025)
par: Fu, Zehua, et autres
Publié: (2025)
Open-Vocabulary Semantic Segmentation Network Integrating Object-Level Label and Scene-Level Semantic Features for Multimodal Remote Sensing Images
par: Dai, Jinkun, et autres
Publié: (2026)
par: Dai, Jinkun, et autres
Publié: (2026)
MM-OVSeg:Multimodal Optical-SAR Fusion for Open-Vocabulary Segmentation in Remote Sensing
par: Wei, Yimin, et autres
Publié: (2026)
par: Wei, Yimin, et autres
Publié: (2026)
Towards Open-Vocabulary Remote Sensing Image Semantic Segmentation
par: Ye, Chengyang, et autres
Publié: (2024)
par: Ye, Chengyang, et autres
Publié: (2024)
Interactive Masked Image Modeling for Multimodal Object Detection in Remote Sensing
par: Vu, Minh-Duc, et autres
Publié: (2024)
par: Vu, Minh-Duc, et autres
Publié: (2024)
GeoBEV: Learning Geometric BEV Representation for Multi-view 3D Object Detection
par: Zhang, Jinqing, et autres
Publié: (2024)
par: Zhang, Jinqing, et autres
Publié: (2024)
SegEarth-OV: Towards Training-Free Open-Vocabulary Segmentation for Remote Sensing Images
par: Li, Kaiyu, et autres
Publié: (2024)
par: Li, Kaiyu, et autres
Publié: (2024)
Reasoning-Driven Anomaly Detection and Localization with Image-Level Supervision
par: Jin, Yizhou, et autres
Publié: (2026)
par: Jin, Yizhou, et autres
Publié: (2026)
SPMTrack: Spatio-Temporal Parameter-Efficient Fine-Tuning with Mixture of Experts for Scalable Visual Tracking
par: Cai, Wenrui, et autres
Publié: (2025)
par: Cai, Wenrui, et autres
Publié: (2025)
HiT: Building Mapping with Hierarchical Transformers
par: Zhang, Mingming, et autres
Publié: (2023)
par: Zhang, Mingming, et autres
Publié: (2023)
Learning Background Prompts to Discover Implicit Knowledge for Open Vocabulary Object Detection
par: Li, Jiaming, et autres
Publié: (2024)
par: Li, Jiaming, et autres
Publié: (2024)
Open-Vocabulary Object Detection with Meta Prompt Representation and Instance Contrastive Optimization
par: Wang, Zhao, et autres
Publié: (2024)
par: Wang, Zhao, et autres
Publié: (2024)
OpenDPR: Open-Vocabulary Change Detection via Vision-Centric Diffusion-Guided Prototype Retrieval for Remote Sensing Imagery
par: Guo, Qi, et autres
Publié: (2026)
par: Guo, Qi, et autres
Publié: (2026)
FSD-BEV: Foreground Self-Distillation for Multi-view 3D Object Detection
par: Jiang, Zheng, et autres
Publié: (2024)
par: Jiang, Zheng, et autres
Publié: (2024)
Open-Vocabulary HOI Detection with Interaction-aware Prompt and Concept Calibration
par: Lei, Ting, et autres
Publié: (2025)
par: Lei, Ting, et autres
Publié: (2025)
SCORE: Scene Context Matters in Open-Vocabulary Remote Sensing Instance Segmentation
par: Huang, Shiqi, et autres
Publié: (2025)
par: Huang, Shiqi, et autres
Publié: (2025)
RS-OVC: Open-Vocabulary Counting for Remote-Sensing Data
par: Shor, Tamir, et autres
Publié: (2026)
par: Shor, Tamir, et autres
Publié: (2026)
Towards Open-Vocabulary Multimodal 3D Object Detection with Attributes
par: Xiang, Xinhao, et autres
Publié: (2025)
par: Xiang, Xinhao, et autres
Publié: (2025)
Learning to Detect and Segment for Open Vocabulary Object Detection
par: Wang, Tao, et autres
Publié: (2022)
par: Wang, Tao, et autres
Publié: (2022)
Seg2Change: Adapting Open-Vocabulary Semantic Segmentation Model for Remote Sensing Change Detection
par: Su, You, et autres
Publié: (2026)
par: Su, You, et autres
Publié: (2026)
Open Vocabulary Monocular 3D Object Detection
par: Yao, Jin, et autres
Publié: (2024)
par: Yao, Jin, et autres
Publié: (2024)
Multimodal Transformer Using Cross-Channel attention for Object Detection in Remote Sensing Images
par: Bahaduri, Bissmella, et autres
Publié: (2023)
par: Bahaduri, Bissmella, et autres
Publié: (2023)
MO R-CNN: Multispectral Oriented R-CNN for Object Detection in Remote Sensing Image
par: Wang, Leiyu, et autres
Publié: (2025)
par: Wang, Leiyu, et autres
Publié: (2025)
Boosting Open-Vocabulary Object Detection by Handling Background Samples
par: Zeng, Ruizhe, et autres
Publié: (2024)
par: Zeng, Ruizhe, et autres
Publié: (2024)
Documents similaires
-
OpenRSD: Towards Open-prompts for Object Detection in Remote Sensing Images
par: Huang, Ziyue, et autres
Publié: (2025) -
MutDet: Mutually Optimizing Pre-training for Remote Sensing Object Detection
par: Huang, Ziyue, et autres
Publié: (2024) -
Context-Enhanced Detector For Building Detection From Remote Sensing Images
par: Huang, Ziyue, et autres
Publié: (2023) -
Generic Knowledge Boosted Pre-training For Remote Sensing Images
par: Huang, Ziyue, et autres
Publié: (2024) -
Incremental Object Detection with CLIP
par: Huang, Ziyue, et autres
Publié: (2023)