Zero-Shot and Supervised Bird Image Segmentation Using Foundation Models: A Dual-Pipeline Approach with Grounding DINO~1.5, YOLOv11, and SAM~2.1
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Munagala, Abhinav |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Zero-Shot Pseudo Labels Generation Using SAM and CLIP for Semi-Supervised Semantic Segmentation
par: Saito, Nagito, et autres
Publié: (2025)
par: Saito, Nagito, et autres
Publié: (2025)
Efficient License Plate Recognition via Pseudo-Labeled Supervision with Grounding DINO and YOLOv8
par: Vargoorani, Zahra Ebrahimi, et autres
Publié: (2025)
par: Vargoorani, Zahra Ebrahimi, et autres
Publié: (2025)
ReferDINO: Referring Video Object Segmentation with Visual Grounding Foundations
par: Liang, Tianming, et autres
Publié: (2025)
par: Liang, Tianming, et autres
Publié: (2025)
ProtoSAM: One-Shot Medical Image Segmentation With Foundational Models
par: Ayzenberg, Lev, et autres
Publié: (2024)
par: Ayzenberg, Lev, et autres
Publié: (2024)
Grounding DINO 1.5: Advance the "Edge" of Open-Set Object Detection
par: Ren, Tianhe, et autres
Publié: (2024)
par: Ren, Tianhe, et autres
Publié: (2024)
GuiDINO: Rethinking Vision Foundation Model in Medical Image Segmentation
par: Liang, Zhuonan, et autres
Publié: (2026)
par: Liang, Zhuonan, et autres
Publié: (2026)
Zero-Shot Segmentation of Eye Features Using the Segment Anything Model (SAM)
par: Maquiling, Virmarie, et autres
Publié: (2023)
par: Maquiling, Virmarie, et autres
Publié: (2023)
OVS-DINO: Open-Vocabulary Segmentation via Structure-Aligned SAM-DINO with Language Guidance
par: Zeng, Haoxi, et autres
Publié: (2026)
par: Zeng, Haoxi, et autres
Publié: (2026)
Few-Shot Adaptation of Grounding DINO for Agricultural Domain
par: Singh, Rajhans, et autres
Publié: (2025)
par: Singh, Rajhans, et autres
Publié: (2025)
ClipSAM: CLIP and SAM Collaboration for Zero-Shot Anomaly Segmentation
par: Li, Shengze, et autres
Publié: (2024)
par: Li, Shengze, et autres
Publié: (2024)
WPS-SAM: Towards Weakly-Supervised Part Segmentation with Foundation Models
par: Wu, Xinjian, et autres
Publié: (2024)
par: Wu, Xinjian, et autres
Publié: (2024)
Few-Shot Panoptic Segmentation With Foundation Models
par: Käppeler, Markus, et autres
Publié: (2023)
par: Käppeler, Markus, et autres
Publié: (2023)
SAM-Mamba: Mamba Guided SAM Architecture for Generalized Zero-Shot Polyp Segmentation
par: Dutta, Tapas Kumar, et autres
Publié: (2024)
par: Dutta, Tapas Kumar, et autres
Publié: (2024)
Early Semantic Grounding in Image Editing Models for Zero-Shot Referring Image Segmentation
par: He, Jingxuan, et autres
Publié: (2026)
par: He, Jingxuan, et autres
Publié: (2026)
Grounding DINO-US-SAM: Text-Prompted Multi-Organ Segmentation in Ultrasound with LoRA-Tuned Vision-Language Models
par: Rasaee, Hamza, et autres
Publié: (2025)
par: Rasaee, Hamza, et autres
Publié: (2025)
SemiSAM+: Rethinking Semi-Supervised Medical Image Segmentation in the Era of Foundation Models
par: Zhang, Yichi, et autres
Publié: (2025)
par: Zhang, Yichi, et autres
Publié: (2025)
OPTED: Open Preprocessed Trachoma Eye Dataset Using Zero-Shot SAM 3 Segmentation
par: Gebremedhin, Kibrom, et autres
Publié: (2026)
par: Gebremedhin, Kibrom, et autres
Publié: (2026)
SAM-LAD: Segment Anything Model Meets Zero-Shot Logic Anomaly Detection
par: Peng, Yun, et autres
Publié: (2024)
par: Peng, Yun, et autres
Publié: (2024)
Zero-Shot Image Anomaly Detection Using Generative Foundation Models
par: Abdi, Lemar, et autres
Publié: (2025)
par: Abdi, Lemar, et autres
Publié: (2025)
Iris-SAM: Iris Segmentation Using a Foundation Model
par: Farmanifard, Parisa, et autres
Publié: (2024)
par: Farmanifard, Parisa, et autres
Publié: (2024)
Zero-Shot Refinement of Buildings' Segmentation Models using SAM
par: Mayladan, Ali, et autres
Publié: (2023)
par: Mayladan, Ali, et autres
Publié: (2023)
DINO in the Room: Leveraging 2D Foundation Models for 3D Segmentation
par: Knaebel, Karim, et autres
Publié: (2025)
par: Knaebel, Karim, et autres
Publié: (2025)
SAM3D: Zero-Shot Semi-Automatic Segmentation in 3D Medical Images with the Segment Anything Model
par: Chan, Trevor J., et autres
Publié: (2024)
par: Chan, Trevor J., et autres
Publié: (2024)
SegDINO: An Efficient Design for Medical and Natural Image Segmentation with DINO-V3
par: Yang, Sicheng, et autres
Publié: (2025)
par: Yang, Sicheng, et autres
Publié: (2025)
Evaluating Stenosis Detection with Grounding DINO, YOLO, and DINO-DETR
par: Ansari, Muhammad Musab
Publié: (2025)
par: Ansari, Muhammad Musab
Publié: (2025)
Grounding DINO: Marrying DINO with Grounded Pre-Training for Open-Set Object Detection
par: Liu, Shilong, et autres
Publié: (2023)
par: Liu, Shilong, et autres
Publié: (2023)
Comparing SAM 2 and SAM 3 for Zero-Shot Segmentation of 3D Medical Data
par: Chakrabarty, Satrajit, et autres
Publié: (2025)
par: Chakrabarty, Satrajit, et autres
Publié: (2025)
PixelDINO: Semi-Supervised Semantic Segmentation for Detecting Permafrost Disturbances
par: Heidler, Konrad, et autres
Publié: (2024)
par: Heidler, Konrad, et autres
Publié: (2024)
PointSAM: Pointly-Supervised Segment Anything Model for Remote Sensing Images
par: Liu, Nanqing, et autres
Publié: (2024)
par: Liu, Nanqing, et autres
Publié: (2024)
SAM-IF: Leveraging SAM for Incremental Few-Shot Instance Segmentation
par: Zhou, Xudong, et autres
Publié: (2024)
par: Zhou, Xudong, et autres
Publié: (2024)
Fine-Grained DINO Tuning with Dual Supervision for Face Forgery Detection
par: Zhang, Tianxiang, et autres
Publié: (2025)
par: Zhang, Tianxiang, et autres
Publié: (2025)
CLIP meets DINO for Tuning Zero-Shot Classifier using Unlabeled Image Collections
par: Imam, Mohamed Fazli, et autres
Publié: (2024)
par: Imam, Mohamed Fazli, et autres
Publié: (2024)
Zero Shot Context-Based Object Segmentation using SLIP (SAM+CLIP)
par: Gundavarapu, Saaketh Koundinya, et autres
Publié: (2024)
par: Gundavarapu, Saaketh Koundinya, et autres
Publié: (2024)
Foundation Models for Zero-Shot Segmentation of Scientific Images without AI-Ready Data
par: Mukherjee, Shubhabrata, et autres
Publié: (2025)
par: Mukherjee, Shubhabrata, et autres
Publié: (2025)
DiffuSAM: Diffusion Guided Zero-Shot Object Grounding for Remote Sensing Imagery
par: Sethi, Geet, et autres
Publié: (2026)
par: Sethi, Geet, et autres
Publié: (2026)
Learning Robust Correlation with Foundation Model for Weakly-Supervised Few-Shot Segmentation
par: Huang, Xinyang, et autres
Publié: (2024)
par: Huang, Xinyang, et autres
Publié: (2024)
SAM-6D: Segment Anything Model Meets Zero-Shot 6D Object Pose Estimation
par: Lin, Jiehong, et autres
Publié: (2023)
par: Lin, Jiehong, et autres
Publié: (2023)
DINO-R1: Incentivizing Reasoning Capability in Vision Foundation Models
par: Pan, Chenbin, et autres
Publié: (2025)
par: Pan, Chenbin, et autres
Publié: (2025)
PET-DINO: Unifying Visual Cues into Grounding DINO with Prompt-Enriched Training
par: Fu, Weifu, et autres
Publié: (2026)
par: Fu, Weifu, et autres
Publié: (2026)
SAM-Fed: SAM-Guided Federated Semi-Supervised Learning for Medical Image Segmentation
par: Nasirihaghighi, Sahar, et autres
Publié: (2025)
par: Nasirihaghighi, Sahar, et autres
Publié: (2025)
Documents similaires
-
Zero-Shot Pseudo Labels Generation Using SAM and CLIP for Semi-Supervised Semantic Segmentation
par: Saito, Nagito, et autres
Publié: (2025) -
Efficient License Plate Recognition via Pseudo-Labeled Supervision with Grounding DINO and YOLOv8
par: Vargoorani, Zahra Ebrahimi, et autres
Publié: (2025) -
ReferDINO: Referring Video Object Segmentation with Visual Grounding Foundations
par: Liang, Tianming, et autres
Publié: (2025) -
ProtoSAM: One-Shot Medical Image Segmentation With Foundational Models
par: Ayzenberg, Lev, et autres
Publié: (2024) -
Grounding DINO 1.5: Advance the "Edge" of Open-Set Object Detection
par: Ren, Tianhe, et autres
Publié: (2024)