Segment Anything Model for automated image data annotation: empirical studies using text prompts from Grounding DINO
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Mumuni, Fuseini, Mumuni, Alhassan |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Data augmentation with automated machine learning: approaches and performance comparison with classical data augmentation methods
par: Mumuni, Alhassan, et autres
Publié: (2024)
par: Mumuni, Alhassan, et autres
Publié: (2024)
Large language models for artificial general intelligence (AGI): A survey of foundational principles and approaches
par: Mumuni, Alhassan, et autres
Publié: (2025)
par: Mumuni, Alhassan, et autres
Publié: (2025)
Explainable artificial intelligence (XAI): from inherent explainability to large language models
par: Mumuni, Fuseini, et autres
Publié: (2025)
par: Mumuni, Fuseini, et autres
Publié: (2025)
Automated data processing and feature engineering for deep learning and big data applications: a survey
par: Mumuni, Alhassan, et autres
Publié: (2024)
par: Mumuni, Alhassan, et autres
Publié: (2024)
Improving deep learning with prior knowledge and cognitive models: A survey on enhancing explainability, adversarial robustness and zero-shot learning
par: Mumuni, Fuseinin, et autres
Publié: (2024)
par: Mumuni, Fuseinin, et autres
Publié: (2024)
A survey of synthetic data augmentation methods in computer vision
par: Mumuni, Alhassan, et autres
Publié: (2024)
par: Mumuni, Alhassan, et autres
Publié: (2024)
LocateAnything: Fast and High-Quality Vision-Language Grounding with Parallel Box Decoding
par: Wang, Shihao, et autres
Publié: (2026)
par: Wang, Shihao, et autres
Publié: (2026)
Revisit Anything: Visual Place Recognition via Image Segment Retrieval
par: Garg, Kartik, et autres
Publié: (2024)
par: Garg, Kartik, et autres
Publié: (2024)
CataractSAM-2: A Domain-Adapted Model for Anterior Segment Surgery Segmentation and Scalable Ground-Truth Annotation
par: Eslami, Mohammad, et autres
Publié: (2026)
par: Eslami, Mohammad, et autres
Publié: (2026)
MapAnything: Universal Feed-Forward Metric 3D Reconstruction
par: Keetha, Nikhil, et autres
Publié: (2025)
par: Keetha, Nikhil, et autres
Publié: (2025)
Grounding Video Models to Actions through Goal Conditioned Exploration
par: Luo, Yunhao, et autres
Publié: (2024)
par: Luo, Yunhao, et autres
Publié: (2024)
Fast Feature Field ($\text{F}^3$): A Predictive Representation of Events
par: Das, Richeek, et autres
Publié: (2025)
par: Das, Richeek, et autres
Publié: (2025)
Grounding Intelligence in Movement
par: Segado, Melanie, et autres
Publié: (2025)
par: Segado, Melanie, et autres
Publié: (2025)
GrndCtrl: Grounding World Models via Self-Supervised Reward Alignment
par: He, Haoyang, et autres
Publié: (2025)
par: He, Haoyang, et autres
Publié: (2025)
Hyperspectral Adapter for Semantic Segmentation with Vision Foundation Models
par: Hurtado, Juana Valeria, et autres
Publié: (2025)
par: Hurtado, Juana Valeria, et autres
Publié: (2025)
How to Benchmark Vision Foundation Models for Semantic Segmentation?
par: Kerssies, Tommie, et autres
Publié: (2024)
par: Kerssies, Tommie, et autres
Publié: (2024)
Grounding Foundational Vision Models with 3D Human Poses for Robust Action Recognition
par: Babey, Nicholas, et autres
Publié: (2025)
par: Babey, Nicholas, et autres
Publié: (2025)
From Spatial to Actions: Grounding Vision-Language-Action Model in Spatial Foundation Priors
par: Zhang, Zhengshen, et autres
Publié: (2025)
par: Zhang, Zhengshen, et autres
Publié: (2025)
Red-Teaming Segment Anything Model
par: Jankowski, Krzysztof, et autres
Publié: (2024)
par: Jankowski, Krzysztof, et autres
Publié: (2024)
ICAT: Incident-Case-Grounded Adaptive Testing for Physical-Risk Prediction in Embodied World Models
par: Lai, Zhenglin, et autres
Publié: (2026)
par: Lai, Zhenglin, et autres
Publié: (2026)
ODIN: A Single Model for 2D and 3D Segmentation
par: Jain, Ayush, et autres
Publié: (2024)
par: Jain, Ayush, et autres
Publié: (2024)
FoundObj: Self-supervised Foundation Models as Rewards for Label-free 3D Object Segmentation
par: Zhang, Zihui, et autres
Publié: (2026)
par: Zhang, Zihui, et autres
Publié: (2026)
GroCo: Ground Constraint for Metric Self-Supervised Monocular Depth
par: Cecille, Aurélien, et autres
Publié: (2024)
par: Cecille, Aurélien, et autres
Publié: (2024)
RAD-LAD: Rule and Language Grounded Autonomous Driving in Real-Time
par: Ghosh, Anurag, et autres
Publié: (2026)
par: Ghosh, Anurag, et autres
Publié: (2026)
UnSAMFlow: Unsupervised Optical Flow Guided by Segment Anything Model
par: Yuan, Shuai, et autres
Publié: (2024)
par: Yuan, Shuai, et autres
Publié: (2024)
First Place Solution to the ECCV 2024 BRAVO Challenge: Evaluating Robustness of Vision Foundation Models for Semantic Segmentation
par: Kerssies, Tommie, et autres
Publié: (2024)
par: Kerssies, Tommie, et autres
Publié: (2024)
Adapting Segment Anything Model to Melanoma Segmentation in Microscopy Slide Images
par: Liu, Qingyuan, et autres
Publié: (2024)
par: Liu, Qingyuan, et autres
Publié: (2024)
IKEA Manuals at Work: 4D Grounding of Assembly Instructions on Internet Videos
par: Liu, Yunong, et autres
Publié: (2024)
par: Liu, Yunong, et autres
Publié: (2024)
Eye image segmentation using visual and concept prompts with Segment Anything Model 3 (SAM3)
par: Niehorster, Diederick C., et autres
Publié: (2026)
par: Niehorster, Diederick C., et autres
Publié: (2026)
GSplatLoc: Grounding Keypoint Descriptors into 3D Gaussian Splatting for Improved Visual Localization
par: Sidorov, Gennady, et autres
Publié: (2024)
par: Sidorov, Gennady, et autres
Publié: (2024)
Audio-3DVG: Unified Audio -- Point Cloud Fusion for 3D Visual Grounding
par: Cao-Dinh, Duc, et autres
Publié: (2025)
par: Cao-Dinh, Duc, et autres
Publié: (2025)
Subtask-Aware Visual Reward Learning from Segmented Demonstrations
par: Kim, Changyeon, et autres
Publié: (2025)
par: Kim, Changyeon, et autres
Publié: (2025)
Extremely Simple Multimodal Outlier Synthesis for Out-of-Distribution Detection and Segmentation
par: Liu, Moru, et autres
Publié: (2025)
par: Liu, Moru, et autres
Publié: (2025)
TopoSD: Topology-Enhanced Lane Segment Perception with SDMap Prior
par: Yang, Sen, et autres
Publié: (2024)
par: Yang, Sen, et autres
Publié: (2024)
unMORE: Unsupervised Multi-Object Segmentation via Center-Boundary Reasoning
par: Yang, Yafei, et autres
Publié: (2025)
par: Yang, Yafei, et autres
Publié: (2025)
MESSI: A Multi-Elevation Semantic Segmentation Image Dataset of an Urban Environment
par: Pinkovich, Barak, et autres
Publié: (2025)
par: Pinkovich, Barak, et autres
Publié: (2025)
Open-Set LiDAR Panoptic Segmentation Guided by Uncertainty-Aware Learning
par: Mohan, Rohit, et autres
Publié: (2025)
par: Mohan, Rohit, et autres
Publié: (2025)
SegXAL: Explainable Active Learning for Semantic Segmentation in Driving Scene Scenarios
par: Mandalika, Sriram, et autres
Publié: (2024)
par: Mandalika, Sriram, et autres
Publié: (2024)
NIL: No-data Imitation Learning by Leveraging Pre-trained Video Diffusion Models
par: Albaba, Mert, et autres
Publié: (2025)
par: Albaba, Mert, et autres
Publié: (2025)
GrabS: Generative Embodied Agent for 3D Object Segmentation without Scene Supervision
par: Zhang, Zihui, et autres
Publié: (2025)
par: Zhang, Zihui, et autres
Publié: (2025)
Documents similaires
-
Data augmentation with automated machine learning: approaches and performance comparison with classical data augmentation methods
par: Mumuni, Alhassan, et autres
Publié: (2024) -
Large language models for artificial general intelligence (AGI): A survey of foundational principles and approaches
par: Mumuni, Alhassan, et autres
Publié: (2025) -
Explainable artificial intelligence (XAI): from inherent explainability to large language models
par: Mumuni, Fuseini, et autres
Publié: (2025) -
Automated data processing and feature engineering for deep learning and big data applications: a survey
par: Mumuni, Alhassan, et autres
Publié: (2024) -
Improving deep learning with prior knowledge and cognitive models: A survey on enhancing explainability, adversarial robustness and zero-shot learning
par: Mumuni, Fuseinin, et autres
Publié: (2024)