Generalization vs. Specialization: Evaluating Segment Anything Model (SAM3) Zero-Shot Segmentation Against Fine-Tuned YOLO Detectors
Fuente:
arXiv
Salvato in:
| Autori principali: | Sapkota, Ranjan, Roumeliotis, Konstantinos I., Karkee, Manoj, Tselikas, Nikolaos D. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
The SAM2-to-SAM3 Gap in the Segment Anything Model Family: Why Prompt-Based Expertise Fails in Concept-Driven Image Segmentation
di: Sapkota, Ranjan, et al.
Pubblicazione: (2025)
di: Sapkota, Ranjan, et al.
Pubblicazione: (2025)
Agentic AI with Orchestrator-Agent Trust: A Modular Visual Classification Framework with Trust-Aware Orchestration and RAG-Based Reasoning
di: Roumeliotis, Konstantinos I., et al.
Pubblicazione: (2025)
di: Roumeliotis, Konstantinos I., et al.
Pubblicazione: (2025)
AI Agents vs. Agentic AI: A Conceptual Taxonomy, Applications and Challenges
di: Sapkota, Ranjan, et al.
Pubblicazione: (2025)
di: Sapkota, Ranjan, et al.
Pubblicazione: (2025)
Vibe Coding vs. Agentic Coding: Fundamentals and Practical Implications of Agentic AI
di: Sapkota, Ranjan, et al.
Pubblicazione: (2025)
di: Sapkota, Ranjan, et al.
Pubblicazione: (2025)
Plant Disease Detection through Multimodal Large Language Models and Convolutional Neural Networks
di: Roumeliotis, Konstantinos I., et al.
Pubblicazione: (2025)
di: Roumeliotis, Konstantinos I., et al.
Pubblicazione: (2025)
Ultralytics YOLO Evolution: An Overview of YOLO26, YOLO11, YOLOv8 and YOLOv5 Object Detectors for Computer Vision and Pattern Recognition
di: Sapkota, Ranjan, et al.
Pubblicazione: (2025)
di: Sapkota, Ranjan, et al.
Pubblicazione: (2025)
YOLOE-26: Integrating YOLO26 with YOLOE for Real-Time Open-Vocabulary Instance Segmentation
di: Sapkota, Ranjan, et al.
Pubblicazione: (2026)
di: Sapkota, Ranjan, et al.
Pubblicazione: (2026)
UAVs Meet Agentic AI: A Multidomain Survey of Autonomous Aerial Intelligence and Agentic UAVs
di: Sapkota, Ranjan, et al.
Pubblicazione: (2025)
di: Sapkota, Ranjan, et al.
Pubblicazione: (2025)
Integrating YOLO11 and Convolution Block Attention Module for Multi-Season Segmentation of Tree Trunks and Branches in Commercial Apple Orchards
di: Sapkota, Ranjan, et al.
Pubblicazione: (2024)
di: Sapkota, Ranjan, et al.
Pubblicazione: (2024)
Zero-Shot Automatic Annotation and Instance Segmentation using LLM-Generated Datasets: Eliminating Field Imaging and Manual Annotation for Deep Learning Model Development
di: Sapkota, Ranjan, et al.
Pubblicazione: (2024)
di: Sapkota, Ranjan, et al.
Pubblicazione: (2024)
Vision-Language-Action (VLA) Models: Concepts, Progress, Applications and Challenges
di: Sapkota, Ranjan, et al.
Pubblicazione: (2025)
di: Sapkota, Ranjan, et al.
Pubblicazione: (2025)
YOLO11 and Vision Transformers based 3D Pose Estimation of Immature Green Fruits in Commercial Apple Orchards for Robotic Thinning
di: Sapkota, Ranjan, et al.
Pubblicazione: (2024)
di: Sapkota, Ranjan, et al.
Pubblicazione: (2024)
Improved YOLOv12 with LLM-Generated Synthetic Data for Enhanced Apple Detection and Benchmarking Against YOLOv11 and YOLOv10
di: Sapkota, Ranjan, et al.
Pubblicazione: (2025)
di: Sapkota, Ranjan, et al.
Pubblicazione: (2025)
A Review of 3D Object Detection with Vision-Language Models
di: Sapkota, Ranjan, et al.
Pubblicazione: (2025)
di: Sapkota, Ranjan, et al.
Pubblicazione: (2025)
Generative AI in Agriculture: Creating Image Datasets Using DALL.E's Advanced Large Language Model Capabilities
di: Sapkota, Ranjan, et al.
Pubblicazione: (2023)
di: Sapkota, Ranjan, et al.
Pubblicazione: (2023)
Comparing YOLOv11 and YOLOv8 for instance segmentation of occluded and non-occluded immature green fruits in complex orchard environment
di: Sapkota, Ranjan, et al.
Pubblicazione: (2024)
di: Sapkota, Ranjan, et al.
Pubblicazione: (2024)
Object Detection with Multimodal Large Vision-Language Models: An In-depth Review
di: Sapkota, Ranjan, et al.
Pubblicazione: (2025)
di: Sapkota, Ranjan, et al.
Pubblicazione: (2025)
YOLO26: Key Architectural Enhancements and Performance Benchmarking for Real-Time Object Detection
di: Sapkota, Ranjan, et al.
Pubblicazione: (2025)
di: Sapkota, Ranjan, et al.
Pubblicazione: (2025)
Comprehensive Analysis of Transparency and Accessibility of ChatGPT, DeepSeek, And other SoTA Large Language Models
di: Sapkota, Ranjan, et al.
Pubblicazione: (2025)
di: Sapkota, Ranjan, et al.
Pubblicazione: (2025)
Comparing YOLOv8 and Mask R-CNN for instance segmentation in complex orchard environments
di: Sapkota, Ranjan, et al.
Pubblicazione: (2023)
di: Sapkota, Ranjan, et al.
Pubblicazione: (2023)
Comprehensive Performance Evaluation of YOLOv12, YOLO11, YOLOv10, YOLOv9 and YOLOv8 on Detecting and Counting Fruitlet in Complex Orchard Environments
di: Sapkota, Ranjan, et al.
Pubblicazione: (2024)
di: Sapkota, Ranjan, et al.
Pubblicazione: (2024)
Zero-Shot Segmentation of Eye Features Using the Segment Anything Model (SAM)
di: Maquiling, Virmarie, et al.
Pubblicazione: (2023)
di: Maquiling, Virmarie, et al.
Pubblicazione: (2023)
RF-DETR Object Detection vs YOLOv12 : A Study of Transformer-based and CNN-based Architectures for Single-Class and Multi-Class Greenfruit Detection in Complex Orchard Environments Under Label Ambiguity
di: Sapkota, Ranjan, et al.
Pubblicazione: (2025)
di: Sapkota, Ranjan, et al.
Pubblicazione: (2025)
SAM-Mamba: Mamba Guided SAM Architecture for Generalized Zero-Shot Polyp Segmentation
di: Dutta, Tapas Kumar, et al.
Pubblicazione: (2024)
di: Dutta, Tapas Kumar, et al.
Pubblicazione: (2024)
S-SAM: SVD-based Fine-Tuning of Segment Anything Model for Medical Image Segmentation
di: Paranjape, Jay N., et al.
Pubblicazione: (2024)
di: Paranjape, Jay N., et al.
Pubblicazione: (2024)
TS-SAM: Fine-Tuning Segment-Anything Model for Downstream Tasks
di: Yu, Yang, et al.
Pubblicazione: (2024)
di: Yu, Yang, et al.
Pubblicazione: (2024)
TRiSM for Agentic AI: A Review of Trust, Risk, and Security Management in LLM-based Agentic Multi-Agent Systems
di: Raza, Shaina, et al.
Pubblicazione: (2025)
di: Raza, Shaina, et al.
Pubblicazione: (2025)
Immature Green Apple Detection and Sizing in Commercial Orchards using YOLOv8 and Shape Fitting Techniques
di: Sapkota, Ranjan, et al.
Pubblicazione: (2023)
di: Sapkota, Ranjan, et al.
Pubblicazione: (2023)
CAT-SAM: Conditional Tuning for Few-Shot Adaptation of Segment Anything Model
di: Xiao, Aoran, et al.
Pubblicazione: (2024)
di: Xiao, Aoran, et al.
Pubblicazione: (2024)
SAM3D: Zero-Shot Semi-Automatic Segmentation in 3D Medical Images with the Segment Anything Model
di: Chan, Trevor J., et al.
Pubblicazione: (2024)
di: Chan, Trevor J., et al.
Pubblicazione: (2024)
SAM-LAD: Segment Anything Model Meets Zero-Shot Logic Anomaly Detection
di: Peng, Yun, et al.
Pubblicazione: (2024)
di: Peng, Yun, et al.
Pubblicazione: (2024)
SAM3D: Zero-Shot 3D Object Detection via Segment Anything Model
di: Zhang, Dingyuan, et al.
Pubblicazione: (2023)
di: Zhang, Dingyuan, et al.
Pubblicazione: (2023)
InfoSAM: Fine-Tuning the Segment Anything Model from An Information-Theoretic Perspective
di: Zhang, Yuanhong, et al.
Pubblicazione: (2025)
di: Zhang, Yuanhong, et al.
Pubblicazione: (2025)
SAM 3: Segment Anything with Concepts
di: Carion, Nicolas, et al.
Pubblicazione: (2025)
di: Carion, Nicolas, et al.
Pubblicazione: (2025)
AD-SAM: Fine-Tuning the Segment Anything Vision Foundation Model for Autonomous Driving Perception
di: Camarena, Mario, et al.
Pubblicazione: (2025)
di: Camarena, Mario, et al.
Pubblicazione: (2025)
Multimodal Large Language Models for Image, Text, and Speech Data Augmentation: A Survey
di: Sapkota, Ranjan, et al.
Pubblicazione: (2025)
di: Sapkota, Ranjan, et al.
Pubblicazione: (2025)
SAM3-I: Segment Anything with Instructions
di: Li, Jingjing, et al.
Pubblicazione: (2025)
di: Li, Jingjing, et al.
Pubblicazione: (2025)
X-SAM: From Segment Anything to Any Segmentation
di: Wang, Hao, et al.
Pubblicazione: (2025)
di: Wang, Hao, et al.
Pubblicazione: (2025)
SAM Audio: Segment Anything in Audio
di: Shi, Bowen, et al.
Pubblicazione: (2025)
di: Shi, Bowen, et al.
Pubblicazione: (2025)
3D Reconstruction and Information Fusion between Dormant and Canopy Seasons in Commercial Orchards Using Deep Learning and Fast GICP
di: Sapkota, Ranjan, et al.
Pubblicazione: (2025)
di: Sapkota, Ranjan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
The SAM2-to-SAM3 Gap in the Segment Anything Model Family: Why Prompt-Based Expertise Fails in Concept-Driven Image Segmentation
di: Sapkota, Ranjan, et al.
Pubblicazione: (2025) -
Agentic AI with Orchestrator-Agent Trust: A Modular Visual Classification Framework with Trust-Aware Orchestration and RAG-Based Reasoning
di: Roumeliotis, Konstantinos I., et al.
Pubblicazione: (2025) -
AI Agents vs. Agentic AI: A Conceptual Taxonomy, Applications and Challenges
di: Sapkota, Ranjan, et al.
Pubblicazione: (2025) -
Vibe Coding vs. Agentic Coding: Fundamentals and Practical Implications of Agentic AI
di: Sapkota, Ranjan, et al.
Pubblicazione: (2025) -
Plant Disease Detection through Multimodal Large Language Models and Convolutional Neural Networks
di: Roumeliotis, Konstantinos I., et al.
Pubblicazione: (2025)