YOLOE-26: Integrating YOLO26 with YOLOE for Real-Time Open-Vocabulary Instance Segmentation
Fuente:
arXiv
Guardado en:
| Autores principales: | Sapkota, Ranjan, Karkee, Manoj |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Ultralytics YOLO Evolution: An Overview of YOLO26, YOLO11, YOLOv8 and YOLOv5 Object Detectors for Computer Vision and Pattern Recognition
por: Sapkota, Ranjan, et al.
Publicado: (2025)
por: Sapkota, Ranjan, et al.
Publicado: (2025)
YOLOE: Real-Time Seeing Anything
por: Wang, Ao, et al.
Publicado: (2025)
por: Wang, Ao, et al.
Publicado: (2025)
Integrating YOLO11 and Convolution Block Attention Module for Multi-Season Segmentation of Tree Trunks and Branches in Commercial Apple Orchards
por: Sapkota, Ranjan, et al.
Publicado: (2024)
por: Sapkota, Ranjan, et al.
Publicado: (2024)
YOLO26: Key Architectural Enhancements and Performance Benchmarking for Real-Time Object Detection
por: Sapkota, Ranjan, et al.
Publicado: (2025)
por: Sapkota, Ranjan, et al.
Publicado: (2025)
YOLO11 and Vision Transformers based 3D Pose Estimation of Immature Green Fruits in Commercial Apple Orchards for Robotic Thinning
por: Sapkota, Ranjan, et al.
Publicado: (2024)
por: Sapkota, Ranjan, et al.
Publicado: (2024)
Zero-Shot Automatic Annotation and Instance Segmentation using LLM-Generated Datasets: Eliminating Field Imaging and Manual Annotation for Deep Learning Model Development
por: Sapkota, Ranjan, et al.
Publicado: (2024)
por: Sapkota, Ranjan, et al.
Publicado: (2024)
Generative AI in Agriculture: Creating Image Datasets Using DALL.E's Advanced Large Language Model Capabilities
por: Sapkota, Ranjan, et al.
Publicado: (2023)
por: Sapkota, Ranjan, et al.
Publicado: (2023)
Comparing YOLOv11 and YOLOv8 for instance segmentation of occluded and non-occluded immature green fruits in complex orchard environment
por: Sapkota, Ranjan, et al.
Publicado: (2024)
por: Sapkota, Ranjan, et al.
Publicado: (2024)
Generalization vs. Specialization: Evaluating Segment Anything Model (SAM3) Zero-Shot Segmentation Against Fine-Tuned YOLO Detectors
por: Sapkota, Ranjan, et al.
Publicado: (2025)
por: Sapkota, Ranjan, et al.
Publicado: (2025)
Improved YOLOv12 with LLM-Generated Synthetic Data for Enhanced Apple Detection and Benchmarking Against YOLOv11 and YOLOv10
por: Sapkota, Ranjan, et al.
Publicado: (2025)
por: Sapkota, Ranjan, et al.
Publicado: (2025)
Object Detection with Multimodal Large Vision-Language Models: An In-depth Review
por: Sapkota, Ranjan, et al.
Publicado: (2025)
por: Sapkota, Ranjan, et al.
Publicado: (2025)
The SAM2-to-SAM3 Gap in the Segment Anything Model Family: Why Prompt-Based Expertise Fails in Concept-Driven Image Segmentation
por: Sapkota, Ranjan, et al.
Publicado: (2025)
por: Sapkota, Ranjan, et al.
Publicado: (2025)
Comparing YOLOv8 and Mask R-CNN for instance segmentation in complex orchard environments
por: Sapkota, Ranjan, et al.
Publicado: (2023)
por: Sapkota, Ranjan, et al.
Publicado: (2023)
Immature Green Apple Detection and Sizing in Commercial Orchards using YOLOv8 and Shape Fitting Techniques
por: Sapkota, Ranjan, et al.
Publicado: (2023)
por: Sapkota, Ranjan, et al.
Publicado: (2023)
Comprehensive Performance Evaluation of YOLOv12, YOLO11, YOLOv10, YOLOv9 and YOLOv8 on Detecting and Counting Fruitlet in Complex Orchard Environments
por: Sapkota, Ranjan, et al.
Publicado: (2024)
por: Sapkota, Ranjan, et al.
Publicado: (2024)
Vision-Language-Action (VLA) Models: Concepts, Progress, Applications and Challenges
por: Sapkota, Ranjan, et al.
Publicado: (2025)
por: Sapkota, Ranjan, et al.
Publicado: (2025)
RF-DETR Object Detection vs YOLOv12 : A Study of Transformer-based and CNN-based Architectures for Single-Class and Multi-Class Greenfruit Detection in Complex Orchard Environments Under Label Ambiguity
por: Sapkota, Ranjan, et al.
Publicado: (2025)
por: Sapkota, Ranjan, et al.
Publicado: (2025)
Towards Real-Time Open-Vocabulary Video Instance Segmentation
por: Yan, Bin, et al.
Publicado: (2024)
por: Yan, Bin, et al.
Publicado: (2024)
Multimodal Large Language Models for Image, Text, and Speech Data Augmentation: A Survey
por: Sapkota, Ranjan, et al.
Publicado: (2025)
por: Sapkota, Ranjan, et al.
Publicado: (2025)
Open-YOLO 3D: Towards Fast and Accurate Open-Vocabulary 3D Instance Segmentation
por: Boudjoghra, Mohamed El Amine, et al.
Publicado: (2024)
por: Boudjoghra, Mohamed El Amine, et al.
Publicado: (2024)
YOLO-World: Real-Time Open-Vocabulary Object Detection
por: Cheng, Tianheng, et al.
Publicado: (2024)
por: Cheng, Tianheng, et al.
Publicado: (2024)
INSTA-YOLO: Real-Time Instance Segmentation
por: Mohamed, Eslam, et al.
Publicado: (2021)
por: Mohamed, Eslam, et al.
Publicado: (2021)
3D Reconstruction and Information Fusion between Dormant and Canopy Seasons in Commercial Orchards Using Deep Learning and Fast GICP
por: Sapkota, Ranjan, et al.
Publicado: (2025)
por: Sapkota, Ranjan, et al.
Publicado: (2025)
YOLO advances to its genesis: a decadal and comprehensive review of the You Only Look Once (YOLO) series
por: Sapkota, Ranjan, et al.
Publicado: (2024)
por: Sapkota, Ranjan, et al.
Publicado: (2024)
Plant Disease Detection through Multimodal Large Language Models and Convolutional Neural Networks
por: Roumeliotis, Konstantinos I., et al.
Publicado: (2025)
por: Roumeliotis, Konstantinos I., et al.
Publicado: (2025)
A Review of 3D Object Detection with Vision-Language Models
por: Sapkota, Ranjan, et al.
Publicado: (2025)
por: Sapkota, Ranjan, et al.
Publicado: (2025)
Unified Embedding Alignment for Open-Vocabulary Video Instance Segmentation
por: Fang, Hao, et al.
Publicado: (2024)
por: Fang, Hao, et al.
Publicado: (2024)
Zero-Shot Dual-Path Integration Framework for Open-Vocabulary 3D Instance Segmentation
por: Ton, Tri, et al.
Publicado: (2024)
por: Ton, Tri, et al.
Publicado: (2024)
Mamba-YOLO-World: Marrying YOLO-World with Mamba for Open-Vocabulary Detection
por: Wang, Haoxuan, et al.
Publicado: (2024)
por: Wang, Haoxuan, et al.
Publicado: (2024)
CLIP-VIS: Adapting CLIP for Open-Vocabulary Video Instance Segmentation
por: Zhu, Wenqi, et al.
Publicado: (2024)
por: Zhu, Wenqi, et al.
Publicado: (2024)
SCORE: Scene Context Matters in Open-Vocabulary Remote Sensing Instance Segmentation
por: Huang, Shiqi, et al.
Publicado: (2025)
por: Huang, Shiqi, et al.
Publicado: (2025)
Leveraging Vision-Language Models for Open-Vocabulary Instance Segmentation and Tracking
por: Pätzold, Bastian, et al.
Publicado: (2025)
por: Pätzold, Bastian, et al.
Publicado: (2025)
OpenTrack3D: Towards Accurate and Generalizable Open-Vocabulary 3D Instance Segmentation
por: Zhou, Zhishan, et al.
Publicado: (2025)
por: Zhou, Zhishan, et al.
Publicado: (2025)
OpenSplat3D: Open-Vocabulary 3D Instance Segmentation using Gaussian Splatting
por: Piekenbrinck, Jens, et al.
Publicado: (2025)
por: Piekenbrinck, Jens, et al.
Publicado: (2025)
Open3DIS: Open-Vocabulary 3D Instance Segmentation with 2D Mask Guidance
por: Nguyen, Phuc D. A., et al.
Publicado: (2023)
por: Nguyen, Phuc D. A., et al.
Publicado: (2023)
YOLO26: An Analysis of NMS-Free End to End Framework for Real-Time Object Detection
por: Chakrabarty, Sudip
Publicado: (2026)
por: Chakrabarty, Sudip
Publicado: (2026)
Retrieving Objects from 3D Scenes with Box-Guided Open-Vocabulary Instance Segmentation
por: Nguyen, Khanh, et al.
Publicado: (2025)
por: Nguyen, Khanh, et al.
Publicado: (2025)
OVI-MAP:Open-Vocabulary Instance-Semantic Mapping
por: Deng, Zilong, et al.
Publicado: (2026)
por: Deng, Zilong, et al.
Publicado: (2026)
MARIS: Marine Open-Vocabulary Instance Segmentation with Geometric Enhancement and Semantic Alignment
por: Li, Bingyu, et al.
Publicado: (2025)
por: Li, Bingyu, et al.
Publicado: (2025)
SEP-YOLO: Fourier-Domain Feature Representation for Transparent Object Instance Segmentation
por: Zhang, Fengming, et al.
Publicado: (2026)
por: Zhang, Fengming, et al.
Publicado: (2026)
Ejemplares similares
-
Ultralytics YOLO Evolution: An Overview of YOLO26, YOLO11, YOLOv8 and YOLOv5 Object Detectors for Computer Vision and Pattern Recognition
por: Sapkota, Ranjan, et al.
Publicado: (2025) -
YOLOE: Real-Time Seeing Anything
por: Wang, Ao, et al.
Publicado: (2025) -
Integrating YOLO11 and Convolution Block Attention Module for Multi-Season Segmentation of Tree Trunks and Branches in Commercial Apple Orchards
por: Sapkota, Ranjan, et al.
Publicado: (2024) -
YOLO26: Key Architectural Enhancements and Performance Benchmarking for Real-Time Object Detection
por: Sapkota, Ranjan, et al.
Publicado: (2025) -
YOLO11 and Vision Transformers based 3D Pose Estimation of Immature Green Fruits in Commercial Apple Orchards for Robotic Thinning
por: Sapkota, Ranjan, et al.
Publicado: (2024)