YOLOv10: Real-Time End-to-End Object Detection
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Ao, Chen, Hui, Liu, Lihao, Chen, Kai, Lin, Zijia, Han, Jungong, Ding, Guiguang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
YOLOE: Real-Time Seeing Anything
di: Wang, Ao, et al.
Pubblicazione: (2025)
di: Wang, Ao, et al.
Pubblicazione: (2025)
RepViT-SAM: Towards Real-Time Segmenting Anything
di: Wang, Ao, et al.
Pubblicazione: (2023)
di: Wang, Ao, et al.
Pubblicazione: (2023)
YOLO-UniOW: Efficient Universal Open-World Object Detection
di: Liu, Lihao, et al.
Pubblicazione: (2024)
di: Liu, Lihao, et al.
Pubblicazione: (2024)
LSNet: See Large, Focus Small
di: Wang, Ao, et al.
Pubblicazione: (2025)
di: Wang, Ao, et al.
Pubblicazione: (2025)
RepViT: Revisiting Mobile CNN From ViT Perspective
di: Wang, Ao, et al.
Pubblicazione: (2023)
di: Wang, Ao, et al.
Pubblicazione: (2023)
Context Enhancement with Reconstruction as Sequence for Unified Unsupervised Anomaly Detection
di: Yang, Hui-Yue, et al.
Pubblicazione: (2024)
di: Yang, Hui-Yue, et al.
Pubblicazione: (2024)
[CLS] Token Tells Everything Needed for Training-free Efficient MLLMs
di: Wang, Ao, et al.
Pubblicazione: (2024)
di: Wang, Ao, et al.
Pubblicazione: (2024)
CAIT: Triple-Win Compression towards High Accuracy, Fast Inference, and Favorable Transferability For ViTs
di: Wang, Ao, et al.
Pubblicazione: (2023)
di: Wang, Ao, et al.
Pubblicazione: (2023)
Promptable Anomaly Segmentation with SAM Through Self-Perception Tuning
di: Yang, Hui-Yue, et al.
Pubblicazione: (2024)
di: Yang, Hui-Yue, et al.
Pubblicazione: (2024)
PrefixKV: Adaptive Prefix KV Cache is What Vision Instruction-Following Models Need for Efficient Generation
di: Wang, Ao, et al.
Pubblicazione: (2024)
di: Wang, Ao, et al.
Pubblicazione: (2024)
YOLOv13: Real-Time Object Detection with Hypergraph-Enhanced Adaptive Visual Perception
di: Lei, Mengqi, et al.
Pubblicazione: (2025)
di: Lei, Mengqi, et al.
Pubblicazione: (2025)
Neutralizing Token Aggregation via Information Augmentation for Efficient Test-Time Adaptation
di: Xiong, Yizhe, et al.
Pubblicazione: (2025)
di: Xiong, Yizhe, et al.
Pubblicazione: (2025)
Advancing Reliable Test-Time Adaptation of Vision-Language Models under Visual Variations
di: Liang, Yiwen, et al.
Pubblicazione: (2025)
di: Liang, Yiwen, et al.
Pubblicazione: (2025)
PYRA: Parallel Yielding Re-Activation for Training-Inference Efficient Task Adaptation
di: Xiong, Yizhe, et al.
Pubblicazione: (2024)
di: Xiong, Yizhe, et al.
Pubblicazione: (2024)
Learn from the Learnt: Source-Free Active Domain Adaptation via Contrastive Sampling and Visual Persistence
di: Lyu, Mengyao, et al.
Pubblicazione: (2024)
di: Lyu, Mengyao, et al.
Pubblicazione: (2024)
STORM: End-to-End Referring Multi-Object Tracking in Videos
di: Lu, Zijia, et al.
Pubblicazione: (2026)
di: Lu, Zijia, et al.
Pubblicazione: (2026)
UFO-DETR: Frequency-Guided End-to-End Detector for UAV Tiny Objects
di: Chen, Yuankai, et al.
Pubblicazione: (2026)
di: Chen, Yuankai, et al.
Pubblicazione: (2026)
AdaTP: Attention-Debiased Token Pruning for Video Large Language Models
di: Sun, Fengyuan, et al.
Pubblicazione: (2025)
di: Sun, Fengyuan, et al.
Pubblicazione: (2025)
Comprehensive Performance Evaluation of YOLOv11, YOLOv10, YOLOv9, YOLOv8 and YOLOv5 on Object Detection of Power Equipment
di: He, Zijian, et al.
Pubblicazione: (2024)
di: He, Zijian, et al.
Pubblicazione: (2024)
UAV-DETR: Efficient End-to-End Object Detection for Unmanned Aerial Vehicle Imagery
di: Zhang, Huaxiang, et al.
Pubblicazione: (2025)
di: Zhang, Huaxiang, et al.
Pubblicazione: (2025)
An End-to-End Real-World Camera Imaging Pipeline
di: Xu, Kepeng, et al.
Pubblicazione: (2024)
di: Xu, Kepeng, et al.
Pubblicazione: (2024)
YOLOv4: A Breakthrough in Real-Time Object Detection
di: Geetha, Athulya Sundaresan
Pubblicazione: (2025)
di: Geetha, Athulya Sundaresan
Pubblicazione: (2025)
Tracking and Segmenting Anything in Any Modality
di: Zhang, Tianlu, et al.
Pubblicazione: (2025)
di: Zhang, Tianlu, et al.
Pubblicazione: (2025)
RQFormer: Rotated Query Transformer for End-to-End Oriented Object Detection
di: Zhao, Jiaqi, et al.
Pubblicazione: (2023)
di: Zhao, Jiaqi, et al.
Pubblicazione: (2023)
YOLO26: An Analysis of NMS-Free End to End Framework for Real-Time Object Detection
di: Chakrabarty, Sudip
Pubblicazione: (2026)
di: Chakrabarty, Sudip
Pubblicazione: (2026)
RT-DETRv3: Real-time End-to-End Object Detection with Hierarchical Dense Positive Supervision
di: Wang, Shuo, et al.
Pubblicazione: (2024)
di: Wang, Shuo, et al.
Pubblicazione: (2024)
End-to-End Temporal Action Detection with 1B Parameters Across 1000 Frames
di: Liu, Shuming, et al.
Pubblicazione: (2023)
di: Liu, Shuming, et al.
Pubblicazione: (2023)
YOLOv1 to YOLOv11: A Comprehensive Survey of Real-Time Object Detection Innovations and Challenges
di: Kotthapalli, Manikanta, et al.
Pubblicazione: (2025)
di: Kotthapalli, Manikanta, et al.
Pubblicazione: (2025)
Towards Efficient Vision-Language Tuning: More Information Density, More Generalizability
di: Hao, Tianxiang, et al.
Pubblicazione: (2023)
di: Hao, Tianxiang, et al.
Pubblicazione: (2023)
CIB-SE-YOLOv8: Optimized YOLOv8 for Real-Time Safety Equipment Detection on Construction Sites
di: Liu, Xiaoyi, et al.
Pubblicazione: (2024)
di: Liu, Xiaoyi, et al.
Pubblicazione: (2024)
DEYO: DETR with YOLO for End-to-End Object Detection
di: Ouyang, Haodong
Pubblicazione: (2024)
di: Ouyang, Haodong
Pubblicazione: (2024)
LLMI3D: MLLM-based 3D Perception from a Single 2D Image
di: Yang, Fan, et al.
Pubblicazione: (2024)
di: Yang, Fan, et al.
Pubblicazione: (2024)
Body of Her: A Preliminary Study on End-to-End Humanoid Agent
di: Ao, Tenglong
Pubblicazione: (2024)
di: Ao, Tenglong
Pubblicazione: (2024)
Comparative Analysis of YOLOv9, YOLOv10 and RT-DETR for Real-Time Weed Detection
di: Saltık, Ahmet Oğuz, et al.
Pubblicazione: (2024)
di: Saltık, Ahmet Oğuz, et al.
Pubblicazione: (2024)
Single Point, Full Mask: Velocity-Guided Level Set Evolution for End-to-End Amodal Segmentation
di: Li, Zhixuan, et al.
Pubblicazione: (2025)
di: Li, Zhixuan, et al.
Pubblicazione: (2025)
Polar R-CNN: End-to-End Lane Detection with Fewer Anchors
di: Wang, Shengqi, et al.
Pubblicazione: (2024)
di: Wang, Shengqi, et al.
Pubblicazione: (2024)
DMAT: An End-to-End Framework for Joint Atmospheric Turbulence Mitigation and Object Detection
di: Hill, Paul, et al.
Pubblicazione: (2025)
di: Hill, Paul, et al.
Pubblicazione: (2025)
Accelerating Object Detection with YOLOv4 for Real-Time Applications
di: Kumar, K. Senthil, et al.
Pubblicazione: (2024)
di: Kumar, K. Senthil, et al.
Pubblicazione: (2024)
ADA-Track++: End-to-End Multi-Camera 3D Multi-Object Tracking with Alternating Detection and Association
di: Ding, Shuxiao, et al.
Pubblicazione: (2024)
di: Ding, Shuxiao, et al.
Pubblicazione: (2024)
PruneHal: Reducing Hallucinations in Multi-modal Large Language Models through Adaptive KV Cache Pruning
di: Sun, Fengyuan, et al.
Pubblicazione: (2025)
di: Sun, Fengyuan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
YOLOE: Real-Time Seeing Anything
di: Wang, Ao, et al.
Pubblicazione: (2025) -
RepViT-SAM: Towards Real-Time Segmenting Anything
di: Wang, Ao, et al.
Pubblicazione: (2023) -
YOLO-UniOW: Efficient Universal Open-World Object Detection
di: Liu, Lihao, et al.
Pubblicazione: (2024) -
LSNet: See Large, Focus Small
di: Wang, Ao, et al.
Pubblicazione: (2025) -
RepViT: Revisiting Mobile CNN From ViT Perspective
di: Wang, Ao, et al.
Pubblicazione: (2023)