DINOv3 Visual Representations for Blueberry Perception Toward Robotic Harvesting
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Rui-Feng, Petti, Daniel, Chen, Yue, Li, Changying |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
AD-DINOv3: Enhancing DINOv3 for Zero-Shot Anomaly Detection with Anomaly-Aware Calibration
di: Yuan, Jingyi, et al.
Pubblicazione: (2025)
di: Yuan, Jingyi, et al.
Pubblicazione: (2025)
DINOv3
di: Siméoni, Oriane, et al.
Pubblicazione: (2025)
di: Siméoni, Oriane, et al.
Pubblicazione: (2025)
DINOv2: Learning Robust Visual Features without Supervision
di: Oquab, Maxime, et al.
Pubblicazione: (2023)
di: Oquab, Maxime, et al.
Pubblicazione: (2023)
NeuroSeg Meets DINOv3: Transferring 2D Self-Supervised Visual Priors to 3D Neuron Segmentation via DINOv3 Initialization
di: Cheng, Yik San, et al.
Pubblicazione: (2026)
di: Cheng, Yik San, et al.
Pubblicazione: (2026)
INSID3: Training-Free In-Context Segmentation with DINOv3
di: Cuttano, Claudia, et al.
Pubblicazione: (2026)
di: Cuttano, Claudia, et al.
Pubblicazione: (2026)
DINOv3-Diffusion Policy: Self-Supervised Large Visual Model for Visuomotor Diffusion Policy Learning
di: Egbe, ThankGod, et al.
Pubblicazione: (2025)
di: Egbe, ThankGod, et al.
Pubblicazione: (2025)
DINOv3 Beats Specialized Detectors: A Simple Foundation Model Baseline for Image Forensics
di: Yu, Jieming, et al.
Pubblicazione: (2026)
di: Yu, Jieming, et al.
Pubblicazione: (2026)
Visual Bridge: Universal Visual Perception Representations Generating
di: Gao, Yilin, et al.
Pubblicazione: (2025)
di: Gao, Yilin, et al.
Pubblicazione: (2025)
DINOv2 Driven Gait Representation Learning for Video-Based Visible-Infrared Person Re-identification
di: Yang, Yujie, et al.
Pubblicazione: (2025)
di: Yang, Yujie, et al.
Pubblicazione: (2025)
Optimizing DINOv2 with Registers for Face Anti-Spoofing
di: Feng, Mika, et al.
Pubblicazione: (2025)
di: Feng, Mika, et al.
Pubblicazione: (2025)
Real-Time Object Detection Meets DINOv3
di: Huang, Shihua, et al.
Pubblicazione: (2025)
di: Huang, Shihua, et al.
Pubblicazione: (2025)
Revisiting Birds Eye View Perception Models with Frozen Foundation Models: DINOv2 and Metric3Dv2
di: Hayes, Seamie, et al.
Pubblicazione: (2025)
di: Hayes, Seamie, et al.
Pubblicazione: (2025)
SUGAR: Pre-training 3D Visual Representations for Robotics
di: Chen, Shizhe, et al.
Pubblicazione: (2024)
di: Chen, Shizhe, et al.
Pubblicazione: (2024)
SINDER: Repairing the Singular Defects of DINOv2
di: Wang, Haoqi, et al.
Pubblicazione: (2024)
di: Wang, Haoqi, et al.
Pubblicazione: (2024)
Rethinking Cross-Generator Image Forgery Detection through DINOv3
di: Huang, Zhenglin, et al.
Pubblicazione: (2025)
di: Huang, Zhenglin, et al.
Pubblicazione: (2025)
DINO-MVR: Multi-View Readout of Frozen DINOv3 for Annotation-Efficient Medical Segmentation
di: Jiang, Wei, et al.
Pubblicazione: (2026)
di: Jiang, Wei, et al.
Pubblicazione: (2026)
NegoCollab: A Common Representation Negotiation Approach for Heterogeneous Collaborative Perception
di: Shao, Congzhang, et al.
Pubblicazione: (2025)
di: Shao, Congzhang, et al.
Pubblicazione: (2025)
Benchmarking DINOv3 for Multi-Task Stroke Analysis on Non-Contrast CT
di: Zhang, Donghao, et al.
Pubblicazione: (2025)
di: Zhang, Donghao, et al.
Pubblicazione: (2025)
DINO-BOLDNet: A DINOv3-Guided Multi-Slice Attention Network for T1-to-BOLD Generation
di: Wang, Jianwei, et al.
Pubblicazione: (2025)
di: Wang, Jianwei, et al.
Pubblicazione: (2025)
DinoDental: Benchmarking DINOv3 as a Unified Vision Encoder for Dental Image Analysis
di: Tang, Kun, et al.
Pubblicazione: (2026)
di: Tang, Kun, et al.
Pubblicazione: (2026)
CHMv2: Improvements in Global Canopy Height Mapping using DINOv3
di: Brandt, John, et al.
Pubblicazione: (2026)
di: Brandt, John, et al.
Pubblicazione: (2026)
Simultaneous Tactile-Visual Perception for Learning Multimodal Robot Manipulation
di: Li, Yuyang, et al.
Pubblicazione: (2025)
di: Li, Yuyang, et al.
Pubblicazione: (2025)
DINOv3 with Test-Time Training for Medical Image Registration
di: Wang, Shansong, et al.
Pubblicazione: (2025)
di: Wang, Shansong, et al.
Pubblicazione: (2025)
MedDINOv3: How to adapt vision foundation models for medical image segmentation?
di: Li, Yuheng, et al.
Pubblicazione: (2025)
di: Li, Yuheng, et al.
Pubblicazione: (2025)
Spatial Autoregressive Modeling of DINOv3 Embeddings for Unsupervised Anomaly Detection
di: Erdil, Ertunc, et al.
Pubblicazione: (2026)
di: Erdil, Ertunc, et al.
Pubblicazione: (2026)
Towards Adversarial Robustness and Uncertainty Quantification in DINOv2-based Few-Shot Anomaly Detection
di: Khan, Akib Mohammed, et al.
Pubblicazione: (2025)
di: Khan, Akib Mohammed, et al.
Pubblicazione: (2025)
DINOv3-Guided Cross Fusion Framework for Semantic-aware CT generation from MRI and CBCT
di: Zhou, Xianhao, et al.
Pubblicazione: (2025)
di: Zhou, Xianhao, et al.
Pubblicazione: (2025)
Does DINOv3 Set a New Medical Vision Standard? Benchmarking 2D and 3D Classification, Segmentation, and Registration
di: Liu, Che, et al.
Pubblicazione: (2025)
di: Liu, Che, et al.
Pubblicazione: (2025)
Dyn-Adapter: Towards Disentangled Representation for Efficient Visual Recognition
di: Zhang, Yurong, et al.
Pubblicazione: (2024)
di: Zhang, Yurong, et al.
Pubblicazione: (2024)
Parameter-Efficient Fine-Tuning of DINOv2 for Large-Scale Font Classification
di: Chen, Daniel, et al.
Pubblicazione: (2026)
di: Chen, Daniel, et al.
Pubblicazione: (2026)
From SAM to DINOv2: Towards Distilling Foundation Models to Lightweight Baselines for Generalized Polyp Segmentation
di: Agnihotri, Shivanshu, et al.
Pubblicazione: (2025)
di: Agnihotri, Shivanshu, et al.
Pubblicazione: (2025)
Real-Time Privacy Preservation for Robot Visual Perception
di: Choi, Minkyu, et al.
Pubblicazione: (2025)
di: Choi, Minkyu, et al.
Pubblicazione: (2025)
From Web to Pixels: Bringing Agentic Search into Visual Perception
di: Yang, Bokang, et al.
Pubblicazione: (2026)
di: Yang, Bokang, et al.
Pubblicazione: (2026)
Learning to Adapt Foundation Model DINOv2 for Capsule Endoscopy Diagnosis
di: Zhang, Bowen, et al.
Pubblicazione: (2024)
di: Zhang, Bowen, et al.
Pubblicazione: (2024)
What Is The Best 3D Scene Representation for Robotics? From Geometric to Foundation Models
di: Deng, Tianchen, et al.
Pubblicazione: (2025)
di: Deng, Tianchen, et al.
Pubblicazione: (2025)
DINO Soars: DINOv3 for Open-Vocabulary Semantic Segmentation of Remote Sensing Imagery
di: Faulkenberry, Ryan, et al.
Pubblicazione: (2026)
di: Faulkenberry, Ryan, et al.
Pubblicazione: (2026)
LSK3DNet: Towards Effective and Efficient 3D Perception with Large Sparse Kernels
di: Feng, Tuo, et al.
Pubblicazione: (2024)
di: Feng, Tuo, et al.
Pubblicazione: (2024)
Temporal vs. Spatial: Comparing DINOv3 and V-JEPA2 Feature Representations for Video Action Analysis
di: Kodathala, Sai Varun, et al.
Pubblicazione: (2025)
di: Kodathala, Sai Varun, et al.
Pubblicazione: (2025)
Accurate Crop Yield Estimation of Blueberries using Deep Learning and Smart Drones
di: Nguyen, Hieu D., et al.
Pubblicazione: (2025)
di: Nguyen, Hieu D., et al.
Pubblicazione: (2025)
Representation Fréchet Loss for Visual Generation
di: Yang, Jiawei, et al.
Pubblicazione: (2026)
di: Yang, Jiawei, et al.
Pubblicazione: (2026)
Documenti analoghi
-
AD-DINOv3: Enhancing DINOv3 for Zero-Shot Anomaly Detection with Anomaly-Aware Calibration
di: Yuan, Jingyi, et al.
Pubblicazione: (2025) -
DINOv3
di: Siméoni, Oriane, et al.
Pubblicazione: (2025) -
DINOv2: Learning Robust Visual Features without Supervision
di: Oquab, Maxime, et al.
Pubblicazione: (2023) -
NeuroSeg Meets DINOv3: Transferring 2D Self-Supervised Visual Priors to 3D Neuron Segmentation via DINOv3 Initialization
di: Cheng, Yik San, et al.
Pubblicazione: (2026) -
INSID3: Training-Free In-Context Segmentation with DINOv3
di: Cuttano, Claudia, et al.
Pubblicazione: (2026)