Evaluating Vision Foundation Models for Pixel and Object Classification in Microscopy
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Teuber, Carolin, Archit, Anwai, Boothe, Tobias, Ditte, Peter, Rink, Jochen, Pape, Constantin |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Parameter Efficient Fine-Tuning of Segment Anything Model for Biomedical Imaging
par: Teuber, Carolin, et autres
Publié: (2025)
par: Teuber, Carolin, et autres
Publié: (2025)
ViM-UNet: Vision Mamba for Biomedical Segmentation
par: Archit, Anwai, et autres
Publié: (2024)
par: Archit, Anwai, et autres
Publié: (2024)
Revisiting foundation models for cell instance segmentation
par: Archit, Anwai, et autres
Publié: (2026)
par: Archit, Anwai, et autres
Publié: (2026)
Probabilistic Domain Adaptation for Biomedical Image Segmentation
par: Archit, Anwai, et autres
Publié: (2023)
par: Archit, Anwai, et autres
Publié: (2023)
MedicoSAM: Robust Improvement of SAM for Medical Imaging
par: Archit, Anwai, et autres
Publié: (2025)
par: Archit, Anwai, et autres
Publié: (2025)
Segment Anything for Histopathology
par: Griebel, Titus, et autres
Publié: (2025)
par: Griebel, Titus, et autres
Publié: (2025)
BioimageAIpub: a toolbox for AI-ready bioimaging data publishing
par: Dvoretskii, Stefan, et autres
Publié: (2025)
par: Dvoretskii, Stefan, et autres
Publié: (2025)
Tiling artifacts and trade-offs of feature normalization in the segmentation of large biological images
par: Buglakova, Elena, et autres
Publié: (2025)
par: Buglakova, Elena, et autres
Publié: (2025)
Boosting Gaze Object Prediction via Pixel-level Supervision from Vision Foundation Model
par: Jin, Yang, et autres
Publié: (2024)
par: Jin, Yang, et autres
Publié: (2024)
Are Vision Foundation Models Foundational for Electron Microscopy Image Segmentation?
par: Fuster-Barceló, Caterina, et autres
Publié: (2026)
par: Fuster-Barceló, Caterina, et autres
Publié: (2026)
Edge Attention Module for Object Classification
par: Roy, Santanu, et autres
Publié: (2025)
par: Roy, Santanu, et autres
Publié: (2025)
PixFoundation: Are We Heading in the Right Direction with Pixel-level Vision Foundation Models?
par: Siam, Mennatullah
Publié: (2025)
par: Siam, Mennatullah
Publié: (2025)
Efficient Spatio-Temporal Vegetation Pixel Classification with Vision Transformers
par: Gomes, Alan, et autres
Publié: (2026)
par: Gomes, Alan, et autres
Publié: (2026)
From Pixels to Tokens: Revisiting Object Hallucinations in Large Vision-Language Models
par: Shang, Yuying, et autres
Publié: (2024)
par: Shang, Yuying, et autres
Publié: (2024)
SOCO: Benchmarking Semantic Object Correspondence in Vision Foundation Models
par: Dünkel, Olaf, et autres
Publié: (2026)
par: Dünkel, Olaf, et autres
Publié: (2026)
Vector-Quantized Vision Foundation Models for Object-Centric Learning
par: Zhao, Rongzhen, et autres
Publié: (2025)
par: Zhao, Rongzhen, et autres
Publié: (2025)
Scalable Object Detection in the Car Interior With Vision Foundation Models
par: Schmidt, Sebastian, et autres
Publié: (2025)
par: Schmidt, Sebastian, et autres
Publié: (2025)
Benchmarking Deep Learning and Vision Foundation Models for Atypical vs. Normal Mitosis Classification with Cross-Dataset Evaluation
par: Banerjee, Sweta, et autres
Publié: (2025)
par: Banerjee, Sweta, et autres
Publié: (2025)
Data Adaptive Traceback for Vision-Language Foundation Models in Image Classification
par: Peng, Wenshuo, et autres
Publié: (2024)
par: Peng, Wenshuo, et autres
Publié: (2024)
Fusion of Foundation and Vision Transformer Model Features for Dermatoscopic Image Classification
par: Mahbod, Amirreza, et autres
Publié: (2025)
par: Mahbod, Amirreza, et autres
Publié: (2025)
Towards Unbiased Source-Free Object Detection via Vision Foundation Models
par: Cai, Zhi, et autres
Publié: (2026)
par: Cai, Zhi, et autres
Publié: (2026)
Looking Locally: Object-Centric Vision Transformers as Foundation Models for Efficient Segmentation
par: Traub, Manuel, et autres
Publié: (2025)
par: Traub, Manuel, et autres
Publié: (2025)
Temporal Slowness in Central Vision Drives Semantic Object Learning
par: Schaumlöffel, Timothy, et autres
Publié: (2026)
par: Schaumlöffel, Timothy, et autres
Publié: (2026)
Quantification and Classification of Carbon Nanotubes in Electron Micrographs using Vision Foundation Models
par: Pradeep, Sanjay, et autres
Publié: (2026)
par: Pradeep, Sanjay, et autres
Publié: (2026)
Automated Wildfire Damage Assessment from Multi view Ground level Imagery Via Vision Language Models
par: Esparza, Miguel, et autres
Publié: (2025)
par: Esparza, Miguel, et autres
Publié: (2025)
Sapiens: Foundation for Human Vision Models
par: Khirodkar, Rawal, et autres
Publié: (2024)
par: Khirodkar, Rawal, et autres
Publié: (2024)
PixelVLA: Advancing Pixel-level Understanding in Vision-Language-Action Model
par: Liang, Wenqi, et autres
Publié: (2025)
par: Liang, Wenqi, et autres
Publié: (2025)
Articulate-Anything: Automatic Modeling of Articulated Objects via a Vision-Language Foundation Model
par: Le, Long, et autres
Publié: (2024)
par: Le, Long, et autres
Publié: (2024)
FSOD-VFM: Few-Shot Object Detection with Vision Foundation Models and Graph Diffusion
par: Feng, Chen-Bin, et autres
Publié: (2026)
par: Feng, Chen-Bin, et autres
Publié: (2026)
Decoupled Prototype Matching with Vision Foundation Models for Few-Shot Industrial Object Detection
par: M., Hari Prasanth S., et autres
Publié: (2026)
par: M., Hari Prasanth S., et autres
Publié: (2026)
A Human-in-the-Loop Framework for Efficient Prompt Selection in Microscopy Vision-Language Models
par: Kandiyana, Abhiram, et autres
Publié: (2026)
par: Kandiyana, Abhiram, et autres
Publié: (2026)
Skin Cancer Detection utilizing Deep Learning: Classification of Skin Lesion Images using a Vision Transformer
par: Flosdorf, Carolin, et autres
Publié: (2024)
par: Flosdorf, Carolin, et autres
Publié: (2024)
PicoPose: Progressive Pixel-to-Pixel Correspondence Learning for Novel Object Pose Estimation
par: Liu, Lihua, et autres
Publié: (2025)
par: Liu, Lihua, et autres
Publié: (2025)
Zero-shot Shape Classification of Nanoparticles in SEM Images using Vision Foundation Models
par: Barnatan, Freida, et autres
Publié: (2025)
par: Barnatan, Freida, et autres
Publié: (2025)
DinoRADE: Full Spectral Radar-Camera Fusion with Vision Foundation Model Features for Multi-class Object Detection in Adverse Weather
par: Leitgeb, Christof, et autres
Publié: (2026)
par: Leitgeb, Christof, et autres
Publié: (2026)
Recov-Vision: Linking Street View Imagery and Vision-Language Models for Post-Disaster Recovery
par: Xiao, Yiming, et autres
Publié: (2025)
par: Xiao, Yiming, et autres
Publié: (2025)
Does Your VFM Speak Plant? The Botanical Grammar of Vision Foundation Models for Object Detection
par: Lundqvist, Lars, et autres
Publié: (2026)
par: Lundqvist, Lars, et autres
Publié: (2026)
RT-DETRv4: Painlessly Furthering Real-Time Object Detection with Vision Foundation Models
par: Liao, Zijun, et autres
Publié: (2025)
par: Liao, Zijun, et autres
Publié: (2025)
PixelCAM: Pixel Class Activation Mapping for Histology Image Classification and ROI Localization
par: Guichemerre, Alexis, et autres
Publié: (2025)
par: Guichemerre, Alexis, et autres
Publié: (2025)
From Pixels to Words -- Towards Native One-Vision Models at Scale
par: Diao, Haiwen, et autres
Publié: (2026)
par: Diao, Haiwen, et autres
Publié: (2026)
Documents similaires
-
Parameter Efficient Fine-Tuning of Segment Anything Model for Biomedical Imaging
par: Teuber, Carolin, et autres
Publié: (2025) -
ViM-UNet: Vision Mamba for Biomedical Segmentation
par: Archit, Anwai, et autres
Publié: (2024) -
Revisiting foundation models for cell instance segmentation
par: Archit, Anwai, et autres
Publié: (2026) -
Probabilistic Domain Adaptation for Biomedical Image Segmentation
par: Archit, Anwai, et autres
Publié: (2023) -
MedicoSAM: Robust Improvement of SAM for Medical Imaging
par: Archit, Anwai, et autres
Publié: (2025)