Few-Class Arena: A Benchmark for Efficient Selection of Vision Models and Dataset Difficulty Measurement
Fuente:
arXiv
Salvato in:
| Autori principali: | Cao, Bryan Bo, O'Gorman, Lawrence, Coss, Michael, Jain, Shubham |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
StatsMerging: Statistics-Guided Model Merging via Task-Specific Teacher Distillation
di: Merugu, Ranjith, et al.
Pubblicazione: (2025)
di: Merugu, Ranjith, et al.
Pubblicazione: (2025)
A Landmark-Aware Visual Navigation Dataset
di: Johnson, Faith, et al.
Pubblicazione: (2024)
di: Johnson, Faith, et al.
Pubblicazione: (2024)
MVTamperBench: Evaluating Robustness of Vision-Language Models
di: Agarwal, Amit, et al.
Pubblicazione: (2024)
di: Agarwal, Amit, et al.
Pubblicazione: (2024)
The Impact of Image Resolution on Face Detection: A Comparative Analysis of MTCNN, YOLOv XI and YOLOv XII models
di: Ömercikoğlu, Ahmet Can, et al.
Pubblicazione: (2025)
di: Ömercikoğlu, Ahmet Can, et al.
Pubblicazione: (2025)
CVCM Track Circuits Pre-emptive Failure Diagnostics for Predictive Maintenance Using Deep Neural Networks
di: Mukherjee, Debdeep, et al.
Pubblicazione: (2025)
di: Mukherjee, Debdeep, et al.
Pubblicazione: (2025)
Parameter-efficient fine-tuning (PEFT) of Vision Foundation Models for Atypical Mitotic Figure Classification
di: Ramchandani, Lavish, et al.
Pubblicazione: (2025)
di: Ramchandani, Lavish, et al.
Pubblicazione: (2025)
HieraEdgeNet: A Multi-Scale Edge-Enhanced Framework for Automated Pollen Recognition
di: Long, Yuchong, et al.
Pubblicazione: (2025)
di: Long, Yuchong, et al.
Pubblicazione: (2025)
ViFiCon: Vision and Wireless Association Via Self-Supervised Contrastive Learning
di: Meegan, Nicholas, et al.
Pubblicazione: (2022)
di: Meegan, Nicholas, et al.
Pubblicazione: (2022)
Single-Step Reconstruction-Free Anomaly Detection and Segmentation via Diffusion Models
di: Moradi, Mehrdad, et al.
Pubblicazione: (2025)
di: Moradi, Mehrdad, et al.
Pubblicazione: (2025)
Contract-Driven QoE Auditing for Speech and Singing Services: From MOS Regression to Service Graphs
di: Du, Wenzhang
Pubblicazione: (2025)
di: Du, Wenzhang
Pubblicazione: (2025)
Advancing Brain Tumor Segmentation via Attention-based 3D U-Net Architecture and Digital Image Processing
di: Gad, Eyad, et al.
Pubblicazione: (2025)
di: Gad, Eyad, et al.
Pubblicazione: (2025)
YOLO Ensemble for UAV-based Multispectral Defect Detection in Wind Turbine Components
di: Svystun, Serhii, et al.
Pubblicazione: (2025)
di: Svystun, Serhii, et al.
Pubblicazione: (2025)
Deep Spectral Meshes: Multi-Frequency Facial Mesh Processing with Graph Neural Networks
di: Kosk, Robert, et al.
Pubblicazione: (2024)
di: Kosk, Robert, et al.
Pubblicazione: (2024)
Event-ECC: Asynchronous Tracking of Events with Continuous Optimization
di: Zafeiri, Maria, et al.
Pubblicazione: (2024)
di: Zafeiri, Maria, et al.
Pubblicazione: (2024)
Lightweight MRI-Based Automated Segmentation of Pancreatic Cancer with Auto3DSeg
di: Jha, Keshav, et al.
Pubblicazione: (2025)
di: Jha, Keshav, et al.
Pubblicazione: (2025)
Adaptive thresholding pattern for fingerprint forgery detection
di: Farzadpour, Zahra, et al.
Pubblicazione: (2025)
di: Farzadpour, Zahra, et al.
Pubblicazione: (2025)
Kolmogorov-Arnold Attention: Is Learnable Attention Better For Vision Transformers?
di: Maity, Subhajit, et al.
Pubblicazione: (2025)
di: Maity, Subhajit, et al.
Pubblicazione: (2025)
Scalable, Technology-Agnostic Diagnosis and Predictive Maintenance for Point Machine using Deep Learning
di: Di Santi, Eduardo, et al.
Pubblicazione: (2025)
di: Di Santi, Eduardo, et al.
Pubblicazione: (2025)
Transfer learning with generative models for object detection on limited datasets
di: Paiano, Matteo, et al.
Pubblicazione: (2024)
di: Paiano, Matteo, et al.
Pubblicazione: (2024)
ArmFormer: Lightweight Transformer Architecture for Real-Time Multi-Class Weapon Segmentation and Classification
di: Kambhatla, Akhila, et al.
Pubblicazione: (2025)
di: Kambhatla, Akhila, et al.
Pubblicazione: (2025)
Task-Aligned Self-Supervised Learning for Medical Image Analysis: A Systematic Review and Practical Design Guidelines
di: Wimalasiri, Chathura
Pubblicazione: (2026)
di: Wimalasiri, Chathura
Pubblicazione: (2026)
A Single Image Is All You Need: Zero-Shot Anomaly Localization Without Training Data
di: Moradi, Mehrdad, et al.
Pubblicazione: (2025)
di: Moradi, Mehrdad, et al.
Pubblicazione: (2025)
UNION: Unsupervised 3D Object Detection using Object Appearance-based Pseudo-Classes
di: Lentsch, Ted, et al.
Pubblicazione: (2024)
di: Lentsch, Ted, et al.
Pubblicazione: (2024)
Polygonizing Roof Segments from High-Resolution Aerial Images Using Yolov8-Based Edge Detection
di: Mei, Qipeng, et al.
Pubblicazione: (2025)
di: Mei, Qipeng, et al.
Pubblicazione: (2025)
Parametric Digital Twins for Preserving Historic Buildings: A Case Study at Löfstad Castle in Östergötland, Sweden
di: Ni, Zhongjun, et al.
Pubblicazione: (2024)
di: Ni, Zhongjun, et al.
Pubblicazione: (2024)
Heart Failure Prediction using Modal Decomposition and Masked Autoencoders for Scarce Echocardiography Databases
di: Bell-Navas, Andrés, et al.
Pubblicazione: (2025)
di: Bell-Navas, Andrés, et al.
Pubblicazione: (2025)
Deep Learning-Based Multi-Object Tracking: A Comprehensive Survey from Foundations to State-of-the-Art
di: Adžemović, Momir
Pubblicazione: (2025)
di: Adžemović, Momir
Pubblicazione: (2025)
Logits-Constrained Framework with RoBERTa for Ancient Chinese NER
di: Hua, Wenjie, et al.
Pubblicazione: (2025)
di: Hua, Wenjie, et al.
Pubblicazione: (2025)
Energy Propagation in Scattering Convolution Networks Can Be Arbitrarily Slow
di: Führ, Hartmut, et al.
Pubblicazione: (2024)
di: Führ, Hartmut, et al.
Pubblicazione: (2024)
DRL: Discriminative Representation Learning with Parallel Adapters for Class Incremental Learning
di: Zhan, Jiawei, et al.
Pubblicazione: (2025)
di: Zhan, Jiawei, et al.
Pubblicazione: (2025)
Eye-gaze Guided Multi-modal Alignment for Medical Representation Learning
di: Ma, Chong, et al.
Pubblicazione: (2024)
di: Ma, Chong, et al.
Pubblicazione: (2024)
Person detection and re-identification in open-world settings of retail stores and public spaces
di: Brkljač, Branko, et al.
Pubblicazione: (2025)
di: Brkljač, Branko, et al.
Pubblicazione: (2025)
RG-TTA: Regime-Guided Meta-Control for Test-Time Adaptation in Streaming Time Series
di: Kumar, Indar, et al.
Pubblicazione: (2026)
di: Kumar, Indar, et al.
Pubblicazione: (2026)
TowerVision: Understanding and Improving Multilinguality in Vision-Language Models
di: Viveiros, André G., et al.
Pubblicazione: (2025)
di: Viveiros, André G., et al.
Pubblicazione: (2025)
Polarization-Based Eye Tracking with Personalized Siamese Architectures
di: Kalkanli, Beyza, et al.
Pubblicazione: (2026)
di: Kalkanli, Beyza, et al.
Pubblicazione: (2026)
Interpretable label-free self-guided subspace clustering
di: Kopriva, Ivica
Pubblicazione: (2024)
di: Kopriva, Ivica
Pubblicazione: (2024)
Ensemble YOLO Framework for Multi-Domain Mitotic Figure Detection in Histopathology Images
di: Kelam, Navya Sri, et al.
Pubblicazione: (2025)
di: Kelam, Navya Sri, et al.
Pubblicazione: (2025)
Wafer Map Defect Classification Using Autoencoder-Based Data Augmentation and Convolutional Neural Network
di: Bao, Yin-Yin, et al.
Pubblicazione: (2024)
di: Bao, Yin-Yin, et al.
Pubblicazione: (2024)
Leveraging large multimodal models for audio-video deepfake detection: a pilot study
di: Cao, Songjun, et al.
Pubblicazione: (2026)
di: Cao, Songjun, et al.
Pubblicazione: (2026)
Graph Connectionist Temporal Classification for Phoneme Recognition
di: Grafé, Henry, et al.
Pubblicazione: (2025)
di: Grafé, Henry, et al.
Pubblicazione: (2025)
Documenti analoghi
-
StatsMerging: Statistics-Guided Model Merging via Task-Specific Teacher Distillation
di: Merugu, Ranjith, et al.
Pubblicazione: (2025) -
A Landmark-Aware Visual Navigation Dataset
di: Johnson, Faith, et al.
Pubblicazione: (2024) -
MVTamperBench: Evaluating Robustness of Vision-Language Models
di: Agarwal, Amit, et al.
Pubblicazione: (2024) -
The Impact of Image Resolution on Face Detection: A Comparative Analysis of MTCNN, YOLOv XI and YOLOv XII models
di: Ömercikoğlu, Ahmet Can, et al.
Pubblicazione: (2025) -
CVCM Track Circuits Pre-emptive Failure Diagnostics for Predictive Maintenance Using Deep Neural Networks
di: Mukherjee, Debdeep, et al.
Pubblicazione: (2025)