Flaws of ImageNet, Computer Vision's Favourite Dataset
Fuente:
arXiv
Guardado en:
| Autores principales: | Kisel, Nikita, Volkov, Illia, Hanzelkova, Katerina, Janouskova, Klara, Matas, Jiri |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Image Recognition with Vision and Language Embeddings of VLMs
por: Volkov, Illia, et al.
Publicado: (2025)
por: Volkov, Illia, et al.
Publicado: (2025)
Multimodal Large Language Models as Image Classifiers
por: Kisel, Nikita, et al.
Publicado: (2026)
por: Kisel, Nikita, et al.
Publicado: (2026)
Bringing the Context Back into Object Recognition, Robustly
por: Janouskova, Klara, et al.
Publicado: (2024)
por: Janouskova, Klara, et al.
Publicado: (2024)
Robust Context-Aware Object Recognition
por: Janouskova, Klara, et al.
Publicado: (2025)
por: Janouskova, Klara, et al.
Publicado: (2025)
Single Image Test-Time Adaptation for Segmentation
por: Janouskova, Klara, et al.
Publicado: (2023)
por: Janouskova, Klara, et al.
Publicado: (2023)
Koo-Fu CLIP: Closed-Form Adaptation of Vision-Language Models via Fukunaga-Koontz Linear Discriminant Analysis
por: Suchanek, Matej, et al.
Publicado: (2026)
por: Suchanek, Matej, et al.
Publicado: (2026)
FungiTastic: A multi-modal dataset and benchmark for image categorization
por: Picek, Lukas, et al.
Publicado: (2024)
por: Picek, Lukas, et al.
Publicado: (2024)
Speedrunning ImageNet Diffusion
por: Bhanded, Swayam
Publicado: (2025)
por: Bhanded, Swayam
Publicado: (2025)
Beyond ImageNet: Understanding Cross-Dataset Robustness of Lightweight Vision Models
por: Zhang, Weidong, et al.
Publicado: (2025)
por: Zhang, Weidong, et al.
Publicado: (2025)
CNN and ViT Efficiency Study on Tiny ImageNet and DermaMNIST Datasets
por: Amangeldi, Aidar, et al.
Publicado: (2025)
por: Amangeldi, Aidar, et al.
Publicado: (2025)
Babel-ImageNet: Massively Multilingual Evaluation of Vision-and-Language Representations
por: Geigle, Gregor, et al.
Publicado: (2023)
por: Geigle, Gregor, et al.
Publicado: (2023)
Mitigating Overfitting in Medical Imaging: Self-Supervised Pretraining vs. ImageNet Transfer Learning for Dermatological Diagnosis
por: Matas, Iván, et al.
Publicado: (2025)
por: Matas, Iván, et al.
Publicado: (2025)
Fine-Grained ImageNet Classification in the Wild
por: Lymperaiou, Maria, et al.
Publicado: (2023)
por: Lymperaiou, Maria, et al.
Publicado: (2023)
ImageNet-Think-250K: A Large-Scale Synthetic Dataset for Multimodal Reasoning for Vision Language Models
por: Chitty-Venkata, Krishna Teja, et al.
Publicado: (2025)
por: Chitty-Venkata, Krishna Teja, et al.
Publicado: (2025)
How far can we go with ImageNet for Text-to-Image generation?
por: Degeorge, L., et al.
Publicado: (2025)
por: Degeorge, L., et al.
Publicado: (2025)
ImageNet-OOD: Deciphering Modern Out-of-Distribution Detection Algorithms
por: Yang, William, et al.
Publicado: (2023)
por: Yang, William, et al.
Publicado: (2023)
Accessing Vision Foundation Models via ImageNet-1K
por: Zhang, Yitian, et al.
Publicado: (2024)
por: Zhang, Yitian, et al.
Publicado: (2024)
ImageNot: A contrast with ImageNet preserves model rankings
por: Salaudeen, Olawale, et al.
Publicado: (2024)
por: Salaudeen, Olawale, et al.
Publicado: (2024)
What Makes ImageNet Look Unlike LAION
por: Shirali, Ali, et al.
Publicado: (2023)
por: Shirali, Ali, et al.
Publicado: (2023)
Infrared Object Detection with Ultra Small ConvNets: Is ImageNet Pretraining Still Useful?
por: Muralidharan, Srikanth, et al.
Publicado: (2025)
por: Muralidharan, Srikanth, et al.
Publicado: (2025)
Geometry aware 3D generation from in-the-wild images in ImageNet
por: Shen, Qijia, et al.
Publicado: (2024)
por: Shen, Qijia, et al.
Publicado: (2024)
SOOD-ImageNet: a Large-Scale Dataset for Semantic Out-Of-Distribution Image Classification and Semantic Segmentation
por: Bacchin, Alberto, et al.
Publicado: (2024)
por: Bacchin, Alberto, et al.
Publicado: (2024)
G3DR: Generative 3D Reconstruction in ImageNet
por: Reddy, Pradyumna, et al.
Publicado: (2024)
por: Reddy, Pradyumna, et al.
Publicado: (2024)
Automated Classification of Model Errors on ImageNet
por: Peychev, Momchil, et al.
Publicado: (2023)
por: Peychev, Momchil, et al.
Publicado: (2023)
Comparative Performance of Finetuned ImageNet Pre-trained Models for Electronic Component Classification
por: Shao, Yidi, et al.
Publicado: (2025)
por: Shao, Yidi, et al.
Publicado: (2025)
Corner Cases: How Size and Position of Objects Challenge ImageNet-Trained Models
por: Fatima, Mishal, et al.
Publicado: (2025)
por: Fatima, Mishal, et al.
Publicado: (2025)
Unlocking ImageNet's Multi-Object Nature: Automated Large-Scale Multilabel Annotation
por: Chen, Junyu, et al.
Publicado: (2026)
por: Chen, Junyu, et al.
Publicado: (2026)
Do ImageNet-trained models learn shortcuts? The impact of frequency shortcuts on generalization
por: Wang, Shunxin, et al.
Publicado: (2025)
por: Wang, Shunxin, et al.
Publicado: (2025)
BioBench: A Blueprint to Move Beyond ImageNet for Scientific ML Benchmarks
por: Stevens, Samuel
Publicado: (2025)
por: Stevens, Samuel
Publicado: (2025)
Detection, Pose Estimation and Segmentation for Multiple Bodies: Closing the Virtuous Circle
por: Purkrabek, Miroslav, et al.
Publicado: (2024)
por: Purkrabek, Miroslav, et al.
Publicado: (2024)
ProbPose: A Probabilistic Approach to 2D Human Pose Estimation
por: Purkrabek, Miroslav, et al.
Publicado: (2024)
por: Purkrabek, Miroslav, et al.
Publicado: (2024)
Video shutter angle estimation using optical flow and linear blur
por: Korcak, David, et al.
Publicado: (2023)
por: Korcak, David, et al.
Publicado: (2023)
Accurate Planar Tracking With Robust Re-Detection
por: Serych, Jonas, et al.
Publicado: (2026)
por: Serych, Jonas, et al.
Publicado: (2026)
Improving 2D Human Pose Estimation in Rare Camera Views with Synthetic Data
por: Purkrabek, Miroslav, et al.
Publicado: (2023)
por: Purkrabek, Miroslav, et al.
Publicado: (2023)
Going Beyond U-Net: Assessing Vision Transformers for Semantic Segmentation in Microscopy Image Analysis
por: Tsiporenko, Illia, et al.
Publicado: (2024)
por: Tsiporenko, Illia, et al.
Publicado: (2024)
A New Dataset and a Distractor-Aware Architecture for Transparent Object Tracking
por: Lukezic, Alan, et al.
Publicado: (2024)
por: Lukezic, Alan, et al.
Publicado: (2024)
ConvNet vs Transformer, Supervised vs CLIP: Beyond ImageNet Accuracy
por: Vishniakov, Kirill, et al.
Publicado: (2023)
por: Vishniakov, Kirill, et al.
Publicado: (2023)
ImageNet3D: Towards General-Purpose Object-Level 3D Understanding
por: Ma, Wufei, et al.
Publicado: (2024)
por: Ma, Wufei, et al.
Publicado: (2024)
Can Biases in ImageNet Models Explain Generalization?
por: Gavrikov, Paul, et al.
Publicado: (2024)
por: Gavrikov, Paul, et al.
Publicado: (2024)
Toward Errorless Training ImageNet-1k
por: Deng, Bo, et al.
Publicado: (2025)
por: Deng, Bo, et al.
Publicado: (2025)
Ejemplares similares
-
Image Recognition with Vision and Language Embeddings of VLMs
por: Volkov, Illia, et al.
Publicado: (2025) -
Multimodal Large Language Models as Image Classifiers
por: Kisel, Nikita, et al.
Publicado: (2026) -
Bringing the Context Back into Object Recognition, Robustly
por: Janouskova, Klara, et al.
Publicado: (2024) -
Robust Context-Aware Object Recognition
por: Janouskova, Klara, et al.
Publicado: (2025) -
Single Image Test-Time Adaptation for Segmentation
por: Janouskova, Klara, et al.
Publicado: (2023)