Flaws of ImageNet, Computer Vision's Favourite Dataset
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kisel, Nikita, Volkov, Illia, Hanzelkova, Katerina, Janouskova, Klara, Matas, Jiri |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Image Recognition with Vision and Language Embeddings of VLMs
par: Volkov, Illia, et autres
Publié: (2025)
par: Volkov, Illia, et autres
Publié: (2025)
Multimodal Large Language Models as Image Classifiers
par: Kisel, Nikita, et autres
Publié: (2026)
par: Kisel, Nikita, et autres
Publié: (2026)
Bringing the Context Back into Object Recognition, Robustly
par: Janouskova, Klara, et autres
Publié: (2024)
par: Janouskova, Klara, et autres
Publié: (2024)
Robust Context-Aware Object Recognition
par: Janouskova, Klara, et autres
Publié: (2025)
par: Janouskova, Klara, et autres
Publié: (2025)
Single Image Test-Time Adaptation for Segmentation
par: Janouskova, Klara, et autres
Publié: (2023)
par: Janouskova, Klara, et autres
Publié: (2023)
Koo-Fu CLIP: Closed-Form Adaptation of Vision-Language Models via Fukunaga-Koontz Linear Discriminant Analysis
par: Suchanek, Matej, et autres
Publié: (2026)
par: Suchanek, Matej, et autres
Publié: (2026)
FungiTastic: A multi-modal dataset and benchmark for image categorization
par: Picek, Lukas, et autres
Publié: (2024)
par: Picek, Lukas, et autres
Publié: (2024)
Speedrunning ImageNet Diffusion
par: Bhanded, Swayam
Publié: (2025)
par: Bhanded, Swayam
Publié: (2025)
Beyond ImageNet: Understanding Cross-Dataset Robustness of Lightweight Vision Models
par: Zhang, Weidong, et autres
Publié: (2025)
par: Zhang, Weidong, et autres
Publié: (2025)
CNN and ViT Efficiency Study on Tiny ImageNet and DermaMNIST Datasets
par: Amangeldi, Aidar, et autres
Publié: (2025)
par: Amangeldi, Aidar, et autres
Publié: (2025)
Babel-ImageNet: Massively Multilingual Evaluation of Vision-and-Language Representations
par: Geigle, Gregor, et autres
Publié: (2023)
par: Geigle, Gregor, et autres
Publié: (2023)
Mitigating Overfitting in Medical Imaging: Self-Supervised Pretraining vs. ImageNet Transfer Learning for Dermatological Diagnosis
par: Matas, Iván, et autres
Publié: (2025)
par: Matas, Iván, et autres
Publié: (2025)
Fine-Grained ImageNet Classification in the Wild
par: Lymperaiou, Maria, et autres
Publié: (2023)
par: Lymperaiou, Maria, et autres
Publié: (2023)
ImageNet-Think-250K: A Large-Scale Synthetic Dataset for Multimodal Reasoning for Vision Language Models
par: Chitty-Venkata, Krishna Teja, et autres
Publié: (2025)
par: Chitty-Venkata, Krishna Teja, et autres
Publié: (2025)
How far can we go with ImageNet for Text-to-Image generation?
par: Degeorge, L., et autres
Publié: (2025)
par: Degeorge, L., et autres
Publié: (2025)
ImageNet-OOD: Deciphering Modern Out-of-Distribution Detection Algorithms
par: Yang, William, et autres
Publié: (2023)
par: Yang, William, et autres
Publié: (2023)
Accessing Vision Foundation Models via ImageNet-1K
par: Zhang, Yitian, et autres
Publié: (2024)
par: Zhang, Yitian, et autres
Publié: (2024)
ImageNot: A contrast with ImageNet preserves model rankings
par: Salaudeen, Olawale, et autres
Publié: (2024)
par: Salaudeen, Olawale, et autres
Publié: (2024)
What Makes ImageNet Look Unlike LAION
par: Shirali, Ali, et autres
Publié: (2023)
par: Shirali, Ali, et autres
Publié: (2023)
Infrared Object Detection with Ultra Small ConvNets: Is ImageNet Pretraining Still Useful?
par: Muralidharan, Srikanth, et autres
Publié: (2025)
par: Muralidharan, Srikanth, et autres
Publié: (2025)
Geometry aware 3D generation from in-the-wild images in ImageNet
par: Shen, Qijia, et autres
Publié: (2024)
par: Shen, Qijia, et autres
Publié: (2024)
SOOD-ImageNet: a Large-Scale Dataset for Semantic Out-Of-Distribution Image Classification and Semantic Segmentation
par: Bacchin, Alberto, et autres
Publié: (2024)
par: Bacchin, Alberto, et autres
Publié: (2024)
G3DR: Generative 3D Reconstruction in ImageNet
par: Reddy, Pradyumna, et autres
Publié: (2024)
par: Reddy, Pradyumna, et autres
Publié: (2024)
Automated Classification of Model Errors on ImageNet
par: Peychev, Momchil, et autres
Publié: (2023)
par: Peychev, Momchil, et autres
Publié: (2023)
Comparative Performance of Finetuned ImageNet Pre-trained Models for Electronic Component Classification
par: Shao, Yidi, et autres
Publié: (2025)
par: Shao, Yidi, et autres
Publié: (2025)
Corner Cases: How Size and Position of Objects Challenge ImageNet-Trained Models
par: Fatima, Mishal, et autres
Publié: (2025)
par: Fatima, Mishal, et autres
Publié: (2025)
Unlocking ImageNet's Multi-Object Nature: Automated Large-Scale Multilabel Annotation
par: Chen, Junyu, et autres
Publié: (2026)
par: Chen, Junyu, et autres
Publié: (2026)
Do ImageNet-trained models learn shortcuts? The impact of frequency shortcuts on generalization
par: Wang, Shunxin, et autres
Publié: (2025)
par: Wang, Shunxin, et autres
Publié: (2025)
BioBench: A Blueprint to Move Beyond ImageNet for Scientific ML Benchmarks
par: Stevens, Samuel
Publié: (2025)
par: Stevens, Samuel
Publié: (2025)
Detection, Pose Estimation and Segmentation for Multiple Bodies: Closing the Virtuous Circle
par: Purkrabek, Miroslav, et autres
Publié: (2024)
par: Purkrabek, Miroslav, et autres
Publié: (2024)
ProbPose: A Probabilistic Approach to 2D Human Pose Estimation
par: Purkrabek, Miroslav, et autres
Publié: (2024)
par: Purkrabek, Miroslav, et autres
Publié: (2024)
Video shutter angle estimation using optical flow and linear blur
par: Korcak, David, et autres
Publié: (2023)
par: Korcak, David, et autres
Publié: (2023)
Accurate Planar Tracking With Robust Re-Detection
par: Serych, Jonas, et autres
Publié: (2026)
par: Serych, Jonas, et autres
Publié: (2026)
Improving 2D Human Pose Estimation in Rare Camera Views with Synthetic Data
par: Purkrabek, Miroslav, et autres
Publié: (2023)
par: Purkrabek, Miroslav, et autres
Publié: (2023)
Going Beyond U-Net: Assessing Vision Transformers for Semantic Segmentation in Microscopy Image Analysis
par: Tsiporenko, Illia, et autres
Publié: (2024)
par: Tsiporenko, Illia, et autres
Publié: (2024)
A New Dataset and a Distractor-Aware Architecture for Transparent Object Tracking
par: Lukezic, Alan, et autres
Publié: (2024)
par: Lukezic, Alan, et autres
Publié: (2024)
ConvNet vs Transformer, Supervised vs CLIP: Beyond ImageNet Accuracy
par: Vishniakov, Kirill, et autres
Publié: (2023)
par: Vishniakov, Kirill, et autres
Publié: (2023)
ImageNet3D: Towards General-Purpose Object-Level 3D Understanding
par: Ma, Wufei, et autres
Publié: (2024)
par: Ma, Wufei, et autres
Publié: (2024)
Can Biases in ImageNet Models Explain Generalization?
par: Gavrikov, Paul, et autres
Publié: (2024)
par: Gavrikov, Paul, et autres
Publié: (2024)
Toward Errorless Training ImageNet-1k
par: Deng, Bo, et autres
Publié: (2025)
par: Deng, Bo, et autres
Publié: (2025)
Documents similaires
-
Image Recognition with Vision and Language Embeddings of VLMs
par: Volkov, Illia, et autres
Publié: (2025) -
Multimodal Large Language Models as Image Classifiers
par: Kisel, Nikita, et autres
Publié: (2026) -
Bringing the Context Back into Object Recognition, Robustly
par: Janouskova, Klara, et autres
Publié: (2024) -
Robust Context-Aware Object Recognition
par: Janouskova, Klara, et autres
Publié: (2025) -
Single Image Test-Time Adaptation for Segmentation
par: Janouskova, Klara, et autres
Publié: (2023)