Accessing Vision Foundation Models via ImageNet-1K
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Yitian, Ma, Xu, Bai, Yue, Wang, Huan, Fu, Yun |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Automated Classification of Model Errors on ImageNet
di: Peychev, Momchil, et al.
Pubblicazione: (2023)
di: Peychev, Momchil, et al.
Pubblicazione: (2023)
Scaling Up Deep Clustering Methods Beyond ImageNet-1K
di: Adaloglou, Nikolas, et al.
Pubblicazione: (2024)
di: Adaloglou, Nikolas, et al.
Pubblicazione: (2024)
Don't Judge by the Look: Towards Motion Coherent Video Representation
di: Zhang, Yitian, et al.
Pubblicazione: (2024)
di: Zhang, Yitian, et al.
Pubblicazione: (2024)
Can Biases in ImageNet Models Explain Generalization?
di: Gavrikov, Paul, et al.
Pubblicazione: (2024)
di: Gavrikov, Paul, et al.
Pubblicazione: (2024)
Interpreting CLIP: Insights on the Robustness to ImageNet Distribution Shifts
di: Crabbé, Jonathan, et al.
Pubblicazione: (2023)
di: Crabbé, Jonathan, et al.
Pubblicazione: (2023)
ImageNet-D: Benchmarking Neural Network Robustness on Diffusion Synthetic Object
di: Zhang, Chenshuang, et al.
Pubblicazione: (2024)
di: Zhang, Chenshuang, et al.
Pubblicazione: (2024)
Fine-Grained ImageNet Classification in the Wild
di: Lymperaiou, Maria, et al.
Pubblicazione: (2023)
di: Lymperaiou, Maria, et al.
Pubblicazione: (2023)
Beyond ImageNet: Understanding Cross-Dataset Robustness of Lightweight Vision Models
di: Zhang, Weidong, et al.
Pubblicazione: (2025)
di: Zhang, Weidong, et al.
Pubblicazione: (2025)
From MNIST to ImageNet: Understanding the Scalability Boundaries of Differentiable Logic Gate Networks
di: Brändle, Sven, et al.
Pubblicazione: (2025)
di: Brändle, Sven, et al.
Pubblicazione: (2025)
Squeeze, Recover and Relabel: Dataset Condensation at ImageNet Scale From A New Perspective
di: Yin, Zeyuan, et al.
Pubblicazione: (2023)
di: Yin, Zeyuan, et al.
Pubblicazione: (2023)
Self-supervised Benchmark Lottery on ImageNet: Do Marginal Improvements Translate to Improvements on Similar Datasets?
di: Ozbulak, Utku, et al.
Pubblicazione: (2025)
di: Ozbulak, Utku, et al.
Pubblicazione: (2025)
ImageNet-trained CNNs are not biased towards texture: Revisiting feature reliance through controlled suppression
di: Burgert, Tom, et al.
Pubblicazione: (2025)
di: Burgert, Tom, et al.
Pubblicazione: (2025)
Spurious Feature Eraser: Stabilizing Test-Time Adaptation for Vision-Language Foundation Model
di: Ma, Huan, et al.
Pubblicazione: (2024)
di: Ma, Huan, et al.
Pubblicazione: (2024)
Efficiency Bottlenecks of Convolutional Kolmogorov-Arnold Networks: A Comprehensive Scrutiny with ImageNet, AlexNet, LeNet and Tabular Classification
di: Dahal, Ashim, et al.
Pubblicazione: (2025)
di: Dahal, Ashim, et al.
Pubblicazione: (2025)
SHIELD: Suppressing Hallucinations In LVLM Encoders via Bias and Vulnerability Defense
di: Huang, Yiyang, et al.
Pubblicazione: (2025)
di: Huang, Yiyang, et al.
Pubblicazione: (2025)
Mitigating Overfitting in Medical Imaging: Self-Supervised Pretraining vs. ImageNet Transfer Learning for Dermatological Diagnosis
di: Matas, Iván, et al.
Pubblicazione: (2025)
di: Matas, Iván, et al.
Pubblicazione: (2025)
ViTime: Foundation Model for Time Series Forecasting Powered by Vision Intelligence
di: Yang, Luoxiao, et al.
Pubblicazione: (2024)
di: Yang, Luoxiao, et al.
Pubblicazione: (2024)
Transfer Learning from ImageNet for MEG-Based Decoding of Imagined Speech
di: Jhilal, Soufiane, et al.
Pubblicazione: (2026)
di: Jhilal, Soufiane, et al.
Pubblicazione: (2026)
ImageNet-Think-250K: A Large-Scale Synthetic Dataset for Multimodal Reasoning for Vision Language Models
di: Chitty-Venkata, Krishna Teja, et al.
Pubblicazione: (2025)
di: Chitty-Venkata, Krishna Teja, et al.
Pubblicazione: (2025)
PhiNet v2: A Mask-Free Brain-Inspired Vision Foundation Model from Video
di: Yamada, Makoto, et al.
Pubblicazione: (2025)
di: Yamada, Makoto, et al.
Pubblicazione: (2025)
Vision Foundation Models as Effective Visual Tokenizers for Autoregressive Image Generation
di: Zheng, Anlin, et al.
Pubblicazione: (2025)
di: Zheng, Anlin, et al.
Pubblicazione: (2025)
EXAONEPath 1.0 Patch-level Foundation Model for Pathology
di: Yun, Juseung, et al.
Pubblicazione: (2024)
di: Yun, Juseung, et al.
Pubblicazione: (2024)
Project Imaging-X: A Survey of 1000+ Open-Access Medical Imaging Datasets for Foundation Model Development
di: Deng, Zhongying, et al.
Pubblicazione: (2026)
di: Deng, Zhongying, et al.
Pubblicazione: (2026)
Few-Shot Segmentation of Historical Maps via Linear Probing of Vision Foundation Models
di: Sterzinger, Rafael, et al.
Pubblicazione: (2025)
di: Sterzinger, Rafael, et al.
Pubblicazione: (2025)
OOSTraj: Out-of-Sight Trajectory Prediction With Vision-Positioning Denoising
di: Zhang, Haichao, et al.
Pubblicazione: (2024)
di: Zhang, Haichao, et al.
Pubblicazione: (2024)
REGEN: Learning Compact Video Embedding with (Re-)Generative Decoder
di: Zhang, Yitian, et al.
Pubblicazione: (2025)
di: Zhang, Yitian, et al.
Pubblicazione: (2025)
CycleNet: Rethinking Cycle Consistency in Text-Guided Diffusion for Image Manipulation
di: Xu, Sihan, et al.
Pubblicazione: (2023)
di: Xu, Sihan, et al.
Pubblicazione: (2023)
Hollowed Net for On-Device Personalization of Text-to-Image Diffusion Models
di: Cho, Wonguk, et al.
Pubblicazione: (2024)
di: Cho, Wonguk, et al.
Pubblicazione: (2024)
VFMF: World Modeling by Forecasting Vision Foundation Model Features
di: Boduljak, Gabrijel, et al.
Pubblicazione: (2025)
di: Boduljak, Gabrijel, et al.
Pubblicazione: (2025)
CFM: Language-aligned Concept Foundation Model for Vision
di: Wittenmayer, Kai, et al.
Pubblicazione: (2026)
di: Wittenmayer, Kai, et al.
Pubblicazione: (2026)
Benchmarking Feature Upsampling Methods for Vision Foundation Models using Interactive Segmentation
di: Havrylov, Volodymyr, et al.
Pubblicazione: (2025)
di: Havrylov, Volodymyr, et al.
Pubblicazione: (2025)
AutoMiSeg: Automatic Medical Image Segmentation via Test-Time Adaptation of Foundation Models
di: Li, Xingjian, et al.
Pubblicazione: (2025)
di: Li, Xingjian, et al.
Pubblicazione: (2025)
ImageNot: A contrast with ImageNet preserves model rankings
di: Salaudeen, Olawale, et al.
Pubblicazione: (2024)
di: Salaudeen, Olawale, et al.
Pubblicazione: (2024)
What Makes ImageNet Look Unlike LAION
di: Shirali, Ali, et al.
Pubblicazione: (2023)
di: Shirali, Ali, et al.
Pubblicazione: (2023)
Effectiveness Assessment of Recent Large Vision-Language Models
di: Jiang, Yao, et al.
Pubblicazione: (2024)
di: Jiang, Yao, et al.
Pubblicazione: (2024)
Parameter-Free Fine-tuning via Redundancy Elimination for Vision Foundation Models
di: Long, Jiahuan, et al.
Pubblicazione: (2025)
di: Long, Jiahuan, et al.
Pubblicazione: (2025)
Camouflaged Image Synthesis Is All You Need to Boost Camouflaged Detection
di: Zhang, Haichao, et al.
Pubblicazione: (2023)
di: Zhang, Haichao, et al.
Pubblicazione: (2023)
X-Prompt: Towards Universal In-Context Image Generation in Auto-Regressive Vision Language Foundation Models
di: Sun, Zeyi, et al.
Pubblicazione: (2024)
di: Sun, Zeyi, et al.
Pubblicazione: (2024)
Fewer Tokens and Fewer Videos: Extending Video Understanding Abilities in Large Vision-Language Models
di: Chen, Shimin, et al.
Pubblicazione: (2024)
di: Chen, Shimin, et al.
Pubblicazione: (2024)
Toward Errorless Training ImageNet-1k
di: Deng, Bo, et al.
Pubblicazione: (2025)
di: Deng, Bo, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Automated Classification of Model Errors on ImageNet
di: Peychev, Momchil, et al.
Pubblicazione: (2023) -
Scaling Up Deep Clustering Methods Beyond ImageNet-1K
di: Adaloglou, Nikolas, et al.
Pubblicazione: (2024) -
Don't Judge by the Look: Towards Motion Coherent Video Representation
di: Zhang, Yitian, et al.
Pubblicazione: (2024) -
Can Biases in ImageNet Models Explain Generalization?
di: Gavrikov, Paul, et al.
Pubblicazione: (2024) -
Interpreting CLIP: Insights on the Robustness to ImageNet Distribution Shifts
di: Crabbé, Jonathan, et al.
Pubblicazione: (2023)