How far can we go with ImageNet for Text-to-Image generation?
Fuente:
arXiv
Salvato in:
| Autori principali: | Degeorge, L., Ghosh, A., Dufour, N., Picard, D., Kalogeiton, V. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MIRO: MultI-Reward cOnditioned pretraining improves T2I quality and efficiency
di: Dufour, Nicolas, et al.
Pubblicazione: (2025)
di: Dufour, Nicolas, et al.
Pubblicazione: (2025)
Speedrunning ImageNet Diffusion
di: Bhanded, Swayam
Pubblicazione: (2025)
di: Bhanded, Swayam
Pubblicazione: (2025)
E.T. the Exceptional Trajectories: Text-to-camera-trajectory generation with character awareness
di: Courant, Robin, et al.
Pubblicazione: (2024)
di: Courant, Robin, et al.
Pubblicazione: (2024)
Geometry aware 3D generation from in-the-wild images in ImageNet
di: Shen, Qijia, et al.
Pubblicazione: (2024)
di: Shen, Qijia, et al.
Pubblicazione: (2024)
Around the World in 80 Timesteps: A Generative Approach to Global Visual Geolocation
di: Dufour, Nicolas, et al.
Pubblicazione: (2024)
di: Dufour, Nicolas, et al.
Pubblicazione: (2024)
Don't drop your samples! Coherence-aware training benefits Conditional diffusion
di: Dufour, Nicolas, et al.
Pubblicazione: (2024)
di: Dufour, Nicolas, et al.
Pubblicazione: (2024)
Flaws of ImageNet, Computer Vision's Favourite Dataset
di: Kisel, Nikita, et al.
Pubblicazione: (2024)
di: Kisel, Nikita, et al.
Pubblicazione: (2024)
One-step Diffusion Models with Bregman Density Ratio Matching
di: Zhu, Yuanzhi, et al.
Pubblicazione: (2025)
di: Zhu, Yuanzhi, et al.
Pubblicazione: (2025)
Corner Cases: How Size and Position of Objects Challenge ImageNet-Trained Models
di: Fatima, Mishal, et al.
Pubblicazione: (2025)
di: Fatima, Mishal, et al.
Pubblicazione: (2025)
Fine-Grained ImageNet Classification in the Wild
di: Lymperaiou, Maria, et al.
Pubblicazione: (2023)
di: Lymperaiou, Maria, et al.
Pubblicazione: (2023)
ImageNot: A contrast with ImageNet preserves model rankings
di: Salaudeen, Olawale, et al.
Pubblicazione: (2024)
di: Salaudeen, Olawale, et al.
Pubblicazione: (2024)
ImageNet-OOD: Deciphering Modern Out-of-Distribution Detection Algorithms
di: Yang, William, et al.
Pubblicazione: (2023)
di: Yang, William, et al.
Pubblicazione: (2023)
What Makes ImageNet Look Unlike LAION
di: Shirali, Ali, et al.
Pubblicazione: (2023)
di: Shirali, Ali, et al.
Pubblicazione: (2023)
Infrared Object Detection with Ultra Small ConvNets: Is ImageNet Pretraining Still Useful?
di: Muralidharan, Srikanth, et al.
Pubblicazione: (2025)
di: Muralidharan, Srikanth, et al.
Pubblicazione: (2025)
Automated Classification of Model Errors on ImageNet
di: Peychev, Momchil, et al.
Pubblicazione: (2023)
di: Peychev, Momchil, et al.
Pubblicazione: (2023)
CNN and ViT Efficiency Study on Tiny ImageNet and DermaMNIST Datasets
di: Amangeldi, Aidar, et al.
Pubblicazione: (2025)
di: Amangeldi, Aidar, et al.
Pubblicazione: (2025)
Babel-ImageNet: Massively Multilingual Evaluation of Vision-and-Language Representations
di: Geigle, Gregor, et al.
Pubblicazione: (2023)
di: Geigle, Gregor, et al.
Pubblicazione: (2023)
G3DR: Generative 3D Reconstruction in ImageNet
di: Reddy, Pradyumna, et al.
Pubblicazione: (2024)
di: Reddy, Pradyumna, et al.
Pubblicazione: (2024)
PoM: Efficient Image and Video Generation with the Polynomial Mixer
di: Picard, David, et al.
Pubblicazione: (2024)
di: Picard, David, et al.
Pubblicazione: (2024)
Comparative Performance of Finetuned ImageNet Pre-trained Models for Electronic Component Classification
di: Shao, Yidi, et al.
Pubblicazione: (2025)
di: Shao, Yidi, et al.
Pubblicazione: (2025)
Do ImageNet-trained models learn shortcuts? The impact of frequency shortcuts on generalization
di: Wang, Shunxin, et al.
Pubblicazione: (2025)
di: Wang, Shunxin, et al.
Pubblicazione: (2025)
BioBench: A Blueprint to Move Beyond ImageNet for Scientific ML Benchmarks
di: Stevens, Samuel
Pubblicazione: (2025)
di: Stevens, Samuel
Pubblicazione: (2025)
Unlocking ImageNet's Multi-Object Nature: Automated Large-Scale Multilabel Annotation
di: Chen, Junyu, et al.
Pubblicazione: (2026)
di: Chen, Junyu, et al.
Pubblicazione: (2026)
Toward Errorless Training ImageNet-1k
di: Deng, Bo, et al.
Pubblicazione: (2025)
di: Deng, Bo, et al.
Pubblicazione: (2025)
Can Biases in ImageNet Models Explain Generalization?
di: Gavrikov, Paul, et al.
Pubblicazione: (2024)
di: Gavrikov, Paul, et al.
Pubblicazione: (2024)
ConvNet vs Transformer, Supervised vs CLIP: Beyond ImageNet Accuracy
di: Vishniakov, Kirill, et al.
Pubblicazione: (2023)
di: Vishniakov, Kirill, et al.
Pubblicazione: (2023)
ImageNet3D: Towards General-Purpose Object-Level 3D Understanding
di: Ma, Wufei, et al.
Pubblicazione: (2024)
di: Ma, Wufei, et al.
Pubblicazione: (2024)
Beyond ImageNet: Understanding Cross-Dataset Robustness of Lightweight Vision Models
di: Zhang, Weidong, et al.
Pubblicazione: (2025)
di: Zhang, Weidong, et al.
Pubblicazione: (2025)
Interpreting CLIP: Insights on the Robustness to ImageNet Distribution Shifts
di: Crabbé, Jonathan, et al.
Pubblicazione: (2023)
di: Crabbé, Jonathan, et al.
Pubblicazione: (2023)
Large-Scale Data-Free Knowledge Distillation for ImageNet via Multi-Resolution Data Generation
di: Tran, Minh-Tuan, et al.
Pubblicazione: (2024)
di: Tran, Minh-Tuan, et al.
Pubblicazione: (2024)
Self-Supervised ImageNet Representations for In Vivo Confocal Microscopy: Tortuosity Grading without Segmentation Maps
di: Ouan, Kim, et al.
Pubblicazione: (2026)
di: Ouan, Kim, et al.
Pubblicazione: (2026)
SemiSAM-O1: How far can we push the boundary of annotation-efficient medical image segmentation?
di: Zhang, Yichi, et al.
Pubblicazione: (2026)
di: Zhang, Yichi, et al.
Pubblicazione: (2026)
How far have we gone in Generative Image Restoration? A study on its capability, limitations and evaluation practices
di: Yin, Xiang, et al.
Pubblicazione: (2026)
di: Yin, Xiang, et al.
Pubblicazione: (2026)
Transfer Learning from ImageNet for MEG-Based Decoding of Imagined Speech
di: Jhilal, Soufiane, et al.
Pubblicazione: (2026)
di: Jhilal, Soufiane, et al.
Pubblicazione: (2026)
Is ImageNet worth 1 video? Learning strong image encoders from 1 long unlabelled video
di: Venkataramanan, Shashanka, et al.
Pubblicazione: (2023)
di: Venkataramanan, Shashanka, et al.
Pubblicazione: (2023)
Accessing Vision Foundation Models via ImageNet-1K
di: Zhang, Yitian, et al.
Pubblicazione: (2024)
di: Zhang, Yitian, et al.
Pubblicazione: (2024)
Mitigating Overfitting in Medical Imaging: Self-Supervised Pretraining vs. ImageNet Transfer Learning for Dermatological Diagnosis
di: Matas, Iván, et al.
Pubblicazione: (2025)
di: Matas, Iván, et al.
Pubblicazione: (2025)
SOOD-ImageNet: a Large-Scale Dataset for Semantic Out-Of-Distribution Image Classification and Semantic Segmentation
di: Bacchin, Alberto, et al.
Pubblicazione: (2024)
di: Bacchin, Alberto, et al.
Pubblicazione: (2024)
Bridging Text and Image for Artist Style Transfer via Contrastive Learning
di: Liu, Zhi-Song, et al.
Pubblicazione: (2024)
di: Liu, Zhi-Song, et al.
Pubblicazione: (2024)
NanoVLMs: How small can we go and still make coherent Vision Language Models?
di: Agarwalla, Mukund, et al.
Pubblicazione: (2025)
di: Agarwalla, Mukund, et al.
Pubblicazione: (2025)
Documenti analoghi
-
MIRO: MultI-Reward cOnditioned pretraining improves T2I quality and efficiency
di: Dufour, Nicolas, et al.
Pubblicazione: (2025) -
Speedrunning ImageNet Diffusion
di: Bhanded, Swayam
Pubblicazione: (2025) -
E.T. the Exceptional Trajectories: Text-to-camera-trajectory generation with character awareness
di: Courant, Robin, et al.
Pubblicazione: (2024) -
Geometry aware 3D generation from in-the-wild images in ImageNet
di: Shen, Qijia, et al.
Pubblicazione: (2024) -
Around the World in 80 Timesteps: A Generative Approach to Global Visual Geolocation
di: Dufour, Nicolas, et al.
Pubblicazione: (2024)