Reproducible scaling laws for contrastive language-image learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Cherti, Mehdi, Beaumont, Romain, Wightman, Ross, Wortsman, Mitchell, Ilharco, Gabriel, Gordon, Cade, Schuhmann, Christoph, Schmidt, Ludwig, Jitsev, Jenia |
|---|---|
| Format: | Preprint |
| Publié: |
2022
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Resolving Discrepancies in Compute-Optimal Scaling of Language Models
par: Porian, Tomer, et autres
Publié: (2024)
par: Porian, Tomer, et autres
Publié: (2024)
Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets
par: Nezhurina, Marianna, et autres
Publié: (2025)
par: Nezhurina, Marianna, et autres
Publié: (2025)
Alice in Wonderland: Simple Tasks Showing Complete Reasoning Breakdown in State-Of-the-Art Large Language Models
par: Nezhurina, Marianna, et autres
Publié: (2024)
par: Nezhurina, Marianna, et autres
Publié: (2024)
A Good CREPE needs more than just Sugar: Investigating Biases in Compositional Vision-Language Benchmarks
par: Udandarao, Vishaal, et autres
Publié: (2025)
par: Udandarao, Vishaal, et autres
Publié: (2025)
Inverse Deep Learning Ray Tracing for Heliostat Surface Prediction
par: Lewen, Jan, et autres
Publié: (2024)
par: Lewen, Jan, et autres
Publié: (2024)
Scalable heliostat surface predictions from focal spots: Sim-to-Real transfer of inverse Deep Learning Raytracing
par: Lewen, Jan, et autres
Publié: (2025)
par: Lewen, Jan, et autres
Publié: (2025)
Concept-Aware Batch Sampling Improves Language-Image Pretraining
par: Ghosh, Adhiraj, et autres
Publié: (2025)
par: Ghosh, Adhiraj, et autres
Publié: (2025)
Game Reasoning Arena: A Framework and Benchmark for Assessing Reasoning Capabilities of Large Language Models via Game Play
par: Cipolina-Kun, Lucia, et autres
Publié: (2025)
par: Cipolina-Kun, Lucia, et autres
Publié: (2025)
Project Alexandria: Towards Freeing Scientific Knowledge from Copyright Burdens via LLMs
par: Schuhmann, Christoph, et autres
Publié: (2025)
par: Schuhmann, Christoph, et autres
Publié: (2025)
Language models scale reliably with over-training and on downstream tasks
par: Gadre, Samir Yitzhak, et autres
Publié: (2024)
par: Gadre, Samir Yitzhak, et autres
Publié: (2024)
AudioToolAgent: An Agentic Framework for Audio-Language Models
par: Wijngaard, Gijs, et autres
Publié: (2025)
par: Wijngaard, Gijs, et autres
Publié: (2025)
Improving Performance, Robustness, and Fairness of Radiographic AI Models with Finely-Controllable Synthetic Data
par: Moroianu, Stefania L., et autres
Publié: (2025)
par: Moroianu, Stefania L., et autres
Publié: (2025)
Open-sci-ref-0.01: open and reproducible reference baselines for language model and dataset comparison
par: Nezhurina, Marianna, et autres
Publié: (2025)
par: Nezhurina, Marianna, et autres
Publié: (2025)
Kernel ridge regression under power-law data: spectrum and generalization
par: Wortsman, Arie, et autres
Publié: (2025)
par: Wortsman, Arie, et autres
Publié: (2025)
Paradoxes of Social Capital
par: Cherti, Myriam
Publié: (2010)
par: Cherti, Myriam
Publié: (2010)
Learning in Compact Spaces with Approximately Normalized Transformer
par: Franke, Jörg K. H., et autres
Publié: (2025)
par: Franke, Jörg K. H., et autres
Publié: (2025)
Study of scaling laws in language families
par: Santos, Maelyson R. F., et autres
Publié: (2025)
par: Santos, Maelyson R. F., et autres
Publié: (2025)
Scattering amplitudes of stable curves
par: Tevelev, Jenia
Publié: (2020)
par: Tevelev, Jenia
Publié: (2020)
Emergent musical properties of a transformer under contrastive self-supervised learning
par: Kong, Yuexuan, et autres
Publié: (2025)
par: Kong, Yuexuan, et autres
Publié: (2025)
wewightman/pycbf: v1.1.0 - Object oriented class-based ultrasound beamformers with CPU and GPU acceleration
par: Wren Wightman
Publié: (2025)
par: Wren Wightman
Publié: (2025)
Reforestación con caoba y cedro = reforestation with mahogany & spanish cedar / Kevyn Wightman
par: Wightman, Kevyn
par: Wightman, Kevyn
El interés económico de los países industrializados en el desarrollo del tercer mundo / preparado para el Centro de Información Económica y Social de las Naciones Unidas por David Wightman
par: Wightman, David
Publié: (1971)
par: Wightman, David
Publié: (1971)
Advances in image‐based diagnosis of nail disorders
par: Andrea Sechi, et autres
Publié: (2024)
par: Andrea Sechi, et autres
Publié: (2024)
Survival and growth of local and transplanted blue mussels (Mytilus trossulus, Lamark). / Jenia F. Yanick
par: Yanick, Jenia F
Publié: (2003)
par: Yanick, Jenia F
Publié: (2003)
Color Doppler Ultrasound Pattern of Cutaneous Exosomes at High and Ultra‐High Frequency
par: Ximena Wortsman, et autres
Publié: (2025)
par: Ximena Wortsman, et autres
Publié: (2025)
Constraining the physics of protoplanetary disks within Earth-like orbits: The warm molecular disk
par: Cade, Bürgy
Publié: (2025)
par: Cade, Bürgy
Publié: (2025)
(Table 1) Distribution of Cretaceous-Tertiary benthic foraminifers in ODP Hole 129-802A
par: Wightman, Winton G
Publié: (1992)
par: Wightman, Winton G
Publié: (1992)
Maternal Deaths in Australia, 1964–2020. A Review
par: Gerald Wightman Lawson
Publié: (2025)
par: Gerald Wightman Lawson
Publié: (2025)
La cadena de la reforestación y la importancia en la calidad de las plantas
par: Kevyn E. Wightman
Publié: (2003)
par: Kevyn E. Wightman
Publié: (2003)
Bayesian scaling laws for in-context learning
par: Arora, Aryaman, et autres
Publié: (2024)
par: Arora, Aryaman, et autres
Publié: (2024)
Generative Humanization for Therapeutic Antibodies
par: Gordon, Cade, et autres
Publié: (2024)
par: Gordon, Cade, et autres
Publié: (2024)
Robust image representations with counterfactual contrastive learning
par: Roschewitz, Mélanie, et autres
Publié: (2024)
par: Roschewitz, Mélanie, et autres
Publié: (2024)
Equilibrium contrastive learning for imbalanced image classification
par: Roh, Sumin, et autres
Publié: (2026)
par: Roh, Sumin, et autres
Publié: (2026)
Enhancing elusive clues in knowledge learning by contrasting attention of language models
par: Gao, Jian, et autres
Publié: (2024)
par: Gao, Jian, et autres
Publié: (2024)
Radikale Individualität
par: Schuhmann, Maurice
Publié: (2024)
par: Schuhmann, Maurice
Publié: (2024)
MixtureVitae: Open Web-Scale Pretraining Dataset With High Quality Instruction and Reasoning Data Built from Permissive-First Text Sources
par: Nguyen, Huu, et autres
Publié: (2025)
par: Nguyen, Huu, et autres
Publié: (2025)
Metadata-enhanced contrastive learning from retinal optical coherence tomography images
par: Holland, Robbie, et autres
Publié: (2022)
par: Holland, Robbie, et autres
Publié: (2022)
Deformations of Kalck--Karmazyn algebras via Mirror Symmetry
par: Lekili, Yanki, et autres
Publié: (2024)
par: Lekili, Yanki, et autres
Publié: (2024)
Noncommutative resolution of $SU_C(2)$
par: Sink, Elias, et autres
Publié: (2024)
par: Sink, Elias, et autres
Publié: (2024)
On the centralizers of endomorphisms of the projective line
par: Beaumont, Alonso
Publié: (2025)
par: Beaumont, Alonso
Publié: (2025)
Documents similaires
-
Resolving Discrepancies in Compute-Optimal Scaling of Language Models
par: Porian, Tomer, et autres
Publié: (2024) -
Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets
par: Nezhurina, Marianna, et autres
Publié: (2025) -
Alice in Wonderland: Simple Tasks Showing Complete Reasoning Breakdown in State-Of-the-Art Large Language Models
par: Nezhurina, Marianna, et autres
Publié: (2024) -
A Good CREPE needs more than just Sugar: Investigating Biases in Compositional Vision-Language Benchmarks
par: Udandarao, Vishaal, et autres
Publié: (2025) -
Inverse Deep Learning Ray Tracing for Heliostat Surface Prediction
par: Lewen, Jan, et autres
Publié: (2024)