Enregistré dans:
| Auteurs principaux: | Ghosh, Adhiraj, Udandarao, Vishaal, Nguyen, Thao, Farina, Matteo, Cherti, Mehdi, Jitsev, Jenia, Oh, Sewoong, Ricci, Elisa, Schmidt, Ludwig, Bethge, Matthias |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2511.20643 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
A Good CREPE needs more than just Sugar: Investigating Biases in Compositional Vision-Language Benchmarks
par: Udandarao, Vishaal, et autres
Publié: (2025)
par: Udandarao, Vishaal, et autres
Publié: (2025)
ONEBench to Test Them All: Sample-Level Benchmarking Over Open-Ended Capabilities
par: Ghosh, Adhiraj, et autres
Publié: (2024)
par: Ghosh, Adhiraj, et autres
Publié: (2024)
No "Zero-Shot" Without Exponential Data: Pretraining Concept Frequency Determines Multimodal Model Performance
par: Udandarao, Vishaal, et autres
Publié: (2024)
par: Udandarao, Vishaal, et autres
Publié: (2024)
A Practitioner's Guide to Continual Multimodal Pretraining
par: Roth, Karsten, et autres
Publié: (2024)
par: Roth, Karsten, et autres
Publié: (2024)
Alice in Wonderland: Simple Tasks Showing Complete Reasoning Breakdown in State-Of-the-Art Large Language Models
par: Nezhurina, Marianna, et autres
Publié: (2024)
par: Nezhurina, Marianna, et autres
Publié: (2024)
Reproducible scaling laws for contrastive language-image learning
par: Cherti, Mehdi, et autres
Publié: (2022)
par: Cherti, Mehdi, et autres
Publié: (2022)
Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets
par: Nezhurina, Marianna, et autres
Publié: (2025)
par: Nezhurina, Marianna, et autres
Publié: (2025)
Inverse Deep Learning Ray Tracing for Heliostat Surface Prediction
par: Lewen, Jan, et autres
Publié: (2024)
par: Lewen, Jan, et autres
Publié: (2024)
Scalable heliostat surface predictions from focal spots: Sim-to-Real transfer of inverse Deep Learning Raytracing
par: Lewen, Jan, et autres
Publié: (2025)
par: Lewen, Jan, et autres
Publié: (2025)
A Sober Look at Progress in Language Model Reasoning: Pitfalls and Paths to Reproducibility
par: Hochlehnert, Andreas, et autres
Publié: (2025)
par: Hochlehnert, Andreas, et autres
Publié: (2025)
Solving Spatial Supersensing Without Spatial Supersensing
par: Udandarao, Vishaal, et autres
Publié: (2025)
par: Udandarao, Vishaal, et autres
Publié: (2025)
Efficient Lifelong Model Evaluation in an Era of Rapid Progress
par: Prabhu, Ameya, et autres
Publié: (2024)
par: Prabhu, Ameya, et autres
Publié: (2024)
CiteME: Can Language Models Accurately Cite Scientific Claims?
par: Press, Ori, et autres
Publié: (2024)
par: Press, Ori, et autres
Publié: (2024)
Resolving Discrepancies in Compute-Optimal Scaling of Language Models
par: Porian, Tomer, et autres
Publié: (2024)
par: Porian, Tomer, et autres
Publié: (2024)
How to Merge Your Multimodal Models Over Time?
par: Dziadzio, Sebastian, et autres
Publié: (2024)
par: Dziadzio, Sebastian, et autres
Publié: (2024)
Project Alexandria: Towards Freeing Scientific Knowledge from Copyright Burdens via LLMs
par: Schuhmann, Christoph, et autres
Publié: (2025)
par: Schuhmann, Christoph, et autres
Publié: (2025)
Recycling the Web: A Method to Enhance Pre-training Data Quality and Quantity for Language Models
par: Nguyen, Thao, et autres
Publié: (2025)
par: Nguyen, Thao, et autres
Publié: (2025)
Better Alignment with Instruction Back-and-Forth Translation
par: Nguyen, Thao, et autres
Publié: (2024)
par: Nguyen, Thao, et autres
Publié: (2024)
Game Reasoning Arena: A Framework and Benchmark for Assessing Reasoning Capabilities of Large Language Models via Game Play
par: Cipolina-Kun, Lucia, et autres
Publié: (2025)
par: Cipolina-Kun, Lucia, et autres
Publié: (2025)
AudioToolAgent: An Agentic Framework for Audio-Language Models
par: Wijngaard, Gijs, et autres
Publié: (2025)
par: Wijngaard, Gijs, et autres
Publié: (2025)
Multilingual Diversity Improves Vision-Language Representations
par: Nguyen, Thao, et autres
Publié: (2024)
par: Nguyen, Thao, et autres
Publié: (2024)
Improving Performance, Robustness, and Fairness of Radiographic AI Models with Finely-Controllable Synthetic Data
par: Moroianu, Stefania L., et autres
Publié: (2025)
par: Moroianu, Stefania L., et autres
Publié: (2025)
LLM generation novelty through the lens of semantic similarity
par: Davydov, Philipp, et autres
Publié: (2025)
par: Davydov, Philipp, et autres
Publié: (2025)
Data-Centric Lessons To Improve Speech-Language Pretraining
par: Udandarao, Vishaal, et autres
Publié: (2025)
par: Udandarao, Vishaal, et autres
Publié: (2025)
Rethinking Few-Shot Adaptation of Vision-Language Models in Two Stages
par: Farina, Matteo, et autres
Publié: (2025)
par: Farina, Matteo, et autres
Publié: (2025)
Linear Model Merging Unlocks Simple and Scalable Multimodal Data Mixture Optimization
par: Berasi, Davide, et autres
Publié: (2026)
par: Berasi, Davide, et autres
Publié: (2026)
Paradoxes of Social Capital
par: Cherti, Myriam
Publié: (2010)
par: Cherti, Myriam
Publié: (2010)
Portfolio Optimization Proxies under Label Scarcity and Regime Shifts via Bayesian and Deterministic Students under Semi-Supervised Sandwich Training
par: Chattopadhyay, Adhiraj
Publié: (2026)
par: Chattopadhyay, Adhiraj
Publié: (2026)
Equivariance by Contrast: Identifiable Equivariant Embeddings from Unlabeled Finite Group Actions
par: Schmidt, Tobias, et autres
Publié: (2025)
par: Schmidt, Tobias, et autres
Publié: (2025)
Large Multimodal Models as General In-Context Classifiers
par: Garosi, Marco, et autres
Publié: (2026)
par: Garosi, Marco, et autres
Publié: (2026)
Not Only Text: Exploring Compositionality of Visual Representations in Vision-Language Models
par: Berasi, Davide, et autres
Publié: (2025)
par: Berasi, Davide, et autres
Publié: (2025)
Frustratingly Easy Test-Time Adaptation of Vision-Language Models
par: Farina, Matteo, et autres
Publié: (2024)
par: Farina, Matteo, et autres
Publié: (2024)
Learning in Compact Spaces with Approximately Normalized Transformer
par: Franke, Jörg K. H., et autres
Publié: (2025)
par: Franke, Jörg K. H., et autres
Publié: (2025)
Sampling from Your Language Model One Byte at a Time
par: Hayase, Jonathan, et autres
Publié: (2025)
par: Hayase, Jonathan, et autres
Publié: (2025)
Pretraining Frequency Predicts Compositional Generalization of CLIP on Real-World Tasks
par: Wiedemer, Thaddäus, et autres
Publié: (2025)
par: Wiedemer, Thaddäus, et autres
Publié: (2025)
Reflecting on the State of Rehearsal-free Continual Learning with Pretrained Models
par: Thede, Lukas, et autres
Publié: (2024)
par: Thede, Lukas, et autres
Publié: (2024)
Investigating Continual Pretraining in Large Language Models: Insights and Implications
par: Yıldız, Çağatay, et autres
Publié: (2024)
par: Yıldız, Çağatay, et autres
Publié: (2024)
PairAlign: A Framework for Sequence Tokenization via Self-Alignment with Applications to Audio Tokenization
par: Banerjee, Adhiraj, et autres
Publié: (2026)
par: Banerjee, Adhiraj, et autres
Publié: (2026)
Dissipative relativistic fluid flow: A simple Lorentz invariant causal model capturing entropy shocks in its zero viscosity limit
par: Reintjes, Moritz, et autres
Publié: (2024)
par: Reintjes, Moritz, et autres
Publié: (2024)
CodecSep: Prompt-Driven Universal Sound Separation on Neural Audio Codec Latents
par: Banerjee, Adhiraj, et autres
Publié: (2025)
par: Banerjee, Adhiraj, et autres
Publié: (2025)
Documents similaires
-
A Good CREPE needs more than just Sugar: Investigating Biases in Compositional Vision-Language Benchmarks
par: Udandarao, Vishaal, et autres
Publié: (2025) -
ONEBench to Test Them All: Sample-Level Benchmarking Over Open-Ended Capabilities
par: Ghosh, Adhiraj, et autres
Publié: (2024) -
No "Zero-Shot" Without Exponential Data: Pretraining Concept Frequency Determines Multimodal Model Performance
par: Udandarao, Vishaal, et autres
Publié: (2024) -
A Practitioner's Guide to Continual Multimodal Pretraining
par: Roth, Karsten, et autres
Publié: (2024) -
Alice in Wonderland: Simple Tasks Showing Complete Reasoning Breakdown in State-Of-the-Art Large Language Models
par: Nezhurina, Marianna, et autres
Publié: (2024)