How many classifiers do we need?
Fuente:
arXiv
Salvato in:
| Autori principali: | Kim, Hyunsuk, Hodgkinson, Liam, Theisen, Ryan, Mahoney, Michael W. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Models of Heavy-Tailed Mechanistic Universality
di: Hodgkinson, Liam, et al.
Pubblicazione: (2025)
di: Hodgkinson, Liam, et al.
Pubblicazione: (2025)
Uncertainty-Aware Diagnostics for Physics-Informed Machine Learning
di: Daniels, Mara, et al.
Pubblicazione: (2025)
di: Daniels, Mara, et al.
Pubblicazione: (2025)
How many classes do we need to see for novel class discovery?
di: Sarkar, Akanksha, et al.
Pubblicazione: (2025)
di: Sarkar, Akanksha, et al.
Pubblicazione: (2025)
Spectral Estimation with Free Decompression
di: Ameli, Siavash, et al.
Pubblicazione: (2025)
di: Ameli, Siavash, et al.
Pubblicazione: (2025)
Free Decompression with Algebraic Spectral Curves
di: Ameli, Siavash, et al.
Pubblicazione: (2026)
di: Ameli, Siavash, et al.
Pubblicazione: (2026)
The Interpolating Information Criterion for Overparameterized Models
di: Hodgkinson, Liam, et al.
Pubblicazione: (2023)
di: Hodgkinson, Liam, et al.
Pubblicazione: (2023)
A Regularization-Sharpness Tradeoff for Linear Interpolators
di: Hu, Qingyi, et al.
Pubblicazione: (2026)
di: Hu, Qingyi, et al.
Pubblicazione: (2026)
How many simulations do we need for simulation-based inference in cosmology?
di: Bairagi, Anirban, et al.
Pubblicazione: (2025)
di: Bairagi, Anirban, et al.
Pubblicazione: (2025)
Determinant Estimation under Memory Constraints and Neural Scaling Laws
di: Ameli, Siavash, et al.
Pubblicazione: (2025)
di: Ameli, Siavash, et al.
Pubblicazione: (2025)
Unsupervised anomaly detection algorithms on real-world data: how many do we need?
di: Bouman, Roel, et al.
Pubblicazione: (2023)
di: Bouman, Roel, et al.
Pubblicazione: (2023)
Is the Last Layer Sufficient for Uncertainty Quantification?
di: Wilson, Joseph, et al.
Pubblicazione: (2026)
di: Wilson, Joseph, et al.
Pubblicazione: (2026)
Uncertainty Quantification with the Empirical Neural Tangent Kernel
di: Wilson, Joseph, et al.
Pubblicazione: (2025)
di: Wilson, Joseph, et al.
Pubblicazione: (2025)
How many samples are needed to train a deep neural network?
di: Golestaneh, Pegah, et al.
Pubblicazione: (2024)
di: Golestaneh, Pegah, et al.
Pubblicazione: (2024)
Temperature Optimization for Bayesian Deep Learning
di: Ng, Kenyon, et al.
Pubblicazione: (2024)
di: Ng, Kenyon, et al.
Pubblicazione: (2024)
State space models, emergence, and ergodicity: How many parameters are needed for stable predictions?
di: Ziemann, Ingvar, et al.
Pubblicazione: (2024)
di: Ziemann, Ingvar, et al.
Pubblicazione: (2024)
Do we need equivariant models for molecule generation?
di: Nowara, Ewa M., et al.
Pubblicazione: (2025)
di: Nowara, Ewa M., et al.
Pubblicazione: (2025)
NysAct: A Scalable Preconditioned Gradient Descent using Nystrom Approximation
di: Seung, Hyunseok, et al.
Pubblicazione: (2025)
di: Seung, Hyunseok, et al.
Pubblicazione: (2025)
MAC: An Efficient Gradient Preconditioning using Mean Activation Approximated Curvature
di: Seung, Hyunseok, et al.
Pubblicazione: (2025)
di: Seung, Hyunseok, et al.
Pubblicazione: (2025)
Low-Rank Curvature for Zeroth-Order Optimization in LLM Fine-Tuning
di: Seung, Hyunseok, et al.
Pubblicazione: (2025)
di: Seung, Hyunseok, et al.
Pubblicazione: (2025)
Random Matrix Theory for Deep Learning: Beyond Eigenvalues of Linear Models
di: Liao, Zhenyu, et al.
Pubblicazione: (2025)
di: Liao, Zhenyu, et al.
Pubblicazione: (2025)
Do we really need the Rademacher complexities?
di: Bartl, Daniel, et al.
Pubblicazione: (2025)
di: Bartl, Daniel, et al.
Pubblicazione: (2025)
Recent and Upcoming Developments in Randomized Numerical Linear Algebra for Machine Learning
di: Dereziński, Michał, et al.
Pubblicazione: (2024)
di: Dereziński, Michał, et al.
Pubblicazione: (2024)
Statistical Inference of Constrained Stochastic Optimization via Sketched Sequential Quadratic Programming
di: Na, Sen, et al.
Pubblicazione: (2022)
di: Na, Sen, et al.
Pubblicazione: (2022)
Towards Scalable and Versatile Weight Space Learning
di: Schürholt, Konstantin, et al.
Pubblicazione: (2024)
di: Schürholt, Konstantin, et al.
Pubblicazione: (2024)
Logistic regression models for patient-level prediction based on massive observational data: Do we need all data?
di: John, Luis H., et al.
Pubblicazione: (2020)
di: John, Luis H., et al.
Pubblicazione: (2020)
An Adaptive Method Stabilizing Activations for Enhanced Generalization
di: Seung, Hyunseok, et al.
Pubblicazione: (2025)
di: Seung, Hyunseok, et al.
Pubblicazione: (2025)
HOPE for a Robust Parameterization of Long-memory State Space Models
di: Yu, Annan, et al.
Pubblicazione: (2024)
di: Yu, Annan, et al.
Pubblicazione: (2024)
Do we need rebalancing strategies? A theoretical and empirical study around SMOTE and its variants
di: Sakho, Abdoulaye, et al.
Pubblicazione: (2024)
di: Sakho, Abdoulaye, et al.
Pubblicazione: (2024)
How adversarial attacks can disrupt seemingly stable accurate classifiers
di: Sutton, Oliver J., et al.
Pubblicazione: (2023)
di: Sutton, Oliver J., et al.
Pubblicazione: (2023)
A Three-regime Model of Network Pruning
di: Zhou, Yefan, et al.
Pubblicazione: (2023)
di: Zhou, Yefan, et al.
Pubblicazione: (2023)
Paving the way for scientific foundation models: enhancing generalization and robustness in PDEs with constraint-aware pre-training
di: Totounferoush, Amin, et al.
Pubblicazione: (2025)
di: Totounferoush, Amin, et al.
Pubblicazione: (2025)
Learning rheological parameters of non-Newtonian fluids from velocimetry data
di: Kontogiannis, Alexandros, et al.
Pubblicazione: (2024)
di: Kontogiannis, Alexandros, et al.
Pubblicazione: (2024)
1 bit is all we need: binary normalized neural networks
di: Cabral, Eduardo Lobo Lustoda, et al.
Pubblicazione: (2025)
di: Cabral, Eduardo Lobo Lustoda, et al.
Pubblicazione: (2025)
Recency Biased Causal Attention for Time-series Forecasting
di: Hegazy, Kareem, et al.
Pubblicazione: (2025)
di: Hegazy, Kareem, et al.
Pubblicazione: (2025)
Zero-failure testing of binary classifiers
di: Ivrissimtzis, Ioannis, et al.
Pubblicazione: (2024)
di: Ivrissimtzis, Ioannis, et al.
Pubblicazione: (2024)
Model Stock: All we need is just a few fine-tuned models
di: Jang, Dong-Hwan, et al.
Pubblicazione: (2024)
di: Jang, Dong-Hwan, et al.
Pubblicazione: (2024)
Transferring Graph Neural Networks for Soft Sensor Modeling using Process Topologies
di: Theisen, Maximilian F., et al.
Pubblicazione: (2025)
di: Theisen, Maximilian F., et al.
Pubblicazione: (2025)
A Statistical Framework for Ranking LLM-Based Chatbots
di: Ameli, Siavash, et al.
Pubblicazione: (2024)
di: Ameli, Siavash, et al.
Pubblicazione: (2024)
KVQuant: Towards 10 Million Context Length LLM Inference with KV Cache Quantization
di: Hooper, Coleman, et al.
Pubblicazione: (2024)
di: Hooper, Coleman, et al.
Pubblicazione: (2024)
Hierarchical mixture of discriminative Generalized Dirichlet classifiers
di: Togban, Elvis, et al.
Pubblicazione: (2024)
di: Togban, Elvis, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Models of Heavy-Tailed Mechanistic Universality
di: Hodgkinson, Liam, et al.
Pubblicazione: (2025) -
Uncertainty-Aware Diagnostics for Physics-Informed Machine Learning
di: Daniels, Mara, et al.
Pubblicazione: (2025) -
How many classes do we need to see for novel class discovery?
di: Sarkar, Akanksha, et al.
Pubblicazione: (2025) -
Spectral Estimation with Free Decompression
di: Ameli, Siavash, et al.
Pubblicazione: (2025) -
Free Decompression with Algebraic Spectral Curves
di: Ameli, Siavash, et al.
Pubblicazione: (2026)