When +1% Is Not Enough: A Paired Bootstrap Protocol for Evaluating Small Improvements
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Du, Wenzhang |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Non-Heuristic Selection via Hybrid Regularized and Machine Learning Models for Insurance
par: Galvão, Luciano Ribeiro, et autres
Publié: (2025)
par: Galvão, Luciano Ribeiro, et autres
Publié: (2025)
Calibrated Counterfactual Conformal Fairness ($C^3F$): Post-hoc, Shift-Aware Coverage Parity via Conformal Prediction and Counterfactual Regularization
par: Alpay, Faruk, et autres
Publié: (2025)
par: Alpay, Faruk, et autres
Publié: (2025)
Enhancing Visual Interpretability and Explainability in Functional Survival Trees and Forests
par: Loffredo, Giuseppe, et autres
Publié: (2025)
par: Loffredo, Giuseppe, et autres
Publié: (2025)
An Imbalance-Robust Evaluation Framework for Extreme Risk Forecasts
par: Nikolopoulos, Sotirios D.
Publié: (2025)
par: Nikolopoulos, Sotirios D.
Publié: (2025)
Closed-Form Beta Distribution Estimation from Sparse Statistics with Random Forest Implicit Regularization
par: Landers, Jonathan R.
Publié: (2025)
par: Landers, Jonathan R.
Publié: (2025)
ML-driven detection and reduction of ballast information in multi-modal datasets
par: Solovko, Yaroslav
Publié: (2026)
par: Solovko, Yaroslav
Publié: (2026)
ICE: Intervention-Consistent Explanation Evaluation with Statistical Grounding for LLMs
par: Basu, Abhinaba, et autres
Publié: (2026)
par: Basu, Abhinaba, et autres
Publié: (2026)
Evaluation of the number of clusters in a data set using $p$-values from Multiple Tests of Hypotheses
par: Modak, Soumita
Publié: (2026)
par: Modak, Soumita
Publié: (2026)
Augmented Functional Random Forests: Classifier Construction and Unbiased Functional Principal Components Importance through Ad-Hoc Conditional Permutations
par: Maturo, Fabrizio, et autres
Publié: (2024)
par: Maturo, Fabrizio, et autres
Publié: (2024)
Conservative Decisions with Risk Scores
par: Wei, Yishu, et autres
Publié: (2025)
par: Wei, Yishu, et autres
Publié: (2025)
Censored lifespans in a double-truncated sample: Maximum likelihood inference for the exponential distribution
par: Sieg, Fiete, et autres
Publié: (2025)
par: Sieg, Fiete, et autres
Publié: (2025)
Optimised Support Vector Regression for California Housing Price Prediction: The Critical Role of Feature Engineering and Hyperparameter Tuning
par: Adutwum, Emmanuel
Publié: (2026)
par: Adutwum, Emmanuel
Publié: (2026)
The Good, the Bad, and the Ugly of Markov Boundary for Tabular Prediction
par: Wan, Shu, et autres
Publié: (2026)
par: Wan, Shu, et autres
Publié: (2026)
Bootstrapping not under the null?
par: Derumigny, Alexis, et autres
Publié: (2025)
par: Derumigny, Alexis, et autres
Publié: (2025)
Exploring Hierarchical Classification Performance for Time Series Data: Dissimilarity Measures and Classifier Comparisons
par: Alagoz, Celal
Publié: (2024)
par: Alagoz, Celal
Publié: (2024)
Forecasting intermittent time series with Gaussian Processes and Tweedie likelihood
par: Damato, Stefano, et autres
Publié: (2025)
par: Damato, Stefano, et autres
Publié: (2025)
Ostrom-Weighted Bootstrap: A Theoretically Optimal and Provably Complete Framework for Hierarchical Imputation in Multi-Agent Systems
par: Wakimoto, Hirofumi
Publié: (2025)
par: Wakimoto, Hirofumi
Publié: (2025)
SplitWise Regression: Stepwise Modeling with Adaptive Dummy Encoding
par: Kurbucz, Marcell T., et autres
Publié: (2025)
par: Kurbucz, Marcell T., et autres
Publié: (2025)
Scalable Bayesian Clustering for Integrative Analysis of Multi-View Data
par: Cabral, Rafael, et autres
Publié: (2024)
par: Cabral, Rafael, et autres
Publié: (2024)
Integration of Structural Equation Modeling and Bayesian Networks in the Context of Causal Inference: A Case Study on Personal Positive Youth Development
par: Benitez, Edgar, et autres
Publié: (2024)
par: Benitez, Edgar, et autres
Publié: (2024)
Dimension-independent rates for structured neural density estimation
par: Vandermeulen, Robert A., et autres
Publié: (2024)
par: Vandermeulen, Robert A., et autres
Publié: (2024)
Ranking of Multi-Response Experiment Treatments
par: Pebes-Trujillo, Miguel R., et autres
Publié: (2024)
par: Pebes-Trujillo, Miguel R., et autres
Publié: (2024)
CSTS: A Benchmark for the Discovery of Correlation Structures in Time Series Clustering
par: Degen, Isabella, et autres
Publié: (2025)
par: Degen, Isabella, et autres
Publié: (2025)
Statistical Measures for Explainable Aspect-Based Sentiment Analysis: A Case Study on Environmental Discourse in Reddit
par: Stracqualursi, Luisa, et autres
Publié: (2026)
par: Stracqualursi, Luisa, et autres
Publié: (2026)
Classifier Calibration at Scale: An Empirical Study of Model-Agnostic Post-Hoc Methods
par: Manokhin, Valery, et autres
Publié: (2026)
par: Manokhin, Valery, et autres
Publié: (2026)
When to Trust Confidence Thresholding: Calibration Diagnostics for Pseudo-Labelled Regression
par: Kurbucz, Marcell T.
Publié: (2026)
par: Kurbucz, Marcell T.
Publié: (2026)
Geometric Mixture Classifier (GMC): A Discriminative Per-Class Mixture of Hyperplanes
par: K, Prasanth K, et autres
Publié: (2025)
par: K, Prasanth K, et autres
Publié: (2025)
Asymptotic Consistency and Generalization in Hybrid Models of Regularized Selection and Nonlinear Learning
par: Galvão, Luciano Ribeiro, et autres
Publié: (2025)
par: Galvão, Luciano Ribeiro, et autres
Publié: (2025)
Evaluating the Quality of the Quantified Uncertainty for (Re)Calibration of Data-Driven Regression Models
par: Wibbeke, Jelke, et autres
Publié: (2025)
par: Wibbeke, Jelke, et autres
Publié: (2025)
Factorizable joint shift revisited
par: Tasche, Dirk
Publié: (2026)
par: Tasche, Dirk
Publié: (2026)
Confidence Sets for Multidimensional Scaling
par: Vishwanath, Siddharth, et autres
Publié: (2025)
par: Vishwanath, Siddharth, et autres
Publié: (2025)
A Bayesian Bootstrap for Mixture Models
par: Cui, Fuheng, et autres
Publié: (2023)
par: Cui, Fuheng, et autres
Publié: (2023)
A Hybrid Mixture Approach for Clustering and Characterizing Cancer Data
par: Kareem, Kazeem, et autres
Publié: (2025)
par: Kareem, Kazeem, et autres
Publié: (2025)
Pair Correlation Factor and the Sample Complexity of Gaussian Mixtures
par: Aryan, Farzad
Publié: (2025)
par: Aryan, Farzad
Publié: (2025)
PRIM-cipal components analysis
par: Liu, Tianhao, et autres
Publié: (2026)
par: Liu, Tianhao, et autres
Publié: (2026)
5G-DIL: Domain Incremental Learning with Similarity-Aware Sampling for Dynamic 5G Indoor Localization
par: Raichur, Nisha Lakshmana, et autres
Publié: (2025)
par: Raichur, Nisha Lakshmana, et autres
Publié: (2025)
Causal Deep Learning
par: Vasilescu, M. Alex O.
Publié: (2023)
par: Vasilescu, M. Alex O.
Publié: (2023)
Multi-layered model-based characterisation of the local-Universe galaxy data from the GAMA survey
par: Dai, Fan, et autres
Publié: (2026)
par: Dai, Fan, et autres
Publié: (2026)
Statistical Multicriteria Benchmarking via the GSD-Front
par: Jansen, Christoph, et autres
Publié: (2024)
par: Jansen, Christoph, et autres
Publié: (2024)
Dense Video Understanding with Gated Residual Tokenization
par: Zhang, Haichao, et autres
Publié: (2025)
par: Zhang, Haichao, et autres
Publié: (2025)
Documents similaires
-
Non-Heuristic Selection via Hybrid Regularized and Machine Learning Models for Insurance
par: Galvão, Luciano Ribeiro, et autres
Publié: (2025) -
Calibrated Counterfactual Conformal Fairness ($C^3F$): Post-hoc, Shift-Aware Coverage Parity via Conformal Prediction and Counterfactual Regularization
par: Alpay, Faruk, et autres
Publié: (2025) -
Enhancing Visual Interpretability and Explainability in Functional Survival Trees and Forests
par: Loffredo, Giuseppe, et autres
Publié: (2025) -
An Imbalance-Robust Evaluation Framework for Extreme Risk Forecasts
par: Nikolopoulos, Sotirios D.
Publié: (2025) -
Closed-Form Beta Distribution Estimation from Sparse Statistics with Random Forest Implicit Regularization
par: Landers, Jonathan R.
Publié: (2025)