Evaluating Supervised Machine Learning Models: Principles, Pitfalls, and Metric Selection
Fuente:
arXiv
Saved in:
| Main Authors: | Liu, Xuanyan, Martin, Ignacio Cabrera, Trovati, Marcello, Xu, Xiaolong, Polatidis, Nikolaos |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Evolving Machine Learning in Non-Stationary Environments: A Unified Survey of Drift, Forgetting, and Adaptation
by: Martin, Ignacio Cabrera, et al.
Published: (2025)
by: Martin, Ignacio Cabrera, et al.
Published: (2025)
Metric-DST: Mitigating Selection Bias Through Diversity-Guided Semi-Supervised Metric Learning
by: Tepeli, Yasin I., et al.
Published: (2024)
by: Tepeli, Yasin I., et al.
Published: (2024)
Towards Principled Unsupervised Multi-Agent Reinforcement Learning
by: Zamboni, Riccardo, et al.
Published: (2025)
by: Zamboni, Riccardo, et al.
Published: (2025)
Pitfalls in Evaluating Language Model Forecasters
by: Paleka, Daniel, et al.
Published: (2025)
by: Paleka, Daniel, et al.
Published: (2025)
Utilizing Large Language Models for Machine Learning Explainability
by: Vassiliades, Alexandros, et al.
Published: (2025)
by: Vassiliades, Alexandros, et al.
Published: (2025)
Evaluating Explainability in Machine Learning Predictions through Explainer-Agnostic Metrics
by: Munoz, Cristian, et al.
Published: (2023)
by: Munoz, Cristian, et al.
Published: (2023)
From Challenges and Pitfalls to Recommendations and Opportunities: Implementing Federated Learning in Healthcare
by: Li, Ming, et al.
Published: (2024)
by: Li, Ming, et al.
Published: (2024)
Deep Learning Inference on Heterogeneous Mobile Processors: Potentials and Pitfalls
by: Liu, Sicong, et al.
Published: (2024)
by: Liu, Sicong, et al.
Published: (2024)
Automated Machine Learning: From Principles to Practices
by: Shen, Zhenqian, et al.
Published: (2018)
by: Shen, Zhenqian, et al.
Published: (2018)
Subjectivity in Unsupervised Machine Learning Model Selection
by: Chen, Wanyi, et al.
Published: (2023)
by: Chen, Wanyi, et al.
Published: (2023)
A Confidence-Variance Theory for Pseudo-Label Selection in Semi-Supervised Learning
by: Liu, Jinshi, et al.
Published: (2026)
by: Liu, Jinshi, et al.
Published: (2026)
Addressing Pitfalls in the Evaluation of Uncertainty Estimation Methods for Natural Language Generation
by: Ielanskyi, Mykyta, et al.
Published: (2025)
by: Ielanskyi, Mykyta, et al.
Published: (2025)
Causal Feature Selection for Responsible Machine Learning
by: Moraffah, Raha, et al.
Published: (2024)
by: Moraffah, Raha, et al.
Published: (2024)
A Framework for Selection of Machine Learning Algorithms Based on Performance Metrices and Akaike Information Criteria in Healthcare, Telecommunication, and Marketing Sector
by: Hamisu, A. K., et al.
Published: (2025)
by: Hamisu, A. K., et al.
Published: (2025)
The Pitfalls of KV Cache Compression
by: Chen, Alex, et al.
Published: (2025)
by: Chen, Alex, et al.
Published: (2025)
Why Can't Transformers Learn Multiplication? Reverse-Engineering Reveals Long-Range Dependency Pitfalls
by: Bai, Xiaoyan, et al.
Published: (2025)
by: Bai, Xiaoyan, et al.
Published: (2025)
Incorporating Attribution Importance for Improving Faithfulness Metrics
by: Zhao, Zhixue, et al.
Published: (2023)
by: Zhao, Zhixue, et al.
Published: (2023)
Robust Anomaly Detection in Network Traffic: Evaluating Machine Learning Models on CICIDS2017
by: Xu, Zhaoyang, et al.
Published: (2025)
by: Xu, Zhaoyang, et al.
Published: (2025)
Evaluation of Bio-Inspired Models under Different Learning Settings For Energy Efficiency in Network Traffic Prediction
by: Tsiolakis, Theodoros, et al.
Published: (2024)
by: Tsiolakis, Theodoros, et al.
Published: (2024)
A Selective Quantization Tuner for ONNX Models
by: Louloudakis, Nikolaos, et al.
Published: (2025)
by: Louloudakis, Nikolaos, et al.
Published: (2025)
Generative Synthetic Data for Causal Inference: Pitfalls, Remedies, and Opportunities
by: Xu, Yichen
Published: (2026)
by: Xu, Yichen
Published: (2026)
Mind the Gap: A Framework for Assessing Pitfalls in Multimodal Active Learning
by: Eisenhardt, Dustin, et al.
Published: (2026)
by: Eisenhardt, Dustin, et al.
Published: (2026)
Improving User Behavior Prediction: Leveraging Annotator Metadata in Supervised Machine Learning Models
by: Ng, Lynnette Hui Xian, et al.
Published: (2025)
by: Ng, Lynnette Hui Xian, et al.
Published: (2025)
The Data Minimization Principle in Machine Learning
by: Ganesh, Prakhar, et al.
Published: (2024)
by: Ganesh, Prakhar, et al.
Published: (2024)
Welfare as a Guiding Principle for Machine Learning -- From Compass, to Lens, to Roadmap
by: Rosenfeld, Nir, et al.
Published: (2025)
by: Rosenfeld, Nir, et al.
Published: (2025)
Automated Off-Policy Estimator Selection via Supervised Learning
by: Felicioni, Nicolò, et al.
Published: (2024)
by: Felicioni, Nicolò, et al.
Published: (2024)
Reinforcement Learning with Reward Machines for Sleep Control in Mobile Networks
by: Levina, Kristina, et al.
Published: (2026)
by: Levina, Kristina, et al.
Published: (2026)
Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples
by: Gao, Chengqian, et al.
Published: (2025)
by: Gao, Chengqian, et al.
Published: (2025)
Evaluating Supervised Learning Models for Fraud Detection: A Comparative Study of Classical and Deep Architectures on Imbalanced Transaction Data
by: Wang, Chao, et al.
Published: (2025)
by: Wang, Chao, et al.
Published: (2025)
The Pitfalls of Memorization: When Memorization Hurts Generalization
by: Bayat, Reza, et al.
Published: (2024)
by: Bayat, Reza, et al.
Published: (2024)
Promises and Pitfalls of Threshold-based Auto-labeling
by: Vishwakarma, Harit, et al.
Published: (2022)
by: Vishwakarma, Harit, et al.
Published: (2022)
Evaluating Self-Supervised Learning via Risk Decomposition
by: Dubois, Yann, et al.
Published: (2023)
by: Dubois, Yann, et al.
Published: (2023)
The Right to be Forgotten in Pruning: Unveil Machine Unlearning on Sparse Models
by: Xiao, Yang, et al.
Published: (2025)
by: Xiao, Yang, et al.
Published: (2025)
Benefits and Pitfalls of Reinforcement Learning for Language Model Planning: A Theoretical Perspective
by: Wang, Siwei, et al.
Published: (2025)
by: Wang, Siwei, et al.
Published: (2025)
LLM-Generated Samples for Android Malware Detection
by: Rollinson, Nik, et al.
Published: (2025)
by: Rollinson, Nik, et al.
Published: (2025)
On the Overlooked Pitfalls of Weight Decay and How to Mitigate Them: A Gradient-Norm Perspective
by: Xie, Zeke, et al.
Published: (2020)
by: Xie, Zeke, et al.
Published: (2020)
Rethinking The Uniformity Metric in Self-Supervised Learning
by: Fang, Xianghong, et al.
Published: (2024)
by: Fang, Xianghong, et al.
Published: (2024)
GCFL: A Gradient Correction-based Federated Learning Framework for Privacy-preserving CPSS
by: Wan, Jiayi, et al.
Published: (2025)
by: Wan, Jiayi, et al.
Published: (2025)
AI-CARE: Carbon-Aware Reporting Evaluation Metric for AI Models
by: Santosh, KC, et al.
Published: (2026)
by: Santosh, KC, et al.
Published: (2026)
Data Heterogeneity Modeling for Trustworthy Machine Learning
by: Liu, Jiashuo, et al.
Published: (2025)
by: Liu, Jiashuo, et al.
Published: (2025)
Similar Items
-
Evolving Machine Learning in Non-Stationary Environments: A Unified Survey of Drift, Forgetting, and Adaptation
by: Martin, Ignacio Cabrera, et al.
Published: (2025) -
Metric-DST: Mitigating Selection Bias Through Diversity-Guided Semi-Supervised Metric Learning
by: Tepeli, Yasin I., et al.
Published: (2024) -
Towards Principled Unsupervised Multi-Agent Reinforcement Learning
by: Zamboni, Riccardo, et al.
Published: (2025) -
Pitfalls in Evaluating Language Model Forecasters
by: Paleka, Daniel, et al.
Published: (2025) -
Utilizing Large Language Models for Machine Learning Explainability
by: Vassiliades, Alexandros, et al.
Published: (2025)