Relax and penalize: a new bilevel approach to mixed-binary hyperparameter optimization
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Venturini, Sara, de Santis, Marianna, Patracone, Jordan, Rinaldi, Francesco, Salzo, Saverio, Schmidt, Martin |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Iteration Complexity of Frank-Wolfe and Its Variants for Bilevel Optimization
par: Palmieri, Anthony, et autres
Publié: (2026)
par: Palmieri, Anthony, et autres
Publié: (2026)
An adaptively inexact first-order method for bilevel optimization with application to hyperparameter learning
par: Salehi, Mohammad Sadegh, et autres
Publié: (2023)
par: Salehi, Mohammad Sadegh, et autres
Publié: (2023)
Convergence Properties of Stochastic Hypergradients
par: Grazzi, Riccardo, et autres
Publié: (2020)
par: Grazzi, Riccardo, et autres
Publié: (2020)
AdaGrad-Diff: A New Version of the Adaptive Gradient Algorithm
par: Bojovic, Matia, et autres
Publié: (2026)
par: Bojovic, Matia, et autres
Publié: (2026)
Nonsmooth Implicit Differentiation: Deterministic and Stochastic Convergence Rates
par: Grazzi, Riccardo, et autres
Publié: (2024)
par: Grazzi, Riccardo, et autres
Publié: (2024)
Conformal Online Learning of Deep Koopman Linear Embeddings
par: Gao, Ben, et autres
Publié: (2025)
par: Gao, Ben, et autres
Publié: (2025)
Variance reduction techniques for stochastic proximal point algorithms
par: Traoré, Cheik, et autres
Publié: (2023)
par: Traoré, Cheik, et autres
Publié: (2023)
Be aware of overfitting by hyperparameter optimization!
par: Tetko, Igor V., et autres
Publié: (2024)
par: Tetko, Igor V., et autres
Publié: (2024)
The iterates of FISTA convergence even under inexact computations and stochastic gradients
par: Salzo, Saverio
Publié: (2025)
par: Salzo, Saverio
Publié: (2025)
High Probability Bounds for Stochastic Subgradient Schemes with Heavy Tailed Noise
par: Parletta, Daniela A., et autres
Publié: (2022)
par: Parletta, Daniela A., et autres
Publié: (2022)
A Hessian-informed hyperparameter optimization for differential learning rate
par: Xu, Shiyun, et autres
Publié: (2025)
par: Xu, Shiyun, et autres
Publié: (2025)
Two-step hyperparameter optimization method: Accelerating hyperparameter search by using a fraction of a training dataset
par: Yu, Sungduk, et autres
Publié: (2023)
par: Yu, Sungduk, et autres
Publié: (2023)
Fuzzy hyperparameters update in a second order optimization
par: Bensadok, Abdelaziz, et autres
Publié: (2024)
par: Bensadok, Abdelaziz, et autres
Publié: (2024)
Beyond algorithm hyperparameters: on preprocessing hyperparameters and associated pitfalls in machine learning applications
par: Sauer, Christina, et autres
Publié: (2024)
par: Sauer, Christina, et autres
Publié: (2024)
Bayesian autoregression to optimize temporal Matérn kernel Gaussian process hyperparameters
par: Kouw, Wouter M.
Publié: (2025)
par: Kouw, Wouter M.
Publié: (2025)
A two-step sequential approach for hyperparameter selection in finite context models
par: Contente, José, et autres
Publié: (2026)
par: Contente, José, et autres
Publié: (2026)
Towards hyperparameter-free optimization with differential privacy
par: Bu, Zhiqi, et autres
Publié: (2025)
par: Bu, Zhiqi, et autres
Publié: (2025)
Application-oriented automatic hyperparameter optimization for spiking neural network prototyping
par: Fra, Vittorio
Publié: (2025)
par: Fra, Vittorio
Publié: (2025)
A framework for bilevel optimization that enables stochastic and global variance reduction algorithms
par: Dagréou, Mathieu, et autres
Publié: (2022)
par: Dagréou, Mathieu, et autres
Publié: (2022)
An algorithmic framework for the optimization of deep neural networks architectures and hyperparameters
par: Keisler, Julie, et autres
Publié: (2023)
par: Keisler, Julie, et autres
Publié: (2023)
Regularized boosting with an increasing coefficient magnitude stop criterion as meta-learner in hyperparameter optimization stacking ensemble
par: Fdez-Díaz, Laura, et autres
Publié: (2024)
par: Fdez-Díaz, Laura, et autres
Publié: (2024)
An experimental comparative study of backpropagation and alternatives for training binary neural networks for image classification
par: Crulis, Ben, et autres
Publié: (2024)
par: Crulis, Ben, et autres
Publié: (2024)
LancBiO: dynamic Lanczos-aided bilevel optimization via Krylov subspace
par: Yang, Yan, et autres
Publié: (2024)
par: Yang, Yan, et autres
Publié: (2024)
Bilevel optimization for learning hyperparameters: Application to solving PDEs and inverse problems with Gaussian processes
par: Nelsen, Nicholas H., et autres
Publié: (2025)
par: Nelsen, Nicholas H., et autres
Publié: (2025)
Decision-focused predictions via pessimistic bilevel optimization: complexity and algorithms
par: Bucarey, Víctor, et autres
Publié: (2023)
par: Bucarey, Víctor, et autres
Publié: (2023)
Deep learning from strongly mixing observations: Sparse-penalized regularization and minimax optimality
par: Kengne, William, et autres
Publié: (2024)
par: Kengne, William, et autres
Publié: (2024)
Effect of hyperparameters on variable selection in random forests
par: Fouodo, Cesaire J. K., et autres
Publié: (2023)
par: Fouodo, Cesaire J. K., et autres
Publié: (2023)
Offline-to-online hyperparameter transfer for stochastic bandits
par: Sharma, Dravyansh, et autres
Publié: (2025)
par: Sharma, Dravyansh, et autres
Publié: (2025)
Calibrating dimension reduction hyperparameters in the presence of noise
par: Lin, Justin, et autres
Publié: (2023)
par: Lin, Justin, et autres
Publié: (2023)
Selecting time-series hyperparameters with the artificial jackknife
par: Pellegrino, Filippo
Publié: (2020)
par: Pellegrino, Filippo
Publié: (2020)
Classification under strategic adversary manipulation using pessimistic bilevel optimisation
par: Benfield, David, et autres
Publié: (2024)
par: Benfield, David, et autres
Publié: (2024)
Solving bilevel optimization via sequential minimax optimization
par: Lu, Zhaosong, et autres
Publié: (2025)
par: Lu, Zhaosong, et autres
Publié: (2025)
How far away are truly hyperparameter-free learning algorithms?
par: Kasimbeg, Priya, et autres
Publié: (2025)
par: Kasimbeg, Priya, et autres
Publié: (2025)
Relaxed Gaussian process interpolation: a goal-oriented approach to Bayesian optimization
par: Petit, Sébastien, et autres
Publié: (2022)
par: Petit, Sébastien, et autres
Publié: (2022)
Relaxation methods for pessimistic bilevel optimization
par: Benchouk, Imane, et autres
Publié: (2024)
par: Benchouk, Imane, et autres
Publié: (2024)
Better Trees: An empirical study on hyperparameter tuning of classification decision tree induction algorithms
par: Mantovani, Rafael Gomes, et autres
Publié: (2018)
par: Mantovani, Rafael Gomes, et autres
Publié: (2018)
First-order penalty methods for bilevel optimization
par: Lu, Zhaosong, et autres
Publié: (2023)
par: Lu, Zhaosong, et autres
Publié: (2023)
Auto Researching, not hyperparameter tuning: Convergence Analysis of 10,000 Experiments
par: Li, Xiaoyi
Publié: (2026)
par: Li, Xiaoyi
Publié: (2026)
$μ$pscaling small models: Principled warm starts and hyperparameter transfer
par: Ma, Yuxin, et autres
Publié: (2026)
par: Ma, Yuxin, et autres
Publié: (2026)
Time-optimal neural feedback control of nilpotent systems as a binary classification problem
par: Bicego, Sara, et autres
Publié: (2025)
par: Bicego, Sara, et autres
Publié: (2025)
Documents similaires
-
Iteration Complexity of Frank-Wolfe and Its Variants for Bilevel Optimization
par: Palmieri, Anthony, et autres
Publié: (2026) -
An adaptively inexact first-order method for bilevel optimization with application to hyperparameter learning
par: Salehi, Mohammad Sadegh, et autres
Publié: (2023) -
Convergence Properties of Stochastic Hypergradients
par: Grazzi, Riccardo, et autres
Publié: (2020) -
AdaGrad-Diff: A New Version of the Adaptive Gradient Algorithm
par: Bojovic, Matia, et autres
Publié: (2026) -
Nonsmooth Implicit Differentiation: Deterministic and Stochastic Convergence Rates
par: Grazzi, Riccardo, et autres
Publié: (2024)