Sample complexity of data-driven tuning of model hyperparameters in neural networks with structured parameter-dependent dual function
Fuente:
arXiv
Salvato in:
| Autori principali: | Balcan, Maria-Florina, Nguyen, Anh Tuan, Sharma, Dravyansh |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Algorithm Configuration for Structured Pfaffian Settings
di: Balcan, Maria-Florina, et al.
Pubblicazione: (2024)
di: Balcan, Maria-Florina, et al.
Pubblicazione: (2024)
Learning accurate and interpretable tree-based models
di: Balcan, Maria-Florina, et al.
Pubblicazione: (2024)
di: Balcan, Maria-Florina, et al.
Pubblicazione: (2024)
Accelerating ERM for data-driven algorithm design using output-sensitive techniques
di: Balcan, Maria-Florina, et al.
Pubblicazione: (2022)
di: Balcan, Maria-Florina, et al.
Pubblicazione: (2022)
Distribution-dependent Generalization Bounds for Tuning Linear Regression Across Tasks
di: Balcan, Maria-Florina, et al.
Pubblicazione: (2025)
di: Balcan, Maria-Florina, et al.
Pubblicazione: (2025)
Provably tuning the ElasticNet across instances
di: Balcan, Maria-Florina, et al.
Pubblicazione: (2022)
di: Balcan, Maria-Florina, et al.
Pubblicazione: (2022)
Subsidy design for better social outcomes
di: Balcan, Maria-Florina, et al.
Pubblicazione: (2024)
di: Balcan, Maria-Florina, et al.
Pubblicazione: (2024)
On Learning Verifiers and Implications to Chain-of-Thought Reasoning
di: Balcan, Maria-Florina, et al.
Pubblicazione: (2025)
di: Balcan, Maria-Florina, et al.
Pubblicazione: (2025)
Online Learnability of Chain-of-Thought Verifiers: Soundness and Completeness Trade-offs
di: Balcan, Maria-Florina, et al.
Pubblicazione: (2026)
di: Balcan, Maria-Florina, et al.
Pubblicazione: (2026)
Offline-to-online hyperparameter transfer for stochastic bandits
di: Sharma, Dravyansh, et al.
Pubblicazione: (2025)
di: Sharma, Dravyansh, et al.
Pubblicazione: (2025)
The Active and Noise-Tolerant Strategic Perceptron
di: Balcan, Maria-Florina, et al.
Pubblicazione: (2025)
di: Balcan, Maria-Florina, et al.
Pubblicazione: (2025)
New Guarantees for Learning Revenue Maximizing Menus of Lotteries and Two-Part Tariffs
di: Balcan, Maria-Florina, et al.
Pubblicazione: (2023)
di: Balcan, Maria-Florina, et al.
Pubblicazione: (2023)
Gradient Descent with Provably Tuned Learning-rate Schedules
di: Sharma, Dravyansh
Pubblicazione: (2025)
di: Sharma, Dravyansh
Pubblicazione: (2025)
Provably data-driven projection method for quadratic programming
di: Nguyen, Anh Tuan, et al.
Pubblicazione: (2025)
di: Nguyen, Anh Tuan, et al.
Pubblicazione: (2025)
Provably Data-driven Multiple Hyper-parameter Tuning with Structured Loss Function
di: Le, Tung Quoc, et al.
Pubblicazione: (2026)
di: Le, Tung Quoc, et al.
Pubblicazione: (2026)
What Does Preference Learning Recover from Pairwise Comparison Data?
di: Pukdee, Rattana, et al.
Pubblicazione: (2026)
di: Pukdee, Rattana, et al.
Pubblicazione: (2026)
Reward Learning from Best-of-$N$ Preference Data: Targets, Tradeoffs, and Design Principles
di: Pukdee, Rattana, et al.
Pubblicazione: (2026)
di: Pukdee, Rattana, et al.
Pubblicazione: (2026)
Learning in Structured Stackelberg Games
di: Balcan, Maria-Florina, et al.
Pubblicazione: (2025)
di: Balcan, Maria-Florina, et al.
Pubblicazione: (2025)
Training neural networks faster with minimal tuning using pre-computed lists of hyperparameters for NAdamW
di: Medapati, Sourabh, et al.
Pubblicazione: (2025)
di: Medapati, Sourabh, et al.
Pubblicazione: (2025)
Regret Minimization in Stackelberg Games with Side Information
di: Harris, Keegan, et al.
Pubblicazione: (2024)
di: Harris, Keegan, et al.
Pubblicazione: (2024)
Provably Data-driven Lagrangian Relaxation for Mixed Integer Linear Programming
di: Le, Tung Quoc, et al.
Pubblicazione: (2026)
di: Le, Tung Quoc, et al.
Pubblicazione: (2026)
SGD method for entropy error function with smoothing l0 regularization for neural networks
di: Nguyen, Trong-Tuan, et al.
Pubblicazione: (2024)
di: Nguyen, Trong-Tuan, et al.
Pubblicazione: (2024)
Multilevel Picard approximations and deep neural networks with ReLU, leaky ReLU, and softplus activation overcome the curse of dimensionality when approximating semilinear parabolic partial differential equations in $L^p$-sense
di: Neufeld, Ariel, et al.
Pubblicazione: (2024)
di: Neufeld, Ariel, et al.
Pubblicazione: (2024)
Learning to Relax: Setting Solver Parameters Across a Sequence of Linear System Instances
di: Khodak, Mikhail, et al.
Pubblicazione: (2023)
di: Khodak, Mikhail, et al.
Pubblicazione: (2023)
Spectrally Transformed Kernel Regression
di: Zhai, Runtian, et al.
Pubblicazione: (2024)
di: Zhai, Runtian, et al.
Pubblicazione: (2024)
Application-oriented automatic hyperparameter optimization for spiking neural network prototyping
di: Fra, Vittorio
Pubblicazione: (2025)
di: Fra, Vittorio
Pubblicazione: (2025)
An algorithmic framework for the optimization of deep neural networks architectures and hyperparameters
di: Keisler, Julie, et al.
Pubblicazione: (2023)
di: Keisler, Julie, et al.
Pubblicazione: (2023)
VPI-Mlogs: A web-based machine learning solution for applications in petrophysics
di: Nguyen, Anh Tuan
Pubblicazione: (2024)
di: Nguyen, Anh Tuan
Pubblicazione: (2024)
Conservative classifiers do consistently well with improving agents: characterizing statistical and online learning
di: Sharma, Dravyansh, et al.
Pubblicazione: (2025)
di: Sharma, Dravyansh, et al.
Pubblicazione: (2025)
Tuning Algorithmic and Architectural Hyperparameters in Graph-Based Semi-Supervised Learning with Provable Guarantees
di: Du, Ally Yalei, et al.
Pubblicazione: (2025)
di: Du, Ally Yalei, et al.
Pubblicazione: (2025)
Neural Velocity for hyperparameter tuning
di: Dalmasso, Gianluca, et al.
Pubblicazione: (2025)
di: Dalmasso, Gianluca, et al.
Pubblicazione: (2025)
Auto Researching, not hyperparameter tuning: Convergence Analysis of 10,000 Experiments
di: Li, Xiaoyi
Pubblicazione: (2026)
di: Li, Xiaoyi
Pubblicazione: (2026)
Better Trees: An empirical study on hyperparameter tuning of classification decision tree induction algorithms
di: Mantovani, Rafael Gomes, et al.
Pubblicazione: (2018)
di: Mantovani, Rafael Gomes, et al.
Pubblicazione: (2018)
Algorithm Design and Stronger Guarantees for the Improving Multi-Armed Bandits Problem
di: Blum, Avrim, et al.
Pubblicazione: (2025)
di: Blum, Avrim, et al.
Pubblicazione: (2025)
Statistical tuning of artificial neural network
di: Mohamad, Mohamad Yamen AL, et al.
Pubblicazione: (2024)
di: Mohamad, Mohamad Yamen AL, et al.
Pubblicazione: (2024)
Compute the edge p-Laplacian centrality for air traffic network
di: Tran, Loc Hoang, et al.
Pubblicazione: (2025)
di: Tran, Loc Hoang, et al.
Pubblicazione: (2025)
Optimization on black-box function by parameter-shift rule
di: Hai, Vu Tuan
Pubblicazione: (2025)
di: Hai, Vu Tuan
Pubblicazione: (2025)
Nearly-Optimal Bandit Learning in Stackelberg Games with Side Information
di: Balcan, Maria-Florina, et al.
Pubblicazione: (2025)
di: Balcan, Maria-Florina, et al.
Pubblicazione: (2025)
Beyond algorithm hyperparameters: on preprocessing hyperparameters and associated pitfalls in machine learning applications
di: Sauer, Christina, et al.
Pubblicazione: (2024)
di: Sauer, Christina, et al.
Pubblicazione: (2024)
BayesFlow: Learning complex stochastic models with invertible neural networks
di: Radev, Stefan T., et al.
Pubblicazione: (2020)
di: Radev, Stefan T., et al.
Pubblicazione: (2020)
DPG loss functions for learning parameter-to-solution maps by neural networks
di: Castillo, Pablo Cortés, et al.
Pubblicazione: (2025)
di: Castillo, Pablo Cortés, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Algorithm Configuration for Structured Pfaffian Settings
di: Balcan, Maria-Florina, et al.
Pubblicazione: (2024) -
Learning accurate and interpretable tree-based models
di: Balcan, Maria-Florina, et al.
Pubblicazione: (2024) -
Accelerating ERM for data-driven algorithm design using output-sensitive techniques
di: Balcan, Maria-Florina, et al.
Pubblicazione: (2022) -
Distribution-dependent Generalization Bounds for Tuning Linear Regression Across Tasks
di: Balcan, Maria-Florina, et al.
Pubblicazione: (2025) -
Provably tuning the ElasticNet across instances
di: Balcan, Maria-Florina, et al.
Pubblicazione: (2022)