Tune My Adam, Please!
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Athanasiadis, Theodoros, Adriaensen, Steven, Müller, Samuel, Hutter, Frank |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Gompertz Linear Units: Leveraging Asymmetry for Enhanced Learning Dynamics
par: Das, Indrashis, et autres
Publié: (2025)
par: Das, Indrashis, et autres
Publié: (2025)
In-Context Freeze-Thaw Bayesian Optimization for Hyperparameter Optimization
par: Rakotoarison, Herilalaina, et autres
Publié: (2024)
par: Rakotoarison, Herilalaina, et autres
Publié: (2024)
Bayes' Power for Explaining In-Context Learning Generalizations
par: Müller, Samuel, et autres
Publié: (2024)
par: Müller, Samuel, et autres
Publié: (2024)
From Tables to Time: Extending TabPFN-v2 to Time Series Forecasting
par: Hoo, Shi Bin, et autres
Publié: (2025)
par: Hoo, Shi Bin, et autres
Publié: (2025)
Causal Data Augmentation for Robust Fine-Tuning of Tabular Foundation Models
par: Bühler, Magnus, et autres
Publié: (2026)
par: Bühler, Magnus, et autres
Publié: (2026)
Transformers Can Do Bayesian Inference
par: Müller, Samuel, et autres
Publié: (2021)
par: Müller, Samuel, et autres
Publié: (2021)
Bayesian Neural Scaling Law Extrapolation with Prior-Data Fitted Networks
par: Lee, Dongwoo, et autres
Publié: (2025)
par: Lee, Dongwoo, et autres
Publié: (2025)
FairPFN: A Tabular Foundation Model for Causal Fairness
par: Robertson, Jake, et autres
Publié: (2025)
par: Robertson, Jake, et autres
Publié: (2025)
Position: The Future of Bayesian Prediction Is Prior-Fitted
par: Müller, Samuel, et autres
Publié: (2025)
par: Müller, Samuel, et autres
Publié: (2025)
Extracting Moore Machines from Transformers using Queries and Counterexamples
par: Adriaensen, Rik, et autres
Publié: (2024)
par: Adriaensen, Rik, et autres
Publié: (2024)
Tuning LLM Judge Design Decisions for 1/1000 of the Cost
par: Salinas, David, et autres
Publié: (2025)
par: Salinas, David, et autres
Publié: (2025)
Cost-Sensitive Freeze-thaw Bayesian Optimization for Efficient Hyperparameter Tuning
par: Lee, Dong Bok, et autres
Publié: (2025)
par: Lee, Dong Bok, et autres
Publié: (2025)
Quick-Tune: Quickly Learning Which Pretrained Model to Finetune and How
par: Arango, Sebastian Pineda, et autres
Publié: (2023)
par: Arango, Sebastian Pineda, et autres
Publié: (2023)
Quickly Tuning Foundation Models for Image Segmentation
par: Das, Breenda, et autres
Publié: (2025)
par: Das, Breenda, et autres
Publié: (2025)
Drift-Resilient TabPFN: In-Context Learning Temporal Distribution Shifts on Tabular Data
par: Helli, Kai, et autres
Publié: (2024)
par: Helli, Kai, et autres
Publié: (2024)
Model Stitching by Functional Latent Alignment
par: Athanasiadis, Ioannis, et autres
Publié: (2025)
par: Athanasiadis, Ioannis, et autres
Publié: (2025)
Prior Learning in Introspective VAEs
par: Athanasiadis, Ioannis, et autres
Publié: (2024)
par: Athanasiadis, Ioannis, et autres
Publié: (2024)
Can Muon Fine-tune Adam-Pretrained Models?
par: Qu, Xingyu, et autres
Publié: (2026)
par: Qu, Xingyu, et autres
Publié: (2026)
Real-TabPFN: Improving Tabular Foundation Models via Continued Pre-training With Real-World Data
par: Garg, Anurag, et autres
Publié: (2025)
par: Garg, Anurag, et autres
Publié: (2025)
Hybrid Phenology Modeling for Predicting Temperature Effects on Tree Dormancy
par: van Bree, Ron, et autres
Publié: (2025)
par: van Bree, Ron, et autres
Publié: (2025)
c-TPE: Tree-structured Parzen Estimator with Inequality Constraints for Expensive Hyperparameter Optimization
par: Watanabe, Shuhei, et autres
Publié: (2022)
par: Watanabe, Shuhei, et autres
Publié: (2022)
A Few Moments Please: Scalable Graphon Learning via Moment Matching
par: Ramezanpour, Reza, et autres
Publié: (2025)
par: Ramezanpour, Reza, et autres
Publié: (2025)
TuneTables: Context Optimization for Scalable Prior-Data Fitted Networks
par: Feuer, Benjamin, et autres
Publié: (2024)
par: Feuer, Benjamin, et autres
Publié: (2024)
Early Stopping Tabular In-Context Learning
par: Küken, Jaris, et autres
Publié: (2025)
par: Küken, Jaris, et autres
Publié: (2025)
A General Framework for User-Guided Bayesian Optimization
par: Hvarfner, Carl, et autres
Publié: (2023)
par: Hvarfner, Carl, et autres
Publié: (2023)
Pimp My LLM: Leveraging Variability Modeling to Tune Inference Hyperparameters
par: Zine, Nada, et autres
Publié: (2026)
par: Zine, Nada, et autres
Publié: (2026)
DP-Adam-AC: Privacy-preserving Fine-Tuning of Localizable Language Models Using Adam Optimization with Adaptive Clipping
par: Yang, Ruoxing
Publié: (2025)
par: Yang, Ruoxing
Publié: (2025)
To Measure or Not: A Cost-Sensitive, Selective Measuring Environment for Agricultural Management Decisions with Reinforcement Learning
par: Baja, Hilmy, et autres
Publié: (2025)
par: Baja, Hilmy, et autres
Publié: (2025)
CaAdam: Improving Adam optimizer using connection aware methods
par: Genet, Remi, et autres
Publié: (2024)
par: Genet, Remi, et autres
Publié: (2024)
EquiTabPFN: A Target-Permutation Equivariant Prior Fitted Networks
par: Arbel, Michael, et autres
Publié: (2025)
par: Arbel, Michael, et autres
Publié: (2025)
Agentic NL2SQL to Reduce Computational Costs
par: Jehle, Dominik, et autres
Publié: (2025)
par: Jehle, Dominik, et autres
Publié: (2025)
Efficient Search for Customized Activation Functions with Gradient Descent
par: Strack, Lukas, et autres
Publié: (2024)
par: Strack, Lukas, et autres
Publié: (2024)
Large Language Models Engineer Too Many Simple Features For Tabular Data
par: Küken, Jaris, et autres
Publié: (2024)
par: Küken, Jaris, et autres
Publié: (2024)
Don't Waste Your Time: Early Stopping Cross-Validation
par: Bergman, Edward, et autres
Publié: (2024)
par: Bergman, Edward, et autres
Publié: (2024)
How Usable is Automated Feature Engineering for Tabular Data?
par: Schäfer, Bastian, et autres
Publié: (2025)
par: Schäfer, Bastian, et autres
Publié: (2025)
nanoTabPFN: A Lightweight and Educational Reimplementation of TabPFN
par: Pfefferle, Alexander, et autres
Publié: (2025)
par: Pfefferle, Alexander, et autres
Publié: (2025)
Self-Correcting Bayesian Optimization through Bayesian Active Learning
par: Hvarfner, Carl, et autres
Publié: (2023)
par: Hvarfner, Carl, et autres
Publié: (2023)
A Human-in-the-Loop Fairness-Aware Model Selection Framework for Complex Fairness Objective Landscapes
par: Robertson, Jake, et autres
Publié: (2024)
par: Robertson, Jake, et autres
Publié: (2024)
HomeAdam: Adam and AdamW Algorithms Sometimes Go Home to Obtain Better Provable Generalization
par: Huang, Feihu, et autres
Publié: (2026)
par: Huang, Feihu, et autres
Publié: (2026)
In Search of Adam's Secret Sauce
par: Orvieto, Antonio, et autres
Publié: (2025)
par: Orvieto, Antonio, et autres
Publié: (2025)
Documents similaires
-
Gompertz Linear Units: Leveraging Asymmetry for Enhanced Learning Dynamics
par: Das, Indrashis, et autres
Publié: (2025) -
In-Context Freeze-Thaw Bayesian Optimization for Hyperparameter Optimization
par: Rakotoarison, Herilalaina, et autres
Publié: (2024) -
Bayes' Power for Explaining In-Context Learning Generalizations
par: Müller, Samuel, et autres
Publié: (2024) -
From Tables to Time: Extending TabPFN-v2 to Time Series Forecasting
par: Hoo, Shi Bin, et autres
Publié: (2025) -
Causal Data Augmentation for Robust Fine-Tuning of Tabular Foundation Models
par: Bühler, Magnus, et autres
Publié: (2026)