Salvato in:
| Autori principali: | Zhang, Michael R., Desai, Nishkrit, Bae, Juhan, Lorraine, Jonathan, Ba, Jimmy |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2312.04528 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
EMA Policy Gradient: Taming Reinforcement Learning for LLMs with EMA Anchor and Top-k KL
di: Zhang, Lunjun, et al.
Pubblicazione: (2026)
di: Zhang, Lunjun, et al.
Pubblicazione: (2026)
Report Cards: Qualitative Evaluation of Language Models Using Natural Language Summaries
di: Yang, Blair, et al.
Pubblicazione: (2024)
di: Yang, Blair, et al.
Pubblicazione: (2024)
Improving Hyperparameter Optimization with Checkpointed Model Weights
di: Mehta, Nikhil, et al.
Pubblicazione: (2024)
di: Mehta, Nikhil, et al.
Pubblicazione: (2024)
Mastering Diverse Domains through World Models
di: Hafner, Danijar, et al.
Pubblicazione: (2023)
di: Hafner, Danijar, et al.
Pubblicazione: (2023)
ORTHOBO: Orthogonal Bayesian Hyperparameter Optimization
di: Schröder, Maresa, et al.
Pubblicazione: (2026)
di: Schröder, Maresa, et al.
Pubblicazione: (2026)
Large Language Model Enhanced Particle Swarm Optimization for Hyperparameter Tuning for Deep Learning Models
di: Hameed, Saad, et al.
Pubblicazione: (2025)
di: Hameed, Saad, et al.
Pubblicazione: (2025)
Influence Functions for Scalable Data Attribution in Diffusion Models
di: Mlodozeniec, Bruno, et al.
Pubblicazione: (2024)
di: Mlodozeniec, Bruno, et al.
Pubblicazione: (2024)
STEVE-1: A Generative Model for Text-to-Behavior in Minecraft
di: Lifshitz, Shalev, et al.
Pubblicazione: (2023)
di: Lifshitz, Shalev, et al.
Pubblicazione: (2023)
Distributed Interpretability and Control for Large Language Models
di: Desai, Dev Arpan, et al.
Pubblicazione: (2026)
di: Desai, Dev Arpan, et al.
Pubblicazione: (2026)
Training Data Attribution via Approximate Unrolled Differentiation
di: Bae, Juhan, et al.
Pubblicazione: (2024)
di: Bae, Juhan, et al.
Pubblicazione: (2024)
Diversity-Aware Reverse Kullback-Leibler Divergence for Large Language Model Distillation
di: Luong, Hoang-Chau, et al.
Pubblicazione: (2026)
di: Luong, Hoang-Chau, et al.
Pubblicazione: (2026)
Hyperparameter Optimization via Interacting with Probabilistic Circuits
di: Seng, Jonas, et al.
Pubblicazione: (2025)
di: Seng, Jonas, et al.
Pubblicazione: (2025)
Sequential Policy Gradient for Adaptive Hyperparameter Optimization
di: Li, Zheng, et al.
Pubblicazione: (2025)
di: Li, Zheng, et al.
Pubblicazione: (2025)
A Unified Gaussian Process for Branching and Nested Hyperparameter Optimization
di: Zhang, Jiazhao, et al.
Pubblicazione: (2024)
di: Zhang, Jiazhao, et al.
Pubblicazione: (2024)
Data Descriptions from Large Language Models with Influence Estimation
di: Kim, Chaeri, et al.
Pubblicazione: (2025)
di: Kim, Chaeri, et al.
Pubblicazione: (2025)
Using Large Language Models for Parametric Shape Optimization
di: Zhang, Xinxin, et al.
Pubblicazione: (2024)
di: Zhang, Xinxin, et al.
Pubblicazione: (2024)
A Unified Hyperparameter Optimization Pipeline for Transformer-Based Time Series Forecasting Models
di: Xu, Jingjing, et al.
Pubblicazione: (2025)
di: Xu, Jingjing, et al.
Pubblicazione: (2025)
HyperSHAP: Shapley Values and Interactions for Explaining Hyperparameter Optimization
di: Wever, Marcel, et al.
Pubblicazione: (2025)
di: Wever, Marcel, et al.
Pubblicazione: (2025)
Frozen Layers: Memory-efficient Many-fidelity Hyperparameter Optimization
di: Carstensen, Timur, et al.
Pubblicazione: (2025)
di: Carstensen, Timur, et al.
Pubblicazione: (2025)
Scalable Hyperparameter-Divergent Ensemble Training with Automatic Learning Rate Exploration for Large Models
di: Cheng, Hailing, et al.
Pubblicazione: (2026)
di: Cheng, Hailing, et al.
Pubblicazione: (2026)
Bayesian Optimization for Hyperparameters Tuning in Neural Networks
di: Onorato, Gabriele
Pubblicazione: (2024)
di: Onorato, Gabriele
Pubblicazione: (2024)
Interactive Hyperparameter Optimization in Multi-Objective Problems via Preference Learning
di: Giovanelli, Joseph, et al.
Pubblicazione: (2023)
di: Giovanelli, Joseph, et al.
Pubblicazione: (2023)
A Method for Evaluating Hyperparameter Sensitivity in Reinforcement Learning
di: Adkins, Jacob, et al.
Pubblicazione: (2024)
di: Adkins, Jacob, et al.
Pubblicazione: (2024)
ULTHO: Ultra-Lightweight yet Efficient Hyperparameter Optimization in Deep Reinforcement Learning
di: Yuan, Mingqi, et al.
Pubblicazione: (2025)
di: Yuan, Mingqi, et al.
Pubblicazione: (2025)
Default Machine Learning Hyperparameters Do Not Provide Informative Initialization for Bayesian Optimization
di: Prieto, Nicolás Villagrán, et al.
Pubblicazione: (2026)
di: Prieto, Nicolás Villagrán, et al.
Pubblicazione: (2026)
Self-Tuning Sparse Attention: Multi-Fidelity Hyperparameter Optimization for Transformer Acceleration
di: Dev, Arundhathi, et al.
Pubblicazione: (2026)
di: Dev, Arundhathi, et al.
Pubblicazione: (2026)
Hyperparameter Optimization for Driving Strategies Based on Reinforcement Learning
di: Adde, Nihal Acharya, et al.
Pubblicazione: (2024)
di: Adde, Nihal Acharya, et al.
Pubblicazione: (2024)
MedChat: A Multi-Agent Framework for Multimodal Diagnosis with Large Language Models
di: Liu, Philip R., et al.
Pubblicazione: (2025)
di: Liu, Philip R., et al.
Pubblicazione: (2025)
Cross-Entropy Optimization for Hyperparameter Optimization in Stochastic Gradient-based Approaches to Train Deep Neural Networks
di: Li, Kevin, et al.
Pubblicazione: (2024)
di: Li, Kevin, et al.
Pubblicazione: (2024)
FAS: Fast ANN-SNN Conversion for Spiking Large Language Models
di: Chen, Long, et al.
Pubblicazione: (2025)
di: Chen, Long, et al.
Pubblicazione: (2025)
Generating Reliable Synthetic Clinical Trial Data: The Role of Hyperparameter Optimization and Domain Constraints
di: Hahn, Waldemar, et al.
Pubblicazione: (2025)
di: Hahn, Waldemar, et al.
Pubblicazione: (2025)
c-TPE: Tree-structured Parzen Estimator with Inequality Constraints for Expensive Hyperparameter Optimization
di: Watanabe, Shuhei, et al.
Pubblicazione: (2022)
di: Watanabe, Shuhei, et al.
Pubblicazione: (2022)
Efficient Bilevel Optimization for Meta Label Correction in Noisy Label Learning
di: Nguyen, Ba Hoang Anh, et al.
Pubblicazione: (2026)
di: Nguyen, Ba Hoang Anh, et al.
Pubblicazione: (2026)
AfroBench: How Good are Large Language Models on African Languages?
di: Ojo, Jessica, et al.
Pubblicazione: (2023)
di: Ojo, Jessica, et al.
Pubblicazione: (2023)
Understanding the Mechanisms of Fast Hyperparameter Transfer
di: Ghosh, Nikhil, et al.
Pubblicazione: (2025)
di: Ghosh, Nikhil, et al.
Pubblicazione: (2025)
Graph Metanetworks for Processing Diverse Neural Architectures
di: Lim, Derek, et al.
Pubblicazione: (2023)
di: Lim, Derek, et al.
Pubblicazione: (2023)
Adaptive Elicitation of Latent Information Using Natural Language
di: Wang, Jimmy, et al.
Pubblicazione: (2025)
di: Wang, Jimmy, et al.
Pubblicazione: (2025)
Clustering Inductive Biases with Unrolled Networks
di: Huml, Jonathan, et al.
Pubblicazione: (2023)
di: Huml, Jonathan, et al.
Pubblicazione: (2023)
Semantic-aware Wasserstein Policy Regularization for Large Language Model Alignment
di: Na, Byeonghu, et al.
Pubblicazione: (2026)
di: Na, Byeonghu, et al.
Pubblicazione: (2026)
Large Language Model Compression with Global Rank and Sparsity Optimization
di: Zhou, Changhai, et al.
Pubblicazione: (2025)
di: Zhou, Changhai, et al.
Pubblicazione: (2025)
Documenti analoghi
-
EMA Policy Gradient: Taming Reinforcement Learning for LLMs with EMA Anchor and Top-k KL
di: Zhang, Lunjun, et al.
Pubblicazione: (2026) -
Report Cards: Qualitative Evaluation of Language Models Using Natural Language Summaries
di: Yang, Blair, et al.
Pubblicazione: (2024) -
Improving Hyperparameter Optimization with Checkpointed Model Weights
di: Mehta, Nikhil, et al.
Pubblicazione: (2024) -
Mastering Diverse Domains through World Models
di: Hafner, Danijar, et al.
Pubblicazione: (2023) -
ORTHOBO: Orthogonal Bayesian Hyperparameter Optimization
di: Schröder, Maresa, et al.
Pubblicazione: (2026)