Interim Report on Human-Guided Adaptive Hyperparameter Optimization with Multi-Fidelity Sprints
Fuente:
arXiv
Salvato in:
| Autore principale: | Kamfonas, Michael |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ADOPT: Adaptive Dependency-Guided Joint Prompt Optimization for Multi-Step LLM Pipelines
di: Zhao, Minjun, et al.
Pubblicazione: (2025)
di: Zhao, Minjun, et al.
Pubblicazione: (2025)
Hyperparameter Loss Surfaces Are Simple Near their Optima
di: Lourie, Nicholas, et al.
Pubblicazione: (2025)
di: Lourie, Nicholas, et al.
Pubblicazione: (2025)
Optimizing Retrieval-Augmented Generation: Analysis of Hyperparameter Impact on Performance and Efficiency
di: Ammar, Adel, et al.
Pubblicazione: (2025)
di: Ammar, Adel, et al.
Pubblicazione: (2025)
Adaptive Multi-Expert Reasoning via Difficulty-Aware Routing and Uncertainty-Guided Aggregation
di: Ehab, Mohamed, et al.
Pubblicazione: (2026)
di: Ehab, Mohamed, et al.
Pubblicazione: (2026)
SimPER: A Minimalist Approach to Preference Alignment without Hyperparameters
di: Xiao, Teng, et al.
Pubblicazione: (2025)
di: Xiao, Teng, et al.
Pubblicazione: (2025)
Decoding Decoded: Understanding Hyperparameter Effects in Open-Ended Text Generation
di: Arias, Esteban Garces, et al.
Pubblicazione: (2024)
di: Arias, Esteban Garces, et al.
Pubblicazione: (2024)
Large Language Model Enhanced Particle Swarm Optimization for Hyperparameter Tuning for Deep Learning Models
di: Hameed, Saad, et al.
Pubblicazione: (2025)
di: Hameed, Saad, et al.
Pubblicazione: (2025)
Exploring Public Attention in the Circular Economy through Topic Modelling with Twin Hyperparameter Optimisation
di: Song, Junhao, et al.
Pubblicazione: (2024)
di: Song, Junhao, et al.
Pubblicazione: (2024)
Prompts as Auto-Optimized Training Hyperparameters: Training Best-in-Class IR Models from Scratch with 10 Gold Labels
di: Xian, Jasper, et al.
Pubblicazione: (2024)
di: Xian, Jasper, et al.
Pubblicazione: (2024)
CDS4RAG: Cyclic Dual-Sequential Hyperparameter Optimization for RAG
di: Chen, Pengzhou, et al.
Pubblicazione: (2026)
di: Chen, Pengzhou, et al.
Pubblicazione: (2026)
LLMSYS-HPOBench: Hyperparameter Optimization Benchmark Suite for Real-World LLM Systems
di: Wu, Siyu, et al.
Pubblicazione: (2026)
di: Wu, Siyu, et al.
Pubblicazione: (2026)
Adaptive Preference Optimization with Uncertainty-aware Utility Anchor
di: Wang, Xiaobo, et al.
Pubblicazione: (2025)
di: Wang, Xiaobo, et al.
Pubblicazione: (2025)
ExpThink: Experience-Guided Reinforcement Learning for Adaptive Chain-of-Thought Compression
di: Bian, Tingcheng, et al.
Pubblicazione: (2026)
di: Bian, Tingcheng, et al.
Pubblicazione: (2026)
Examining the Robustness of Homogeneity Bias to Hyperparameter Adjustments in GPT-4
di: Lee, Messi H. J.
Pubblicazione: (2025)
di: Lee, Messi H. J.
Pubblicazione: (2025)
Optimizing Language Models for Human Preferences is a Causal Inference Problem
di: Lin, Victoria, et al.
Pubblicazione: (2024)
di: Lin, Victoria, et al.
Pubblicazione: (2024)
AdaLomo: Low-memory Optimization with Adaptive Learning Rate
di: Lv, Kai, et al.
Pubblicazione: (2023)
di: Lv, Kai, et al.
Pubblicazione: (2023)
AE-LLM: Adaptive Efficiency Optimization for Large Language Models
di: Tanaka, Kaito, et al.
Pubblicazione: (2026)
di: Tanaka, Kaito, et al.
Pubblicazione: (2026)
AdaLRS: Loss-Guided Adaptive Learning Rate Search for Efficient Foundation Model Pretraining
di: Dong, Hongyuan, et al.
Pubblicazione: (2025)
di: Dong, Hongyuan, et al.
Pubblicazione: (2025)
Group-Adaptive Threshold Optimization for Robust AI-Generated Text Detection
di: Jung, Minseok, et al.
Pubblicazione: (2025)
di: Jung, Minseok, et al.
Pubblicazione: (2025)
Stay Tuned: An Empirical Study of the Impact of Hyperparameters on LLM Tuning in Real-World Applications
di: Halfon, Alon, et al.
Pubblicazione: (2024)
di: Halfon, Alon, et al.
Pubblicazione: (2024)
Gradient-Adaptive Policy Optimization: Towards Multi-Objective Alignment of Large Language Models
di: Li, Chengao, et al.
Pubblicazione: (2025)
di: Li, Chengao, et al.
Pubblicazione: (2025)
More Than One Teacher: Adaptive Multi-Guidance Policy Optimization for Diverse Exploration
di: Yuan, Xiaoyang, et al.
Pubblicazione: (2025)
di: Yuan, Xiaoyang, et al.
Pubblicazione: (2025)
Preference Optimization with Multi-Sample Comparisons
di: Wang, Chaoqi, et al.
Pubblicazione: (2024)
di: Wang, Chaoqi, et al.
Pubblicazione: (2024)
AdaJudge: Adaptive Multi-Perspective Judging for Reward Modeling
di: Miao, Yongliang, et al.
Pubblicazione: (2026)
di: Miao, Yongliang, et al.
Pubblicazione: (2026)
AdaDPO: Self-Adaptive Direct Preference Optimization with Balanced Gradient Updates
di: Chen, Shaolong, et al.
Pubblicazione: (2026)
di: Chen, Shaolong, et al.
Pubblicazione: (2026)
MAESTRO: Meta-learning Adaptive Estimation of Scalarization Trade-offs for Reward Optimization
di: Zhao, Yang, et al.
Pubblicazione: (2026)
di: Zhao, Yang, et al.
Pubblicazione: (2026)
SafePassage: High-Fidelity Information Extraction with Black Box LLMs
di: Barrow, Joe, et al.
Pubblicazione: (2025)
di: Barrow, Joe, et al.
Pubblicazione: (2025)
Soft Adaptive Policy Optimization
di: Gao, Chang, et al.
Pubblicazione: (2025)
di: Gao, Chang, et al.
Pubblicazione: (2025)
Adaptive Contrastive Search: Uncertainty-Guided Decoding for Open-Ended Text Generation
di: Arias, Esteban Garces, et al.
Pubblicazione: (2024)
di: Arias, Esteban Garces, et al.
Pubblicazione: (2024)
Efficient Second-Order Neural Network Optimization via Adaptive Trust Region Methods
di: Vo, James
Pubblicazione: (2024)
di: Vo, James
Pubblicazione: (2024)
Error Taxonomy-Guided Prompt Optimization
di: Singh, Mayank, et al.
Pubblicazione: (2026)
di: Singh, Mayank, et al.
Pubblicazione: (2026)
MoEMoE: Question Guided Dense and Scalable Sparse Mixture-of-Expert for Multi-source Multi-modal Answering
di: Verma, Vinay Kumar, et al.
Pubblicazione: (2025)
di: Verma, Vinay Kumar, et al.
Pubblicazione: (2025)
The Impact of Hyperparameters on Large Language Model Inference Performance: An Evaluation of vLLM and HuggingFace Pipelines
di: Martinez, Matias
Pubblicazione: (2024)
di: Martinez, Matias
Pubblicazione: (2024)
LASeR: Learning to Adaptively Select Reward Models with Multi-Armed Bandits
di: Nguyen, Duy, et al.
Pubblicazione: (2024)
di: Nguyen, Duy, et al.
Pubblicazione: (2024)
Direct Multi-Turn Preference Optimization for Language Agents
di: Shi, Wentao, et al.
Pubblicazione: (2024)
di: Shi, Wentao, et al.
Pubblicazione: (2024)
Multi-Reference Preference Optimization for Large Language Models
di: Le, Hung, et al.
Pubblicazione: (2024)
di: Le, Hung, et al.
Pubblicazione: (2024)
Multi-Response Preference Optimization with Augmented Ranking Dataset
di: Gwon, Hansle, et al.
Pubblicazione: (2024)
di: Gwon, Hansle, et al.
Pubblicazione: (2024)
Adaptive Feature-based Low-Rank Compression of Large Language Models via Bayesian Optimization
di: Ji, Yixin, et al.
Pubblicazione: (2024)
di: Ji, Yixin, et al.
Pubblicazione: (2024)
Adaptive Prompt Structure Factorization: A Framework for Self-Discovering and Optimizing Compositional Prompt Programs
di: Liu, Haoyue, et al.
Pubblicazione: (2026)
di: Liu, Haoyue, et al.
Pubblicazione: (2026)
LaMSUM: Amplifying Voices Against Harassment through LLM Guided Extractive Summarization of User Incident Reports
di: Chhikara, Garima, et al.
Pubblicazione: (2024)
di: Chhikara, Garima, et al.
Pubblicazione: (2024)
Documenti analoghi
-
ADOPT: Adaptive Dependency-Guided Joint Prompt Optimization for Multi-Step LLM Pipelines
di: Zhao, Minjun, et al.
Pubblicazione: (2025) -
Hyperparameter Loss Surfaces Are Simple Near their Optima
di: Lourie, Nicholas, et al.
Pubblicazione: (2025) -
Optimizing Retrieval-Augmented Generation: Analysis of Hyperparameter Impact on Performance and Efficiency
di: Ammar, Adel, et al.
Pubblicazione: (2025) -
Adaptive Multi-Expert Reasoning via Difficulty-Aware Routing and Uncertainty-Guided Aggregation
di: Ehab, Mohamed, et al.
Pubblicazione: (2026) -
SimPER: A Minimalist Approach to Preference Alignment without Hyperparameters
di: Xiao, Teng, et al.
Pubblicazione: (2025)