Combining Automated Optimisation of Hyperparameters and Reward Shape
Fuente:
arXiv
Salvato in:
| Autori principali: | Dierkes, Julian, Cramer, Emma, Hoos, Holger H., Trimpe, Sebastian |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Hyperparameter Optimisation with Practical Interpretability and Explanation Methods in Probabilistic Curriculum Learning
di: Salt, Llewyn, et al.
Pubblicazione: (2025)
di: Salt, Llewyn, et al.
Pubblicazione: (2025)
Automated Design of Linear Bounding Functions for Sigmoidal Nonlinearities in Neural Networks
di: König, Matthias, et al.
Pubblicazione: (2024)
di: König, Matthias, et al.
Pubblicazione: (2024)
Exploring the impact of Optimised Hyperparameters on Bi-LSTM-based Contextual Anomaly Detector
di: Toor, Aafan Ahmad, et al.
Pubblicazione: (2025)
di: Toor, Aafan Ahmad, et al.
Pubblicazione: (2025)
Rethinking Evaluation Paradigms in IBP-based Certified Training
di: Kaulen, Konstantin, et al.
Pubblicazione: (2026)
di: Kaulen, Konstantin, et al.
Pubblicazione: (2026)
ARLBench: Flexible and Efficient Benchmarking for Hyperparameter Optimization in Reinforcement Learning
di: Becktepe, Jannis, et al.
Pubblicazione: (2024)
di: Becktepe, Jannis, et al.
Pubblicazione: (2024)
CHEQ-ing the Box: Safe Variable Impedance Learning for Robotic Polishing
di: Cramer, Emma, et al.
Pubblicazione: (2025)
di: Cramer, Emma, et al.
Pubblicazione: (2025)
Bootstrapped Reward Shaping
di: Adamczyk, Jacob, et al.
Pubblicazione: (2025)
di: Adamczyk, Jacob, et al.
Pubblicazione: (2025)
Tracking Object Positions in Reinforcement Learning: A Metric for Keypoint Detection (extended version)
di: Cramer, Emma, et al.
Pubblicazione: (2023)
di: Cramer, Emma, et al.
Pubblicazione: (2023)
Local Entropy Search over Descent Sequences for Bayesian Optimization
di: Stenger, David, et al.
Pubblicazione: (2025)
di: Stenger, David, et al.
Pubblicazione: (2025)
Attention-Based Reward Shaping for Sparse and Delayed Rewards
di: Holmes, Ian, et al.
Pubblicazione: (2025)
di: Holmes, Ian, et al.
Pubblicazione: (2025)
Contextualized Hybrid Ensemble Q-learning: Learning Fast with Control Priors
di: Cramer, Emma, et al.
Pubblicazione: (2024)
di: Cramer, Emma, et al.
Pubblicazione: (2024)
Repairing Reward Functions with Feedback to Mitigate Reward Hacking
di: Hatgis-Kessell, Stephane, et al.
Pubblicazione: (2025)
di: Hatgis-Kessell, Stephane, et al.
Pubblicazione: (2025)
BAMDP Shaping: a Unified Framework for Intrinsic Motivation and Reward Shaping
di: Lidayan, Aly, et al.
Pubblicazione: (2024)
di: Lidayan, Aly, et al.
Pubblicazione: (2024)
Rapid Augmentations for Time Series (RATS): A High-Performance Library for Time Series Augmentation
di: Skaf, Wadie, et al.
Pubblicazione: (2026)
di: Skaf, Wadie, et al.
Pubblicazione: (2026)
Reward Shaping to Mitigate Reward Hacking in RLHF
di: Fu, Jiayi, et al.
Pubblicazione: (2025)
di: Fu, Jiayi, et al.
Pubblicazione: (2025)
Automatic Reward Shaping from Confounded Offline Data
di: Li, Mingxuan, et al.
Pubblicazione: (2025)
di: Li, Mingxuan, et al.
Pubblicazione: (2025)
TWIG: Towards pre-hoc Hyperparameter Optimisation and Cross-Graph Generalisation via Simulated KGE Models
di: Sardina, Jeffrey, et al.
Pubblicazione: (2024)
di: Sardina, Jeffrey, et al.
Pubblicazione: (2024)
From Reward Shaping to Q-Shaping: Achieving Unbiased Learning with LLM-Guided Knowledge
di: Wu, Xiefeng
Pubblicazione: (2024)
di: Wu, Xiefeng
Pubblicazione: (2024)
Highly Efficient Self-Adaptive Reward Shaping for Reinforcement Learning
di: Ma, Haozhe, et al.
Pubblicazione: (2024)
di: Ma, Haozhe, et al.
Pubblicazione: (2024)
Understanding the Mechanisms of Fast Hyperparameter Transfer
di: Ghosh, Nikhil, et al.
Pubblicazione: (2025)
di: Ghosh, Nikhil, et al.
Pubblicazione: (2025)
ORTHOBO: Orthogonal Bayesian Hyperparameter Optimization
di: Schröder, Maresa, et al.
Pubblicazione: (2026)
di: Schröder, Maresa, et al.
Pubblicazione: (2026)
Boosting LLM Reasoning via Human-Inspired Reward Shaping
di: Lin, Wenze, et al.
Pubblicazione: (2026)
di: Lin, Wenze, et al.
Pubblicazione: (2026)
Subgoal-based Reward Shaping to Improve Efficiency in Reinforcement Learning
di: Okudo, Takato, et al.
Pubblicazione: (2021)
di: Okudo, Takato, et al.
Pubblicazione: (2021)
Automatic Reward Shaping from Multi-Objective Human Heuristics
di: Xie, Yuqing, et al.
Pubblicazione: (2025)
di: Xie, Yuqing, et al.
Pubblicazione: (2025)
On the Sample Efficiency of Abstractions and Potential-Based Reward Shaping in Reinforcement Learning
di: Canonaco, Giuseppe, et al.
Pubblicazione: (2024)
di: Canonaco, Giuseppe, et al.
Pubblicazione: (2024)
Reward Shaping for Inference-Time Alignment: A Stackelberg Game Perspective
di: Wang, Haichuan, et al.
Pubblicazione: (2026)
di: Wang, Haichuan, et al.
Pubblicazione: (2026)
MAESTRO: Multi-Agent Environment Shaping through Task and Reward Optimization
di: Wu, Boyuan
Pubblicazione: (2025)
di: Wu, Boyuan
Pubblicazione: (2025)
Shaping Sparse Rewards in Reinforcement Learning: A Semi-supervised Approach
di: Li, Wenyun, et al.
Pubblicazione: (2025)
di: Li, Wenyun, et al.
Pubblicazione: (2025)
Calibrated Dataset Condensation for Faster Hyperparameter Search
di: Ding, Mucong, et al.
Pubblicazione: (2024)
di: Ding, Mucong, et al.
Pubblicazione: (2024)
Using Large Language Models for Hyperparameter Optimization
di: Zhang, Michael R., et al.
Pubblicazione: (2023)
di: Zhang, Michael R., et al.
Pubblicazione: (2023)
Hyperparameters in Score-Based Membership Inference Attacks
di: Pradhan, Gauri, et al.
Pubblicazione: (2025)
di: Pradhan, Gauri, et al.
Pubblicazione: (2025)
Hyperparameter Optimization via Interacting with Probabilistic Circuits
di: Seng, Jonas, et al.
Pubblicazione: (2025)
di: Seng, Jonas, et al.
Pubblicazione: (2025)
Sequential Policy Gradient for Adaptive Hyperparameter Optimization
di: Li, Zheng, et al.
Pubblicazione: (2025)
di: Li, Zheng, et al.
Pubblicazione: (2025)
Extracting Heuristics from Large Language Models for Reward Shaping in Reinforcement Learning
di: Bhambri, Siddhant, et al.
Pubblicazione: (2024)
di: Bhambri, Siddhant, et al.
Pubblicazione: (2024)
Enhancing Inverse Reinforcement Learning through Encoding Dynamic Information in Reward Shaping
di: Zhan, Simon Sinong, et al.
Pubblicazione: (2024)
di: Zhan, Simon Sinong, et al.
Pubblicazione: (2024)
Advantage Shaping as Surrogate Reward Maximization: Unifying Pass@K Policy Gradients
di: Thrampoulidis, Christos, et al.
Pubblicazione: (2025)
di: Thrampoulidis, Christos, et al.
Pubblicazione: (2025)
A Method for Evaluating Hyperparameter Sensitivity in Reinforcement Learning
di: Adkins, Jacob, et al.
Pubblicazione: (2024)
di: Adkins, Jacob, et al.
Pubblicazione: (2024)
Hyperparameter Importance Analysis for Multi-Objective AutoML
di: Theodorakopoulos, Daphne, et al.
Pubblicazione: (2024)
di: Theodorakopoulos, Daphne, et al.
Pubblicazione: (2024)
Hyperparameter Trajectory Inference with Conditional Lagrangian Optimal Transport
di: Amad, Harry, et al.
Pubblicazione: (2026)
di: Amad, Harry, et al.
Pubblicazione: (2026)
DISCOVER: Automated Curricula for Sparse-Reward Reinforcement Learning
di: Diaz-Bone, Leander, et al.
Pubblicazione: (2025)
di: Diaz-Bone, Leander, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Hyperparameter Optimisation with Practical Interpretability and Explanation Methods in Probabilistic Curriculum Learning
di: Salt, Llewyn, et al.
Pubblicazione: (2025) -
Automated Design of Linear Bounding Functions for Sigmoidal Nonlinearities in Neural Networks
di: König, Matthias, et al.
Pubblicazione: (2024) -
Exploring the impact of Optimised Hyperparameters on Bi-LSTM-based Contextual Anomaly Detector
di: Toor, Aafan Ahmad, et al.
Pubblicazione: (2025) -
Rethinking Evaluation Paradigms in IBP-based Certified Training
di: Kaulen, Konstantin, et al.
Pubblicazione: (2026) -
ARLBench: Flexible and Efficient Benchmarking for Hyperparameter Optimization in Reinforcement Learning
di: Becktepe, Jannis, et al.
Pubblicazione: (2024)