Contextualized Hybrid Ensemble Q-learning: Learning Fast with Control Priors
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Cramer, Emma, Frauenknecht, Bernd, Sabirov, Ramil, Trimpe, Sebastian |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
On Rollouts in Model-Based Reinforcement Learning
par: Frauenknecht, Bernd, et autres
Publié: (2025)
par: Frauenknecht, Bernd, et autres
Publié: (2025)
Dyna-Style Safety Augmented Reinforcement Learning: Staying Safe in the Face of Uncertainty
par: Eisele, Artur, et autres
Publié: (2026)
par: Eisele, Artur, et autres
Publié: (2026)
Biased Dreams: Limitations to Epistemic Uncertainty Quantification in Latent Space Models
par: Berger, Julia, et autres
Publié: (2026)
par: Berger, Julia, et autres
Publié: (2026)
CHEQ-ing the Box: Safe Variable Impedance Learning for Robotic Polishing
par: Cramer, Emma, et autres
Publié: (2025)
par: Cramer, Emma, et autres
Publié: (2025)
Trust the Model Where It Trusts Itself -- Model-Based Actor-Critic with Uncertainty-Aware Rollout Adaption
par: Frauenknecht, Bernd, et autres
Publié: (2024)
par: Frauenknecht, Bernd, et autres
Publié: (2024)
Tracking Object Positions in Reinforcement Learning: A Metric for Keypoint Detection (extended version)
par: Cramer, Emma, et autres
Publié: (2023)
par: Cramer, Emma, et autres
Publié: (2023)
Uncertainty-Aware Predictive Safety Filters for Probabilistic Neural Network Dynamics
par: Frauenknecht, Bernd, et autres
Publié: (2026)
par: Frauenknecht, Bernd, et autres
Publié: (2026)
Combining Automated Optimisation of Hyperparameters and Reward Shape
par: Dierkes, Julian, et autres
Publié: (2024)
par: Dierkes, Julian, et autres
Publié: (2024)
Learning Hybrid Dynamics Models With Simulator-Informed Latent States
par: Ensinger, Katharina, et autres
Publié: (2023)
par: Ensinger, Katharina, et autres
Publié: (2023)
MPX: Mixed Precision Training for JAX
par: Gräfe, Alexander, et autres
Publié: (2025)
par: Gräfe, Alexander, et autres
Publié: (2025)
BayeSQP: Bayesian Optimization through Sequential Quadratic Programming
par: Brunzema, Paul, et autres
Publié: (2026)
par: Brunzema, Paul, et autres
Publié: (2026)
Learning to Race in Minutes: Infoprop Dyna on the Mini Wheelbot
par: Subhasish, Devdutt, et autres
Publié: (2026)
par: Subhasish, Devdutt, et autres
Publié: (2026)
Parameter-Adaptive Approximate MPC: Tuning Neural-Network Controllers without Retraining
par: Hose, Henrik, et autres
Publié: (2024)
par: Hose, Henrik, et autres
Publié: (2024)
RockNet: Distributed Learning on Ultra-Low-Power Devices
par: Gräfe, Alexander, et autres
Publié: (2025)
par: Gräfe, Alexander, et autres
Publié: (2025)
Kernel conditional tests from learning-theoretic bounds
par: Massiani, Pierre-François, et autres
Publié: (2025)
par: Massiani, Pierre-François, et autres
Publié: (2025)
Pseudo-rigid body networks: learning interpretable deformable object dynamics from partial observations
par: Mamedov, Shamil, et autres
Publié: (2023)
par: Mamedov, Shamil, et autres
Publié: (2023)
Distributed Event-Based Learning via ADMM
par: Er, Guner Dilsad, et autres
Publié: (2024)
par: Er, Guner Dilsad, et autres
Publié: (2024)
Feedforward Controllers from Learned Dynamic Local Model Networks with Application to Excavator Assistance Functions
par: Greiser, Leon, et autres
Publié: (2024)
par: Greiser, Leon, et autres
Publié: (2024)
Exact Inference for Continuous-Time Gaussian Process Dynamics
par: Ensinger, Katharina, et autres
Publié: (2023)
par: Ensinger, Katharina, et autres
Publié: (2023)
Local Bayesian Optimization for Controller Tuning with Crash Constraints
par: von Rohr, Alexander, et autres
Publié: (2024)
par: von Rohr, Alexander, et autres
Publié: (2024)
Least Squares and Marginal Log-Likelihood Model Predictive Control using Normalizing Flows
par: Cramer, Eike
Publié: (2024)
par: Cramer, Eike
Publié: (2024)
On the Consistency of Kernel Methods with Dependent Observations
par: Massiani, Pierre-François, et autres
Publié: (2024)
par: Massiani, Pierre-François, et autres
Publié: (2024)
Contextual Preference Distribution Learning
par: Hudson, Benjamin, et autres
Publié: (2026)
par: Hudson, Benjamin, et autres
Publié: (2026)
Safety in safe Bayesian optimization and its ramifications for control
par: Fiedler, Christian, et autres
Publié: (2025)
par: Fiedler, Christian, et autres
Publié: (2025)
Viability of Future Actions: Robust Safety in Reinforcement Learning via Entropy Regularization
par: Massiani, Pierre-François, et autres
Publié: (2025)
par: Massiani, Pierre-François, et autres
Publié: (2025)
On Safety in Safe Bayesian Optimization
par: Fiedler, Christian, et autres
Publié: (2024)
par: Fiedler, Christian, et autres
Publié: (2024)
Concept Extraction for Time Series with ECLAD-ts
par: Holzapfel, Antonia, et autres
Publié: (2025)
par: Holzapfel, Antonia, et autres
Publié: (2025)
Active Learning for Stochastic Contextual Linear Bandits
par: Brunskill, Emma, et autres
Publié: (2026)
par: Brunskill, Emma, et autres
Publié: (2026)
A Systems-Theoretic View on the Convergence of Algorithms under Disturbances
par: Er, Guner Dilsad, et autres
Publié: (2025)
par: Er, Guner Dilsad, et autres
Publié: (2025)
Tree Ensembles for Contextual Bandits
par: Nilsson, Hannes, et autres
Publié: (2024)
par: Nilsson, Hannes, et autres
Publié: (2024)
Maximum entropy GFlowNets with soft Q-learning
par: Mohammadpour, Sobhan, et autres
Publié: (2023)
par: Mohammadpour, Sobhan, et autres
Publié: (2023)
Event-Triggered Time-Varying Bayesian Optimization
par: Brunzema, Paul, et autres
Publié: (2022)
par: Brunzema, Paul, et autres
Publié: (2022)
Hybrid Neural Ordinary Differential Equations for Data-Efficient Polymerization Modeling with Incomplete Kinetics
par: Almanasreh, Marah, et autres
Publié: (2026)
par: Almanasreh, Marah, et autres
Publié: (2026)
Iterative Model-Learning Scheme via Gaussian Processes for Nonlinear Model Predictive Control of (Semi-)Batch Processes
par: Tan, Tai Xuan, et autres
Publié: (2026)
par: Tan, Tai Xuan, et autres
Publié: (2026)
Dual Ensembled Multiagent Q-Learning with Hypernet Regularizer
par: Yang, Yaodong, et autres
Publié: (2025)
par: Yang, Yaodong, et autres
Publié: (2025)
Multi-Timescale Ensemble Q-learning for Markov Decision Process Policy Optimization
par: Bozkus, Talha, et autres
Publié: (2024)
par: Bozkus, Talha, et autres
Publié: (2024)
Local Preferential Bayesian Optimization
par: Menn, Johanna, et autres
Publié: (2026)
par: Menn, Johanna, et autres
Publié: (2026)
Partially Observable Residual Reinforcement Learning for PV-Inverter-Based Voltage Control in Distribution Grids
par: Bouchkati, Sarra, et autres
Publié: (2025)
par: Bouchkati, Sarra, et autres
Publié: (2025)
Simulation-Aided Policy Tuning for Black-Box Robot Learning
par: He, Shiming, et autres
Publié: (2024)
par: He, Shiming, et autres
Publié: (2024)
Local Entropy Search over Descent Sequences for Bayesian Optimization
par: Stenger, David, et autres
Publié: (2025)
par: Stenger, David, et autres
Publié: (2025)
Documents similaires
-
On Rollouts in Model-Based Reinforcement Learning
par: Frauenknecht, Bernd, et autres
Publié: (2025) -
Dyna-Style Safety Augmented Reinforcement Learning: Staying Safe in the Face of Uncertainty
par: Eisele, Artur, et autres
Publié: (2026) -
Biased Dreams: Limitations to Epistemic Uncertainty Quantification in Latent Space Models
par: Berger, Julia, et autres
Publié: (2026) -
CHEQ-ing the Box: Safe Variable Impedance Learning for Robotic Polishing
par: Cramer, Emma, et autres
Publié: (2025) -
Trust the Model Where It Trusts Itself -- Model-Based Actor-Critic with Uncertainty-Aware Rollout Adaption
par: Frauenknecht, Bernd, et autres
Publié: (2024)