Differentiating Policies for Non-Myopic Bayesian Optimization
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Nwankwo, Darian, Bindel, David |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Non-Myopic Multifidelity Bayesian Optimization
par: Di Fiore, Francesco, et autres
Publié: (2022)
par: Di Fiore, Francesco, et autres
Publié: (2022)
Non-Myopic Multi-Objective Bayesian Optimization
par: Belakaria, Syrine, et autres
Publié: (2024)
par: Belakaria, Syrine, et autres
Publié: (2024)
Non-Myopic Active Feature Acquisition via Pathwise Policy Gradients
par: Aronsson, Linus, et autres
Publié: (2026)
par: Aronsson, Linus, et autres
Publié: (2026)
Reduced-Rank Multi-objective Policy Learning and Optimization
par: Nwankwo, Ezinne, et autres
Publié: (2024)
par: Nwankwo, Ezinne, et autres
Publié: (2024)
MONA: Myopic Optimization with Non-myopic Approval Can Mitigate Multi-step Reward Hacking
par: Farquhar, Sebastian, et autres
Publié: (2025)
par: Farquhar, Sebastian, et autres
Publié: (2025)
On Building Myopic MPC Policies using Supervised Learning
par: Orrico, Christopher A., et autres
Publié: (2024)
par: Orrico, Christopher A., et autres
Publié: (2024)
Revisiting Policy Gradients for Restricted Policy Classes: Escaping Myopic Local Optima with $k$-step Policy Gradients
par: DeWeese, Alex, et autres
Publié: (2026)
par: DeWeese, Alex, et autres
Publié: (2026)
Repeated Contracting with Multiple Non-Myopic Agents: Policy Regret and Limited Liability
par: Collina, Natalie, et autres
Publié: (2024)
par: Collina, Natalie, et autres
Publié: (2024)
A Minibatch-SGD-Based Learning Meta-Policy for Inventory Systems with Myopic Optimal Policy
par: Lyu, Jiameng, et autres
Publié: (2024)
par: Lyu, Jiameng, et autres
Publié: (2024)
Stochastic Poisson Surface Reconstruction with One Solve using Geometric Gaussian Processes
par: Holalkere, Sidhanth, et autres
Publié: (2025)
par: Holalkere, Sidhanth, et autres
Publié: (2025)
Myopically Verifiable Probabilistic Certificates for Safe Control and Learning
par: Wang, Zhuoyuan, et autres
Publié: (2024)
par: Wang, Zhuoyuan, et autres
Publié: (2024)
Sample Efficient Myopic Exploration Through Multitask Reinforcement Learning with Diverse Tasks
par: Xu, Ziping, et autres
Publié: (2024)
par: Xu, Ziping, et autres
Publié: (2024)
Refining Filter Global Feature Weighting for Fully-Unsupervised Clustering
par: Galis, Fabian, et autres
Publié: (2025)
par: Galis, Fabian, et autres
Publié: (2025)
Differentially Private Hyperparameter Tuning using Local Bayesian Optimization
par: Sopa, Getoar, et autres
Publié: (2025)
par: Sopa, Getoar, et autres
Publié: (2025)
On the Sample Complexity of Differentially Private Policy Optimization
par: He, Yi, et autres
Publié: (2025)
par: He, Yi, et autres
Publié: (2025)
Differentially Private Non-convex Distributionally Robust Optimization
par: Xu, Difei, et autres
Publié: (2026)
par: Xu, Difei, et autres
Publié: (2026)
Bayesian Risk-Sensitive Policy Optimization For MDPs With General Loss Functions
par: Wang, Xiaoshuang, et autres
Publié: (2025)
par: Wang, Xiaoshuang, et autres
Publié: (2025)
Inference Time Policy Optimization for Offline RL with Differentiable World Models
par: Deb, Rohan, et autres
Publié: (2026)
par: Deb, Rohan, et autres
Publié: (2026)
Dynamic Bayesian Optimization Framework for Instruction Tuning in Partial Differential Equation Discovery
par: Qu, Junqi, et autres
Publié: (2025)
par: Qu, Junqi, et autres
Publié: (2025)
Bandit Social Learning: Exploration under Myopic Behavior
par: Banihashem, Kiarash, et autres
Publié: (2023)
par: Banihashem, Kiarash, et autres
Publié: (2023)
Auditing LLMs for Algorithmic Fairness in Casenote-Augmented Tabular Prediction
par: Lee, Xiao Qi, et autres
Publié: (2026)
par: Lee, Xiao Qi, et autres
Publié: (2026)
Optimal Initialization of Batch Bayesian Optimization
par: Ren, Jiuge, et autres
Publié: (2024)
par: Ren, Jiuge, et autres
Publié: (2024)
Fast, Precise Thompson Sampling for Bayesian Optimization
par: Sweet, David
Publié: (2024)
par: Sweet, David
Publié: (2024)
Batch-Adaptive Causal Annotations
par: Nwankwo, Ezinne, et autres
Publié: (2025)
par: Nwankwo, Ezinne, et autres
Publié: (2025)
Overcoming Non-stationary Dynamics with Evidential Proximal Policy Optimization
par: Akgül, Abdullah, et autres
Publié: (2025)
par: Akgül, Abdullah, et autres
Publié: (2025)
Optimistic Policy Optimization is Provably Efficient in Non-stationary MDPs
par: Zhong, Han, et autres
Publié: (2021)
par: Zhong, Han, et autres
Publié: (2021)
Local Preferential Bayesian Optimization
par: Menn, Johanna, et autres
Publié: (2026)
par: Menn, Johanna, et autres
Publié: (2026)
Regularized Offline Policy Optimization with Posterior Hybrid Bayesian Belief
par: Lin, Hongqiang, et autres
Publié: (2026)
par: Lin, Hongqiang, et autres
Publié: (2026)
Tempered Sequential Monte Carlo for Trajectory and Policy Optimization with Differentiable Dynamics
par: Yang, Heng
Publié: (2026)
par: Yang, Heng
Publié: (2026)
Bayesian Optimization for Non-Convex Two-Stage Stochastic Optimization Problems
par: Buckingham, Jack M., et autres
Publié: (2024)
par: Buckingham, Jack M., et autres
Publié: (2024)
Approximation-Aware Bayesian Optimization
par: Maus, Natalie, et autres
Publié: (2024)
par: Maus, Natalie, et autres
Publié: (2024)
Augmented Bayesian Policy Search
par: Kallel, Mahdi, et autres
Publié: (2024)
par: Kallel, Mahdi, et autres
Publié: (2024)
A Feed-Forward Artificial Intelligence Pipeline for Sustainable Desalination under Climate Uncertainties: UAE Insights
par: Nwafor, Obumneme, et autres
Publié: (2025)
par: Nwafor, Obumneme, et autres
Publié: (2025)
Differentially Private Optimization for Non-Decomposable Objective Functions
par: Kong, Weiwei, et autres
Publié: (2023)
par: Kong, Weiwei, et autres
Publié: (2023)
Classification with a Network of Partially Informative Agents: Enabling Wise Crowds from Individually Myopic Classifiers
par: Yao, Tong, et autres
Publié: (2024)
par: Yao, Tong, et autres
Publié: (2024)
Multi-Objective Causal Bayesian Optimization
par: Bhatija, Shriya, et autres
Publié: (2025)
par: Bhatija, Shriya, et autres
Publié: (2025)
Differentially Private Policy Gradient
par: Rio, Alexandre, et autres
Publié: (2025)
par: Rio, Alexandre, et autres
Publié: (2025)
Informed Initialization for Bayesian Optimization and Active Learning
par: Hvarfner, Carl, et autres
Publié: (2025)
par: Hvarfner, Carl, et autres
Publié: (2025)
BOFormer: Learning to Solve Multi-Objective Bayesian Optimization via Non-Markovian RL
par: Hung, Yu-Heng, et autres
Publié: (2025)
par: Hung, Yu-Heng, et autres
Publié: (2025)
Differentially private Bayesian tests
par: Chakraborty, Abhisek, et autres
Publié: (2024)
par: Chakraborty, Abhisek, et autres
Publié: (2024)
Documents similaires
-
Non-Myopic Multifidelity Bayesian Optimization
par: Di Fiore, Francesco, et autres
Publié: (2022) -
Non-Myopic Multi-Objective Bayesian Optimization
par: Belakaria, Syrine, et autres
Publié: (2024) -
Non-Myopic Active Feature Acquisition via Pathwise Policy Gradients
par: Aronsson, Linus, et autres
Publié: (2026) -
Reduced-Rank Multi-objective Policy Learning and Optimization
par: Nwankwo, Ezinne, et autres
Publié: (2024) -
MONA: Myopic Optimization with Non-myopic Approval Can Mitigate Multi-step Reward Hacking
par: Farquhar, Sebastian, et autres
Publié: (2025)