Salvato in:
| Autori principali: | Zhu, Youheng, Lu, Yiping |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2603.03191 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Recurrent Natural Policy Gradient for POMDPs
di: Cayci, Semih, et al.
Pubblicazione: (2024)
di: Cayci, Semih, et al.
Pubblicazione: (2024)
Residuals-based Offline Reinforcement Learning
di: Zhu, Qing, et al.
Pubblicazione: (2026)
di: Zhu, Qing, et al.
Pubblicazione: (2026)
Solving Truly Massive Budgeted Monotonic POMDPs with Oracle-Guided Meta-Reinforcement Learning
di: Vora, Manav, et al.
Pubblicazione: (2024)
di: Vora, Manav, et al.
Pubblicazione: (2024)
Offline Reinforcement Learning via Inverse Optimization
di: Dimanidis, Ioannis, et al.
Pubblicazione: (2025)
di: Dimanidis, Ioannis, et al.
Pubblicazione: (2025)
Dual Control of Linear Systems from Bilinear Observations with Belief Space Model Predictive Control
di: Cao, Daniel, et al.
Pubblicazione: (2026)
di: Cao, Daniel, et al.
Pubblicazione: (2026)
Offline Hierarchical Reinforcement Learning via Inverse Optimization
di: Schmidt, Carolin, et al.
Pubblicazione: (2024)
di: Schmidt, Carolin, et al.
Pubblicazione: (2024)
Operator Models for Continuous-Time Offline Reinforcement Learning
di: Hoischen, Nicolas, et al.
Pubblicazione: (2025)
di: Hoischen, Nicolas, et al.
Pubblicazione: (2025)
On the Width Scaling of Neural Optimizers Under Matrix Operator Norms I: Row/Column Normalization and Hyperparameter Transfer
di: Xu, Ruihan, et al.
Pubblicazione: (2026)
di: Xu, Ruihan, et al.
Pubblicazione: (2026)
Offline-Online Reinforcement Learning for Linear Mixture MDPs
di: Zhang, Zhongjun, et al.
Pubblicazione: (2026)
di: Zhang, Zhongjun, et al.
Pubblicazione: (2026)
Reward-Relevance-Filtered Linear Offline Reinforcement Learning
di: Zhou, Angela
Pubblicazione: (2024)
di: Zhou, Angela
Pubblicazione: (2024)
Online Residual Learning from Offline Experts for Pedestrian Tracking
di: Vlachos, Anastasios, et al.
Pubblicazione: (2024)
di: Vlachos, Anastasios, et al.
Pubblicazione: (2024)
Offline Policy Learning with Weight Clipping and Heaviside Composite Optimization
di: Liu, Jingren, et al.
Pubblicazione: (2026)
di: Liu, Jingren, et al.
Pubblicazione: (2026)
Pessimistic Nonlinear Least-Squares Value Iteration for Offline Reinforcement Learning
di: Di, Qiwei, et al.
Pubblicazione: (2023)
di: Di, Qiwei, et al.
Pubblicazione: (2023)
PAC-Bayes Meets Online Contextual Optimization
di: Xie, Zhuojun, et al.
Pubblicazione: (2025)
di: Xie, Zhuojun, et al.
Pubblicazione: (2025)
Offline Reinforcement Learning via Linear-Programming with Error-Bound Induced Constraints
di: Ozdaglar, Asuman, et al.
Pubblicazione: (2022)
di: Ozdaglar, Asuman, et al.
Pubblicazione: (2022)
No-Rank Tensor Decomposition Using Metric Learning
di: Bagherian, Maryam
Pubblicazione: (2025)
di: Bagherian, Maryam
Pubblicazione: (2025)
SPP-SBL: Space-Power Prior Sparse Bayesian Learning for Block Sparse Recovery
di: Zhang, Yanhao, et al.
Pubblicazione: (2025)
di: Zhang, Yanhao, et al.
Pubblicazione: (2025)
Learning to Cover: Online Learning and Optimization with Irreversible Decisions
di: Jacquillat, Alexandre, et al.
Pubblicazione: (2024)
di: Jacquillat, Alexandre, et al.
Pubblicazione: (2024)
SPARKLE: A Unified Single-Loop Primal-Dual Framework for Decentralized Bilevel Optimization
di: Zhu, Shuchen, et al.
Pubblicazione: (2024)
di: Zhu, Shuchen, et al.
Pubblicazione: (2024)
OptScaler: A Collaborative Framework for Robust Autoscaling in the Cloud
di: Zou, Ding, et al.
Pubblicazione: (2023)
di: Zou, Ding, et al.
Pubblicazione: (2023)
Towards Optimal Offline Reinforcement Learning
di: Li, Mengmeng, et al.
Pubblicazione: (2025)
di: Li, Mengmeng, et al.
Pubblicazione: (2025)
Wait-Less Offline Tuning and Re-solving for Online Decision Making
di: Sun, Jingruo, et al.
Pubblicazione: (2024)
di: Sun, Jingruo, et al.
Pubblicazione: (2024)
Pessimism Meets Risk: Risk-Sensitive Offline Reinforcement Learning
di: Zhang, Dake, et al.
Pubblicazione: (2024)
di: Zhang, Dake, et al.
Pubblicazione: (2024)
Modeling Hierarchical Spaces: A Review and Unified Framework for Surrogate-Based Architecture Design
di: Saves, Paul, et al.
Pubblicazione: (2025)
di: Saves, Paul, et al.
Pubblicazione: (2025)
Unsupervised Ground Metric Learning
di: Auffenberg, Janis, et al.
Pubblicazione: (2025)
di: Auffenberg, Janis, et al.
Pubblicazione: (2025)
A Distance Metric for Mixed Integer Programming Instances
di: Maudet, Gwen, et al.
Pubblicazione: (2025)
di: Maudet, Gwen, et al.
Pubblicazione: (2025)
Formation Shape Control using the Gromov-Wasserstein Metric
di: Nakashima, Haruto, et al.
Pubblicazione: (2025)
di: Nakashima, Haruto, et al.
Pubblicazione: (2025)
Distributionally Robust Optimization via Iterative Algorithms in Continuous Probability Spaces
di: Zhu, Linglingzhi, et al.
Pubblicazione: (2024)
di: Zhu, Linglingzhi, et al.
Pubblicazione: (2024)
A Framework for Adaptive Stabilisation of Nonlinear Stochastic Systems
di: Siriya, Seth, et al.
Pubblicazione: (2025)
di: Siriya, Seth, et al.
Pubblicazione: (2025)
Provable Offline Reinforcement Learning for Structured Cyclic MDPs
di: Lee, Kyungbok, et al.
Pubblicazione: (2026)
di: Lee, Kyungbok, et al.
Pubblicazione: (2026)
Integrated Offline and Online Learning to Solve a Large Class of Scheduling Problems
di: Liu, Anbang, et al.
Pubblicazione: (2025)
di: Liu, Anbang, et al.
Pubblicazione: (2025)
Provably Efficient Representation Selection in Low-rank Markov Decision Processes: From Online to Offline RL
di: Zhang, Weitong, et al.
Pubblicazione: (2021)
di: Zhang, Weitong, et al.
Pubblicazione: (2021)
TaskMet: Task-Driven Metric Learning for Model Learning
di: Bansal, Dishank, et al.
Pubblicazione: (2023)
di: Bansal, Dishank, et al.
Pubblicazione: (2023)
On the Power of (Approximate) Reward Models for Inference-Time Scaling
di: Zhu, Youheng, et al.
Pubblicazione: (2026)
di: Zhu, Youheng, et al.
Pubblicazione: (2026)
A Control Theoretic Framework for Adaptive Gradient Optimizers in Machine Learning
di: Chakrabarti, Kushal, et al.
Pubblicazione: (2022)
di: Chakrabarti, Kushal, et al.
Pubblicazione: (2022)
Bisimulation Metrics are Optimal Transport Distances, and Can be Computed Efficiently
di: Calo, Sergio, et al.
Pubblicazione: (2024)
di: Calo, Sergio, et al.
Pubblicazione: (2024)
Belief Samples Are All You Need For Social Learning
di: JafariNodeh, Mahyar, et al.
Pubblicazione: (2024)
di: JafariNodeh, Mahyar, et al.
Pubblicazione: (2024)
Quantizer Design for Finite Model Approximations, Model Learning, and Quantized Q-Learning for MDPs with Unbounded Spaces
di: Bicer, Osman, et al.
Pubblicazione: (2025)
di: Bicer, Osman, et al.
Pubblicazione: (2025)
A Randomized Zeroth-Order Hierarchical Framework for Heterogeneous Federated Learning
di: Qiu, Yuyang, et al.
Pubblicazione: (2025)
di: Qiu, Yuyang, et al.
Pubblicazione: (2025)
FERERO: A Flexible Framework for Preference-Guided Multi-Objective Learning
di: Chen, Lisha, et al.
Pubblicazione: (2024)
di: Chen, Lisha, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Recurrent Natural Policy Gradient for POMDPs
di: Cayci, Semih, et al.
Pubblicazione: (2024) -
Residuals-based Offline Reinforcement Learning
di: Zhu, Qing, et al.
Pubblicazione: (2026) -
Solving Truly Massive Budgeted Monotonic POMDPs with Oracle-Guided Meta-Reinforcement Learning
di: Vora, Manav, et al.
Pubblicazione: (2024) -
Offline Reinforcement Learning via Inverse Optimization
di: Dimanidis, Ioannis, et al.
Pubblicazione: (2025) -
Dual Control of Linear Systems from Bilinear Observations with Belief Space Model Predictive Control
di: Cao, Daniel, et al.
Pubblicazione: (2026)