Constrained Meta Reinforcement Learning with Provable Test-Time Safety
Fuente:
arXiv
Guardado en:
| Autores principales: | Ni, Tingting, Kamgarpour, Maryam |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
A learning-based approach to stochastic optimal control under reach-avoid constraint
por: Ni, Tingting, et al.
Publicado: (2024)
por: Ni, Tingting, et al.
Publicado: (2024)
A safe exploration approach to constrained Markov decision processes
por: Ni, Tingting, et al.
Publicado: (2023)
por: Ni, Tingting, et al.
Publicado: (2023)
Fast Rates for Inverse Reinforcement Learning
por: Schlaginhaufen, Andreas, et al.
Publicado: (2026)
por: Schlaginhaufen, Andreas, et al.
Publicado: (2026)
Towards the Transferability of Rewards Recovered via Regularized Inverse Reinforcement Learning
por: Schlaginhaufen, Andreas, et al.
Publicado: (2024)
por: Schlaginhaufen, Andreas, et al.
Publicado: (2024)
Convergence of a model-free entropy-regularized inverse reinforcement learning algorithm
por: Renard, Titouan, et al.
Publicado: (2024)
por: Renard, Titouan, et al.
Publicado: (2024)
Learning in Zero-Sum Markov Games: Relaxing Strong Reachability and Mixing Time Assumptions
por: Ouhamma, Reda, et al.
Publicado: (2023)
por: Ouhamma, Reda, et al.
Publicado: (2023)
Model-Based Learning of Near-Optimal Finite-Window Policies in POMDPs
por: Jordan, Philip, et al.
Publicado: (2026)
por: Jordan, Philip, et al.
Publicado: (2026)
Efficient Preference-Based Reinforcement Learning: Randomized Exploration Meets Experimental Design
por: Schlaginhaufen, Andreas, et al.
Publicado: (2025)
por: Schlaginhaufen, Andreas, et al.
Publicado: (2025)
Independent Learning of Nash Equilibria in Partially Observable Markov Potential Games with Decoupled Dynamics
por: Jordan, Philip, et al.
Publicado: (2026)
por: Jordan, Philip, et al.
Publicado: (2026)
Provably Efficient Exploration in Inverse Constrained Reinforcement Learning
por: Yue, Bo, et al.
Publicado: (2024)
por: Yue, Bo, et al.
Publicado: (2024)
Nash Equilibria in Games with Playerwise Concave Coupling Constraints: Existence and Computation
por: Jordan, Philip, et al.
Publicado: (2025)
por: Jordan, Philip, et al.
Publicado: (2025)
Test-Time Regret Minimization in Meta Reinforcement Learning
por: Mutti, Mirco, et al.
Publicado: (2024)
por: Mutti, Mirco, et al.
Publicado: (2024)
Constrained Meta Agnostic Reinforcement Learning
por: Daaboul, Karam, et al.
Publicado: (2024)
por: Daaboul, Karam, et al.
Publicado: (2024)
Provably Optimal Reinforcement Learning under Safety Filtering
por: Oh, Donggeon David, et al.
Publicado: (2025)
por: Oh, Donggeon David, et al.
Publicado: (2025)
A Single-Loop Deep Actor-Critic Algorithm for Constrained Reinforcement Learning with Provable Convergence
por: Wang, Kexuan, et al.
Publicado: (2023)
por: Wang, Kexuan, et al.
Publicado: (2023)
Provable Meta-Learning with Low-Rank Adaptations
por: Block, Jacob L., et al.
Publicado: (2024)
por: Block, Jacob L., et al.
Publicado: (2024)
Provably Efficient RL under Episode-Wise Safety in Constrained MDPs with Linear Function Approximation
por: Kitamura, Toshinori, et al.
Publicado: (2025)
por: Kitamura, Toshinori, et al.
Publicado: (2025)
Latent Safety-Constrained Policy Approach for Safe Offline Reinforcement Learning
por: Koirala, Prajwal, et al.
Publicado: (2024)
por: Koirala, Prajwal, et al.
Publicado: (2024)
Safety Constrained Multi-Agent Reinforcement Learning for Active Voltage Control
por: Qu, Yang, et al.
Publicado: (2024)
por: Qu, Yang, et al.
Publicado: (2024)
Towards Provable Emergence of In-Context Reinforcement Learning
por: Wang, Jiuqi, et al.
Publicado: (2025)
por: Wang, Jiuqi, et al.
Publicado: (2025)
Test-Time Training Provably Improves Transformers as In-context Learners
por: Gozeten, Halil Alperen, et al.
Publicado: (2025)
por: Gozeten, Halil Alperen, et al.
Publicado: (2025)
Meta-Reinforcement Learning with Universal Policy Adaptation: Provable Near-Optimality under All-task Optimum Comparator
por: Xu, Siyuan, et al.
Publicado: (2024)
por: Xu, Siyuan, et al.
Publicado: (2024)
Sparsity-based Safety Conservatism for Constrained Offline Reinforcement Learning
por: Cho, Minjae, et al.
Publicado: (2024)
por: Cho, Minjae, et al.
Publicado: (2024)
Provable Partially Observable Reinforcement Learning with Privileged Information
por: Cai, Yang, et al.
Publicado: (2024)
por: Cai, Yang, et al.
Publicado: (2024)
On characterization and existence of constrained correlated equilibria in Markov games
por: Ni, Tingting, et al.
Publicado: (2025)
por: Ni, Tingting, et al.
Publicado: (2025)
In-Context Learning Is Provably Bayesian Inference: A Generalization Theory for Meta-Learning
por: Wakayama, Tomoya, et al.
Publicado: (2025)
por: Wakayama, Tomoya, et al.
Publicado: (2025)
Minimalist Softmax Attention Provably Learns Constrained Boolean Functions
por: Hu, Jerry Yao-Chieh, et al.
Publicado: (2025)
por: Hu, Jerry Yao-Chieh, et al.
Publicado: (2025)
Provable Data Scaling Law for Meta Learning via Complexity Minimization
por: Fukuchi, Kazuto, et al.
Publicado: (2026)
por: Fukuchi, Kazuto, et al.
Publicado: (2026)
Amplification Effects in Test-Time Reinforcement Learning: Safety and Reasoning Vulnerabilities
por: Khattar, Vanshaj, et al.
Publicado: (2026)
por: Khattar, Vanshaj, et al.
Publicado: (2026)
Provable Domain Adaptation for Offline Reinforcement Learning with Limited Samples
por: Chen, Weiqin, et al.
Publicado: (2024)
por: Chen, Weiqin, et al.
Publicado: (2024)
Provably Efficient Reinforcement Learning with Multinomial Logit Function Approximation
por: Li, Long-Fei, et al.
Publicado: (2024)
por: Li, Long-Fei, et al.
Publicado: (2024)
Provably Sample-Efficient Robust Reinforcement Learning with Average Reward
por: Roch, Zachary, et al.
Publicado: (2025)
por: Roch, Zachary, et al.
Publicado: (2025)
TTRL: Test-Time Reinforcement Learning
por: Zuo, Yuxin, et al.
Publicado: (2025)
por: Zuo, Yuxin, et al.
Publicado: (2025)
Provable Zero-Shot Generalization in Offline Reinforcement Learning
por: Wang, Zhiyong, et al.
Publicado: (2025)
por: Wang, Zhiyong, et al.
Publicado: (2025)
Provable Risk-Sensitive Distributional Reinforcement Learning with General Function Approximation
por: Chen, Yu, et al.
Publicado: (2024)
por: Chen, Yu, et al.
Publicado: (2024)
Provable Reinforcement Learning from Human Feedback with an Unknown Link Function
por: Zhang, Qining, et al.
Publicado: (2025)
por: Zhang, Qining, et al.
Publicado: (2025)
Unsupervised Meta-Testing with Conditional Neural Processes for Hybrid Meta-Reinforcement Learning
por: Ada, Suzan Ece, et al.
Publicado: (2025)
por: Ada, Suzan Ece, et al.
Publicado: (2025)
Provably Convergent Primal-Dual DPO for Constrained LLM Alignment
por: Du, Yihan, et al.
Publicado: (2025)
por: Du, Yihan, et al.
Publicado: (2025)
Deterministic Policies for Constrained Reinforcement Learning in Polynomial Time
por: McMahan, Jeremy
Publicado: (2024)
por: McMahan, Jeremy
Publicado: (2024)
Contrastive UCB: Provably Efficient Contrastive Self-Supervised Learning in Online Reinforcement Learning
por: Qiu, Shuang, et al.
Publicado: (2022)
por: Qiu, Shuang, et al.
Publicado: (2022)
Ejemplares similares
-
A learning-based approach to stochastic optimal control under reach-avoid constraint
por: Ni, Tingting, et al.
Publicado: (2024) -
A safe exploration approach to constrained Markov decision processes
por: Ni, Tingting, et al.
Publicado: (2023) -
Fast Rates for Inverse Reinforcement Learning
por: Schlaginhaufen, Andreas, et al.
Publicado: (2026) -
Towards the Transferability of Rewards Recovered via Regularized Inverse Reinforcement Learning
por: Schlaginhaufen, Andreas, et al.
Publicado: (2024) -
Convergence of a model-free entropy-regularized inverse reinforcement learning algorithm
por: Renard, Titouan, et al.
Publicado: (2024)