Reinforcement Learning with LTL and $ω$-Regular Objectives via Optimality-Preserving Translation to Average Rewards
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Le, Xuan-Bach, Wagner, Dominik, Witzman, Leon, Rabinovich, Alexander, Ong, Luke |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Reinforcement Learning with $ω$-Regular Objectives and Constraints
von: Wagner, Dominik, et al.
Veröffentlicht: (2025)
von: Wagner, Dominik, et al.
Veröffentlicht: (2025)
Average Reward Reinforcement Learning for Omega-Regular and Mean-Payoff Objectives
von: Kazemi, Milad, et al.
Veröffentlicht: (2025)
von: Kazemi, Milad, et al.
Veröffentlicht: (2025)
SB-TRPO: Towards Safe Reinforcement Learning with Hard Constraints
von: Wagner, Dominik, et al.
Veröffentlicht: (2025)
von: Wagner, Dominik, et al.
Veröffentlicht: (2025)
On the Uniqueness of Solution for the Bellman Equation of LTL Objectives
von: Xuan, Zetong, et al.
Veröffentlicht: (2024)
von: Xuan, Zetong, et al.
Veröffentlicht: (2024)
Qualitative Analysis of $ω$-Regular Objectives on Robust MDPs
von: Asadi, Ali, et al.
Veröffentlicht: (2025)
von: Asadi, Ali, et al.
Veröffentlicht: (2025)
Constrained Reinforcement Learning with Average Reward Objective: Model-Based and Model-Free Algorithms
von: Aggarwal, Vaneet, et al.
Veröffentlicht: (2024)
von: Aggarwal, Vaneet, et al.
Veröffentlicht: (2024)
Diagonalisation SGD: Fast & Convergent SGD for Non-Differentiable Models via Reparameterisation and Smoothing
von: Wagner, Dominik, et al.
Veröffentlicht: (2024)
von: Wagner, Dominik, et al.
Veröffentlicht: (2024)
Regret-Free Reinforcement Learning for LTL Specifications
von: Majumdar, Rupak, et al.
Veröffentlicht: (2024)
von: Majumdar, Rupak, et al.
Veröffentlicht: (2024)
Towards the Transferability of Rewards Recovered via Regularized Inverse Reinforcement Learning
von: Schlaginhaufen, Andreas, et al.
Veröffentlicht: (2024)
von: Schlaginhaufen, Andreas, et al.
Veröffentlicht: (2024)
Provably Adaptive Average Reward Reinforcement Learning for Metric Spaces
von: Kar, Avik, et al.
Veröffentlicht: (2024)
von: Kar, Avik, et al.
Veröffentlicht: (2024)
A Harmonic Mean Formulation of Average Reward Reinforcement Learning in SMDPs
von: Shtossel, Erel, et al.
Veröffentlicht: (2026)
von: Shtossel, Erel, et al.
Veröffentlicht: (2026)
Semantically Labelled Automata for Multi-Task Reinforcement Learning with LTL Instructions
von: Abate, Alessandro, et al.
Veröffentlicht: (2026)
von: Abate, Alessandro, et al.
Veröffentlicht: (2026)
Learning Pareto-Optimal Rewards from Noisy Preferences: A Framework for Multi-Objective Inverse Reinforcement Learning
von: Cherukuri, Kalyan, et al.
Veröffentlicht: (2025)
von: Cherukuri, Kalyan, et al.
Veröffentlicht: (2025)
Balancing Rewards in Text Summarization: Multi-Objective Reinforcement Learning via HyperVolume Optimization
von: Song, Junjie, et al.
Veröffentlicht: (2025)
von: Song, Junjie, et al.
Veröffentlicht: (2025)
Efficient $Q$-Learning and Actor-Critic Methods for Robust Average Reward Reinforcement Learning
von: Xu, Yang, et al.
Veröffentlicht: (2025)
von: Xu, Yang, et al.
Veröffentlicht: (2025)
Integrating LTL Constraints into PPO for Safe Reinforcement Learning
von: Zhang, Maifang, et al.
Veröffentlicht: (2026)
von: Zhang, Maifang, et al.
Veröffentlicht: (2026)
Syntax Is Easy, Semantics Is Hard: Evaluating LLMs for LTL Translation
von: Danso, Priscilla Kyei, et al.
Veröffentlicht: (2026)
von: Danso, Priscilla Kyei, et al.
Veröffentlicht: (2026)
DeepLTL: Learning to Efficiently Satisfy Complex LTL Specifications for Multi-Task RL
von: Jackermeier, Mathias, et al.
Veröffentlicht: (2024)
von: Jackermeier, Mathias, et al.
Veröffentlicht: (2024)
Follow the STARs: Dynamic $ω$-Regular Shielding of Learned Policies
von: Anand, Ashwani, et al.
Veröffentlicht: (2025)
von: Anand, Ashwani, et al.
Veröffentlicht: (2025)
AI-SearchPlanner: Modular Agentic Search via Pareto-Optimal Multi-Objective Reinforcement Learning
von: Mei, Lang, et al.
Veröffentlicht: (2025)
von: Mei, Lang, et al.
Veröffentlicht: (2025)
Kernel-Based Function Approximation for Average Reward Reinforcement Learning: An Optimist No-Regret Algorithm
von: Vakili, Sattar, et al.
Veröffentlicht: (2024)
von: Vakili, Sattar, et al.
Veröffentlicht: (2024)
Incentivizing Parametric Knowledge via Reinforcement Learning with Verifiable Rewards for Cross-Cultural Entity Translation
von: Zhou, Jiang, et al.
Veröffentlicht: (2026)
von: Zhou, Jiang, et al.
Veröffentlicht: (2026)
Offline Reinforcement Learning with Wasserstein Regularization via Optimal Transport Maps
von: Omura, Motoki, et al.
Veröffentlicht: (2025)
von: Omura, Motoki, et al.
Veröffentlicht: (2025)
DyJR: Preserving Diversity in Reinforcement Learning with Verifiable Rewards via Dynamic Jensen-Shannon Replay
von: Li, Long, et al.
Veröffentlicht: (2026)
von: Li, Long, et al.
Veröffentlicht: (2026)
Gradient Regularization Prevents Reward Hacking in Reinforcement Learning from Human Feedback and Verifiable Rewards
von: Ackermann, Johannes, et al.
Veröffentlicht: (2026)
von: Ackermann, Johannes, et al.
Veröffentlicht: (2026)
Ensuring Logic in the Fog: Sound POMDP Synthesis with LTL Objectives
von: Zhou, Can, et al.
Veröffentlicht: (2026)
von: Zhou, Can, et al.
Veröffentlicht: (2026)
Stage-Wise Reward Shaping for Acrobatic Robots: A Constrained Multi-Objective Reinforcement Learning Approach
von: Kim, Dohyeong, et al.
Veröffentlicht: (2024)
von: Kim, Dohyeong, et al.
Veröffentlicht: (2024)
Conformal Prediction for Privacy-Preserving Machine Learning
von: Balinsky, Alexander David, et al.
Veröffentlicht: (2025)
von: Balinsky, Alexander David, et al.
Veröffentlicht: (2025)
Composing Dextrous Grasping and In-hand Manipulation via Scoring with a Reinforcement Learning Critic
von: Röstel, Lennart, et al.
Veröffentlicht: (2025)
von: Röstel, Lennart, et al.
Veröffentlicht: (2025)
SSR-Zero: Simple Self-Rewarding Reinforcement Learning for Machine Translation
von: Yang, Wenjie, et al.
Veröffentlicht: (2025)
von: Yang, Wenjie, et al.
Veröffentlicht: (2025)
Beyond Scalar Rewards: Distributional Reinforcement Learning with Preordered Objectives for Safe and Reliable Autonomous Driving
von: Abouelazm, Ahmed, et al.
Veröffentlicht: (2026)
von: Abouelazm, Ahmed, et al.
Veröffentlicht: (2026)
Solving Long-run Average Reward Robust MDPs via Stochastic Games
von: Chatterjee, Krishnendu, et al.
Veröffentlicht: (2023)
von: Chatterjee, Krishnendu, et al.
Veröffentlicht: (2023)
Burning RED: Unlocking Subtask-Driven Reinforcement Learning and Risk-Awareness in Average-Reward Markov Decision Processes
von: Rojas, Juan Sebastian, et al.
Veröffentlicht: (2024)
von: Rojas, Juan Sebastian, et al.
Veröffentlicht: (2024)
Revisiting the Learning Objectives of Vision-Language Reward Models
von: Roy, Simon, et al.
Veröffentlicht: (2025)
von: Roy, Simon, et al.
Veröffentlicht: (2025)
Polychromic Objectives for Reinforcement Learning
von: Hamid, Jubayer Ibn, et al.
Veröffentlicht: (2025)
von: Hamid, Jubayer Ibn, et al.
Veröffentlicht: (2025)
DeepSearch: Overcome the Bottleneck of Reinforcement Learning with Verifiable Rewards via Monte Carlo Tree Search
von: Wu, Fang, et al.
Veröffentlicht: (2025)
von: Wu, Fang, et al.
Veröffentlicht: (2025)
Integrating Explanations in Learning LTL Specifications from Demonstrations
von: Gupta, Ashutosh, et al.
Veröffentlicht: (2024)
von: Gupta, Ashutosh, et al.
Veröffentlicht: (2024)
Reward Models in Deep Reinforcement Learning: A Survey
von: Yu, Rui, et al.
Veröffentlicht: (2025)
von: Yu, Rui, et al.
Veröffentlicht: (2025)
Average-Reward Soft Actor-Critic
von: Adamczyk, Jacob, et al.
Veröffentlicht: (2025)
von: Adamczyk, Jacob, et al.
Veröffentlicht: (2025)
Uncertain Multi-Objective Recommendation via Orthogonal Meta-Learning Enhanced Bayesian Optimization
von: Wang, Hongxu, et al.
Veröffentlicht: (2025)
von: Wang, Hongxu, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Reinforcement Learning with $ω$-Regular Objectives and Constraints
von: Wagner, Dominik, et al.
Veröffentlicht: (2025) -
Average Reward Reinforcement Learning for Omega-Regular and Mean-Payoff Objectives
von: Kazemi, Milad, et al.
Veröffentlicht: (2025) -
SB-TRPO: Towards Safe Reinforcement Learning with Hard Constraints
von: Wagner, Dominik, et al.
Veröffentlicht: (2025) -
On the Uniqueness of Solution for the Bellman Equation of LTL Objectives
von: Xuan, Zetong, et al.
Veröffentlicht: (2024) -
Qualitative Analysis of $ω$-Regular Objectives on Robust MDPs
von: Asadi, Ali, et al.
Veröffentlicht: (2025)