A Harmonic Mean Formulation of Average Reward Reinforcement Learning in SMDPs
Fuente:
arXiv
Salvato in:
| Autori principali: | Shtossel, Erel, Vidler, Alicia, Shaham, Uri, Kaminka, Gal A. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Modular Reinforcement Learning For Cooperative Swarms
di: Shtossel, Erel, et al.
Pubblicazione: (2026)
di: Shtossel, Erel, et al.
Pubblicazione: (2026)
Multiagent Reinforcement Learning for Liquidity Games
di: Vidler, Alicia, et al.
Pubblicazione: (2026)
di: Vidler, Alicia, et al.
Pubblicazione: (2026)
Turning Sand to Gold: Recycling Data to Bridge On-Policy and Off-Policy Learning via Causal Bound
di: Fiskus, Tal, et al.
Pubblicazione: (2025)
di: Fiskus, Tal, et al.
Pubblicazione: (2025)
Evaluating Binary Decision Biases in Large Language Models: Implications for Fair Agent-Based Financial Simulations
di: Vidler, Alicia, et al.
Pubblicazione: (2025)
di: Vidler, Alicia, et al.
Pubblicazione: (2025)
Unsupervised Ensemble Learning Through Deep Energy-based Models
di: Maymon, Ariel, et al.
Pubblicazione: (2026)
di: Maymon, Ariel, et al.
Pubblicazione: (2026)
Provably Adaptive Average Reward Reinforcement Learning for Metric Spaces
di: Kar, Avik, et al.
Pubblicazione: (2024)
di: Kar, Avik, et al.
Pubblicazione: (2024)
Efficient $Q$-Learning and Actor-Critic Methods for Robust Average Reward Reinforcement Learning
di: Xu, Yang, et al.
Pubblicazione: (2025)
di: Xu, Yang, et al.
Pubblicazione: (2025)
Kernel-Based Function Approximation for Average Reward Reinforcement Learning: An Optimist No-Regret Algorithm
di: Vakili, Sattar, et al.
Pubblicazione: (2024)
di: Vakili, Sattar, et al.
Pubblicazione: (2024)
Constrained Reinforcement Learning with Average Reward Objective: Model-Based and Model-Free Algorithms
di: Aggarwal, Vaneet, et al.
Pubblicazione: (2024)
di: Aggarwal, Vaneet, et al.
Pubblicazione: (2024)
Reinforcement Learning with LTL and $ω$-Regular Objectives via Optimality-Preserving Translation to Average Rewards
di: Le, Xuan-Bach, et al.
Pubblicazione: (2024)
di: Le, Xuan-Bach, et al.
Pubblicazione: (2024)
Burning RED: Unlocking Subtask-Driven Reinforcement Learning and Risk-Awareness in Average-Reward Markov Decision Processes
di: Rojas, Juan Sebastian, et al.
Pubblicazione: (2024)
di: Rojas, Juan Sebastian, et al.
Pubblicazione: (2024)
Average-Reward Soft Actor-Critic
di: Adamczyk, Jacob, et al.
Pubblicazione: (2025)
di: Adamczyk, Jacob, et al.
Pubblicazione: (2025)
Gradient Boosting Reinforcement Learning
di: Fuhrer, Benjamin, et al.
Pubblicazione: (2024)
di: Fuhrer, Benjamin, et al.
Pubblicazione: (2024)
Hybrid Autoencoders for Tabular Data: Leveraging Model-Based Augmentation in Low-Label Settings
di: Naor, Erel, et al.
Pubblicazione: (2025)
di: Naor, Erel, et al.
Pubblicazione: (2025)
A Survey of Constraint Formulations in Safe Reinforcement Learning
di: Wachi, Akifumi, et al.
Pubblicazione: (2024)
di: Wachi, Akifumi, et al.
Pubblicazione: (2024)
Reward Learning through Ranking Mean Squared Error
di: Kharyal, Chaitanya, et al.
Pubblicazione: (2026)
di: Kharyal, Chaitanya, et al.
Pubblicazione: (2026)
WARP: On the Benefits of Weight Averaged Rewarded Policies
di: Ramé, Alexandre, et al.
Pubblicazione: (2024)
di: Ramé, Alexandre, et al.
Pubblicazione: (2024)
Reinforcement Learning with Symbolic Reward Machines
di: Krug, Thomas, et al.
Pubblicazione: (2026)
di: Krug, Thomas, et al.
Pubblicazione: (2026)
Reinforcement Learning with Exogenous States and Rewards
di: Trimponias, George, et al.
Pubblicazione: (2023)
di: Trimponias, George, et al.
Pubblicazione: (2023)
Reinforcement Learning with Stochastic Reward Machines
di: Corazza, Jan, et al.
Pubblicazione: (2025)
di: Corazza, Jan, et al.
Pubblicazione: (2025)
Offline Reinforcement Learning with Imputed Rewards
di: Romeo, Carlo, et al.
Pubblicazione: (2024)
di: Romeo, Carlo, et al.
Pubblicazione: (2024)
Multilingual Instruction Tuning With Just a Pinch of Multilinguality
di: Shaham, Uri, et al.
Pubblicazione: (2024)
di: Shaham, Uri, et al.
Pubblicazione: (2024)
Reward Models in Deep Reinforcement Learning: A Survey
di: Yu, Rui, et al.
Pubblicazione: (2025)
di: Yu, Rui, et al.
Pubblicazione: (2025)
Beyond Rewards in Reinforcement Learning for Cyber Defence
di: Bates, Elizabeth, et al.
Pubblicazione: (2026)
di: Bates, Elizabeth, et al.
Pubblicazione: (2026)
RLSR: Reinforcement Learning from Self Reward
di: Simonds, Toby, et al.
Pubblicazione: (2025)
di: Simonds, Toby, et al.
Pubblicazione: (2025)
Efficient Reinforcement Learning in Probabilistic Reward Machines
di: Lin, Xiaofeng, et al.
Pubblicazione: (2024)
di: Lin, Xiaofeng, et al.
Pubblicazione: (2024)
Which Rewards Matter? Reward Selection for Reinforcement Learning under Limited Feedback
di: Chaudhari, Shreyas, et al.
Pubblicazione: (2025)
di: Chaudhari, Shreyas, et al.
Pubblicazione: (2025)
Hierarchical Average-Reward Linearly-solvable Markov Decision Processes
di: Infante, Guillermo, et al.
Pubblicazione: (2024)
di: Infante, Guillermo, et al.
Pubblicazione: (2024)
Constraints as Rewards: Reinforcement Learning for Robots without Reward Functions
di: Ishihara, Yu, et al.
Pubblicazione: (2025)
di: Ishihara, Yu, et al.
Pubblicazione: (2025)
Almost Sure Convergence of Differential Temporal Difference Learning for Average Reward Markov Decision Processes
di: Blaser, Ethan, et al.
Pubblicazione: (2026)
di: Blaser, Ethan, et al.
Pubblicazione: (2026)
Adaptive Personalized Federated Learning via Multi-task Averaging of Kernel Mean Embeddings
di: Fermanian, Jean-Baptiste, et al.
Pubblicazione: (2026)
di: Fermanian, Jean-Baptiste, et al.
Pubblicazione: (2026)
Stabilizing Policy Gradients for Sample-Efficient Reinforcement Learning in LLM Reasoning
di: Melo, Luckeciano C., et al.
Pubblicazione: (2025)
di: Melo, Luckeciano C., et al.
Pubblicazione: (2025)
A Computationally Efficient Algorithm for Infinite-Horizon Average-Reward Linear MDPs
di: Hong, Kihyuk, et al.
Pubblicazione: (2025)
di: Hong, Kihyuk, et al.
Pubblicazione: (2025)
Adaptive Correlation-Weighted Intrinsic Rewards for Reinforcement Learning
di: Nguyen, Viet Bac, et al.
Pubblicazione: (2026)
di: Nguyen, Viet Bac, et al.
Pubblicazione: (2026)
Contextual Rollout Bandits for Reinforcement Learning with Verifiable Rewards
di: Lu, Xiaodong, et al.
Pubblicazione: (2026)
di: Lu, Xiaodong, et al.
Pubblicazione: (2026)
2048: Reinforcement Learning in a Delayed Reward Environment
di: Saligram, Prady, et al.
Pubblicazione: (2025)
di: Saligram, Prady, et al.
Pubblicazione: (2025)
Pushdown Reward Machines for Reinforcement Learning
di: Varricchione, Giovanni, et al.
Pubblicazione: (2025)
di: Varricchione, Giovanni, et al.
Pubblicazione: (2025)
Impoola: The Power of Average Pooling for Image-Based Deep Reinforcement Learning
di: Trumpp, Raphael, et al.
Pubblicazione: (2025)
di: Trumpp, Raphael, et al.
Pubblicazione: (2025)
Beyond Correctness: Harmonizing Process and Outcome Rewards through RL Training
di: Ye, Chenlu, et al.
Pubblicazione: (2025)
di: Ye, Chenlu, et al.
Pubblicazione: (2025)
Shaping Sparse Rewards in Reinforcement Learning: A Semi-supervised Approach
di: Li, Wenyun, et al.
Pubblicazione: (2025)
di: Li, Wenyun, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Modular Reinforcement Learning For Cooperative Swarms
di: Shtossel, Erel, et al.
Pubblicazione: (2026) -
Multiagent Reinforcement Learning for Liquidity Games
di: Vidler, Alicia, et al.
Pubblicazione: (2026) -
Turning Sand to Gold: Recycling Data to Bridge On-Policy and Off-Policy Learning via Causal Bound
di: Fiskus, Tal, et al.
Pubblicazione: (2025) -
Evaluating Binary Decision Biases in Large Language Models: Implications for Fair Agent-Based Financial Simulations
di: Vidler, Alicia, et al.
Pubblicazione: (2025) -
Unsupervised Ensemble Learning Through Deep Energy-based Models
di: Maymon, Ariel, et al.
Pubblicazione: (2026)