Policy Gradients for Cumulative Prospect Theory in Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Lepel, Olivier, Barakat, Anas |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
On the Global Optimality of Policy Gradient Methods in General Utility Reinforcement Learning
di: Barakat, Anas, et al.
Pubblicazione: (2024)
di: Barakat, Anas, et al.
Pubblicazione: (2024)
Policy Mirror Descent with Lookahead
di: Protopapas, Kimon, et al.
Pubblicazione: (2024)
di: Protopapas, Kimon, et al.
Pubblicazione: (2024)
The Definitive Guide to Policy Gradients in Deep Reinforcement Learning: Theory, Algorithms and Implementations
di: Lehmann, Matthias
Pubblicazione: (2024)
di: Lehmann, Matthias
Pubblicazione: (2024)
Why Pass@k Optimization Can Degrade Pass@1: Prompt Interference in LLM Post-training
di: Barakat, Anas, et al.
Pubblicazione: (2026)
di: Barakat, Anas, et al.
Pubblicazione: (2026)
Policy Gradient Methods for Non-Markovian Reinforcement Learning
di: Kar, Avik, et al.
Pubblicazione: (2026)
di: Kar, Avik, et al.
Pubblicazione: (2026)
Emergence of Exploration in Policy Gradient Reinforcement Learning via Retrying
di: Nishimori, Soichiro, et al.
Pubblicazione: (2026)
di: Nishimori, Soichiro, et al.
Pubblicazione: (2026)
$K$-Level Policy Gradients for Multi-Agent Reinforcement Learning
di: Reddi, Aryaman, et al.
Pubblicazione: (2025)
di: Reddi, Aryaman, et al.
Pubblicazione: (2025)
Proximal Policy Gradient Arborescence for Quality Diversity Reinforcement Learning
di: Batra, Sumeet, et al.
Pubblicazione: (2023)
di: Batra, Sumeet, et al.
Pubblicazione: (2023)
PG-Rainbow: Using Distributional Reinforcement Learning in Policy Gradient Methods
di: Jeon, WooJae, et al.
Pubblicazione: (2024)
di: Jeon, WooJae, et al.
Pubblicazione: (2024)
Stabilizing Policy Gradients for Sample-Efficient Reinforcement Learning in LLM Reasoning
di: Melo, Luckeciano C., et al.
Pubblicazione: (2025)
di: Melo, Luckeciano C., et al.
Pubblicazione: (2025)
Rethinking Policy Diversity in Ensemble Policy Gradient in Large-Scale Reinforcement Learning
di: Shitanda, Naoki, et al.
Pubblicazione: (2026)
di: Shitanda, Naoki, et al.
Pubblicazione: (2026)
LPPG-RL: Lexicographically Projected Policy Gradient Reinforcement Learning with Subproblem Exploration
di: Qiu, Ruiyu, et al.
Pubblicazione: (2025)
di: Qiu, Ruiyu, et al.
Pubblicazione: (2025)
Performative Policy Gradient: Optimality in Performative Reinforcement Learning
di: Basu, Debabrota, et al.
Pubblicazione: (2025)
di: Basu, Debabrota, et al.
Pubblicazione: (2025)
Learning General Policies with Policy Gradient Methods
di: Ståhlberg, Simon, et al.
Pubblicazione: (2025)
di: Ståhlberg, Simon, et al.
Pubblicazione: (2025)
Federated Natural Policy Gradient and Actor Critic Methods for Multi-task Reinforcement Learning
di: Yang, Tong, et al.
Pubblicazione: (2023)
di: Yang, Tong, et al.
Pubblicazione: (2023)
Rank-1 Approximation of Inverse Fisher for Natural Policy Gradients in Deep Reinforcement Learning
di: Huo, Yingxiao, et al.
Pubblicazione: (2026)
di: Huo, Yingxiao, et al.
Pubblicazione: (2026)
Deterministic Policy Gradient for Reinforcement Learning with Continuous Time and State
di: Cheng, Ziheng, et al.
Pubblicazione: (2025)
di: Cheng, Ziheng, et al.
Pubblicazione: (2025)
Gradient Boosting Reinforcement Learning
di: Fuhrer, Benjamin, et al.
Pubblicazione: (2024)
di: Fuhrer, Benjamin, et al.
Pubblicazione: (2024)
ProRL: Effective Reinforcement Learning for Proactive Recommendation via Rectified Policy Gradient Estimation
di: Hou, Hongru, et al.
Pubblicazione: (2026)
di: Hou, Hongru, et al.
Pubblicazione: (2026)
EMA Policy Gradient: Taming Reinforcement Learning for LLMs with EMA Anchor and Top-k KL
di: Zhang, Lunjun, et al.
Pubblicazione: (2026)
di: Zhang, Lunjun, et al.
Pubblicazione: (2026)
Enhancing Hardware Fault Tolerance in Machines with Reinforcement Learning Policy Gradient Algorithms
di: Schoepp, Sheila, et al.
Pubblicazione: (2024)
di: Schoepp, Sheila, et al.
Pubblicazione: (2024)
Reinforcement Learning with Non-Cumulative Objective
di: Cui, Wei, et al.
Pubblicazione: (2023)
di: Cui, Wei, et al.
Pubblicazione: (2023)
Gradient Inversion in Federated Reinforcement Learning
di: He, Shenghong
Pubblicazione: (2025)
di: He, Shenghong
Pubblicazione: (2025)
Rethinking Importance Sampling in LLM Policy Optimization: A Cumulative Token Perspective
di: Zhang, Yuheng, et al.
Pubblicazione: (2026)
di: Zhang, Yuheng, et al.
Pubblicazione: (2026)
Policy Gradient Methods for Risk-Sensitive Distributional Reinforcement Learning with Provable Convergence
di: Xiao, Minheng, et al.
Pubblicazione: (2024)
di: Xiao, Minheng, et al.
Pubblicazione: (2024)
Distilling Reinforcement Learning Policies for Interpretable Robot Locomotion: Gradient Boosting Machines and Symbolic Regression
di: Acero, Fernando, et al.
Pubblicazione: (2024)
di: Acero, Fernando, et al.
Pubblicazione: (2024)
Joint Optimization of Multi-Objective Reinforcement Learning with Policy Gradient Based Algorithm
di: Bai, Qinbo, et al.
Pubblicazione: (2021)
di: Bai, Qinbo, et al.
Pubblicazione: (2021)
Deep Reinforcement Learning with Gradient Eligibility Traces
di: Elelimy, Esraa, et al.
Pubblicazione: (2025)
di: Elelimy, Esraa, et al.
Pubblicazione: (2025)
Reinforcement Learning via Value Gradient Flow
di: Xu, Haoran, et al.
Pubblicazione: (2026)
di: Xu, Haoran, et al.
Pubblicazione: (2026)
On the Role of DAG topology in Energy-Aware Cloud Scheduling : A GNN-Based Deep Reinforcement Learning Approach
di: Hattay, Anas, et al.
Pubblicazione: (2026)
di: Hattay, Anas, et al.
Pubblicazione: (2026)
Multi-Agent Reinforcement Learning for Unmanned Aerial Vehicle Coordination by Multi-Critic Policy Gradient Optimization
di: Alon, Yoav, et al.
Pubblicazione: (2020)
di: Alon, Yoav, et al.
Pubblicazione: (2020)
Accelerating Quantum Reinforcement Learning with a Quantum Natural Policy Gradient Based Approach
di: Xu, Yang, et al.
Pubblicazione: (2025)
di: Xu, Yang, et al.
Pubblicazione: (2025)
Gradient Free Deep Reinforcement Learning With TabPFN
di: Schiff, David, et al.
Pubblicazione: (2025)
di: Schiff, David, et al.
Pubblicazione: (2025)
Metric-Gradient Projection for Stable Multi-Agent Policy Learning
di: Zhang, Zuyuan, et al.
Pubblicazione: (2026)
di: Zhang, Zuyuan, et al.
Pubblicazione: (2026)
Towards Off-Policy Reinforcement Learning for Ranking Policies with Human Feedback
di: Xiao, Teng, et al.
Pubblicazione: (2024)
di: Xiao, Teng, et al.
Pubblicazione: (2024)
Maximum Entropy Reinforcement Learning with Diffusion Policy
di: Dong, Xiaoyi, et al.
Pubblicazione: (2025)
di: Dong, Xiaoyi, et al.
Pubblicazione: (2025)
Offline Reinforcement Learning with Generative Trajectory Policies
di: Feng, Xinsong, et al.
Pubblicazione: (2025)
di: Feng, Xinsong, et al.
Pubblicazione: (2025)
Adaptive Policy Synchronization for Scalable Reinforcement Learning
di: Lafuente-Mercado, Rodney
Pubblicazione: (2025)
di: Lafuente-Mercado, Rodney
Pubblicazione: (2025)
EXPO: Stable Reinforcement Learning with Expressive Policies
di: Dong, Perry, et al.
Pubblicazione: (2025)
di: Dong, Perry, et al.
Pubblicazione: (2025)
Flow-Based Policy for Online Reinforcement Learning
di: Lv, Lei, et al.
Pubblicazione: (2025)
di: Lv, Lei, et al.
Pubblicazione: (2025)
Documenti analoghi
-
On the Global Optimality of Policy Gradient Methods in General Utility Reinforcement Learning
di: Barakat, Anas, et al.
Pubblicazione: (2024) -
Policy Mirror Descent with Lookahead
di: Protopapas, Kimon, et al.
Pubblicazione: (2024) -
The Definitive Guide to Policy Gradients in Deep Reinforcement Learning: Theory, Algorithms and Implementations
di: Lehmann, Matthias
Pubblicazione: (2024) -
Why Pass@k Optimization Can Degrade Pass@1: Prompt Interference in LLM Post-training
di: Barakat, Anas, et al.
Pubblicazione: (2026) -
Policy Gradient Methods for Non-Markovian Reinforcement Learning
di: Kar, Avik, et al.
Pubblicazione: (2026)