A Differential Perspective on Distributional Reinforcement Learning
Fuente:
arXiv
Guardado en:
| Autores principales: | Rojas, Juan Sebastian, Lee, Chi-Guhn |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Deep Reinforcement Learning and The Tale of Two Temporal Difference Errors
por: Rojas, Juan Sebastian, et al.
Publicado: (2026)
por: Rojas, Juan Sebastian, et al.
Publicado: (2026)
Ergodic Risk Measures: Towards a Risk-Aware Foundation for Continual Reinforcement Learning
por: Rojas, Juan Sebastian, et al.
Publicado: (2025)
por: Rojas, Juan Sebastian, et al.
Publicado: (2025)
Burning RED: Unlocking Subtask-Driven Reinforcement Learning and Risk-Awareness in Average-Reward Markov Decision Processes
por: Rojas, Juan Sebastian, et al.
Publicado: (2024)
por: Rojas, Juan Sebastian, et al.
Publicado: (2024)
Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning
por: Moslemi, Koorosh, et al.
Publicado: (2025)
por: Moslemi, Koorosh, et al.
Publicado: (2025)
Thermodynamics of Reinforcement Learning Curricula
por: Adamczyk, Jacob, et al.
Publicado: (2026)
por: Adamczyk, Jacob, et al.
Publicado: (2026)
Rethinking Adversarial Attacks in Reinforcement Learning from Policy Distribution Perspective
por: Duan, Tianyang, et al.
Publicado: (2025)
por: Duan, Tianyang, et al.
Publicado: (2025)
Differential Information Distribution: A Bayesian Perspective on Direct Preference Optimization
por: Won, Yunjae, et al.
Publicado: (2025)
por: Won, Yunjae, et al.
Publicado: (2025)
PG-Rainbow: Using Distributional Reinforcement Learning in Policy Gradient Methods
por: Jeon, WooJae, et al.
Publicado: (2024)
por: Jeon, WooJae, et al.
Publicado: (2024)
Is Inverse Reinforcement Learning Harder than Standard Reinforcement Learning? A Theoretical Perspective
por: Zhao, Lei, et al.
Publicado: (2023)
por: Zhao, Lei, et al.
Publicado: (2023)
Optimizing Automatic Differentiation with Deep Reinforcement Learning
por: Lohoff, Jamie, et al.
Publicado: (2024)
por: Lohoff, Jamie, et al.
Publicado: (2024)
Bellman Unbiasedness: Toward Provably Efficient Distributional Reinforcement Learning with General Value Function Approximation
por: Cho, Taehyun, et al.
Publicado: (2024)
por: Cho, Taehyun, et al.
Publicado: (2024)
MADQRL: Distributed Quantum Reinforcement Learning Framework for Multi-Agent Environments
por: Sawaika, Abhishek, et al.
Publicado: (2026)
por: Sawaika, Abhishek, et al.
Publicado: (2026)
An Optimal Discriminator Weighted Imitation Perspective for Reinforcement Learning
por: Xu, Haoran, et al.
Publicado: (2025)
por: Xu, Haoran, et al.
Publicado: (2025)
Towards Differentially Private Reinforcement Learning with General Function Approximation
por: He, Yi, et al.
Publicado: (2026)
por: He, Yi, et al.
Publicado: (2026)
Graph Reinforcement Learning for Combinatorial Optimization: A Survey and Unifying Perspective
por: Darvariu, Victor-Alexandru, et al.
Publicado: (2024)
por: Darvariu, Victor-Alexandru, et al.
Publicado: (2024)
Revisiting Generative Policies: A Simpler Reinforcement Learning Algorithmic Perspective
por: Zhang, Jinouwen, et al.
Publicado: (2024)
por: Zhang, Jinouwen, et al.
Publicado: (2024)
Quantile Geometry Regularization for Distributional Reinforcement Learning
por: Zhang, Zhaofan, et al.
Publicado: (2026)
por: Zhang, Zhaofan, et al.
Publicado: (2026)
Conservative Distributional Reinforcement Learning with Safety Constraints
por: Zhang, Hengrui, et al.
Publicado: (2022)
por: Zhang, Hengrui, et al.
Publicado: (2022)
Value-Distributional Model-Based Reinforcement Learning
por: Luis, Carlos E., et al.
Publicado: (2023)
por: Luis, Carlos E., et al.
Publicado: (2023)
Single-Trajectory Distributionally Robust Reinforcement Learning
por: Liang, Zhipeng, et al.
Publicado: (2023)
por: Liang, Zhipeng, et al.
Publicado: (2023)
Diverse Projection Ensembles for Distributional Reinforcement Learning
por: Zanger, Moritz A., et al.
Publicado: (2023)
por: Zanger, Moritz A., et al.
Publicado: (2023)
On Distributional Reinforcement Learning in Chaotic Dynamical Systems
por: Rudd-Jones, James, et al.
Publicado: (2026)
por: Rudd-Jones, James, et al.
Publicado: (2026)
CALF: Communication-Aware Learning Framework for Distributed Reinforcement Learning
por: Purves, Carlos, et al.
Publicado: (2026)
por: Purves, Carlos, et al.
Publicado: (2026)
ARCLE: The Abstraction and Reasoning Corpus Learning Environment for Reinforcement Learning
por: Lee, Hosung, et al.
Publicado: (2024)
por: Lee, Hosung, et al.
Publicado: (2024)
Scaling of Search and Learning: A Roadmap to Reproduce o1 from Reinforcement Learning Perspective
por: Zeng, Zhiyuan, et al.
Publicado: (2024)
por: Zeng, Zhiyuan, et al.
Publicado: (2024)
Normality-Guided Distributional Reinforcement Learning for Continuous Control
por: Byun, Ju-Seung, et al.
Publicado: (2022)
por: Byun, Ju-Seung, et al.
Publicado: (2022)
Preserve Support, Not Correspondence: Dynamic Routing for Offline Reinforcement Learning
por: Mu, Zhancun, et al.
Publicado: (2026)
por: Mu, Zhancun, et al.
Publicado: (2026)
A Survey on Data-Centric AI: Tabular Learning from Reinforcement Learning and Generative AI Perspective
por: Ying, Wangyang, et al.
Publicado: (2025)
por: Ying, Wangyang, et al.
Publicado: (2025)
Revisiting Reinforcement Learning with Verifiable Rewards from a Contrastive Perspective
por: Zhang, Feng, et al.
Publicado: (2026)
por: Zhang, Feng, et al.
Publicado: (2026)
Balance Reward and Safety Optimization for Safe Reinforcement Learning: A Perspective of Gradient Manipulation
por: Gu, Shangding, et al.
Publicado: (2024)
por: Gu, Shangding, et al.
Publicado: (2024)
Rethinking Reinforcement fine-tuning of LLMs: A Multi-armed Bandit Learning Perspective
por: Hu, Xiao, et al.
Publicado: (2026)
por: Hu, Xiao, et al.
Publicado: (2026)
Thinking with Deltas: Incentivizing Reinforcement Learning via Differential Visual Reasoning Policy
por: Gao, Shujian, et al.
Publicado: (2026)
por: Gao, Shujian, et al.
Publicado: (2026)
Diffusion-Augmented Markov Decision Processes for Maximum Entropy Reinforcement Learning
por: Sanokowski, Sebastian, et al.
Publicado: (2025)
por: Sanokowski, Sebastian, et al.
Publicado: (2025)
Flow-based Policy With Distributional Reinforcement Learning in Trajectory Optimization
por: Hao, Ruijie, et al.
Publicado: (2026)
por: Hao, Ruijie, et al.
Publicado: (2026)
Plasticity Loss in Deep Reinforcement Learning: A Survey
por: Klein, Timo, et al.
Publicado: (2024)
por: Klein, Timo, et al.
Publicado: (2024)
A New Perspective on Transformers in Online Reinforcement Learning for Continuous Control
por: Kachaev, Nikita, et al.
Publicado: (2025)
por: Kachaev, Nikita, et al.
Publicado: (2025)
Rethinking the Sampling Criteria in Reinforcement Learning for LLM Reasoning: A Competence-Difficulty Alignment Perspective
por: Kong, Deyang, et al.
Publicado: (2025)
por: Kong, Deyang, et al.
Publicado: (2025)
Demystifying Design Choices of Reinforcement Fine-tuning: A Batched Contextual Bandit Learning Perspective
por: Xie, Hong, et al.
Publicado: (2026)
por: Xie, Hong, et al.
Publicado: (2026)
A2PO: Towards Effective Offline Reinforcement Learning from an Advantage-aware Perspective
por: Qing, Yunpeng, et al.
Publicado: (2024)
por: Qing, Yunpeng, et al.
Publicado: (2024)
FairDICE: Fairness-Driven Offline Multi-Objective Reinforcement Learning
por: Kim, Woosung, et al.
Publicado: (2025)
por: Kim, Woosung, et al.
Publicado: (2025)
Ejemplares similares
-
Deep Reinforcement Learning and The Tale of Two Temporal Difference Errors
por: Rojas, Juan Sebastian, et al.
Publicado: (2026) -
Ergodic Risk Measures: Towards a Risk-Aware Foundation for Continual Reinforcement Learning
por: Rojas, Juan Sebastian, et al.
Publicado: (2025) -
Burning RED: Unlocking Subtask-Driven Reinforcement Learning and Risk-Awareness in Average-Reward Markov Decision Processes
por: Rojas, Juan Sebastian, et al.
Publicado: (2024) -
Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning
por: Moslemi, Koorosh, et al.
Publicado: (2025) -
Thermodynamics of Reinforcement Learning Curricula
por: Adamczyk, Jacob, et al.
Publicado: (2026)