Discretizing Continuous Action Space with Unimodal Probability Distributions for On-Policy Reinforcement Learning
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Zhu, Yuanyang, Wang, Zhi, Zhu, Yuanheng, Chen, Chunlin, Zhao, Dongbin |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Learning Individual Intrinsic Reward in Multi-Agent Reinforcement Learning via Incorporating Generalized Human Expertise
von: Wu, Xuefei, et al.
Veröffentlicht: (2025)
von: Wu, Xuefei, et al.
Veröffentlicht: (2025)
RLAE: Reinforcement Learning-Assisted Ensemble for LLMs
von: Fu, Yuqian, et al.
Veröffentlicht: (2025)
von: Fu, Yuqian, et al.
Veröffentlicht: (2025)
Revisiting On-Policy Distillation: Empirical Failure Modes and Simple Fixes
von: Fu, Yuqian, et al.
Veröffentlicht: (2026)
von: Fu, Yuqian, et al.
Veröffentlicht: (2026)
DipLLM: Fine-Tuning LLM for Strategic Decision-making in Diplomacy
von: Xu, Kaixuan, et al.
Veröffentlicht: (2025)
von: Xu, Kaixuan, et al.
Veröffentlicht: (2025)
Concept Learning for Cooperative Multi-Agent Reinforcement Learning
von: Ge, Zhonghan, et al.
Veröffentlicht: (2025)
von: Ge, Zhonghan, et al.
Veröffentlicht: (2025)
Learning Future Representation with Synthetic Observations for Sample-efficient Reinforcement Learning
von: Liu, Xin, et al.
Veröffentlicht: (2024)
von: Liu, Xin, et al.
Veröffentlicht: (2024)
Continual Offline Reinforcement Learning via Diffusion-based Dual Generative Replay
von: Liu, Jinmei, et al.
Veröffentlicht: (2024)
von: Liu, Jinmei, et al.
Veröffentlicht: (2024)
Meta-DT: Offline Meta-RL as Conditional Sequence Modeling with World Model Disentanglement
von: Wang, Zhi, et al.
Veröffentlicht: (2024)
von: Wang, Zhi, et al.
Veröffentlicht: (2024)
SRFT: A Single-Stage Method with Supervised and Reinforcement Fine-Tuning for Reasoning
von: Fu, Yuqian, et al.
Veröffentlicht: (2025)
von: Fu, Yuqian, et al.
Veröffentlicht: (2025)
On the Geometry of Reinforcement Learning in Continuous State and Action Spaces
von: Tiwari, Saket, et al.
Veröffentlicht: (2022)
von: Tiwari, Saket, et al.
Veröffentlicht: (2022)
Provably Efficient Action-Manipulation Attack Against Continuous Reinforcement Learning
von: Luo, Zhi, et al.
Veröffentlicht: (2024)
von: Luo, Zhi, et al.
Veröffentlicht: (2024)
Breaking the Grid: Distance-Guided Reinforcement Learning in Large Discrete Action Spaces
von: Hoppe, Heiko, et al.
Veröffentlicht: (2026)
von: Hoppe, Heiko, et al.
Veröffentlicht: (2026)
Policy Optimization in Hybrid Discrete-Continuous Action Spaces via Mixed Gradients
von: Alvo, Matias, et al.
Veröffentlicht: (2026)
von: Alvo, Matias, et al.
Veröffentlicht: (2026)
Geometry of Neural Reinforcement Learning in Continuous State and Action Spaces
von: Tiwari, Saket, et al.
Veröffentlicht: (2025)
von: Tiwari, Saket, et al.
Veröffentlicht: (2025)
SAINT: Attention-Based Policies for Discrete Combinatorial Action Spaces
von: Landers, Matthew, et al.
Veröffentlicht: (2025)
von: Landers, Matthew, et al.
Veröffentlicht: (2025)
Action-Adaptive Continual Learning: Enabling Policy Generalization under Dynamic Action Spaces
von: Pan, Chaofan, et al.
Veröffentlicht: (2025)
von: Pan, Chaofan, et al.
Veröffentlicht: (2025)
Unimodal Distributions for Ordinal Regression
von: Cardoso, Jaime S., et al.
Veröffentlicht: (2023)
von: Cardoso, Jaime S., et al.
Veröffentlicht: (2023)
Cross-domain Random Pre-training with Prototypes for Reinforcement Learning
von: Liu, Xin, et al.
Veröffentlicht: (2023)
von: Liu, Xin, et al.
Veröffentlicht: (2023)
Mixture-of-Experts Meets In-Context Reinforcement Learning
von: Wu, Wenhao, et al.
Veröffentlicht: (2025)
von: Wu, Wenhao, et al.
Veröffentlicht: (2025)
Preferred-Action-Optimized Diffusion Policies for Offline Reinforcement Learning
von: Zhang, Tianle, et al.
Veröffentlicht: (2024)
von: Zhang, Tianle, et al.
Veröffentlicht: (2024)
Harnessing Discrete Representations For Continual Reinforcement Learning
von: Meyer, Edan, et al.
Veröffentlicht: (2023)
von: Meyer, Edan, et al.
Veröffentlicht: (2023)
In-Context Reinforcement Learning for Variable Action Spaces
von: Sinii, Viacheslav, et al.
Veröffentlicht: (2023)
von: Sinii, Viacheslav, et al.
Veröffentlicht: (2023)
Counterfactual Explanations for Continuous Action Reinforcement Learning
von: Dong, Shuyang, et al.
Veröffentlicht: (2025)
von: Dong, Shuyang, et al.
Veröffentlicht: (2025)
An Advantage-based Optimization Method for Reinforcement Learning in Large Action Space
von: Lin, Hai, et al.
Veröffentlicht: (2024)
von: Lin, Hai, et al.
Veröffentlicht: (2024)
MIXRTs: Toward Interpretable Multi-Agent Reinforcement Learning via Mixing Recurrent Soft Decision Trees
von: Liu, Zichuan, et al.
Veröffentlicht: (2022)
von: Liu, Zichuan, et al.
Veröffentlicht: (2022)
Sample and Computationally Efficient Continuous-Time Reinforcement Learning with General Function Approximation
von: Zhao, Runze, et al.
Veröffentlicht: (2025)
von: Zhao, Runze, et al.
Veröffentlicht: (2025)
FM3Q: Factorized Multi-Agent MiniMax Q-Learning for Two-Team Zero-Sum Markov Game
von: Hu, Guangzheng, et al.
Veröffentlicht: (2024)
von: Hu, Guangzheng, et al.
Veröffentlicht: (2024)
Online Preference-based Reinforcement Learning with Self-augmented Feedback from Large Language Model
von: Tu, Songjun, et al.
Veröffentlicht: (2024)
von: Tu, Songjun, et al.
Veröffentlicht: (2024)
CAMEL: Continuous Action Masking Enabled by Large Language Models for Reinforcement Learning
von: Zhao, Yanxiao, et al.
Veröffentlicht: (2025)
von: Zhao, Yanxiao, et al.
Veröffentlicht: (2025)
Dual Action Policy for Robust Sim-to-Real Reinforcement Learning
von: Terence, Ng Wen Zheng, et al.
Veröffentlicht: (2024)
von: Terence, Ng Wen Zheng, et al.
Veröffentlicht: (2024)
In-Dataset Trajectory Return Regularization for Offline Preference-based Reinforcement Learning
von: Tu, Songjun, et al.
Veröffentlicht: (2024)
von: Tu, Songjun, et al.
Veröffentlicht: (2024)
Robust Deep Reinforcement Learning with Adaptive Adversarial Perturbations in Action Space
von: Liu, Qianmei, et al.
Veröffentlicht: (2024)
von: Liu, Qianmei, et al.
Veröffentlicht: (2024)
Model-based Reinforcement Learning for Parameterized Action Spaces
von: Zhang, Renhao, et al.
Veröffentlicht: (2024)
von: Zhang, Renhao, et al.
Veröffentlicht: (2024)
ISEP: Implicit Support Expansion for Offline Reinforcement Learning via Stochastic Policy Optimization
von: Chen, Yifei, et al.
Veröffentlicht: (2026)
von: Chen, Yifei, et al.
Veröffentlicht: (2026)
A Hierarchical Deep Reinforcement Learning Framework for 6-DOF UCAV Air-to-Air Combat
von: Chai, Jiajun, et al.
Veröffentlicht: (2022)
von: Chai, Jiajun, et al.
Veröffentlicht: (2022)
Equivariant Action Sampling for Reinforcement Learning and Planning
von: Zhao, Linfeng, et al.
Veröffentlicht: (2024)
von: Zhao, Linfeng, et al.
Veröffentlicht: (2024)
SofT-GRPO: Surpassing Discrete-Token LLM Reinforcement Learning via Gumbel-Reparameterized Soft-Thinking Policy Optimization
von: Zheng, Zhi, et al.
Veröffentlicht: (2025)
von: Zheng, Zhi, et al.
Veröffentlicht: (2025)
Meta-Learn Unimodal Signals with Weak Supervision for Multimodal Sentiment Analysis
von: Mai, Sijie, et al.
Veröffentlicht: (2024)
von: Mai, Sijie, et al.
Veröffentlicht: (2024)
Bayesian Off-Policy Evaluation and Learning for Large Action Spaces
von: Aouali, Imad, et al.
Veröffentlicht: (2024)
von: Aouali, Imad, et al.
Veröffentlicht: (2024)
Incentivizing Safer Actions in Policy Optimization for Constrained Reinforcement Learning
von: Hazra, Somnath, et al.
Veröffentlicht: (2025)
von: Hazra, Somnath, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Learning Individual Intrinsic Reward in Multi-Agent Reinforcement Learning via Incorporating Generalized Human Expertise
von: Wu, Xuefei, et al.
Veröffentlicht: (2025) -
RLAE: Reinforcement Learning-Assisted Ensemble for LLMs
von: Fu, Yuqian, et al.
Veröffentlicht: (2025) -
Revisiting On-Policy Distillation: Empirical Failure Modes and Simple Fixes
von: Fu, Yuqian, et al.
Veröffentlicht: (2026) -
DipLLM: Fine-Tuning LLM for Strategic Decision-making in Diplomacy
von: Xu, Kaixuan, et al.
Veröffentlicht: (2025) -
Concept Learning for Cooperative Multi-Agent Reinforcement Learning
von: Ge, Zhonghan, et al.
Veröffentlicht: (2025)