Dieker, A. B., Hackman, S. T., Wang, Z., & Yan, Y. (2026). QPLEX Decision Processes: Formulation via Nonlinear Markov Chains and Optimization via Policy Gradients.
Chicago-Zitierstil (17. Ausg.)Dieker, Antonius B., Steven T. Hackman, Zitong Wang, und Yunhao Yan. QPLEX Decision Processes: Formulation via Nonlinear Markov Chains and Optimization via Policy Gradients. 2026.
MLA-Zitierstil (9. Ausg.)Dieker, Antonius B., et al. QPLEX Decision Processes: Formulation via Nonlinear Markov Chains and Optimization via Policy Gradients. 2026.
Achtung: Diese Zitate sind unter Umständen nicht zu 100% korrekt.