Sinha, A., Geist, M., & Mahajan, A. (2025). Convergence of regularized agent-state-based Q-learning in POMDPs.
Cita Chicago Style (17a ed.)Sinha, Amit, Matthieu Geist, y Aditya Mahajan. Convergence of Regularized Agent-state-based Q-learning in POMDPs. 2025.
Cita MLA (9a ed.)Sinha, Amit, et al. Convergence of Regularized Agent-state-based Q-learning in POMDPs. 2025.
Precaución: Estas citas no son 100% exactas.