Your Offline Policy is Not Trustworthy: Bilevel Reinforcement Learning for Sequential Portfolio Optimization

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Yuan, Haochen, Pan, Minting, Wang, Yunbo, Gao, Siyu, Yu, Philip S., Yang, Xiaokang
Formato: Preprint
Publicado: 2025
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!