Fine-tuning Reinforcement Learning Models is Secretly a Forgetting Mitigation Problem

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: Wołczyk, Maciej, Cupiał, Bartłomiej, Ostaszewski, Mateusz, Bortkiewicz, Michał, Zając, Michał, Pascanu, Razvan, Kuciński, Łukasz, Miłoś, Piotr
Format: Preprint
Published: 2024
Subjects:
Online Access:
Tags: Add Tag
No Tags, Be the first to tag this record!