Vintix II: Decision Pre-Trained Transformer is a Scalable In-Context Reinforcement Learner

Fuente: arXiv
Gespeichert in:
Bibliographische Detailangaben
Hauptverfasser: Polubarov, Andrei, Nikita, Lyubaykin, Derevyagin, Alexander, Grishin, Artyom, Saprygin, Igor, Serkov, Aleksandr, Averchenko, Mark, Tikhonov, Daniil, Zhdanov, Maksim, Nikulin, Alexander, Zisman, Ilya, Klepach, Albina, Zemtsov, Alexey, Kurenkov, Vladislav
Format: Preprint
Veröffentlicht: 2026
Schlagworte:
Online-Zugang:
Tags: Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!

Ähnliche Einträge