CG-TTRL: Context-Guided Test-Time Reinforcement Learning for On-Device Large Language Models

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Hosseini, Peyman, Bohdal, Ondrej, Ceritli, Taha, Castro, Ignacio, Purver, Matthew, Ozay, Mete, Michieli, Umberto
Natura: Preprint
Pubblicazione: 2025
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!