ECHO: Entropy-Confidence Hybrid Optimization for Test-Time Reinforcement Learning

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Zhao, Chu, Yang, Enneng, Liu, Yuting, Zhao, Jianzhe, Guo, Guibing
Natura: Preprint
Pubblicazione: 2026
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!

Documenti analoghi