Stop Unnecessary Reflection: Training LRMs for Efficient Reasoning with Adaptive Reflection and Length Coordinated Penalty

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Yu, Zewei, Gao, Lirong, Zhu, Yuke, Zheng, Bo, Zhao, Junbo, Guo, Sheng, Wang, Haobo
Natura: Preprint
Pubblicazione: 2026
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!