StepTool: Enhancing Multi-Step Tool Usage in LLMs via Step-Grained Reinforcement Learning

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Yu, Yuanqing, Wang, Zhefan, Ma, Weizhi, Wang, Shuai, Wu, Chuhan, Guo, Zhiqiang, Zhang, Min
Natura: Preprint
Pubblicazione: 2024
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!