AgentEscapeBench: Evaluating Out-of-Domain Tool-Grounded Reasoning in LLM Agents

Fuente: arXiv
Enregistré dans:
Détails bibliographiques
Auteurs principaux: Guo, Zhengkang, Li, Yiyang, Qiu, Lin, Wang, Xiaohua, Xv, Jingwen, Ru, Dongyu, Li, Xiaoyu, Zheng, Xiaoqing, Cao, Xuezhi, Cai, Xunliang
Format: Preprint
Publié: 2026
Sujets:
Accès en ligne:
Tags: Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!