Learning When to Act or Refuse: Guarding Agentic Reasoning Models for Safe Multi-Step Tool Use

Fuente: arXiv
Enregistré dans:
Détails bibliographiques
Auteurs principaux: Agarwal, Aradhye, Siyan, Gurdit, Pandya, Yash, Singh, Joykirat, Nambi, Akshay, Awadallah, Ahmed
Format: Preprint
Publié: 2026
Sujets:
Accès en ligne:
Tags: Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!

Documents similaires