Towards Safety Reasoning in LLMs: AI-agentic Deliberation for Policy-embedded CoT Data Creation

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: Kumarage, Tharindu, Mehrabi, Ninareh, Ramakrishna, Anil, Zhao, Xinyan, Zemel, Richard, Chang, Kai-Wei, Galstyan, Aram, Gupta, Rahul, Peris, Charith
Format: Preprint
Published: 2025
Subjects:
Online Access:
Tags: Add Tag
No Tags, Be the first to tag this record!

Similar Items