REFINE-AF: A Task-Agnostic Framework to Align Language Models via Self-Generated Instructions using Reinforcement Learning from Automated Feedback

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: Roy, Aniruddha, Ray, Pretam, Nandy, Abhilash, Aditya, Somak, Goyal, Pawan
Format: Preprint
Published: 2025
Subjects:
Online Access:
Tags: Add Tag
No Tags, Be the first to tag this record!