Solway, A. (2024). Reinforcement Learning without Human Feedback for Last Mile Fine-Tuning of Large Language Models.
Citazione stile Chigago Style (17a edizione)Solway, Alec. Reinforcement Learning Without Human Feedback for Last Mile Fine-Tuning of Large Language Models. 2024.
Citatione MLA (9a ed.)Solway, Alec. Reinforcement Learning Without Human Feedback for Last Mile Fine-Tuning of Large Language Models. 2024.
Attenzione: Queste citazioni potrebbero non essere precise al 100%.