Ahmadi, A., Sharif, S., Yaser, & Banad. (2026). Enhanced LLM Reasoning by Optimizing Reward Functions with Search-Driven Reinforcement Learning.
Chicago Style (17th ed.) CitationAhmadi, Arash, Sarah Sharif, Yaser, and Banad. Enhanced LLM Reasoning by Optimizing Reward Functions with Search-Driven Reinforcement Learning. 2026.
MLA (9th ed.) CitationAhmadi, Arash, et al. Enhanced LLM Reasoning by Optimizing Reward Functions with Search-Driven Reinforcement Learning. 2026.
Warning: These citations may not always be 100% accurate.