Modecrua, W., Kaewtawee, K., Pachtrachai, K., & Kraisingkorn, T. (2026). Multi-Turn Reinforcement Learning for Tool-Calling Agents with Iterative Reward Calibration.
Chicago Style (17th ed.) CitationModecrua, Wachiravit, Krittanon Kaewtawee, Krittin Pachtrachai, and Touchapon Kraisingkorn. Multi-Turn Reinforcement Learning for Tool-Calling Agents with Iterative Reward Calibration. 2026.
MLA (9th ed.) CitationModecrua, Wachiravit, et al. Multi-Turn Reinforcement Learning for Tool-Calling Agents with Iterative Reward Calibration. 2026.
Warning: These citations may not always be 100% accurate.