Lin, Y. (2025). MDPO: Multi-Granularity Direct Preference Optimization for Mathematical Reasoning.
Style de citation Chicago (17e éd.)Lin, Yunze. MDPO: Multi-Granularity Direct Preference Optimization for Mathematical Reasoning. 2025.
Style de citation MLA (9e éd.)Lin, Yunze. MDPO: Multi-Granularity Direct Preference Optimization for Mathematical Reasoning. 2025.
Attention : ces citations peuvent ne pas être correctes à 100%.