Wang, C., Wei, L., Zhang, Y., Shao, C., Dan, Z., Huang, W., . . . Wang, Y. (2025). EFRame: Deeper Reasoning via Exploration-Filter-Replay Reinforcement Learning Framework.
Cita Chicago Style (17a ed.)Wang, Chen, Lai Wei, Yanzhi Zhang, Chenyang Shao, Zedong Dan, Weiran Huang, Yuzhi Zhang, y Yue Wang. EFRame: Deeper Reasoning via Exploration-Filter-Replay Reinforcement Learning Framework. 2025.
Cita MLA (9a ed.)Wang, Chen, et al. EFRame: Deeper Reasoning via Exploration-Filter-Replay Reinforcement Learning Framework. 2025.
Precaución: Estas citas no son 100% exactas.