DeepSeek-Prover-V1.5: Harnessing Proof Assistant Feedback for Reinforcement Learning and Monte-Carlo Tree Search

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: Xin, Huajian, Ren, Z. Z., Song, Junxiao, Shao, Zhihong, Zhao, Wanjia, Wang, Haocheng, Liu, Bo, Zhang, Liyue, Lu, Xuan, Du, Qiushi, Gao, Wenjun, Zhu, Qihao, Yang, Dejian, Gou, Zhibin, Wu, Z. F., Luo, Fuli, Ruan, Chong
Format: Preprint
Published: 2024
Subjects:
Online Access:
Tags: Add Tag
No Tags, Be the first to tag this record!