Accessing GPT-4 level Mathematical Olympiad Solutions via Monte Carlo Tree Self-refine with LLaMa-3 8B
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Di, Huang, Xiaoshui, Zhou, Dongzhan, Li, Yuqiang, Ouyang, Wanli |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
LLaMA-Berry: Pairwise Optimization for O1-like Olympiad-Level Mathematical Reasoning
par: Zhang, Di, et autres
Publié: (2024)
par: Zhang, Di, et autres
Publié: (2024)
A Deep User Interface for Exploring LLaMa
par: Perumal, Divya, et autres
Publié: (2025)
par: Perumal, Divya, et autres
Publié: (2025)
LLaMa-SciQ: An Educational Chatbot for Answering Science MCQ
par: Allard, Marc-Antoine, et autres
Publié: (2024)
par: Allard, Marc-Antoine, et autres
Publié: (2024)
Training Dynamics of a 1.7B LLaMa Model: A Data-Efficient Approach
par: Li, Miles Q., et autres
Publié: (2024)
par: Li, Miles Q., et autres
Publié: (2024)
Benchmarking quantized LLaMa-based models on the Brazilian Secondary School Exam
par: Santos, Matheus L. O., et autres
Publié: (2023)
par: Santos, Matheus L. O., et autres
Publié: (2023)
Evaluating LLMs for Quotation Attribution in Literary Texts: A Case Study of LLaMa3
par: Michel, Gaspard, et autres
Publié: (2024)
par: Michel, Gaspard, et autres
Publié: (2024)
SELT: Self-Evaluation Tree Search for LLMs with Task Decomposition
par: Wu, Mengsong, et autres
Publié: (2025)
par: Wu, Mengsong, et autres
Publié: (2025)
PhysicsMinions: Winning Gold Medals in the Latest Physics Olympiads with a Coevolutionary Multimodal Multi-Agent System
par: Yu, Fangchen, et autres
Publié: (2025)
par: Yu, Fangchen, et autres
Publié: (2025)
MOOSE-Chem3: Toward Experiment-Guided Hypothesis Ranking via Simulated Experimental Feedback
par: Liu, Wanhao, et autres
Publié: (2025)
par: Liu, Wanhao, et autres
Publié: (2025)
Revisiting the Broken Symmetry Phase of Solid Hydrogen: A Neural Network Variational Monte Carlo Study
par: Chai, Shengdu, et autres
Publié: (2025)
par: Chai, Shengdu, et autres
Publié: (2025)
Online Test-time Adaptation for Interatomic Potentials
par: Cui, Taoyong, et autres
Publié: (2024)
par: Cui, Taoyong, et autres
Publié: (2024)
ChemMLLM: Chemical Multimodal Large Language Model
par: Tan, Qian, et autres
Publié: (2025)
par: Tan, Qian, et autres
Publié: (2025)
Iterative Pretraining Framework for Interatomic Potentials
par: Cui, Taoyong, et autres
Publié: (2025)
par: Cui, Taoyong, et autres
Publié: (2025)
A CLIP-Powered Framework for Robust and Generalizable Data Selection
par: Yang, Suorong, et autres
Publié: (2024)
par: Yang, Suorong, et autres
Publié: (2024)
ResearchBench: Benchmarking LLMs in Scientific Discovery via Inspiration-Based Task Decomposition
par: Liu, Yujie, et autres
Publié: (2025)
par: Liu, Yujie, et autres
Publié: (2025)
MOOSE-Chem: Large Language Models for Rediscovering Unseen Chemistry Scientific Hypotheses
par: Yang, Zonglin, et autres
Publié: (2024)
par: Yang, Zonglin, et autres
Publié: (2024)
NeRF-Det++: Incorporating Semantic Cues and Perspective-aware Depth Supervision for Indoor Multi-View 3D Detection
par: Huang, Chenxi, et autres
Publié: (2024)
par: Huang, Chenxi, et autres
Publié: (2024)
MeshCraft: Exploring Efficient and Controllable Mesh Generation with Flow-based DiTs
par: He, Xianglong, et autres
Publié: (2025)
par: He, Xianglong, et autres
Publié: (2025)
Discovering Mathematical Formulas from Data via GPT-guided Monte Carlo Tree Search
par: Li, Yanjie, et autres
Publié: (2024)
par: Li, Yanjie, et autres
Publié: (2024)
EEFSUVA: A New Mathematical Olympiad Benchmark
par: Khatibi, Nicole N, et autres
Publié: (2025)
par: Khatibi, Nicole N, et autres
Publié: (2025)
GPT4Vis: What Can GPT-4 Do for Zero-shot Visual Recognition?
par: Wu, Wenhao, et autres
Publié: (2023)
par: Wu, Wenhao, et autres
Publié: (2023)
CrystalX: High-accuracy Crystal Structure Analysis Using Deep Learning
par: Zheng, Kaipeng, et autres
Publié: (2024)
par: Zheng, Kaipeng, et autres
Publié: (2024)
Report on the 61st Annual International Mathematical Olympiad
par: Bajnok, Bela, et autres
Publié: (2024)
par: Bajnok, Bela, et autres
Publié: (2024)
Report on the 63rd Annual International Mathematical Olympiad
par: Bajnok, Béla
Publié: (2025)
par: Bajnok, Béla
Publié: (2025)
Math Matters of the Past (The Very First Mathematical Olympiads)
par: Fomin, Dmitri
Publié: (2025)
par: Fomin, Dmitri
Publié: (2025)
Report on the 50th Annual USA Mathematical Olympiad
par: Bajnok, Bela
Publié: (2024)
par: Bajnok, Bela
Publié: (2024)
LOCR: Location-Guided Transformer for Optical Character Recognition
par: Sun, Yu, et autres
Publié: (2024)
par: Sun, Yu, et autres
Publié: (2024)
GVGEN: Text-to-3D Generation with Volumetric Representation
par: He, Xianglong, et autres
Publié: (2024)
par: He, Xianglong, et autres
Publié: (2024)
PromptCoT: Synthesizing Olympiad-level Problems for Mathematical Reasoning in Large Language Models
par: Zhao, Xueliang, et autres
Publié: (2025)
par: Zhao, Xueliang, et autres
Publié: (2025)
Evidential Deep Learning for Interatomic Potentials
par: Xu, Han, et autres
Publié: (2024)
par: Xu, Han, et autres
Publié: (2024)
Attention Reallocation: Towards Zero-cost and Controllable Hallucination Mitigation of MLLMs
par: Tu, Chongjun, et autres
Publié: (2025)
par: Tu, Chongjun, et autres
Publié: (2025)
Brains vs. Bytes: Evaluating LLM Proficiency in Olympiad Mathematics
par: Mahdavi, Hamed, et autres
Publié: (2025)
par: Mahdavi, Hamed, et autres
Publié: (2025)
Report on the 12th Annual USA Junior Mathematical Olympiad
par: Bajnok, Bela, et autres
Publié: (2024)
par: Bajnok, Bela, et autres
Publié: (2024)
Evaluating Large Vision-and-Language Models on Children's Mathematical Olympiads
par: Cherian, Anoop, et autres
Publié: (2024)
par: Cherian, Anoop, et autres
Publié: (2024)
SBSC: Step-By-Step Coding for Improving Mathematical Olympiad Performance
par: Singh, Kunal, et autres
Publié: (2025)
par: Singh, Kunal, et autres
Publié: (2025)
Taming Stable Diffusion for Text to 360° Panorama Image Generation
par: Zhang, Cheng, et autres
Publié: (2024)
par: Zhang, Cheng, et autres
Publié: (2024)
CogAtom: From Cognitive Atoms to Olympiad-level Mathematical Reasoning in Large Language Models
par: Chen, Zhuofan, et autres
Publié: (2025)
par: Chen, Zhuofan, et autres
Publié: (2025)
Control-R: Towards controllable test-time scaling
par: Zhang, Di, et autres
Publié: (2025)
par: Zhang, Di, et autres
Publié: (2025)
Incremental Structure Discovery of Classification via Sequential Monte Carlo
par: Huang, Changze, et autres
Publié: (2024)
par: Huang, Changze, et autres
Publié: (2024)
Qwen2.5-32B: Leveraging Self-Consistent Tool-Integrated Reasoning for Bengali Mathematical Olympiad Problem Solving
par: Tahmid, Saad, et autres
Publié: (2024)
par: Tahmid, Saad, et autres
Publié: (2024)
Documents similaires
-
LLaMA-Berry: Pairwise Optimization for O1-like Olympiad-Level Mathematical Reasoning
par: Zhang, Di, et autres
Publié: (2024) -
A Deep User Interface for Exploring LLaMa
par: Perumal, Divya, et autres
Publié: (2025) -
LLaMa-SciQ: An Educational Chatbot for Answering Science MCQ
par: Allard, Marc-Antoine, et autres
Publié: (2024) -
Training Dynamics of a 1.7B LLaMa Model: A Data-Efficient Approach
par: Li, Miles Q., et autres
Publié: (2024) -
Benchmarking quantized LLaMa-based models on the Brazilian Secondary School Exam
par: Santos, Matheus L. O., et autres
Publié: (2023)