Overview of AI Grading of Physics Olympiad Exams
Fuente:
arXiv
Saved in:
| Main Author: | McGinness, Lachlan |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
The AlphaPhysics Term Rewriting System for Marking Algebraic Expressions in Physics Exams
by: Baumgartner, Peter, et al.
Published: (2025)
by: Baumgartner, Peter, et al.
Published: (2025)
Large Language Models' Reasoning Stalls: An Investigation into the Capabilities of Frontier Models
by: McGinness, Lachlan, et al.
Published: (2025)
by: McGinness, Lachlan, et al.
Published: (2025)
Highlighting Case Studies in LLM Literature Review of Interdisciplinary System Science
by: McGinness, Lachlan, et al.
Published: (2025)
by: McGinness, Lachlan, et al.
Published: (2025)
Steamroller Problems: An Evaluation of LLM Reasoning Capability with Automated Theorem Prover Strategies
by: McGinness, Lachlan, et al.
Published: (2024)
by: McGinness, Lachlan, et al.
Published: (2024)
Large Language Models Imitate Logical Reasoning, but at what Cost?
by: McGinness, Lachlan, et al.
Published: (2025)
by: McGinness, Lachlan, et al.
Published: (2025)
CON-FOLD -- Explainable Machine Learning with Confidence
by: McGinness, Lachlan, et al.
Published: (2024)
by: McGinness, Lachlan, et al.
Published: (2024)
Automated Theorem Provers Help Improve Large Language Model Reasoning
by: McGinness, Lachlan, et al.
Published: (2024)
by: McGinness, Lachlan, et al.
Published: (2024)
The Benefits and Challenges of a Quantum Computing Concept Inventory
by: McGinness, Lachlan
Published: (2025)
by: McGinness, Lachlan
Published: (2025)
Can Large Language Models Correctly Interpret Equations with Errors?
by: McGinness, Lachlan, et al.
Published: (2025)
by: McGinness, Lachlan, et al.
Published: (2025)
LLM Olympiad: Why Model Evaluation Needs a Sealed Exam
by: Cruz, Jan Christian Blaise, et al.
Published: (2026)
by: Cruz, Jan Christian Blaise, et al.
Published: (2026)
Evaluating Large Language Models on Multimodal Chemistry Olympiad Exams
by: Cui, Yiming, et al.
Published: (2025)
by: Cui, Yiming, et al.
Published: (2025)
DOoM: Difficult Olympiads of Math
by: Kuleshov, Ilya, et al.
Published: (2025)
by: Kuleshov, Ilya, et al.
Published: (2025)
Mastering Olympiad-Level Physics with Artificial Intelligence
by: Jian, Dong-Shan, et al.
Published: (2025)
by: Jian, Dong-Shan, et al.
Published: (2025)
P1-VL: Bridging Visual Perception and Scientific Reasoning in Physics Olympiads
by: Luo, Yun, et al.
Published: (2026)
by: Luo, Yun, et al.
Published: (2026)
P1: Mastering Physics Olympiads with Reinforcement Learning
by: Chen, Jiacheng, et al.
Published: (2025)
by: Chen, Jiacheng, et al.
Published: (2025)
Artificial-Intelligence Grading Assistance for Handwritten Components of a Calculus Exam
by: Kortemeyer, Gerd, et al.
Published: (2025)
by: Kortemeyer, Gerd, et al.
Published: (2025)
Assisting the Grading of a Handwritten General Chemistry Exam with Artificial Intelligence
by: Cvengros, Jan, et al.
Published: (2025)
by: Cvengros, Jan, et al.
Published: (2025)
Proving Olympiad Inequalities by Synergizing LLMs and Symbolic Reasoning
by: Li, Zenan, et al.
Published: (2025)
by: Li, Zenan, et al.
Published: (2025)
OIBench: Benchmarking Strong Reasoning Models with Olympiad in Informatics
by: Zhu, Yaoming, et al.
Published: (2025)
by: Zhu, Yaoming, et al.
Published: (2025)
PhysicsMinions: Winning Gold Medals in the Latest Physics Olympiads with a Coevolutionary Multimodal Multi-Agent System
by: Yu, Fangchen, et al.
Published: (2025)
by: Yu, Fangchen, et al.
Published: (2025)
Machine-Assisted Grading of Nationwide School-Leaving Essay Exams with LLMs and Statistical NLP
by: Karjus, Andres, et al.
Published: (2026)
by: Karjus, Andres, et al.
Published: (2026)
Solving Physics Olympiad via Reinforcement Learning on Physics Simulators
by: Prabhudesai, Mihir, et al.
Published: (2026)
by: Prabhudesai, Mihir, et al.
Published: (2026)
FormalGeo: An Extensible Formalized Framework for Olympiad Geometric Problem Solving
by: Zhang, Xiaokai, et al.
Published: (2023)
by: Zhang, Xiaokai, et al.
Published: (2023)
HiPhO: How Far Are (M)LLMs from Humans in the Latest High School Physics Olympiad Benchmark?
by: Yu, Fangchen, et al.
Published: (2025)
by: Yu, Fangchen, et al.
Published: (2025)
RIMO: An Easy-to-Evaluate, Hard-to-Solve Olympiad Benchmark for Advanced Mathematical Reasoning
by: Chen, Ziye, et al.
Published: (2025)
by: Chen, Ziye, et al.
Published: (2025)
Can Language Models Solve Olympiad Programming?
by: Shi, Quan, et al.
Published: (2024)
by: Shi, Quan, et al.
Published: (2024)
Brains vs. Bytes: Evaluating LLM Proficiency in Olympiad Mathematics
by: Mahdavi, Hamed, et al.
Published: (2025)
by: Mahdavi, Hamed, et al.
Published: (2025)
CombiGraph-Vis: A Curated Multimodal Olympiad Benchmark for Discrete Mathematical Reasoning
by: Mahdavi, Hamed, et al.
Published: (2025)
by: Mahdavi, Hamed, et al.
Published: (2025)
AI-assisted Gaze Detection for Proctoring Online Exams
by: Shih, Yong-Siang, et al.
Published: (2024)
by: Shih, Yong-Siang, et al.
Published: (2024)
Gold-medalist Performance in Solving Olympiad Geometry with AlphaGeometry2
by: Chervonyi, Yuri, et al.
Published: (2025)
by: Chervonyi, Yuri, et al.
Published: (2025)
Long-horizon Reasoning Agent for Olympiad-Level Mathematical Problem Solving
by: Gao, Songyang, et al.
Published: (2025)
by: Gao, Songyang, et al.
Published: (2025)
Can We Trust AI to Govern AI? Benchmarking LLM Performance on Privacy and AI Governance Exams
by: Witherspoon, Zane, et al.
Published: (2025)
by: Witherspoon, Zane, et al.
Published: (2025)
Gold-Medal-Level Olympiad Geometry Solving with Efficient Heuristic Auxiliary Constructions
by: Duan, Boyan, et al.
Published: (2025)
by: Duan, Boyan, et al.
Published: (2025)
Achieving Gold-Medal-Level Olympiad Reasoning via Simple and Unified Scaling
by: Li, Yafu, et al.
Published: (2026)
by: Li, Yafu, et al.
Published: (2026)
SBSC: Step-By-Step Coding for Improving Mathematical Olympiad Performance
by: Singh, Kunal, et al.
Published: (2025)
by: Singh, Kunal, et al.
Published: (2025)
Evaluating GPT- and Reasoning-based Large Language Models on Physics Olympiad Problems: Surpassing Human Performance and Implications for Educational Assessment
by: Tschisgale, Paul, et al.
Published: (2025)
by: Tschisgale, Paul, et al.
Published: (2025)
Xolver: Multi-Agent Reasoning with Holistic Experience Learning Just Like an Olympiad Team
by: Hosain, Md Tanzib, et al.
Published: (2025)
by: Hosain, Md Tanzib, et al.
Published: (2025)
OptProver: Bridging Olympiad and Optimization through Continual Training in Formal Theorem Proving
by: Li, Chenyi, et al.
Published: (2026)
by: Li, Chenyi, et al.
Published: (2026)
Assessing the Quality of AI-Generated Exams: A Large-Scale Field Study
by: Isley, Calvin, et al.
Published: (2025)
by: Isley, Calvin, et al.
Published: (2025)
Making Quantum Accessible: A Seven-Category Framework for K-12 Quantum Education
by: Fernandez, Rhea, et al.
Published: (2025)
by: Fernandez, Rhea, et al.
Published: (2025)
Similar Items
-
The AlphaPhysics Term Rewriting System for Marking Algebraic Expressions in Physics Exams
by: Baumgartner, Peter, et al.
Published: (2025) -
Large Language Models' Reasoning Stalls: An Investigation into the Capabilities of Frontier Models
by: McGinness, Lachlan, et al.
Published: (2025) -
Highlighting Case Studies in LLM Literature Review of Interdisciplinary System Science
by: McGinness, Lachlan, et al.
Published: (2025) -
Steamroller Problems: An Evaluation of LLM Reasoning Capability with Automated Theorem Prover Strategies
by: McGinness, Lachlan, et al.
Published: (2024) -
Large Language Models Imitate Logical Reasoning, but at what Cost?
by: McGinness, Lachlan, et al.
Published: (2025)