Saved in:
| Main Authors: | Tschisgale, Paul, Maus, Holger, Kieser, Fabian, Kroehs, Ben, Petersen, Stefan, Wulff, Peter |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | https://arxiv.org/abs/2505.09438 |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Developing and Evaluating a Large Language Model-Based Automated Feedback System Grounded in Evidence-Centered Design for Supporting Physics Problem Solving
by: Maus, Holger, et al.
Published: (2025)
by: Maus, Holger, et al.
Published: (2025)
Daily and Weekly Periodicity in Large Language Model Performance and Its Implications for Research
by: Tschisgale, Paul, et al.
Published: (2026)
by: Tschisgale, Paul, et al.
Published: (2026)
Evaluating NLP Embedding Models for Handling Science-Specific Symbolic Expressions in Student Texts
by: Bleckmann, Tom, et al.
Published: (2025)
by: Bleckmann, Tom, et al.
Published: (2025)
PromptCoT: Synthesizing Olympiad-level Problems for Mathematical Reasoning in Large Language Models
by: Zhao, Xueliang, et al.
Published: (2025)
by: Zhao, Xueliang, et al.
Published: (2025)
Meteorological observations during POLARSTERN cruise PS122/1
by: Schmithüsen, Holger, et al.
Published: (2021)
by: Schmithüsen, Holger, et al.
Published: (2021)
Radiosonde raw data measured during POLARSTERN cruise PS134, links to files
by: Schmithüsen, Holger, et al.
Published: (2026)
by: Schmithüsen, Holger, et al.
Published: (2026)
Meteorological observations during POLARSTERN cruise PS134
by: Schmithüsen, Holger, et al.
Published: (2025)
by: Schmithüsen, Holger, et al.
Published: (2025)
Radiosonde measurements during POLARSTERN cruise PS134
by: Schmithüsen, Holger, et al.
Published: (2026)
by: Schmithüsen, Holger, et al.
Published: (2026)
CrawfordGribben and John W.Tweeddale, eds. T&T Clark Handbook of John Owen. London: T&T Clark, 2022, 571pp. $39.95
by: Ty Kieser
Published: (2025)
by: Ty Kieser
Published: (2025)
Evaluating Large Vision-and-Language Models on Children's Mathematical Olympiads
by: Cherian, Anoop, et al.
Published: (2024)
by: Cherian, Anoop, et al.
Published: (2024)
Evaluating Large Language Models on Multimodal Chemistry Olympiad Exams
by: Cui, Yiming, et al.
Published: (2025)
by: Cui, Yiming, et al.
Published: (2025)
Challenging the Boundaries of Reasoning: An Olympiad-Level Math Benchmark for Large Language Models
by: Sun, Haoxiang, et al.
Published: (2025)
by: Sun, Haoxiang, et al.
Published: (2025)
Long-horizon Reasoning Agent for Olympiad-Level Mathematical Problem Solving
by: Gao, Songyang, et al.
Published: (2025)
by: Gao, Songyang, et al.
Published: (2025)
OMIBench: Benchmarking Olympiad-Level Multi-Image Reasoning in Large Vision-Language Model
by: Chen, Qiguang, et al.
Published: (2026)
by: Chen, Qiguang, et al.
Published: (2026)
LiveOIBench: Can Large Language Models Outperform Human Contestants in Informatics Olympiads?
by: Zou, Kaijian, et al.
Published: (2025)
by: Zou, Kaijian, et al.
Published: (2025)
CogAtom: From Cognitive Atoms to Olympiad-level Mathematical Reasoning in Large Language Models
by: Chen, Zhuofan, et al.
Published: (2025)
by: Chen, Zhuofan, et al.
Published: (2025)
Comments on “Sample Size Adaptation Designs and Efficiency Comparison With Group Sequential Designs”
by: Meinhard Kieser, et al.
Published: (2025)
by: Meinhard Kieser, et al.
Published: (2025)
OlympiadBench: A Challenging Benchmark for Promoting AGI with Olympiad-Level Bilingual Multimodal Scientific Problems
by: He, Chaoqun, et al.
Published: (2024)
by: He, Chaoqun, et al.
Published: (2024)
Physics-R1: An Audited Olympiad Corpus and Recipe for Visual Physics Reasoning
by: Yang, Shan
Published: (2026)
by: Yang, Shan
Published: (2026)
ChatQA: Surpassing GPT-4 on Conversational QA and RAG
by: Liu, Zihan, et al.
Published: (2024)
by: Liu, Zihan, et al.
Published: (2024)
Large Language Models Achieve Gold Medal Performance at the International Olympiad on Astronomy & Astrophysics (IOAA)
by: Pinheiro, Lucas Carrit Delgado, et al.
Published: (2025)
by: Pinheiro, Lucas Carrit Delgado, et al.
Published: (2025)
RIMO: An Easy-to-Evaluate, Hard-to-Solve Olympiad Benchmark for Advanced Mathematical Reasoning
by: Chen, Ziye, et al.
Published: (2025)
by: Chen, Ziye, et al.
Published: (2025)
Leveraging Online Olympiad-Level Math Problems for LLMs Training and Contamination-Resistant Evaluation
by: Mahdavi, Sadegh, et al.
Published: (2025)
by: Mahdavi, Sadegh, et al.
Published: (2025)
P1-VL: Bridging Visual Perception and Scientific Reasoning in Physics Olympiads
by: Luo, Yun, et al.
Published: (2026)
by: Luo, Yun, et al.
Published: (2026)
Evaluating Large Language Models on Solved and Unsolved Problems in Graph Theory: Implications for Computing Education
by: Kulkarni, Adithya, et al.
Published: (2026)
by: Kulkarni, Adithya, et al.
Published: (2026)
Proving Olympiad Inequalities by Synergizing LLMs and Symbolic Reasoning
by: Li, Zenan, et al.
Published: (2025)
by: Li, Zenan, et al.
Published: (2025)
OIBench: Benchmarking Strong Reasoning Models with Olympiad in Informatics
by: Zhu, Yaoming, et al.
Published: (2025)
by: Zhu, Yaoming, et al.
Published: (2025)
Unreflected Acceptance -- Investigating the Negative Consequences of ChatGPT-Assisted Problem Solving in Physics Education
by: Krupp, Lars, et al.
Published: (2023)
by: Krupp, Lars, et al.
Published: (2023)
Artificial Intelligence in Physical Therapy Education: Evaluating Clinical Reasoning Performance in Musculoskeletal Care Using ChatGPT
by: Jie Hao, et al.
Published: (2025)
by: Jie Hao, et al.
Published: (2025)
Linguistics Olympiad
by: Neacșu, Vlad A.
Published: (2024)
by: Neacșu, Vlad A.
Published: (2024)
Proving Olympiad Algebraic Inequalities without Human Demonstrations
by: Wei, Chenrui, et al.
Published: (2024)
by: Wei, Chenrui, et al.
Published: (2024)
Large Language Models in Student Assessment: Comparing ChatGPT and Human Graders
by: Lundgren, Magnus
Published: (2024)
by: Lundgren, Magnus
Published: (2024)
Trigonometry and Analytic Tools in Olympiad Geometry Problems, Part I
by: Lignos, Orestis
Published: (2023)
by: Lignos, Orestis
Published: (2023)
Can Language Models Solve Olympiad Programming?
by: Shi, Quan, et al.
Published: (2024)
by: Shi, Quan, et al.
Published: (2024)
MalAlgoQA: Pedagogical Evaluation of Counterfactual Reasoning in Large Language Models and Implications for AI in Education
by: Liu, Naiming, et al.
Published: (2024)
by: Liu, Naiming, et al.
Published: (2024)
Overview of AI Grading of Physics Olympiad Exams
by: McGinness, Lachlan
Published: (2025)
by: McGinness, Lachlan
Published: (2025)
Mastering Olympiad-Level Physics with Artificial Intelligence
by: Jian, Dong-Shan, et al.
Published: (2025)
by: Jian, Dong-Shan, et al.
Published: (2025)
End-to-End Bangla AI for Solving Math Olympiad Problem Benchmark: Leveraging Large Language Model Using Integrated Approach
by: Tabib, H. M. Shadman, et al.
Published: (2025)
by: Tabib, H. M. Shadman, et al.
Published: (2025)
A basket trial design based on power priors
by: Baumann, Lukas, et al.
Published: (2023)
by: Baumann, Lukas, et al.
Published: (2023)
LINGOLY: A Benchmark of Olympiad-Level Linguistic Reasoning Puzzles in Low-Resource and Extinct Languages
by: Bean, Andrew M., et al.
Published: (2024)
by: Bean, Andrew M., et al.
Published: (2024)
Similar Items
-
Developing and Evaluating a Large Language Model-Based Automated Feedback System Grounded in Evidence-Centered Design for Supporting Physics Problem Solving
by: Maus, Holger, et al.
Published: (2025) -
Daily and Weekly Periodicity in Large Language Model Performance and Its Implications for Research
by: Tschisgale, Paul, et al.
Published: (2026) -
Evaluating NLP Embedding Models for Handling Science-Specific Symbolic Expressions in Student Texts
by: Bleckmann, Tom, et al.
Published: (2025) -
PromptCoT: Synthesizing Olympiad-level Problems for Mathematical Reasoning in Large Language Models
by: Zhao, Xueliang, et al.
Published: (2025) -
Meteorological observations during POLARSTERN cruise PS122/1
by: Schmithüsen, Holger, et al.
Published: (2021)