System 2 thinking in OpenAI's o1-preview model: Near-perfect performance on a mathematics exam
Fuente:
arXiv
Salvato in:
| Autori principali: | de Winter, Joost, Dodou, Dimitra, Eisma, Yke Bauke |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
An Open-Source Reproducible Chess Robot for Human-Robot Interaction Research
di: Zhang, Renchi, et al.
Pubblicazione: (2024)
di: Zhang, Renchi, et al.
Pubblicazione: (2024)
Walk along: An Experiment on Controlling the Mobile Robot 'Spot' with Voice and Gestures
di: Zhang, Renchi, et al.
Pubblicazione: (2024)
di: Zhang, Renchi, et al.
Pubblicazione: (2024)
Can OpenAI o1 outperform humans in higher-order cognitive thinking?
di: Latif, Ehsan, et al.
Pubblicazione: (2024)
di: Latif, Ehsan, et al.
Pubblicazione: (2024)
Anticipating Future Object Compositions without Forgetting
di: Zahran, Youssef, et al.
Pubblicazione: (2024)
di: Zahran, Youssef, et al.
Pubblicazione: (2024)
From Google Gemini to OpenAI Q* (Q-Star): A Survey of Reshaping the Generative Artificial Intelligence (AI) Research Landscape
di: McIntosh, Timothy R., et al.
Pubblicazione: (2023)
di: McIntosh, Timothy R., et al.
Pubblicazione: (2023)
OpenAI GPT-5 System Card
di: Singh, Aaditya, et al.
Pubblicazione: (2025)
di: Singh, Aaditya, et al.
Pubblicazione: (2025)
LLM Platform Security: Applying a Systematic Evaluation Framework to OpenAI's ChatGPT Plugins
di: Iqbal, Umar, et al.
Pubblicazione: (2023)
di: Iqbal, Umar, et al.
Pubblicazione: (2023)
A Systematic Assessment of OpenAI o1-Preview for Higher Order Thinking in Education
di: Latif, Ehsan, et al.
Pubblicazione: (2024)
di: Latif, Ehsan, et al.
Pubblicazione: (2024)
OpenAI's Approach to External Red Teaming for AI Models and Systems
di: Ahmad, Lama, et al.
Pubblicazione: (2025)
di: Ahmad, Lama, et al.
Pubblicazione: (2025)
When a language model is optimized for reasoning, does it still show embers of autoregression? An analysis of OpenAI o1
di: McCoy, R. Thomas, et al.
Pubblicazione: (2024)
di: McCoy, R. Thomas, et al.
Pubblicazione: (2024)
Sora OpenAI's Prelude: Social Media Perspectives on Sora OpenAI and the Future of AI Video Generation
di: Mogavi, Reza Hadi, et al.
Pubblicazione: (2024)
di: Mogavi, Reza Hadi, et al.
Pubblicazione: (2024)
AI-Assisted Systematization for Evaluating GenAI Systems
di: Agarwal, Dhruv, et al.
Pubblicazione: (2026)
di: Agarwal, Dhruv, et al.
Pubblicazione: (2026)
LLMs Still Can't Plan; Can LRMs? A Preliminary Evaluation of OpenAI's o1 on PlanBench
di: Valmeekam, Karthik, et al.
Pubblicazione: (2024)
di: Valmeekam, Karthik, et al.
Pubblicazione: (2024)
Testing GPT-4-o1-preview on math and science problems: A follow-up study
di: Davis, Ernest
Pubblicazione: (2024)
di: Davis, Ernest
Pubblicazione: (2024)
Defining bias in AI-systems: Biased models are fair models
di: Lindloff, Chiara, et al.
Pubblicazione: (2025)
di: Lindloff, Chiara, et al.
Pubblicazione: (2025)
Evaluation Framework for AI Systems in "the Wild"
di: Jabbour, Sarah, et al.
Pubblicazione: (2025)
di: Jabbour, Sarah, et al.
Pubblicazione: (2025)
Can OpenAI o1 Reason Well in Ophthalmology? A 6,990-Question Head-to-Head Evaluation Study
di: Srinivasan, Sahana, et al.
Pubblicazione: (2025)
di: Srinivasan, Sahana, et al.
Pubblicazione: (2025)
Evaluation of OpenAI o1: Opportunities and Challenges of AGI
di: Zhong, Tianyang, et al.
Pubblicazione: (2024)
di: Zhong, Tianyang, et al.
Pubblicazione: (2024)
Measuring Political Preferences in AI Systems: An Integrative Approach
di: Rozado, David
Pubblicazione: (2025)
di: Rozado, David
Pubblicazione: (2025)
The 2025 OpenAI Preparedness Framework does not guarantee any AI risk mitigation practices: a proof-of-concept for affordance analyses of AI safety policies
di: Coggins, Sam, et al.
Pubblicazione: (2025)
di: Coggins, Sam, et al.
Pubblicazione: (2025)
Security Challenges in AI Agent Deployment: Insights from a Large Scale Public Competition
di: Zou, Andy, et al.
Pubblicazione: (2025)
di: Zou, Andy, et al.
Pubblicazione: (2025)
Analysing the Public Discourse around OpenAI's Text-To-Video Model 'Sora' using Topic Modeling
di: Parikh, Vatsal Vinay
Pubblicazione: (2024)
di: Parikh, Vatsal Vinay
Pubblicazione: (2024)
How Utilitarian Are OpenAI's Models Really? Replicating and Reinterpreting Pfeffer, Krügel, and Uhl (2025)
di: Himmelreich, Johannes
Pubblicazione: (2026)
di: Himmelreich, Johannes
Pubblicazione: (2026)
The ADAIO System at the BEA-2023 Shared Task on Generating AI Teacher Responses in Educational Dialogues
di: Adigwe, Adaeze, et al.
Pubblicazione: (2023)
di: Adigwe, Adaeze, et al.
Pubblicazione: (2023)
MTUncertainty: Assessing the Need for Post-editing of Machine Translation Outputs by Fine-tuning OpenAI LLMs
di: Gladkoff, Serge, et al.
Pubblicazione: (2023)
di: Gladkoff, Serge, et al.
Pubblicazione: (2023)
A Case Study of Web App Coding with OpenAI Reasoning Models
di: Cui, Yi
Pubblicazione: (2024)
di: Cui, Yi
Pubblicazione: (2024)
Competing Visions of Ethical AI: A Case Study of OpenAI
di: Wilfley, Melissa, et al.
Pubblicazione: (2026)
di: Wilfley, Melissa, et al.
Pubblicazione: (2026)
Comparative Analysis of OpenAI GPT-4o and DeepSeek R1 for Scientific Text Categorization Using Prompt Engineering
di: Maiti, Aniruddha, et al.
Pubblicazione: (2025)
di: Maiti, Aniruddha, et al.
Pubblicazione: (2025)
Evaluating the Effectiveness of OpenAI's Parental Control System
di: Ersoz, Kerem, et al.
Pubblicazione: (2026)
di: Ersoz, Kerem, et al.
Pubblicazione: (2026)
DeepSeek-R1 Outperforms Gemini 2.0 Pro, OpenAI o1, and o3-mini in Bilingual Complex Ophthalmology Reasoning
di: Xu, Pusheng, et al.
Pubblicazione: (2025)
di: Xu, Pusheng, et al.
Pubblicazione: (2025)
Open-Ended Wargames with Large Language Models
di: Hogan, Daniel P., et al.
Pubblicazione: (2024)
di: Hogan, Daniel P., et al.
Pubblicazione: (2024)
AI-AI Bias: large language models favor communications generated by large language models
di: Laurito, Walter, et al.
Pubblicazione: (2024)
di: Laurito, Walter, et al.
Pubblicazione: (2024)
OpenAI's GPT-OSS-20B Model and Safety Alignment Issues in a Low-Resource Language
di: Inuwa-Dutse, Isa
Pubblicazione: (2025)
di: Inuwa-Dutse, Isa
Pubblicazione: (2025)
Does GPT-4 surpass human performance in linguistic pragmatics?
di: Bojic, Ljubisa, et al.
Pubblicazione: (2023)
di: Bojic, Ljubisa, et al.
Pubblicazione: (2023)
AI Awareness
di: Li, Xiaojian, et al.
Pubblicazione: (2025)
di: Li, Xiaojian, et al.
Pubblicazione: (2025)
A Comparative Study on Reasoning Patterns of OpenAI's o1 Model
di: Wu, Siwei, et al.
Pubblicazione: (2024)
di: Wu, Siwei, et al.
Pubblicazione: (2024)
AuditWen:An Open-Source Large Language Model for Audit
di: Huang, Jiajia, et al.
Pubblicazione: (2024)
di: Huang, Jiajia, et al.
Pubblicazione: (2024)
Evaluating Text Summaries Generated by Large Language Models Using OpenAI's GPT
di: Shakil, Hassan, et al.
Pubblicazione: (2024)
di: Shakil, Hassan, et al.
Pubblicazione: (2024)
Depictions of Depression in Generative AI Video Models: A Preliminary Study of OpenAI's Sora 2
di: Flathers, Matthew, et al.
Pubblicazione: (2026)
di: Flathers, Matthew, et al.
Pubblicazione: (2026)
Patterns in the Transition From Founder-Leadership to Community Governance of Open Source
di: Noori, Mobina, et al.
Pubblicazione: (2025)
di: Noori, Mobina, et al.
Pubblicazione: (2025)
Documenti analoghi
-
An Open-Source Reproducible Chess Robot for Human-Robot Interaction Research
di: Zhang, Renchi, et al.
Pubblicazione: (2024) -
Walk along: An Experiment on Controlling the Mobile Robot 'Spot' with Voice and Gestures
di: Zhang, Renchi, et al.
Pubblicazione: (2024) -
Can OpenAI o1 outperform humans in higher-order cognitive thinking?
di: Latif, Ehsan, et al.
Pubblicazione: (2024) -
Anticipating Future Object Compositions without Forgetting
di: Zahran, Youssef, et al.
Pubblicazione: (2024) -
From Google Gemini to OpenAI Q* (Q-Star): A Survey of Reshaping the Generative Artificial Intelligence (AI) Research Landscape
di: McIntosh, Timothy R., et al.
Pubblicazione: (2023)