Does GPT-4 pass the Turing test?
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Jones, Cameron R., Bergen, Benjamin K. |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
People cannot distinguish GPT-4 from a human in a Turing test
par: Jones, Cameron R., et autres
Publié: (2024)
par: Jones, Cameron R., et autres
Publié: (2024)
GPT-4 is judged more human than humans in displaced and inverted Turing tests
par: Rathi, Ishika, et autres
Publié: (2024)
par: Rathi, Ishika, et autres
Publié: (2024)
Large Language Models Pass the Turing Test
par: Jones, Cameron R., et autres
Publié: (2025)
par: Jones, Cameron R., et autres
Publié: (2025)
GPT-4 passes most of the 297 written Polish Board Certification Examinations
par: Pokrywka, Jakub, et autres
Publié: (2024)
par: Pokrywka, Jakub, et autres
Publié: (2024)
Does ChatGPT Have a Mind?
par: Goldstein, Simon, et autres
Publié: (2024)
par: Goldstein, Simon, et autres
Publié: (2024)
Does GPT-4 surpass human performance in linguistic pragmatics?
par: Bojic, Ljubisa, et autres
Publié: (2023)
par: Bojic, Ljubisa, et autres
Publié: (2023)
Not quite Sherlock Holmes: Language model predictions do not reliably differentiate impossible from improbable events
par: Michaelov, James A., et autres
Publié: (2025)
par: Michaelov, James A., et autres
Publié: (2025)
Normality and the Turing Test
par: Kabbach, Alexandre
Publié: (2025)
par: Kabbach, Alexandre
Publié: (2025)
How Open Must Language Models be to Enable Reliable Scientific Inference?
par: Michaelov, James A., et autres
Publié: (2026)
par: Michaelov, James A., et autres
Publié: (2026)
Analyzing Narrative Processing in Large Language Models (LLMs): Using GPT4 to test BERT
par: Krauss, Patrick, et autres
Publié: (2024)
par: Krauss, Patrick, et autres
Publié: (2024)
On Psychology of AI -- Does Primacy Effect Affect ChatGPT and Other LLMs?
par: Hämäläinen, Mika
Publié: (2025)
par: Hämäläinen, Mika
Publié: (2025)
GPT-4 Technical Report
par: OpenAI, et autres
Publié: (2023)
par: OpenAI, et autres
Publié: (2023)
GPTEval: A Survey on Assessments of ChatGPT and GPT-4
par: Mao, Rui, et autres
Publié: (2023)
par: Mao, Rui, et autres
Publié: (2023)
Is GPT-4 a reliable rater? Evaluating Consistency in GPT-4 Text Ratings
par: Hackl, Veronika, et autres
Publié: (2023)
par: Hackl, Veronika, et autres
Publié: (2023)
GPT-4V Cannot Generate Radiology Reports Yet
par: Jiang, Yuyang, et autres
Publié: (2024)
par: Jiang, Yuyang, et autres
Publié: (2024)
Signatures of human-like processing in Transformer forward passes
par: Hu, Jennifer, et autres
Publié: (2025)
par: Hu, Jennifer, et autres
Publié: (2025)
Using Hallucinations to Bypass GPT4's Filter
par: Lemkin, Benjamin
Publié: (2024)
par: Lemkin, Benjamin
Publié: (2024)
Comparative Analysis of ChatGPT, GPT-4, and Microsoft Bing Chatbots for GRE Test
par: Abu-Haifa, Mohammad, et autres
Publié: (2023)
par: Abu-Haifa, Mohammad, et autres
Publié: (2023)
Does Tone Change the Answer? Evaluating Prompt Politeness Effects on Modern LLMs: GPT, Gemini, and LLaMA
par: Cai, Hanyu, et autres
Publié: (2025)
par: Cai, Hanyu, et autres
Publié: (2025)
ChatGPT Reads Your Tone and Responds Accordingly -- Until It Does Not -- Emotional Framing Induces Bias in LLM Outputs
par: Bardol, Franck
Publié: (2025)
par: Bardol, Franck
Publié: (2025)
Building another Spanish dictionary, this time with GPT-4
par: Ortega-Martín, Miguel, et autres
Publié: (2024)
par: Ortega-Martín, Miguel, et autres
Publié: (2024)
X-TURING: Towards an Enhanced and Efficient Turing Test for Long-Term Dialogue Agents
par: Wu, Weiqi, et autres
Publié: (2024)
par: Wu, Weiqi, et autres
Publié: (2024)
Is It Bad to Work All the Time? Cross-Cultural Evaluation of Social Norm Biases in GPT-4
par: Liu, Zhuozhuo Joy, et autres
Publié: (2025)
par: Liu, Zhuozhuo Joy, et autres
Publié: (2025)
Attributions toward Artificial Agents in a modified Moral Turing Test
par: Aharoni, Eyal, et autres
Publié: (2024)
par: Aharoni, Eyal, et autres
Publié: (2024)
The Collective Turing Test: Large Language Models Can Generate Realistic Multi-User Discussions
par: Bouleimen, Azza, et autres
Publié: (2025)
par: Bouleimen, Azza, et autres
Publié: (2025)
Removing RLHF Protections in GPT-4 via Fine-Tuning
par: Zhan, Qiusi, et autres
Publié: (2023)
par: Zhan, Qiusi, et autres
Publié: (2023)
Understanding the Role of Temperature in Diverse Question Generation by GPT-4
par: Agarwal, Arav, et autres
Publié: (2024)
par: Agarwal, Arav, et autres
Publié: (2024)
Lies, Damned Lies, and Distributional Language Statistics: Persuasion and Deception with Large Language Models
par: Jones, Cameron R., et autres
Publié: (2024)
par: Jones, Cameron R., et autres
Publié: (2024)
The Generalized Turing Test: A Foundation for Comparing Intelligence
par: Mitropolsky, Daniel, et autres
Publié: (2026)
par: Mitropolsky, Daniel, et autres
Publié: (2026)
Gemini Pro Defeated by GPT-4V: Evidence from Education
par: Lee, Gyeong-Geon, et autres
Publié: (2023)
par: Lee, Gyeong-Geon, et autres
Publié: (2023)
Can GPT-4 learn to analyse moves in research article abstracts?
par: Yu, Danni, et autres
Publié: (2024)
par: Yu, Danni, et autres
Publié: (2024)
GPT-4 on Clinic Depression Assessment: An LLM-Based Pilot Study
par: Lorenzoni, Giuliano, et autres
Publié: (2024)
par: Lorenzoni, Giuliano, et autres
Publié: (2024)
Can machines perform a qualitative data analysis? Reading the debate with Alan Turing
par: De Paoli, Stefano
Publié: (2025)
par: De Paoli, Stefano
Publié: (2025)
RogueGPT: dis-ethical tuning transforms ChatGPT4 into a Rogue AI in 158 Words
par: Buscemi, Alessio, et autres
Publié: (2024)
par: Buscemi, Alessio, et autres
Publié: (2024)
M-MiniGPT4: Multilingual VLLM Alignment via Translated Data
par: Han, Seung Hun, et autres
Publié: (2026)
par: Han, Seung Hun, et autres
Publié: (2026)
Evaluating Students' Open-ended Written Responses with LLMs: Using the RAG Framework for GPT-3.5, GPT-4, Claude-3, and Mistral-Large
par: Jauhiainen, Jussi S., et autres
Publié: (2024)
par: Jauhiainen, Jussi S., et autres
Publié: (2024)
Single layer tiny Co$^4$ outpaces GPT-2 and GPT-BERT
par: Zain, Noor Ul, et autres
Publié: (2025)
par: Zain, Noor Ul, et autres
Publié: (2025)
Using GPT-4 to Augment Unbalanced Data for Automatic Scoring
par: Fang, Luyang, et autres
Publié: (2023)
par: Fang, Luyang, et autres
Publié: (2023)
Evaluating ChatGPT-4 Vision on Brazil's National Undergraduate Computer Science Exam
par: Mendonça, Nabor C.
Publié: (2024)
par: Mendonça, Nabor C.
Publié: (2024)
Iterative Prompt Refinement for Dyslexia-Friendly Text Summarization Using GPT-4o
par: Bhojwani, Samay, et autres
Publié: (2026)
par: Bhojwani, Samay, et autres
Publié: (2026)
Documents similaires
-
People cannot distinguish GPT-4 from a human in a Turing test
par: Jones, Cameron R., et autres
Publié: (2024) -
GPT-4 is judged more human than humans in displaced and inverted Turing tests
par: Rathi, Ishika, et autres
Publié: (2024) -
Large Language Models Pass the Turing Test
par: Jones, Cameron R., et autres
Publié: (2025) -
GPT-4 passes most of the 297 written Polish Board Certification Examinations
par: Pokrywka, Jakub, et autres
Publié: (2024) -
Does ChatGPT Have a Mind?
par: Goldstein, Simon, et autres
Publié: (2024)