Limits of Large Language Models in Debating Humans
Fuente:
arXiv
Saved in:
| Main Authors: | Flamino, James, Modi, Mohammed Shahid, Szymanski, Boleslaw K., Cross, Brendan, Mikolajczyk, Colton |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
ADAPTS: Agentic Decomposition for Automated Protocol-agnostic Tracking of Symptoms
by: Vail, Alexandria K., et al.
Published: (2026)
by: Vail, Alexandria K., et al.
Published: (2026)
Crowdsourced Adaptive Surveys
by: Velez, Yamil
Published: (2024)
by: Velez, Yamil
Published: (2024)
Causal Responsibility Attribution for Human-AI Collaboration
by: Qi, Yahang, et al.
Published: (2024)
by: Qi, Yahang, et al.
Published: (2024)
Mental Health Impacts of AI Companions: Triangulating Social Media Quasi-Experiments, User Perspectives, and Relational Theory
by: Yuan, Yunhao, et al.
Published: (2025)
by: Yuan, Yunhao, et al.
Published: (2025)
Can Large Language Model Agents Simulate Human Trust Behavior?
by: Xie, Chengxing, et al.
Published: (2024)
by: Xie, Chengxing, et al.
Published: (2024)
Assessing the Creativity of Large Language Models: Testing, Limits, and New Frontiers
by: Schapiro, Samuel, et al.
Published: (2026)
by: Schapiro, Samuel, et al.
Published: (2026)
Personality testing of Large Language Models: Limited temporal stability, but highlighted prosociality
by: Bodroza, Bojana, et al.
Published: (2023)
by: Bodroza, Bojana, et al.
Published: (2023)
FOKE: A Personalized and Explainable Education Framework Integrating Foundation Models, Knowledge Graphs, and Prompt Engineering
by: Hu, Silan, et al.
Published: (2024)
by: Hu, Silan, et al.
Published: (2024)
The Effectiveness of Style Vectors for Steering Large Language Models: A Human Evaluation
by: Diallo, Diaoulé, et al.
Published: (2026)
by: Diallo, Diaoulé, et al.
Published: (2026)
Humans and Large Language Models in Clinical Decision Support: A Study with Medical Calculators
by: Wan, Nicholas, et al.
Published: (2024)
by: Wan, Nicholas, et al.
Published: (2024)
Human Evaluation of Procedural Knowledge Graph Extraction from Text with Large Language Models
by: Carriero, Valentina Anita, et al.
Published: (2024)
by: Carriero, Valentina Anita, et al.
Published: (2024)
StressPrompt: Does Stress Impact Large Language Models and Human Performance Similarly?
by: Shen, Guobin, et al.
Published: (2024)
by: Shen, Guobin, et al.
Published: (2024)
Epistemic Integrity in Large Language Models
by: Ghafouri, Bijean, et al.
Published: (2024)
by: Ghafouri, Bijean, et al.
Published: (2024)
AI-Assisted Conversational Interviewing: Effects on Data Quality and Respondent Experience
by: Barari, Soubhik, et al.
Published: (2025)
by: Barari, Soubhik, et al.
Published: (2025)
Pilot Study on Student Public Opinion Regarding GAI
by: Lamberti, William Franz, et al.
Published: (2026)
by: Lamberti, William Franz, et al.
Published: (2026)
"Crash Test Dummies" for AI-Enabled Clinical Assessment: Validating Virtual Patient Scenarios with Virtual Learners
by: Gin, Brian, et al.
Published: (2026)
by: Gin, Brian, et al.
Published: (2026)
LalaEval: A Holistic Human Evaluation Framework for Domain-Specific Large Language Models
by: Sun, Chongyan, et al.
Published: (2024)
by: Sun, Chongyan, et al.
Published: (2024)
Efficient Machine Translation Corpus Generation: Integrating Human-in-the-Loop Post-Editing with Large Language Models
by: Yuksel, Kamer Ali, et al.
Published: (2025)
by: Yuksel, Kamer Ali, et al.
Published: (2025)
Role-Play Zero-Shot Prompting with Large Language Models for Open-Domain Human-Machine Conversation
by: Njifenjou, Ahmed, et al.
Published: (2024)
by: Njifenjou, Ahmed, et al.
Published: (2024)
A Survey on Human-AI Collaboration with Large Foundation Models
by: Vats, Vanshika, et al.
Published: (2024)
by: Vats, Vanshika, et al.
Published: (2024)
Keeping Users Engaged During Repeated Administration of the Same Questionnaire: Using Large Language Models to Reliably Diversify Questions
by: Yun, Hye Sun, et al.
Published: (2023)
by: Yun, Hye Sun, et al.
Published: (2023)
Language Models in Dialogue: Conversational Maxims for Human-AI Interactions
by: Miehling, Erik, et al.
Published: (2024)
by: Miehling, Erik, et al.
Published: (2024)
An Evaluation of Estimative Uncertainty in Large Language Models
by: Tang, Zhisheng, et al.
Published: (2024)
by: Tang, Zhisheng, et al.
Published: (2024)
Evaluating the Prompt Steerability of Large Language Models
by: Miehling, Erik, et al.
Published: (2024)
by: Miehling, Erik, et al.
Published: (2024)
Autonomous Prompt Engineering in Large Language Models
by: Kepel, Daan, et al.
Published: (2024)
by: Kepel, Daan, et al.
Published: (2024)
Dynamics of Ideological Biases of Social Media Users
by: Modi, Mohammed Shahid, et al.
Published: (2023)
by: Modi, Mohammed Shahid, et al.
Published: (2023)
Characterising the Creative Process in Humans and Large Language Models
by: Nath, Surabhi S., et al.
Published: (2024)
by: Nath, Surabhi S., et al.
Published: (2024)
Why Would You Suggest That? Human Trust in Language Model Responses
by: Sharma, Manasi, et al.
Published: (2024)
by: Sharma, Manasi, et al.
Published: (2024)
Inertia in Moral and Value Judgments of Large Language Models
by: Lee, Bruce W., et al.
Published: (2024)
by: Lee, Bruce W., et al.
Published: (2024)
Large Language Model Use Impact Locus of Control
by: Fu, Jenny Xiyu, et al.
Published: (2025)
by: Fu, Jenny Xiyu, et al.
Published: (2025)
Large Language Models and Games: A Survey and Roadmap
by: Gallotta, Roberto, et al.
Published: (2024)
by: Gallotta, Roberto, et al.
Published: (2024)
(Ir)rationality and Cognitive Biases in Large Language Models
by: Macmillan-Scott, Olivia, et al.
Published: (2024)
by: Macmillan-Scott, Olivia, et al.
Published: (2024)
Empowering Private Tutoring by Chaining Large Language Models
by: Chen, Yulin, et al.
Published: (2023)
by: Chen, Yulin, et al.
Published: (2023)
Evaluating Large Language Models in Analysing Classroom Dialogue
by: Long, Yun, et al.
Published: (2024)
by: Long, Yun, et al.
Published: (2024)
Aligning Model Evaluations with Human Preferences: Mitigating Token Count Bias in Language Model Assessments
by: Daynauth, Roland, et al.
Published: (2024)
by: Daynauth, Roland, et al.
Published: (2024)
Multi-agent KTO: Reinforcing Strategic Interactions of Large Language Model in Language Game
by: Ye, Rong, et al.
Published: (2025)
by: Ye, Rong, et al.
Published: (2025)
Pilot Study on Generative AI and Critical Thinking in Higher Education Classrooms
by: Lamberti, W. F., et al.
Published: (2025)
by: Lamberti, W. F., et al.
Published: (2025)
Integrating Computational Methods and AI into Qualitative Studies of Aging and Later Life
by: Abramson, Corey M.
Published: (2025)
by: Abramson, Corey M.
Published: (2025)
Digital Twins as Funhouse Mirrors: Five Key Distortions
by: Peng, Tianyi, et al.
Published: (2025)
by: Peng, Tianyi, et al.
Published: (2025)
RNR: Teaching Large Language Models to Follow Roles and Rules
by: Wang, Kuan, et al.
Published: (2024)
by: Wang, Kuan, et al.
Published: (2024)
Similar Items
-
ADAPTS: Agentic Decomposition for Automated Protocol-agnostic Tracking of Symptoms
by: Vail, Alexandria K., et al.
Published: (2026) -
Crowdsourced Adaptive Surveys
by: Velez, Yamil
Published: (2024) -
Causal Responsibility Attribution for Human-AI Collaboration
by: Qi, Yahang, et al.
Published: (2024) -
Mental Health Impacts of AI Companions: Triangulating Social Media Quasi-Experiments, User Perspectives, and Relational Theory
by: Yuan, Yunhao, et al.
Published: (2025) -
Can Large Language Model Agents Simulate Human Trust Behavior?
by: Xie, Chengxing, et al.
Published: (2024)