Discovering Differences in Strategic Behavior Between Humans and LLMs
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Caroline, Kasenberg, Daniel, Stachenfeld, Kim, Castro, Pablo Samuel |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
LLMs Aren't Human: A Critical Perspective on LLM Personality
par: Zierahn, Kim, et autres
Publié: (2026)
par: Zierahn, Kim, et autres
Publié: (2026)
Beyond Recall: Behavioral Specification as an Interpretive Layer for AI Personalization
par: Gulaya, Aarik
Publié: (2026)
par: Gulaya, Aarik
Publié: (2026)
Discovering High Level Patterns from Simulation Traces
par: Memery, Sean, et autres
Publié: (2026)
par: Memery, Sean, et autres
Publié: (2026)
AI and My Values: User Perceptions of LLMs' Ability to Extract, Embody, and Explain Human Values from Casual Conversations
par: Yun, Bhada, et autres
Publié: (2026)
par: Yun, Bhada, et autres
Publié: (2026)
LLMs and the Human Condition
par: Wallis, Peter
Publié: (2024)
par: Wallis, Peter
Publié: (2024)
VeriPlan: Integrating Formal Verification and LLMs into End-User Planning
par: Lee, Christine, et autres
Publié: (2025)
par: Lee, Christine, et autres
Publié: (2025)
Towards Democratized Flood Risk Management: An Advanced AI Assistant Enabled by GPT-4 for Enhanced Interpretability and Public Engagement
par: Martelo, Rafaela, et autres
Publié: (2024)
par: Martelo, Rafaela, et autres
Publié: (2024)
ChemPro: A Progressive Chemistry Benchmark for Large Language Models
par: Baranwal, Aaditya, et autres
Publié: (2026)
par: Baranwal, Aaditya, et autres
Publié: (2026)
CAG: Chunked Augmented Generation for Google Chrome's Built-in Gemini Nano
par: Surulimuthu, Vivek Vellaiyappan, et autres
Publié: (2024)
par: Surulimuthu, Vivek Vellaiyappan, et autres
Publié: (2024)
A Human-Machine Collaboration Framework for the Development of Schemas
par: Isaak, Nicos
Publié: (2024)
par: Isaak, Nicos
Publié: (2024)
Semantic Commit: Helping Users Update Intent Specifications for AI Memory at Scale
par: Vaithilingam, Priyan, et autres
Publié: (2025)
par: Vaithilingam, Priyan, et autres
Publié: (2025)
CueTip: An Interactive and Explainable Physics-aware Pool Assistant
par: Memery, Sean, et autres
Publié: (2025)
par: Memery, Sean, et autres
Publié: (2025)
Deciphering Digital Detectives: Understanding LLM Behaviors and Capabilities in Multi-Agent Mystery Games
par: Wu, Dekun, et autres
Publié: (2023)
par: Wu, Dekun, et autres
Publié: (2023)
AdaptiveCoPilot: Design and Testing of a NeuroAdaptive LLM Cockpit Guidance System in both Novice and Expert Pilots
par: Wen, Shaoyue, et autres
Publié: (2025)
par: Wen, Shaoyue, et autres
Publié: (2025)
Syntactic Blind Spots: How Misalignment Leads to LLMs Mathematical Errors
par: Williamson, Dane, et autres
Publié: (2025)
par: Williamson, Dane, et autres
Publié: (2025)
3Description: An Intuitive Human-AI Collaborative 3D Modeling Approach
par: Cai, Zhuodi
Publié: (2025)
par: Cai, Zhuodi
Publié: (2025)
From Instructor to Collaborator: What a 90-Participant Study Reveals about Human-Agent Collaboration in a Mobile Serious Game
par: Korre, Danai
Publié: (2026)
par: Korre, Danai
Publié: (2026)
MAP: Multi-user Personalization with Collaborative LLM-powered Agents
par: Lee, Christine, et autres
Publié: (2025)
par: Lee, Christine, et autres
Publié: (2025)
AutoTRIZ: Automating Engineering Innovation with TRIZ and Large Language Models
par: Jiang, Shuo, et autres
Publié: (2024)
par: Jiang, Shuo, et autres
Publié: (2024)
TwinVoice: A Multi-dimensional Benchmark Towards Digital Twins via LLM Persona Simulation
par: Du, Bangde, et autres
Publié: (2025)
par: Du, Bangde, et autres
Publié: (2025)
Human-Robot Dialogue Annotation for Multi-Modal Common Ground
par: Bonial, Claire, et autres
Publié: (2024)
par: Bonial, Claire, et autres
Publié: (2024)
SCOUT: A Situated and Multi-Modal Human-Robot Dialogue Corpus
par: Lukin, Stephanie M., et autres
Publié: (2024)
par: Lukin, Stephanie M., et autres
Publié: (2024)
Human Agency, Causality, and the Human Computer Interface in High-Stakes Artificial Intelligence
par: Hattab, Georges
Publié: (2026)
par: Hattab, Georges
Publié: (2026)
ReFoRCE: A Text-to-SQL Agent with Self-Refinement, Consensus Enforcement, and Column Exploration
par: Deng, Minghang, et autres
Publié: (2025)
par: Deng, Minghang, et autres
Publié: (2025)
Who Sees What? Structured Thought-Action Sequences for Epistemic Reasoning in LLMs
par: Annese, Luca, et autres
Publié: (2025)
par: Annese, Luca, et autres
Publié: (2025)
Neurocognitive Modeling for Text Generation: Deep Learning Architecture for EEG Data
par: Khushiyant
Publié: (2025)
par: Khushiyant
Publié: (2025)
Reporting and Reviewing LLM-Integrated Systems in HCI: Challenges and Considerations
par: Navarro, Karla Felix, et autres
Publié: (2026)
par: Navarro, Karla Felix, et autres
Publié: (2026)
"Girl, I'm so Serious": CARE, a Capability Framework for Reproductive Equity in Human-AI Interaction
par: Zhong, Alice, et autres
Publié: (2026)
par: Zhong, Alice, et autres
Publié: (2026)
Large Language User Interfaces: Voice Interactive User Interfaces powered by LLMs
par: Wasti, Syed Mekael, et autres
Publié: (2024)
par: Wasti, Syed Mekael, et autres
Publié: (2024)
Automated Circuit Interpretation via Probe Prompting
par: Birardi, Giuseppe
Publié: (2025)
par: Birardi, Giuseppe
Publié: (2025)
Semantic Decomposition and Selective Context Filtering -- Text Processing Techniques for Context-Aware NLP-Based Systems
par: Villardar, Karl John
Publié: (2025)
par: Villardar, Karl John
Publié: (2025)
What Would GPT Click: Practical Effects of Human-AI Behavioral Misalignment and the Cost of Synthetic Participants in User Experience
par: Kuric, Eduard, et autres
Publié: (2026)
par: Kuric, Eduard, et autres
Publié: (2026)
Next Token Prediction Is a Dead End for Creativity
par: Olatunji, Ibukun, et autres
Publié: (2025)
par: Olatunji, Ibukun, et autres
Publié: (2025)
BabyReasoningBench: Generating Developmentally-Inspired Reasoning Tasks for Evaluating Baby Language Models
par: Dhole, Kaustubh D.
Publié: (2026)
par: Dhole, Kaustubh D.
Publié: (2026)
"I followed what felt right, not what I was told": Autonomy, Coaching, and Recognizing Bias Through AI-Mediated Dialogue
par: Taheri, Atieh, et autres
Publié: (2026)
par: Taheri, Atieh, et autres
Publié: (2026)
"The Data Says Otherwise"-Towards Automated Fact-checking and Communication of Data Claims
par: Fu, Yu, et autres
Publié: (2024)
par: Fu, Yu, et autres
Publié: (2024)
Growing Perspectives: Modelling Embodied Perspective Taking and Inner Narrative Development Using Large Language Models
par: Patania, Sabrina, et autres
Publié: (2025)
par: Patania, Sabrina, et autres
Publié: (2025)
Therapy as an NLP Task: Psychologists' Comparison of LLMs and Human Peers in CBT
par: Iftikhar, Zainab, et autres
Publié: (2024)
par: Iftikhar, Zainab, et autres
Publié: (2024)
Beyond Training: How Workers Discover Value in Enterprise AI
par: Sahni, Riya, et autres
Publié: (2025)
par: Sahni, Riya, et autres
Publié: (2025)
Humanizing AI Grading: Student-Centered Insights on Fairness, Trust, Consistency and Transparency
par: Riahi, Bahare, et autres
Publié: (2026)
par: Riahi, Bahare, et autres
Publié: (2026)
Documents similaires
-
LLMs Aren't Human: A Critical Perspective on LLM Personality
par: Zierahn, Kim, et autres
Publié: (2026) -
Beyond Recall: Behavioral Specification as an Interpretive Layer for AI Personalization
par: Gulaya, Aarik
Publié: (2026) -
Discovering High Level Patterns from Simulation Traces
par: Memery, Sean, et autres
Publié: (2026) -
AI and My Values: User Perceptions of LLMs' Ability to Extract, Embody, and Explain Human Values from Casual Conversations
par: Yun, Bhada, et autres
Publié: (2026) -
LLMs and the Human Condition
par: Wallis, Peter
Publié: (2024)