CogBench: a large language model walks into a psychology lab
Fuente:
arXiv
Saved in:
| Main Authors: | Coda-Forno, Julian, Binz, Marcel, Wang, Jane X., Schulz, Eric |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Inducing anxiety in large language models can induce bias
by: Coda-Forno, Julian, et al.
Published: (2023)
by: Coda-Forno, Julian, et al.
Published: (2023)
Human-like Category Learning by Injecting Ecological Priors from Large Language Models into Neural Networks
by: Jagadish, Akshay K., et al.
Published: (2024)
by: Jagadish, Akshay K., et al.
Published: (2024)
Meta-learning ecological priors from large language models explains human learning and decision making
by: Jagadish, Akshay K., et al.
Published: (2025)
by: Jagadish, Akshay K., et al.
Published: (2025)
The Illusion of Latent Generalization: Bi-directionality and the Reversal Curse
by: Coda-Forno, Julian, et al.
Published: (2026)
by: Coda-Forno, Julian, et al.
Published: (2026)
Post-training makes large language models less human-like
by: Binz, Marcel, et al.
Published: (2026)
by: Binz, Marcel, et al.
Published: (2026)
Alignment faking in large language models
by: Greenblatt, Ryan, et al.
Published: (2024)
by: Greenblatt, Ryan, et al.
Published: (2024)
Representation in large language models
by: Yetman, Cameron
Published: (2025)
by: Yetman, Cameron
Published: (2025)
Long-form factuality in large language models
by: Wei, Jerry, et al.
Published: (2024)
by: Wei, Jerry, et al.
Published: (2024)
Can large language models explore in-context?
by: Krishnamurthy, Akshay, et al.
Published: (2024)
by: Krishnamurthy, Akshay, et al.
Published: (2024)
Exploring System 1 and 2 communication for latent reasoning in LLMs
by: Coda-Forno, Julian, et al.
Published: (2025)
by: Coda-Forno, Julian, et al.
Published: (2025)
CogBench: A Large Language Model Benchmark for Multilingual Speech-Based Cognitive Impairment Assessment
by: Feng, Rui, et al.
Published: (2025)
by: Feng, Rui, et al.
Published: (2025)
AI-AI Bias: large language models favor communications generated by large language models
by: Laurito, Walter, et al.
Published: (2024)
by: Laurito, Walter, et al.
Published: (2024)
Multimodal large language model for wheat breeding: a new exploration of smart breeding
by: Yang, Guofeng, et al.
Published: (2024)
by: Yang, Guofeng, et al.
Published: (2024)
CogGPT: Unleashing the Power of Cognitive Dynamics on Large Language Models
by: Lv, Yaojia, et al.
Published: (2024)
by: Lv, Yaojia, et al.
Published: (2024)
Safety and accuracy follow different scaling laws in clinical large language models
by: Wind, Sebastian, et al.
Published: (2026)
by: Wind, Sebastian, et al.
Published: (2026)
A dataset and benchmark for hospital course summarization with adapted large language models
by: Aali, Asad, et al.
Published: (2024)
by: Aali, Asad, et al.
Published: (2024)
Benchmarking large language models for biomedical natural language processing applications and recommendations
by: Chen, Qingyu, et al.
Published: (2023)
by: Chen, Qingyu, et al.
Published: (2023)
The language of time: a language model perspective on time-series foundation models
by: Xie, Yi, et al.
Published: (2025)
by: Xie, Yi, et al.
Published: (2025)
Multi-step retrieval and reasoning improves radiology question answering with large language models
by: Wind, Sebastian, et al.
Published: (2025)
by: Wind, Sebastian, et al.
Published: (2025)
SteuerLLM: Local specialized large language model for German tax law analysis
by: Wind, Sebastian, et al.
Published: (2026)
by: Wind, Sebastian, et al.
Published: (2026)
Physical models realizing the transformer architecture of large language models
by: Chen, Zeqian
Published: (2025)
by: Chen, Zeqian
Published: (2025)
Can a large language model be a gaslighter?
by: Li, Wei, et al.
Published: (2024)
by: Li, Wei, et al.
Published: (2024)
Zero-shot data citation function classification using transformer-based large language models (LLMs)
by: Byers, Neil, et al.
Published: (2025)
by: Byers, Neil, et al.
Published: (2025)
Mathematics with large language models as provers and verifiers
by: Duc, Hieu Le, et al.
Published: (2025)
by: Duc, Hieu Le, et al.
Published: (2025)
Block removal for large language models through constrained binary optimization
by: Jansen, David, et al.
Published: (2026)
by: Jansen, David, et al.
Published: (2026)
An artificial intelligence framework for end-to-end rare disease phenotyping from clinical notes using large language models
by: Shyr, Cathy, et al.
Published: (2026)
by: Shyr, Cathy, et al.
Published: (2026)
Cog-DRIFT: Exploration on Adaptively Reformulated Instances Enables Learning from Hard Reasoning Problems
by: Chen, Justin Chih-Yao, et al.
Published: (2026)
by: Chen, Justin Chih-Yao, et al.
Published: (2026)
CogAtom: From Cognitive Atoms to Olympiad-level Mathematical Reasoning in Large Language Models
by: Chen, Zhuofan, et al.
Published: (2025)
by: Chen, Zhuofan, et al.
Published: (2025)
Can large language models replace humans in the systematic review process? Evaluating GPT-4's efficacy in screening and extracting data from peer-reviewed and grey literature in multiple languages
by: Khraisha, Qusai, et al.
Published: (2023)
by: Khraisha, Qusai, et al.
Published: (2023)
Extracting effective solutions hidden in large language models via generated comprehensive specialists: case studies in developing electronic devices
by: Tomita, Hikari, et al.
Published: (2024)
by: Tomita, Hikari, et al.
Published: (2024)
Attack and defense techniques in large language models: A survey and new perspectives
by: Liao, Zhiyu, et al.
Published: (2025)
by: Liao, Zhiyu, et al.
Published: (2025)
A general tensor-structured compression scheme for efficient large language models
by: Lu, Ying, et al.
Published: (2026)
by: Lu, Ying, et al.
Published: (2026)
Machine Psychology
by: Hagendorff, Thilo, et al.
Published: (2023)
by: Hagendorff, Thilo, et al.
Published: (2023)
Lightweight reranking for language model generations
by: Jain, Siddhartha, et al.
Published: (2023)
by: Jain, Siddhartha, et al.
Published: (2023)
Auditing language models for hidden objectives
by: Marks, Samuel, et al.
Published: (2025)
by: Marks, Samuel, et al.
Published: (2025)
On the generalization of language models from in-context learning and finetuning: a controlled study
by: Lampinen, Andrew K., et al.
Published: (2025)
by: Lampinen, Andrew K., et al.
Published: (2025)
Extracting books from production language models
by: Ahmed, Ahmed, et al.
Published: (2026)
by: Ahmed, Ahmed, et al.
Published: (2026)
The opportunities and risks of large language models in mental health
by: Lawrence, Hannah R., et al.
Published: (2024)
by: Lawrence, Hannah R., et al.
Published: (2024)
Towards a copilot in BIM authoring tool using a large language model-based agent for intelligent human-machine interaction
by: Du, Changyu, et al.
Published: (2024)
by: Du, Changyu, et al.
Published: (2024)
EvoMemBench: Benchmarking Agent Memory from a Self-Evolving Perspective
by: Wang, Yuyao, et al.
Published: (2026)
by: Wang, Yuyao, et al.
Published: (2026)
Similar Items
-
Inducing anxiety in large language models can induce bias
by: Coda-Forno, Julian, et al.
Published: (2023) -
Human-like Category Learning by Injecting Ecological Priors from Large Language Models into Neural Networks
by: Jagadish, Akshay K., et al.
Published: (2024) -
Meta-learning ecological priors from large language models explains human learning and decision making
by: Jagadish, Akshay K., et al.
Published: (2025) -
The Illusion of Latent Generalization: Bi-directionality and the Reversal Curse
by: Coda-Forno, Julian, et al.
Published: (2026) -
Post-training makes large language models less human-like
by: Binz, Marcel, et al.
Published: (2026)