Psychometric Alignment: Capturing Human Knowledge Distributions via Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | He-Yueya, Joy, Ma, Wanjing Anya, Gandhi, Kanishk, Domingue, Benjamin W., Brunskill, Emma, Goodman, Noah D. |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Evaluating and Optimizing Educational Content with Large Language Model Judgments
par: He-Yueya, Joy, et autres
Publié: (2024)
par: He-Yueya, Joy, et autres
Publié: (2024)
Learning to Simulate Human Dialogue
par: Gandhi, Kanishk, et autres
Publié: (2026)
par: Gandhi, Kanishk, et autres
Publié: (2026)
GIANTS: Generative Insight Anticipation from Scientific Literature
par: He-Yueya, Joy, et autres
Publié: (2026)
par: He-Yueya, Joy, et autres
Publié: (2026)
Procedural Dilemma Generation for Evaluating Moral Reasoning in Humans and Language Models
par: Fränken, Jan-Philipp, et autres
Publié: (2024)
par: Fränken, Jan-Philipp, et autres
Publié: (2024)
Endless Terminals: Scaling RL Environments for Terminal Agents
par: Gandhi, Kanishk, et autres
Publié: (2026)
par: Gandhi, Kanishk, et autres
Publié: (2026)
Self-Supervised Alignment with Mutual Information: Learning to Follow Principles without Preference Labels
par: Fränken, Jan-Philipp, et autres
Publié: (2024)
par: Fränken, Jan-Philipp, et autres
Publié: (2024)
Cognitive Behaviors that Enable Self-Improving Reasoners, or, Four Habits of Highly Effective STaRs
par: Gandhi, Kanishk, et autres
Publié: (2025)
par: Gandhi, Kanishk, et autres
Publié: (2025)
Non-literal Understanding of Number Words by Language Models
par: Tsvilodub, Polina, et autres
Publié: (2025)
par: Tsvilodub, Polina, et autres
Publié: (2025)
Stream of Search (SoS): Learning to Search in Language
par: Gandhi, Kanishk, et autres
Publié: (2024)
par: Gandhi, Kanishk, et autres
Publié: (2024)
Human-like Affective Cognition in Foundation Models
par: Gandhi, Kanishk, et autres
Publié: (2024)
par: Gandhi, Kanishk, et autres
Publié: (2024)
Scaling up the think-aloud method
par: Wurgaft, Daniel, et autres
Publié: (2025)
par: Wurgaft, Daniel, et autres
Publié: (2025)
Automatic Generation of Inference Making Questions for Reading Comprehension Assessments
par: Ma, Wanjing Anya, et autres
Publié: (2025)
par: Ma, Wanjing Anya, et autres
Publié: (2025)
HumanLM: Simulating Users with State Alignment Beats Response Imitation
par: Wu, Shirley, et autres
Publié: (2026)
par: Wu, Shirley, et autres
Publié: (2026)
Bifocal Attention: Harmonizing Geometric and Spectral Positional Embeddings for Algorithmic Generalization
par: Awadhiya, Kanishk
Publié: (2026)
par: Awadhiya, Kanishk
Publié: (2026)
From Next-Token to Mathematics: The Learning Dynamics of Mathematical Reasoning in Language Models
par: Mishra, Shubhra, et autres
Publié: (2024)
par: Mishra, Shubhra, et autres
Publié: (2024)
Large Language Model Reasoning Failures
par: Song, Peiyang, et autres
Publié: (2026)
par: Song, Peiyang, et autres
Publié: (2026)
Automated Statistical Model Discovery with Language Models
par: Li, Michael Y., et autres
Publié: (2024)
par: Li, Michael Y., et autres
Publié: (2024)
Is Child-Directed Speech Effective Training Data for Language Models?
par: Feng, Steven Y., et autres
Publié: (2024)
par: Feng, Steven Y., et autres
Publié: (2024)
STaR-GATE: Teaching Language Models to Ask Clarifying Questions
par: Andukuri, Chinmaya, et autres
Publié: (2024)
par: Andukuri, Chinmaya, et autres
Publié: (2024)
CLEVRER-Humans: Describing Physical and Causal Events the Human Way
par: Mao, Jiayuan, et autres
Publié: (2023)
par: Mao, Jiayuan, et autres
Publié: (2023)
Roleplay-doh: Enabling Domain-Experts to Create LLM-simulated Patients via Eliciting and Adhering to Principles
par: Louie, Ryan, et autres
Publié: (2024)
par: Louie, Ryan, et autres
Publié: (2024)
The Knowledge Alignment Problem: Bridging Human and External Knowledge for Large Language Models
par: Zhang, Shuo, et autres
Publié: (2023)
par: Zhang, Shuo, et autres
Publié: (2023)
What Makes a Maze Look Like a Maze?
par: Hsu, Joy, et autres
Publié: (2024)
par: Hsu, Joy, et autres
Publié: (2024)
CriticAL: Critic Automation with Language Models
par: Li, Michael Y., et autres
Publié: (2024)
par: Li, Michael Y., et autres
Publié: (2024)
Learning to Compress Prompts with Gist Tokens
par: Mu, Jesse, et autres
Publié: (2023)
par: Mu, Jesse, et autres
Publié: (2023)
Prediction of Item Difficulty for Reading Comprehension Items by Creation of Annotated Item Repository
par: Kapoor, Radhika, et autres
Publié: (2025)
par: Kapoor, Radhika, et autres
Publié: (2025)
Reinforcement Learning for Machine Learning Engineering Agents
par: Yang, Sherry, et autres
Publié: (2025)
par: Yang, Sherry, et autres
Publié: (2025)
QRA++: Quantified Reproducibility Assessment for Common Types of Results in Natural Language Processing
par: Belz, Anya
Publié: (2025)
par: Belz, Anya
Publié: (2025)
Crisp Attention: Regularizing Transformers via Structured Sparsity
par: Gandhi, Sagar, et autres
Publié: (2025)
par: Gandhi, Sagar, et autres
Publié: (2025)
High-quality Data-to-Text Generation for Severely Under-Resourced Languages with Out-of-the-box Large Language Models
par: Lorandi, Michela, et autres
Publié: (2024)
par: Lorandi, Michela, et autres
Publié: (2024)
DevBench: A multimodal developmental benchmark for language learning
par: Tan, Alvin Wei Ming, et autres
Publié: (2024)
par: Tan, Alvin Wei Ming, et autres
Publié: (2024)
Bayesian scaling laws for in-context learning
par: Arora, Aryaman, et autres
Publié: (2024)
par: Arora, Aryaman, et autres
Publié: (2024)
Sample, Don't Search: Rethinking Test-Time Alignment for Language Models
par: Faria, Gonçalo, et autres
Publié: (2025)
par: Faria, Gonçalo, et autres
Publié: (2025)
Learning Next Action Predictors from Human-Computer Interaction
par: Shaikh, Omar, et autres
Publié: (2026)
par: Shaikh, Omar, et autres
Publié: (2026)
Efficient RL for optimizing conversation level outcomes with an LLM-based tutor
par: Nam, Hyunji, et autres
Publié: (2025)
par: Nam, Hyunji, et autres
Publié: (2025)
Enhancing Knowledge Distillation of Large Language Models through Efficient Multi-Modal Distribution Alignment
par: Peng, Tianyu, et autres
Publié: (2024)
par: Peng, Tianyu, et autres
Publié: (2024)
ELSA: A Style Aligned Dataset for Emotionally Intelligent Language Generation
par: Gandhi, Vishal, et autres
Publié: (2025)
par: Gandhi, Vishal, et autres
Publié: (2025)
Hypothesis Search: Inductive Reasoning with Language Models
par: Wang, Ruocheng, et autres
Publié: (2023)
par: Wang, Ruocheng, et autres
Publié: (2023)
AIPsychoBench: Understanding the Psychometric Differences between LLMs and Humans
par: Xie, Wei, et autres
Publié: (2025)
par: Xie, Wei, et autres
Publié: (2025)
Set the Clock: Temporal Alignment of Pretrained Language Models
par: Zhao, Bowen, et autres
Publié: (2024)
par: Zhao, Bowen, et autres
Publié: (2024)
Documents similaires
-
Evaluating and Optimizing Educational Content with Large Language Model Judgments
par: He-Yueya, Joy, et autres
Publié: (2024) -
Learning to Simulate Human Dialogue
par: Gandhi, Kanishk, et autres
Publié: (2026) -
GIANTS: Generative Insight Anticipation from Scientific Literature
par: He-Yueya, Joy, et autres
Publié: (2026) -
Procedural Dilemma Generation for Evaluating Moral Reasoning in Humans and Language Models
par: Fränken, Jan-Philipp, et autres
Publié: (2024) -
Endless Terminals: Scaling RL Environments for Terminal Agents
par: Gandhi, Kanishk, et autres
Publié: (2026)