Language models align with human judgments on key grammatical constructions
Fuente:
arXiv
Salvato in:
| Autori principali: | Hu, Jennifer, Mahowald, Kyle, Lupyan, Gary, Ivanova, Anna, Levy, Roger |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Language Models Fail to Introspect About Their Knowledge of Language
di: Song, Siyuan, et al.
Pubblicazione: (2025)
di: Song, Siyuan, et al.
Pubblicazione: (2025)
What Can String Probability Tell Us About Grammaticality?
di: Hu, Jennifer, et al.
Pubblicazione: (2025)
di: Hu, Jennifer, et al.
Pubblicazione: (2025)
The Counterexample Game: Iterated Conceptual Analysis and Repair in Language Models
di: Drucker, Daniel, et al.
Pubblicazione: (2026)
di: Drucker, Daniel, et al.
Pubblicazione: (2026)
Privileged Self-Access Matters for Introspection in AI
di: Song, Siyuan, et al.
Pubblicazione: (2025)
di: Song, Siyuan, et al.
Pubblicazione: (2025)
Dissociating language and thought in large language models
di: Mahowald, Kyle, et al.
Pubblicazione: (2023)
di: Mahowald, Kyle, et al.
Pubblicazione: (2023)
Emergent Introspection in AI is Content-Agnostic
di: Lederman, Harvey, et al.
Pubblicazione: (2026)
di: Lederman, Harvey, et al.
Pubblicazione: (2026)
Experimental Contexts Can Facilitate Robust Semantic Property Inference in Language Models, but Inconsistently
di: Misra, Kanishka, et al.
Pubblicazione: (2024)
di: Misra, Kanishka, et al.
Pubblicazione: (2024)
Decrypting Cryptic Crosswords: Semantically Complex Wordplay Puzzles as a Target for NLP
di: Rozner, Josh, et al.
Pubblicazione: (2021)
di: Rozner, Josh, et al.
Pubblicazione: (2021)
Causal Interventions Reveal Shared Structure Across English Filler-Gap Constructions
di: Boguraev, Sasha, et al.
Pubblicazione: (2025)
di: Boguraev, Sasha, et al.
Pubblicazione: (2025)
Large language models have learned to use language
di: Lupyan, Gary
Pubblicazione: (2025)
di: Lupyan, Gary
Pubblicazione: (2025)
Models Can and Should Embrace the Communicative Nature of Human-Generated Math
di: Boguraev, Sasha, et al.
Pubblicazione: (2024)
di: Boguraev, Sasha, et al.
Pubblicazione: (2024)
semantic-features: A User-Friendly Tool for Studying Contextual Word Embeddings in Interpretable Semantic Spaces
di: Ranganathan, Jwalanthi, et al.
Pubblicazione: (2025)
di: Ranganathan, Jwalanthi, et al.
Pubblicazione: (2025)
Mission: Impossible Language Models
di: Kallini, Julie, et al.
Pubblicazione: (2024)
di: Kallini, Julie, et al.
Pubblicazione: (2024)
Strong and weak alignment of large language models with human values
di: Khamassi, Mehdi, et al.
Pubblicazione: (2024)
di: Khamassi, Mehdi, et al.
Pubblicazione: (2024)
Toward best research practices in AI Psychology
di: Ivanova, Anna A.
Pubblicazione: (2023)
di: Ivanova, Anna A.
Pubblicazione: (2023)
The Astonishing Ability of Large Language Models to Parse Jabberwockified Language
di: Lupyan, Gary, et al.
Pubblicazione: (2026)
di: Lupyan, Gary, et al.
Pubblicazione: (2026)
The simulation of judgment in LLMs
di: Loru, Edoardo, et al.
Pubblicazione: (2025)
di: Loru, Edoardo, et al.
Pubblicazione: (2025)
How important is language for human-like intelligence?
di: Lupyan, Gary, et al.
Pubblicazione: (2025)
di: Lupyan, Gary, et al.
Pubblicazione: (2025)
Is It JUST Semantics? A Case Study of Discourse Particle Understanding in LLMs
di: Sheffield, William, et al.
Pubblicazione: (2025)
di: Sheffield, William, et al.
Pubblicazione: (2025)
Persona-judge: Personalized Alignment of Large Language Models via Token-level Self-judgment
di: Zhang, Xiaotian, et al.
Pubblicazione: (2025)
di: Zhang, Xiaotian, et al.
Pubblicazione: (2025)
A suite of LMs comprehend puzzle statements as well as humans
di: Goldberg, Adele E, et al.
Pubblicazione: (2025)
di: Goldberg, Adele E, et al.
Pubblicazione: (2025)
Language models are better than humans at next-token prediction
di: Shlegeris, Buck, et al.
Pubblicazione: (2022)
di: Shlegeris, Buck, et al.
Pubblicazione: (2022)
Signatures of human-like processing in Transformer forward passes
di: Hu, Jennifer, et al.
Pubblicazione: (2025)
di: Hu, Jennifer, et al.
Pubblicazione: (2025)
Log Probabilities Are a Reliable Estimate of Semantic Plausibility in Base and Instruction-Tuned Language Models
di: Kauf, Carina, et al.
Pubblicazione: (2024)
di: Kauf, Carina, et al.
Pubblicazione: (2024)
TouchAI: Exploring human-AI perceptual alignment in touch through language model representations
di: Zhong, Shu, et al.
Pubblicazione: (2024)
di: Zhong, Shu, et al.
Pubblicazione: (2024)
How Do LLMs Use Their Depth?
di: Gupta, Akshat, et al.
Pubblicazione: (2025)
di: Gupta, Akshat, et al.
Pubblicazione: (2025)
Auxiliary task demands mask the capabilities of smaller language models
di: Hu, Jennifer, et al.
Pubblicazione: (2024)
di: Hu, Jennifer, et al.
Pubblicazione: (2024)
How Linguistics Learned to Stop Worrying and Love the Language Models
di: Futrell, Richard, et al.
Pubblicazione: (2025)
di: Futrell, Richard, et al.
Pubblicazione: (2025)
Re-evaluating Theory of Mind evaluation in large language models
di: Hu, Jennifer, et al.
Pubblicazione: (2025)
di: Hu, Jennifer, et al.
Pubblicazione: (2025)
Elements of World Knowledge (EWoK): A Cognition-Inspired Framework for Evaluating Basic World Knowledge in Language Models
di: Ivanova, Anna A., et al.
Pubblicazione: (2024)
di: Ivanova, Anna A., et al.
Pubblicazione: (2024)
Language Models Learn Rare Phenomena from Less Rare Phenomena: The Case of the Missing AANNs
di: Misra, Kanishka, et al.
Pubblicazione: (2024)
di: Misra, Kanishka, et al.
Pubblicazione: (2024)
Using LLMs to identify features of personal and professional skills in an open-response situational judgment test
di: Walsh, Cole, et al.
Pubblicazione: (2025)
di: Walsh, Cole, et al.
Pubblicazione: (2025)
Language modelling techniques for analysing the impact of human genetic variation
di: Hegde, Megha, et al.
Pubblicazione: (2025)
di: Hegde, Megha, et al.
Pubblicazione: (2025)
Are Language Models More Like Libraries or Like Librarians? Bibliotechnism, the Novel Reference Problem, and the Attitudes of LLMs
di: Lederman, Harvey, et al.
Pubblicazione: (2024)
di: Lederman, Harvey, et al.
Pubblicazione: (2024)
Alignment Pretraining: AI Discourse Causes Self-Fulfilling (Mis)alignment
di: Tice, Cameron, et al.
Pubblicazione: (2026)
di: Tice, Cameron, et al.
Pubblicazione: (2026)
Hardware-aligned Hierarchical Sparse Attention for Efficient Long-term Memory Access
di: Hu, Xiang, et al.
Pubblicazione: (2025)
di: Hu, Xiang, et al.
Pubblicazione: (2025)
Are they human? Detecting large language models by probing human memory constraints
di: Schug, Simon, et al.
Pubblicazione: (2026)
di: Schug, Simon, et al.
Pubblicazione: (2026)
An overview of domain-specific foundation model: key technologies, applications and challenges
di: Chen, Haolong, et al.
Pubblicazione: (2024)
di: Chen, Haolong, et al.
Pubblicazione: (2024)
Same Task, More Tokens: the Impact of Input Length on the Reasoning Performance of Large Language Models
di: Levy, Mosh, et al.
Pubblicazione: (2024)
di: Levy, Mosh, et al.
Pubblicazione: (2024)
Increasing faithfulness in human-human dialog summarization with Spoken Language Understanding tasks
di: Akani, Eunice, et al.
Pubblicazione: (2024)
di: Akani, Eunice, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Language Models Fail to Introspect About Their Knowledge of Language
di: Song, Siyuan, et al.
Pubblicazione: (2025) -
What Can String Probability Tell Us About Grammaticality?
di: Hu, Jennifer, et al.
Pubblicazione: (2025) -
The Counterexample Game: Iterated Conceptual Analysis and Repair in Language Models
di: Drucker, Daniel, et al.
Pubblicazione: (2026) -
Privileged Self-Access Matters for Introspection in AI
di: Song, Siyuan, et al.
Pubblicazione: (2025) -
Dissociating language and thought in large language models
di: Mahowald, Kyle, et al.
Pubblicazione: (2023)