Language in Vivo vs. in Silico: Size Matters but Larger Language Models Still Do Not Comprehend Language on a Par with Humans Due to Impenetrable Semantic Reference
Fuente:
arXiv
Salvato in:
| Autori principali: | Dentella, Vittoria, Guenther, Fritz, Leivada, Evelina |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Testing AI on language comprehension tasks reveals insensitivity to underlying meaning
di: Dentella, Vittoria, et al.
Pubblicazione: (2023)
di: Dentella, Vittoria, et al.
Pubblicazione: (2023)
Fundamental Principles of Linguistic Structure are Not Represented by o3
di: Murphy, Elliot, et al.
Pubblicazione: (2025)
di: Murphy, Elliot, et al.
Pubblicazione: (2025)
ChatGPT-generated texts show authorship traits that identify them as non-human
di: Dentella, Vittoria, et al.
Pubblicazione: (2025)
di: Dentella, Vittoria, et al.
Pubblicazione: (2025)
Large Language Model probabilities cannot distinguish between possible and impossible language
di: Leivada, Evelina, et al.
Pubblicazione: (2025)
di: Leivada, Evelina, et al.
Pubblicazione: (2025)
A Sentence is Worth a Thousand Pictures: Can Large Language Models Understand Hum4n L4ngu4ge and the W0rld behind W0rds?
di: Leivada, Evelina, et al.
Pubblicazione: (2023)
di: Leivada, Evelina, et al.
Pubblicazione: (2023)
Tracing the ongoing emergence of human-like reasoning in Large Language Models
di: Morosi, Paolo, et al.
Pubblicazione: (2026)
di: Morosi, Paolo, et al.
Pubblicazione: (2026)
Community size rather than grammatical complexity better predicts Large Language Model accuracy in a novel Wug Test
di: Pantelidou, Nikoleta, et al.
Pubblicazione: (2025)
di: Pantelidou, Nikoleta, et al.
Pubblicazione: (2025)
Quantification and object perception in Multimodal Large Language Models and human linguistic cognition
di: Montero, Raquel, et al.
Pubblicazione: (2025)
di: Montero, Raquel, et al.
Pubblicazione: (2025)
Positional Cognitive Specialization: Where Do LLMs Learn To Comprehend and Speak Your Language?
di: Salim, Luis Frentzen, et al.
Pubblicazione: (2026)
di: Salim, Luis Frentzen, et al.
Pubblicazione: (2026)
Why Larger Language Models Do In-context Learning Differently?
di: Shi, Zhenmei, et al.
Pubblicazione: (2024)
di: Shi, Zhenmei, et al.
Pubblicazione: (2024)
An Assessment on Comprehending Mental Health through Large Language Models
di: Arcan, Mihael, et al.
Pubblicazione: (2024)
di: Arcan, Mihael, et al.
Pubblicazione: (2024)
Multilingual Large Language Models do not comprehend all natural languages to equal degrees
di: Moskvina, Natalia, et al.
Pubblicazione: (2026)
di: Moskvina, Natalia, et al.
Pubblicazione: (2026)
Do Language Models' Words Refer?
di: Mandelkern, Matthew, et al.
Pubblicazione: (2023)
di: Mandelkern, Matthew, et al.
Pubblicazione: (2023)
Smaller Language Models are capable of selecting Instruction-Tuning Training Data for Larger Language Models
di: Mekala, Dheeraj, et al.
Pubblicazione: (2024)
di: Mekala, Dheeraj, et al.
Pubblicazione: (2024)
Are Aligned Large Language Models Still Misaligned?
di: Naseem, Usman, et al.
Pubblicazione: (2026)
di: Naseem, Usman, et al.
Pubblicazione: (2026)
Small Language Models Fine-tuned to Coordinate Larger Language Models improve Complex Reasoning
di: Juneja, Gurusha, et al.
Pubblicazione: (2023)
di: Juneja, Gurusha, et al.
Pubblicazione: (2023)
SCORE: Systematic COnsistency and Robustness Evaluation for Large Language Models
di: Nalbandyan, Grigor, et al.
Pubblicazione: (2025)
di: Nalbandyan, Grigor, et al.
Pubblicazione: (2025)
Seamless Deception: Larger Language Models Are Better Knowledge Concealers
di: Ashok, Dhananjay, et al.
Pubblicazione: (2026)
di: Ashok, Dhananjay, et al.
Pubblicazione: (2026)
Segment First or Comprehend First? Explore the Limit of Unsupervised Word Segmentation with Large Language Models
di: Zhang, Zihong, et al.
Pubblicazione: (2025)
di: Zhang, Zihong, et al.
Pubblicazione: (2025)
Log Probabilities Are a Reliable Estimate of Semantic Plausibility in Base and Instruction-Tuned Language Models
di: Kauf, Carina, et al.
Pubblicazione: (2024)
di: Kauf, Carina, et al.
Pubblicazione: (2024)
Should We Still Pretrain Encoders with Masked Language Modeling?
di: Gisserot-Boukhlef, Hippolyte, et al.
Pubblicazione: (2025)
di: Gisserot-Boukhlef, Hippolyte, et al.
Pubblicazione: (2025)
Large Language Models Still Exhibit Bias in Long Text
di: Jeung, Wonje, et al.
Pubblicazione: (2024)
di: Jeung, Wonje, et al.
Pubblicazione: (2024)
Do Language Models Agree with Human Perceptions of Suspense in Stories?
di: Matlin, Glenn, et al.
Pubblicazione: (2025)
di: Matlin, Glenn, et al.
Pubblicazione: (2025)
Do Language Models Know When They're Hallucinating References?
di: Agrawal, Ayush, et al.
Pubblicazione: (2023)
di: Agrawal, Ayush, et al.
Pubblicazione: (2023)
Lexicon-Level Contrastive Visual-Grounding Improves Language Modeling
di: Zhuang, Chengxu, et al.
Pubblicazione: (2024)
di: Zhuang, Chengxu, et al.
Pubblicazione: (2024)
Leveraging Vision-Language Pre-training for Human Activity Recognition in Still Images
di: Mahanta, Cristina, et al.
Pubblicazione: (2025)
di: Mahanta, Cristina, et al.
Pubblicazione: (2025)
Surprising Efficacy of Fine-Tuned Transformers for Fact-Checking over Larger Language Models
di: Setty, Vinay
Pubblicazione: (2024)
di: Setty, Vinay
Pubblicazione: (2024)
Vectors from Larger Language Models Predict Human Reading Time and fMRI Data More Poorly when Dimensionality Expansion is Controlled
di: Lin, Yi-Chien, et al.
Pubblicazione: (2025)
di: Lin, Yi-Chien, et al.
Pubblicazione: (2025)
Do Language Models Encode Semantic Relations? Probing and Sparse Feature Analysis
di: Diera, Andor, et al.
Pubblicazione: (2026)
di: Diera, Andor, et al.
Pubblicazione: (2026)
Too Big to Fail: Larger Language Models are Disproportionately Resilient to Induction of Dementia-Related Linguistic Anomalies
di: Li, Changye, et al.
Pubblicazione: (2024)
di: Li, Changye, et al.
Pubblicazione: (2024)
Surprisal from Larger Transformer-based Language Models Predicts fMRI Data More Poorly
di: Lin, Yi-Chien, et al.
Pubblicazione: (2025)
di: Lin, Yi-Chien, et al.
Pubblicazione: (2025)
Large Language Models Perform on Par with Experts Identifying Mental Health Factors in Adolescent Online Forums
di: Lorge, Isabelle, et al.
Pubblicazione: (2024)
di: Lorge, Isabelle, et al.
Pubblicazione: (2024)
RoParQ: Paraphrase-Aware Alignment of Large Language Models Towards Robustness to Paraphrased Questions
di: Choi, Minjoon
Pubblicazione: (2025)
di: Choi, Minjoon
Pubblicazione: (2025)
Do Large Language Models Judge Error Severity Like Humans?
di: Sun, Diege, et al.
Pubblicazione: (2025)
di: Sun, Diege, et al.
Pubblicazione: (2025)
Do Language Models Exhibit Human-like Structural Priming Effects?
di: Jumelet, Jaap, et al.
Pubblicazione: (2024)
di: Jumelet, Jaap, et al.
Pubblicazione: (2024)
When Do Language Models Endorse Limitations on Human Rights Principles?
di: Samway, Keenan, et al.
Pubblicazione: (2026)
di: Samway, Keenan, et al.
Pubblicazione: (2026)
Large Language Models Are Still Misled by Simple Bias Ensembles
di: Sun, Zhouhao, et al.
Pubblicazione: (2025)
di: Sun, Zhouhao, et al.
Pubblicazione: (2025)
Humans vs Vision-Language Models: A Unified Measure of Narrative Coherence
di: Ilinykh, Nikolai, et al.
Pubblicazione: (2026)
di: Ilinykh, Nikolai, et al.
Pubblicazione: (2026)
Enhancing Aspect-based Sentiment Analysis with ParsBERT in Persian Language
di: Ariai, Farid, et al.
Pubblicazione: (2025)
di: Ariai, Farid, et al.
Pubblicazione: (2025)
Representational Curvature Modulates Behavioral Uncertainty in Large Language Models
di: King, Jack, et al.
Pubblicazione: (2026)
di: King, Jack, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Testing AI on language comprehension tasks reveals insensitivity to underlying meaning
di: Dentella, Vittoria, et al.
Pubblicazione: (2023) -
Fundamental Principles of Linguistic Structure are Not Represented by o3
di: Murphy, Elliot, et al.
Pubblicazione: (2025) -
ChatGPT-generated texts show authorship traits that identify them as non-human
di: Dentella, Vittoria, et al.
Pubblicazione: (2025) -
Large Language Model probabilities cannot distinguish between possible and impossible language
di: Leivada, Evelina, et al.
Pubblicazione: (2025) -
A Sentence is Worth a Thousand Pictures: Can Large Language Models Understand Hum4n L4ngu4ge and the W0rld behind W0rds?
di: Leivada, Evelina, et al.
Pubblicazione: (2023)