Why do language models perform worse for morphologically complex languages?
Fuente:
arXiv
Guardado en:
| Autores principales: | Arnett, Catherine, Bergen, Benjamin K. |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Revenge of the Fallen? Recurrent Models Match Transformers at Predicting Human Language Comprehension Metrics
por: Michaelov, James A., et al.
Publicado: (2024)
por: Michaelov, James A., et al.
Publicado: (2024)
A Bit of a Problem: Measurement Disparities in Dataset Sizes Across Languages
por: Arnett, Catherine, et al.
Publicado: (2024)
por: Arnett, Catherine, et al.
Publicado: (2024)
Goldfish: Monolingual Language Models for 350 Languages
por: Chang, Tyler A., et al.
Publicado: (2024)
por: Chang, Tyler A., et al.
Publicado: (2024)
Explaining and Mitigating Crosslingual Tokenizer Inequities
por: Arnett, Catherine, et al.
Publicado: (2025)
por: Arnett, Catherine, et al.
Publicado: (2025)
On the Acquisition of Shared Grammatical Representations in Bilingual Language Models
por: Arnett, Catherine, et al.
Publicado: (2025)
por: Arnett, Catherine, et al.
Publicado: (2025)
Why transformers are obviously good models of language
por: Hill, Felix
Publicado: (2024)
por: Hill, Felix
Publicado: (2024)
Dissecting the Ullman Variations with a SCALPEL: Why do LLMs fail at Trivial Alterations to the False Belief Task?
por: Pi, Zhiqiang, et al.
Publicado: (2024)
por: Pi, Zhiqiang, et al.
Publicado: (2024)
Why do small language models underperform? Studying Language Model Saturation via the Softmax Bottleneck
por: Godey, Nathan, et al.
Publicado: (2024)
por: Godey, Nathan, et al.
Publicado: (2024)
InkubaLM: A small language model for low-resource African languages
por: Tonja, Atnafu Lambebo, et al.
Publicado: (2024)
por: Tonja, Atnafu Lambebo, et al.
Publicado: (2024)
Large language models have learned to use language
por: Lupyan, Gary
Publicado: (2025)
por: Lupyan, Gary
Publicado: (2025)
BPE Stays on SCRIPT: Structured Encoding for Robust Multilingual Pretokenization
por: Land, Sander, et al.
Publicado: (2025)
por: Land, Sander, et al.
Publicado: (2025)
Can we teach language models to gloss endangered languages?
por: Ginn, Michael, et al.
Publicado: (2024)
por: Ginn, Michael, et al.
Publicado: (2024)
Retrieval augmentation of large language models for lay language generation
por: Guo, Yue, et al.
Publicado: (2022)
por: Guo, Yue, et al.
Publicado: (2022)
Do large language models resemble humans in language use?
por: Cai, Zhenguang G., et al.
Publicado: (2023)
por: Cai, Zhenguang G., et al.
Publicado: (2023)
Studies with impossible languages falsify LMs as models of human language
por: Bowers, Jeffrey S., et al.
Publicado: (2025)
por: Bowers, Jeffrey S., et al.
Publicado: (2025)
Tiny language models
por: Gross, Ronit D., et al.
Publicado: (2025)
por: Gross, Ronit D., et al.
Publicado: (2025)
Large language models are not about natural language
por: Bolhuis, Johan J., et al.
Publicado: (2025)
por: Bolhuis, Johan J., et al.
Publicado: (2025)
Dissociating language and thought in large language models
por: Mahowald, Kyle, et al.
Publicado: (2023)
por: Mahowald, Kyle, et al.
Publicado: (2023)
How much do language models memorize?
por: Morris, John X., et al.
Publicado: (2025)
por: Morris, John X., et al.
Publicado: (2025)
AI-AI Bias: large language models favor communications generated by large language models
por: Laurito, Walter, et al.
Publicado: (2024)
por: Laurito, Walter, et al.
Publicado: (2024)
Large language models management of medications: three performance analyses
por: Henry, Kelli, et al.
Publicado: (2025)
por: Henry, Kelli, et al.
Publicado: (2025)
Why are language models less surprised than humans? Testing the Parse Multiplicity Mismatch Hypothesis
por: Timkey, William, et al.
Publicado: (2026)
por: Timkey, William, et al.
Publicado: (2026)
Prompting language influences diagnostic reasoning and accuracy of large language models
por: Bazoge, Adrien, et al.
Publicado: (2026)
por: Bazoge, Adrien, et al.
Publicado: (2026)
Logical forms complement probability in understanding language model (and human) performance
por: Wang, Yixuan, et al.
Publicado: (2025)
por: Wang, Yixuan, et al.
Publicado: (2025)
Evaluating the performance and fragility of large language models on the self-assessment for neurological surgeons
por: Vishwanath, Krithik, et al.
Publicado: (2025)
por: Vishwanath, Krithik, et al.
Publicado: (2025)
Why is constrained neural language generation particularly challenging?
por: Garbacea, Cristina, et al.
Publicado: (2022)
por: Garbacea, Cristina, et al.
Publicado: (2022)
Do language models accommodate their users? A study of linguistic convergence
por: Blevins, Terra, et al.
Publicado: (2025)
por: Blevins, Terra, et al.
Publicado: (2025)
Disaggregation Reveals Hidden Training Dynamics: The Case of Agreement Attraction
por: Michaelov, James A., et al.
Publicado: (2025)
por: Michaelov, James A., et al.
Publicado: (2025)
Humans overrely on overconfident language models, across languages
por: Rathi, Neil, et al.
Publicado: (2025)
por: Rathi, Neil, et al.
Publicado: (2025)
Dynamic data sampler for cross-language transfer learning in large language models
por: Li, Yudong, et al.
Publicado: (2024)
por: Li, Yudong, et al.
Publicado: (2024)
Multilingual large language models leak human stereotypes across language boundaries
por: Cao, Yang Trista, et al.
Publicado: (2023)
por: Cao, Yang Trista, et al.
Publicado: (2023)
Effective vocabulary expanding of multilingual language models for extremely low-resource languages
por: Zheng, Jianyu
Publicado: (2026)
por: Zheng, Jianyu
Publicado: (2026)
Involvement drives complexity of language in online debates
por: Amadori, Eleonora, et al.
Publicado: (2025)
por: Amadori, Eleonora, et al.
Publicado: (2025)
XLM: A Python package for non-autoregressive language models
por: Patel, Dhruvesh, et al.
Publicado: (2025)
por: Patel, Dhruvesh, et al.
Publicado: (2025)
Do language models capture implied discourse meanings? An investigation with exhaustivity implicatures of Korean morphology
por: Shin, Hagyeong, et al.
Publicado: (2024)
por: Shin, Hagyeong, et al.
Publicado: (2024)
Superhuman performance of a large language model on the reasoning tasks of a physician
por: Brodeur, Peter G., et al.
Publicado: (2024)
por: Brodeur, Peter G., et al.
Publicado: (2024)
Anthropocentric bias in language model evaluation
por: Millière, Raphaël, et al.
Publicado: (2024)
por: Millière, Raphaël, et al.
Publicado: (2024)
Open foundation models for Azerbaijani language
por: Isbarov, Jafar, et al.
Publicado: (2024)
por: Isbarov, Jafar, et al.
Publicado: (2024)
Demystifying optimized prompts in language models
por: Melamed, Rimon, et al.
Publicado: (2025)
por: Melamed, Rimon, et al.
Publicado: (2025)
Explanation sensitivity to the randomness of large language models: the case of journalistic text classification
por: Bogaert, Jeremie, et al.
Publicado: (2024)
por: Bogaert, Jeremie, et al.
Publicado: (2024)
Ejemplares similares
-
Revenge of the Fallen? Recurrent Models Match Transformers at Predicting Human Language Comprehension Metrics
por: Michaelov, James A., et al.
Publicado: (2024) -
A Bit of a Problem: Measurement Disparities in Dataset Sizes Across Languages
por: Arnett, Catherine, et al.
Publicado: (2024) -
Goldfish: Monolingual Language Models for 350 Languages
por: Chang, Tyler A., et al.
Publicado: (2024) -
Explaining and Mitigating Crosslingual Tokenizer Inequities
por: Arnett, Catherine, et al.
Publicado: (2025) -
On the Acquisition of Shared Grammatical Representations in Bilingual Language Models
por: Arnett, Catherine, et al.
Publicado: (2025)