Why transformers are obviously good models of language
Fuente:
arXiv
Guardado en:
| Autor principal: | Hill, Felix |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Why do language models perform worse for morphologically complex languages?
por: Arnett, Catherine, et al.
Publicado: (2024)
por: Arnett, Catherine, et al.
Publicado: (2024)
Is your multimodal large language model a good science tutor?
por: Liu, Ming, et al.
Publicado: (2025)
por: Liu, Ming, et al.
Publicado: (2025)
Large language models are good medical coders, if provided with tools
por: Kwan, Keith
Publicado: (2024)
por: Kwan, Keith
Publicado: (2024)
Efficient transformer with reinforced position embedding for language models
por: Hsiao, Yen-Che, et al.
Publicado: (2024)
por: Hsiao, Yen-Che, et al.
Publicado: (2024)
Geopolitical biases in LLMs: what are the "good" and the "bad" countries according to contemporary language models
por: Salnikov, Mikhail, et al.
Publicado: (2025)
por: Salnikov, Mikhail, et al.
Publicado: (2025)
NLD-LLM: A systematic framework for evaluating small language transformer models on natural language description
por: Jelodar, Hamed, et al.
Publicado: (2025)
por: Jelodar, Hamed, et al.
Publicado: (2025)
Lost without translation -- Can transformer (language models) understand mood states?
por: Shivaprakash, Prakrithi, et al.
Publicado: (2025)
por: Shivaprakash, Prakrithi, et al.
Publicado: (2025)
Why are language models less surprised than humans? Testing the Parse Multiplicity Mismatch Hypothesis
por: Timkey, William, et al.
Publicado: (2026)
por: Timkey, William, et al.
Publicado: (2026)
Mixture-of-Depths: Dynamically allocating compute in transformer-based language models
por: Raposo, David, et al.
Publicado: (2024)
por: Raposo, David, et al.
Publicado: (2024)
Why do small language models underperform? Studying Language Model Saturation via the Softmax Bottleneck
por: Godey, Nathan, et al.
Publicado: (2024)
por: Godey, Nathan, et al.
Publicado: (2024)
Humans and transformer LMs: Abstraction drives language learning
por: Jian, Jasper, et al.
Publicado: (2026)
por: Jian, Jasper, et al.
Publicado: (2026)
Physical models realizing the transformer architecture of large language models
por: Chen, Zeqian
Publicado: (2025)
por: Chen, Zeqian
Publicado: (2025)
Comparison of different Unique hard attention transformer models by the formal languages they can recognize
por: Ryvkin, Leonid
Publicado: (2025)
por: Ryvkin, Leonid
Publicado: (2025)
Human-like fleeting memory improves language learning but impairs reading time prediction in transformer language models
por: Thamma, Abishek, et al.
Publicado: (2025)
por: Thamma, Abishek, et al.
Publicado: (2025)
Spatio-temporal transformer to support automatic sign language translation
por: Ruiz, Christian, et al.
Publicado: (2025)
por: Ruiz, Christian, et al.
Publicado: (2025)
Re-evaluating Theory of Mind evaluation in large language models
por: Hu, Jennifer, et al.
Publicado: (2025)
por: Hu, Jennifer, et al.
Publicado: (2025)
Why is constrained neural language generation particularly challenging?
por: Garbacea, Cristina, et al.
Publicado: (2022)
por: Garbacea, Cristina, et al.
Publicado: (2022)
A path to natural language through tokenisation and transformers
por: Berman, David S., et al.
Publicado: (2026)
por: Berman, David S., et al.
Publicado: (2026)
Attention-based transformer models for image captioning across languages: An in-depth survey and evaluation
por: Albadarneh, Israa A., et al.
Publicado: (2025)
por: Albadarneh, Israa A., et al.
Publicado: (2025)
Enhanced Arabic-language cyberbullying detection: deep embedding and transformer (BERT) approaches
por: Aljohani, Ebtesam Jaber, et al.
Publicado: (2025)
por: Aljohani, Ebtesam Jaber, et al.
Publicado: (2025)
A multitask transformer to sign language translation using motion gesture primitives
por: López, Fredy Alejandro Mendoza, et al.
Publicado: (2025)
por: López, Fredy Alejandro Mendoza, et al.
Publicado: (2025)
Large language models have learned to use language
por: Lupyan, Gary
Publicado: (2025)
por: Lupyan, Gary
Publicado: (2025)
Tiny language models
por: Gross, Ronit D., et al.
Publicado: (2025)
por: Gross, Ronit D., et al.
Publicado: (2025)
Detecting out-of-distribution text using topological features of transformer-based language models
por: Pollano, Andres, et al.
Publicado: (2023)
por: Pollano, Andres, et al.
Publicado: (2023)
Can we teach language models to gloss endangered languages?
por: Ginn, Michael, et al.
Publicado: (2024)
por: Ginn, Michael, et al.
Publicado: (2024)
Retrieval augmentation of large language models for lay language generation
por: Guo, Yue, et al.
Publicado: (2022)
por: Guo, Yue, et al.
Publicado: (2022)
Do large language models resemble humans in language use?
por: Cai, Zhenguang G., et al.
Publicado: (2023)
por: Cai, Zhenguang G., et al.
Publicado: (2023)
Studies with impossible languages falsify LMs as models of human language
por: Bowers, Jeffrey S., et al.
Publicado: (2025)
por: Bowers, Jeffrey S., et al.
Publicado: (2025)
Prompting language influences diagnostic reasoning and accuracy of large language models
por: Bazoge, Adrien, et al.
Publicado: (2026)
por: Bazoge, Adrien, et al.
Publicado: (2026)
Child vs. machine language learning: Can the logical structure of human language unleash LLMs?
por: Sauerland, Uli, et al.
Publicado: (2025)
por: Sauerland, Uli, et al.
Publicado: (2025)
Simulated patient systems powered by large language model-based AI agents offer potential for transforming medical education
por: Yu, Huizi, et al.
Publicado: (2024)
por: Yu, Huizi, et al.
Publicado: (2024)
Large language models are not about natural language
por: Bolhuis, Johan J., et al.
Publicado: (2025)
por: Bolhuis, Johan J., et al.
Publicado: (2025)
Dissociating language and thought in large language models
por: Mahowald, Kyle, et al.
Publicado: (2023)
por: Mahowald, Kyle, et al.
Publicado: (2023)
Dynamic data sampler for cross-language transfer learning in large language models
por: Li, Yudong, et al.
Publicado: (2024)
por: Li, Yudong, et al.
Publicado: (2024)
InkubaLM: A small language model for low-resource African languages
por: Tonja, Atnafu Lambebo, et al.
Publicado: (2024)
por: Tonja, Atnafu Lambebo, et al.
Publicado: (2024)
Multilingual large language models leak human stereotypes across language boundaries
por: Cao, Yang Trista, et al.
Publicado: (2023)
por: Cao, Yang Trista, et al.
Publicado: (2023)
Effective vocabulary expanding of multilingual language models for extremely low-resource languages
por: Zheng, Jianyu
Publicado: (2026)
por: Zheng, Jianyu
Publicado: (2026)
Are LLMs reliable? An exploration of the reliability of large language models in clinical note generation
por: Carandang, Kristine Ann M., et al.
Publicado: (2025)
por: Carandang, Kristine Ann M., et al.
Publicado: (2025)
Anthropocentric bias in language model evaluation
por: Millière, Raphaël, et al.
Publicado: (2024)
por: Millière, Raphaël, et al.
Publicado: (2024)
Open foundation models for Azerbaijani language
por: Isbarov, Jafar, et al.
Publicado: (2024)
por: Isbarov, Jafar, et al.
Publicado: (2024)
Ejemplares similares
-
Why do language models perform worse for morphologically complex languages?
por: Arnett, Catherine, et al.
Publicado: (2024) -
Is your multimodal large language model a good science tutor?
por: Liu, Ming, et al.
Publicado: (2025) -
Large language models are good medical coders, if provided with tools
por: Kwan, Keith
Publicado: (2024) -
Efficient transformer with reinforced position embedding for language models
por: Hsiao, Yen-Che, et al.
Publicado: (2024) -
Geopolitical biases in LLMs: what are the "good" and the "bad" countries according to contemporary language models
por: Salnikov, Mikhail, et al.
Publicado: (2025)