What do language models model? Transformers, automata, and the format of thought
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Klein, Colin |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Dissociating language and thought in large language models
par: Mahowald, Kyle, et autres
Publié: (2023)
par: Mahowald, Kyle, et autres
Publié: (2023)
What can large language models do for sustainable food?
par: Thomas, Anna T., et autres
Publié: (2025)
par: Thomas, Anna T., et autres
Publié: (2025)
Large language models can learn and generalize steganographic chain-of-thought under process supervision
par: Skaf, Joey, et autres
Publié: (2025)
par: Skaf, Joey, et autres
Publié: (2025)
A Review on the Applications of Transformer-based language models for Nucleotide Sequence Analysis
par: Ghosh, Nimisha, et autres
Publié: (2024)
par: Ghosh, Nimisha, et autres
Publié: (2024)
Fluent dreaming for language models
par: Thompson, T. Ben, et autres
Publié: (2024)
par: Thompson, T. Ben, et autres
Publié: (2024)
Algorithmic progress in language models
par: Ho, Anson, et autres
Publié: (2024)
par: Ho, Anson, et autres
Publié: (2024)
On the attribution of confidence to large language models
par: Keeling, Geoff, et autres
Publié: (2024)
par: Keeling, Geoff, et autres
Publié: (2024)
Large language models and linguistic intentionality
par: Grindrod, Jumbly
Publié: (2024)
par: Grindrod, Jumbly
Publié: (2024)
A survey of textual cyber abuse detection using cutting-edge language models and large language models
par: Diaz-Garcia, Jose A., et autres
Publié: (2025)
par: Diaz-Garcia, Jose A., et autres
Publié: (2025)
Linguistic traces of stochastic empathy in language models
par: Kleinberg, Bennett, et autres
Publié: (2024)
par: Kleinberg, Bennett, et autres
Publié: (2024)
Infusing clinical knowledge into tokenisers for language models
par: Hasan, Abul, et autres
Publié: (2024)
par: Hasan, Abul, et autres
Publié: (2024)
CONFLARE: CONFormal LArge language model REtrieval
par: Rouzrokh, Pouria, et autres
Publié: (2024)
par: Rouzrokh, Pouria, et autres
Publié: (2024)
Cognitive models can reveal interpretable value trade-offs in language models
par: Murthy, Sonia K., et autres
Publié: (2025)
par: Murthy, Sonia K., et autres
Publié: (2025)
Code-enabled language models can outperform reasoning models on diverse tasks
par: Zhang, Cedegao E., et autres
Publié: (2025)
par: Zhang, Cedegao E., et autres
Publié: (2025)
The language of time: a language model perspective on time-series foundation models
par: Xie, Yi, et autres
Publié: (2025)
par: Xie, Yi, et autres
Publié: (2025)
Do language models practice what they preach? Examining language ideologies about gendered language reform encoded in LLMs
par: Watson, Julia, et autres
Publié: (2024)
par: Watson, Julia, et autres
Publié: (2024)
Slm-mux: Orchestrating small language models for reasoning
par: Wang, Chenyu, et autres
Publié: (2025)
par: Wang, Chenyu, et autres
Publié: (2025)
Just-in-time and distributed task representations in language models
par: Li, Yuxuan, et autres
Publié: (2025)
par: Li, Yuxuan, et autres
Publié: (2025)
Quantifying non deterministic drift in large language models
par: Nicholson, Claire
Publié: (2026)
par: Nicholson, Claire
Publié: (2026)
Can large language models build causal graphs?
par: Long, Stephanie, et autres
Publié: (2023)
par: Long, Stephanie, et autres
Publié: (2023)
Multi-round jailbreak attack on large language models
par: Zhou, Yihua, et autres
Publié: (2024)
par: Zhou, Yihua, et autres
Publié: (2024)
Response: Emergent analogical reasoning in large language models
par: Hodel, Damian, et autres
Publié: (2023)
par: Hodel, Damian, et autres
Publié: (2023)
Large language models struggle with ethnographic text annotation
par: Goodall, Leonardo S., et autres
Publié: (2026)
par: Goodall, Leonardo S., et autres
Publié: (2026)
Scaling laws for language encoding models in fMRI
par: Antonello, Richard, et autres
Publié: (2023)
par: Antonello, Richard, et autres
Publié: (2023)
The 20 questions game to distinguish large language models
par: Richardeau, Gurvan, et autres
Publié: (2024)
par: Richardeau, Gurvan, et autres
Publié: (2024)
Large language model empowered participatory urban planning
par: Zhou, Zhilun, et autres
Publié: (2024)
par: Zhou, Zhilun, et autres
Publié: (2024)
Humans overrely on overconfident language models, across languages
par: Rathi, Neil, et autres
Publié: (2025)
par: Rathi, Neil, et autres
Publié: (2025)
Retrieval-augmented reasoning with lean language models
par: Chan, Ryan Sze-Yin, et autres
Publié: (2025)
par: Chan, Ryan Sze-Yin, et autres
Publié: (2025)
Do Chinese models speak Chinese languages?
par: Wen-Yi, Andrea W, et autres
Publié: (2025)
par: Wen-Yi, Andrea W, et autres
Publié: (2025)
Failure of contextual invariance in large language models
par: Kumar, Sagar, et autres
Publié: (2026)
par: Kumar, Sagar, et autres
Publié: (2026)
Large language models in medicine: the potentials and pitfalls
par: Omiye, Jesutofunmi A., et autres
Publié: (2023)
par: Omiye, Jesutofunmi A., et autres
Publié: (2023)
Representation in large language models
par: Yetman, Cameron
Publié: (2025)
par: Yetman, Cameron
Publié: (2025)
Streamlining evidence based clinical recommendations with large language models
par: Li, Dubai, et autres
Publié: (2025)
par: Li, Dubai, et autres
Publié: (2025)
Re-evaluating Theory of Mind evaluation in large language models
par: Hu, Jennifer, et autres
Publié: (2025)
par: Hu, Jennifer, et autres
Publié: (2025)
Large language models management of medications: three performance analyses
par: Henry, Kelli, et autres
Publié: (2025)
par: Henry, Kelli, et autres
Publié: (2025)
Large language model for Bible sentiment analysis: Sermon on the Mount
par: Vora, Mahek, et autres
Publié: (2024)
par: Vora, Mahek, et autres
Publié: (2024)
Strong and weak alignment of large language models with human values
par: Khamassi, Mehdi, et autres
Publié: (2024)
par: Khamassi, Mehdi, et autres
Publié: (2024)
Correcting misinformation on social media with a large language model
par: Zhou, Xinyi, et autres
Publié: (2024)
par: Zhou, Xinyi, et autres
Publié: (2024)
Generics are puzzling. Can language models find the missing piece?
par: Calderón, Gustavo Cilleruelo, et autres
Publié: (2024)
par: Calderón, Gustavo Cilleruelo, et autres
Publié: (2024)
Morphological evaluation of subwords vocabulary used by BETO language model
par: García-Sierra, Óscar, et autres
Publié: (2024)
par: García-Sierra, Óscar, et autres
Publié: (2024)
Documents similaires
-
Dissociating language and thought in large language models
par: Mahowald, Kyle, et autres
Publié: (2023) -
What can large language models do for sustainable food?
par: Thomas, Anna T., et autres
Publié: (2025) -
Large language models can learn and generalize steganographic chain-of-thought under process supervision
par: Skaf, Joey, et autres
Publié: (2025) -
A Review on the Applications of Transformer-based language models for Nucleotide Sequence Analysis
par: Ghosh, Nimisha, et autres
Publié: (2024) -
Fluent dreaming for language models
par: Thompson, T. Ben, et autres
Publié: (2024)