Vocabulary embeddings organize linguistic structure early in language model training
Fuente:
arXiv
Salvato in:
| Autori principali: | Papadimitriou, Isabel, Prince, Jacob |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Investigating the interaction of linguistic and mathematical reasoning in language models using multilingual number puzzles
di: Bhattacharya, Antara Raaghavi, et al.
Pubblicazione: (2025)
di: Bhattacharya, Antara Raaghavi, et al.
Pubblicazione: (2025)
Large language models and linguistic intentionality
di: Grindrod, Jumbly
Pubblicazione: (2024)
di: Grindrod, Jumbly
Pubblicazione: (2024)
A blind spot for large language models: Supradiegetic linguistic information
di: Zimmerman, Julia Witte, et al.
Pubblicazione: (2023)
di: Zimmerman, Julia Witte, et al.
Pubblicazione: (2023)
Interpreting the linear structure of vision-language model embedding spaces
di: Papadimitriou, Isabel, et al.
Pubblicazione: (2025)
di: Papadimitriou, Isabel, et al.
Pubblicazione: (2025)
Scaling LLM Pre-training with Vocabulary Curriculum
di: Yu, Fangyuan
Pubblicazione: (2025)
di: Yu, Fangyuan
Pubblicazione: (2025)
Using Shapley interactions to understand how models use structure
di: Singhvi, Divyansh, et al.
Pubblicazione: (2024)
di: Singhvi, Divyansh, et al.
Pubblicazione: (2024)
Can pre-trained language models generate titles for research papers?
di: Rehman, Tohida, et al.
Pubblicazione: (2024)
di: Rehman, Tohida, et al.
Pubblicazione: (2024)
Vocabulary shapes cross-lingual variation of word-order learnability in language models
di: Martins, Jonas Mayer, et al.
Pubblicazione: (2026)
di: Martins, Jonas Mayer, et al.
Pubblicazione: (2026)
The potential -- and the pitfalls -- of using pre-trained language models as cognitive science theories
di: Shah, Raj Sanjay, et al.
Pubblicazione: (2025)
di: Shah, Raj Sanjay, et al.
Pubblicazione: (2025)
Vocabulary Dropout for Curriculum Diversity in LLM Co-Evolution
di: Dineen, Jacob, et al.
Pubblicazione: (2026)
di: Dineen, Jacob, et al.
Pubblicazione: (2026)
A systematic review of trial-matching pipelines using large language models
di: Morrison, Braxton A., et al.
Pubblicazione: (2025)
di: Morrison, Braxton A., et al.
Pubblicazione: (2025)
Assessment and manipulation of latent constructs in pre-trained language models using psychometric scales
di: Reuben, Maor, et al.
Pubblicazione: (2024)
di: Reuben, Maor, et al.
Pubblicazione: (2024)
WizardLM: Empowering large pre-trained language models to follow complex instructions
di: Xu, Can, et al.
Pubblicazione: (2023)
di: Xu, Can, et al.
Pubblicazione: (2023)
Code-enabled language models can outperform reasoning models on diverse tasks
di: Zhang, Cedegao E., et al.
Pubblicazione: (2025)
di: Zhang, Cedegao E., et al.
Pubblicazione: (2025)
StatLLaMA: Multi-Stage training for domain-optimized statistical large language models
di: Zeng, Jing-Yi, et al.
Pubblicazione: (2025)
di: Zeng, Jing-Yi, et al.
Pubblicazione: (2025)
Tracking the emergence of linguistic structure in self-supervised models learning from speech
di: Kloots, Marianne de Heer, et al.
Pubblicazione: (2026)
di: Kloots, Marianne de Heer, et al.
Pubblicazione: (2026)
Ensemble of pre-trained language models and data augmentation for hate speech detection from Arabic tweets
di: Daouadi, Kheir Eddine, et al.
Pubblicazione: (2024)
di: Daouadi, Kheir Eddine, et al.
Pubblicazione: (2024)
Generalist embedding models are better at short-context clinical semantic search than specialized embedding models
di: Excoffier, Jean-Baptiste, et al.
Pubblicazione: (2024)
di: Excoffier, Jean-Baptiste, et al.
Pubblicazione: (2024)
Word stress in self-supervised speech models: A cross-linguistic comparison
di: Bentum, Martijn, et al.
Pubblicazione: (2025)
di: Bentum, Martijn, et al.
Pubblicazione: (2025)
Post-training makes large language models less human-like
di: Binz, Marcel, et al.
Pubblicazione: (2026)
di: Binz, Marcel, et al.
Pubblicazione: (2026)
Dissociating language and thought in large language models
di: Mahowald, Kyle, et al.
Pubblicazione: (2023)
di: Mahowald, Kyle, et al.
Pubblicazione: (2023)
Data filtering methods for training language models
di: Shevchenko, Egor, et al.
Pubblicazione: (2026)
di: Shevchenko, Egor, et al.
Pubblicazione: (2026)
Employing self-supervised learning models for cross-linguistic child speech maturity classification
di: Zhang, Theo, et al.
Pubblicazione: (2025)
di: Zhang, Theo, et al.
Pubblicazione: (2025)
Mission: Impossible Language Models
di: Kallini, Julie, et al.
Pubblicazione: (2024)
di: Kallini, Julie, et al.
Pubblicazione: (2024)
The Grounding Gap: How LLMs Anchor the Meaning of Abstract Concepts Differently from Humans
di: Chlapanis, Odysseas S., et al.
Pubblicazione: (2026)
di: Chlapanis, Odysseas S., et al.
Pubblicazione: (2026)
Computational modeling of early language learning from acoustic speech and audiovisual input without linguistic priors
di: Räsänen, Okko
Pubblicazione: (2026)
di: Räsänen, Okko
Pubblicazione: (2026)
Bringing legal knowledge to the public by constructing a legal question bank using large-scale pre-trained language model
di: Yuan, Mingruo, et al.
Pubblicazione: (2025)
di: Yuan, Mingruo, et al.
Pubblicazione: (2025)
Scaling Laws with Vocabulary: Larger Models Deserve Larger Vocabularies
di: Tao, Chaofan, et al.
Pubblicazione: (2024)
di: Tao, Chaofan, et al.
Pubblicazione: (2024)
PhDGPT: Introducing a psychometric and linguistic dataset about how large language models perceive graduate students and professors in psychology
di: De Duro, Edoardo Sebastiano, et al.
Pubblicazione: (2024)
di: De Duro, Edoardo Sebastiano, et al.
Pubblicazione: (2024)
Child vs. machine language learning: Can the logical structure of human language unleash LLMs?
di: Sauerland, Uli, et al.
Pubblicazione: (2025)
di: Sauerland, Uli, et al.
Pubblicazione: (2025)
Fluent dreaming for language models
di: Thompson, T. Ben, et al.
Pubblicazione: (2024)
di: Thompson, T. Ben, et al.
Pubblicazione: (2024)
Algorithmic progress in language models
di: Ho, Anson, et al.
Pubblicazione: (2024)
di: Ho, Anson, et al.
Pubblicazione: (2024)
Overcoming Vocabulary Mismatch: Vocabulary-agnostic Teacher Guided Language Modeling
di: Shin, Haebin, et al.
Pubblicazione: (2025)
di: Shin, Haebin, et al.
Pubblicazione: (2025)
A systematic review of geospatial location embedding approaches in large language models: A path to spatial AI systems
di: Tucker, Sean
Pubblicazione: (2024)
di: Tucker, Sean
Pubblicazione: (2024)
Benchmarking pre-trained text embedding models in aligning built asset information
di: Shahinmoghadam, Mehrzad, et al.
Pubblicazione: (2024)
di: Shahinmoghadam, Mehrzad, et al.
Pubblicazione: (2024)
Towards Nepali-language LLMs: Efficient GPT training with a Nepali BPE tokenizer
di: Shrestha, Adarsha, et al.
Pubblicazione: (2025)
di: Shrestha, Adarsha, et al.
Pubblicazione: (2025)
On the attribution of confidence to large language models
di: Keeling, Geoff, et al.
Pubblicazione: (2024)
di: Keeling, Geoff, et al.
Pubblicazione: (2024)
A survey of textual cyber abuse detection using cutting-edge language models and large language models
di: Diaz-Garcia, Jose A., et al.
Pubblicazione: (2025)
di: Diaz-Garcia, Jose A., et al.
Pubblicazione: (2025)
Do language models practice what they preach? Examining language ideologies about gendered language reform encoded in LLMs
di: Watson, Julia, et al.
Pubblicazione: (2024)
di: Watson, Julia, et al.
Pubblicazione: (2024)
Aviary: training language agents on challenging scientific tasks
di: Narayanan, Siddharth, et al.
Pubblicazione: (2024)
di: Narayanan, Siddharth, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Investigating the interaction of linguistic and mathematical reasoning in language models using multilingual number puzzles
di: Bhattacharya, Antara Raaghavi, et al.
Pubblicazione: (2025) -
Large language models and linguistic intentionality
di: Grindrod, Jumbly
Pubblicazione: (2024) -
A blind spot for large language models: Supradiegetic linguistic information
di: Zimmerman, Julia Witte, et al.
Pubblicazione: (2023) -
Interpreting the linear structure of vision-language model embedding spaces
di: Papadimitriou, Isabel, et al.
Pubblicazione: (2025) -
Scaling LLM Pre-training with Vocabulary Curriculum
di: Yu, Fangyuan
Pubblicazione: (2025)