Morphological evaluation of subwords vocabulary used by BETO language model
Fuente:
arXiv
Guardado en:
| Autores principales: | García-Sierra, Óscar, Cesteros, Ana Fernández-Pampillón, Ortega-Martín, Miguel |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Re-evaluating Theory of Mind evaluation in large language models
por: Hu, Jennifer, et al.
Publicado: (2025)
por: Hu, Jennifer, et al.
Publicado: (2025)
CVE-LLM : Automatic vulnerability evaluation in medical device industry using large language models
por: Ghosh, Rikhiya, et al.
Publicado: (2024)
por: Ghosh, Rikhiya, et al.
Publicado: (2024)
A survey of textual cyber abuse detection using cutting-edge language models and large language models
por: Diaz-Garcia, Jose A., et al.
Publicado: (2025)
por: Diaz-Garcia, Jose A., et al.
Publicado: (2025)
Can open source large language models be used for tumor documentation in Germany? -- An evaluation on urological doctors' notes
por: Lenz, Stefan, et al.
Publicado: (2025)
por: Lenz, Stefan, et al.
Publicado: (2025)
A review on the use of large language models as virtual tutors
por: García-Méndez, Silvia, et al.
Publicado: (2024)
por: García-Méndez, Silvia, et al.
Publicado: (2024)
TeleEval-OS: Performance evaluations of large language models for operations scheduling
por: Wang, Yanyan, et al.
Publicado: (2025)
por: Wang, Yanyan, et al.
Publicado: (2025)
The use of large language models to enhance cancer clinical trial educational materials
por: Gao, Mingye, et al.
Publicado: (2024)
por: Gao, Mingye, et al.
Publicado: (2024)
Disentangling generalization and memorization in large language models using chess
por: Pleiss, Leonard S., et al.
Publicado: (2026)
por: Pleiss, Leonard S., et al.
Publicado: (2026)
Dissociating language and thought in large language models
por: Mahowald, Kyle, et al.
Publicado: (2023)
por: Mahowald, Kyle, et al.
Publicado: (2023)
Playing with words: Comparing the vocabulary and lexical diversity of ChatGPT and humans
por: Reviriego, Pedro, et al.
Publicado: (2023)
por: Reviriego, Pedro, et al.
Publicado: (2023)
Fine-tuning multilingual language models in Twitter/X sentiment analysis: a study on Eastern-European V4 languages
por: Filip, Tomáš, et al.
Publicado: (2024)
por: Filip, Tomáš, et al.
Publicado: (2024)
Entry-level guide to the use of large language models for medical research
por: Jin, Qiao, et al.
Publicado: (2024)
por: Jin, Qiao, et al.
Publicado: (2024)
RigoChat 2: an adapted language model to Spanish using a bounded dataset and reduced hardware
por: Gómez, Gonzalo Santamaría, et al.
Publicado: (2025)
por: Gómez, Gonzalo Santamaría, et al.
Publicado: (2025)
Building another Spanish dictionary, this time with GPT-4
por: Ortega-Martín, Miguel, et al.
Publicado: (2024)
por: Ortega-Martín, Miguel, et al.
Publicado: (2024)
Sentiment analysis of preservice teachers' reflections using a large language model
por: Park, Yunsoo, et al.
Publicado: (2024)
por: Park, Yunsoo, et al.
Publicado: (2024)
A systematic review of trial-matching pipelines using large language models
por: Morrison, Braxton A., et al.
Publicado: (2025)
por: Morrison, Braxton A., et al.
Publicado: (2025)
The potential -- and the pitfalls -- of using pre-trained language models as cognitive science theories
por: Shah, Raj Sanjay, et al.
Publicado: (2025)
por: Shah, Raj Sanjay, et al.
Publicado: (2025)
Fluent dreaming for language models
por: Thompson, T. Ben, et al.
Publicado: (2024)
por: Thompson, T. Ben, et al.
Publicado: (2024)
Algorithmic progress in language models
por: Ho, Anson, et al.
Publicado: (2024)
por: Ho, Anson, et al.
Publicado: (2024)
Improving accuracy of GPT-3/4 results on biomedical data using a retrieval-augmented language model
por: Soong, David, et al.
Publicado: (2023)
por: Soong, David, et al.
Publicado: (2023)
Exploiting the English Vocabulary Profile for L2 word-level vocabulary assessment with LLMs
por: Bannò, Stefano, et al.
Publicado: (2025)
por: Bannò, Stefano, et al.
Publicado: (2025)
Assessment and manipulation of latent constructs in pre-trained language models using psychometric scales
por: Reuben, Maor, et al.
Publicado: (2024)
por: Reuben, Maor, et al.
Publicado: (2024)
Investigating the interaction of linguistic and mathematical reasoning in language models using multilingual number puzzles
por: Bhattacharya, Antara Raaghavi, et al.
Publicado: (2025)
por: Bhattacharya, Antara Raaghavi, et al.
Publicado: (2025)
Functional Subspace, where language models can use vector algebra to solve problems
por: Lee, Jung H., et al.
Publicado: (2026)
por: Lee, Jung H., et al.
Publicado: (2026)
A survey on cutting-edge relation extraction techniques based on language models
por: Diaz-Garcia, Jose A., et al.
Publicado: (2024)
por: Diaz-Garcia, Jose A., et al.
Publicado: (2024)
On the attribution of confidence to large language models
por: Keeling, Geoff, et al.
Publicado: (2024)
por: Keeling, Geoff, et al.
Publicado: (2024)
Large language models and linguistic intentionality
por: Grindrod, Jumbly
Publicado: (2024)
por: Grindrod, Jumbly
Publicado: (2024)
Do language models practice what they preach? Examining language ideologies about gendered language reform encoded in LLMs
por: Watson, Julia, et al.
Publicado: (2024)
por: Watson, Julia, et al.
Publicado: (2024)
A longitudinal sentiment analysis of Sinophobia during COVID-19 using large language models
por: Wang, Chen, et al.
Publicado: (2024)
por: Wang, Chen, et al.
Publicado: (2024)
Comparative analysis of subword tokenization approaches for Indian languages
por: Das, Sudhansu Bala, et al.
Publicado: (2025)
por: Das, Sudhansu Bala, et al.
Publicado: (2025)
An evaluation of LLMs and Google Translate for translation of selected Indian languages via sentiment and semantic analyses
por: Chandra, Rohitash, et al.
Publicado: (2025)
por: Chandra, Rohitash, et al.
Publicado: (2025)
Linguistic traces of stochastic empathy in language models
por: Kleinberg, Bennett, et al.
Publicado: (2024)
por: Kleinberg, Bennett, et al.
Publicado: (2024)
Infusing clinical knowledge into tokenisers for language models
por: Hasan, Abul, et al.
Publicado: (2024)
por: Hasan, Abul, et al.
Publicado: (2024)
CONFLARE: CONFormal LArge language model REtrieval
por: Rouzrokh, Pouria, et al.
Publicado: (2024)
por: Rouzrokh, Pouria, et al.
Publicado: (2024)
Vibe-Eval: A hard evaluation suite for measuring progress of multimodal language models
por: Padlewski, Piotr, et al.
Publicado: (2024)
por: Padlewski, Piotr, et al.
Publicado: (2024)
Attention-based transformer models for image captioning across languages: An in-depth survey and evaluation
por: Albadarneh, Israa A., et al.
Publicado: (2025)
por: Albadarneh, Israa A., et al.
Publicado: (2025)
Plain language adaptations of biomedical text using LLMs: Comparision of evaluation metrics
por: Kocbek, Primoz, et al.
Publicado: (2025)
por: Kocbek, Primoz, et al.
Publicado: (2025)
AugSumm: towards generalizable speech summarization using synthetic labels from large language model
por: Jung, Jee-weon, et al.
Publicado: (2024)
por: Jung, Jee-weon, et al.
Publicado: (2024)
Metaphor identification using large language models: A comparison of RAG, prompt engineering, and fine-tuning
por: Fuoli, Matteo, et al.
Publicado: (2025)
por: Fuoli, Matteo, et al.
Publicado: (2025)
Redefining technology for indigenous languages
por: Fernandez-Sabido, Silvia, et al.
Publicado: (2025)
por: Fernandez-Sabido, Silvia, et al.
Publicado: (2025)
Ejemplares similares
-
Re-evaluating Theory of Mind evaluation in large language models
por: Hu, Jennifer, et al.
Publicado: (2025) -
CVE-LLM : Automatic vulnerability evaluation in medical device industry using large language models
por: Ghosh, Rikhiya, et al.
Publicado: (2024) -
A survey of textual cyber abuse detection using cutting-edge language models and large language models
por: Diaz-Garcia, Jose A., et al.
Publicado: (2025) -
Can open source large language models be used for tumor documentation in Germany? -- An evaluation on urological doctors' notes
por: Lenz, Stefan, et al.
Publicado: (2025) -
A review on the use of large language models as virtual tutors
por: García-Méndez, Silvia, et al.
Publicado: (2024)