Can we teach language models to gloss endangered languages?
Fuente:
arXiv
Saved in:
| Main Authors: | Ginn, Michael, Hulden, Mans, Palmer, Alexis |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Neural Induction of Finite-State Transducers
by: Ginn, Michael, et al.
Published: (2026)
by: Ginn, Michael, et al.
Published: (2026)
Historia Magistra Vitae: Dynamic Topic Modeling of Roman Literature using Neural Embeddings
by: Ginn, Michael, et al.
Published: (2024)
by: Ginn, Michael, et al.
Published: (2024)
Robust Generalization Strategies for Morpheme Glossing in an Endangered Language Documentation Context
by: Ginn, Michael, et al.
Published: (2023)
by: Ginn, Michael, et al.
Published: (2023)
A Simple Formalism for Capturing Order and Co-Occurrence in Computational Morphology
by: Mans Hulden
Published: (2007)
by: Mans Hulden
Published: (2007)
Is linguistically-motivated data augmentation worth it?
by: Groshan, Ray, et al.
Published: (2025)
by: Groshan, Ray, et al.
Published: (2025)
Prompt and circumstance: A word-by-word LLM prompting approach to interlinear glossing for low-resource languages
by: Elsner, Micha, et al.
Published: (2025)
by: Elsner, Micha, et al.
Published: (2025)
Fast approximate string matching with finite automata
by: Mans Hulden
Published: (2009)
by: Mans Hulden
Published: (2009)
Speculative Decoding Across Languages
by: Paudel, Nirajan, et al.
Published: (2026)
by: Paudel, Nirajan, et al.
Published: (2026)
Can adversarial attacks by large language models be attributed?
by: Cebrian, Manuel, et al.
Published: (2024)
by: Cebrian, Manuel, et al.
Published: (2024)
Can large language models build causal graphs?
by: Long, Stephanie, et al.
Published: (2023)
by: Long, Stephanie, et al.
Published: (2023)
Can large language models explore in-context?
by: Krishnamurthy, Akshay, et al.
Published: (2024)
by: Krishnamurthy, Akshay, et al.
Published: (2024)
Large language models have learned to use language
by: Lupyan, Gary
Published: (2025)
by: Lupyan, Gary
Published: (2025)
Tree Transformers are an Ineffective Model of Syntactic Constituency
by: Ginn, Michael
Published: (2024)
by: Ginn, Michael
Published: (2024)
GlossLM: A Massively Multilingual Corpus and Pretrained Model for Interlinear Glossed Text
by: Ginn, Michael, et al.
Published: (2024)
by: Ginn, Michael, et al.
Published: (2024)
Retrieval augmentation of large language models for lay language generation
by: Guo, Yue, et al.
Published: (2022)
by: Guo, Yue, et al.
Published: (2022)
Do large language models resemble humans in language use?
by: Cai, Zhenguang G., et al.
Published: (2023)
by: Cai, Zhenguang G., et al.
Published: (2023)
Studies with impossible languages falsify LMs as models of human language
by: Bowers, Jeffrey S., et al.
Published: (2025)
by: Bowers, Jeffrey S., et al.
Published: (2025)
Generics are puzzling. Can language models find the missing piece?
by: Calderón, Gustavo Cilleruelo, et al.
Published: (2024)
by: Calderón, Gustavo Cilleruelo, et al.
Published: (2024)
Tiny language models
by: Gross, Ronit D., et al.
Published: (2025)
by: Gross, Ronit D., et al.
Published: (2025)
Fluent dreaming for language models
by: Thompson, T. Ben, et al.
Published: (2024)
by: Thompson, T. Ben, et al.
Published: (2024)
Large language models are not about natural language
by: Bolhuis, Johan J., et al.
Published: (2025)
by: Bolhuis, Johan J., et al.
Published: (2025)
Dissociating language and thought in large language models
by: Mahowald, Kyle, et al.
Published: (2023)
by: Mahowald, Kyle, et al.
Published: (2023)
Do we really have to filter out random noise in pre-training data for language models?
by: Ru, Jinghan, et al.
Published: (2025)
by: Ru, Jinghan, et al.
Published: (2025)
Lost without translation -- Can transformer (language models) understand mood states?
by: Shivaprakash, Prakrithi, et al.
Published: (2025)
by: Shivaprakash, Prakrithi, et al.
Published: (2025)
Why do language models perform worse for morphologically complex languages?
by: Arnett, Catherine, et al.
Published: (2024)
by: Arnett, Catherine, et al.
Published: (2024)
Prompting language influences diagnostic reasoning and accuracy of large language models
by: Bazoge, Adrien, et al.
Published: (2026)
by: Bazoge, Adrien, et al.
Published: (2026)
Can a large language model be a gaslighter?
by: Li, Wei, et al.
Published: (2024)
by: Li, Wei, et al.
Published: (2024)
Can pre-trained language models generate titles for research papers?
by: Rehman, Tohida, et al.
Published: (2024)
by: Rehman, Tohida, et al.
Published: (2024)
Can large language models understand uncommon meanings of common words?
by: Wu, Jinyang, et al.
Published: (2024)
by: Wu, Jinyang, et al.
Published: (2024)
Humans overrely on overconfident language models, across languages
by: Rathi, Neil, et al.
Published: (2025)
by: Rathi, Neil, et al.
Published: (2025)
Dynamic data sampler for cross-language transfer learning in large language models
by: Li, Yudong, et al.
Published: (2024)
by: Li, Yudong, et al.
Published: (2024)
InkubaLM: A small language model for low-resource African languages
by: Tonja, Atnafu Lambebo, et al.
Published: (2024)
by: Tonja, Atnafu Lambebo, et al.
Published: (2024)
Multilingual large language models leak human stereotypes across language boundaries
by: Cao, Yang Trista, et al.
Published: (2023)
by: Cao, Yang Trista, et al.
Published: (2023)
Effective vocabulary expanding of multilingual language models for extremely low-resource languages
by: Zheng, Jianyu
Published: (2026)
by: Zheng, Jianyu
Published: (2026)
Child vs. machine language learning: Can the logical structure of human language unleash LLMs?
by: Sauerland, Uli, et al.
Published: (2025)
by: Sauerland, Uli, et al.
Published: (2025)
Massively Multilingual Joint Segmentation and Glossing
by: Ginn, Michael, et al.
Published: (2026)
by: Ginn, Michael, et al.
Published: (2026)
Can language models learn analogical reasoning? Investigating training objectives and comparisons to human performance
by: Petersen, Molly R., et al.
Published: (2023)
by: Petersen, Molly R., et al.
Published: (2023)
Context informs pragmatic interpretation in vision-language models
by: Tan, Alvin Wei Ming, et al.
Published: (2025)
by: Tan, Alvin Wei Ming, et al.
Published: (2025)
Anthropocentric bias in language model evaluation
by: Millière, Raphaël, et al.
Published: (2024)
by: Millière, Raphaël, et al.
Published: (2024)
Open foundation models for Azerbaijani language
by: Isbarov, Jafar, et al.
Published: (2024)
by: Isbarov, Jafar, et al.
Published: (2024)
Similar Items
-
Neural Induction of Finite-State Transducers
by: Ginn, Michael, et al.
Published: (2026) -
Historia Magistra Vitae: Dynamic Topic Modeling of Roman Literature using Neural Embeddings
by: Ginn, Michael, et al.
Published: (2024) -
Robust Generalization Strategies for Morpheme Glossing in an Endangered Language Documentation Context
by: Ginn, Michael, et al.
Published: (2023) -
A Simple Formalism for Capturing Order and Co-Occurrence in Computational Morphology
by: Mans Hulden
Published: (2007) -
Is linguistically-motivated data augmentation worth it?
by: Groshan, Ray, et al.
Published: (2025)