Shona spaCy: A Morphological Analyzer for an Under-Resourced Bantu Language
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Masoka, Happymore |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Advancing Conversational AI with Shona Slang: A Dataset and Hybrid Model for Digital Inclusion
par: Masoka, Happymore
Publié: (2025)
par: Masoka, Happymore
Publié: (2025)
Paramanu: Compact and Competitive Monolingual Language Models for Low-Resource Morphologically Rich Indian Languages
par: Niyogi, Mitodru, et autres
Publié: (2024)
par: Niyogi, Mitodru, et autres
Publié: (2024)
Evaluation of Language Models in the Medical Context Under Resource-Constrained Settings
par: Posada, Andrea, et autres
Publié: (2024)
par: Posada, Andrea, et autres
Publié: (2024)
Evaluating Modern Large Language Models on Low-Resource and Morphologically Rich Languages:A Cross-Lingual Benchmark Across Cantonese, Japanese, and Turkish
par: Xia, Chengxuan, et autres
Publié: (2025)
par: Xia, Chengxuan, et autres
Publié: (2025)
ExCyTIn-Bench: Evaluating LLM agents on Cyber Threat Investigation
par: Wu, Yiran, et autres
Publié: (2025)
par: Wu, Yiran, et autres
Publié: (2025)
The Effectiveness of Morphology-aware Segmentation in Low-Resource Neural Machine Translation
par: Sälevä, Jonne, et autres
Publié: (2021)
par: Sälevä, Jonne, et autres
Publié: (2021)
SSA-COMET: Do LLMs Outperform Learned Metrics in Evaluating MT for Under-Resourced African Languages?
par: Li, Senyu, et autres
Publié: (2025)
par: Li, Senyu, et autres
Publié: (2025)
Analyzing Nobel Prize Literature with Large Language Models
par: Yang, Zhenyuan, et autres
Publié: (2024)
par: Yang, Zhenyuan, et autres
Publié: (2024)
Context Discipline and Performance Correlation: Analyzing LLM Performance and Quality Degradation Under Varying Context Lengths
par: Ponnusamy, Ahilan Ayyachamy Nadar, et autres
Publié: (2025)
par: Ponnusamy, Ahilan Ayyachamy Nadar, et autres
Publié: (2025)
MindShift: Analyzing Language Models' Reactions to Psychological Prompts
par: Vasiliuk, Anton, et autres
Publié: (2025)
par: Vasiliuk, Anton, et autres
Publié: (2025)
Evaluating Morphological Compositional Generalization in Large Language Models
par: Ismayilzada, Mete, et autres
Publié: (2024)
par: Ismayilzada, Mete, et autres
Publié: (2024)
Mixture-of-Experts Can Surpass Dense LLMs Under Strictly Equal Resource
par: Li, Houyi, et autres
Publié: (2025)
par: Li, Houyi, et autres
Publié: (2025)
Can Large Language Models Analyze Graphs like Professionals? A Benchmark, Datasets and Models
par: Li, Xin, et autres
Publié: (2024)
par: Li, Xin, et autres
Publié: (2024)
Can Language Models Analyze Data? Evaluating Large Language Models for Question Answering over Datasets
par: Xenofontos, Andreas, et autres
Publié: (2026)
par: Xenofontos, Andreas, et autres
Publié: (2026)
LLM-ProS: Analyzing Large Language Models' Performance in Competitive Problem Solving
par: Hossain, Md Sifat, et autres
Publié: (2025)
par: Hossain, Md Sifat, et autres
Publié: (2025)
H-Net++: Hierarchical Dynamic Chunking for Tokenizer-Free Language Modelling in Morphologically-Rich Languages
par: Zakershahrak, Mehrdad, et autres
Publié: (2025)
par: Zakershahrak, Mehrdad, et autres
Publié: (2025)
Natural Language Processing for Analyzing Electronic Health Records and Clinical Notes in Cancer Research: A Review
par: Bilal, Muhammad, et autres
Publié: (2024)
par: Bilal, Muhammad, et autres
Publié: (2024)
Towards LogiGLUE: A Brief Survey and A Benchmark for Analyzing Logical Reasoning Capabilities of Language Models
par: Luo, Man, et autres
Publié: (2023)
par: Luo, Man, et autres
Publié: (2023)
Embedding Style Beyond Topics: Analyzing Dispersion Effects Across Different Language Models
par: Icard, Benjamin, et autres
Publié: (2025)
par: Icard, Benjamin, et autres
Publié: (2025)
On the Tip of the Tongue: Analyzing Conceptual Representation in Large Language Models with Reverse-Dictionary Probe
par: Xu, Ningyu, et autres
Publié: (2024)
par: Xu, Ningyu, et autres
Publié: (2024)
Whispers that Shake Foundations: Analyzing and Mitigating False Premise Hallucinations in Large Language Models
par: Yuan, Hongbang, et autres
Publié: (2024)
par: Yuan, Hongbang, et autres
Publié: (2024)
NaijaNLP: A Survey of Nigerian Low-Resource Languages
par: Inuwa-Dutse, Isa
Publié: (2025)
par: Inuwa-Dutse, Isa
Publié: (2025)
Multimodal Large Language Models for Low-Resource Languages: A Case Study for Basque
par: Arana, Lukas, et autres
Publié: (2025)
par: Arana, Lukas, et autres
Publié: (2025)
GhanaNLP Parallel Corpora: Comprehensive Multilingual Resources for Low-Resource Ghanaian Languages
par: Gyamfi, Lawrence Adu, et autres
Publié: (2026)
par: Gyamfi, Lawrence Adu, et autres
Publié: (2026)
Transformers for Low-Resource Languages: Is Féidir Linn!
par: Lankford, Séamus, et autres
Publié: (2024)
par: Lankford, Séamus, et autres
Publié: (2024)
Ensuring Safety and Trust: Analyzing the Risks of Large Language Models in Medicine
par: Yang, Yifan, et autres
Publié: (2024)
par: Yang, Yifan, et autres
Publié: (2024)
Amuro and Char: Analyzing the Relationship between Pre-Training and Fine-Tuning of Large Language Models
par: Sun, Kaiser, et autres
Publié: (2024)
par: Sun, Kaiser, et autres
Publié: (2024)
Analyzing Narrative Processing in Large Language Models (LLMs): Using GPT4 to test BERT
par: Krauss, Patrick, et autres
Publié: (2024)
par: Krauss, Patrick, et autres
Publié: (2024)
Zero-Shot Morphological Discovery in Low-Resource Bantu Languages via Cross-Lingual Transfer and Unsupervised Clustering
par: Mutisya, Hillary, et autres
Publié: (2026)
par: Mutisya, Hillary, et autres
Publié: (2026)
Transcending Language Boundaries: Harnessing LLMs for Low-Resource Language Translation
par: Shu, Peng, et autres
Publié: (2024)
par: Shu, Peng, et autres
Publié: (2024)
Overcoming Data Scarcity in Generative Language Modelling for Low-Resource Languages: A Systematic Review
par: McGiff, Josh, et autres
Publié: (2025)
par: McGiff, Josh, et autres
Publié: (2025)
UrduLM: A Resource-Efficient Monolingual Urdu Language Model
par: Ali, Syed Muhammad, et autres
Publié: (2026)
par: Ali, Syed Muhammad, et autres
Publié: (2026)
DeepAnalyze: Agentic Large Language Models for Autonomous Data Science
par: Zhang, Shaolei, et autres
Publié: (2025)
par: Zhang, Shaolei, et autres
Publié: (2025)
In-Context Learning in Speech Language Models: Analyzing the Role of Acoustic Features, Linguistic Structure, and Induction Heads
par: Pouw, Charlotte, et autres
Publié: (2026)
par: Pouw, Charlotte, et autres
Publié: (2026)
Continual-learning for Modelling Low-Resource Languages from Large Language Models
par: K, Santosh Srinath, et autres
Publié: (2026)
par: K, Santosh Srinath, et autres
Publié: (2026)
Opportunities and Challenges of Large Language Models for Low-Resource Languages in Humanities Research
par: Zhong, Tianyang, et autres
Publié: (2024)
par: Zhong, Tianyang, et autres
Publié: (2024)
Comparing Approaches to Automatic Summarization in Less-Resourced Languages
par: Palen-Michel, Chester, et autres
Publié: (2025)
par: Palen-Michel, Chester, et autres
Publié: (2025)
Mevaker: Conclusion Extraction and Allocation Resources for the Hebrew Language
par: Shalumov, Vitaly, et autres
Publié: (2024)
par: Shalumov, Vitaly, et autres
Publié: (2024)
Multilingual Training and Evaluation Resources for Vision-Language Models
par: Baiamonte, Daniela, et autres
Publié: (2026)
par: Baiamonte, Daniela, et autres
Publié: (2026)
Unlocking the Potential of Model Merging for Low-Resource Languages
par: Tao, Mingxu, et autres
Publié: (2024)
par: Tao, Mingxu, et autres
Publié: (2024)
Documents similaires
-
Advancing Conversational AI with Shona Slang: A Dataset and Hybrid Model for Digital Inclusion
par: Masoka, Happymore
Publié: (2025) -
Paramanu: Compact and Competitive Monolingual Language Models for Low-Resource Morphologically Rich Indian Languages
par: Niyogi, Mitodru, et autres
Publié: (2024) -
Evaluation of Language Models in the Medical Context Under Resource-Constrained Settings
par: Posada, Andrea, et autres
Publié: (2024) -
Evaluating Modern Large Language Models on Low-Resource and Morphologically Rich Languages:A Cross-Lingual Benchmark Across Cantonese, Japanese, and Turkish
par: Xia, Chengxuan, et autres
Publié: (2025) -
ExCyTIn-Bench: Evaluating LLM agents on Cyber Threat Investigation
par: Wu, Yiran, et autres
Publié: (2025)