Pula: Training Large Language Models for Setswana
Fuente:
arXiv
Saved in:
| Main Authors: | Brown, Nathan, Marivate, Vukosi |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
The Annotation Scarcity Paradox in Low-Resource NLP Evaluation: A Decade of Acceleration and Emerging Constraints
by: Marivate, Vukosi
Published: (2026)
by: Marivate, Vukosi
Published: (2026)
From N-grams to Pre-trained Multilingual Models For Language Identification
by: Sindane, Thapelo, et al.
Published: (2024)
by: Sindane, Thapelo, et al.
Published: (2024)
Prompting Towards Alleviating Code-Switched Data Scarcity in Under-Resourced Languages with GPT as a Pivot
by: Terblanche, Michelle, et al.
Published: (2024)
by: Terblanche, Michelle, et al.
Published: (2024)
Analysing Public Transport User Sentiment on Low Resource Multilingual Data
by: Myoya, Rozina L., et al.
Published: (2024)
by: Myoya, Rozina L., et al.
Published: (2024)
Cross-lingual transfer of multilingual models on low resource African Languages
by: Thangaraj, Harish, et al.
Published: (2024)
by: Thangaraj, Harish, et al.
Published: (2024)
MAGE: Multi-Head Attention Guided Embeddings for Low Resource Sentiment Classification
by: Vashisht, Varun, et al.
Published: (2025)
by: Vashisht, Varun, et al.
Published: (2025)
AfroXLMR-Comet: Multilingual Knowledge Distillation with Attention Matching for Low-Resource languages
by: Raju, Joshua Sakthivel, et al.
Published: (2025)
by: Raju, Joshua Sakthivel, et al.
Published: (2025)
Language-Independent Sentiment Labelling with Distant Supervision: A Case Study for English, Sepedi and Setswana
by: Mabokela, Koena Ronny, et al.
Published: (2025)
by: Mabokela, Koena Ronny, et al.
Published: (2025)
Correcting FLORES Evaluation Dataset for Four African Languages
by: Abdulmumin, Idris, et al.
Published: (2024)
by: Abdulmumin, Idris, et al.
Published: (2024)
HausaNLP: Current Status, Challenges and Future Directions for Hausa Natural Language Processing
by: Muhammad, Shamsuddeen Hassan, et al.
Published: (2025)
by: Muhammad, Shamsuddeen Hassan, et al.
Published: (2025)
Mafoko: Structuring and Building Open Multilingual Terminologies for South African NLP
by: Marivate, Vukosi, et al.
Published: (2025)
by: Marivate, Vukosi, et al.
Published: (2025)
InkubaLM: A small language model for low-resource African languages
by: Tonja, Atnafu Lambebo, et al.
Published: (2024)
by: Tonja, Atnafu Lambebo, et al.
Published: (2024)
The Esethu Framework: Reimagining Sustainable Dataset Governance and Curation for Low-Resource Languages
by: Rajab, Jenalea, et al.
Published: (2025)
by: Rajab, Jenalea, et al.
Published: (2025)
Hybrid Alignment Training for Large Language Models
by: Wang, Chenglong, et al.
Published: (2024)
by: Wang, Chenglong, et al.
Published: (2024)
Sparsity-Accelerated Training for Large Language Models
by: Ma, Da, et al.
Published: (2024)
by: Ma, Da, et al.
Published: (2024)
End-to-end Planner Training for Language Modeling
by: Cornille, Nathan, et al.
Published: (2024)
by: Cornille, Nathan, et al.
Published: (2024)
AfriScience-MT: Towards Decolonizing Science in Africa through Text Translation
by: Abdulmumin, Idris, et al.
Published: (2026)
by: Abdulmumin, Idris, et al.
Published: (2026)
HausaNLP at SemEval-2025 Task 2: Entity-Aware Fine-tuning vs. Prompt Engineering in Entity-Aware Machine Translation
by: Abubakar, Abdulhamid, et al.
Published: (2025)
by: Abubakar, Abdulhamid, et al.
Published: (2025)
Saten: Sparse Augmented Tensor Networks for Post-Training Compression of Large Language Models
by: Solgi, Ryan, et al.
Published: (2025)
by: Solgi, Ryan, et al.
Published: (2025)
Exploring Forgetting in Large Language Model Pre-Training
by: Liao, Chonghua, et al.
Published: (2024)
by: Liao, Chonghua, et al.
Published: (2024)
Training-Free Multimodal Large Language Model Orchestration
by: Xie, Tianyu, et al.
Published: (2025)
by: Xie, Tianyu, et al.
Published: (2025)
Mid-Training of Large Language Models: A Survey
by: Mo, Kaixiang, et al.
Published: (2025)
by: Mo, Kaixiang, et al.
Published: (2025)
Social Skill Training with Large Language Models
by: Yang, Diyi, et al.
Published: (2024)
by: Yang, Diyi, et al.
Published: (2024)
Predicting Anti-microbial Resistance using Large Language Models
by: Yoo, Hyunwoo, et al.
Published: (2024)
by: Yoo, Hyunwoo, et al.
Published: (2024)
Evolution without Large Models: Training Language Model with Task Principles
by: Zhu, Minghang, et al.
Published: (2025)
by: Zhu, Minghang, et al.
Published: (2025)
DeepSeek's WEIRD Behavior: The cultural alignment of Large Language Models and the effects of prompt language and cultural prompting
by: Luther, James, et al.
Published: (2025)
by: Luther, James, et al.
Published: (2025)
Cool-Fusion: Fuse Large Language Models without Training
by: Liu, Cong, et al.
Published: (2024)
by: Liu, Cong, et al.
Published: (2024)
Latent Distance Guided Alignment Training for Large Language Models
by: Luo, Haotian
Published: (2024)
by: Luo, Haotian
Published: (2024)
Towards Training A Chinese Large Language Model for Anesthesiology
by: Wang, Zhonghai, et al.
Published: (2024)
by: Wang, Zhonghai, et al.
Published: (2024)
Training-Free Long-Context Scaling of Large Language Models
by: An, Chenxin, et al.
Published: (2024)
by: An, Chenxin, et al.
Published: (2024)
DAST: Difficulty-Aware Self-Training on Large Language Models
by: Xue, Boyang, et al.
Published: (2025)
by: Xue, Boyang, et al.
Published: (2025)
Context-Preserving Tensorial Reconfiguration in Large Language Model Training
by: Tonix, Larin, et al.
Published: (2025)
by: Tonix, Larin, et al.
Published: (2025)
Is Temperature the Creativity Parameter of Large Language Models?
by: Peeperkorn, Max, et al.
Published: (2024)
by: Peeperkorn, Max, et al.
Published: (2024)
Evolving Subnetwork Training for Large Language Models
by: Li, Hanqi, et al.
Published: (2024)
by: Li, Hanqi, et al.
Published: (2024)
On the Effectiveness of Incremental Training of Large Language Models
by: Li, Miles Q., et al.
Published: (2024)
by: Li, Miles Q., et al.
Published: (2024)
STEER-ME: Assessing the Microeconomic Reasoning of Large Language Models
by: Raman, Narun, et al.
Published: (2025)
by: Raman, Narun, et al.
Published: (2025)
Prior Constraints-based Reward Model Training for Aligning Large Language Models
by: Zhou, Hang, et al.
Published: (2024)
by: Zhou, Hang, et al.
Published: (2024)
Training Large Language Models to Reason in a Continuous Latent Space
by: Hao, Shibo, et al.
Published: (2024)
by: Hao, Shibo, et al.
Published: (2024)
On the Diversity of Synthetic Data and its Impact on Training Large Language Models
by: Chen, Hao, et al.
Published: (2024)
by: Chen, Hao, et al.
Published: (2024)
Self-Training Large Language Models for Tool-Use Without Demonstrations
by: Luo, Ne, et al.
Published: (2025)
by: Luo, Ne, et al.
Published: (2025)
Similar Items
-
The Annotation Scarcity Paradox in Low-Resource NLP Evaluation: A Decade of Acceleration and Emerging Constraints
by: Marivate, Vukosi
Published: (2026) -
From N-grams to Pre-trained Multilingual Models For Language Identification
by: Sindane, Thapelo, et al.
Published: (2024) -
Prompting Towards Alleviating Code-Switched Data Scarcity in Under-Resourced Languages with GPT as a Pivot
by: Terblanche, Michelle, et al.
Published: (2024) -
Analysing Public Transport User Sentiment on Low Resource Multilingual Data
by: Myoya, Rozina L., et al.
Published: (2024) -
Cross-lingual transfer of multilingual models on low resource African Languages
by: Thangaraj, Harish, et al.
Published: (2024)