Development and Preliminary Evaluation of a Domain-Specific Large Language Model for Tuberculosis Care in South Africa
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Khosa, Thokozile, Daramola, Olawande |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
The Hidden Attention of Mamba Models
par: Ali, Ameen, et autres
Publié: (2024)
par: Ali, Ameen, et autres
Publié: (2024)
Random Heterogeneous Neurochaos Learning Architecture for Data Classification
par: S, Remya Ajai A, et autres
Publié: (2024)
par: S, Remya Ajai A, et autres
Publié: (2024)
Evaluating the efficacy of LLM Safety Solutions : The Palit Benchmark Dataset
par: Palit, Sayon, et autres
Publié: (2025)
par: Palit, Sayon, et autres
Publié: (2025)
Robust Reward Modeling for Large Language Models via Causal Decomposition
par: Lu, Yunsheng, et autres
Publié: (2026)
par: Lu, Yunsheng, et autres
Publié: (2026)
Factual Dialogue Summarization via Learning from Large Language Models
par: Zhu, Rongxin, et autres
Publié: (2024)
par: Zhu, Rongxin, et autres
Publié: (2024)
Do Large Language Models Speak All Languages Equally? A Comparative Study in Low-Resource Settings
par: Hasan, Md. Arid, et autres
Publié: (2024)
par: Hasan, Md. Arid, et autres
Publié: (2024)
Machine learning and emoji prediction: How much accuracy can MARBERT achieve?
par: Shormani, Mohammed Q., et autres
Publié: (2026)
par: Shormani, Mohammed Q., et autres
Publié: (2026)
AllMetrics: A Unified Python Library for Standardized Metric Evaluation and Robust Data Validation in Machine Learning
par: Alizadeh, Morteza, et autres
Publié: (2025)
par: Alizadeh, Morteza, et autres
Publié: (2025)
Remote Sensing-Oriented World Model
par: Lu, Yuxi, et autres
Publié: (2025)
par: Lu, Yuxi, et autres
Publié: (2025)
Deep-SITAR: A SITAR-Based Deep Learning Framework for Growth Curve Modeling via Autoencoders
par: Hernández, María Alejandra, et autres
Publié: (2025)
par: Hernández, María Alejandra, et autres
Publié: (2025)
Recurrent Memory-Augmented Transformers with Chunked Attention for Long-Context Language Modeling
par: Kashyap, Ankit
Publié: (2025)
par: Kashyap, Ankit
Publié: (2025)
LayerRoute: Input-Conditioned Adaptive Layer Skipping via LoRA Fine-Tuning for Agentic Language Models
par: Sikdar, Prateek Kumar
Publié: (2026)
par: Sikdar, Prateek Kumar
Publié: (2026)
Predictable Scale: Part I, Step Law -- Optimal Hyperparameter Scaling Law in Large Language Model Pretraining
par: Li, Houyi, et autres
Publié: (2025)
par: Li, Houyi, et autres
Publié: (2025)
PaperVoyager : Building Interactive Web with Visual Language Models
par: Dai, Dasen, et autres
Publié: (2026)
par: Dai, Dasen, et autres
Publié: (2026)
SLM Finetuning for Natural Language to Domain Specific Code Generation in Production
par: Nair, Renjini R., et autres
Publié: (2026)
par: Nair, Renjini R., et autres
Publié: (2026)
Sequential Cohort Selection
par: Nana, Hortence Phalonne, et autres
Publié: (2025)
par: Nana, Hortence Phalonne, et autres
Publié: (2025)
Explaining Modern Gated-Linear RNNs via a Unified Implicit Attention Formulation
par: Zimerman, Itamar, et autres
Publié: (2024)
par: Zimerman, Itamar, et autres
Publié: (2024)
Segmenting Action-Value Functions Over Time-Scales in SARSA via TD($Δ$)
par: Humayoo, Mahammad
Publié: (2024)
par: Humayoo, Mahammad
Publié: (2024)
ZTree: A Subgroup Identification Based Decision Tree Learning Framework
par: Cheng, Eric, et autres
Publié: (2025)
par: Cheng, Eric, et autres
Publié: (2025)
Transfer Learning for a Class of Cascade Dynamical Systems
par: Rabiei, Shima, et autres
Publié: (2024)
par: Rabiei, Shima, et autres
Publié: (2024)
Time-Scale Separation in Q-Learning: Extending TD($\triangle$) for Action-Value Function Decomposition
par: Humayoo, Mahammad
Publié: (2024)
par: Humayoo, Mahammad
Publié: (2024)
Testing the Efficacy of Hyperparameter Optimization Algorithms in Short-Term Load Forecasting
par: Hakyemez, Tugrul Cabir, et autres
Publié: (2024)
par: Hakyemez, Tugrul Cabir, et autres
Publié: (2024)
PromptSAM+: Malware Detection based on Prompt Segment Anything Model
par: Wei, Xingyuan, et autres
Publié: (2024)
par: Wei, Xingyuan, et autres
Publié: (2024)
Evaluating the Limitations of Local LLMs in Solving Complex Programming Challenges
par: Matotek, Kadin, et autres
Publié: (2025)
par: Matotek, Kadin, et autres
Publié: (2025)
Circularity and Symmetries of $p$ and $p^{2}$-polygons
par: Haag, Rolf
Publié: (2025)
par: Haag, Rolf
Publié: (2025)
Evaluating Model Robustness Using Adaptive Sparse L0 Regularization
par: Liu, Weiyou, et autres
Publié: (2024)
par: Liu, Weiyou, et autres
Publié: (2024)
DEM: Distribution Edited Model for Training with Mixed Data Distributions
par: Ram, Dhananjay, et autres
Publié: (2024)
par: Ram, Dhananjay, et autres
Publié: (2024)
I-WebGenBench : Evaluating Interactivity in LLM-Generated Scientific Web Applications
par: Dai, Dasen, et autres
Publié: (2026)
par: Dai, Dasen, et autres
Publié: (2026)
Vision-Language Reasoning for Geolocalization: A Reinforcement Learning Approach
par: Wu, Biao, et autres
Publié: (2026)
par: Wu, Biao, et autres
Publié: (2026)
Large Language Models for Propaganda Span Annotation
par: Hasanain, Maram, et autres
Publié: (2023)
par: Hasanain, Maram, et autres
Publié: (2023)
Mobile Phone Sensor-based Nigerian Driving Dataset to Detect Alcohol-influenced Behaviours
par: Thompson, Iniakpokeikiye Peter, et autres
Publié: (2025)
par: Thompson, Iniakpokeikiye Peter, et autres
Publié: (2025)
Corpus Considerations for Annotator Modeling and Scaling
par: Sarumi, Olufunke O., et autres
Publié: (2024)
par: Sarumi, Olufunke O., et autres
Publié: (2024)
CBR -- Boosting Adaptive Classification By Retrieval of Encrypted Network Traffic with Out-of-distribution
par: Lukach, Amir, et autres
Publié: (2024)
par: Lukach, Amir, et autres
Publié: (2024)
From Pixels to Privacy: Temporally Consistent Video Anonymization via Token Pruning for Privacy Preserving Action Recognition
par: Aslam, Nazia, et autres
Publié: (2026)
par: Aslam, Nazia, et autres
Publié: (2026)
Policy-Grounded Safety Evaluation of 20 Large Language Models
par: Contreras, Juan Manuel
Publié: (2025)
par: Contreras, Juan Manuel
Publié: (2025)
CGRclust: Chaos Game Representation for Twin Contrastive Clustering of Unlabelled DNA Sequences
par: Alipour, Fatemeh, et autres
Publié: (2024)
par: Alipour, Fatemeh, et autres
Publié: (2024)
Developer Challenges on Large Language Models: A Study of Stack Overflow and OpenAI Developer Forum Posts
par: Alam, Khairul, et autres
Publié: (2024)
par: Alam, Khairul, et autres
Publié: (2024)
Transcribing Bengali Text with Regional Dialects to IPA using District Guided Tokens
par: Islam, S M Jishanul, et autres
Publié: (2024)
par: Islam, S M Jishanul, et autres
Publié: (2024)
Anomaly Detection in IEC-61850 GOOSE Networks: Evaluating Unsupervised and Temporal Learning for Real-Time Intrusion Detection
par: Moore, Joseph
Publié: (2026)
par: Moore, Joseph
Publié: (2026)
Software Implementation of Digital Filtering via Tustin's Bilinear Transform
par: Herron, Connor W.
Publié: (2024)
par: Herron, Connor W.
Publié: (2024)
Documents similaires
-
The Hidden Attention of Mamba Models
par: Ali, Ameen, et autres
Publié: (2024) -
Random Heterogeneous Neurochaos Learning Architecture for Data Classification
par: S, Remya Ajai A, et autres
Publié: (2024) -
Evaluating the efficacy of LLM Safety Solutions : The Palit Benchmark Dataset
par: Palit, Sayon, et autres
Publié: (2025) -
Robust Reward Modeling for Large Language Models via Causal Decomposition
par: Lu, Yunsheng, et autres
Publié: (2026) -
Factual Dialogue Summarization via Learning from Large Language Models
par: Zhu, Rongxin, et autres
Publié: (2024)