Evaluating the Effectiveness of the Foundational Models for Q&A Classification in Mental Health care
Fuente:
arXiv
Guardado en:
| Autores principales: | Alhuzali, Hassan, Alasmari, Ashwag |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
SaudiCulture: A Benchmark for Evaluating Large Language Models Cultural Competence within Saudi Arabia
por: Ayash, Lama, et al.
Publicado: (2025)
por: Ayash, Lama, et al.
Publicado: (2025)
From Words to Proverbs: Evaluating LLMs Linguistic and Cultural Competence in Saudi Dialects with Absher
por: Al-Monef, Renad, et al.
Publicado: (2025)
por: Al-Monef, Renad, et al.
Publicado: (2025)
MentalQA: An Annotated Arabic Corpus for Questions and Answers of Mental Healthcare
por: Alhuzali, Hassan, et al.
Publicado: (2024)
por: Alhuzali, Hassan, et al.
Publicado: (2024)
Investigating Persuasion Techniques in Arabic: An Empirical Study Leveraging Large Language Models
por: Alzahrani, Abdurahmman, et al.
Publicado: (2024)
por: Alzahrani, Abdurahmman, et al.
Publicado: (2024)
XCR-Bench: A Multi-Task Benchmark for Evaluating Cultural Reasoning in LLMs
por: Kabir, Mohsinul, et al.
Publicado: (2026)
por: Kabir, Mohsinul, et al.
Publicado: (2026)
Cognitive-Mental-LLM: Evaluating Reasoning in Large Language Models for Mental Health Prediction via Online Text
por: Patil, Avinash, et al.
Publicado: (2025)
por: Patil, Avinash, et al.
Publicado: (2025)
Still Not Quite There! Evaluating Large Language Models for Comorbid Mental Health Diagnosis
por: Hengle, Amey, et al.
Publicado: (2024)
por: Hengle, Amey, et al.
Publicado: (2024)
TrustMH-Bench: A Comprehensive Benchmark for Evaluating the Trustworthiness of Large Language Models in Mental Health
por: Xiong, Zixin, et al.
Publicado: (2026)
por: Xiong, Zixin, et al.
Publicado: (2026)
A Dual-Prompting for Interpretable Mental Health Language Models
por: Jeon, Hyolim, et al.
Publicado: (2024)
por: Jeon, Hyolim, et al.
Publicado: (2024)
Elsevier Arena: Human Evaluation of Chemistry/Biology/Health Foundational Large Language Models
por: Thorne, Camilo, et al.
Publicado: (2024)
por: Thorne, Camilo, et al.
Publicado: (2024)
AraHealthQA 2025: The First Shared Task on Arabic Health Question Answering
por: Alhuzali, Hassan, et al.
Publicado: (2025)
por: Alhuzali, Hassan, et al.
Publicado: (2025)
The Science of Evaluating Foundation Models
por: Yuan, Jiayi, et al.
Publicado: (2025)
por: Yuan, Jiayi, et al.
Publicado: (2025)
A Novel Nuanced Conversation Evaluation Framework for Large Language Models in Mental Health
por: Marrapese, Alexander, et al.
Publicado: (2024)
por: Marrapese, Alexander, et al.
Publicado: (2024)
Large Language Model for Mental Health: A Systematic Review
por: Guo, Zhijun, et al.
Publicado: (2024)
por: Guo, Zhijun, et al.
Publicado: (2024)
Large Language Models in Mental Health Care: a Scoping Review
por: Hua, Yining, et al.
Publicado: (2024)
por: Hua, Yining, et al.
Publicado: (2024)
multiMentalRoBERTa: A Fine-tuned Multiclass Classifier for Mental Health Disorder
por: Islam, K M Sajjadul, et al.
Publicado: (2025)
por: Islam, K M Sajjadul, et al.
Publicado: (2025)
Generative Foundation Model for Structured and Unstructured Electronic Health Records
por: Sivarajkumar, Sonish, et al.
Publicado: (2025)
por: Sivarajkumar, Sonish, et al.
Publicado: (2025)
RedditESS: A Mental Health Social Support Interaction Dataset -- Understanding Effective Social Support to Refine AI-Driven Support Tools
por: Alghamdi, Zeyad, et al.
Publicado: (2025)
por: Alghamdi, Zeyad, et al.
Publicado: (2025)
Do Large Language Models Align with Core Mental Health Counseling Competencies?
por: Nguyen, Viet Cuong, et al.
Publicado: (2024)
por: Nguyen, Viet Cuong, et al.
Publicado: (2024)
Towards Privacy-aware Mental Health AI Models: Advances, Challenges, and Opportunities
por: Mandal, Aishik, et al.
Publicado: (2025)
por: Mandal, Aishik, et al.
Publicado: (2025)
MindEval: Benchmarking Language Models on Multi-turn Mental Health Support
por: Pombal, José, et al.
Publicado: (2025)
por: Pombal, José, et al.
Publicado: (2025)
Zero-shot Explainable Mental Health Analysis on Social Media by Incorporating Mental Scales
por: Li, Wenyu, et al.
Publicado: (2024)
por: Li, Wenyu, et al.
Publicado: (2024)
A Comparative Study on Patient Language across Therapeutic Domains for Effective Patient Voice Classification in Online Health Discussions
por: Lysandrou, Giorgos, et al.
Publicado: (2024)
por: Lysandrou, Giorgos, et al.
Publicado: (2024)
A Comprehensive Evaluation of Large Language Models on Mental Illnesses in Arabic Context
por: Zahran, Noureldin, et al.
Publicado: (2025)
por: Zahran, Noureldin, et al.
Publicado: (2025)
An Ubuntu-Guided Large Language Model Framework for Cognitive Behavioral Mental Health Dialogue
por: Forane, Sontaga G., et al.
Publicado: (2026)
por: Forane, Sontaga G., et al.
Publicado: (2026)
Style Transfer as Bias Mitigation: Diffusion Models for Synthetic Mental Health Text for Arabic
por: Mankarious, Saad, et al.
Publicado: (2026)
por: Mankarious, Saad, et al.
Publicado: (2026)
RECAP: Resistance Capture in Text-based Mental Health Counseling with Large Language Models
por: Li, Anqi, et al.
Publicado: (2026)
por: Li, Anqi, et al.
Publicado: (2026)
MHSafeEval: Role-Aware Interaction-Level Evaluation of Mental Health Safety in Large Language Models
por: Lee, Suhyun, et al.
Publicado: (2026)
por: Lee, Suhyun, et al.
Publicado: (2026)
K-SENSE: A Knowledge-Guided Self-Augmented Encoder for Neuro-Semantic Evaluation of Mental Health Conditions on Social Media
por: Yadav, Vijay
Publicado: (2026)
por: Yadav, Vijay
Publicado: (2026)
ALBA: Adaptive Language-based Assessments for Mental Health
por: Varadarajan, Vasudha, et al.
Publicado: (2023)
por: Varadarajan, Vasudha, et al.
Publicado: (2023)
A Comprehensive Review of Datasets for Clinical Mental Health AI Systems
por: Mandal, Aishik, et al.
Publicado: (2025)
por: Mandal, Aishik, et al.
Publicado: (2025)
Cross-Platform Evaluation of Reasoning Capabilities in Foundation Models
por: de Curtò, J., et al.
Publicado: (2025)
por: de Curtò, J., et al.
Publicado: (2025)
Evaluating the Elementary Multilingual Capabilities of Large Language Models with MultiQ
por: Holtermann, Carolin, et al.
Publicado: (2024)
por: Holtermann, Carolin, et al.
Publicado: (2024)
LENS: LLM-Enabled Narrative Synthesis for Mental Health by Aligning Multimodal Sensing with Language Models
por: Xu, Wenxuan, et al.
Publicado: (2025)
por: Xu, Wenxuan, et al.
Publicado: (2025)
A Layered Multi-Expert Framework for Long-Context Mental Health Assessments
por: Tang, Jinwen, et al.
Publicado: (2025)
por: Tang, Jinwen, et al.
Publicado: (2025)
MentalArena: Self-play Training of Language Models for Diagnosis and Treatment of Mental Health Disorders
por: Li, Cheng, et al.
Publicado: (2024)
por: Li, Cheng, et al.
Publicado: (2024)
Evaluating Progress in Graph Foundation Models: A Comprehensive Benchmark and New Insights
por: Yu, Xingtong, et al.
Publicado: (2026)
por: Yu, Xingtong, et al.
Publicado: (2026)
CARMA: Comprehensive Automatically-annotated Reddit Mental Health Dataset for Arabic
por: Mankarious, Saad, et al.
Publicado: (2025)
por: Mankarious, Saad, et al.
Publicado: (2025)
Understanding Student Sentiment on Mental Health Support in Colleges Using Large Language Models
por: Sood, Palak, et al.
Publicado: (2024)
por: Sood, Palak, et al.
Publicado: (2024)
An AI-Based Behavioral Health Safety Filter and Dataset for Identifying Mental Health Crises in Text-Based Conversations
por: Nelson, Benjamin W., et al.
Publicado: (2025)
por: Nelson, Benjamin W., et al.
Publicado: (2025)
Ejemplares similares
-
SaudiCulture: A Benchmark for Evaluating Large Language Models Cultural Competence within Saudi Arabia
por: Ayash, Lama, et al.
Publicado: (2025) -
From Words to Proverbs: Evaluating LLMs Linguistic and Cultural Competence in Saudi Dialects with Absher
por: Al-Monef, Renad, et al.
Publicado: (2025) -
MentalQA: An Annotated Arabic Corpus for Questions and Answers of Mental Healthcare
por: Alhuzali, Hassan, et al.
Publicado: (2024) -
Investigating Persuasion Techniques in Arabic: An Empirical Study Leveraging Large Language Models
por: Alzahrani, Abdurahmman, et al.
Publicado: (2024) -
XCR-Bench: A Multi-Task Benchmark for Evaluating Cultural Reasoning in LLMs
por: Kabir, Mohsinul, et al.
Publicado: (2026)