PerMedCQA: Benchmarking Large Language Models on Medical Consumer Question Answering in Persian Language
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Jamali, Naghmeh, Mohammadi, Milad, Baledi, Danial, Rezvani, Zahra, Faili, Hesham |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Enhancing Few-Shot Transfer Learning with Optimized Multi-Task Prompt Tuning through Modular Prompt Composition
par: Pouramini, Ahmad, et autres
Publié: (2024)
par: Pouramini, Ahmad, et autres
Publié: (2024)
CrossPT: Exploring Cross-Task Transferability through Multi-Task Prompt Tuning
par: Pouramini, Ahmad, et autres
Publié: (2025)
par: Pouramini, Ahmad, et autres
Publié: (2025)
MedLM: Exploring Language Models for Medical Question Answering Systems
par: Yagnik, Niraj, et autres
Publié: (2024)
par: Yagnik, Niraj, et autres
Publié: (2024)
MedExQA: Medical Question Answering Benchmark with Multiple Explanations
par: Kim, Yunsoo, et autres
Publié: (2024)
par: Kim, Yunsoo, et autres
Publié: (2024)
LLM-MedQA: Enhancing Medical Question Answering through Case Studies in Large Language Models
par: Yang, Hang, et autres
Publié: (2024)
par: Yang, Hang, et autres
Publié: (2024)
MedExpQA: Multilingual Benchmarking of Large Language Models for Medical Question Answering
par: Alonso, Iñigo, et autres
Publié: (2024)
par: Alonso, Iñigo, et autres
Publié: (2024)
Leveraging Online Data to Enhance Medical Knowledge in a Small Persian Language Model
par: Ghassabi, Mehrdad, et autres
Publié: (2025)
par: Ghassabi, Mehrdad, et autres
Publié: (2025)
Multilingual Medical Reasoning for Question Answering with Large Language Models
par: Ferrazzi, Pietro, et autres
Publié: (2025)
par: Ferrazzi, Pietro, et autres
Publié: (2025)
Uncertainty Estimation of Large Language Models in Medical Question Answering
par: Wu, Jiaxin, et autres
Publié: (2024)
par: Wu, Jiaxin, et autres
Publié: (2024)
A Large-Scale Benchmark for Evaluating Large Language Models on Medical Question Answering in Romanian
par: Rogoz, Ana-Cristina, et autres
Publié: (2025)
par: Rogoz, Ana-Cristina, et autres
Publié: (2025)
PersianPunc: A Large-Scale Dataset and BERT-Based Approach for Persian Punctuation Restoration
par: Kalahroodi, Mohammad Javad Ranjbar, et autres
Publié: (2026)
par: Kalahroodi, Mohammad Javad Ranjbar, et autres
Publié: (2026)
PerSHOP -- A Persian dataset for shopping dialogue systems modeling
par: Mahmoudi, Keyvan, et autres
Publié: (2024)
par: Mahmoudi, Keyvan, et autres
Publié: (2024)
PerHalluEval: Persian Hallucination Evaluation Benchmark for Large Language Models
par: Hosseini, Mohammad, et autres
Publié: (2025)
par: Hosseini, Mohammad, et autres
Publié: (2025)
Collaboration among Multiple Large Language Models for Medical Question Answering
par: Shang, Kexin, et autres
Publié: (2025)
par: Shang, Kexin, et autres
Publié: (2025)
FairMedQA: Benchmarking Bias in Large Language Models for Medical Question Answering
par: Xiao, Ying, et autres
Publié: (2025)
par: Xiao, Ying, et autres
Publié: (2025)
Persian Typographical Error Type Detection Using Deep Neural Networks on Algorithmically-Generated Misspellings
par: Dehghani, Mohammad, et autres
Publié: (2023)
par: Dehghani, Mohammad, et autres
Publié: (2023)
SchemaGraphSQL: Efficient Schema Linking with Pathfinding Graph Algorithms for Text-to-SQL on Large-Scale Databases
par: Safdarian, AmirHossein, et autres
Publié: (2025)
par: Safdarian, AmirHossein, et autres
Publié: (2025)
MedEthicsQA: A Comprehensive Question Answering Benchmark for Medical Ethics Evaluation of LLMs
par: Wei, Jianhui, et autres
Publié: (2025)
par: Wei, Jianhui, et autres
Publié: (2025)
MEG: Medical Knowledge-Augmented Large Language Models for Question Answering
par: Cabello, Laura, et autres
Publié: (2024)
par: Cabello, Laura, et autres
Publié: (2024)
EpiQAL: Benchmarking Large Language Models in Epidemiological Question Answering and Reasoning
par: Wei, Mingyang, et autres
Publié: (2026)
par: Wei, Mingyang, et autres
Publié: (2026)
RJUA-MedDQA: A Multimodal Benchmark for Medical Document Question Answering and Clinical Reasoning
par: Jin, Congyun, et autres
Publié: (2024)
par: Jin, Congyun, et autres
Publié: (2024)
Enhancing Healthcare through Large Language Models: A Study on Medical Question Answering
par: Yu, Haoran, et autres
Publié: (2024)
par: Yu, Haoran, et autres
Publié: (2024)
InsQABench: Benchmarking Chinese Insurance Domain Question Answering with Large Language Models
par: Ding, Jing, et autres
Publié: (2025)
par: Ding, Jing, et autres
Publié: (2025)
MizanQA: Benchmarking Large Language Models on Moroccan Legal Question Answering
par: Bahaj, Adil, et autres
Publié: (2025)
par: Bahaj, Adil, et autres
Publié: (2025)
MedFuzz: Exploring the Robustness of Large Language Models in Medical Question Answering
par: Ness, Robert Osazuwa, et autres
Publié: (2024)
par: Ness, Robert Osazuwa, et autres
Publié: (2024)
MedPAIR: Measuring Physicians and AI Relevance Alignment in Medical Question Answering
par: Hao, Yuexing, et autres
Publié: (2025)
par: Hao, Yuexing, et autres
Publié: (2025)
MedFact: Benchmarking the Fact-Checking Capabilities of Large Language Models on Chinese Medical Texts
par: He, Jiayi, et autres
Publié: (2025)
par: He, Jiayi, et autres
Publié: (2025)
MedHallBench: A New Benchmark for Assessing Hallucination in Medical Large Language Models
par: Zuo, Kaiwen, et autres
Publié: (2024)
par: Zuo, Kaiwen, et autres
Publié: (2024)
MedArabiQ: Benchmarking Large Language Models on Arabic Medical Tasks
par: Daoud, Mouath Abu, et autres
Publié: (2025)
par: Daoud, Mouath Abu, et autres
Publié: (2025)
Unmasking Deceptive Visuals: Benchmarking Multimodal Large Language Models on Misleading Chart Question Answering
par: Chen, Zixin, et autres
Publié: (2025)
par: Chen, Zixin, et autres
Publié: (2025)
Evaluating Monolingual and Multilingual Large Language Models for Greek Question Answering: The DemosQA Benchmark
par: Mastrokostas, Charalampos, et autres
Publié: (2026)
par: Mastrokostas, Charalampos, et autres
Publié: (2026)
MedREQAL: Examining Medical Knowledge Recall of Large Language Models via Question Answering
par: Vladika, Juraj, et autres
Publié: (2024)
par: Vladika, Juraj, et autres
Publié: (2024)
Benchmarking Large Language Models on Answering and Explaining Challenging Medical Questions
par: Chen, Hanjie, et autres
Publié: (2024)
par: Chen, Hanjie, et autres
Publié: (2024)
PARSA-Bench: A Comprehensive Persian Audio-Language Model Benchmark
par: Kalahroodi, Mohammad Javad Ranjbar, et autres
Publié: (2026)
par: Kalahroodi, Mohammad Javad Ranjbar, et autres
Publié: (2026)
An Empirical Evaluation of Large Language Models on Consumer Health Questions
par: Abrar, Moaiz, et autres
Publié: (2024)
par: Abrar, Moaiz, et autres
Publié: (2024)
FocusMed: A Large Language Model-based Framework for Enhancing Medical Question Summarization with Focus Identification
par: Liu, Chao, et autres
Publié: (2025)
par: Liu, Chao, et autres
Publié: (2025)
MedHallu: A Comprehensive Benchmark for Detecting Medical Hallucinations in Large Language Models
par: Pandit, Shrey, et autres
Publié: (2025)
par: Pandit, Shrey, et autres
Publié: (2025)
LiCQA : A Lightweight Complex Question Answering System
par: Saha, Sourav, et autres
Publié: (2026)
par: Saha, Sourav, et autres
Publié: (2026)
MedGo: A Chinese Medical Large Language Model
par: Zhang, Haitao, et autres
Publié: (2024)
par: Zhang, Haitao, et autres
Publié: (2024)
Lightweight Large Language Model for Medication Enquiry: Med-Pal
par: Elangovan, Kabilan, et autres
Publié: (2024)
par: Elangovan, Kabilan, et autres
Publié: (2024)
Documents similaires
-
Enhancing Few-Shot Transfer Learning with Optimized Multi-Task Prompt Tuning through Modular Prompt Composition
par: Pouramini, Ahmad, et autres
Publié: (2024) -
CrossPT: Exploring Cross-Task Transferability through Multi-Task Prompt Tuning
par: Pouramini, Ahmad, et autres
Publié: (2025) -
MedLM: Exploring Language Models for Medical Question Answering Systems
par: Yagnik, Niraj, et autres
Publié: (2024) -
MedExQA: Medical Question Answering Benchmark with Multiple Explanations
par: Kim, Yunsoo, et autres
Publié: (2024) -
LLM-MedQA: Enhancing Medical Question Answering through Case Studies in Large Language Models
par: Yang, Hang, et autres
Publié: (2024)