MedArabiQ: Benchmarking Large Language Models on Arabic Medical Tasks
Fuente:
arXiv
Salvato in:
| Autori principali: | Daoud, Mouath Abu, Abouzahir, Chaimae, Kharouf, Leen, Al-Eisawi, Walid, Habash, Nizar, Shamout, Farah E. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
AraHealthQA 2025: The First Shared Task on Arabic Health Question Answering
di: Alhuzali, Hassan, et al.
Pubblicazione: (2025)
di: Alhuzali, Hassan, et al.
Pubblicazione: (2025)
Cross-Lingual Empirical Evaluation of Large Language Models for Arabic Medical Tasks
di: Abouzahir, Chaimae, et al.
Pubblicazione: (2026)
di: Abouzahir, Chaimae, et al.
Pubblicazione: (2026)
MedAraBench: Large-Scale Arabic Medical Question Answering Dataset and Benchmark
di: Abu-Daoud, Mouath, et al.
Pubblicazione: (2026)
di: Abu-Daoud, Mouath, et al.
Pubblicazione: (2026)
Desk2Desk: Optimization-based Mixed Reality Workspace Integration for Remote Side-by-side Collaboration
di: Sidenmark, Ludwig, et al.
Pubblicazione: (2024)
di: Sidenmark, Ludwig, et al.
Pubblicazione: (2024)
Measuring Large Language Models Dependency: Validating the Arabic Version of the LLM-D12 Scale
di: AlShakhsi, Sameha, et al.
Pubblicazione: (2025)
di: AlShakhsi, Sameha, et al.
Pubblicazione: (2025)
K-QA: A Real-World Medical Q&A Benchmark
di: Manes, Itay, et al.
Pubblicazione: (2024)
di: Manes, Itay, et al.
Pubblicazione: (2024)
Making It Work Is the Work: Engineering Maturity as Epistemic Work
di: Leen, Danny, et al.
Pubblicazione: (2026)
di: Leen, Danny, et al.
Pubblicazione: (2026)
Design of a visual environment for programming by direct data manipulation
di: Adam, Michel, et al.
Pubblicazione: (2025)
di: Adam, Michel, et al.
Pubblicazione: (2025)
Arabic Little STT: Arabic Children Speech Recognition Dataset
di: Alkadri, Mouhand, et al.
Pubblicazione: (2025)
di: Alkadri, Mouhand, et al.
Pubblicazione: (2025)
Developing and Validating the Arabic Version of the Attitudes Toward Large Language Models Scale
di: Barajeeh, Basad, et al.
Pubblicazione: (2025)
di: Barajeeh, Basad, et al.
Pubblicazione: (2025)
MedBike: A Cardiac Patient Monitoring System Enhanced through Gamification
di: Hossain, Tahmim, et al.
Pubblicazione: (2024)
di: Hossain, Tahmim, et al.
Pubblicazione: (2024)
Combining Automation and Expertise: A Semi-automated Approach to Correcting Eye Tracking Data in Reading Tasks
di: Madi, Naser Al, et al.
Pubblicazione: (2025)
di: Madi, Naser Al, et al.
Pubblicazione: (2025)
SyriSign: A Parallel Corpus for Arabic Text to Syrian Arabic Sign Language Translation
di: Khalil, Mohammad Amer, et al.
Pubblicazione: (2026)
di: Khalil, Mohammad Amer, et al.
Pubblicazione: (2026)
MedFoundationHub: A Lightweight and Secure Toolkit for Deploying Medical Vision Language Foundation Models
di: Li, Xiao, et al.
Pubblicazione: (2025)
di: Li, Xiao, et al.
Pubblicazione: (2025)
ArEEG_Chars: Dataset for Envisioned Speech Recognition using EEG for Arabic Characters
di: Darwish, Hazem, et al.
Pubblicazione: (2024)
di: Darwish, Hazem, et al.
Pubblicazione: (2024)
ArEEG_Words: Dataset for Envisioned Speech Recognition using EEG for Arabic Words
di: Darwish, Hazem, et al.
Pubblicazione: (2024)
di: Darwish, Hazem, et al.
Pubblicazione: (2024)
Adjusting B‐Tree for Better Usability: Nodes as Files Instead of Disk Blocks
di: Majed AbuSafiya
Pubblicazione: (2026)
di: Majed AbuSafiya
Pubblicazione: (2026)
MedDialogRubrics: A Comprehensive Benchmark and Evaluation Framework for Multi-turn Medical Consultations in Large Language Models
di: Gong, Lecheng, et al.
Pubblicazione: (2026)
di: Gong, Lecheng, et al.
Pubblicazione: (2026)
Experimental Interface for Multimodal and Large Language Model Based Explanations of Educational Recommender Systems
di: Abu-Rasheed, Hasan, et al.
Pubblicazione: (2024)
di: Abu-Rasheed, Hasan, et al.
Pubblicazione: (2024)
Bias Beneath the Tone: Empirical Characterisation of Tone Bias in LLM-Driven UX Systems
di: Bodara, Heet, et al.
Pubblicazione: (2025)
di: Bodara, Heet, et al.
Pubblicazione: (2025)
Abjad-Kids: An Arabic Speech Classification Dataset for Primary Education
di: Snoubara, Abdul Aziz, et al.
Pubblicazione: (2026)
di: Snoubara, Abdul Aziz, et al.
Pubblicazione: (2026)
Investigating the Task Load of Investigating the Task Load in Visualization Studies
di: Pahr, Daniel, et al.
Pubblicazione: (2025)
di: Pahr, Daniel, et al.
Pubblicazione: (2025)
Lemmatization as a Classification Task: Results from Arabic across Multiple Genres
di: Saeed, Mostafa, et al.
Pubblicazione: (2025)
di: Saeed, Mostafa, et al.
Pubblicazione: (2025)
Prompt2Task: Automating UI Tasks on Smartphones from Textual Prompts
di: Huang, Tian, et al.
Pubblicazione: (2024)
di: Huang, Tian, et al.
Pubblicazione: (2024)
Task Mode: Dynamic Filtering for Task-Specific Web Navigation using LLMs
di: Mohanbabu, Ananya Gubbi, et al.
Pubblicazione: (2025)
di: Mohanbabu, Ananya Gubbi, et al.
Pubblicazione: (2025)
Does GenAI Make Usability Testing Obsolete?
di: Pourasad, Ali Ebrahimi, et al.
Pubblicazione: (2024)
di: Pourasad, Ali Ebrahimi, et al.
Pubblicazione: (2024)
RFM-HRI : A Multimodal Dataset of Medical Robot Failure, User Reaction and Recovery Preferences for Item Retrieval Tasks
di: Batra, Yashika, et al.
Pubblicazione: (2026)
di: Batra, Yashika, et al.
Pubblicazione: (2026)
TaskLens: Generating Task-Conditioned Scaffolded Interfaces for Learning Professional Creative Software
di: Liu, Yimeng, et al.
Pubblicazione: (2025)
di: Liu, Yimeng, et al.
Pubblicazione: (2025)
CPS-TaskForge: Generating Collaborative Problem Solving Environments for Diverse Communication Tasks
di: Haduong, Nikita, et al.
Pubblicazione: (2024)
di: Haduong, Nikita, et al.
Pubblicazione: (2024)
Exploring diversity perceptions in a community through a Q&A chatbot
di: Kun, Peter, et al.
Pubblicazione: (2024)
di: Kun, Peter, et al.
Pubblicazione: (2024)
VisionTasker: Mobile Task Automation Using Vision Based UI Understanding and LLM Task Planning
di: Song, Yunpeng, et al.
Pubblicazione: (2023)
di: Song, Yunpeng, et al.
Pubblicazione: (2023)
From Following to Understanding: Investigating the Role of Reflective Prompts in AR-Guided Tasks to Promote Task Understanding
di: Zhang, Nandi, et al.
Pubblicazione: (2025)
di: Zhang, Nandi, et al.
Pubblicazione: (2025)
Expert-Generated Privacy Q&A Dataset for Conversational AI and User Study Insights
di: Leschanowsky, Anna, et al.
Pubblicazione: (2025)
di: Leschanowsky, Anna, et al.
Pubblicazione: (2025)
Management and Visualization Tools for Emergency Medical Services
di: Guigues, Vincent, et al.
Pubblicazione: (2024)
di: Guigues, Vincent, et al.
Pubblicazione: (2024)
PyZoBot: A Platform for Conversational Information Extraction and Synthesis from Curated Zotero Reference Libraries through Advanced Retrieval-Augmented Generation
di: Alshammari, Suad, et al.
Pubblicazione: (2024)
di: Alshammari, Suad, et al.
Pubblicazione: (2024)
ErgoGlide: A Wearable Trackball Device for Ergonomic Text Entry in Virtual Reality
di: Bakar, Muhammad Abu, et al.
Pubblicazione: (2026)
di: Bakar, Muhammad Abu, et al.
Pubblicazione: (2026)
ContextQ: Generated Questions to Support Meaningful Parent-Child Dialogue While Co-Reading
di: Smith, Griffin Dietz, et al.
Pubblicazione: (2024)
di: Smith, Griffin Dietz, et al.
Pubblicazione: (2024)
Task-Aware Delegation Cues for LLM Agents
di: Gu, Xingrui
Pubblicazione: (2026)
di: Gu, Xingrui
Pubblicazione: (2026)
A Typology of Decision-Making Tasks for Visualization
di: Brumar, Camelia D., et al.
Pubblicazione: (2024)
di: Brumar, Camelia D., et al.
Pubblicazione: (2024)
Haptic VR Simulation for Surgery Procedures in Medical Training
di: Jie, Lim Zheng, et al.
Pubblicazione: (2024)
di: Jie, Lim Zheng, et al.
Pubblicazione: (2024)
Documenti analoghi
-
AraHealthQA 2025: The First Shared Task on Arabic Health Question Answering
di: Alhuzali, Hassan, et al.
Pubblicazione: (2025) -
Cross-Lingual Empirical Evaluation of Large Language Models for Arabic Medical Tasks
di: Abouzahir, Chaimae, et al.
Pubblicazione: (2026) -
MedAraBench: Large-Scale Arabic Medical Question Answering Dataset and Benchmark
di: Abu-Daoud, Mouath, et al.
Pubblicazione: (2026) -
Desk2Desk: Optimization-based Mixed Reality Workspace Integration for Remote Side-by-side Collaboration
di: Sidenmark, Ludwig, et al.
Pubblicazione: (2024) -
Measuring Large Language Models Dependency: Validating the Arabic Version of the LLM-D12 Scale
di: AlShakhsi, Sameha, et al.
Pubblicazione: (2025)