A Case Study of HealthBench in the Japanese Medical Context
Fuente:
Zenodo
Guardado en:
| Autor principal: | HISADA, Shohei |
|---|---|
| Formato: | Recurso digital |
| Lenguaje: | japonés |
| Publicado: |
Zenodo
2025
|
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Filling in the Clinical Gaps in Benchmark: Case for HealthBench for the Japanese medical system
por: Hisada, Shohei, et al.
Publicado: (2025)
por: Hisada, Shohei, et al.
Publicado: (2025)
Decomposing Physician Disagreement in HealthBench
por: Borgohain, Satya, et al.
Publicado: (2026)
por: Borgohain, Satya, et al.
Publicado: (2026)
Rethinking Evidence Hierarchies in Medical Language Benchmarks: A Critical Evaluation of HealthBench
por: Mutisya, Fred, et al.
Publicado: (2025)
por: Mutisya, Fred, et al.
Publicado: (2025)
HealthBench: Evaluating Large Language Models Towards Improved Human Health
por: Arora, Rahul K., et al.
Publicado: (2025)
por: Arora, Rahul K., et al.
Publicado: (2025)
OpenAIs HealthBench in Action: Evaluating an LLM-Based Medical Assistant on Realistic Clinical Queries
por: Ravichandran, Sandhanakrishnan, et al.
Publicado: (2025)
por: Ravichandran, Sandhanakrishnan, et al.
Publicado: (2025)
MDIA: A Multi-Agent Diagnostic Intelligence Pipeline on HealthBench Professional
por: Cruz, Roberto, et al.
Publicado: (2026)
por: Cruz, Roberto, et al.
Publicado: (2026)
HealthBench Professional: Evaluating Large Language Models on Real Clinician Chats
por: Hicks, Rebecca Soskin, et al.
Publicado: (2026)
por: Hicks, Rebecca Soskin, et al.
Publicado: (2026)
CADEL: A Corpus of Administrative Web Documents for Japanese Entity Linking
por: Higashiyama, Shohei, et al.
Publicado: (2026)
por: Higashiyama, Shohei, et al.
Publicado: (2026)
Sensory and physicochemical characteristics of Japanese jidori chicken (Choshu‐Kurokashiwa) and broiler thigh meat: Effect of cooking procedure
por: Shohei Murata, et al.
Publicado: (2024)
por: Shohei Murata, et al.
Publicado: (2024)
Supplier Relationship Management: A Case Study in the Context of Health Care
por: Tobias Mettler
Publicado: (2009)
por: Tobias Mettler
Publicado: (2009)
Health-ORSC-Bench: A Benchmark for Measuring Over-Refusal and Safety Completion in Health Context
por: Zhang, Zhihao, et al.
Publicado: (2026)
por: Zhang, Zhihao, et al.
Publicado: (2026)
Association between the Japanese‐style diet and low prevalence of depressive symptoms: Japan Epidemiology Collaboration on Occupational Health Study
por: Haruka Miyake, et al.
Publicado: (2025)
por: Haruka Miyake, et al.
Publicado: (2025)
ATD-Trans: A Geographically Grounded Japanese-English Travelogue Translation Dataset
por: Higashiyama, Shohei, et al.
Publicado: (2026)
por: Higashiyama, Shohei, et al.
Publicado: (2026)
JMedEthicBench: A Multi-Turn Conversational Benchmark for Evaluating Medical Safety in Japanese Large Language Models
por: Liu, Junyu, et al.
Publicado: (2026)
por: Liu, Junyu, et al.
Publicado: (2026)
Relationship of Social Jetlag and Chronotype With the Risk of Diabetes Among Predominantly Male Japanese Daytime Workers: A Prospective Study
por: Zobida Islam, et al.
Publicado: (2025)
por: Zobida Islam, et al.
Publicado: (2025)
The importance of examining both the amount and balance of social support: A study on the relationship between social support and subjective well‐being of older Japanese adults
por: Yukari Jessica Tham, et al.
Publicado: (2024)
por: Yukari Jessica Tham, et al.
Publicado: (2024)
Japanese Medical Libraries - A Brief Visit
por: Wender, Ruth W.
Publicado: (1974)
por: Wender, Ruth W.
Publicado: (1974)
Heron-Bench: A Benchmark for Evaluating Vision Language Models in Japanese
por: Inoue, Yuichi, et al.
Publicado: (2024)
por: Inoue, Yuichi, et al.
Publicado: (2024)
SWE Context Bench: A Benchmark for Context Learning in Coding
por: Zhu, Jiayuan, et al.
Publicado: (2026)
por: Zhu, Jiayuan, et al.
Publicado: (2026)
ContextBench: A Benchmark for Context Retrieval in Coding Agents
por: Li, Han, et al.
Publicado: (2026)
por: Li, Han, et al.
Publicado: (2026)
JMedBench: A Benchmark for Evaluating Japanese Biomedical Large Language Models
por: Jiang, Junfeng, et al.
Publicado: (2024)
por: Jiang, Junfeng, et al.
Publicado: (2024)
ContextBench: Modifying Contexts for Targeted Latent Activation
por: Graham, Robert, et al.
Publicado: (2025)
por: Graham, Robert, et al.
Publicado: (2025)
Breast milk pasteurization for preventing cytomegalovirus infection: A preliminary study in a Japanese perinatal center
por: Sakiko Uho, et al.
Publicado: (2025)
por: Sakiko Uho, et al.
Publicado: (2025)
Club Activity, Study Groups, and Academic Achievement: A Nationwide Study of Japanese Medical Students' Extracurricular Life
por: Hirohisa Fujikawa, et al.
Publicado: (2026)
por: Hirohisa Fujikawa, et al.
Publicado: (2026)
HalDec-Bench: Benchmarking Hallucination Detector in Image Captioning
por: Saito, Kuniaki, et al.
Publicado: (2025)
por: Saito, Kuniaki, et al.
Publicado: (2025)
HalDec-Bench: Benchmarking Hallucination Detector in Image Captioning
por: Saito, Kuniaki, et al.
Publicado: (2026)
por: Saito, Kuniaki, et al.
Publicado: (2026)
ChatGPT as a Translation Engine: A Case Study on Japanese-English
por: Sutanto, Vincent Michael, et al.
Publicado: (2025)
por: Sutanto, Vincent Michael, et al.
Publicado: (2025)
To Drop or Not to Drop? Predicting Argument Ellipsis Judgments: A Case Study in Japanese
por: Ishizuki, Yukiko, et al.
Publicado: (2024)
por: Ishizuki, Yukiko, et al.
Publicado: (2024)
Reforming the Japanese Preschool System: An Ethnographic Case Study of Policy Implementation
por: Akiko Hayashi
Publicado: (2017)
por: Akiko Hayashi
Publicado: (2017)
Trust in Medical AI: The Case of mHealth Diabetes Apps
por: Sophie Materne, et al.
Publicado: (2025)
por: Sophie Materne, et al.
Publicado: (2025)
Structural Model of Quantum Entanglement (Japanese)
por: Morimoto, Yuta
Publicado: (2025)
por: Morimoto, Yuta
Publicado: (2025)
Learning from Fukushima (Japanese version)
Publicado: (2020)
Publicado: (2020)
Pretraining and Updates of Domain-Specific LLM: A Case Study in the Japanese Business Domain
por: Takahashi, Kosuke, et al.
Publicado: (2024)
por: Takahashi, Kosuke, et al.
Publicado: (2024)
Case Studies in Global Health
Publicado: (2026)
Publicado: (2026)
Medical Model Synthesis Architectures: A Case Study
por: Collins, Katherine M., et al.
Publicado: (2026)
por: Collins, Katherine M., et al.
Publicado: (2026)
CCA-ISF-02: Canonical Case — Interpretive Sovereignty Failure Medical Education Context: Cross-Model Replication Study
por: Segeren, Hillary
Publicado: (2026)
por: Segeren, Hillary
Publicado: (2026)
HakushoBench: A Japanese Chart and Table VQA Benchmark from Governmental White Papers
por: Sugiura, Issa, et al.
Publicado: (2026)
por: Sugiura, Issa, et al.
Publicado: (2026)
Association Between Liver Fibrosis and Cause‐Specific Mortality in Japanese Patients With Biopsy‐Confirmed Metabolic Dysfunction–Associated Steatotic Liver Disease: A Prospective Cohort Study / Liver Fibrosis and Mortality in Japanese MASLD
por: Kyoko Sakai, et al.
Publicado: (2025)
por: Kyoko Sakai, et al.
Publicado: (2025)
MileBench: Benchmarking MLLMs in Long Context
por: Song, Dingjie, et al.
Publicado: (2024)
por: Song, Dingjie, et al.
Publicado: (2024)
Do Large Language Models Know Folktales? A Case Study of Yokai in Japanese Folktales
por: Tsutsumi, Ayuto, et al.
Publicado: (2025)
por: Tsutsumi, Ayuto, et al.
Publicado: (2025)
Ejemplares similares
-
Filling in the Clinical Gaps in Benchmark: Case for HealthBench for the Japanese medical system
por: Hisada, Shohei, et al.
Publicado: (2025) -
Decomposing Physician Disagreement in HealthBench
por: Borgohain, Satya, et al.
Publicado: (2026) -
Rethinking Evidence Hierarchies in Medical Language Benchmarks: A Critical Evaluation of HealthBench
por: Mutisya, Fred, et al.
Publicado: (2025) -
HealthBench: Evaluating Large Language Models Towards Improved Human Health
por: Arora, Rahul K., et al.
Publicado: (2025) -
OpenAIs HealthBench in Action: Evaluating an LLM-Based Medical Assistant on Realistic Clinical Queries
por: Ravichandran, Sandhanakrishnan, et al.
Publicado: (2025)