Guardado en:
| Autores principales: | Jang, Han, Lee, Junhyeok, Eum, Heeseong, Choi, Kyu Sung |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2604.05738 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Segmentation-before-Staining Improves Structural Fidelity in Virtual IHC-to-Multiplex IF Translation
por: Lee, Junhyeok, et al.
Publicado: (2026)
por: Lee, Junhyeok, et al.
Publicado: (2026)
MPIB: A Benchmark for Medical Prompt Injection Attacks and Clinical Safety in LLMs
por: Lee, Junhyeok, et al.
Publicado: (2026)
por: Lee, Junhyeok, et al.
Publicado: (2026)
SciZoom: A Large-scale Benchmark for Hierarchical Scientific Summarization across the LLM Era
por: Jang, Han, et al.
Publicado: (2026)
por: Jang, Han, et al.
Publicado: (2026)
Hierarchical Perfusion Graphs for Tumor Heterogeneity Modeling in Glioma Molecular Subtyping
por: Jang, Han, et al.
Publicado: (2026)
por: Jang, Han, et al.
Publicado: (2026)
Routing Sensitivity Without Controllability: A Diagnostic Study of Fairness in MoE Language Models
por: Lee, Junhyeok, et al.
Publicado: (2026)
por: Lee, Junhyeok, et al.
Publicado: (2026)
Evidential Perfusion Physics-Informed Neural Networks with Residual Uncertainty Quantification
por: Lee, Junhyeok, et al.
Publicado: (2026)
por: Lee, Junhyeok, et al.
Publicado: (2026)
WisPerMed at BioLaySumm: Adapting Autoregressive Large Language Models for Lay Summarization of Scientific Articles
por: Pakull, Tabea M. G., et al.
Publicado: (2024)
por: Pakull, Tabea M. G., et al.
Publicado: (2024)
Laying Anchors: Semantically Priming Numerals in Language Modeling
por: Sharma, Mandar, et al.
Publicado: (2024)
por: Sharma, Mandar, et al.
Publicado: (2024)
Magical: Medical Lay Language Generation via Semantic Invariance and Layperson-tailored Adaptation
por: Liao, Weibin, et al.
Publicado: (2025)
por: Liao, Weibin, et al.
Publicado: (2025)
Domain-Specialized Interactive Segmentation Framework for Meningioma Radiotherapy Planning
por: Lee, Junhyeok, et al.
Publicado: (2025)
por: Lee, Junhyeok, et al.
Publicado: (2025)
The Lay Person's Guide to Biomedicine: Orchestrating Large Language Models
por: Luo, Zheheng, et al.
Publicado: (2024)
por: Luo, Zheheng, et al.
Publicado: (2024)
CliMedBench: A Large-Scale Chinese Benchmark for Evaluating Medical Large Language Models in Clinical Scenarios
por: Ouyang, Zetian, et al.
Publicado: (2024)
por: Ouyang, Zetian, et al.
Publicado: (2024)
Lesion-Aware Post-Training of Latent Diffusion Models for Synthesizing Diffusion MRI from CT Perfusion
por: Lee, Junhyeok, et al.
Publicado: (2025)
por: Lee, Junhyeok, et al.
Publicado: (2025)
Leveraging Large Language Models for Zero-shot Lay Summarisation in Biomedicine and Beyond
por: Goldsack, Tomas, et al.
Publicado: (2025)
por: Goldsack, Tomas, et al.
Publicado: (2025)
MedAraBench: Large-Scale Arabic Medical Question Answering Dataset and Benchmark
por: Abu-Daoud, Mouath, et al.
Publicado: (2026)
por: Abu-Daoud, Mouath, et al.
Publicado: (2026)
LayAlign: Enhancing Multilingual Reasoning in Large Language Models via Layer-Wise Adaptive Fusion and Alignment Strategy
por: Ruan, Zhiwen, et al.
Publicado: (2025)
por: Ruan, Zhiwen, et al.
Publicado: (2025)
KorMedMCQA-V: A Multimodal Benchmark for Evaluating Vision-Language Models on the Korean Medical Licensing Examination
por: Choi, Byungjin, et al.
Publicado: (2026)
por: Choi, Byungjin, et al.
Publicado: (2026)
Overview of the BioLaySumm 2024 Shared Task on the Lay Summarization of Biomedical Research Articles
por: Goldsack, Tomas, et al.
Publicado: (2024)
por: Goldsack, Tomas, et al.
Publicado: (2024)
MedHallBench: A New Benchmark for Assessing Hallucination in Medical Large Language Models
por: Zuo, Kaiwen, et al.
Publicado: (2024)
por: Zuo, Kaiwen, et al.
Publicado: (2024)
OmniV-Med: Scaling Medical Vision-Language Model for Universal Visual Understanding
por: Jiang, Songtao, et al.
Publicado: (2025)
por: Jiang, Songtao, et al.
Publicado: (2025)
ControlMed: Adding Reasoning Control to Medical Language Model
por: Lee, Sung-Min, et al.
Publicado: (2025)
por: Lee, Sung-Min, et al.
Publicado: (2025)
MedBench-IT: A Comprehensive Benchmark for Evaluating Large Language Models on Italian Medical Entrance Examinations
por: Lazzaroni, Ruggero Marino, et al.
Publicado: (2025)
por: Lazzaroni, Ruggero Marino, et al.
Publicado: (2025)
Med-RewardBench: Benchmarking Reward Models and Judges for Medical Multimodal Large Language Models
por: Ding, Meidan, et al.
Publicado: (2025)
por: Ding, Meidan, et al.
Publicado: (2025)
RAG-RLRC-LaySum at BioLaySumm: Integrating Retrieval-Augmented Generation and Readability Control for Layman Summarization of Biomedical Texts
por: Ji, Yuelyu, et al.
Publicado: (2024)
por: Ji, Yuelyu, et al.
Publicado: (2024)
MedCalc-Bench: Evaluating Large Language Models for Medical Calculations
por: Khandekar, Nikhil, et al.
Publicado: (2024)
por: Khandekar, Nikhil, et al.
Publicado: (2024)
MedBench: A Comprehensive, Standardized, and Reliable Benchmarking System for Evaluating Chinese Medical Large Language Models
por: Liu, Mianxin, et al.
Publicado: (2024)
por: Liu, Mianxin, et al.
Publicado: (2024)
ReLay: Personalized LLM-Generated Plain-Language Summaries for Better Understanding, but at What Cost?
por: Chan, Joey, et al.
Publicado: (2026)
por: Chan, Joey, et al.
Publicado: (2026)
TemMed-Bench: Evaluating Temporal Medical Image Reasoning in Vision-Language Models
por: Zhang, Junyi, et al.
Publicado: (2025)
por: Zhang, Junyi, et al.
Publicado: (2025)
Doc-PP: Document Policy Preservation Benchmark for Large Vision-Language Models
por: Jang, Haeun, et al.
Publicado: (2026)
por: Jang, Haeun, et al.
Publicado: (2026)
ATLAS: Improving Lay Summarisation with Attribute-based Control
por: Zhang, Zhihao, et al.
Publicado: (2024)
por: Zhang, Zhihao, et al.
Publicado: (2024)
MedErrBench: A Fine-Grained Multilingual Benchmark for Medical Error Detection and Correction with Clinical Expert Annotations
por: Ma, Congbo, et al.
Publicado: (2026)
por: Ma, Congbo, et al.
Publicado: (2026)
SciReasoner: Laying the Scientific Reasoning Ground Across Disciplines
por: Wang, Yizhou, et al.
Publicado: (2025)
por: Wang, Yizhou, et al.
Publicado: (2025)
MedPriv-Bench: Benchmarking the Privacy-Utility Trade-off of Large Language Models in Medical Open-End Question Answering
por: Guan, Shaowei, et al.
Publicado: (2026)
por: Guan, Shaowei, et al.
Publicado: (2026)
README: Bridging Medical Jargon and Lay Understanding for Patient Education through Data-Centric NLP
por: Yao, Zonghai, et al.
Publicado: (2023)
por: Yao, Zonghai, et al.
Publicado: (2023)
Med-MoE: Mixture of Domain-Specific Experts for Lightweight Medical Vision-Language Models
por: Jiang, Songtao, et al.
Publicado: (2024)
por: Jiang, Songtao, et al.
Publicado: (2024)
KoDialogBench: Evaluating Conversational Understanding of Language Models with Korean Dialogue Benchmark
por: Jang, Seongbo, et al.
Publicado: (2024)
por: Jang, Seongbo, et al.
Publicado: (2024)
MedBench v4: A Robust and Scalable Benchmark for Evaluating Chinese Medical Language Models, Multimodal Models, and Intelligent Agents
por: Ding, Jinru, et al.
Publicado: (2025)
por: Ding, Jinru, et al.
Publicado: (2025)
AlignBench: Benchmarking Chinese Alignment of Large Language Models
por: Liu, Xiao, et al.
Publicado: (2023)
por: Liu, Xiao, et al.
Publicado: (2023)
MedAgentsBench: Benchmarking Thinking Models and Agent Frameworks for Complex Medical Reasoning
por: Tang, Xiangru, et al.
Publicado: (2025)
por: Tang, Xiangru, et al.
Publicado: (2025)
MedExpQA: Multilingual Benchmarking of Large Language Models for Medical Question Answering
por: Alonso, Iñigo, et al.
Publicado: (2024)
por: Alonso, Iñigo, et al.
Publicado: (2024)
Ejemplares similares
-
Segmentation-before-Staining Improves Structural Fidelity in Virtual IHC-to-Multiplex IF Translation
por: Lee, Junhyeok, et al.
Publicado: (2026) -
MPIB: A Benchmark for Medical Prompt Injection Attacks and Clinical Safety in LLMs
por: Lee, Junhyeok, et al.
Publicado: (2026) -
SciZoom: A Large-scale Benchmark for Hierarchical Scientific Summarization across the LLM Era
por: Jang, Han, et al.
Publicado: (2026) -
Hierarchical Perfusion Graphs for Tumor Heterogeneity Modeling in Glioma Molecular Subtyping
por: Jang, Han, et al.
Publicado: (2026) -
Routing Sensitivity Without Controllability: A Diagnostic Study of Fairness in MoE Language Models
por: Lee, Junhyeok, et al.
Publicado: (2026)