Benchmarking Retrieval-Augmented Large Language Models in Biomedical NLP: Application, Robustness, and Self-Awareness
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Li, Mingchen, Zhan, Zaifu, Yang, Han, Xiao, Yongkang, Huang, Jiatan, Zhang, Rui |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
RAMIE: Retrieval-Augmented Multi-task Information Extraction with Large Language Models on Dietary Supplements
von: Zhan, Zaifu, et al.
Veröffentlicht: (2024)
von: Zhan, Zaifu, et al.
Veröffentlicht: (2024)
MMRAG: Multi-Mode Retrieval-Augmented Generation with Large Language Models for Biomedical In-Context Learning
von: Zhan, Zaifu, et al.
Veröffentlicht: (2025)
von: Zhan, Zaifu, et al.
Veröffentlicht: (2025)
In-Context Optimization for Retrieval-Augmented Generation: A Gradient-Descent Perspective
von: Li, Mingchen, et al.
Veröffentlicht: (2026)
von: Li, Mingchen, et al.
Veröffentlicht: (2026)
Can Large Language Models Self-Correct in Medical Question Answering? An Exploratory Study
von: Zhan, Zaifu, et al.
Veröffentlicht: (2026)
von: Zhan, Zaifu, et al.
Veröffentlicht: (2026)
Towards Better Multi-task Learning: A Framework for Optimizing Dataset Combinations in Large Language Models
von: Zhan, Zaifu, et al.
Veröffentlicht: (2024)
von: Zhan, Zaifu, et al.
Veröffentlicht: (2024)
Efficient and Effective Internal Memory Retrieval for LLM-Based Healthcare Prediction
von: Li, Mingchen, et al.
Veröffentlicht: (2026)
von: Li, Mingchen, et al.
Veröffentlicht: (2026)
RiTeK: A Dataset for Large Language Models Complex Reasoning over Textual Knowledge Graphs in Medicine
von: Huang, Jiatan, et al.
Veröffentlicht: (2024)
von: Huang, Jiatan, et al.
Veröffentlicht: (2024)
BiomedRAG: A Retrieval Augmented Large Language Model for Biomedicine
von: Li, Mingchen, et al.
Veröffentlicht: (2024)
von: Li, Mingchen, et al.
Veröffentlicht: (2024)
CancerLLM: A Large Language Model in Cancer Domain
von: Li, Mingchen, et al.
Veröffentlicht: (2024)
von: Li, Mingchen, et al.
Veröffentlicht: (2024)
Benchingmaking Large Langage Models in Biomedical Triple Extraction
von: Li, Mingchen, et al.
Veröffentlicht: (2023)
von: Li, Mingchen, et al.
Veröffentlicht: (2023)
GLEN-Bench: A Graph-Language based Benchmark for Nutritional Health
von: Huang, Jiatan, et al.
Veröffentlicht: (2026)
von: Huang, Jiatan, et al.
Veröffentlicht: (2026)
Quantized Large Language Models in Biomedical Natural Language Processing: Evaluation and Recommendation
von: Zhan, Zaifu, et al.
Veröffentlicht: (2025)
von: Zhan, Zaifu, et al.
Veröffentlicht: (2025)
An evaluation of DeepSeek Models in Biomedical Natural Language Processing
von: Zhan, Zaifu, et al.
Veröffentlicht: (2025)
von: Zhan, Zaifu, et al.
Veröffentlicht: (2025)
RICE-PO: Turning Retrieval Interactions into Credit Signals for Reasoning Agents
von: Li, Mingchen, et al.
Veröffentlicht: (2026)
von: Li, Mingchen, et al.
Veröffentlicht: (2026)
Data-Efficient Biomedical In-Context Learning: A Diversity-Enhanced Submodular Perspective
von: Wang, Jun, et al.
Veröffentlicht: (2025)
von: Wang, Jun, et al.
Veröffentlicht: (2025)
DrKGC: Dynamic Subgraph Retrieval-Augmented LLMs for Knowledge Graph Completion across General and Biomedical Domains
von: Xiao, Yongkang, et al.
Veröffentlicht: (2025)
von: Xiao, Yongkang, et al.
Veröffentlicht: (2025)
Counterfactual Graph for Multi-Agent LLM Calibration
von: Huang, Jiatan, et al.
Veröffentlicht: (2026)
von: Huang, Jiatan, et al.
Veröffentlicht: (2026)
How far is Language Model from 100% Few-shot Named Entity Recognition in Medical Domain
von: Li, Mingchen, et al.
Veröffentlicht: (2023)
von: Li, Mingchen, et al.
Veröffentlicht: (2023)
An Underexplored Frontier: Large Language Models for Rare Disease Patient Education and Communication -- A scoping review
von: Zhan, Zaifu, et al.
Veröffentlicht: (2026)
von: Zhan, Zaifu, et al.
Veröffentlicht: (2026)
A Condensed Transition Graph Framework for Zero-shot Link Prediction with Large Language Models
von: Li, Mingchen, et al.
Veröffentlicht: (2024)
von: Li, Mingchen, et al.
Veröffentlicht: (2024)
EpiScreen: Early Epilepsy Detection from Electronic Health Records with Large Language Models
von: Zhou, Shuang, et al.
Veröffentlicht: (2026)
von: Zhou, Shuang, et al.
Veröffentlicht: (2026)
Uncertainty-Aware Large Language Models for Explainable Disease Diagnosis
von: Zhou, Shuang, et al.
Veröffentlicht: (2025)
von: Zhou, Shuang, et al.
Veröffentlicht: (2025)
Equipping Retrieval-Augmented Large Language Models with Document Structure Awareness
von: Xu, Lingnan, et al.
Veröffentlicht: (2025)
von: Xu, Lingnan, et al.
Veröffentlicht: (2025)
Benchmarking GPT-5 for biomedical natural language processing
von: Hou, Yu, et al.
Veröffentlicht: (2025)
von: Hou, Yu, et al.
Veröffentlicht: (2025)
TP-RAG: Benchmarking Retrieval-Augmented Large Language Model Agents for Spatiotemporal-Aware Travel Planning
von: Ni, Hang, et al.
Veröffentlicht: (2025)
von: Ni, Hang, et al.
Veröffentlicht: (2025)
R4: Reinforced Retriever-Reorder-Responder for Retrieval-Augmented Large Language Models
von: Zhang, Taolin, et al.
Veröffentlicht: (2024)
von: Zhang, Taolin, et al.
Veröffentlicht: (2024)
NLP-ADBench: NLP Anomaly Detection Benchmark
von: Li, Yuangang, et al.
Veröffentlicht: (2024)
von: Li, Yuangang, et al.
Veröffentlicht: (2024)
SeRTS: Self-Rewarding Tree Search for Biomedical Retrieval-Augmented Generation
von: Hu, Minda, et al.
Veröffentlicht: (2024)
von: Hu, Minda, et al.
Veröffentlicht: (2024)
Explainable Biomedical Hypothesis Generation via Retrieval Augmented Generation enabled Large Language Models
von: Pelletier, Alexander R., et al.
Veröffentlicht: (2024)
von: Pelletier, Alexander R., et al.
Veröffentlicht: (2024)
CASE-Bench: Context-Aware SafEty Benchmark for Large Language Models
von: Sun, Guangzhi, et al.
Veröffentlicht: (2025)
von: Sun, Guangzhi, et al.
Veröffentlicht: (2025)
JMedBench: A Benchmark for Evaluating Japanese Biomedical Large Language Models
von: Jiang, Junfeng, et al.
Veröffentlicht: (2024)
von: Jiang, Junfeng, et al.
Veröffentlicht: (2024)
Privacy-Aware Decoding: Mitigating Privacy Leakage of Large Language Models in Retrieval-Augmented Generation
von: Wang, Haoran, et al.
Veröffentlicht: (2025)
von: Wang, Haoran, et al.
Veröffentlicht: (2025)
Unraveling and Mitigating Retriever Inconsistencies in Retrieval-Augmented Large Language Models
von: Li, Mingda, et al.
Veröffentlicht: (2024)
von: Li, Mingda, et al.
Veröffentlicht: (2024)
RoRA-VLM: Robust Retrieval-Augmented Vision Language Models
von: Qi, Jingyuan, et al.
Veröffentlicht: (2024)
von: Qi, Jingyuan, et al.
Veröffentlicht: (2024)
Evaluating the Effectiveness of Cost-Efficient Large Language Models in Benchmark Biomedical Tasks
von: Jahan, Israt, et al.
Veröffentlicht: (2025)
von: Jahan, Israt, et al.
Veröffentlicht: (2025)
BURMESE-SAN: Burmese NLP Benchmark for Evaluating Large Language Models
von: Aung, Thura, et al.
Veröffentlicht: (2026)
von: Aung, Thura, et al.
Veröffentlicht: (2026)
Evaluating Self-Generated Documents for Enhancing Retrieval-Augmented Generation with Large Language Models
von: Li, Jiatao, et al.
Veröffentlicht: (2024)
von: Li, Jiatao, et al.
Veröffentlicht: (2024)
Auto-RAG: Autonomous Retrieval-Augmented Generation for Large Language Models
von: Yu, Tian, et al.
Veröffentlicht: (2024)
von: Yu, Tian, et al.
Veröffentlicht: (2024)
Improving Retrieval Augmented Language Model with Self-Reasoning
von: Xia, Yuan, et al.
Veröffentlicht: (2024)
von: Xia, Yuan, et al.
Veröffentlicht: (2024)
Evaluation of Attribution Bias in Generator-Aware Retrieval-Augmented Large Language Models
von: Abolghasemi, Amin, et al.
Veröffentlicht: (2024)
von: Abolghasemi, Amin, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
RAMIE: Retrieval-Augmented Multi-task Information Extraction with Large Language Models on Dietary Supplements
von: Zhan, Zaifu, et al.
Veröffentlicht: (2024) -
MMRAG: Multi-Mode Retrieval-Augmented Generation with Large Language Models for Biomedical In-Context Learning
von: Zhan, Zaifu, et al.
Veröffentlicht: (2025) -
In-Context Optimization for Retrieval-Augmented Generation: A Gradient-Descent Perspective
von: Li, Mingchen, et al.
Veröffentlicht: (2026) -
Can Large Language Models Self-Correct in Medical Question Answering? An Exploratory Study
von: Zhan, Zaifu, et al.
Veröffentlicht: (2026) -
Towards Better Multi-task Learning: A Framework for Optimizing Dataset Combinations in Large Language Models
von: Zhan, Zaifu, et al.
Veröffentlicht: (2024)