M-Eval: A Heterogeneity-Based Framework for Multi-evidence Validation in Medical RAG Systems
Fuente:
arXiv
Guardado en:
| Autores principales: | Sun, Mengzhou, Zhao, Sendong, Chen, Jianyu, Wang, Haochun, Qin, Bin |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
META-RAG: Meta-Analysis-Inspired Evidence-Re-Ranking Method for Retrieval-Augmented Generation in Evidence-Based Medicine
por: Sun, Mengzhou, et al.
Publicado: (2025)
por: Sun, Mengzhou, et al.
Publicado: (2025)
PICOs-RAG: PICO-supported Query Rewriting for Retrieval-Augmented Generation in Evidence-Based Medicine
por: Sun, Mengzhou, et al.
Publicado: (2025)
por: Sun, Mengzhou, et al.
Publicado: (2025)
ArcAligner: Adaptive Recursive Aligner for Compressed Context Embeddings in RAG
por: Li, Jianbo, et al.
Publicado: (2026)
por: Li, Jianbo, et al.
Publicado: (2026)
From Artificially Real to Real: Leveraging Pseudo Data from Large Language Models for Low-Resource Molecule Discovery
por: Chen, Yuhan, et al.
Publicado: (2023)
por: Chen, Yuhan, et al.
Publicado: (2023)
Beyond Direct Diagnosis: LLM-based Multi-Specialist Agent Consultation for Automatic Diagnosis
por: Wang, Haochun, et al.
Publicado: (2024)
por: Wang, Haochun, et al.
Publicado: (2024)
Uncovering the Role of Initial Saliency in U-Shaped Attention Bias: Scaling Initial Token Weight for Enhanced Long-Text Processing
por: Qiang, Zewen, et al.
Publicado: (2025)
por: Qiang, Zewen, et al.
Publicado: (2025)
AS-ES Learning: Towards Efficient CoT Learning in Small Models
por: Xi, Nuwa, et al.
Publicado: (2024)
por: Xi, Nuwa, et al.
Publicado: (2024)
MolTailor: Tailoring Chemical Molecular Representation to Specific Tasks via Text Prompts
por: Guo, Haoqiang, et al.
Publicado: (2024)
por: Guo, Haoqiang, et al.
Publicado: (2024)
LLMs May Perform MCQA by Selecting the Least Incorrect Option
por: Wang, Haochun, et al.
Publicado: (2024)
por: Wang, Haochun, et al.
Publicado: (2024)
CoCoA: Collaborative Chain-of-Agents for Parametric-Retrieved Knowledge Synergy
por: Jiang, Yi, et al.
Publicado: (2025)
por: Jiang, Yi, et al.
Publicado: (2025)
Manifold-based Verbalizer Space Re-embedding for Tuning-free Prompt-based Classification
por: Wang, Haochun, et al.
Publicado: (2023)
por: Wang, Haochun, et al.
Publicado: (2023)
Easier to Judge than to Find: Predicting In-Context Learning Success for Demonstration Selection
por: Wang, Haochun, et al.
Publicado: (2026)
por: Wang, Haochun, et al.
Publicado: (2026)
Knowledge-tuning Large Language Models with Structured Medical Knowledge Bases for Reliable Response Generation in Chinese
por: Wang, Haochun, et al.
Publicado: (2023)
por: Wang, Haochun, et al.
Publicado: (2023)
When Correct Beliefs Collapse: Epistemic Resilience of LLMs under Clinical Pressure
por: Xiao, Boyu, et al.
Publicado: (2026)
por: Xiao, Boyu, et al.
Publicado: (2026)
HeteroRAG: A Heterogeneous Retrieval-Augmented Generation Framework for Medical Vision Language Tasks
por: Chen, Zhe, et al.
Publicado: (2025)
por: Chen, Zhe, et al.
Publicado: (2025)
From Latent Signals to Reflection Behavior: Tracing Meta-Cognitive Activation Trajectory in R1-Style LLMs
por: Du, Yanrui, et al.
Publicado: (2026)
por: Du, Yanrui, et al.
Publicado: (2026)
Don't Ignore Dual Logic Ability of LLMs while Privatizing: A Data-Intensive Analysis in Medical Domain
por: Du, Yanrui, et al.
Publicado: (2023)
por: Du, Yanrui, et al.
Publicado: (2023)
Beyond Frameworks: Unpacking Collaboration Strategies in Multi-Agent Systems
por: Wang, Haochun, et al.
Publicado: (2025)
por: Wang, Haochun, et al.
Publicado: (2025)
Analyzing the Inherent Response Tendency of LLMs: Real-World Instructions-Driven Jailbreak
por: Du, Yanrui, et al.
Publicado: (2023)
por: Du, Yanrui, et al.
Publicado: (2023)
GainRAG: Preference Alignment in Retrieval-Augmented Generation through Gain Signal Synthesis
por: Jiang, Yi, et al.
Publicado: (2025)
por: Jiang, Yi, et al.
Publicado: (2025)
MoGU: A Framework for Enhancing Safety of Open-Sourced LLMs While Preserving Their Usability
por: Du, Yanrui, et al.
Publicado: (2024)
por: Du, Yanrui, et al.
Publicado: (2024)
The Multi-Round Diagnostic RAG Framework for Emulating Clinical Reasoning
por: Sun, Penglei, et al.
Publicado: (2025)
por: Sun, Penglei, et al.
Publicado: (2025)
OmniEval: An Omnidirectional and Automatic RAG Evaluation Benchmark in Financial Domain
por: Wang, Shuting, et al.
Publicado: (2024)
por: Wang, Shuting, et al.
Publicado: (2024)
SEMA-RAG: A Self-Evolving Multi-Agent Retrieval-Augmented Generation Framework for Medical Reasoning
por: Huang, Yongfeng, et al.
Publicado: (2026)
por: Huang, Yongfeng, et al.
Publicado: (2026)
AILS-NTUA at SemEval-2026 Task 8: Evaluating Multi-Turn RAG Conversations
por: Athanasiou, Dimosthenis, et al.
Publicado: (2026)
por: Athanasiou, Dimosthenis, et al.
Publicado: (2026)
MedPlan: A Two-Stage RAG-Based System for Personalized Medical Plan Generation
por: Hsu, Hsin-Ling, et al.
Publicado: (2025)
por: Hsu, Hsin-Ling, et al.
Publicado: (2025)
TableRAG: A Retrieval Augmented Generation Framework for Heterogeneous Document Reasoning
por: Yu, Xiaohan, et al.
Publicado: (2025)
por: Yu, Xiaohan, et al.
Publicado: (2025)
ER-RAG: Enhance RAG with ER-Based Unified Modeling of Heterogeneous Data Sources
por: Xia, Yikuan, et al.
Publicado: (2025)
por: Xia, Yikuan, et al.
Publicado: (2025)
H-RAG at SemEval-2026 Task 8: Hierarchical Parent-Child Retrieval for Multi-Turn RAG Conversations
por: Elchafei, Passant, et al.
Publicado: (2026)
por: Elchafei, Passant, et al.
Publicado: (2026)
MoGU V2: Toward a Higher Pareto Frontier Between Model Usability and Security
por: Du, Yanrui, et al.
Publicado: (2025)
por: Du, Yanrui, et al.
Publicado: (2025)
SciEval: A Multi-Level Large Language Model Evaluation Benchmark for Scientific Research
por: Sun, Liangtai, et al.
Publicado: (2023)
por: Sun, Liangtai, et al.
Publicado: (2023)
MMed-RAG: Versatile Multimodal RAG System for Medical Vision Language Models
por: Xia, Peng, et al.
Publicado: (2024)
por: Xia, Peng, et al.
Publicado: (2024)
Inter-Passage Verification for Multi-evidence Multi-answer QA
por: Chen, Bingsen, et al.
Publicado: (2025)
por: Chen, Bingsen, et al.
Publicado: (2025)
Knowledge-Graph Based RAG System Evaluation Framework
por: Dong, Sicheng, et al.
Publicado: (2025)
por: Dong, Sicheng, et al.
Publicado: (2025)
TemPrompt: Multi-Task Prompt Learning for Temporal Relation Extraction in RAG-based Crowdsourcing Systems
por: Yang, Jing, et al.
Publicado: (2024)
por: Yang, Jing, et al.
Publicado: (2024)
LingYi: Medical Conversational Question Answering System based on Multi-modal Knowledge Graphs
por: Xia, Fei, et al.
Publicado: (2022)
por: Xia, Fei, et al.
Publicado: (2022)
MultifacetEval: Multifaceted Evaluation to Probe LLMs in Mastering Medical Knowledge
por: Zhou, Yuxuan, et al.
Publicado: (2024)
por: Zhou, Yuxuan, et al.
Publicado: (2024)
A Single Character can Make or Break Your LLM Evals
por: Su, Jingtong, et al.
Publicado: (2025)
por: Su, Jingtong, et al.
Publicado: (2025)
A RAG-Based Multi-Agent LLM System for Natural Hazard Resilience and Adaptation
por: Xie, Yangxinyu, et al.
Publicado: (2025)
por: Xie, Yangxinyu, et al.
Publicado: (2025)
Modular RAG: Transforming RAG Systems into LEGO-like Reconfigurable Frameworks
por: Gao, Yunfan, et al.
Publicado: (2024)
por: Gao, Yunfan, et al.
Publicado: (2024)
Ejemplares similares
-
META-RAG: Meta-Analysis-Inspired Evidence-Re-Ranking Method for Retrieval-Augmented Generation in Evidence-Based Medicine
por: Sun, Mengzhou, et al.
Publicado: (2025) -
PICOs-RAG: PICO-supported Query Rewriting for Retrieval-Augmented Generation in Evidence-Based Medicine
por: Sun, Mengzhou, et al.
Publicado: (2025) -
ArcAligner: Adaptive Recursive Aligner for Compressed Context Embeddings in RAG
por: Li, Jianbo, et al.
Publicado: (2026) -
From Artificially Real to Real: Leveraging Pseudo Data from Large Language Models for Low-Resource Molecule Discovery
por: Chen, Yuhan, et al.
Publicado: (2023) -
Beyond Direct Diagnosis: LLM-based Multi-Specialist Agent Consultation for Automatic Diagnosis
por: Wang, Haochun, et al.
Publicado: (2024)