GenRES: Rethinking Evaluation for Generative Relation Extraction in the Era of Large Language Models
Fuente:
arXiv
Saved in:
| Main Authors: | Jiang, Pengcheng, Lin, Jiacheng, Wang, Zifeng, Sun, Jimeng, Han, Jiawei |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
s3: You Don't Need That Much Data to Train a Search Agent via RL
by: Jiang, Pengcheng, et al.
Published: (2025)
by: Jiang, Pengcheng, et al.
Published: (2025)
MindMap: Knowledge Graph Prompting Sparks Graph of Thoughts in Large Language Models
by: Wen, Yilin, et al.
Published: (2023)
by: Wen, Yilin, et al.
Published: (2023)
Panacea: A foundation model for clinical trial search, summarization, design, and recruitment
by: Lin, Jiacheng, et al.
Published: (2024)
by: Lin, Jiacheng, et al.
Published: (2024)
Developing Large Language Models for Clinical Research Using One Million Clinical Trials
by: Wang, Zifeng, et al.
Published: (2025)
by: Wang, Zifeng, et al.
Published: (2025)
TTM-RE: Memory-Augmented Document-Level Relation Extraction
by: Gao, Chufan, et al.
Published: (2024)
by: Gao, Chufan, et al.
Published: (2024)
BioDSA-1K: Benchmarking Data Science Agents for Biomedical Research
by: Wang, Zifeng, et al.
Published: (2025)
by: Wang, Zifeng, et al.
Published: (2025)
Can Large Language Models Replace Data Scientists in Biomedical Research?
by: Wang, Zifeng, et al.
Published: (2024)
by: Wang, Zifeng, et al.
Published: (2024)
From Symbolic to Natural-Language Relations: Rethinking Knowledge Graph Construction in the Era of Large Language Models
by: Han, Kanyao, et al.
Published: (2026)
by: Han, Kanyao, et al.
Published: (2026)
TriSum: Learning Summarization Ability from Large Language Models with Structured Rationale
by: Jiang, Pengcheng, et al.
Published: (2024)
by: Jiang, Pengcheng, et al.
Published: (2024)
TaSR-RAG: Taxonomy-guided Structured Reasoning for Retrieval-Augmented Generation
by: Sun, Jiashuo, et al.
Published: (2026)
by: Sun, Jiashuo, et al.
Published: (2026)
Contextualized Sequence Likelihood: Enhanced Confidence Scores for Natural Language Generation
by: Lin, Zhen, et al.
Published: (2024)
by: Lin, Zhen, et al.
Published: (2024)
Matching Patients to Clinical Trials with Large Language Models
by: Jin, Qiao, et al.
Published: (2023)
by: Jin, Qiao, et al.
Published: (2023)
Rethinking Interpretability in the Era of Large Language Models
by: Singh, Chandan, et al.
Published: (2024)
by: Singh, Chandan, et al.
Published: (2024)
AutoRD: An Automatic and End-to-End System for Rare Disease Knowledge Graph Construction Based on Ontologies-enhanced Large Language Models
by: Cao, Lang, et al.
Published: (2024)
by: Cao, Lang, et al.
Published: (2024)
Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses
by: Jiang, Pengcheng, et al.
Published: (2026)
by: Jiang, Pengcheng, et al.
Published: (2026)
OCR or Not? Rethinking Document Information Extraction in the MLLMs Era with Real-World Large-Scale Datasets
by: Shen, Jiyuan, et al.
Published: (2026)
by: Shen, Jiyuan, et al.
Published: (2026)
DynamicRAG: Leveraging Outputs of Large Language Model as Feedback for Dynamic Reranking in Retrieval-Augmented Generation
by: Sun, Jiashuo, et al.
Published: (2025)
by: Sun, Jiashuo, et al.
Published: (2025)
Seeking Neural Nuggets: Knowledge Transfer in Large Language Models from a Parametric Perspective
by: Zhong, Ming, et al.
Published: (2023)
by: Zhong, Ming, et al.
Published: (2023)
Rethinking the Reranker: Boundary-Aware Evidence Selection for Robust Retrieval-Augmented Generation
by: Sun, Jiashuo, et al.
Published: (2026)
by: Sun, Jiashuo, et al.
Published: (2026)
Beyond Label Attention: Transparency in Language Models for Automated Medical Coding via Dictionary Learning
by: Wu, John, et al.
Published: (2024)
by: Wu, John, et al.
Published: (2024)
Relation Extraction with Fine-Tuned Large Language Models in Retrieval Augmented Generation Frameworks
by: Efeoglu, Sefika, et al.
Published: (2024)
by: Efeoglu, Sefika, et al.
Published: (2024)
Are Large Language Models Really Good Logical Reasoners? A Comprehensive Evaluation and Beyond
by: Xu, Fangzhi, et al.
Published: (2023)
by: Xu, Fangzhi, et al.
Published: (2023)
Empirical Analysis of Dialogue Relation Extraction with Large Language Models
by: Li, Guozheng, et al.
Published: (2024)
by: Li, Guozheng, et al.
Published: (2024)
ConSiDERS-The-Human Evaluation Framework: Rethinking Human Evaluation for Generative Large Language Models
by: Elangovan, Aparna, et al.
Published: (2024)
by: Elangovan, Aparna, et al.
Published: (2024)
AbGen: Evaluating Large Language Models in Ablation Study Design and Evaluation for Scientific Research
by: Zhao, Yilun, et al.
Published: (2025)
by: Zhao, Yilun, et al.
Published: (2025)
Model Tuning or Prompt Tuning? A Study of Large Language Models for Clinical Concept and Relation Extraction
by: Peng, Cheng, et al.
Published: (2023)
by: Peng, Cheng, et al.
Published: (2023)
AutoRE: Document-Level Relation Extraction with Large Language Models
by: Xue, Lilong, et al.
Published: (2024)
by: Xue, Lilong, et al.
Published: (2024)
Preserving Knowledge Invariance: Rethinking Robustness Evaluation of Open Information Extraction
by: Qi, Ji, et al.
Published: (2023)
by: Qi, Ji, et al.
Published: (2023)
LoRA-Gen: Specializing Large Language Model via Online LoRA Generation
by: Xiao, Yicheng, et al.
Published: (2025)
by: Xiao, Yicheng, et al.
Published: (2025)
Rethinking Toxicity Evaluation in Large Language Models: A Multi-Label Perspective
by: Kou, Zhiqiang, et al.
Published: (2025)
by: Kou, Zhiqiang, et al.
Published: (2025)
SQL-PaLM: Improved Large Language Model Adaptation for Text-to-SQL (extended)
by: Sun, Ruoxi, et al.
Published: (2023)
by: Sun, Ruoxi, et al.
Published: (2023)
Steering When Necessary: Flexible Steering Large Language Models with Backtracking
by: Cheng, Zifeng, et al.
Published: (2025)
by: Cheng, Zifeng, et al.
Published: (2025)
A Large-Language Model Framework for Relative Timeline Extraction from PubMed Case Reports
by: Wang, Jing, et al.
Published: (2025)
by: Wang, Jing, et al.
Published: (2025)
Retrieval-Augmented Generation for Large Language Models: A Survey
by: Gao, Yunfan, et al.
Published: (2023)
by: Gao, Yunfan, et al.
Published: (2023)
SED: Self-Evaluation Decoding Enhances Large Language Models for Better Generation
by: Luo, Ziqin, et al.
Published: (2024)
by: Luo, Ziqin, et al.
Published: (2024)
A Perspective for Adapting Generalist AI to Specialized Medical AI Applications and Their Challenges
by: Wang, Zifeng, et al.
Published: (2024)
by: Wang, Zifeng, et al.
Published: (2024)
Meta-Cognitive Analysis: Evaluating Declarative and Procedural Knowledge in Datasets and Large Language Models
by: Li, Zhuoqun, et al.
Published: (2024)
by: Li, Zhuoqun, et al.
Published: (2024)
Document Intelligence in the Era of Large Language Models: A Survey
by: Wang, Weishi, et al.
Published: (2025)
by: Wang, Weishi, et al.
Published: (2025)
AgentGen: Enhancing Planning Abilities for Large Language Model based Agent via Environment and Task Generation
by: Hu, Mengkang, et al.
Published: (2024)
by: Hu, Mengkang, et al.
Published: (2024)
Rethinking Legal Judgement Prediction in a Realistic Scenario in the Era of Large Language Models
by: Nigam, Shubham Kumar, et al.
Published: (2024)
by: Nigam, Shubham Kumar, et al.
Published: (2024)
Similar Items
-
s3: You Don't Need That Much Data to Train a Search Agent via RL
by: Jiang, Pengcheng, et al.
Published: (2025) -
MindMap: Knowledge Graph Prompting Sparks Graph of Thoughts in Large Language Models
by: Wen, Yilin, et al.
Published: (2023) -
Panacea: A foundation model for clinical trial search, summarization, design, and recruitment
by: Lin, Jiacheng, et al.
Published: (2024) -
Developing Large Language Models for Clinical Research Using One Million Clinical Trials
by: Wang, Zifeng, et al.
Published: (2025) -
TTM-RE: Memory-Augmented Document-Level Relation Extraction
by: Gao, Chufan, et al.
Published: (2024)