Standardizing Longitudinal Radiology Report Evaluation via Large Language Model Annotation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Xinyi, Figueredo, Grazziela, Li, Ruizhe, Chen, Xin |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
RadAnnotate: Large Language Models for Efficient and Reliable Radiology Report Annotation
par: Shetty, Saisha Pradeep, et autres
Publié: (2026)
par: Shetty, Saisha Pradeep, et autres
Publié: (2026)
Radiology-GPT: A Large Language Model for Radiology
par: Liu, Zhengliang, et autres
Publié: (2023)
par: Liu, Zhengliang, et autres
Publié: (2023)
Improving Radiology Report Conciseness and Structure via Local Large Language Models
par: Hartsock, Iryna, et autres
Publié: (2024)
par: Hartsock, Iryna, et autres
Publié: (2024)
Improving Automatic Summarization of Radiology Reports through Mid-Training of Large Language Models
par: Lyu, Mengxian, et autres
Publié: (2026)
par: Lyu, Mengxian, et autres
Publié: (2026)
Generative Large Language Models Trained for Detecting Errors in Radiology Reports
par: Sun, Cong, et autres
Publié: (2025)
par: Sun, Cong, et autres
Publié: (2025)
A Survey of Deep Learning-based Radiology Report Generation Using Multimodal Data
par: Wang, Xinyi, et autres
Publié: (2024)
par: Wang, Xinyi, et autres
Publié: (2024)
Automated Creativity Evaluation for Large Language Models: A Reference-Based Approach
par: Li, Ruizhe, et autres
Publié: (2025)
par: Li, Ruizhe, et autres
Publié: (2025)
Development and Validation of a Large Language Model for Generating Fully-Structured Radiology Reports
par: Niu, Chuang, et autres
Publié: (2024)
par: Niu, Chuang, et autres
Publié: (2024)
Persona-judge: Personalized Alignment of Large Language Models via Token-level Self-judgment
par: Zhang, Xiaotian, et autres
Publié: (2025)
par: Zhang, Xiaotian, et autres
Publié: (2025)
Large Language Model Bias Mitigation from the Perspective of Knowledge Editing
par: Chen, Ruizhe, et autres
Publié: (2024)
par: Chen, Ruizhe, et autres
Publié: (2024)
Leveraging Professional Radiologists' Expertise to Enhance LLMs' Evaluation for Radiology Reports
par: Zhu, Qingqing, et autres
Publié: (2024)
par: Zhu, Qingqing, et autres
Publié: (2024)
MRScore: Evaluating Radiology Report Generation with LLM-based Reward System
par: Liu, Yunyi, et autres
Publié: (2024)
par: Liu, Yunyi, et autres
Publié: (2024)
An Empirical Analysis on Large Language Models in Debate Evaluation
par: Liu, Xinyi, et autres
Publié: (2024)
par: Liu, Xinyi, et autres
Publié: (2024)
RadReason: Radiology Report Evaluation Metric with Reasons and Sub-Scores
par: Li, Yingshu, et autres
Publié: (2025)
par: Li, Yingshu, et autres
Publié: (2025)
KemenkeuGPT: Leveraging a Large Language Model on Indonesia's Government Financial Data and Regulations to Enhance Decision Making
par: Febrian, Gilang Fajar, et autres
Publié: (2024)
par: Febrian, Gilang Fajar, et autres
Publié: (2024)
GREEN: Generative Radiology Report Evaluation and Error Notation
par: Ostmeier, Sophie, et autres
Publié: (2024)
par: Ostmeier, Sophie, et autres
Publié: (2024)
VERT: Reliable LLM Judges for Radiology Report Evaluation
par: Bologna, Federica, et autres
Publié: (2026)
par: Bologna, Federica, et autres
Publié: (2026)
MedBench: A Comprehensive, Standardized, and Reliable Benchmarking System for Evaluating Chinese Medical Large Language Models
par: Liu, Mianxin, et autres
Publié: (2024)
par: Liu, Mianxin, et autres
Publié: (2024)
Agent-Based Uncertainty Awareness Improves Automated Radiology Report Labeling with an Open-Source Large Language Model
par: Ben-Atya, Hadas, et autres
Publié: (2025)
par: Ben-Atya, Hadas, et autres
Publié: (2025)
Entity Alignment with Noisy Annotations from Large Language Models
par: Chen, Shengyuan, et autres
Publié: (2024)
par: Chen, Shengyuan, et autres
Publié: (2024)
CLEAR: A Clinically-Grounded Tabular Framework for Radiology Report Evaluation
par: Jiang, Yuyang, et autres
Publié: (2025)
par: Jiang, Yuyang, et autres
Publié: (2025)
DLP-LoRA: Efficient Task-Specific LoRA Fusion with a Dynamic, Lightweight Plugin for Large Language Models
par: Zhang, Yuxuan, et autres
Publié: (2024)
par: Zhang, Yuxuan, et autres
Publié: (2024)
EvalCards: A Framework for Standardized Evaluation Reporting
par: Dhar, Ruchira, et autres
Publié: (2025)
par: Dhar, Ruchira, et autres
Publié: (2025)
Large Language Models Are Effective Human Annotation Assistants, But Not Good Independent Annotators
par: Gu, Feng, et autres
Publié: (2025)
par: Gu, Feng, et autres
Publié: (2025)
Multilingual Natural Language Processing Model for Radiology Reports -- The Summary is all you need!
par: Lindo, Mariana, et autres
Publié: (2023)
par: Lindo, Mariana, et autres
Publié: (2023)
ReFINE: A Reward-Based Framework for Interpretable and Nuanced Evaluation of Radiology Report Generation
par: Liu, Yunyi, et autres
Publié: (2024)
par: Liu, Yunyi, et autres
Publié: (2024)
ANAH: Analytical Annotation of Hallucinations in Large Language Models
par: Ji, Ziwei, et autres
Publié: (2024)
par: Ji, Ziwei, et autres
Publié: (2024)
Fake News Detection: Comparative Evaluation of BERT-like Models and Large Language Models with Generative AI-Annotated Data
par: Raza, Shaina, et autres
Publié: (2024)
par: Raza, Shaina, et autres
Publié: (2024)
MDIT-Bench: Evaluating the Dual-Implicit Toxicity in Large Multimodal Models
par: Jin, Bohan, et autres
Publié: (2025)
par: Jin, Bohan, et autres
Publié: (2025)
Talking to Yourself: Defying Forgetting in Large Language Models
par: Sun, Yutao, et autres
Publié: (2026)
par: Sun, Yutao, et autres
Publié: (2026)
OLMES: A Standard for Language Model Evaluations
par: Gu, Yuling, et autres
Publié: (2024)
par: Gu, Yuling, et autres
Publié: (2024)
Towards Coarse-to-Fine Evaluation of Inference Efficiency for Large Language Models
par: Chen, Yushuo, et autres
Publié: (2024)
par: Chen, Yushuo, et autres
Publié: (2024)
Exploring Multilingual Large Language Models for Enhanced TNM classification of Radiology Report in lung cancer staging
par: Matsuo, Hidetoshi, et autres
Publié: (2024)
par: Matsuo, Hidetoshi, et autres
Publié: (2024)
Summarizing Radiology Reports Findings into Impressions
par: de Padua, Raul Salles, et autres
Publié: (2024)
par: de Padua, Raul Salles, et autres
Publié: (2024)
Semantic Consistency-Based Uncertainty Quantification for Factuality in Radiology Report Generation
par: Wang, Chenyu, et autres
Publié: (2024)
par: Wang, Chenyu, et autres
Publié: (2024)
MGH Radiology Llama: A Llama 3 70B Model for Radiology
par: Shi, Yucheng, et autres
Publié: (2024)
par: Shi, Yucheng, et autres
Publié: (2024)
Evaluating Quantized Large Language Models
par: Li, Shiyao, et autres
Publié: (2024)
par: Li, Shiyao, et autres
Publié: (2024)
BiasFreeBench: a Benchmark for Mitigating Bias in Large Language Model Responses
par: Xu, Xin, et autres
Publié: (2025)
par: Xu, Xin, et autres
Publié: (2025)
ANAH-v2: Scaling Analytical Hallucination Annotation of Large Language Models
par: Gu, Yuzhe, et autres
Publié: (2024)
par: Gu, Yuzhe, et autres
Publié: (2024)
Using Large Language Models to Understand Telecom Standards
par: Karapantelakis, Athanasios, et autres
Publié: (2024)
par: Karapantelakis, Athanasios, et autres
Publié: (2024)
Documents similaires
-
RadAnnotate: Large Language Models for Efficient and Reliable Radiology Report Annotation
par: Shetty, Saisha Pradeep, et autres
Publié: (2026) -
Radiology-GPT: A Large Language Model for Radiology
par: Liu, Zhengliang, et autres
Publié: (2023) -
Improving Radiology Report Conciseness and Structure via Local Large Language Models
par: Hartsock, Iryna, et autres
Publié: (2024) -
Improving Automatic Summarization of Radiology Reports through Mid-Training of Large Language Models
par: Lyu, Mengxian, et autres
Publié: (2026) -
Generative Large Language Models Trained for Detecting Errors in Radiology Reports
par: Sun, Cong, et autres
Publié: (2025)