Detecting Reference Errors in Scientific Literature with Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Tianmai M., Abernethy, Neil F. |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Reviewing Scientific Papers for Critical Problems With Reasoning LLMs: Baseline Approaches and Automatic Evaluation
par: Zhang, Tianmai M., et autres
Publié: (2025)
par: Zhang, Tianmai M., et autres
Publié: (2025)
UW-BioNLP at ChemoTimelines 2025: Thinking, Fine-Tuning, and Dictionary-Enhanced LLM Systems for Chemotherapy Timeline Extraction
par: Zhang, Tianmai M., et autres
Publié: (2025)
par: Zhang, Tianmai M., et autres
Publié: (2025)
Instruct Large Language Models to Generate Scientific Literature Survey Step by Step
par: Lai, Yuxuan, et autres
Publié: (2024)
par: Lai, Yuxuan, et autres
Publié: (2024)
SciGPT: A Large Language Model for Scientific Literature Understanding and Knowledge Discovery
par: She, Fengyu, et autres
Publié: (2025)
par: She, Fengyu, et autres
Publié: (2025)
Can Large Language Models Detect Errors in Long Chain-of-Thought Reasoning?
par: He, Yancheng, et autres
Publié: (2025)
par: He, Yancheng, et autres
Publié: (2025)
Validation of the Scientific Literature via Chemputation Augmented by Large Language Models
par: Pagel, Sebastian, et autres
Publié: (2024)
par: Pagel, Sebastian, et autres
Publié: (2024)
ErrorRadar: Benchmarking Complex Mathematical Reasoning of Multimodal Large Language Models Via Error Detection
par: Yan, Yibo, et autres
Publié: (2024)
par: Yan, Yibo, et autres
Publié: (2024)
GAPMAP: Mapping Scientific Knowledge Gaps in Biomedical Literature Using Large Language Models
par: Salem, Nourah M, et autres
Publié: (2025)
par: Salem, Nourah M, et autres
Publié: (2025)
Harnessing Large Language Models for Scientific Novelty Detection
par: Liu, Yan, et autres
Publié: (2025)
par: Liu, Yan, et autres
Publié: (2025)
A Comprehensive Survey of Scientific Large Language Models and Their Applications in Scientific Discovery
par: Zhang, Yu, et autres
Publié: (2024)
par: Zhang, Yu, et autres
Publié: (2024)
ArxivDIGESTables: Synthesizing Scientific Literature into Tables using Language Models
par: Newman, Benjamin, et autres
Publié: (2024)
par: Newman, Benjamin, et autres
Publié: (2024)
SciDaSynth: Interactive Structured Data Extraction from Scientific Literature with Large Language Model
par: Wang, Xingbo, et autres
Publié: (2024)
par: Wang, Xingbo, et autres
Publié: (2024)
The Human Factor in Detecting Errors of Large Language Models: A Systematic Literature Review and Future Research Directions
par: Schiller, Christian A.
Publié: (2024)
par: Schiller, Christian A.
Publié: (2024)
Reference-free Hallucination Detection for Large Vision-Language Models
par: Li, Qing, et autres
Publié: (2024)
par: Li, Qing, et autres
Publié: (2024)
ByteScience: Bridging Unstructured Scientific Literature and Structured Data with Auto Fine-tuned Large Language Model in Token Granularity
par: Xie, Tong, et autres
Publié: (2024)
par: Xie, Tong, et autres
Publié: (2024)
Generative Large Language Models Trained for Detecting Errors in Radiology Reports
par: Sun, Cong, et autres
Publié: (2025)
par: Sun, Cong, et autres
Publié: (2025)
On Learning to Summarize with Large Language Models as References
par: Liu, Yixin, et autres
Publié: (2023)
par: Liu, Yixin, et autres
Publié: (2023)
Scientific Large Language Models: A Survey on Biological & Chemical Domains
par: Zhang, Qiang, et autres
Publié: (2024)
par: Zhang, Qiang, et autres
Publié: (2024)
ArxEval: Evaluating Retrieval and Generation in Language Models for Scientific Literature
par: Sinha, Aarush, et autres
Publié: (2025)
par: Sinha, Aarush, et autres
Publié: (2025)
Large Language Models for Automated Literature Review: An Evaluation of Reference Generation, Abstract Writing, and Review Composition
par: Tang, Xuemei, et autres
Publié: (2024)
par: Tang, Xuemei, et autres
Publié: (2024)
Concurrent Linguistic Error Detection (CLED): a New Methodology for Error Detection in Large Language Models
par: Zhu, Jinhua, et autres
Publié: (2024)
par: Zhu, Jinhua, et autres
Publié: (2024)
ResearchAgent: Iterative Research Idea Generation over Scientific Literature with Large Language Models
par: Baek, Jinheon, et autres
Publié: (2024)
par: Baek, Jinheon, et autres
Publié: (2024)
Leveraging Large Language Models for Analyzing Blood Pressure Variations Across Biological Sex from Scientific Literature
par: Guo, Yuting, et autres
Publié: (2024)
par: Guo, Yuting, et autres
Publié: (2024)
Error Reflection Prompting: Can Large Language Models Successfully Understand Errors?
par: Li, Jason, et autres
Publié: (2025)
par: Li, Jason, et autres
Publié: (2025)
RECKON: Large-scale Reference-based Efficient Knowledge Evaluation for Large Language Model
par: Zhang, Lin, et autres
Publié: (2025)
par: Zhang, Lin, et autres
Publié: (2025)
Evaluating the Performance of Large Language Models in Scientific Claim Detection and Classification
par: Faruk, Tanjim Bin
Publié: (2024)
par: Faruk, Tanjim Bin
Publié: (2024)
ReFACT: A Benchmark for Scientific Confabulation Detection with Positional Error Annotations
par: Wang, Yindong, et autres
Publié: (2025)
par: Wang, Yindong, et autres
Publié: (2025)
Since the Scientific Literature Is Multilingual, Our Models Should Be Too
par: Ebrahimi, Abteen, et autres
Publié: (2024)
par: Ebrahimi, Abteen, et autres
Publié: (2024)
Can Large Language Models Detect Misinformation in Scientific News Reporting?
par: Cao, Yupeng, et autres
Publié: (2024)
par: Cao, Yupeng, et autres
Publié: (2024)
Scientific Computing with Large Language Models
par: Culver, Christopher, et autres
Publié: (2024)
par: Culver, Christopher, et autres
Publié: (2024)
MoRI: Learning Motivation-Grounded Reasoning for Scientific Ideation in Large Language Models
par: Gu, Chenyang, et autres
Publié: (2026)
par: Gu, Chenyang, et autres
Publié: (2026)
SMRC: Aligning Large Language Models with Student Reasoning for Mathematical Error Correction
par: Zeng, Biaojie, et autres
Publié: (2025)
par: Zeng, Biaojie, et autres
Publié: (2025)
SciCUEval: A Comprehensive Dataset for Evaluating Scientific Context Understanding in Large Language Models
par: Yu, Jing, et autres
Publié: (2025)
par: Yu, Jing, et autres
Publié: (2025)
Deep Learning Detection Method for Large Language Models-Generated Scientific Content
par: Alhijawi, Bushra, et autres
Publié: (2024)
par: Alhijawi, Bushra, et autres
Publié: (2024)
Analyzing Nobel Prize Literature with Large Language Models
par: Yang, Zhenyuan, et autres
Publié: (2024)
par: Yang, Zhenyuan, et autres
Publié: (2024)
Racing Thoughts: Explaining Contextualization Errors in Large Language Models
par: Lepori, Michael A., et autres
Publié: (2024)
par: Lepori, Michael A., et autres
Publié: (2024)
TurQUaz at CheckThat! 2025: Debating Large Language Models for Scientific Web Discourse Detection
par: Saraç, Tarık, et autres
Publié: (2025)
par: Saraç, Tarık, et autres
Publié: (2025)
Improving Data and Reward Design for Scientific Reasoning in Large Language Models
par: Chen, Zijie, et autres
Publié: (2026)
par: Chen, Zijie, et autres
Publié: (2026)
Generative Linguistics, Large Language Models, and the Social Nature of Scientific Success
par: Hao, Sophie
Publié: (2025)
par: Hao, Sophie
Publié: (2025)
SciKnowEval: Evaluating Multi-level Scientific Knowledge of Large Language Models
par: Feng, Kehua, et autres
Publié: (2024)
par: Feng, Kehua, et autres
Publié: (2024)
Documents similaires
-
Reviewing Scientific Papers for Critical Problems With Reasoning LLMs: Baseline Approaches and Automatic Evaluation
par: Zhang, Tianmai M., et autres
Publié: (2025) -
UW-BioNLP at ChemoTimelines 2025: Thinking, Fine-Tuning, and Dictionary-Enhanced LLM Systems for Chemotherapy Timeline Extraction
par: Zhang, Tianmai M., et autres
Publié: (2025) -
Instruct Large Language Models to Generate Scientific Literature Survey Step by Step
par: Lai, Yuxuan, et autres
Publié: (2024) -
SciGPT: A Large Language Model for Scientific Literature Understanding and Knowledge Discovery
par: She, Fengyu, et autres
Publié: (2025) -
Can Large Language Models Detect Errors in Long Chain-of-Thought Reasoning?
par: He, Yancheng, et autres
Publié: (2025)