Large Language Models as Evaluators for Scientific Synthesis
Fuente:
arXiv
Guardado en:
| Autores principales: | Evans, Julia, D'Souza, Jennifer, Auer, Sören |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Large Language Models for Scientific Information Extraction: An Empirical Study for Virology
por: Shamsabadi, Mahsa, et al.
Publicado: (2024)
por: Shamsabadi, Mahsa, et al.
Publicado: (2024)
LLMs4Synthesis: Leveraging Large Language Models for Scientific Synthesis
por: Giglou, Hamed Babaei, et al.
Publicado: (2024)
por: Giglou, Hamed Babaei, et al.
Publicado: (2024)
Evaluating Large Language Models for Structured Science Summarization in the Open Research Knowledge Graph
por: Nechakhin, Vladyslav, et al.
Publicado: (2024)
por: Nechakhin, Vladyslav, et al.
Publicado: (2024)
Astro-NER -- Astronomy Named Entity Recognition: Is GPT a Good Domain Expert Annotator?
por: Evans, Julia, et al.
Publicado: (2024)
por: Evans, Julia, et al.
Publicado: (2024)
LLMs4OL 2024 Overview: The 1st Large Language Models for Ontology Learning Challenge
por: Giglou, Hamed Babaei, et al.
Publicado: (2024)
por: Giglou, Hamed Babaei, et al.
Publicado: (2024)
Exploring the Latest LLMs for Leaderboard Extraction
por: Kabongo, Salomon, et al.
Publicado: (2024)
por: Kabongo, Salomon, et al.
Publicado: (2024)
Publishing FAIR and Machine-actionable Reviews in Materials Science: The Case for Symbolic Knowledge in Neuro-symbolic Artificial Intelligence
por: D'Souza, Jennifer, et al.
Publicado: (2026)
por: D'Souza, Jennifer, et al.
Publicado: (2026)
Bridging the Evaluation Gap: Leveraging Large Language Models for Topic Model Evaluation
por: Tan, Zhiyin, et al.
Publicado: (2025)
por: Tan, Zhiyin, et al.
Publicado: (2025)
OntoAligner: A Comprehensive Modular and Robust Python Toolkit for Ontology Alignment
por: Giglou, Hamed Babaei, et al.
Publicado: (2025)
por: Giglou, Hamed Babaei, et al.
Publicado: (2025)
Toward Purpose-oriented Topic Model Evaluation enabled by Large Language Models
por: Tan, Zhiyin, et al.
Publicado: (2025)
por: Tan, Zhiyin, et al.
Publicado: (2025)
Scholarly Question Answering using Large Language Models in the NFDI4DataScience Gateway
por: Giglou, Hamed Babaei, et al.
Publicado: (2024)
por: Giglou, Hamed Babaei, et al.
Publicado: (2024)
LLMs4SchemaDiscovery: A Human-in-the-Loop Workflow for Scientific Schema Mining with Large Language Models
por: Sadruddin, Sameer, et al.
Publicado: (2025)
por: Sadruddin, Sameer, et al.
Publicado: (2025)
From Keywords to Structured Summaries: Streamlining Scholarly Information Access
por: Shamsabadi, Mahsa, et al.
Publicado: (2024)
por: Shamsabadi, Mahsa, et al.
Publicado: (2024)
Empowering Meta-Analysis: Leveraging Large Language Models for Scientific Synthesis
por: Ahad, Jawad Ibn, et al.
Publicado: (2024)
por: Ahad, Jawad Ibn, et al.
Publicado: (2024)
Conversational Complexity for Assessing Risk in Large Language Models
por: Burden, John, et al.
Publicado: (2024)
por: Burden, John, et al.
Publicado: (2024)
Slaves to the Law of Large Numbers: An Asymptotic Equipartition Property for Perplexity in Generative Language Models
por: Bell, Tyler, et al.
Publicado: (2024)
por: Bell, Tyler, et al.
Publicado: (2024)
YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering
por: D'Souza, Jennifer, et al.
Publicado: (2025)
por: D'Souza, Jennifer, et al.
Publicado: (2025)
Diff-eRank: A Novel Rank-Based Metric for Evaluating Large Language Models
por: Wei, Lai, et al.
Publicado: (2024)
por: Wei, Lai, et al.
Publicado: (2024)
LLMs4OM: Matching Ontologies with Large Language Models
por: Giglou, Hamed Babaei, et al.
Publicado: (2024)
por: Giglou, Hamed Babaei, et al.
Publicado: (2024)
The Information of Large Language Model Geometry
por: Tan, Zhiquan, et al.
Publicado: (2024)
por: Tan, Zhiquan, et al.
Publicado: (2024)
Mining for Species, Locations, Habitats, and Ecosystems from Scientific Papers in Invasion Biology: A Large-Scale Exploratory Study with Large Language Models
por: D'Souza, Jennifer, et al.
Publicado: (2025)
por: D'Souza, Jennifer, et al.
Publicado: (2025)
Task-Centric Acceleration of Small-Language Models
por: Tsur, Dor, et al.
Publicado: (2026)
por: Tsur, Dor, et al.
Publicado: (2026)
Validation of the Scientific Literature via Chemputation Augmented by Large Language Models
por: Pagel, Sebastian, et al.
Publicado: (2024)
por: Pagel, Sebastian, et al.
Publicado: (2024)
A Survey on Large Language Models from Concept to Implementation
por: Wang, Chen, et al.
Publicado: (2024)
por: Wang, Chen, et al.
Publicado: (2024)
Think or Not? Exploring Thinking Efficiency in Large Reasoning Models via an Information-Theoretic Lens
por: Yong, Xixian, et al.
Publicado: (2025)
por: Yong, Xixian, et al.
Publicado: (2025)
A FAIR and Free Prompt-based Research Assistant
por: Shamsabadi, Mahsa, et al.
Publicado: (2024)
por: Shamsabadi, Mahsa, et al.
Publicado: (2024)
DeepResearch$^{\text{Eco}}$: A Recursive Agentic Workflow for Complex Scientific Question Answering in Ecology
por: D'Souza, Jennifer, et al.
Publicado: (2025)
por: D'Souza, Jennifer, et al.
Publicado: (2025)
NeuroSym-BioCAT: Leveraging Neuro-Symbolic Methods for Biomedical Scholarly Document Categorization and Question Answering
por: Zamil, Parvez, et al.
Publicado: (2024)
por: Zamil, Parvez, et al.
Publicado: (2024)
Can Large Language Models Detect Misinformation in Scientific News Reporting?
por: Cao, Yupeng, et al.
Publicado: (2024)
por: Cao, Yupeng, et al.
Publicado: (2024)
Generalized Measures of Anticipation and Responsivity in Online Language Processing
por: Giulianelli, Mario, et al.
Publicado: (2024)
por: Giulianelli, Mario, et al.
Publicado: (2024)
Effective Context Selection in LLM-based Leaderboard Generation: An Empirical Study
por: Kabongo, Salomon, et al.
Publicado: (2024)
por: Kabongo, Salomon, et al.
Publicado: (2024)
Language Modeling Is Compression
por: Delétang, Grégoire, et al.
Publicado: (2023)
por: Delétang, Grégoire, et al.
Publicado: (2023)
Evaluating the External and Parametric Knowledge Fusion of Large Language Models
por: Zhang, Hao, et al.
Publicado: (2024)
por: Zhang, Hao, et al.
Publicado: (2024)
Beyond Words: Evaluating Large Language Models in Transportation Planning
por: Ying, Shaowei, et al.
Publicado: (2024)
por: Ying, Shaowei, et al.
Publicado: (2024)
Efficient Evaluation of Large Language Models via Collaborative Filtering
por: Zhong, Xu-Xiang, et al.
Publicado: (2025)
por: Zhong, Xu-Xiang, et al.
Publicado: (2025)
Large Language Models Meet Knowledge Graphs for Question Answering: Synthesis and Opportunities
por: Ma, Chuangtao, et al.
Publicado: (2025)
por: Ma, Chuangtao, et al.
Publicado: (2025)
On the Reasoning Capacity of AI Models and How to Quantify It
por: Radha, Santosh Kumar, et al.
Publicado: (2025)
por: Radha, Santosh Kumar, et al.
Publicado: (2025)
Diagnosing Structural Failures in LLM-Based Evidence Extraction for Meta-Analysis
por: Tan, Zhiyin, et al.
Publicado: (2026)
por: Tan, Zhiyin, et al.
Publicado: (2026)
Can We Locate and Prevent Stereotypes in LLMs?
por: D'Souza, Alex
Publicado: (2026)
por: D'Souza, Alex
Publicado: (2026)
Evaluating Large Language Models as Generative User Simulators for Conversational Recommendation
por: Yoon, Se-eun, et al.
Publicado: (2024)
por: Yoon, Se-eun, et al.
Publicado: (2024)
Ejemplares similares
-
Large Language Models for Scientific Information Extraction: An Empirical Study for Virology
por: Shamsabadi, Mahsa, et al.
Publicado: (2024) -
LLMs4Synthesis: Leveraging Large Language Models for Scientific Synthesis
por: Giglou, Hamed Babaei, et al.
Publicado: (2024) -
Evaluating Large Language Models for Structured Science Summarization in the Open Research Knowledge Graph
por: Nechakhin, Vladyslav, et al.
Publicado: (2024) -
Astro-NER -- Astronomy Named Entity Recognition: Is GPT a Good Domain Expert Annotator?
por: Evans, Julia, et al.
Publicado: (2024) -
LLMs4OL 2024 Overview: The 1st Large Language Models for Ontology Learning Challenge
por: Giglou, Hamed Babaei, et al.
Publicado: (2024)