Guardado en:
| Autores principales: | Kabongo, Salomon, D'Souza, Jennifer, Auer, Sören |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2407.02409 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Exploring the Latest LLMs for Leaderboard Extraction
por: Kabongo, Salomon, et al.
Publicado: (2024)
por: Kabongo, Salomon, et al.
Publicado: (2024)
Instruction Finetuning for Leaderboard Generation from Empirical AI Research
por: Kabongo, Salomon, et al.
Publicado: (2024)
por: Kabongo, Salomon, et al.
Publicado: (2024)
Large Language Models for Scientific Information Extraction: An Empirical Study for Virology
por: Shamsabadi, Mahsa, et al.
Publicado: (2024)
por: Shamsabadi, Mahsa, et al.
Publicado: (2024)
Large Language Models as Evaluators for Scientific Synthesis
por: Evans, Julia, et al.
Publicado: (2024)
por: Evans, Julia, et al.
Publicado: (2024)
LLMs4OL 2024 Overview: The 1st Large Language Models for Ontology Learning Challenge
por: Giglou, Hamed Babaei, et al.
Publicado: (2024)
por: Giglou, Hamed Babaei, et al.
Publicado: (2024)
LLMs4Synthesis: Leveraging Large Language Models for Scientific Synthesis
por: Giglou, Hamed Babaei, et al.
Publicado: (2024)
por: Giglou, Hamed Babaei, et al.
Publicado: (2024)
Fine-tuning and Prompt Engineering with Cognitive Knowledge Graphs for Scholarly Knowledge Organization
por: Rabby, Gollam, et al.
Publicado: (2024)
por: Rabby, Gollam, et al.
Publicado: (2024)
OntoAligner: A Comprehensive Modular and Robust Python Toolkit for Ontology Alignment
por: Giglou, Hamed Babaei, et al.
Publicado: (2025)
por: Giglou, Hamed Babaei, et al.
Publicado: (2025)
Diagnosing Structural Failures in LLM-Based Evidence Extraction for Meta-Analysis
por: Tan, Zhiyin, et al.
Publicado: (2026)
por: Tan, Zhiyin, et al.
Publicado: (2026)
A FAIR and Free Prompt-based Research Assistant
por: Shamsabadi, Mahsa, et al.
Publicado: (2024)
por: Shamsabadi, Mahsa, et al.
Publicado: (2024)
Scholarly Question Answering using Large Language Models in the NFDI4DataScience Gateway
por: Giglou, Hamed Babaei, et al.
Publicado: (2024)
por: Giglou, Hamed Babaei, et al.
Publicado: (2024)
The Leaderboard Illusion
por: Singh, Shivalika, et al.
Publicado: (2025)
por: Singh, Shivalika, et al.
Publicado: (2025)
YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering
por: D'Souza, Jennifer, et al.
Publicado: (2025)
por: D'Souza, Jennifer, et al.
Publicado: (2025)
Toward Purpose-oriented Topic Model Evaluation enabled by Large Language Models
por: Tan, Zhiyin, et al.
Publicado: (2025)
por: Tan, Zhiyin, et al.
Publicado: (2025)
Bridging the Evaluation Gap: Leveraging Large Language Models for Topic Model Evaluation
por: Tan, Zhiyin, et al.
Publicado: (2025)
por: Tan, Zhiyin, et al.
Publicado: (2025)
From Keywords to Structured Summaries: Streamlining Scholarly Information Access
por: Shamsabadi, Mahsa, et al.
Publicado: (2024)
por: Shamsabadi, Mahsa, et al.
Publicado: (2024)
Publishing FAIR and Machine-actionable Reviews in Materials Science: The Case for Symbolic Knowledge in Neuro-symbolic Artificial Intelligence
por: D'Souza, Jennifer, et al.
Publicado: (2026)
por: D'Souza, Jennifer, et al.
Publicado: (2026)
LLMs4SchemaDiscovery: A Human-in-the-Loop Workflow for Scientific Schema Mining with Large Language Models
por: Sadruddin, Sameer, et al.
Publicado: (2025)
por: Sadruddin, Sameer, et al.
Publicado: (2025)
Can We Locate and Prevent Stereotypes in LLMs?
por: D'Souza, Alex
Publicado: (2026)
por: D'Souza, Alex
Publicado: (2026)
Improving LLM Leaderboards with Psychometrical Methodology
por: Federiakin, Denis
Publicado: (2025)
por: Federiakin, Denis
Publicado: (2025)
Evaluating Large Language Models for Structured Science Summarization in the Open Research Knowledge Graph
por: Nechakhin, Vladyslav, et al.
Publicado: (2024)
por: Nechakhin, Vladyslav, et al.
Publicado: (2024)
Astro-NER -- Astronomy Named Entity Recognition: Is GPT a Good Domain Expert Annotator?
por: Evans, Julia, et al.
Publicado: (2024)
por: Evans, Julia, et al.
Publicado: (2024)
Iterative Hypothesis Generation for Scientific Discovery with Monte Carlo Nash Equilibrium Self-Refining Trees
por: Rabby, Gollam, et al.
Publicado: (2025)
por: Rabby, Gollam, et al.
Publicado: (2025)
LEGOBench: Scientific Leaderboard Generation Benchmark
por: Singh, Shruti, et al.
Publicado: (2024)
por: Singh, Shruti, et al.
Publicado: (2024)
League: Leaderboard Generation on Demand
por: Wu, Jian, et al.
Publicado: (2025)
por: Wu, Jian, et al.
Publicado: (2025)
SemEval-2025 Task 5: LLMs4Subjects -- LLM-based Automated Subject Tagging for a National Technical Library's Open-Access Catalog
por: D'Souza, Jennifer, et al.
Publicado: (2025)
por: D'Souza, Jennifer, et al.
Publicado: (2025)
Benchmarking LLM Faithfulness in RAG with Evolving Leaderboards
por: Tamber, Manveer Singh, et al.
Publicado: (2025)
por: Tamber, Manveer Singh, et al.
Publicado: (2025)
DeepResearch$^{\text{Eco}}$: A Recursive Agentic Workflow for Complex Scientific Question Answering in Ecology
por: D'Souza, Jennifer, et al.
Publicado: (2025)
por: D'Souza, Jennifer, et al.
Publicado: (2025)
Understanding LLM Development Through Longitudinal Study: Insights from the Open Ko-LLM Leaderboard
por: Park, Chanjun, et al.
Publicado: (2024)
por: Park, Chanjun, et al.
Publicado: (2024)
Prompt-to-Leaderboard
por: Frick, Evan, et al.
Publicado: (2025)
por: Frick, Evan, et al.
Publicado: (2025)
SCI-IDEA: Context-Aware Scientific Ideation Using Token and Sentence Embeddings
por: Keya, Farhana, et al.
Publicado: (2025)
por: Keya, Farhana, et al.
Publicado: (2025)
The Trust Paradox: How CS Researchers Engage LLM Leaderboards
por: Sadeghi, Pouya, et al.
Publicado: (2026)
por: Sadeghi, Pouya, et al.
Publicado: (2026)
Libra-Leaderboard: Towards Responsible AI through a Balanced Leaderboard of Safety and Capability
por: Li, Haonan, et al.
Publicado: (2024)
por: Li, Haonan, et al.
Publicado: (2024)
La Leaderboard: A Large Language Model Leaderboard for Spanish Varieties and Languages of Spain and Latin America
por: Grandury, María, et al.
Publicado: (2025)
por: Grandury, María, et al.
Publicado: (2025)
LLMs4OM: Matching Ontologies with Large Language Models
por: Giglou, Hamed Babaei, et al.
Publicado: (2024)
por: Giglou, Hamed Babaei, et al.
Publicado: (2024)
OntoAligner Meets Knowledge Graph Embedding Aligners
por: Giglou, Hamed Babaei, et al.
Publicado: (2025)
por: Giglou, Hamed Babaei, et al.
Publicado: (2025)
Open Universal Arabic ASR Leaderboard
por: Wang, Yingzhi, et al.
Publicado: (2024)
por: Wang, Yingzhi, et al.
Publicado: (2024)
Computational Fact-Checking of Online Discourse: Scoring scientific accuracy in climate change related news articles
por: Wittenborg, Tim, et al.
Publicado: (2025)
por: Wittenborg, Tim, et al.
Publicado: (2025)
Misconfidence-based Demonstration Selection for LLM In-Context Learning
por: Xu, Shangqing, et al.
Publicado: (2024)
por: Xu, Shangqing, et al.
Publicado: (2024)
A Position Paper on the Automatic Generation of Machine Learning Leaderboards
por: Timmer, Roelien C, et al.
Publicado: (2025)
por: Timmer, Roelien C, et al.
Publicado: (2025)
Ejemplares similares
-
Exploring the Latest LLMs for Leaderboard Extraction
por: Kabongo, Salomon, et al.
Publicado: (2024) -
Instruction Finetuning for Leaderboard Generation from Empirical AI Research
por: Kabongo, Salomon, et al.
Publicado: (2024) -
Large Language Models for Scientific Information Extraction: An Empirical Study for Virology
por: Shamsabadi, Mahsa, et al.
Publicado: (2024) -
Large Language Models as Evaluators for Scientific Synthesis
por: Evans, Julia, et al.
Publicado: (2024) -
LLMs4OL 2024 Overview: The 1st Large Language Models for Ontology Learning Challenge
por: Giglou, Hamed Babaei, et al.
Publicado: (2024)