SciImpact: A Multi-Dimensional, Multi-Field Benchmark for Scientific Impact Prediction
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhu, Hangxiao, Zhang, Yuyu, Nie, Ping, Zhang, Yu |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
SciMMIR: Benchmarking Scientific Multi-modal Information Retrieval
por: Wu, Siwei, et al.
Publicado: (2024)
por: Wu, Siwei, et al.
Publicado: (2024)
SciAgentGym: Benchmarking Multi-Step Scientific Tool-use in LLM Agents
por: Shen, Yujiong, et al.
Publicado: (2026)
por: Shen, Yujiong, et al.
Publicado: (2026)
SciEvent: Benchmarking Multi-domain Scientific Event Extraction
por: Dong, Bofu, et al.
Publicado: (2025)
por: Dong, Bofu, et al.
Publicado: (2025)
SciEval: A Multi-Level Large Language Model Evaluation Benchmark for Scientific Research
por: Sun, Liangtai, et al.
Publicado: (2023)
por: Sun, Liangtai, et al.
Publicado: (2023)
Beyond Single-shot Writing: Deep Research Agents are Unreliable at Multi-turn Report Revision
por: Chen, Bingsen, et al.
Publicado: (2026)
por: Chen, Bingsen, et al.
Publicado: (2026)
SciToolAgent: A Knowledge Graph-Driven Scientific Agent for Multi-Tool Integration
por: Ding, Keyan, et al.
Publicado: (2025)
por: Ding, Keyan, et al.
Publicado: (2025)
M3SciQA: A Multi-Modal Multi-Document Scientific QA Benchmark for Evaluating Foundation Models
por: Li, Chuhan, et al.
Publicado: (2024)
por: Li, Chuhan, et al.
Publicado: (2024)
SciKnowEval: Evaluating Multi-level Scientific Knowledge of Large Language Models
por: Feng, Kehua, et al.
Publicado: (2024)
por: Feng, Kehua, et al.
Publicado: (2024)
SciAssess: Benchmarking LLM Proficiency in Scientific Literature Analysis
por: Cai, Hengxing, et al.
Publicado: (2024)
por: Cai, Hengxing, et al.
Publicado: (2024)
SciAgent: A Unified Multi-Agent System for Generalistic Scientific Reasoning
por: Li, Xuchen, et al.
Publicado: (2025)
por: Li, Xuchen, et al.
Publicado: (2025)
MEBench: Benchmarking Large Language Models for Cross-Document Multi-Entity Question Answering
por: Lin, Teng, et al.
Publicado: (2025)
por: Lin, Teng, et al.
Publicado: (2025)
SciNLP: A Domain-Specific Benchmark for Full-Text Scientific Entity and Relation Extraction in NLP
por: Duan, Decheng, et al.
Publicado: (2025)
por: Duan, Decheng, et al.
Publicado: (2025)
SKT5SciSumm -- Revisiting Extractive-Generative Approach for Multi-Document Scientific Summarization
por: To, Huy Quoc, et al.
Publicado: (2024)
por: To, Huy Quoc, et al.
Publicado: (2024)
SciVerse: Unveiling the Knowledge Comprehension and Visual Reasoning of LMMs on Multi-modal Scientific Problems
por: Guo, Ziyu, et al.
Publicado: (2025)
por: Guo, Ziyu, et al.
Publicado: (2025)
The Effect of Gender Diversity on Scientific Team Impact: A Team Roles Perspective
por: Zhao, Yi, et al.
Publicado: (2025)
por: Zhao, Yi, et al.
Publicado: (2025)
SciCUEval: A Comprehensive Dataset for Evaluating Scientific Context Understanding in Large Language Models
por: Yu, Jing, et al.
Publicado: (2025)
por: Yu, Jing, et al.
Publicado: (2025)
SciRerankBench: Benchmarking Rerankers Towards Scientific Retrieval-Augmented Generated LLMs
por: Chen, Haotian, et al.
Publicado: (2025)
por: Chen, Haotian, et al.
Publicado: (2025)
SciZoom: A Large-scale Benchmark for Hierarchical Scientific Summarization across the LLM Era
por: Jang, Han, et al.
Publicado: (2026)
por: Jang, Han, et al.
Publicado: (2026)
SciDA: Scientific Dynamic Assessor of LLMs
por: Zhou, Junting, et al.
Publicado: (2025)
por: Zhou, Junting, et al.
Publicado: (2025)
Accelerating Scientific Discovery with Multi-Document Summarization of Impact-Ranked Papers
por: Koloveas, Paris, et al.
Publicado: (2025)
por: Koloveas, Paris, et al.
Publicado: (2025)
SciTopic: Enhancing Topic Discovery in Scientific Literature through Advanced LLM
por: Li, Pengjiang, et al.
Publicado: (2025)
por: Li, Pengjiang, et al.
Publicado: (2025)
A User-Centric Multi-Intent Benchmark for Evaluating Large Language Models
por: Wang, Jiayin, et al.
Publicado: (2024)
por: Wang, Jiayin, et al.
Publicado: (2024)
SciCustom: A Framework for Custom Evaluation of Scientific Capabilities in Large Language Models
por: Gu, Yiyang, et al.
Publicado: (2026)
por: Gu, Yiyang, et al.
Publicado: (2026)
MultiFileTest: A Multi-File-Level LLM Unit Test Generation Benchmark and Impact of Error Fixing Mechanisms
por: Wang, Yibo, et al.
Publicado: (2025)
por: Wang, Yibo, et al.
Publicado: (2025)
From Text to Trust: Empowering AI-assisted Decision Making with Adaptive LLM-powered Analysis
por: Li, Zhuoyan, et al.
Publicado: (2025)
por: Li, Zhuoyan, et al.
Publicado: (2025)
SciPaths: Forecasting Pathways to Scientific Discovery
por: Chamoun, Eric, et al.
Publicado: (2026)
por: Chamoun, Eric, et al.
Publicado: (2026)
SciTaRC: Benchmarking QA on Scientific Tabular Data that Requires Language Reasoning and Complex Computation
por: Wang, Hexuan, et al.
Publicado: (2026)
por: Wang, Hexuan, et al.
Publicado: (2026)
PRISM: A Multi-Dimensional Benchmark for Evaluating LLM Peer Reviewers
por: Loc, Ngoc Phan Phuoc, et al.
Publicado: (2026)
por: Loc, Ngoc Phan Phuoc, et al.
Publicado: (2026)
SciPrompt: Knowledge-augmented Prompting for Fine-grained Categorization of Scientific Topics
por: You, Zhiwen, et al.
Publicado: (2024)
por: You, Zhiwen, et al.
Publicado: (2024)
SciNets: Graph-Constrained Multi-Hop Reasoning for Scientific Literature Synthesis
por: Dubey, Sauhard
Publicado: (2025)
por: Dubey, Sauhard
Publicado: (2025)
SciDoc2Diagrammer-MAF: Towards Generation of Scientific Diagrams from Documents guided by Multi-Aspect Feedback Refinement
por: Mondal, Ishani, et al.
Publicado: (2024)
por: Mondal, Ishani, et al.
Publicado: (2024)
Automated Safety Benchmarking: A Multi-agent Pipeline for LVLMs
por: Zhu, Xiangyang, et al.
Publicado: (2026)
por: Zhu, Xiangyang, et al.
Publicado: (2026)
SciSafeEval: A Comprehensive Benchmark for Safety Alignment of Large Language Models in Scientific Tasks
por: Li, Tianhao, et al.
Publicado: (2024)
por: Li, Tianhao, et al.
Publicado: (2024)
BIOME-Bench: A Benchmark for Biomolecular Interaction Inference and Multi-Omics Pathway Mechanism Elucidation from Scientific Literature
por: Wei, Sibo, et al.
Publicado: (2025)
por: Wei, Sibo, et al.
Publicado: (2025)
SciAtlas: A Large-Scale Knowledge Graph for Automated Scientific Research
por: Qiao, Shuofei, et al.
Publicado: (2026)
por: Qiao, Shuofei, et al.
Publicado: (2026)
SciReasoner: Laying the Scientific Reasoning Ground Across Disciplines
por: Wang, Yizhou, et al.
Publicado: (2025)
por: Wang, Yizhou, et al.
Publicado: (2025)
Dialogue-Based Multi-Dimensional Relationship Extraction from Novels
por: Yan, Yuchen, et al.
Publicado: (2025)
por: Yan, Yuchen, et al.
Publicado: (2025)
MuSciClaims: Multimodal Scientific Claim Verification
por: Lal, Yash Kumar, et al.
Publicado: (2025)
por: Lal, Yash Kumar, et al.
Publicado: (2025)
SRAG: Structured Retrieval-Augmented Generation for Multi-Entity Question Answering over Wikipedia Graph
por: Lin, Teng, et al.
Publicado: (2025)
por: Lin, Teng, et al.
Publicado: (2025)
TurnBench-MS: A Benchmark for Evaluating Multi-Turn, Multi-Step Reasoning in Large Language Models
por: Zhang, Yiran, et al.
Publicado: (2025)
por: Zhang, Yiran, et al.
Publicado: (2025)
Ejemplares similares
-
SciMMIR: Benchmarking Scientific Multi-modal Information Retrieval
por: Wu, Siwei, et al.
Publicado: (2024) -
SciAgentGym: Benchmarking Multi-Step Scientific Tool-use in LLM Agents
por: Shen, Yujiong, et al.
Publicado: (2026) -
SciEvent: Benchmarking Multi-domain Scientific Event Extraction
por: Dong, Bofu, et al.
Publicado: (2025) -
SciEval: A Multi-Level Large Language Model Evaluation Benchmark for Scientific Research
por: Sun, Liangtai, et al.
Publicado: (2023) -
Beyond Single-shot Writing: Deep Research Agents are Unreliable at Multi-turn Report Revision
por: Chen, Bingsen, et al.
Publicado: (2026)