SeedBench: A Multi-task Benchmark for Evaluating Large Language Models in Seed Science
Fuente:
arXiv
Saved in:
| Main Authors: | Ying, Jie, Chen, Zihong, Wang, Zhefan, Jiang, Wanli, Wang, Chenyang, Yuan, Zhonghang, Su, Haoyang, Kong, Huanjun, Yang, Fan, Dong, Nanqing |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
GraphGen: Enhancing Supervised Fine-Tuning for LLMs with Knowledge-Driven Synthetic Data Generation
by: Chen, Zihong, et al.
Published: (2025)
by: Chen, Zihong, et al.
Published: (2025)
ROGRAG: A Robustly Optimized GraphRAG Framework
by: Wang, Zhefan, et al.
Published: (2025)
by: Wang, Zhefan, et al.
Published: (2025)
Knowledge-to-Verification: Exploring RLVR for LLMs in Knowledge-Intensive Domains
by: Yuan, Zhonghang, et al.
Published: (2026)
by: Yuan, Zhonghang, et al.
Published: (2026)
An Embarrassingly Simple Approach to Enhance Transformer Performance in Genomic Selection for Crop Breeding
by: Chen, Renqi, et al.
Published: (2024)
by: Chen, Renqi, et al.
Published: (2024)
Scalable Multi-Agent Reinforcement Learning for Residential Load Scheduling under Data Governance
by: Qin, Zhaoming, et al.
Published: (2021)
by: Qin, Zhaoming, et al.
Published: (2021)
ViroBench: Benchmarking Nucleotide Foundation Models on Viral Genomics Tasks
by: Ye, Dongxin, et al.
Published: (2026)
by: Ye, Dongxin, et al.
Published: (2026)
Towards Efficient and Intelligent Laser Weeding: Method and Dataset for Weed Stem Detection
by: Liu, Dingning, et al.
Published: (2025)
by: Liu, Dingning, et al.
Published: (2025)
CoCo-Bench: A Comprehensive Code Benchmark For Multi-task Large Language Model Evaluation
by: Yin, Wenjing, et al.
Published: (2025)
by: Yin, Wenjing, et al.
Published: (2025)
AI-Driven Automation Can Become the Foundation of Next-Era Science of Science Research
by: Chen, Renqi, et al.
Published: (2025)
by: Chen, Renqi, et al.
Published: (2025)
Moderate Seasonal Grazing During the Seed‐Set Stage Is Detrimental to Seed Rain and the Soil Seed Bank in an Alpine Meadow
by: Shu‐Lin Wang, et al.
Published: (2026)
by: Shu‐Lin Wang, et al.
Published: (2026)
Seed Science Research
Published: (2026)
Published: (2026)
Journal of Seed Science
Published: (2016)
Published: (2016)
Seed Science and Technology
Published: (2023)
Published: (2023)
Labeling supervised fine-tuning data with the scaling law
by: Kong, Huanjun
Published: (2024)
by: Kong, Huanjun
Published: (2024)
Application of Hyperspectral Imaging for Watermelon Seed Classification Using Deep Learning and Scoring Mechanism
by: Hengnian Qi, et al.
Published: (2024)
by: Hengnian Qi, et al.
Published: (2024)
Seed-Guided Topic Discovery with Out-of-Vocabulary Seeds
by: Zhang, Yu, et al.
Published: (2022)
by: Zhang, Yu, et al.
Published: (2022)
Science and technology. Seeds of discontent
Published: (1999)
Published: (1999)
Synergistic Effects of Uniconazole and 2, 4‐Epibrassinolide on Seed Productivity in High‐Density Rapeseed
by: Haicai Fu, et al.
Published: (2025)
by: Haicai Fu, et al.
Published: (2025)
Seed-to-Seed: Image Translation in Diffusion Seed Space
by: Greenberg, Or, et al.
Published: (2024)
by: Greenberg, Or, et al.
Published: (2024)
McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models
by: Lan, Tian, et al.
Published: (2025)
by: Lan, Tian, et al.
Published: (2025)
SeedVR: Seeding Infinity in Diffusion Transformer Towards Generic Video Restoration
by: Wang, Jianyi, et al.
Published: (2025)
by: Wang, Jianyi, et al.
Published: (2025)
MT-Bench-101: A Fine-Grained Benchmark for Evaluating Large Language Models in Multi-Turn Dialogues
by: Bai, Ge, et al.
Published: (2024)
by: Bai, Ge, et al.
Published: (2024)
SeedPrints: Fingerprints Can Even Tell Which Seed Your Large Language Model Was Trained From
by: Tong, Yao, et al.
Published: (2025)
by: Tong, Yao, et al.
Published: (2025)
Selecting Initial Seeds for Better JVM Fuzzing
by: Gao, Tianchang, et al.
Published: (2024)
by: Gao, Tianchang, et al.
Published: (2024)
SeedAIchemy: LLM-Driven Seed Corpus Generation for Fuzzing
by: Wen, Aidan, et al.
Published: (2025)
by: Wen, Aidan, et al.
Published: (2025)
Seed‐Source Precipitation Drives Drought Acclimatization of Reaumuria songarica : Implications for Seed Germination and Seedling Growth in the HeHuang Valley
by: XinYou Wang, et al.
Published: (2025)
by: XinYou Wang, et al.
Published: (2025)
VLBiasBench: A Comprehensive Benchmark for Evaluating Bias in Large Vision-Language Model
by: Wang, Sibo, et al.
Published: (2024)
by: Wang, Sibo, et al.
Published: (2024)
CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories
by: Xiao, Yijia, et al.
Published: (2025)
by: Xiao, Yijia, et al.
Published: (2025)
FinChart-Bench: Benchmarking Financial Chart Comprehension in Vision-Language Models
by: Shu, Dong, et al.
Published: (2025)
by: Shu, Dong, et al.
Published: (2025)
Ensemble Fuzzing with Dynamic Resource Scheduling and Multidimensional Seed Evaluation
by: Zhao, Yukai, et al.
Published: (2025)
by: Zhao, Yukai, et al.
Published: (2025)
PyBench: Evaluating LLM Agent on various real-world coding tasks
by: Zhang, Yaolun, et al.
Published: (2024)
by: Zhang, Yaolun, et al.
Published: (2024)
Seeds
Published: (2023)
Published: (2023)
Guiding Clinical Reasoning with Large Language Models via Knowledge Seeds
by: WU, Jiageng, et al.
Published: (2024)
by: WU, Jiageng, et al.
Published: (2024)
Evaluating the Impact of Seed‐Borne Mycoflora on Seed Quality and Health of Various Oryza sativa Varieties
by: Mohammad Waris Haider, et al.
Published: (2024)
by: Mohammad Waris Haider, et al.
Published: (2024)
DataSciBench: An LLM Agent Benchmark for Data Science
by: Zhang, Dan, et al.
Published: (2025)
by: Zhang, Dan, et al.
Published: (2025)
Towards Ancient Plant Seed Classification: A Benchmark Dataset and Baseline Model
by: Xing, Rui, et al.
Published: (2025)
by: Xing, Rui, et al.
Published: (2025)
PSQE: A Theoretical-Practical Approach to Pseudo Seed Quality Enhancement for Unsupervised Multimodal Entity Alignment
by: Hong, Yunpeng, et al.
Published: (2026)
by: Hong, Yunpeng, et al.
Published: (2026)
Multi-answer Constrained Optimal Querying: Maximum Information Gain Coding
by: Li, Zhefan, et al.
Published: (2024)
by: Li, Zhefan, et al.
Published: (2024)
Nearly-Linear Time Seeded Extractors with Short Seeds
by: Doron, Dean, et al.
Published: (2024)
by: Doron, Dean, et al.
Published: (2024)
Room‐Temperature Degradation of Lignin from Wasted Seed Coats for the Production of Pyrocatechol/Gallol Derivatives
by: Shihao Su, et al.
Published: (2026)
by: Shihao Su, et al.
Published: (2026)
Similar Items
-
GraphGen: Enhancing Supervised Fine-Tuning for LLMs with Knowledge-Driven Synthetic Data Generation
by: Chen, Zihong, et al.
Published: (2025) -
ROGRAG: A Robustly Optimized GraphRAG Framework
by: Wang, Zhefan, et al.
Published: (2025) -
Knowledge-to-Verification: Exploring RLVR for LLMs in Knowledge-Intensive Domains
by: Yuan, Zhonghang, et al.
Published: (2026) -
An Embarrassingly Simple Approach to Enhance Transformer Performance in Genomic Selection for Crop Breeding
by: Chen, Renqi, et al.
Published: (2024) -
Scalable Multi-Agent Reinforcement Learning for Residential Load Scheduling under Data Governance
by: Qin, Zhaoming, et al.
Published: (2021)