Large Language Models as Biomedical Hypothesis Generators: A Comprehensive Evaluation
Fuente:
arXiv
Guardado en:
| Autores principales: | Qi, Biqing, Zhang, Kaiyan, Tian, Kai, Li, Haoxiang, Chen, Zhang-Ren, Zeng, Sihang, Hua, Ermo, Jinfang, Hu, Zhou, Bowen |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
CoGenesis: A Framework Collaborating Large and Small Language Models for Secure Context-Aware Instruction Following
por: Zhang, Kaiyan, et al.
Publicado: (2024)
por: Zhang, Kaiyan, et al.
Publicado: (2024)
Fast and Slow Generating: An Empirical Study on Large and Small Language Models Collaborative Decoding
por: Zhang, Kaiyan, et al.
Publicado: (2024)
por: Zhang, Kaiyan, et al.
Publicado: (2024)
Intuitive Fine-Tuning: Towards Simplifying Alignment into a Single Process
por: Hua, Ermo, et al.
Publicado: (2024)
por: Hua, Ermo, et al.
Publicado: (2024)
Retrieval-Augmented Visual Question Answering via Built-in Autoregressive Search Engines
por: Long, Xinwei, et al.
Publicado: (2025)
por: Long, Xinwei, et al.
Publicado: (2025)
UltraMedical: Building Specialized Generalists in Biomedicine
por: Zhang, Kaiyan, et al.
Publicado: (2024)
por: Zhang, Kaiyan, et al.
Publicado: (2024)
Towards Building Specialized Generalist AI with System 1 and System 2 Fusion
por: Zhang, Kaiyan, et al.
Publicado: (2024)
por: Zhang, Kaiyan, et al.
Publicado: (2024)
Scalable Efficient Training of Large Language Models with Low-dimensional Projected Attention
por: Lv, Xingtai, et al.
Publicado: (2024)
por: Lv, Xingtai, et al.
Publicado: (2024)
Fourier Position Embedding: Enhancing Attention's Periodic Extension for Length Generalization
por: Hua, Ermo, et al.
Publicado: (2024)
por: Hua, Ermo, et al.
Publicado: (2024)
PaD: Program-aided Distillation Can Teach Small Models Reasoning Better than Chain-of-thought Fine-tuning
por: Zhu, Xuekai, et al.
Publicado: (2023)
por: Zhu, Xuekai, et al.
Publicado: (2023)
ReviewRL: Towards Automated Scientific Review with RL
por: Zeng, Sihang, et al.
Publicado: (2025)
por: Zeng, Sihang, et al.
Publicado: (2025)
Generative Multi-Modal Knowledge Retrieval with Large Language Models
por: Long, Xinwei, et al.
Publicado: (2024)
por: Long, Xinwei, et al.
Publicado: (2024)
Online DPO: Online Direct Preference Optimization with Fast-Slow Chasing
por: Qi, Biqing, et al.
Publicado: (2024)
por: Qi, Biqing, et al.
Publicado: (2024)
Quantized Large Language Models in Biomedical Natural Language Processing: Evaluation and Recommendation
por: Zhan, Zaifu, et al.
Publicado: (2025)
por: Zhan, Zaifu, et al.
Publicado: (2025)
Retrieval Augmented Generation Evaluation in the Era of Large Language Models: A Comprehensive Survey
por: Gan, Aoran, et al.
Publicado: (2025)
por: Gan, Aoran, et al.
Publicado: (2025)
Learning Evaluation Models from Large Language Models for Sequence Generation
por: Wang, Chenglong, et al.
Publicado: (2023)
por: Wang, Chenglong, et al.
Publicado: (2023)
GenPRM: Scaling Test-Time Compute of Process Reward Models via Generative Reasoning
por: Zhao, Jian, et al.
Publicado: (2025)
por: Zhao, Jian, et al.
Publicado: (2025)
Can 1B LLM Surpass 405B LLM? Rethinking Compute-Optimal Test-Time Scaling
por: Liu, Runze, et al.
Publicado: (2025)
por: Liu, Runze, et al.
Publicado: (2025)
How to Synthesize Text Data without Model Collapse?
por: Zhu, Xuekai, et al.
Publicado: (2024)
por: Zhu, Xuekai, et al.
Publicado: (2024)
MARS$^2$: Scaling Multi-Agent Tree Search via Reinforcement Learning for Code Generation
por: Li, Pengfei, et al.
Publicado: (2026)
por: Li, Pengfei, et al.
Publicado: (2026)
BioVerge: A Comprehensive Benchmark and Study of Self-Evaluating Agents for Biomedical Hypothesis Generation
por: Yang, Fuyi, et al.
Publicado: (2025)
por: Yang, Fuyi, et al.
Publicado: (2025)
TTRL: Test-Time Reinforcement Learning
por: Zuo, Yuxin, et al.
Publicado: (2025)
por: Zuo, Yuxin, et al.
Publicado: (2025)
Explainable Biomedical Hypothesis Generation via Retrieval Augmented Generation enabled Large Language Models
por: Pelletier, Alexander R., et al.
Publicado: (2024)
por: Pelletier, Alexander R., et al.
Publicado: (2024)
MedXpertQA: Benchmarking Expert-Level Medical Reasoning and Understanding
por: Zuo, Yuxin, et al.
Publicado: (2025)
por: Zuo, Yuxin, et al.
Publicado: (2025)
Technologies on Effectiveness and Efficiency: A Survey of State Spaces Models
por: Lv, Xingtai, et al.
Publicado: (2025)
por: Lv, Xingtai, et al.
Publicado: (2025)
On Large Language Models' Hallucination with Regard to Known Facts
por: Jiang, Che, et al.
Publicado: (2024)
por: Jiang, Che, et al.
Publicado: (2024)
Self Speculative Decoding for Diffusion Large Language Models
por: Gao, Yifeng, et al.
Publicado: (2025)
por: Gao, Yifeng, et al.
Publicado: (2025)
DARE: Diffusion Large Language Models Alignment and Reinforcement Executor
por: Yang, Jingyi, et al.
Publicado: (2026)
por: Yang, Jingyi, et al.
Publicado: (2026)
DePass: Unified Feature Attributing by Simple Decomposed Forward Pass
por: Hong, Xiangyu, et al.
Publicado: (2025)
por: Hong, Xiangyu, et al.
Publicado: (2025)
Hypothesis Generation with Large Language Models
por: Zhou, Yangqiaoyu, et al.
Publicado: (2024)
por: Zhou, Yangqiaoyu, et al.
Publicado: (2024)
Accelerating Diffusion Large Language Models with SlowFast Sampling: The Three Golden Principles
por: Wei, Qingyan, et al.
Publicado: (2025)
por: Wei, Qingyan, et al.
Publicado: (2025)
A Comprehensive Evaluation of Large Language Models on Benchmark Biomedical Text Processing Tasks
por: Jahan, Israt, et al.
Publicado: (2023)
por: Jahan, Israt, et al.
Publicado: (2023)
Strengthening Programming Comprehension in Large Language Models through Code Generation
por: Ren, Xiaoning, et al.
Publicado: (2025)
por: Ren, Xiaoning, et al.
Publicado: (2025)
Toward Reliable Scientific Hypothesis Generation: Evaluating Truthfulness and Hallucination in Large Language Models
por: Xiong, Guangzhi, et al.
Publicado: (2025)
por: Xiong, Guangzhi, et al.
Publicado: (2025)
A Comprehensive Evaluation of Large Language Models on Aspect-Based Sentiment Analysis
por: Zhou, Changzhi, et al.
Publicado: (2024)
por: Zhou, Changzhi, et al.
Publicado: (2024)
ValueBench: Towards Comprehensively Evaluating Value Orientations and Understanding of Large Language Models
por: Ren, Yuanyi, et al.
Publicado: (2024)
por: Ren, Yuanyi, et al.
Publicado: (2024)
A Survey of Reinforcement Learning for Large Reasoning Models
por: Zhang, Kaiyan, et al.
Publicado: (2025)
por: Zhang, Kaiyan, et al.
Publicado: (2025)
Distilling Reasoning Ability from Large Language Models with Adaptive Thinking
por: Chen, Xiaoshu, et al.
Publicado: (2024)
por: Chen, Xiaoshu, et al.
Publicado: (2024)
BioTool: A Comprehensive Tool-Calling Dataset for Enhancing Biomedical Capabilities of Large Language Models
por: Gao, Xin, et al.
Publicado: (2026)
por: Gao, Xin, et al.
Publicado: (2026)
Mind's Mirror: Distilling Self-Evaluation Capability and Comprehensive Thinking from Large Language Models
por: Liu, Weize, et al.
Publicado: (2023)
por: Liu, Weize, et al.
Publicado: (2023)
BioPulse-QA: A Dynamic Biomedical Question-Answering Benchmark for Evaluating Factuality, Robustness, and Bias in Large Language Models
por: Bhattarai, Kriti, et al.
Publicado: (2026)
por: Bhattarai, Kriti, et al.
Publicado: (2026)
Ejemplares similares
-
CoGenesis: A Framework Collaborating Large and Small Language Models for Secure Context-Aware Instruction Following
por: Zhang, Kaiyan, et al.
Publicado: (2024) -
Fast and Slow Generating: An Empirical Study on Large and Small Language Models Collaborative Decoding
por: Zhang, Kaiyan, et al.
Publicado: (2024) -
Intuitive Fine-Tuning: Towards Simplifying Alignment into a Single Process
por: Hua, Ermo, et al.
Publicado: (2024) -
Retrieval-Augmented Visual Question Answering via Built-in Autoregressive Search Engines
por: Long, Xinwei, et al.
Publicado: (2025) -
UltraMedical: Building Specialized Generalists in Biomedicine
por: Zhang, Kaiyan, et al.
Publicado: (2024)