DrafterBench: Benchmarking Large Language Models for Tasks Automation in Civil Engineering
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Yinsheng, Dong, Zhen, Shao, Yi |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
IdeaBench: Benchmarking Large Language Models for Research Idea Generation
par: Guo, Sikun, et autres
Publié: (2024)
par: Guo, Sikun, et autres
Publié: (2024)
QuantBench: Benchmarking AI Methods for Quantitative Investment
par: Wang, Saizhuo, et autres
Publié: (2025)
par: Wang, Saizhuo, et autres
Publié: (2025)
ResearchBench: Benchmarking LLMs in Scientific Discovery via Inspiration-Based Task Decomposition
par: Liu, Yujie, et autres
Publié: (2025)
par: Liu, Yujie, et autres
Publié: (2025)
Automating Structural Engineering Workflows with Large Language Model Agents
par: Liang, Haoran, et autres
Publié: (2025)
par: Liang, Haoran, et autres
Publié: (2025)
INVESTORBENCH: A Benchmark for Financial Decision-Making Tasks with LLM-based Agent
par: Li, Haohang, et autres
Publié: (2024)
par: Li, Haohang, et autres
Publié: (2024)
Enterprise Benchmarks for Large Language Model Evaluation
par: Zhang, Bing, et autres
Publié: (2024)
par: Zhang, Bing, et autres
Publié: (2024)
Are LLMs Socially Adaptive? Contrasting Belief Evolution in Large Language Models and Humans
par: Lei, Yu, et autres
Publié: (2024)
par: Lei, Yu, et autres
Publié: (2024)
FinBen: A Holistic Financial Benchmark for Large Language Models
par: Xie, Qianqian, et autres
Publié: (2024)
par: Xie, Qianqian, et autres
Publié: (2024)
Opportunities for Large Language Models and Discourse in Engineering Design
par: Göpfert, Jan, et autres
Publié: (2023)
par: Göpfert, Jan, et autres
Publié: (2023)
FinAudio: A Benchmark for Audio Large Language Models in Financial Applications
par: Cao, Yupeng, et autres
Publié: (2025)
par: Cao, Yupeng, et autres
Publié: (2025)
When Life gives you LLMs, make LLM-ADE: Large Language Models with Adaptive Data Engineering
par: Choi, Stephen, et autres
Publié: (2024)
par: Choi, Stephen, et autres
Publié: (2024)
From Concept to Manufacturing: Evaluating Vision-Language Models for Engineering Design
par: Picard, Cyril, et autres
Publié: (2023)
par: Picard, Cyril, et autres
Publié: (2023)
CatMemo at the FinLLM Challenge Task: Fine-Tuning Large Language Models using Data Fusion in Financial Applications
par: Cao, Yupeng, et autres
Publié: (2024)
par: Cao, Yupeng, et autres
Publié: (2024)
ProtChatGPT: Towards Understanding Proteins with Large Language Models
par: Wang, Chao, et autres
Publié: (2024)
par: Wang, Chao, et autres
Publié: (2024)
MetaBench: A Multi-task Benchmark for Assessing LLMs in Metabolomics
par: Lu, Yuxing, et autres
Publié: (2025)
par: Lu, Yuxing, et autres
Publié: (2025)
Diffusion Large Language Models for Black-Box Optimization
par: Yuan, Ye, et autres
Publié: (2026)
par: Yuan, Ye, et autres
Publié: (2026)
Empirical Asset Pricing with Large Language Model Agents
par: Cheng, Junyan, et autres
Publié: (2024)
par: Cheng, Junyan, et autres
Publié: (2024)
BikeBench: A Bicycle Design Benchmark for Generative Models with Objectives and Constraints
par: Regenwetter, Lyle, et autres
Publié: (2025)
par: Regenwetter, Lyle, et autres
Publié: (2025)
Compressing Large Language Models with PCA Without Performance Loss
par: Bengtsson, Magnus
Publié: (2025)
par: Bengtsson, Magnus
Publié: (2025)
Diabetica: Adapting Large Language Model to Enhance Multiple Medical Tasks in Diabetes Care and Management
par: Wei, Lai, et autres
Publié: (2024)
par: Wei, Lai, et autres
Publié: (2024)
OceanGPT: A Large Language Model for Ocean Science Tasks
par: Bi, Zhen, et autres
Publié: (2023)
par: Bi, Zhen, et autres
Publié: (2023)
QuantMCP: Grounding Large Language Models in Verifiable Financial Reality
par: Zeng, Yifan
Publié: (2025)
par: Zeng, Yifan
Publié: (2025)
A Survey of Sustainability in Large Language Models: Applications, Economics, and Challenges
par: Singh, Aditi, et autres
Publié: (2024)
par: Singh, Aditi, et autres
Publié: (2024)
Assessing and Enhancing Large Language Models in Rare Disease Question-answering
par: Wang, Guanchu, et autres
Publié: (2024)
par: Wang, Guanchu, et autres
Publié: (2024)
PEAR: A Robust and Flexible Automation Framework for Ptychography Enabled by Multiple Large Language Model Agents
par: Yin, Xiangyu, et autres
Publié: (2024)
par: Yin, Xiangyu, et autres
Publié: (2024)
Assertion-Aware Test Code Summarization with Large Language Models
par: Mollah, Anamul Haque, et autres
Publié: (2025)
par: Mollah, Anamul Haque, et autres
Publié: (2025)
LiveTradeBench: Seeking Real-World Alpha with Large Language Models
par: Yu, Haofei, et autres
Publié: (2025)
par: Yu, Haofei, et autres
Publié: (2025)
Large Language Models as Optimization Controllers: Adaptive Continuation for SIMP Topology Optimization
par: Yang, Shaoliang, et autres
Publié: (2026)
par: Yang, Shaoliang, et autres
Publié: (2026)
Reinforcement Learning of Large Language Models for Interpretable Credit Card Fraud Detection
par: Lin, Cooper, et autres
Publié: (2026)
par: Lin, Cooper, et autres
Publié: (2026)
CAX-Agent: A Lightweight Agent Harness for Reliable APDL Automation
par: Lin, Chenying, et autres
Publié: (2026)
par: Lin, Chenying, et autres
Publié: (2026)
BizFinBench: A Business-Driven Real-World Financial Benchmark for Evaluating LLMs
par: Lu, Guilong, et autres
Publié: (2025)
par: Lu, Guilong, et autres
Publié: (2025)
Physics-Informed Large Language Models for HVAC Anomaly Detection with Autonomous Rule Generation
par: Lin, Subin, et autres
Publié: (2025)
par: Lin, Subin, et autres
Publié: (2025)
TCM-FTP: Fine-Tuning Large Language Models for Herbal Prescription Prediction
par: Zhou, Xingzhi, et autres
Publié: (2024)
par: Zhou, Xingzhi, et autres
Publié: (2024)
Ethereum Price Prediction Employing Large Language Models for Short-term and Few-shot Forecasting
par: Makri, Eftychia, et autres
Publié: (2025)
par: Makri, Eftychia, et autres
Publié: (2025)
Large Language Models for Bioinformatics
par: Ruan, Wei, et autres
Publié: (2025)
par: Ruan, Wei, et autres
Publié: (2025)
Assessing Consistency and Reproducibility in the Outputs of Large Language Models: Evidence Across Diverse Finance and Accounting Tasks
par: Wang, Julian Junyan, et autres
Publié: (2025)
par: Wang, Julian Junyan, et autres
Publié: (2025)
FLAME: Financial Large-Language Model Assessment and Metrics Evaluation
par: Guo, Jiayu, et autres
Publié: (2025)
par: Guo, Jiayu, et autres
Publié: (2025)
FinRule-Bench: A Benchmark for Joint Reasoning over Financial Tables and Principles
par: Malarkkan, Arun Vignesh, et autres
Publié: (2026)
par: Malarkkan, Arun Vignesh, et autres
Publié: (2026)
EUR-USD Exchange Rate Forecasting Based on Information Fusion with Large Language Models and Deep Learning Methods
par: Ding, Hongcheng, et autres
Publié: (2024)
par: Ding, Hongcheng, et autres
Publié: (2024)
ChronoLLM: A Framework for Customizing Large Language Model for Digital Twins generalization based on PyChrono
par: Wang, Jingquan, et autres
Publié: (2025)
par: Wang, Jingquan, et autres
Publié: (2025)
Documents similaires
-
IdeaBench: Benchmarking Large Language Models for Research Idea Generation
par: Guo, Sikun, et autres
Publié: (2024) -
QuantBench: Benchmarking AI Methods for Quantitative Investment
par: Wang, Saizhuo, et autres
Publié: (2025) -
ResearchBench: Benchmarking LLMs in Scientific Discovery via Inspiration-Based Task Decomposition
par: Liu, Yujie, et autres
Publié: (2025) -
Automating Structural Engineering Workflows with Large Language Model Agents
par: Liang, Haoran, et autres
Publié: (2025) -
INVESTORBENCH: A Benchmark for Financial Decision-Making Tasks with LLM-based Agent
par: Li, Haohang, et autres
Publié: (2024)