Responsible AI in Construction Safety: Systematic Evaluation of Large Language Models and Prompt Engineering
Fuente:
arXiv
Salvato in:
| Autori principali: | Sammour, Farouq, Xu, Jia, Wang, Xi, Hu, Mo, Zhang, Zhenyu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Bridging Dual Knowledge Graphs for Multi-Hop Question Answering in Construction Safety
di: Zhang, Yuxin, et al.
Pubblicazione: (2025)
di: Zhang, Yuxin, et al.
Pubblicazione: (2025)
SafetyPrompts: a Systematic Review of Open Datasets for Evaluating and Improving Large Language Model Safety
di: Röttger, Paul, et al.
Pubblicazione: (2024)
di: Röttger, Paul, et al.
Pubblicazione: (2024)
SORRY-Bench: Systematically Evaluating Large Language Model Safety Refusal
di: Xie, Tinghao, et al.
Pubblicazione: (2024)
di: Xie, Tinghao, et al.
Pubblicazione: (2024)
APEER: Automatic Prompt Engineering Enhances Large Language Model Reranking
di: Jin, Can, et al.
Pubblicazione: (2024)
di: Jin, Can, et al.
Pubblicazione: (2024)
DrLLM: Prompt-Enhanced Distributed Denial-of-Service Resistance Method with Large Language Models
di: Yin, Zhenyu, et al.
Pubblicazione: (2024)
di: Yin, Zhenyu, et al.
Pubblicazione: (2024)
Latency-Response Theory Model: Evaluating Large Language Models via Response Accuracy and Chain-of-Thought Length
di: Xu, Zhiyu, et al.
Pubblicazione: (2025)
di: Xu, Zhiyu, et al.
Pubblicazione: (2025)
Evaluating Reliability Gaps in Large Language Model Safety via Repeated Prompt Sampling
di: Broadwater, Keita
Pubblicazione: (2026)
di: Broadwater, Keita
Pubblicazione: (2026)
LongSafety: Evaluating Long-Context Safety of Large Language Models
di: Lu, Yida, et al.
Pubblicazione: (2025)
di: Lu, Yida, et al.
Pubblicazione: (2025)
Intelligent Understanding of Large Language Models in Traditional Chinese Medicine Based on Prompt Engineering Framework
di: Chen, Yirui, et al.
Pubblicazione: (2024)
di: Chen, Yirui, et al.
Pubblicazione: (2024)
A Systematic Survey of Prompt Engineering in Large Language Models: Techniques and Applications
di: Sahoo, Pranab, et al.
Pubblicazione: (2024)
di: Sahoo, Pranab, et al.
Pubblicazione: (2024)
Engineering Safety Requirements for Autonomous Driving with Large Language Models
di: Nouri, Ali, et al.
Pubblicazione: (2024)
di: Nouri, Ali, et al.
Pubblicazione: (2024)
Holistic Safety and Responsibility Evaluations of Advanced AI Models
di: Weidinger, Laura, et al.
Pubblicazione: (2024)
di: Weidinger, Laura, et al.
Pubblicazione: (2024)
An Evaluation of Large Language Models on Text Summarization Tasks Using Prompt Engineering Techniques
di: Aly, Walid Mohamed, et al.
Pubblicazione: (2025)
di: Aly, Walid Mohamed, et al.
Pubblicazione: (2025)
SafeSci: Safety Evaluation of Large Language Models in Science Domains and Beyond
di: Zhu, Xiangyang, et al.
Pubblicazione: (2026)
di: Zhu, Xiangyang, et al.
Pubblicazione: (2026)
Safety by Measurement: A Systematic Literature Review of AI Safety Evaluation Methods
di: Grey, Markov, et al.
Pubblicazione: (2025)
di: Grey, Markov, et al.
Pubblicazione: (2025)
DP-OPT: Make Large Language Model Your Privacy-Preserving Prompt Engineer
di: Hong, Junyuan, et al.
Pubblicazione: (2023)
di: Hong, Junyuan, et al.
Pubblicazione: (2023)
Integrating Chemistry Knowledge in Large Language Models via Prompt Engineering
di: Liu, Hongxuan, et al.
Pubblicazione: (2024)
di: Liu, Hongxuan, et al.
Pubblicazione: (2024)
MedSafetyBench: Evaluating and Improving the Medical Safety of Large Language Models
di: Han, Tessa, et al.
Pubblicazione: (2024)
di: Han, Tessa, et al.
Pubblicazione: (2024)
Dynamic Compressing Prompts for Efficient Inference of Large Language Models
di: Hu, Jinwu, et al.
Pubblicazione: (2025)
di: Hu, Jinwu, et al.
Pubblicazione: (2025)
MTMCS-Bench: Evaluating Contextual Safety of Multimodal Large Language Models in Multi-Turn Dialogues
di: Liu, Zheyuan, et al.
Pubblicazione: (2026)
di: Liu, Zheyuan, et al.
Pubblicazione: (2026)
Graph Neural Prompting with Large Language Models
di: Tian, Yijun, et al.
Pubblicazione: (2023)
di: Tian, Yijun, et al.
Pubblicazione: (2023)
Oyster-I: Beyond Refusal -- Constructive Safety Alignment for Responsible Language Models
di: Duan, Ranjie, et al.
Pubblicazione: (2025)
di: Duan, Ranjie, et al.
Pubblicazione: (2025)
KnowledgeBerg: Evaluating Systematic Knowledge Coverage and Compositional Reasoning in Large Language Models
di: Zhang, Xiao, et al.
Pubblicazione: (2026)
di: Zhang, Xiao, et al.
Pubblicazione: (2026)
Autonomous Prompt Engineering in Large Language Models
di: Kepel, Daan, et al.
Pubblicazione: (2024)
di: Kepel, Daan, et al.
Pubblicazione: (2024)
Large Language Models for Software Engineering: A Systematic Literature Review
di: Hou, Xinyi, et al.
Pubblicazione: (2023)
di: Hou, Xinyi, et al.
Pubblicazione: (2023)
DROJ: A Prompt-Driven Attack against Large Language Models
di: Hu, Leyang, et al.
Pubblicazione: (2024)
di: Hu, Leyang, et al.
Pubblicazione: (2024)
Large Language Models as Virtual Survey Respondents: Evaluating Sociodemographic Response Generation
di: Zhao, Jianpeng, et al.
Pubblicazione: (2025)
di: Zhao, Jianpeng, et al.
Pubblicazione: (2025)
An Engorgio Prompt Makes Large Language Model Babble on
di: Dong, Jianshuo, et al.
Pubblicazione: (2024)
di: Dong, Jianshuo, et al.
Pubblicazione: (2024)
AgenticEval: Toward Agentic and Self-Evolving Safety Evaluation of Large Language Models
di: Wang, Yixu, et al.
Pubblicazione: (2025)
di: Wang, Yixu, et al.
Pubblicazione: (2025)
Framing Effects in Independent-Agent Large Language Models: A Cross-Family Behavioral Analysis
di: Wang, Zice, et al.
Pubblicazione: (2026)
di: Wang, Zice, et al.
Pubblicazione: (2026)
Psychometric-Based Evaluation for Theorem Proving with Large Language Models
di: Zhang, Jianyu, et al.
Pubblicazione: (2025)
di: Zhang, Jianyu, et al.
Pubblicazione: (2025)
Characteristic AI Agents via Large Language Models
di: Wang, Xi, et al.
Pubblicazione: (2024)
di: Wang, Xi, et al.
Pubblicazione: (2024)
Evaluation of Prompt Injection Defenses in Large Language Models
di: Deep, Priyal, et al.
Pubblicazione: (2026)
di: Deep, Priyal, et al.
Pubblicazione: (2026)
SafetyALFRED: Evaluating Safety-Conscious Planning of Multimodal Large Language Models
di: Torres-Fonseca, Josue, et al.
Pubblicazione: (2026)
di: Torres-Fonseca, Josue, et al.
Pubblicazione: (2026)
Conventional Commit Classification using Large Language Models and Prompt Engineering
di: Quadir, H. M. Sazzad, et al.
Pubblicazione: (2026)
di: Quadir, H. M. Sazzad, et al.
Pubblicazione: (2026)
Evaluating Prompting Strategies and Large Language Models in Systematic Literature Review Screening: Relevance and Task-Stage Classification
di: Han, Binglan, et al.
Pubblicazione: (2025)
di: Han, Binglan, et al.
Pubblicazione: (2025)
RePrompt: Planning by Automatic Prompt Engineering for Large Language Models Agents
di: Chen, Weizhe, et al.
Pubblicazione: (2024)
di: Chen, Weizhe, et al.
Pubblicazione: (2024)
Wordflow: Social Prompt Engineering for Large Language Models
di: Wang, Zijie J., et al.
Pubblicazione: (2024)
di: Wang, Zijie J., et al.
Pubblicazione: (2024)
WXImpactBench: A Disruptive Weather Impact Understanding Benchmark for Evaluating Large Language Models
di: Yu, Yongan, et al.
Pubblicazione: (2025)
di: Yu, Yongan, et al.
Pubblicazione: (2025)
EngiBench: A Benchmark for Evaluating Large Language Models on Engineering Problem Solving
di: Zhou, Xiyuan, et al.
Pubblicazione: (2025)
di: Zhou, Xiyuan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Bridging Dual Knowledge Graphs for Multi-Hop Question Answering in Construction Safety
di: Zhang, Yuxin, et al.
Pubblicazione: (2025) -
SafetyPrompts: a Systematic Review of Open Datasets for Evaluating and Improving Large Language Model Safety
di: Röttger, Paul, et al.
Pubblicazione: (2024) -
SORRY-Bench: Systematically Evaluating Large Language Model Safety Refusal
di: Xie, Tinghao, et al.
Pubblicazione: (2024) -
APEER: Automatic Prompt Engineering Enhances Large Language Model Reranking
di: Jin, Can, et al.
Pubblicazione: (2024) -
DrLLM: Prompt-Enhanced Distributed Denial-of-Service Resistance Method with Large Language Models
di: Yin, Zhenyu, et al.
Pubblicazione: (2024)