Evaluating the Reliability of Multiple Large Language Models in Risk Assessment: A CIS Controls Based Approach
Fuente:
arXiv
Saved in:
| Main Authors: | Pinto, Gustavo Roberto, Labaki, Arthur do Prado, Miani, Rodrigo Sanches |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Risk Assessment and Security Analysis of Large Language Models
by: Zhang, Xiaoyan, et al.
Published: (2025)
by: Zhang, Xiaoyan, et al.
Published: (2025)
Identification of Malicious Posts on the Dark Web Using Supervised Machine Learning
by: Filho, Sebastião Alves de Jesus, et al.
Published: (2025)
by: Filho, Sebastião Alves de Jesus, et al.
Published: (2025)
Visualisation for the CIS benchmark scanning results
by: Zhao, Zhenshuo, et al.
Published: (2025)
by: Zhao, Zhenshuo, et al.
Published: (2025)
Decompiling Smart Contracts with a Large Language Model
by: David, Isaac, et al.
Published: (2025)
by: David, Isaac, et al.
Published: (2025)
Leveraging Large Language Models for Trustworthiness Assessment of Web Applications
by: Yarotskyi, Oleksandr, et al.
Published: (2026)
by: Yarotskyi, Oleksandr, et al.
Published: (2026)
Cooking Up Risks: Benchmarking and Reducing Food Safety Risks in Large Language Models
by: Luo, Weidi, et al.
Published: (2026)
by: Luo, Weidi, et al.
Published: (2026)
A Survey on Privacy Risks and Protection in Large Language Models
by: Chen, Kang, et al.
Published: (2025)
by: Chen, Kang, et al.
Published: (2025)
Risks of Practicing Large Language Models in Smart Grid: Threat Modeling and Validation
by: Li, Jiangnan, et al.
Published: (2024)
by: Li, Jiangnan, et al.
Published: (2024)
MasterKey: Automated Jailbreak Across Multiple Large Language Model Chatbots
by: Deng, Gelei, et al.
Published: (2023)
by: Deng, Gelei, et al.
Published: (2023)
Threat-Specific Risk Assessment for IP Multimedia Subsystem Networks Based on Hierarchical Models
by: Shaikh, Abdullah Ehsan, et al.
Published: (2025)
by: Shaikh, Abdullah Ehsan, et al.
Published: (2025)
AICrypto: Evaluating Cryptography Capabilities of Large Language Models
by: Wang, Yu, et al.
Published: (2025)
by: Wang, Yu, et al.
Published: (2025)
CYBERSECEVAL 3: Advancing the Evaluation of Cybersecurity Risks and Capabilities in Large Language Models
by: Wan, Shengye, et al.
Published: (2024)
by: Wan, Shengye, et al.
Published: (2024)
Evaluating the Reliability and Fidelity of Automated Judgment Systems of Large Language Models
by: Biskupski, Tom, et al.
Published: (2026)
by: Biskupski, Tom, et al.
Published: (2026)
TempCharBERT: Keystroke Dynamics for Continuous Access Control Based on Pre-trained Language Models
by: Simão, Matheus, et al.
Published: (2024)
by: Simão, Matheus, et al.
Published: (2024)
PRvL: Quantifying the Capabilities and Risks of Large Language Models for PII Redaction
by: Garza, Leon, et al.
Published: (2025)
by: Garza, Leon, et al.
Published: (2025)
Evaluating and Enhancing the Vulnerability Reasoning Capabilities of Large Language Models
by: Lu, Li, et al.
Published: (2026)
by: Lu, Li, et al.
Published: (2026)
PerProb: Indirectly Evaluating Memorization in Large Language Models
by: Liao, Yihan, et al.
Published: (2025)
by: Liao, Yihan, et al.
Published: (2025)
Automated Vulnerability Validation and Verification: A Large Language Model Approach
by: Lotfi, Alireza, et al.
Published: (2025)
by: Lotfi, Alireza, et al.
Published: (2025)
On the Reliability of Watermarks for Large Language Models
by: Kirchenbauer, John, et al.
Published: (2023)
by: Kirchenbauer, John, et al.
Published: (2023)
Towards Scalable and Interpretable Mobile App Risk Analysis via Large Language Models
by: Yang, Yu, et al.
Published: (2025)
by: Yang, Yu, et al.
Published: (2025)
Investigating the Impact of Quantization Methods on the Safety and Reliability of Large Language Models
by: Kharinaev, Artyom, et al.
Published: (2025)
by: Kharinaev, Artyom, et al.
Published: (2025)
Risk Assessment and Threat Modeling for safe autonomous driving technology
by: Paz, Ian Alexis Wong, et al.
Published: (2025)
by: Paz, Ian Alexis Wong, et al.
Published: (2025)
An End-to-End Model for Logits-Based Large Language Models Watermarking
by: Wong, Kahim, et al.
Published: (2025)
by: Wong, Kahim, et al.
Published: (2025)
Evaluation Framework for Quantum Security Risk Assessment: A Comprehensive Strategy for Quantum-Safe Transition
by: Baseri, Yaser, et al.
Published: (2024)
by: Baseri, Yaser, et al.
Published: (2024)
One-Time Certificates for Reliable and Secure Document Signing
by: Mayr, Lucas, et al.
Published: (2022)
by: Mayr, Lucas, et al.
Published: (2022)
SafeBench: A Safety Evaluation Framework for Multimodal Large Language Models
by: Ying, Zonghao, et al.
Published: (2024)
by: Ying, Zonghao, et al.
Published: (2024)
Towards Supporting Penetration Testing Education with Large Language Models: an Evaluation and Comparison
by: Nizon-Deladoeuille, Martin, et al.
Published: (2025)
by: Nizon-Deladoeuille, Martin, et al.
Published: (2025)
Large Language Models as Explainable Cyberattack Detectors for Energy Industrial Control Systems
by: Kong, Weiyi, et al.
Published: (2026)
by: Kong, Weiyi, et al.
Published: (2026)
Permit: Permission-Aware Representation Intervention for Controlled Generation in Large Language Models
by: Sun, Pengcheng, et al.
Published: (2026)
by: Sun, Pengcheng, et al.
Published: (2026)
An Automated Attack Investigation Approach Leveraging Threat-Knowledge-Augmented Large Language Models
by: Dai, Rujie, et al.
Published: (2025)
by: Dai, Rujie, et al.
Published: (2025)
An Effective Approach to Scramble Multiple Diagnostic Imageries Using Chaos-Based Cryptography
by: Sanaboina, Dr Chandra Sekhar, et al.
Published: (2024)
by: Sanaboina, Dr Chandra Sekhar, et al.
Published: (2024)
PSY: Posterior Sampling Based Privacy Enhancer in Large Language Models
by: Sun, Yulian, et al.
Published: (2024)
by: Sun, Yulian, et al.
Published: (2024)
VirtualCrime: Evaluating Criminal Potential of Large Language Models via Sandbox Simulation
by: Tang, Yilin, et al.
Published: (2026)
by: Tang, Yilin, et al.
Published: (2026)
Can Small Language Models Reliably Resist Jailbreak Attacks? A Comprehensive Evaluation
by: Zhang, Wenhui, et al.
Published: (2025)
by: Zhang, Wenhui, et al.
Published: (2025)
A Large Language Model Approach to Generating Bypass Rules for Malware Evasion in Analysis Sandbox
by: Sui, Zhiyong, et al.
Published: (2026)
by: Sui, Zhiyong, et al.
Published: (2026)
Identifying and Quantifying Trade-offs in Multi-Stakeholder Risk Evaluation with Applications to the Data Protection Impact Assessment of the GDPR
by: Mollaeefar, Majid, et al.
Published: (2022)
by: Mollaeefar, Majid, et al.
Published: (2022)
Nob-MIAs: Non-biased Membership Inference Attacks Assessment on Large Language Models with Ex-Post Dataset Construction
by: Eichler, Cédric, et al.
Published: (2024)
by: Eichler, Cédric, et al.
Published: (2024)
ASTRA: Agentic Steerability and Risk Assessment Framework
by: Hazan, Itay, et al.
Published: (2025)
by: Hazan, Itay, et al.
Published: (2025)
Modeling the Interdependent Coupling of Safety and Security for Connected and Automated Vehicles: A Copula-Based Integrated Risk Analysis Approach
by: Li, Xingyu, et al.
Published: (2025)
by: Li, Xingyu, et al.
Published: (2025)
Understanding the Supply Chain and Risks of Large Language Model Applications
by: Ma, Yujie, et al.
Published: (2025)
by: Ma, Yujie, et al.
Published: (2025)
Similar Items
-
Risk Assessment and Security Analysis of Large Language Models
by: Zhang, Xiaoyan, et al.
Published: (2025) -
Identification of Malicious Posts on the Dark Web Using Supervised Machine Learning
by: Filho, Sebastião Alves de Jesus, et al.
Published: (2025) -
Visualisation for the CIS benchmark scanning results
by: Zhao, Zhenshuo, et al.
Published: (2025) -
Decompiling Smart Contracts with a Large Language Model
by: David, Isaac, et al.
Published: (2025) -
Leveraging Large Language Models for Trustworthiness Assessment of Web Applications
by: Yarotskyi, Oleksandr, et al.
Published: (2026)