Evaluating the Reliability of Multiple Large Language Models in Risk Assessment: A CIS Controls Based Approach
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Pinto, Gustavo Roberto, Labaki, Arthur do Prado, Miani, Rodrigo Sanches |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Risk Assessment and Security Analysis of Large Language Models
par: Zhang, Xiaoyan, et autres
Publié: (2025)
par: Zhang, Xiaoyan, et autres
Publié: (2025)
Identification of Malicious Posts on the Dark Web Using Supervised Machine Learning
par: Filho, Sebastião Alves de Jesus, et autres
Publié: (2025)
par: Filho, Sebastião Alves de Jesus, et autres
Publié: (2025)
Visualisation for the CIS benchmark scanning results
par: Zhao, Zhenshuo, et autres
Publié: (2025)
par: Zhao, Zhenshuo, et autres
Publié: (2025)
Decompiling Smart Contracts with a Large Language Model
par: David, Isaac, et autres
Publié: (2025)
par: David, Isaac, et autres
Publié: (2025)
Leveraging Large Language Models for Trustworthiness Assessment of Web Applications
par: Yarotskyi, Oleksandr, et autres
Publié: (2026)
par: Yarotskyi, Oleksandr, et autres
Publié: (2026)
Cooking Up Risks: Benchmarking and Reducing Food Safety Risks in Large Language Models
par: Luo, Weidi, et autres
Publié: (2026)
par: Luo, Weidi, et autres
Publié: (2026)
A Survey on Privacy Risks and Protection in Large Language Models
par: Chen, Kang, et autres
Publié: (2025)
par: Chen, Kang, et autres
Publié: (2025)
Risks of Practicing Large Language Models in Smart Grid: Threat Modeling and Validation
par: Li, Jiangnan, et autres
Publié: (2024)
par: Li, Jiangnan, et autres
Publié: (2024)
MasterKey: Automated Jailbreak Across Multiple Large Language Model Chatbots
par: Deng, Gelei, et autres
Publié: (2023)
par: Deng, Gelei, et autres
Publié: (2023)
Threat-Specific Risk Assessment for IP Multimedia Subsystem Networks Based on Hierarchical Models
par: Shaikh, Abdullah Ehsan, et autres
Publié: (2025)
par: Shaikh, Abdullah Ehsan, et autres
Publié: (2025)
AICrypto: Evaluating Cryptography Capabilities of Large Language Models
par: Wang, Yu, et autres
Publié: (2025)
par: Wang, Yu, et autres
Publié: (2025)
CYBERSECEVAL 3: Advancing the Evaluation of Cybersecurity Risks and Capabilities in Large Language Models
par: Wan, Shengye, et autres
Publié: (2024)
par: Wan, Shengye, et autres
Publié: (2024)
Evaluating the Reliability and Fidelity of Automated Judgment Systems of Large Language Models
par: Biskupski, Tom, et autres
Publié: (2026)
par: Biskupski, Tom, et autres
Publié: (2026)
TempCharBERT: Keystroke Dynamics for Continuous Access Control Based on Pre-trained Language Models
par: Simão, Matheus, et autres
Publié: (2024)
par: Simão, Matheus, et autres
Publié: (2024)
PRvL: Quantifying the Capabilities and Risks of Large Language Models for PII Redaction
par: Garza, Leon, et autres
Publié: (2025)
par: Garza, Leon, et autres
Publié: (2025)
Evaluating and Enhancing the Vulnerability Reasoning Capabilities of Large Language Models
par: Lu, Li, et autres
Publié: (2026)
par: Lu, Li, et autres
Publié: (2026)
PerProb: Indirectly Evaluating Memorization in Large Language Models
par: Liao, Yihan, et autres
Publié: (2025)
par: Liao, Yihan, et autres
Publié: (2025)
Automated Vulnerability Validation and Verification: A Large Language Model Approach
par: Lotfi, Alireza, et autres
Publié: (2025)
par: Lotfi, Alireza, et autres
Publié: (2025)
On the Reliability of Watermarks for Large Language Models
par: Kirchenbauer, John, et autres
Publié: (2023)
par: Kirchenbauer, John, et autres
Publié: (2023)
Towards Scalable and Interpretable Mobile App Risk Analysis via Large Language Models
par: Yang, Yu, et autres
Publié: (2025)
par: Yang, Yu, et autres
Publié: (2025)
Investigating the Impact of Quantization Methods on the Safety and Reliability of Large Language Models
par: Kharinaev, Artyom, et autres
Publié: (2025)
par: Kharinaev, Artyom, et autres
Publié: (2025)
Risk Assessment and Threat Modeling for safe autonomous driving technology
par: Paz, Ian Alexis Wong, et autres
Publié: (2025)
par: Paz, Ian Alexis Wong, et autres
Publié: (2025)
An End-to-End Model for Logits-Based Large Language Models Watermarking
par: Wong, Kahim, et autres
Publié: (2025)
par: Wong, Kahim, et autres
Publié: (2025)
Evaluation Framework for Quantum Security Risk Assessment: A Comprehensive Strategy for Quantum-Safe Transition
par: Baseri, Yaser, et autres
Publié: (2024)
par: Baseri, Yaser, et autres
Publié: (2024)
One-Time Certificates for Reliable and Secure Document Signing
par: Mayr, Lucas, et autres
Publié: (2022)
par: Mayr, Lucas, et autres
Publié: (2022)
SafeBench: A Safety Evaluation Framework for Multimodal Large Language Models
par: Ying, Zonghao, et autres
Publié: (2024)
par: Ying, Zonghao, et autres
Publié: (2024)
Towards Supporting Penetration Testing Education with Large Language Models: an Evaluation and Comparison
par: Nizon-Deladoeuille, Martin, et autres
Publié: (2025)
par: Nizon-Deladoeuille, Martin, et autres
Publié: (2025)
Large Language Models as Explainable Cyberattack Detectors for Energy Industrial Control Systems
par: Kong, Weiyi, et autres
Publié: (2026)
par: Kong, Weiyi, et autres
Publié: (2026)
Permit: Permission-Aware Representation Intervention for Controlled Generation in Large Language Models
par: Sun, Pengcheng, et autres
Publié: (2026)
par: Sun, Pengcheng, et autres
Publié: (2026)
An Automated Attack Investigation Approach Leveraging Threat-Knowledge-Augmented Large Language Models
par: Dai, Rujie, et autres
Publié: (2025)
par: Dai, Rujie, et autres
Publié: (2025)
An Effective Approach to Scramble Multiple Diagnostic Imageries Using Chaos-Based Cryptography
par: Sanaboina, Dr Chandra Sekhar, et autres
Publié: (2024)
par: Sanaboina, Dr Chandra Sekhar, et autres
Publié: (2024)
PSY: Posterior Sampling Based Privacy Enhancer in Large Language Models
par: Sun, Yulian, et autres
Publié: (2024)
par: Sun, Yulian, et autres
Publié: (2024)
VirtualCrime: Evaluating Criminal Potential of Large Language Models via Sandbox Simulation
par: Tang, Yilin, et autres
Publié: (2026)
par: Tang, Yilin, et autres
Publié: (2026)
Can Small Language Models Reliably Resist Jailbreak Attacks? A Comprehensive Evaluation
par: Zhang, Wenhui, et autres
Publié: (2025)
par: Zhang, Wenhui, et autres
Publié: (2025)
A Large Language Model Approach to Generating Bypass Rules for Malware Evasion in Analysis Sandbox
par: Sui, Zhiyong, et autres
Publié: (2026)
par: Sui, Zhiyong, et autres
Publié: (2026)
Identifying and Quantifying Trade-offs in Multi-Stakeholder Risk Evaluation with Applications to the Data Protection Impact Assessment of the GDPR
par: Mollaeefar, Majid, et autres
Publié: (2022)
par: Mollaeefar, Majid, et autres
Publié: (2022)
Nob-MIAs: Non-biased Membership Inference Attacks Assessment on Large Language Models with Ex-Post Dataset Construction
par: Eichler, Cédric, et autres
Publié: (2024)
par: Eichler, Cédric, et autres
Publié: (2024)
ASTRA: Agentic Steerability and Risk Assessment Framework
par: Hazan, Itay, et autres
Publié: (2025)
par: Hazan, Itay, et autres
Publié: (2025)
Modeling the Interdependent Coupling of Safety and Security for Connected and Automated Vehicles: A Copula-Based Integrated Risk Analysis Approach
par: Li, Xingyu, et autres
Publié: (2025)
par: Li, Xingyu, et autres
Publié: (2025)
Understanding the Supply Chain and Risks of Large Language Model Applications
par: Ma, Yujie, et autres
Publié: (2025)
par: Ma, Yujie, et autres
Publié: (2025)
Documents similaires
-
Risk Assessment and Security Analysis of Large Language Models
par: Zhang, Xiaoyan, et autres
Publié: (2025) -
Identification of Malicious Posts on the Dark Web Using Supervised Machine Learning
par: Filho, Sebastião Alves de Jesus, et autres
Publié: (2025) -
Visualisation for the CIS benchmark scanning results
par: Zhao, Zhenshuo, et autres
Publié: (2025) -
Decompiling Smart Contracts with a Large Language Model
par: David, Isaac, et autres
Publié: (2025) -
Leveraging Large Language Models for Trustworthiness Assessment of Web Applications
par: Yarotskyi, Oleksandr, et autres
Publié: (2026)