CTIBench: A Benchmark for Evaluating LLMs in Cyber Threat Intelligence
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Alam, Md Tanvirul, Bhusal, Dipkamal, Nguyen, Le, Rastogi, Nidhi |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
AthenaBench: A Dynamic Benchmark for Evaluating LLMs in Cyber Threat Intelligence
par: Alam, Md Tanvirul, et autres
Publié: (2025)
par: Alam, Md Tanvirul, et autres
Publié: (2025)
Actionable Cyber Threat Intelligence using Knowledge Graphs and Large Language Models
par: Fieblinger, Romy, et autres
Publié: (2024)
par: Fieblinger, Romy, et autres
Publié: (2024)
R+R: Revisiting Static Feature-Based Android Malware Detection using Machine Learning
par: Alam, Md Tanvirul, et autres
Publié: (2024)
par: Alam, Md Tanvirul, et autres
Publié: (2024)
PASA: Attack Agnostic Unsupervised Adversarial Detection using Prediction & Attribution Sensitivity Analysis
par: Bhusal, Dipkamal, et autres
Publié: (2024)
par: Bhusal, Dipkamal, et autres
Publié: (2024)
Adapting Large Language Models to Emerging Cybersecurity using Retrieval Augmented Generation
par: Borah, Arnabh, et autres
Publié: (2025)
par: Borah, Arnabh, et autres
Publié: (2025)
SECURE: Benchmarking Large Language Models for Cybersecurity
par: Bhusal, Dipkamal, et autres
Publié: (2024)
par: Bhusal, Dipkamal, et autres
Publié: (2024)
Adversarial Patterns: Building Robust Android Malware Classifiers
par: Bhusal, Dipkamal, et autres
Publié: (2022)
par: Bhusal, Dipkamal, et autres
Publié: (2022)
ADAPT: A Pseudo-labeling Approach to Combat Concept Drift in Malware Detection
par: Alam, Md Tanvirul, et autres
Publié: (2025)
par: Alam, Md Tanvirul, et autres
Publié: (2025)
CyberSOCEval: Benchmarking LLMs Capabilities for Malware Analysis and Threat Intelligence Reasoning
par: Deason, Lauren, et autres
Publié: (2025)
par: Deason, Lauren, et autres
Publié: (2025)
Cyber Threat Intelligence for Artificial Intelligence Systems
par: Krawczyk, Natalia, et autres
Publié: (2026)
par: Krawczyk, Natalia, et autres
Publié: (2026)
CTIArena: Benchmarking LLM Knowledge and Reasoning Across Heterogeneous Cyber Threat Intelligence
par: Cheng, Yutong, et autres
Publié: (2025)
par: Cheng, Yutong, et autres
Publié: (2025)
PROVEX: Enhancing SOC Analyst Trust with Explainable Provenance-Based IDS
par: Dhanuka, Devang, et autres
Publié: (2025)
par: Dhanuka, Devang, et autres
Publié: (2025)
Training for Trustworthy Saliency Maps: Adversarial Training Meets Feature-Map Smoothing
par: Bhusal, Dipkamal, et autres
Publié: (2026)
par: Bhusal, Dipkamal, et autres
Publié: (2026)
Uncovering Vulnerabilities of LLM-Assisted Cyber Threat Intelligence
par: Meng, Yuqiao, et autres
Publié: (2025)
par: Meng, Yuqiao, et autres
Publié: (2025)
Beyond RAG for Cyber Threat Intelligence: A Systematic Evaluation of Graph-Based and Agentic Retrieval
par: Hamzic, Dzenan, et autres
Publié: (2026)
par: Hamzic, Dzenan, et autres
Publié: (2026)
XAI-CF -- Examining the Role of Explainable Artificial Intelligence in Cyber Forensics
par: Alam, Shahid, et autres
Publié: (2024)
par: Alam, Shahid, et autres
Publié: (2024)
AI-Driven Cyber Threat Intelligence Automation
par: Shah, Shrit, et autres
Publié: (2024)
par: Shah, Shrit, et autres
Publié: (2024)
Large Language Models Are Unreliable for Cyber Threat Intelligence
par: Mezzi, Emanuele, et autres
Publié: (2025)
par: Mezzi, Emanuele, et autres
Publié: (2025)
CyberMetric: A Benchmark Dataset based on Retrieval-Augmented Generation for Evaluating LLMs in Cybersecurity Knowledge
par: Tihanyi, Norbert, et autres
Publié: (2024)
par: Tihanyi, Norbert, et autres
Publié: (2024)
FALCON: Autonomous Cyber Threat Intelligence Mining with LLMs for IDS Rule Generation
par: Mitra, Shaswata, et autres
Publié: (2025)
par: Mitra, Shaswata, et autres
Publié: (2025)
Cyber Defense Benchmark: Agentic Threat Hunting Evaluation for LLMs in SecOps
par: Chona, Alankrit, et autres
Publié: (2026)
par: Chona, Alankrit, et autres
Publié: (2026)
ExCyTIn-Bench: Evaluating LLM agents on Cyber Threat Investigation
par: Wu, Yiran, et autres
Publié: (2025)
par: Wu, Yiran, et autres
Publié: (2025)
CyberSentinel: An Emergent Threat Detection System for AI Security
par: Tallam, Krti
Publié: (2025)
par: Tallam, Krti
Publié: (2025)
CyberCertBench: Evaluating LLMs in Cybersecurity Certification Knowledge
par: Keppler, Gustav, et autres
Publié: (2026)
par: Keppler, Gustav, et autres
Publié: (2026)
Countering Autonomous Cyber Threats
par: Heckel, Kade M., et autres
Publié: (2024)
par: Heckel, Kade M., et autres
Publié: (2024)
Technique Inference Engine: A Recommender Model to Support Cyber Threat Hunting
par: Turner, Matthew J., et autres
Publié: (2025)
par: Turner, Matthew J., et autres
Publié: (2025)
POLAR: Automating Cyber Threat Prioritization through LLM-Powered Assessment
par: Tang, Luoxi, et autres
Publié: (2025)
par: Tang, Luoxi, et autres
Publié: (2025)
BARTPredict: Empowering IoT Security with LLM-Driven Cyber Threat Prediction
par: Diaf, Alaeddine, et autres
Publié: (2025)
par: Diaf, Alaeddine, et autres
Publié: (2025)
Contextualized AI for Cyber Defense: An Automated Survey using LLMs
par: Haryanto, Christoforus Yoga, et autres
Publié: (2024)
par: Haryanto, Christoforus Yoga, et autres
Publié: (2024)
TITAN: Graph-Executable Reasoning for Cyber Threat Intelligence
par: Simoni, Marco, et autres
Publié: (2025)
par: Simoni, Marco, et autres
Publié: (2025)
The Use of Large Language Models (LLM) for Cyber Threat Intelligence (CTI) in Cybercrime Forums
par: Clairoux-Trepanier, Vanessa, et autres
Publié: (2024)
par: Clairoux-Trepanier, Vanessa, et autres
Publié: (2024)
A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations
par: Zhou, Yihe, et autres
Publié: (2025)
par: Zhou, Yihe, et autres
Publié: (2025)
Mind the Gap: Missing Cyber Threat Coverage in NIDS Datasets for the Energy Sector
par: Tory, Adrita Rahman, et autres
Publié: (2025)
par: Tory, Adrita Rahman, et autres
Publié: (2025)
A Large Language Model-Supported Threat Modeling Framework for Transportation Cyber-Physical Systems
par: Salek, M Sabbir, et autres
Publié: (2025)
par: Salek, M Sabbir, et autres
Publié: (2025)
CTINexus: Automatic Cyber Threat Intelligence Knowledge Graph Construction Using Large Language Models
par: Cheng, Yutong, et autres
Publié: (2024)
par: Cheng, Yutong, et autres
Publié: (2024)
HonestCyberEval: An AI Cyber Risk Benchmark for Automated Software Exploitation
par: Ristea, Dan, et autres
Publié: (2024)
par: Ristea, Dan, et autres
Publié: (2024)
Towards Explainable and Lightweight AI for Real-Time Cyber Threat Hunting in Edge Networks
par: Rahmati, Milad
Publié: (2025)
par: Rahmati, Milad
Publié: (2025)
A Global Analysis of Cyber Threats to the Energy Sector: "Currents of Conflict" from a Geopolitical Perspective
par: Sánchez, Gustavo, et autres
Publié: (2025)
par: Sánchez, Gustavo, et autres
Publié: (2025)
Confusion is the Final Barrier: Rethinking Jailbreak Evaluation and Investigating the Real Misuse Threat of LLMs
par: Yan, Yu, et autres
Publié: (2025)
par: Yan, Yu, et autres
Publié: (2025)
AI-Driven Security in Cloud Computing: Enhancing Threat Detection, Automated Response, and Cyber Resilience
par: Shaffi, Shamnad Mohamed, et autres
Publié: (2025)
par: Shaffi, Shamnad Mohamed, et autres
Publié: (2025)
Documents similaires
-
AthenaBench: A Dynamic Benchmark for Evaluating LLMs in Cyber Threat Intelligence
par: Alam, Md Tanvirul, et autres
Publié: (2025) -
Actionable Cyber Threat Intelligence using Knowledge Graphs and Large Language Models
par: Fieblinger, Romy, et autres
Publié: (2024) -
R+R: Revisiting Static Feature-Based Android Malware Detection using Machine Learning
par: Alam, Md Tanvirul, et autres
Publié: (2024) -
PASA: Attack Agnostic Unsupervised Adversarial Detection using Prediction & Attribution Sensitivity Analysis
par: Bhusal, Dipkamal, et autres
Publié: (2024) -
Adapting Large Language Models to Emerging Cybersecurity using Retrieval Augmented Generation
par: Borah, Arnabh, et autres
Publié: (2025)