CTIArena: Benchmarking LLM Knowledge and Reasoning Across Heterogeneous Cyber Threat Intelligence
Fuente:
arXiv
Saved in:
| Main Authors: | Cheng, Yutong, Liu, Yang, Li, Changze, Song, Dawn, Gao, Peng |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
CTINexus: Automatic Cyber Threat Intelligence Knowledge Graph Construction Using Large Language Models
by: Cheng, Yutong, et al.
Published: (2024)
by: Cheng, Yutong, et al.
Published: (2024)
CyberSOCEval: Benchmarking LLMs Capabilities for Malware Analysis and Threat Intelligence Reasoning
by: Deason, Lauren, et al.
Published: (2025)
by: Deason, Lauren, et al.
Published: (2025)
Uncovering Vulnerabilities of LLM-Assisted Cyber Threat Intelligence
by: Meng, Yuqiao, et al.
Published: (2025)
by: Meng, Yuqiao, et al.
Published: (2025)
CTIBench: A Benchmark for Evaluating LLMs in Cyber Threat Intelligence
by: Alam, Md Tanvirul, et al.
Published: (2024)
by: Alam, Md Tanvirul, et al.
Published: (2024)
Cyber Threat Intelligence for Artificial Intelligence Systems
by: Krawczyk, Natalia, et al.
Published: (2026)
by: Krawczyk, Natalia, et al.
Published: (2026)
AthenaBench: A Dynamic Benchmark for Evaluating LLMs in Cyber Threat Intelligence
by: Alam, Md Tanvirul, et al.
Published: (2025)
by: Alam, Md Tanvirul, et al.
Published: (2025)
LLM-Assisted Proactive Threat Intelligence for Automated Reasoning
by: Paul, Shuva, et al.
Published: (2025)
by: Paul, Shuva, et al.
Published: (2025)
Actionable Cyber Threat Intelligence using Knowledge Graphs and Large Language Models
by: Fieblinger, Romy, et al.
Published: (2024)
by: Fieblinger, Romy, et al.
Published: (2024)
ThreatKG: An AI-Powered System for Automated Open-Source Cyber Threat Intelligence Gathering and Management
by: Gao, Peng, et al.
Published: (2022)
by: Gao, Peng, et al.
Published: (2022)
TITAN: Graph-Executable Reasoning for Cyber Threat Intelligence
by: Simoni, Marco, et al.
Published: (2025)
by: Simoni, Marco, et al.
Published: (2025)
POLAR: Automating Cyber Threat Prioritization through LLM-Powered Assessment
by: Tang, Luoxi, et al.
Published: (2025)
by: Tang, Luoxi, et al.
Published: (2025)
BARTPredict: Empowering IoT Security with LLM-Driven Cyber Threat Prediction
by: Diaf, Alaeddine, et al.
Published: (2025)
by: Diaf, Alaeddine, et al.
Published: (2025)
AI-Driven Cyber Threat Intelligence Automation
by: Shah, Shrit, et al.
Published: (2024)
by: Shah, Shrit, et al.
Published: (2024)
The Use of Large Language Models (LLM) for Cyber Threat Intelligence (CTI) in Cybercrime Forums
by: Clairoux-Trepanier, Vanessa, et al.
Published: (2024)
by: Clairoux-Trepanier, Vanessa, et al.
Published: (2024)
Large Language Models Are Unreliable for Cyber Threat Intelligence
by: Mezzi, Emanuele, et al.
Published: (2025)
by: Mezzi, Emanuele, et al.
Published: (2025)
TTPrint: Evidence-Grounded TTP Extraction via Diverge-then-Converge Verification
by: Cheng, Yutong, et al.
Published: (2026)
by: Cheng, Yutong, et al.
Published: (2026)
Benchmarking LLM-Assisted Blue Teaming via Standardized Threat Hunting
by: Meng, Yuqiao, et al.
Published: (2025)
by: Meng, Yuqiao, et al.
Published: (2025)
Beyond RAG for Cyber Threat Intelligence: A Systematic Evaluation of Graph-Based and Agentic Retrieval
by: Hamzic, Dzenan, et al.
Published: (2026)
by: Hamzic, Dzenan, et al.
Published: (2026)
VulnLLM-R: Specialized Reasoning LLM with Agent Scaffold for Vulnerability Detection
by: Nie, Yuzhou, et al.
Published: (2025)
by: Nie, Yuzhou, et al.
Published: (2025)
SCDBench: A Benchmark for LLM-Based Smart Contract Decompilers
by: Qin, Kaihua, et al.
Published: (2026)
by: Qin, Kaihua, et al.
Published: (2026)
CyberSentinel: An Emergent Threat Detection System for AI Security
by: Tallam, Krti
Published: (2025)
by: Tallam, Krti
Published: (2025)
Countering Autonomous Cyber Threats
by: Heckel, Kade M., et al.
Published: (2024)
by: Heckel, Kade M., et al.
Published: (2024)
ThreatModeling-LLM: Automating Threat Modeling using Large Language Models for Banking System
by: Wu, Tingmin, et al.
Published: (2024)
by: Wu, Tingmin, et al.
Published: (2024)
CyBiasBench: Benchmarking Bias in LLM Agents for Cyber-Attack Scenarios
by: Lim, Taein, et al.
Published: (2026)
by: Lim, Taein, et al.
Published: (2026)
LOCALINTEL: Generating Organizational Threat Intelligence from Global and Local Cyber Knowledge
by: Mitra, Shaswata, et al.
Published: (2024)
by: Mitra, Shaswata, et al.
Published: (2024)
ExCyTIn-Bench: Evaluating LLM agents on Cyber Threat Investigation
by: Wu, Yiran, et al.
Published: (2025)
by: Wu, Yiran, et al.
Published: (2025)
Technique Inference Engine: A Recommender Model to Support Cyber Threat Hunting
by: Turner, Matthew J., et al.
Published: (2025)
by: Turner, Matthew J., et al.
Published: (2025)
Benchmarking Safety Risks of Knowledge-Intensive Reasoning under Malicious Knowledge Editing
by: Mao, Qinghua, et al.
Published: (2026)
by: Mao, Qinghua, et al.
Published: (2026)
Audit-LLM: Multi-Agent Collaboration for Log-based Insider Threat Detection
by: Song, Chengyu, et al.
Published: (2024)
by: Song, Chengyu, et al.
Published: (2024)
HonestCyberEval: An AI Cyber Risk Benchmark for Automated Software Exploitation
by: Ristea, Dan, et al.
Published: (2024)
by: Ristea, Dan, et al.
Published: (2024)
Towards Explainable and Lightweight AI for Real-Time Cyber Threat Hunting in Edge Networks
by: Rahmati, Milad
Published: (2025)
by: Rahmati, Milad
Published: (2025)
CyberMetric: A Benchmark Dataset based on Retrieval-Augmented Generation for Evaluating LLMs in Cybersecurity Knowledge
by: Tihanyi, Norbert, et al.
Published: (2024)
by: Tihanyi, Norbert, et al.
Published: (2024)
AI-Driven Security in Cloud Computing: Enhancing Threat Detection, Automated Response, and Cyber Resilience
by: Shaffi, Shamnad Mohamed, et al.
Published: (2025)
by: Shaffi, Shamnad Mohamed, et al.
Published: (2025)
A Large Language Model-Supported Threat Modeling Framework for Transportation Cyber-Physical Systems
by: Salek, M Sabbir, et al.
Published: (2025)
by: Salek, M Sabbir, et al.
Published: (2025)
Towards a scalable AI-driven framework for data-independent Cyber Threat Intelligence Information Extraction
by: Sorokoletova, Olga, et al.
Published: (2025)
by: Sorokoletova, Olga, et al.
Published: (2025)
Quantifying and Defending against Privacy Threats on Federated Knowledge Graph Embedding
by: Hu, Yuke, et al.
Published: (2023)
by: Hu, Yuke, et al.
Published: (2023)
Towards Secure Retrieval-Augmented Generation: A Comprehensive Review of Threats, Defenses and Benchmarks
by: Mu, Yanming, et al.
Published: (2026)
by: Mu, Yanming, et al.
Published: (2026)
SecPI: Secure Code Generation with Reasoning Models via Security Reasoning Internalization
by: Wang, Hao, et al.
Published: (2026)
by: Wang, Hao, et al.
Published: (2026)
SafeGenBench: A Benchmark Framework for Security Vulnerability Detection in LLM-Generated Code
by: Li, Xinghang, et al.
Published: (2025)
by: Li, Xinghang, et al.
Published: (2025)
SEvenLLM: Benchmarking, Eliciting, and Enhancing Abilities of Large Language Models in Cyber Threat Intelligence
by: Ji, Hangyuan, et al.
Published: (2024)
by: Ji, Hangyuan, et al.
Published: (2024)
Similar Items
-
CTINexus: Automatic Cyber Threat Intelligence Knowledge Graph Construction Using Large Language Models
by: Cheng, Yutong, et al.
Published: (2024) -
CyberSOCEval: Benchmarking LLMs Capabilities for Malware Analysis and Threat Intelligence Reasoning
by: Deason, Lauren, et al.
Published: (2025) -
Uncovering Vulnerabilities of LLM-Assisted Cyber Threat Intelligence
by: Meng, Yuqiao, et al.
Published: (2025) -
CTIBench: A Benchmark for Evaluating LLMs in Cyber Threat Intelligence
by: Alam, Md Tanvirul, et al.
Published: (2024) -
Cyber Threat Intelligence for Artificial Intelligence Systems
by: Krawczyk, Natalia, et al.
Published: (2026)