SEvenLLM: Benchmarking, Eliciting, and Enhancing Abilities of Large Language Models in Cyber Threat Intelligence
Fuente:
arXiv
Saved in:
| Main Authors: | Ji, Hangyuan, Yang, Jian, Chai, Linzheng, Wei, Chaoren, Yang, Liqun, Duan, Yunlong, Wang, Yunli, Sun, Tianzhen, Guo, Hongcheng, Li, Tongliang, Ren, Changyu, Li, Zhoujun |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Raw Text is All you Need: Knowledge-intensive Multi-turn Instruction Tuning for Large Language Model
by: Hou, Xia, et al.
Published: (2024)
by: Hou, Xia, et al.
Published: (2024)
UniCoder: Scaling Code Large Language Model via Universal Code
by: Sun, Tao, et al.
Published: (2024)
by: Sun, Tao, et al.
Published: (2024)
WGAN-AFL: Seed Generation Augmented Fuzzer with Wasserstein-GAN
by: Yang, Liqun, et al.
Published: (2024)
by: Yang, Liqun, et al.
Published: (2024)
TableBench: A Comprehensive and Complex Benchmark for Table Question Answering
by: Wu, Xianjie, et al.
Published: (2024)
by: Wu, Xianjie, et al.
Published: (2024)
McEval: Massively Multilingual Code Evaluation
by: Chai, Linzheng, et al.
Published: (2024)
by: Chai, Linzheng, et al.
Published: (2024)
xCoT: Cross-lingual Instruction Tuning for Cross-lingual Chain-of-Thought Reasoning
by: Chai, Linzheng, et al.
Published: (2024)
by: Chai, Linzheng, et al.
Published: (2024)
FuzzCoder: Byte-level Fuzzing Test via Large Language Model
by: Yang, Liqun, et al.
Published: (2024)
by: Yang, Liqun, et al.
Published: (2024)
RoNID: New Intent Discovery with Generated-Reliable Labels and Cluster-friendly Representations
by: Zhang, Shun, et al.
Published: (2024)
by: Zhang, Shun, et al.
Published: (2024)
m3P: Towards Multimodal Multilingual Translation with Multimodal Prompt
by: Yang, Jian, et al.
Published: (2024)
by: Yang, Jian, et al.
Published: (2024)
CTIArena: Benchmarking LLM Knowledge and Reasoning Across Heterogeneous Cyber Threat Intelligence
by: Cheng, Yutong, et al.
Published: (2025)
by: Cheng, Yutong, et al.
Published: (2025)
Pet-Bench: Benchmarking the Abilities of Large Language Models as E-Pets in Social Network Services
by: Guo, Hongcheng, et al.
Published: (2025)
by: Guo, Hongcheng, et al.
Published: (2025)
REALM: RAG-Driven Enhancement of Multimodal Electronic Health Records Analysis via Large Language Models
by: Zhu, Yinghao, et al.
Published: (2024)
by: Zhu, Yinghao, et al.
Published: (2024)
OWL: A Large Language Model for IT Operations
by: Guo, Hongcheng, et al.
Published: (2023)
by: Guo, Hongcheng, et al.
Published: (2023)
CTIBench: A Benchmark for Evaluating LLMs in Cyber Threat Intelligence
by: Alam, Md Tanvirul, et al.
Published: (2024)
by: Alam, Md Tanvirul, et al.
Published: (2024)
Discerning Reliable Cyber Threat Indicators for Timely Cyber Threat Intelligence
by: Arikkat, Dincy R, et al.
Published: (2023)
by: Arikkat, Dincy R, et al.
Published: (2023)
RoleLLM: Benchmarking, Eliciting, and Enhancing Role-Playing Abilities of Large Language Models
by: Wang, Zekun Moore, et al.
Published: (2023)
by: Wang, Zekun Moore, et al.
Published: (2023)
CTISum: A New Benchmark Dataset For Cyber Threat Intelligence Summarization
by: Peng, Wei, et al.
Published: (2024)
by: Peng, Wei, et al.
Published: (2024)
Uncovering Vulnerabilities of LLM-Assisted Cyber Threat Intelligence
by: Meng, Yuqiao, et al.
Published: (2025)
by: Meng, Yuqiao, et al.
Published: (2025)
Cyber Threat Intelligence for Artificial Intelligence Systems
by: Krawczyk, Natalia, et al.
Published: (2026)
by: Krawczyk, Natalia, et al.
Published: (2026)
MdEval: Massively Multilingual Code Debugging
by: Liu, Shukai, et al.
Published: (2024)
by: Liu, Shukai, et al.
Published: (2024)
NUMINA: A Natural Understanding Benchmark for Multi-dimensional Intelligence and Numerical Reasoning Abilities
by: Zeng, Changyu, et al.
Published: (2025)
by: Zeng, Changyu, et al.
Published: (2025)
Towards Cyber Threat Intelligence for the IoT
by: Iacovazzi, Alfonso, et al.
Published: (2024)
by: Iacovazzi, Alfonso, et al.
Published: (2024)
H2HTalk: Evaluating Large Language Models as Emotional Companion
by: Wang, Boyang, et al.
Published: (2025)
by: Wang, Boyang, et al.
Published: (2025)
CodeIF: Benchmarking the Instruction-Following Capabilities of Large Language Models for Code Generation
by: Yan, Kaiwen, et al.
Published: (2025)
by: Yan, Kaiwen, et al.
Published: (2025)
In-Context Code-Text Learning for Bimodal Software Engineering
by: Tang, Xunzhu, et al.
Published: (2024)
by: Tang, Xunzhu, et al.
Published: (2024)
CyberSOCEval: Benchmarking LLMs Capabilities for Malware Analysis and Threat Intelligence Reasoning
by: Deason, Lauren, et al.
Published: (2025)
by: Deason, Lauren, et al.
Published: (2025)
AthenaBench: A Dynamic Benchmark for Evaluating LLMs in Cyber Threat Intelligence
by: Alam, Md Tanvirul, et al.
Published: (2025)
by: Alam, Md Tanvirul, et al.
Published: (2025)
Cyber Threat Hunting: Non-Parametric Mining of Attack Patterns from Cyber Threat Intelligence for Precise Threats Attribution
by: Kanwal, Rimsha, et al.
Published: (2025)
by: Kanwal, Rimsha, et al.
Published: (2025)
A Threat Intelligence Event Extraction Conceptual Model for Cyber Threat Intelligence Feeds
by: Al-Yasiri, Jamal H., et al.
Published: (2025)
by: Al-Yasiri, Jamal H., et al.
Published: (2025)
ThreatKG: An AI-Powered System for Automated Open-Source Cyber Threat Intelligence Gathering and Management
by: Gao, Peng, et al.
Published: (2022)
by: Gao, Peng, et al.
Published: (2022)
Securing Intelligence: Cyber Threats in AI Systems
by: Tina Borole
Published: (2026)
by: Tina Borole
Published: (2026)
Cyber Threat Intelligence meets the Analytic Tradecraft
by: Bjurling, Björn, et al.
Published: (2024)
by: Bjurling, Björn, et al.
Published: (2024)
AI-Driven Cyber Threat Intelligence Automation
by: Shah, Shrit, et al.
Published: (2024)
by: Shah, Shrit, et al.
Published: (2024)
Trustworthy Artificial Intelligence for Cyber Threat Analysis
by: Wang, Shuangbao Paul, et al.
Published: (2025)
by: Wang, Shuangbao Paul, et al.
Published: (2025)
Investigating the Temporal Dynamics of Cyber Threat Intelligence
by: Kodituwakku, Angel, et al.
Published: (2024)
by: Kodituwakku, Angel, et al.
Published: (2024)
DependEval: Benchmarking LLMs for Repository Dependency Understanding
by: Du, Junjia, et al.
Published: (2025)
by: Du, Junjia, et al.
Published: (2025)
The Ouroboros Threat - How AI Cannibalism Degrades Cyber Threat Intelligence
by: Ahmad, Faran
Published: (2026)
by: Ahmad, Faran
Published: (2026)
mABC: multi-Agent Blockchain-Inspired Collaboration for root cause analysis in micro-services architecture
by: Zhang, Wei, et al.
Published: (2024)
by: Zhang, Wei, et al.
Published: (2024)
P2P: Automated Paper-to-Poster Generation and Fine-Grained Benchmark
by: Sun, Tao, et al.
Published: (2025)
by: Sun, Tao, et al.
Published: (2025)
New Intent Discovery with Attracting and Dispersing Prototype
by: Zhang, Shun, et al.
Published: (2024)
by: Zhang, Shun, et al.
Published: (2024)
Similar Items
-
Raw Text is All you Need: Knowledge-intensive Multi-turn Instruction Tuning for Large Language Model
by: Hou, Xia, et al.
Published: (2024) -
UniCoder: Scaling Code Large Language Model via Universal Code
by: Sun, Tao, et al.
Published: (2024) -
WGAN-AFL: Seed Generation Augmented Fuzzer with Wasserstein-GAN
by: Yang, Liqun, et al.
Published: (2024) -
TableBench: A Comprehensive and Complex Benchmark for Table Question Answering
by: Wu, Xianjie, et al.
Published: (2024) -
McEval: Massively Multilingual Code Evaluation
by: Chai, Linzheng, et al.
Published: (2024)