SECURE: Benchmarking Large Language Models for Cybersecurity
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Bhusal, Dipkamal, Alam, Md Tanvirul, Nguyen, Le, Mahara, Ashim, Lightcap, Zachary, Frazier, Rodney, Fieblinger, Romy, Torales, Grace Long, Blakely, Benjamin A., Rastogi, Nidhi |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MORPH: Towards Automated Concept Drift Adaptation for Malware Detection
par: Alam, Md Tanvirul, et autres
Publié: (2024)
par: Alam, Md Tanvirul, et autres
Publié: (2024)
CTIBench: A Benchmark for Evaluating LLMs in Cyber Threat Intelligence
par: Alam, Md Tanvirul, et autres
Publié: (2024)
par: Alam, Md Tanvirul, et autres
Publié: (2024)
Actionable Cyber Threat Intelligence using Knowledge Graphs and Large Language Models
par: Fieblinger, Romy, et autres
Publié: (2024)
par: Fieblinger, Romy, et autres
Publié: (2024)
Training for Trustworthy Saliency Maps: Adversarial Training Meets Feature-Map Smoothing
par: Bhusal, Dipkamal, et autres
Publié: (2026)
par: Bhusal, Dipkamal, et autres
Publié: (2026)
R+R: Revisiting Static Feature-Based Android Malware Detection using Machine Learning
par: Alam, Md Tanvirul, et autres
Publié: (2024)
par: Alam, Md Tanvirul, et autres
Publié: (2024)
AthenaBench: A Dynamic Benchmark for Evaluating LLMs in Cyber Threat Intelligence
par: Alam, Md Tanvirul, et autres
Publié: (2025)
par: Alam, Md Tanvirul, et autres
Publié: (2025)
Adversarial Patterns: Building Robust Android Malware Classifiers
par: Bhusal, Dipkamal, et autres
Publié: (2022)
par: Bhusal, Dipkamal, et autres
Publié: (2022)
Adapting Large Language Models to Emerging Cybersecurity using Retrieval Augmented Generation
par: Borah, Arnabh, et autres
Publié: (2025)
par: Borah, Arnabh, et autres
Publié: (2025)
PASA: Attack Agnostic Unsupervised Adversarial Detection using Prediction & Attribution Sensitivity Analysis
par: Bhusal, Dipkamal, et autres
Publié: (2024)
par: Bhusal, Dipkamal, et autres
Publié: (2024)
Limits of Generalization in RLVR: Two Case Studies in Mathematical Reasoning
par: Alam, Md Tanvirul, et autres
Publié: (2025)
par: Alam, Md Tanvirul, et autres
Publié: (2025)
Cybersecurity Data Extraction from Common Crawl
par: Mahara, Ashim
Publié: (2025)
par: Mahara, Ashim
Publié: (2025)
Learning to Look: Cognitive Attention Alignment with Vision-Language Models
par: Yang, Ryan L., et autres
Publié: (2025)
par: Yang, Ryan L., et autres
Publié: (2025)
ADAPT: A Pseudo-labeling Approach to Combat Concept Drift in Malware Detection
par: Alam, Md Tanvirul, et autres
Publié: (2025)
par: Alam, Md Tanvirul, et autres
Publié: (2025)
Do Sparse Subnetworks Exhibit Cognitively Aligned Attention? Effects of Pruning on Saliency Map Fidelity, Sparsity, and Concept Coherence
par: Suwal, Sanish, et autres
Publié: (2025)
par: Suwal, Sanish, et autres
Publié: (2025)
H-Sets: Hessian-Guided Discovery of Set-Level Feature Interactions in Image Classifiers
par: Mehrotra, Ayushi, et autres
Publié: (2026)
par: Mehrotra, Ayushi, et autres
Publié: (2026)
Concept-Based Masking: A Patch-Agnostic Defense Against Adversarial Patch Attacks
par: Mehrotra, Ayushi, et autres
Publié: (2025)
par: Mehrotra, Ayushi, et autres
Publié: (2025)
FACE: Faithful Automatic Concept Extraction
par: Bhusal, Dipkamal, et autres
Publié: (2025)
par: Bhusal, Dipkamal, et autres
Publié: (2025)
Towards Understanding Self-play for LLM Reasoning
par: Chae, Justin Yang, et autres
Publié: (2025)
par: Chae, Justin Yang, et autres
Publié: (2025)
Smaller is Better: Enhancing Transparency in Vehicle AI Systems via Pruning
par: Suwal, Sanish, et autres
Publié: (2025)
par: Suwal, Sanish, et autres
Publié: (2025)
SPHINX: A Synthetic Environment for Visual Perception and Reasoning
par: Alam, Md Tanvirul, et autres
Publié: (2025)
par: Alam, Md Tanvirul, et autres
Publié: (2025)
Detecting Malicious Entra OAuth Apps with LLM-Based Permission Risk Scoring
par: Mahara, Ashim
Publié: (2025)
par: Mahara, Ashim
Publié: (2025)
Beyond Perception Errors: Semantic Fixation in Large Vision-Language Models
par: Alam, Md Tanvirul
Publié: (2026)
par: Alam, Md Tanvirul
Publié: (2026)
Minerva: Reinforcement Learning with Verifiable Rewards for Cyber Threat Intelligence LLMs
par: Alam, Md Tanvirul, et autres
Publié: (2026)
par: Alam, Md Tanvirul, et autres
Publié: (2026)
Multi-Label Classification of Thoracic Diseases using Dense Convolutional Network on Chest Radiographs
par: Bhusal, Dipkamal, et autres
Publié: (2022)
par: Bhusal, Dipkamal, et autres
Publié: (2022)
Hybrid Analytical-Machine Learning Framework for Ripple Factor Estimation in Cockcroft-Walton Voltage Multipliers with Residual Correction for Non-Ideal Effects
par: Islam, Md. Tanvirul
Publié: (2025)
par: Islam, Md. Tanvirul
Publié: (2025)
SECURE Deliverable 5.2: Mainstreaming Plan for SECURE Research Framework
par: Molnár, Ádám, et autres
Publié: (2025)
par: Molnár, Ádám, et autres
Publié: (2025)
PROVEX: Enhancing SOC Analyst Trust with Explainable Provenance-Based IDS
par: Dhanuka, Devang, et autres
Publié: (2025)
par: Dhanuka, Devang, et autres
Publié: (2025)
Achieving EF1 and Epistemic EFX Guarantees Simultaneously
par: Akrami, Hannaneh, et autres
Publié: (2026)
par: Akrami, Hannaneh, et autres
Publié: (2026)
AI-Driven Cybersecurity Testbed for Nuclear Infrastructure: Comprehensive Evaluation Using METL Operational Data
par: Blakely, Benjamin, et autres
Publié: (2025)
par: Blakely, Benjamin, et autres
Publié: (2025)
Toward a Quantum Information System Cybersecurity Taxonomy and Testbed: Exploiting a Unique Opportunity for Early Impact
par: Blakely, Benjamin, et autres
Publié: (2024)
par: Blakely, Benjamin, et autres
Publié: (2024)
A Polynomial-Time Algorithm for Fair and Efficient Allocation with a Fixed Number of Agents
par: Mahara, Ryoga
Publié: (2024)
par: Mahara, Ryoga
Publié: (2024)
Existence of Fair and Efficient Allocation of Indivisible Chores
par: Mahara, Ryoga
Publié: (2025)
par: Mahara, Ryoga
Publié: (2025)
Existence of EFX for Two Additive Valuations
par: Mahara, Ryoga
Publié: (2020)
par: Mahara, Ryoga
Publié: (2020)
The application of single cell gel electrophoresis or comet assay to human monitoring studies
par: Mahara Valverde
Publié: (1999)
par: Mahara Valverde
Publié: (1999)
LA REPARACIÓN DEL DAÑO MORAL DERIVADO DEL INCUMPLIMIENTO CONTRACTUAL. TENDENCIA EN LA RECIENTE JURISPRUDENCIA NACIONAL Y ESPAÑOLA
par: Romy Grace Rutherford Parentti
Publié: (2013)
par: Romy Grace Rutherford Parentti
Publié: (2013)
Cybersecurity: Past, Present and Future
par: Alam, Shahid
Publié: (2022)
par: Alam, Shahid
Publié: (2022)
Grid-STIX: A STIX 2.1-Compliant Cyber-Physical Security Ontology for Power Grid
par: Blakely, Benjamin, et autres
Publié: (2025)
par: Blakely, Benjamin, et autres
Publié: (2025)
Hedonic analysis of the price of mangalarga marchador horses sold at auctions
par: Mahara Moreira Marquez
Publié: (2024)
par: Mahara Moreira Marquez
Publié: (2024)
SECURE Deliverable 7.1: Dissemination and Communication Plan
par: Šujdović, Irena, et autres
Publié: (2025)
par: Šujdović, Irena, et autres
Publié: (2025)
Women, Work and the Everyday Politics of Welfare
par: Blakely, Helen
Publié: (2025)
par: Blakely, Helen
Publié: (2025)
Documents similaires
-
MORPH: Towards Automated Concept Drift Adaptation for Malware Detection
par: Alam, Md Tanvirul, et autres
Publié: (2024) -
CTIBench: A Benchmark for Evaluating LLMs in Cyber Threat Intelligence
par: Alam, Md Tanvirul, et autres
Publié: (2024) -
Actionable Cyber Threat Intelligence using Knowledge Graphs and Large Language Models
par: Fieblinger, Romy, et autres
Publié: (2024) -
Training for Trustworthy Saliency Maps: Adversarial Training Meets Feature-Map Smoothing
par: Bhusal, Dipkamal, et autres
Publié: (2026) -
R+R: Revisiting Static Feature-Based Android Malware Detection using Machine Learning
par: Alam, Md Tanvirul, et autres
Publié: (2024)