DefenderBench: A Toolkit for Evaluating Language Agents in Cybersecurity Environments
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Chiyu, Cote, Marc-Alexandre, Albada, Michael, Sankaran, Anush, Stokes, Jack W., Wang, Tong, Abdi, Amir, Blum, William, Abdul-Mageed, Muhammad |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
AttentionDefense: Leveraging System Prompt Attention for Explainable Defense Against Novel Jailbreaks
par: Siska, Charlotte, et autres
Publié: (2025)
par: Siska, Charlotte, et autres
Publié: (2025)
LaMini-LM: A Diverse Herd of Distilled Models from Large-Scale Instructions
par: Wu, Minghao, et autres
Publié: (2023)
par: Wu, Minghao, et autres
Publié: (2023)
BountyBench: Dollar Impact of AI Agent Attackers and Defenders on Real-World Cybersecurity Systems
par: Zhang, Andy K., et autres
Publié: (2025)
par: Zhang, Andy K., et autres
Publié: (2025)
IDAT: A Multi-Modal Dataset and Toolkit for Building and Evaluating Interactive Task-Solving Agents
par: Mohanty, Shrestha, et autres
Publié: (2024)
par: Mohanty, Shrestha, et autres
Publié: (2024)
Distilling Text Style Transfer With Self-Explanation From LLMs
par: Zhang, Chiyu, et autres
Publié: (2024)
par: Zhang, Chiyu, et autres
Publié: (2024)
On Barriers to Archival Audio Processing
par: Sullivan, Peter, et autres
Publié: (2025)
par: Sullivan, Peter, et autres
Publié: (2025)
To Distill or Not to Distill? On the Robustness of Robust Knowledge Distillation
par: Waheed, Abdul, et autres
Publié: (2024)
par: Waheed, Abdul, et autres
Publié: (2024)
Predicting Clinical Outcomes with Waveform LSTMs
par: Albada, Michael
Publié: (2025)
par: Albada, Michael
Publié: (2025)
EduAdapt: A Question Answer Benchmark Dataset for Evaluating Grade-Level Adaptability in LLMs
par: Naeem, Numaan, et autres
Publié: (2025)
par: Naeem, Numaan, et autres
Publié: (2025)
Effective Self-Mining of In-Context Examples for Unsupervised Machine Translation with LLMs
par: Mekki, Abdellah El, et autres
Publié: (2024)
par: Mekki, Abdellah El, et autres
Publié: (2024)
Towards Zero-Shot Text-To-Speech for Arabic Dialects
par: Doan, Khai Duy, et autres
Publié: (2024)
par: Doan, Khai Duy, et autres
Publié: (2024)
DISCOVERYWORLD: A Virtual Environment for Developing and Evaluating Automated Scientific Discovery Agents
par: Jansen, Peter, et autres
Publié: (2024)
par: Jansen, Peter, et autres
Publié: (2024)
Dallah: A Dialect-Aware Multimodal Large Language Model for Arabic
par: Alwajih, Fakhraddin, et autres
Publié: (2024)
par: Alwajih, Fakhraddin, et autres
Publié: (2024)
uDistil-Whisper: Label-Free Data Filtering for Knowledge Distillation in Low-Data Regimes
par: Waheed, Abdul, et autres
Publié: (2024)
par: Waheed, Abdul, et autres
Publié: (2024)
NADI 2024: The Fifth Nuanced Arabic Dialect Identification Shared Task
par: Abdul-Mageed, Muhammad, et autres
Publié: (2024)
par: Abdul-Mageed, Muhammad, et autres
Publié: (2024)
Toucan: Many-to-Many Translation for 150 African Language Pairs
par: Elmadany, AbdelRahim, et autres
Publié: (2024)
par: Elmadany, AbdelRahim, et autres
Publié: (2024)
Autoregressive + Chain of Thought = Recurrent: Recurrence's Role in Language Models' Computability and a Revisit of Recurrent Transformer
par: Zhang, Xiang, et autres
Publié: (2024)
par: Zhang, Xiang, et autres
Publié: (2024)
Interplay of Machine Translation, Diacritics, and Diacritization
par: Chen, Wei-Rui, et autres
Publié: (2024)
par: Chen, Wei-Rui, et autres
Publié: (2024)
Zero-Shot Context-Aware ASR for Diverse Arabic Varieties
par: Talafha, Bashar, et autres
Publié: (2025)
par: Talafha, Bashar, et autres
Publié: (2025)
Cheetah: Natural Language Generation for 517 African Languages
par: Adebara, Ife, et autres
Publié: (2024)
par: Adebara, Ife, et autres
Publié: (2024)
GhostEI-Bench: Do Mobile Agents Resilience to Environmental Injection in Dynamic On-Device Environments?
par: Chen, Chiyu, et autres
Publié: (2025)
par: Chen, Chiyu, et autres
Publié: (2025)
WeDefense: A Toolkit to Defend Against Fake Audio
par: Zhang, Lin, et autres
Publié: (2026)
par: Zhang, Lin, et autres
Publié: (2026)
TEMPO: A Realistic Multi-Domain Benchmark for Temporal Reasoning-Intensive Retrieval
par: Abdallah, Abdelrahman, et autres
Publié: (2026)
par: Abdallah, Abdelrahman, et autres
Publié: (2026)
AfroScope: A Framework for Studying the Linguistic Landscape of Africa
par: Kwon, Sang Yun, et autres
Publié: (2026)
par: Kwon, Sang Yun, et autres
Publié: (2026)
Arabic Automatic Story Generation with Large Language Models
par: El-Shangiti, Ahmed Oumar, et autres
Publié: (2024)
par: El-Shangiti, Ahmed Oumar, et autres
Publié: (2024)
Rational Cybersecurity for Business
par: Blum, Dan
Publié: (2020)
par: Blum, Dan
Publié: (2020)
VLMGuard: Defending VLMs against Malicious Prompts via Unlabeled Data
par: Du, Xuefeng, et autres
Publié: (2024)
par: Du, Xuefeng, et autres
Publié: (2024)
CyberCertBench: Evaluating LLMs in Cybersecurity Certification Knowledge
par: Keppler, Gustav, et autres
Publié: (2026)
par: Keppler, Gustav, et autres
Publié: (2026)
Towards testate amoebae genomics and beyond, a wish list…
par: Kosakyan, Anush
Publié: (2025)
par: Kosakyan, Anush
Publié: (2025)
TALES: Text Adventure Learning Environment Suite
par: Cui, Christopher Zhang, et autres
Publié: (2025)
par: Cui, Christopher Zhang, et autres
Publié: (2025)
ExploitBench: A Capability Ladder Benchmark for LLM Cybersecurity Agents
par: Lee, Seunghyun, et autres
Publié: (2026)
par: Lee, Seunghyun, et autres
Publié: (2026)
Waste-Bench: A Comprehensive Benchmark for Evaluating VLLMs in Cluttered Environments
par: Ali, Muhammad, et autres
Publié: (2025)
par: Ali, Muhammad, et autres
Publié: (2025)
Where Are We? Evaluating LLM Performance on African Languages
par: Adebara, Ife, et autres
Publié: (2025)
par: Adebara, Ife, et autres
Publié: (2025)
Sub-goal Distillation: A Method to Improve Small Language Agents
par: Hashemzadeh, Maryam, et autres
Publié: (2024)
par: Hashemzadeh, Maryam, et autres
Publié: (2024)
CritBench: A Framework for Evaluating Cybersecurity Capabilities of Large Language Models in IEC 61850 Digital Substation Environments
par: Keppler, Gustav, et autres
Publié: (2026)
par: Keppler, Gustav, et autres
Publié: (2026)
Learning to Defend by Attacking (and Vice-Versa): Transfer of Learning in Cybersecurity Games
par: Malloy, Tailia, et autres
Publié: (2023)
par: Malloy, Tailia, et autres
Publié: (2023)
SPAR: Personalized Content-Based Recommendation via Long Engagement Attention
par: Zhang, Chiyu, et autres
Publié: (2024)
par: Zhang, Chiyu, et autres
Publié: (2024)
DetoxLLM: A Framework for Detoxification with Explanations
par: Khondaker, Md Tawkat Islam, et autres
Publié: (2024)
par: Khondaker, Md Tawkat Islam, et autres
Publié: (2024)
LLM Performance Predictors are good initializers for Architecture Search
par: Jawahar, Ganesh, et autres
Publié: (2023)
par: Jawahar, Ganesh, et autres
Publié: (2023)
PhysicianBench: Evaluating LLM Agents in Real-World EHR Environments
par: Liu, Ruoqi, et autres
Publié: (2026)
par: Liu, Ruoqi, et autres
Publié: (2026)
Documents similaires
-
AttentionDefense: Leveraging System Prompt Attention for Explainable Defense Against Novel Jailbreaks
par: Siska, Charlotte, et autres
Publié: (2025) -
LaMini-LM: A Diverse Herd of Distilled Models from Large-Scale Instructions
par: Wu, Minghao, et autres
Publié: (2023) -
BountyBench: Dollar Impact of AI Agent Attackers and Defenders on Real-World Cybersecurity Systems
par: Zhang, Andy K., et autres
Publié: (2025) -
IDAT: A Multi-Modal Dataset and Toolkit for Building and Evaluating Interactive Task-Solving Agents
par: Mohanty, Shrestha, et autres
Publié: (2024) -
Distilling Text Style Transfer With Self-Explanation From LLMs
par: Zhang, Chiyu, et autres
Publié: (2024)