REBENCH: A Procedural, Fair-by-Construction Benchmark for LLMs on Stripped-Binary Types and Names (Extended Version)
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Won, Jun Yeon, Jin, Xin, Ma, Shiqing, Lin, Zhiqiang |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Automated Repair of OpenID Connect Programs (Extended Version)
par: Rahat, Tamjid Al, et autres
Publié: (2025)
par: Rahat, Tamjid Al, et autres
Publié: (2025)
PATCHEVAL: A New Benchmark for Evaluating LLMs on Patching Real-World Vulnerabilities
par: Wei, Zichao, et autres
Publié: (2025)
par: Wei, Zichao, et autres
Publié: (2025)
Train in Vain: Functionality-Preserving Poisoning to Prevent Unauthorized Use of Code Datasets
par: Xiao, Yuan, et autres
Publié: (2026)
par: Xiao, Yuan, et autres
Publié: (2026)
On the Effectiveness of Function-Level Vulnerability Detectors for Inter-Procedural Vulnerabilities
par: Li, Zhen, et autres
Publié: (2024)
par: Li, Zhen, et autres
Publié: (2024)
VERCATION: Precise Vulnerable Open-source Software Version Identification based on Static Analysis and LLM
par: Cheng, Yiran, et autres
Publié: (2024)
par: Cheng, Yiran, et autres
Publié: (2024)
Cross-Inlining Binary Function Similarity Detection
par: Jia, Ang, et autres
Publié: (2024)
par: Jia, Ang, et autres
Publié: (2024)
ELFuzz: Efficient Input Generation via LLM-driven Synthesis Over Fuzzer Space
par: Chen, Chuyang, et autres
Publié: (2025)
par: Chen, Chuyang, et autres
Publié: (2025)
PPT4J: Patch Presence Test for Java Binaries
par: Pan, Zhiyuan, et autres
Publié: (2023)
par: Pan, Zhiyuan, et autres
Publié: (2023)
Beyond Function-Level Analysis: Context-Aware Reasoning for Inter-Procedural Vulnerability Detection
par: Li, Yikun, et autres
Publié: (2026)
par: Li, Yikun, et autres
Publié: (2026)
AUTOVR: Automated UI Exploration for Detecting Sensitive Data Flow Exposures in Virtual Reality Apps
par: Kim, John Y., et autres
Publié: (2025)
par: Kim, John Y., et autres
Publié: (2025)
StriderSPD: Structure-Guided Joint Representation Learning for Binary Security Patch Detection
par: Li, Qingyuan, et autres
Publié: (2026)
par: Li, Qingyuan, et autres
Publié: (2026)
SafeToolBench: Pioneering a Prospective Benchmark to Evaluating Tool Utilization Safety in LLMs
par: Xia, Hongfei, et autres
Publié: (2025)
par: Xia, Hongfei, et autres
Publié: (2025)
SCRIBE: Practical Static Binary Patching via Binary-Aware Recompilation of Decompiled Code
par: Dai, Han, et autres
Publié: (2026)
par: Dai, Han, et autres
Publié: (2026)
SABER: Benchmarking Operational Safety of LLM Coding Agents in Stateful Project Workspaces
par: Hu, Qi, et autres
Publié: (2026)
par: Hu, Qi, et autres
Publié: (2026)
CAShift: Benchmarking Log-Based Cloud Attack Detection under Normality Shift
par: Yu, Jiongchi, et autres
Publié: (2025)
par: Yu, Jiongchi, et autres
Publié: (2025)
DeCoMa: Detecting and Purifying Code Dataset Watermarks through Dual Channel Code Abstraction
par: Xiao, Yuan, et autres
Publié: (2025)
par: Xiao, Yuan, et autres
Publié: (2025)
Unveiling Dynamic Binary Instrumentation Techniques
par: Llorente-Vazquez, Oscar, et autres
Publié: (2025)
par: Llorente-Vazquez, Oscar, et autres
Publié: (2025)
SCALE: Constructing Structured Natural Language Comment Trees for Software Vulnerability Detection
par: Wen, Xin-Cheng, et autres
Publié: (2024)
par: Wen, Xin-Cheng, et autres
Publié: (2024)
Automated TEE Adaptation with LLMs: Identifying, Transforming, and Porting Sensitive Functions in Programs
par: Han, Ruidong, et autres
Publié: (2025)
par: Han, Ruidong, et autres
Publié: (2025)
HarnessAgent: Scaling Automatic Fuzzing Harness Construction with Tool-Augmented LLM Pipelines
par: Yang, Kang, et autres
Publié: (2025)
par: Yang, Kang, et autres
Publié: (2025)
Assessing the Effectiveness of Binary-Level CFI Techniques
par: Vaidya, Ruturaj K., et autres
Publié: (2024)
par: Vaidya, Ruturaj K., et autres
Publié: (2024)
CVE Breadcrumbs: Tracking Vulnerabilities Through Versioned Apache Libraries
par: Garcia, Derek, et autres
Publié: (2025)
par: Garcia, Derek, et autres
Publié: (2025)
Patch2QL: Discover Cognate Defects in Open Source Software Supply Chain With Auto-generated Static Analysis Rules
par: Wang, Fuwei, et autres
Publié: (2024)
par: Wang, Fuwei, et autres
Publié: (2024)
Harnessing the Power of LLM to Support Binary Taint Analysis
par: Liu, Puzhuo, et autres
Publié: (2023)
par: Liu, Puzhuo, et autres
Publié: (2023)
Identifying Adversary Tactics and Techniques in Malware Binaries with an LLM Agent
par: Xuan, Zhou, et autres
Publié: (2026)
par: Xuan, Zhou, et autres
Publié: (2026)
Tactics, Techniques, and Procedures (TTPs) in Interpreted Malware: A Zero-Shot Generation with Large Language Models
par: Zhang, Ying, et autres
Publié: (2024)
par: Zhang, Ying, et autres
Publié: (2024)
Towards Secure Logging: Characterizing and Benchmarking Logging Code Security Issues with LLMs
par: Yuan, He Yang, et autres
Publié: (2026)
par: Yuan, He Yang, et autres
Publié: (2026)
FuzzBox: Blending Fuzzing into Emulation for Binary-Only Embedded Targets
par: Cesarano, Carmine, et autres
Publié: (2025)
par: Cesarano, Carmine, et autres
Publié: (2025)
An Empirical Study on the Effectiveness of Large Language Models for Binary Code Understanding
par: Shang, Xiuwei, et autres
Publié: (2025)
par: Shang, Xiuwei, et autres
Publié: (2025)
Give LLMs a Security Course: Securing Retrieval-Augmented Code Generation via Knowledge Injection
par: Lin, Bo, et autres
Publié: (2025)
par: Lin, Bo, et autres
Publié: (2025)
Unsupervised Binary Code Translation with Application to Code Similarity Detection and Vulnerability Discovery
par: Ahmad, Iftakhar, et autres
Publié: (2024)
par: Ahmad, Iftakhar, et autres
Publié: (2024)
Version-level Third-Party Library Detection in Android Applications via Class Structural Similarity
par: Zhou, Bolin, et autres
Publié: (2025)
par: Zhou, Bolin, et autres
Publié: (2025)
From TinyGo to gc Compiler: Extending Zorya's Concolic Framework to Real-World Go Binaries
par: Gorna, Karolina, et autres
Publié: (2026)
par: Gorna, Karolina, et autres
Publié: (2026)
Veritas: A Semantically Grounded Agentic Framework for Memory Corruption Vulnerability Detection in Binaries
par: Zheng, Xinran, et autres
Publié: (2026)
par: Zheng, Xinran, et autres
Publié: (2026)
BinEnhance: An Enhancement Framework Based on External Environment Semantics for Binary Code Search
par: Wang, Yongpan, et autres
Publié: (2024)
par: Wang, Yongpan, et autres
Publié: (2024)
SeeWasm: An Efficient and Fully-Functional Symbolic Execution Engine for WebAssembly Binaries
par: He, Ningyu, et autres
Publié: (2024)
par: He, Ningyu, et autres
Publié: (2024)
CEBin: A Cost-Effective Framework for Large-Scale Binary Code Similarity Detection
par: Wang, Hao, et autres
Publié: (2024)
par: Wang, Hao, et autres
Publié: (2024)
BinPRE: Enhancing Field Inference in Binary Analysis Based Protocol Reverse Engineering
par: Jiang, Jiayi, et autres
Publié: (2024)
par: Jiang, Jiayi, et autres
Publié: (2024)
Rust for Embedded Systems: Current State, Challenges and Open Problems (Extended Report)
par: Sharma, Ayushi, et autres
Publié: (2023)
par: Sharma, Ayushi, et autres
Publié: (2023)
Reentrancy Detection in the Age of LLMs
par: Ressi, Dalila, et autres
Publié: (2026)
par: Ressi, Dalila, et autres
Publié: (2026)
Documents similaires
-
Automated Repair of OpenID Connect Programs (Extended Version)
par: Rahat, Tamjid Al, et autres
Publié: (2025) -
PATCHEVAL: A New Benchmark for Evaluating LLMs on Patching Real-World Vulnerabilities
par: Wei, Zichao, et autres
Publié: (2025) -
Train in Vain: Functionality-Preserving Poisoning to Prevent Unauthorized Use of Code Datasets
par: Xiao, Yuan, et autres
Publié: (2026) -
On the Effectiveness of Function-Level Vulnerability Detectors for Inter-Procedural Vulnerabilities
par: Li, Zhen, et autres
Publié: (2024) -
VERCATION: Precise Vulnerable Open-source Software Version Identification based on Static Analysis and LLM
par: Cheng, Yiran, et autres
Publié: (2024)