BinMetric: A Comprehensive Binary Analysis Benchmark for Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Shang, Xiuwei, Chen, Guoqiang, Cheng, Shaoyin, Wu, Benlong, Hu, Li, Li, Gangyang, Zhang, Weiming, Yu, Nenghai |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
An Empirical Study on the Effectiveness of Large Language Models for Binary Code Understanding
di: Shang, Xiuwei, et al.
Pubblicazione: (2025)
di: Shang, Xiuwei, et al.
Pubblicazione: (2025)
Binary Code Similarity Detection via Graph Contrastive Learning on Intermediate Representations
di: Shang, Xiuwei, et al.
Pubblicazione: (2024)
di: Shang, Xiuwei, et al.
Pubblicazione: (2024)
CompileAgent: Automated Real-World Repo-Level Compilation with Tool-Integrated LLM-based Agent System
di: Hu, Li, et al.
Pubblicazione: (2025)
di: Hu, Li, et al.
Pubblicazione: (2025)
How Far Have We Gone in Binary Code Understanding Using Large Language Models
di: Shang, Xiuwei, et al.
Pubblicazione: (2024)
di: Shang, Xiuwei, et al.
Pubblicazione: (2024)
Can LLMs Deobfuscate Binary Code? A Systematic Analysis of Large Language Models into Pseudocode Deobfuscation
di: Hu, Li, et al.
Pubblicazione: (2026)
di: Hu, Li, et al.
Pubblicazione: (2026)
Cross-modal Retrieval Models for Stripped Binary Analysis
di: Chen, Guoqiang, et al.
Pubblicazione: (2025)
di: Chen, Guoqiang, et al.
Pubblicazione: (2025)
Beyond the Edge of Function: Unraveling the Patterns of Type Recovery in Binary Code
di: Li, Gangyang, et al.
Pubblicazione: (2025)
di: Li, Gangyang, et al.
Pubblicazione: (2025)
DCE-LLM: Dead Code Elimination with Large Language Models
di: Chen, Minyu, et al.
Pubblicazione: (2025)
di: Chen, Minyu, et al.
Pubblicazione: (2025)
FoC: Figure out the Cryptographic Functions in Stripped Binaries with LLMs
di: Shang, Xiuwei, et al.
Pubblicazione: (2024)
di: Shang, Xiuwei, et al.
Pubblicazione: (2024)
A Multi-Language Object-Oriented Programming Benchmark for Large Language Models
di: Wang, Shuai, et al.
Pubblicazione: (2025)
di: Wang, Shuai, et al.
Pubblicazione: (2025)
BinEnhance: An Enhancement Framework Based on External Environment Semantics for Binary Code Search
di: Wang, Yongpan, et al.
Pubblicazione: (2024)
di: Wang, Yongpan, et al.
Pubblicazione: (2024)
BinCoFer: Three-Stage Purification for Effective C/C++ Binary Third-Party Library Detection
di: Zou, Yayi, et al.
Pubblicazione: (2025)
di: Zou, Yayi, et al.
Pubblicazione: (2025)
Defects4C: Benchmarking Large Language Model Repair Capability with C/C++ Bugs
di: Wang, Jian, et al.
Pubblicazione: (2025)
di: Wang, Jian, et al.
Pubblicazione: (2025)
BinPRE: Enhancing Field Inference in Binary Analysis Based Protocol Reverse Engineering
di: Jiang, Jiayi, et al.
Pubblicazione: (2024)
di: Jiang, Jiayi, et al.
Pubblicazione: (2024)
Bin2Vec: Interpretable and Auditable Multi-View Binary Analysis for Code Plagiarism Detection
di: Moussaoui, Moussa, et al.
Pubblicazione: (2025)
di: Moussaoui, Moussa, et al.
Pubblicazione: (2025)
Counterexample Guided Branching via Directional Relaxation Analysis in Complete Neural Network Verification
di: Li, Jingyang, et al.
Pubblicazione: (2026)
di: Li, Jingyang, et al.
Pubblicazione: (2026)
Studying and Benchmarking Large Language Models For Log Level Suggestion
di: Heng, Yi Wen, et al.
Pubblicazione: (2024)
di: Heng, Yi Wen, et al.
Pubblicazione: (2024)
Enhancing Semantic Understanding in Pointer Analysis using Large Language Models
di: Cheng, Baijun, et al.
Pubblicazione: (2025)
di: Cheng, Baijun, et al.
Pubblicazione: (2025)
Benchmarking Large Language Models for Multi-Language Software Vulnerability Detection
di: Zhang, Ting, et al.
Pubblicazione: (2025)
di: Zhang, Ting, et al.
Pubblicazione: (2025)
Semantic-Enhanced Indirect Call Analysis with Large Language Models
di: Cheng, Baijun, et al.
Pubblicazione: (2024)
di: Cheng, Baijun, et al.
Pubblicazione: (2024)
Is This the Same Code? A Comprehensive Study of Decompilation Techniques for WebAssembly Binaries
di: Wu, Wei-Cheng, et al.
Pubblicazione: (2024)
di: Wu, Wei-Cheng, et al.
Pubblicazione: (2024)
A Survey of AIOps for Failure Management in the Era of Large Language Models
di: Zhang, Lingzhe, et al.
Pubblicazione: (2024)
di: Zhang, Lingzhe, et al.
Pubblicazione: (2024)
Strengthening Programming Comprehension in Large Language Models through Code Generation
di: Ren, Xiaoning, et al.
Pubblicazione: (2025)
di: Ren, Xiaoning, et al.
Pubblicazione: (2025)
SpecEval: Evaluating Code Comprehension in Large Language Models via Program Specifications
di: Ma, Lezhi, et al.
Pubblicazione: (2024)
di: Ma, Lezhi, et al.
Pubblicazione: (2024)
Self-planning Code Generation with Large Language Models
di: Jiang, Xue, et al.
Pubblicazione: (2023)
di: Jiang, Xue, et al.
Pubblicazione: (2023)
A Real-World Benchmark for Evaluating Fine-Grained Issue Solving Capabilities of Large Language Models
di: Hu, Ruida, et al.
Pubblicazione: (2024)
di: Hu, Ruida, et al.
Pubblicazione: (2024)
Assessing and Advancing Benchmarks for Evaluating Large Language Models in Software Engineering Tasks
di: Hu, Xing, et al.
Pubblicazione: (2025)
di: Hu, Xing, et al.
Pubblicazione: (2025)
Attention Distance: A Novel Metric for Directed Fuzzing with Large Language Models
di: Bin, Wang, et al.
Pubblicazione: (2025)
di: Bin, Wang, et al.
Pubblicazione: (2025)
A Software Engineering Perspective on Testing Large Language Models: Research, Practice, Tools and Benchmarks
di: Hudson, Sinclair, et al.
Pubblicazione: (2024)
di: Hudson, Sinclair, et al.
Pubblicazione: (2024)
A Tool for Benchmarking Large Language Models' Robustness in Assessing the Realism of Driving Scenarios
di: Wu, Jiahui, et al.
Pubblicazione: (2025)
di: Wu, Jiahui, et al.
Pubblicazione: (2025)
The Emergence of Large Language Models in Static Analysis: A First Look through Micro-Benchmarks
di: Venkatesh, Ashwin Prasad Shivarpatna, et al.
Pubblicazione: (2024)
di: Venkatesh, Ashwin Prasad Shivarpatna, et al.
Pubblicazione: (2024)
Enhancing Automated Loop Invariant Generation for Complex Programs with Large Language Models
di: Liu, Ruibang, et al.
Pubblicazione: (2024)
di: Liu, Ruibang, et al.
Pubblicazione: (2024)
Your Fix Is My Exploit: Enabling Comprehensive DL Library API Fuzzing with Large Language Models
di: Zhang, Kunpeng, et al.
Pubblicazione: (2025)
di: Zhang, Kunpeng, et al.
Pubblicazione: (2025)
A Code Comprehension Benchmark for Large Language Models for Code
di: Havare, Jayant, et al.
Pubblicazione: (2025)
di: Havare, Jayant, et al.
Pubblicazione: (2025)
PromCopilot: Simplifying Prometheus Metric Querying in Cloud Native Online Service Systems via Large Language Models
di: Zhang, Chenxi, et al.
Pubblicazione: (2025)
di: Zhang, Chenxi, et al.
Pubblicazione: (2025)
Optimizing Knowledge Utilization for Multi-Intent Comment Generation with Large Language Models
di: Li, Shuochuan, et al.
Pubblicazione: (2025)
di: Li, Shuochuan, et al.
Pubblicazione: (2025)
BinaryAI: Binary Software Composition Analysis via Intelligent Binary Source Code Matching
di: Jiang, Ling, et al.
Pubblicazione: (2024)
di: Jiang, Ling, et al.
Pubblicazione: (2024)
Large Language Models Versus Static Code Analysis Tools: A Systematic Benchmark for Vulnerability Detection
di: Gnieciak, Damian, et al.
Pubblicazione: (2025)
di: Gnieciak, Damian, et al.
Pubblicazione: (2025)
CoCo-Bench: A Comprehensive Code Benchmark For Multi-task Large Language Model Evaluation
di: Yin, Wenjing, et al.
Pubblicazione: (2025)
di: Yin, Wenjing, et al.
Pubblicazione: (2025)
VulStamp: Vulnerability Assessment using Large Language Model
di: Shen, Hao, et al.
Pubblicazione: (2025)
di: Shen, Hao, et al.
Pubblicazione: (2025)
Documenti analoghi
-
An Empirical Study on the Effectiveness of Large Language Models for Binary Code Understanding
di: Shang, Xiuwei, et al.
Pubblicazione: (2025) -
Binary Code Similarity Detection via Graph Contrastive Learning on Intermediate Representations
di: Shang, Xiuwei, et al.
Pubblicazione: (2024) -
CompileAgent: Automated Real-World Repo-Level Compilation with Tool-Integrated LLM-based Agent System
di: Hu, Li, et al.
Pubblicazione: (2025) -
How Far Have We Gone in Binary Code Understanding Using Large Language Models
di: Shang, Xiuwei, et al.
Pubblicazione: (2024) -
Can LLMs Deobfuscate Binary Code? A Systematic Analysis of Large Language Models into Pseudocode Deobfuscation
di: Hu, Li, et al.
Pubblicazione: (2026)