CRUST-Bench: A Comprehensive Benchmark for C-to-safe-Rust Transpilation
Fuente:
arXiv
Saved in:
| Main Authors: | Khatry, Anirudh, Zhang, Robert, Pan, Jia, Wang, Ziteng, Chen, Qiaochu, Durrett, Greg, Dillig, Isil |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
VeriSoftBench: Repository-Scale Formal Verification Benchmarks for Lean
by: Xin, Yutong, et al.
Published: (2026)
by: Xin, Yutong, et al.
Published: (2026)
Coeditor: Leveraging Contextual Changes for Multi-round Code Auto-editing
by: Wei, Jiayi, et al.
Published: (2023)
by: Wei, Jiayi, et al.
Published: (2023)
Towards a Transpiler for C/C++ to Safer Rust
by: Tripuramallu, Dhiren, et al.
Published: (2024)
by: Tripuramallu, Dhiren, et al.
Published: (2024)
VERT: Verified Equivalent Rust Transpilation with Large Language Models as Few-Shot Learners
by: Yang, Aidan Z. H., et al.
Published: (2024)
by: Yang, Aidan Z. H., et al.
Published: (2024)
ORBIT: Guided Agentic Orchestration for Autonomous C-to-Rust Transpilation
by: Farrukh, Muhammad, et al.
Published: (2026)
by: Farrukh, Muhammad, et al.
Published: (2026)
Guess & Sketch: Language Model Guided Transpilation
by: Lee, Celine, et al.
Published: (2023)
by: Lee, Celine, et al.
Published: (2023)
CodeUpdateArena: Benchmarking Knowledge Editing on API Updates
by: Liu, Zeyu Leo, et al.
Published: (2024)
by: Liu, Zeyu Leo, et al.
Published: (2024)
RustAssure: Differential Symbolic Testing for LLM-Transpiled C-to-Rust Code
by: Bai, Yubo, et al.
Published: (2025)
by: Bai, Yubo, et al.
Published: (2025)
SafeTrans: LLM-assisted Transpilation from C to Rust
by: Farrukh, Muhammad, et al.
Published: (2025)
by: Farrukh, Muhammad, et al.
Published: (2025)
LLM4C2Rust: Large Language Models for Automated Memory-Safe Code Transpilation
by: Bedell, Sarah, et al.
Published: (2026)
by: Bedell, Sarah, et al.
Published: (2026)
Guaranteed Guess: A Language Modeling Approach for CISC-to-RISC Transpilation with Testing Guarantees
by: Heakl, Ahmed, et al.
Published: (2025)
by: Heakl, Ahmed, et al.
Published: (2025)
Conditional Execution of Transpiler Passes Based on Per-Script Feature Detection
by: Bhatia, Rishipal Singh
Published: (2026)
by: Bhatia, Rishipal Singh
Published: (2026)
Syzygy: Dual Code-Test C to (safe) Rust Translation using LLMs and Dynamic Analysis
by: Shetty, Manish, et al.
Published: (2024)
by: Shetty, Manish, et al.
Published: (2024)
Translating Large-Scale C Repositories to Idiomatic Rust
by: Dehghan, Saman, et al.
Published: (2025)
by: Dehghan, Saman, et al.
Published: (2025)
CLEVER: A Curated Benchmark for Formally Verified Code Generation
by: Thakur, Amitayush, et al.
Published: (2025)
by: Thakur, Amitayush, et al.
Published: (2025)
ISD-Agent-Bench: A Comprehensive Benchmark for Evaluating LLM-based Instructional Design Agents
by: Jeon, YoungHoon, et al.
Published: (2026)
by: Jeon, YoungHoon, et al.
Published: (2026)
Semantically Aligned Question and Code Generation for Automated Insight Generation
by: Singha, Ananya, et al.
Published: (2024)
by: Singha, Ananya, et al.
Published: (2024)
TDD-Bench Verified: Can LLMs Generate Tests for Issues Before They Get Resolved?
by: Ahmed, Toufique, et al.
Published: (2024)
by: Ahmed, Toufique, et al.
Published: (2024)
CodePivot: Bootstrapping Multilingual Transpilation in LLMs via Reinforcement Learning without Parallel Corpora
by: Li, Shangyu, et al.
Published: (2026)
by: Li, Shangyu, et al.
Published: (2026)
EvoCodeBench: An Evolving Code Generation Benchmark with Domain-Specific Evaluations
by: Li, Jia, et al.
Published: (2024)
by: Li, Jia, et al.
Published: (2024)
DafnyBench: A Benchmark for Formal Software Verification
by: Loughridge, Chloe, et al.
Published: (2024)
by: Loughridge, Chloe, et al.
Published: (2024)
EffiBench: Benchmarking the Efficiency of Automatically Generated Code
by: Huang, Dong, et al.
Published: (2024)
by: Huang, Dong, et al.
Published: (2024)
An Interactive Debugger for Rust Trait Errors
by: Gray, Gavin, et al.
Published: (2025)
by: Gray, Gavin, et al.
Published: (2025)
JavaBench: A Benchmark of Object-Oriented Code Generation for Evaluating Large Language Models
by: Cao, Jialun, et al.
Published: (2024)
by: Cao, Jialun, et al.
Published: (2024)
A Core Calculus for Type-safe Product Lines of C Programs
by: Damiani, Ferruccio, et al.
Published: (2026)
by: Damiani, Ferruccio, et al.
Published: (2026)
EquiBench: Benchmarking Large Language Models' Reasoning about Program Semantics via Equivalence Checking
by: Wei, Anjiang, et al.
Published: (2025)
by: Wei, Anjiang, et al.
Published: (2025)
Raw Pointer Rewriting with LLMs for Translating C to Safer Rust
by: Gao, Yifei, et al.
Published: (2025)
by: Gao, Yifei, et al.
Published: (2025)
Search-Based Multi-Trajectory Refinement for Safe C-to-Rust Translation with Large Language Models
by: Sim, HoHyun, et al.
Published: (2025)
by: Sim, HoHyun, et al.
Published: (2025)
CodeSpecBench: Benchmarking LLMs for Executable Behavioral Specification Generation
by: Chen, Zaoyu, et al.
Published: (2026)
by: Chen, Zaoyu, et al.
Published: (2026)
Static Deadlock Detection for Rust Programs
by: Zhang, Yu, et al.
Published: (2024)
by: Zhang, Yu, et al.
Published: (2024)
CommitBench: A Benchmark for Commit Message Generation
by: Schall, Maximilian, et al.
Published: (2024)
by: Schall, Maximilian, et al.
Published: (2024)
NaturalCodeBench: Examining Coding Performance Mismatch on HumanEval and Natural User Prompts
by: Zhang, Shudan, et al.
Published: (2024)
by: Zhang, Shudan, et al.
Published: (2024)
Unlocking a New Rust Programming Experience: Fast and Slow Thinking with LLMs to Conquer Undefined Behaviors
by: Jiang, Renshuang, et al.
Published: (2025)
by: Jiang, Renshuang, et al.
Published: (2025)
PerfCodeBench: Benchmarking LLMs for System-Level High-Performance Code Optimization
by: Jing, Huihao, et al.
Published: (2026)
by: Jing, Huihao, et al.
Published: (2026)
AutoCodeBench: Large Language Models are Automatic Code Benchmark Generators
by: Chou, Jason, et al.
Published: (2025)
by: Chou, Jason, et al.
Published: (2025)
RustRepoTrans: Repository-level Code Translation Benchmark Targeting Rust
by: Ou, Guangsheng, et al.
Published: (2024)
by: Ou, Guangsheng, et al.
Published: (2024)
LiveCodeBench: Holistic and Contamination Free Evaluation of Large Language Models for Code
by: Jain, Naman, et al.
Published: (2024)
by: Jain, Naman, et al.
Published: (2024)
Characterizing Unsafe Code Encapsulation In Real-world Rust Systems
by: Rao, Zihao, et al.
Published: (2024)
by: Rao, Zihao, et al.
Published: (2024)
Translating C To Rust: Lessons from a User Study
by: Li, Ruishi, et al.
Published: (2024)
by: Li, Ruishi, et al.
Published: (2024)
CodeFlowBench: A Multi-turn, Iterative Benchmark for Complex Code Generation
by: Wang, Sizhe, et al.
Published: (2025)
by: Wang, Sizhe, et al.
Published: (2025)
Similar Items
-
VeriSoftBench: Repository-Scale Formal Verification Benchmarks for Lean
by: Xin, Yutong, et al.
Published: (2026) -
Coeditor: Leveraging Contextual Changes for Multi-round Code Auto-editing
by: Wei, Jiayi, et al.
Published: (2023) -
Towards a Transpiler for C/C++ to Safer Rust
by: Tripuramallu, Dhiren, et al.
Published: (2024) -
VERT: Verified Equivalent Rust Transpilation with Large Language Models as Few-Shot Learners
by: Yang, Aidan Z. H., et al.
Published: (2024) -
ORBIT: Guided Agentic Orchestration for Autonomous C-to-Rust Transpilation
by: Farrukh, Muhammad, et al.
Published: (2026)