QuanBench: Benchmarking Quantum Code Generation with Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Guo, Xiaoyu, Wang, Minggu, Zhao, Jianjun |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
QuanBench+: A Unified Multi-Framework Benchmark for LLM-Based Quantum Code Generation
par: Slim, Ali, et autres
Publié: (2026)
par: Slim, Ali, et autres
Publié: (2026)
QuanUML: Towards A Modeling Language for Model-Driven Quantum Software Development
par: Guo, Xiaoyu, et autres
Publié: (2025)
par: Guo, Xiaoyu, et autres
Publié: (2025)
QuanForge: A Mutation Testing Framework for Quantum Neural Networks
par: Shao, Minqi, et autres
Publié: (2026)
par: Shao, Minqi, et autres
Publié: (2026)
M2QCode: A Model-Driven Framework for Generating Multi-Platform Quantum Programs
par: Guo, Xiaoyu, et autres
Publié: (2025)
par: Guo, Xiaoyu, et autres
Publié: (2025)
Quantum Circuit Ansatz: Patterns of Abstraction and Reuse of Quantum Algorithm Design
par: Guo, Xiaoyu, et autres
Publié: (2024)
par: Guo, Xiaoyu, et autres
Publié: (2024)
SimdBench: Benchmarking Large Language Models for SIMD-Intrinsic Code Generation
par: He, Yibo, et autres
Publié: (2025)
par: He, Yibo, et autres
Publié: (2025)
AutoCodeBench: Large Language Models are Automatic Code Benchmark Generators
par: Chou, Jason, et autres
Publié: (2025)
par: Chou, Jason, et autres
Publié: (2025)
On Repairing Quantum Programs Using ChatGPT
par: Guo, Xiaoyu, et autres
Publié: (2024)
par: Guo, Xiaoyu, et autres
Publié: (2024)
CodeGolf Bench: A Multi-Language Benchmark for Evaluating Concise Code Generation Capabilities of Large Language Models
par: Padwal, Vedant
Publié: (2026)
par: Padwal, Vedant
Publié: (2026)
DSCodeBench: A Realistic Benchmark for Data Science Code Generation
par: Ouyang, Shuyin, et autres
Publié: (2025)
par: Ouyang, Shuyin, et autres
Publié: (2025)
CodeIF: Benchmarking the Instruction-Following Capabilities of Large Language Models for Code Generation
par: Yan, Kaiwen, et autres
Publié: (2025)
par: Yan, Kaiwen, et autres
Publié: (2025)
Quantum Concolic Testing
par: Xia, Shangzhou, et autres
Publié: (2024)
par: Xia, Shangzhou, et autres
Publié: (2024)
Aligning Requirement for Large Language Model's Code Generation
par: Tian, Zhao, et autres
Publié: (2025)
par: Tian, Zhao, et autres
Publié: (2025)
SWE-Bench+: Enhanced Coding Benchmark for LLMs
par: Aleithan, Reem, et autres
Publié: (2024)
par: Aleithan, Reem, et autres
Publié: (2024)
CoCo-Bench: A Comprehensive Code Benchmark For Multi-task Large Language Model Evaluation
par: Yin, Wenjing, et autres
Publié: (2025)
par: Yin, Wenjing, et autres
Publié: (2025)
CodeSpecBench: Benchmarking LLMs for Executable Behavioral Specification Generation
par: Chen, Zaoyu, et autres
Publié: (2026)
par: Chen, Zaoyu, et autres
Publié: (2026)
SolEval: Benchmarking Large Language Models for Repository-level Solidity Code Generation
par: Peng, Zhiyuan, et autres
Publié: (2025)
par: Peng, Zhiyuan, et autres
Publié: (2025)
Cross-Task Benchmarking and Evaluation of General-Purpose and Code-Specific Large Language Models
par: Das, Gunjan, et autres
Publié: (2025)
par: Das, Gunjan, et autres
Publié: (2025)
DevBench: A Realistic, Developer-Informed Benchmark for Code Generation Models
par: Kumarappan, Adarsh, et autres
Publié: (2026)
par: Kumarappan, Adarsh, et autres
Publié: (2026)
OSS-Bench: Benchmark Generator for Coding LLMs
par: Jiang, Yuancheng, et autres
Publié: (2025)
par: Jiang, Yuancheng, et autres
Publié: (2025)
AssertionBench: A Benchmark to Evaluate Large-Language Models for Assertion Generation
par: Pulavarthi, Vaishnavi, et autres
Publié: (2024)
par: Pulavarthi, Vaishnavi, et autres
Publié: (2024)
Can Large Language Models Generate Geospatial Code?
par: Hou, Shuyang, et autres
Publié: (2024)
par: Hou, Shuyang, et autres
Publié: (2024)
EvoCodeBench: An Evolving Code Generation Benchmark with Domain-Specific Evaluations
par: Li, Jia, et autres
Publié: (2024)
par: Li, Jia, et autres
Publié: (2024)
On the Effectiveness of Large Language Models in Domain-Specific Code Generation
par: Gu, Xiaodong, et autres
Publié: (2023)
par: Gu, Xiaodong, et autres
Publié: (2023)
A Survey on Evaluating Large Language Models in Code Generation Tasks
par: Chen, Liguo, et autres
Publié: (2024)
par: Chen, Liguo, et autres
Publié: (2024)
Unveiling Code Clones in Quantum Programming: An Empirical Study with Qiskit
par: Manoku, Kenta, et autres
Publié: (2025)
par: Manoku, Kenta, et autres
Publié: (2025)
Fixing Large Language Models' Specification Misunderstanding for Better Code Generation
par: Tian, Zhao, et autres
Publié: (2023)
par: Tian, Zhao, et autres
Publié: (2023)
Optimizing Large Language Model Hyperparameters for Code Generation
par: Arora, Chetan, et autres
Publié: (2024)
par: Arora, Chetan, et autres
Publié: (2024)
QuanTest: Entanglement-Guided Testing of Quantum Neural Network Systems
par: Shi, Jinjing, et autres
Publié: (2024)
par: Shi, Jinjing, et autres
Publié: (2024)
A Survey of Large Language Models for Code: Evolution, Benchmarking, and Future Trends
par: Zheng, Zibin, et autres
Publié: (2023)
par: Zheng, Zibin, et autres
Publié: (2023)
CodeFlowBench: A Multi-turn, Iterative Benchmark for Complex Code Generation
par: Wang, Sizhe, et autres
Publié: (2025)
par: Wang, Sizhe, et autres
Publié: (2025)
RealBench: A Repo-Level Code Generation Benchmark Aligned with Real-World Software Development Practices
par: Li, Jia, et autres
Publié: (2026)
par: Li, Jia, et autres
Publié: (2026)
Self-planning Code Generation with Large Language Models
par: Jiang, Xue, et autres
Publié: (2023)
par: Jiang, Xue, et autres
Publié: (2023)
EffiBench: Benchmarking the Efficiency of Automatically Generated Code
par: Huang, Dong, et autres
Publié: (2024)
par: Huang, Dong, et autres
Publié: (2024)
CodeIF-Bench: Evaluating Instruction-Following Capabilities of Large Language Models in Interactive Code Generation
par: Wang, Peiding, et autres
Publié: (2025)
par: Wang, Peiding, et autres
Publié: (2025)
FEA-Bench: A Benchmark for Evaluating Repository-Level Code Generation for Feature Implementation
par: Li, Wei, et autres
Publié: (2025)
par: Li, Wei, et autres
Publié: (2025)
TESTEVAL: Benchmarking Large Language Models for Test Case Generation
par: Wang, Wenhan, et autres
Publié: (2024)
par: Wang, Wenhan, et autres
Publié: (2024)
AICD Bench: A Challenging Benchmark for AI-Generated Code Detection
par: Orel, Daniil, et autres
Publié: (2026)
par: Orel, Daniil, et autres
Publié: (2026)
Software Development Life Cycle Perspective: A Survey of Benchmarks for Code Large Language Models and Agents
par: Wang, Kaixin, et autres
Publié: (2025)
par: Wang, Kaixin, et autres
Publié: (2025)
CodeBenchGen: Creating Scalable Execution-based Code Generation Benchmarks
par: Xie, Yiqing, et autres
Publié: (2024)
par: Xie, Yiqing, et autres
Publié: (2024)
Documents similaires
-
QuanBench+: A Unified Multi-Framework Benchmark for LLM-Based Quantum Code Generation
par: Slim, Ali, et autres
Publié: (2026) -
QuanUML: Towards A Modeling Language for Model-Driven Quantum Software Development
par: Guo, Xiaoyu, et autres
Publié: (2025) -
QuanForge: A Mutation Testing Framework for Quantum Neural Networks
par: Shao, Minqi, et autres
Publié: (2026) -
M2QCode: A Model-Driven Framework for Generating Multi-Platform Quantum Programs
par: Guo, Xiaoyu, et autres
Publié: (2025) -
Quantum Circuit Ansatz: Patterns of Abstraction and Reuse of Quantum Algorithm Design
par: Guo, Xiaoyu, et autres
Publié: (2024)