ConCodeEval: Evaluating Large Language Models for Code Constraints in Domain-Specific Languages
Fuente:
arXiv
Salvato in:
| Autori principali: | Kammakomati, Mehant, Pimparkhede, Sameer, Tamilselvam, Srikanth, Kumar, Prince, Bhattacharyya, Pushpak |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
DocCGen: Document-based Controlled Code Generation
di: Pimparkhede, Sameer, et al.
Pubblicazione: (2024)
di: Pimparkhede, Sameer, et al.
Pubblicazione: (2024)
ETF: An Entity Tracing Framework for Hallucination Detection in Code Summaries
di: Maharaj, Kishan, et al.
Pubblicazione: (2024)
di: Maharaj, Kishan, et al.
Pubblicazione: (2024)
A Code Comprehension Benchmark for Large Language Models for Code
di: Havare, Jayant, et al.
Pubblicazione: (2025)
di: Havare, Jayant, et al.
Pubblicazione: (2025)
Robustness and Reasoning Fidelity of Large Language Models in Long-Context Code Question Answering
di: Maharaj, Kishan, et al.
Pubblicazione: (2026)
di: Maharaj, Kishan, et al.
Pubblicazione: (2026)
VHDL-Eval: A Framework for Evaluating Large Language Models in VHDL Code Generation
di: Vijayaraghavan, Prashanth, et al.
Pubblicazione: (2024)
di: Vijayaraghavan, Prashanth, et al.
Pubblicazione: (2024)
CodeMind: Evaluating Large Language Models for Code Reasoning
di: Liu, Changshu, et al.
Pubblicazione: (2024)
di: Liu, Changshu, et al.
Pubblicazione: (2024)
Lost in Transcription: How Speech-to-Text Errors Derail Code Understanding
di: Havare, Jayant, et al.
Pubblicazione: (2026)
di: Havare, Jayant, et al.
Pubblicazione: (2026)
MonoCoder: Domain-Specific Code Language Model for HPC Codes and Tasks
di: Kadosh, Tal, et al.
Pubblicazione: (2023)
di: Kadosh, Tal, et al.
Pubblicazione: (2023)
Is Your AI-Generated Code Really Safe? Evaluating Large Language Models on Secure Code Generation with CodeSecEval
di: Wang, Jiexin, et al.
Pubblicazione: (2024)
di: Wang, Jiexin, et al.
Pubblicazione: (2024)
CodeJudge-Eval: Can Large Language Models be Good Judges in Code Understanding?
di: Zhao, Yuwei, et al.
Pubblicazione: (2024)
di: Zhao, Yuwei, et al.
Pubblicazione: (2024)
ICE-Score: Instructing Large Language Models to Evaluate Code
di: Zhuo, Terry Yue
Pubblicazione: (2023)
di: Zhuo, Terry Yue
Pubblicazione: (2023)
CodeIF-Bench: Evaluating Instruction-Following Capabilities of Large Language Models in Interactive Code Generation
di: Wang, Peiding, et al.
Pubblicazione: (2025)
di: Wang, Peiding, et al.
Pubblicazione: (2025)
CodeMirage: Hallucinations in Code Generated by Large Language Models
di: Agarwal, Vibhor, et al.
Pubblicazione: (2024)
di: Agarwal, Vibhor, et al.
Pubblicazione: (2024)
Large Language Model Critics for Execution-Free Evaluation of Code Changes
di: Yadavally, Aashish, et al.
Pubblicazione: (2025)
di: Yadavally, Aashish, et al.
Pubblicazione: (2025)
Testing the Effect of Code Documentation on Large Language Model Code Understanding
di: Macke, William, et al.
Pubblicazione: (2024)
di: Macke, William, et al.
Pubblicazione: (2024)
HumanEval Pro and MBPP Pro: Evaluating Large Language Models on Self-invoking Code Generation
di: Yu, Zhaojian, et al.
Pubblicazione: (2024)
di: Yu, Zhaojian, et al.
Pubblicazione: (2024)
ArchCode: Incorporating Software Requirements in Code Generation with Large Language Models
di: Han, Hojae, et al.
Pubblicazione: (2024)
di: Han, Hojae, et al.
Pubblicazione: (2024)
AdaptEval: A Benchmark for Evaluating Large Language Models on Code Snippet Adaptation
di: Zhang, Tanghaoran, et al.
Pubblicazione: (2026)
di: Zhang, Tanghaoran, et al.
Pubblicazione: (2026)
CodeEditorBench: Evaluating Code Editing Capability of Large Language Models
di: Guo, Jiawei, et al.
Pubblicazione: (2024)
di: Guo, Jiawei, et al.
Pubblicazione: (2024)
DevEval: Evaluating Code Generation in Practical Software Projects
di: Li, Jia, et al.
Pubblicazione: (2024)
di: Li, Jia, et al.
Pubblicazione: (2024)
SwiftEval: Developing a Language-Specific Benchmark for LLM-generated Code Evaluation
di: Petrukha, Ivan, et al.
Pubblicazione: (2025)
di: Petrukha, Ivan, et al.
Pubblicazione: (2025)
Is Functional Correctness Enough to Evaluate Code Language Models? Exploring Diversity of Generated Codes
di: Chon, Heejae, et al.
Pubblicazione: (2024)
di: Chon, Heejae, et al.
Pubblicazione: (2024)
A Survey on Large Language Models for Code Generation
di: Jiang, Juyong, et al.
Pubblicazione: (2024)
di: Jiang, Juyong, et al.
Pubblicazione: (2024)
Analyzing the Performance of Large Language Models on Code Summarization
di: Haldar, Rajarshi, et al.
Pubblicazione: (2024)
di: Haldar, Rajarshi, et al.
Pubblicazione: (2024)
CodeVisionary: An Agent-based Framework for Evaluating Large Language Models in Code Generation
di: Wang, Xinchen, et al.
Pubblicazione: (2025)
di: Wang, Xinchen, et al.
Pubblicazione: (2025)
SpecEval: Evaluating Code Comprehension in Large Language Models via Program Specifications
di: Ma, Lezhi, et al.
Pubblicazione: (2024)
di: Ma, Lezhi, et al.
Pubblicazione: (2024)
Asm2SrcEval: Evaluating Large Language Models for Assembly-to-Source Code Translation
di: Hamedi, Parisa, et al.
Pubblicazione: (2025)
di: Hamedi, Parisa, et al.
Pubblicazione: (2025)
CodexGraph: Bridging Large Language Models and Code Repositories via Code Graph Databases
di: Liu, Xiangyan, et al.
Pubblicazione: (2024)
di: Liu, Xiangyan, et al.
Pubblicazione: (2024)
Enabling Communication via APIs for Mainframe Applications
di: Kanvar, Vini, et al.
Pubblicazione: (2024)
di: Kanvar, Vini, et al.
Pubblicazione: (2024)
Perish or Flourish? A Holistic Evaluation of Large Language Models for Code Generation in Functional Programming
di: Lang, Nguyet-Anh H., et al.
Pubblicazione: (2026)
di: Lang, Nguyet-Anh H., et al.
Pubblicazione: (2026)
SV-TrustEval-C: Evaluating Structure and Semantic Reasoning in Large Language Models for Source Code Vulnerability Analysis
di: Li, Yansong, et al.
Pubblicazione: (2025)
di: Li, Yansong, et al.
Pubblicazione: (2025)
Large Language Models for Code Summarization
di: Szalontai, Balázs, et al.
Pubblicazione: (2024)
di: Szalontai, Balázs, et al.
Pubblicazione: (2024)
TaskEval: Assessing Difficulty of Code Generation Tasks for Large Language Models
di: Tambon, Florian, et al.
Pubblicazione: (2024)
di: Tambon, Florian, et al.
Pubblicazione: (2024)
EvoCodeBench: An Evolving Code Generation Benchmark with Domain-Specific Evaluations
di: Li, Jia, et al.
Pubblicazione: (2024)
di: Li, Jia, et al.
Pubblicazione: (2024)
Exploring Data-Efficient Adaptation of Large Language Models for Code Generation
di: Jiang, Xue, et al.
Pubblicazione: (2024)
di: Jiang, Xue, et al.
Pubblicazione: (2024)
Astraios: Parameter-Efficient Instruction Tuning Code Large Language Models
di: Zhuo, Terry Yue, et al.
Pubblicazione: (2024)
di: Zhuo, Terry Yue, et al.
Pubblicazione: (2024)
Self-Explained Keywords Empower Large Language Models for Code Generation
di: Fan, Lishui, et al.
Pubblicazione: (2024)
di: Fan, Lishui, et al.
Pubblicazione: (2024)
CODESYNC: Synchronizing Large Language Models with Dynamic Code Evolution at Scale
di: Wang, Chenlong, et al.
Pubblicazione: (2025)
di: Wang, Chenlong, et al.
Pubblicazione: (2025)
Main Predicate and Their Arguments as Explanation Signals For Intent Classification
di: Pimparkhede, Sameer, et al.
Pubblicazione: (2025)
di: Pimparkhede, Sameer, et al.
Pubblicazione: (2025)
Mitigating Gender Bias in Code Large Language Models via Model Editing
di: Qin, Zhanyue, et al.
Pubblicazione: (2024)
di: Qin, Zhanyue, et al.
Pubblicazione: (2024)
Documenti analoghi
-
DocCGen: Document-based Controlled Code Generation
di: Pimparkhede, Sameer, et al.
Pubblicazione: (2024) -
ETF: An Entity Tracing Framework for Hallucination Detection in Code Summaries
di: Maharaj, Kishan, et al.
Pubblicazione: (2024) -
A Code Comprehension Benchmark for Large Language Models for Code
di: Havare, Jayant, et al.
Pubblicazione: (2025) -
Robustness and Reasoning Fidelity of Large Language Models in Long-Context Code Question Answering
di: Maharaj, Kishan, et al.
Pubblicazione: (2026) -
VHDL-Eval: A Framework for Evaluating Large Language Models in VHDL Code Generation
di: Vijayaraghavan, Prashanth, et al.
Pubblicazione: (2024)