Saved in:
| Main Authors: | Pulavarthi, Vaishnavi, Nandal, Deeksha, Dan, Soham, Pal, Debjit |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | https://arxiv.org/abs/2406.18627 |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Are LLMs Ready for Practical Adoption for Assertion Generation?
by: Pulavarthi, Vaishnavi, et al.
Published: (2025)
by: Pulavarthi, Vaishnavi, et al.
Published: (2025)
LAUDE: LLM-Assisted Unit Test Generation and Debugging of Hardware DEsigns
by: Nandal, Deeksha, et al.
Published: (2026)
by: Nandal, Deeksha, et al.
Published: (2026)
ChIRAAG: ChatGPT Informed Rapid and Automated Assertion Generation
by: Mali, Bhabesh, et al.
Published: (2024)
by: Mali, Bhabesh, et al.
Published: (2024)
Towards Counterfactual Explanation and Assertion Inference for CPS Debugging
by: Ghazal, Zaid, et al.
Published: (2026)
by: Ghazal, Zaid, et al.
Published: (2026)
Assertion Messages with Large Language Models (LLMs) for Code
by: Aljohani, Ahmed, et al.
Published: (2025)
by: Aljohani, Ahmed, et al.
Published: (2025)
Automatic Assertion Mining in Assertion-Based Verification: Techniques, Challenges, and Future Directions
by: Iman, Mohammad Reza Heidari, et al.
Published: (2026)
by: Iman, Mohammad Reza Heidari, et al.
Published: (2026)
Assertion-Aware Test Code Summarization with Large Language Models
by: Mollah, Anamul Haque, et al.
Published: (2025)
by: Mollah, Anamul Haque, et al.
Published: (2025)
SPADE: Synthesizing Data Quality Assertions for Large Language Model Pipelines
by: Shankar, Shreya, et al.
Published: (2024)
by: Shankar, Shreya, et al.
Published: (2024)
CPP-UT-Bench: Can LLMs Write Complex Unit Tests in C++?
by: Bhargava, Vaishnavi, et al.
Published: (2024)
by: Bhargava, Vaishnavi, et al.
Published: (2024)
DeCon: Detecting Incorrect Assertions via Postconditions Generated by a Large Language Model
by: Yu, Hao, et al.
Published: (2025)
by: Yu, Hao, et al.
Published: (2025)
JavaBench: A Benchmark of Object-Oriented Code Generation for Evaluating Large Language Models
by: Cao, Jialun, et al.
Published: (2024)
by: Cao, Jialun, et al.
Published: (2024)
Fine-Grained Assertion-Based Test Selection
by: Gu, Sijia, et al.
Published: (2024)
by: Gu, Sijia, et al.
Published: (2024)
Understanding and Characterizing Mock Assertions in Unit Tests
by: Zhu, Hengcheng, et al.
Published: (2025)
by: Zhu, Hengcheng, et al.
Published: (2025)
InfiBench: Evaluating the Question-Answering Capabilities of Code Large Language Models
by: Li, Linyi, et al.
Published: (2024)
by: Li, Linyi, et al.
Published: (2024)
AsserT5: Test Assertion Generation Using a Fine-Tuned Code Language Model
by: Primbs, Severin, et al.
Published: (2025)
by: Primbs, Severin, et al.
Published: (2025)
A Time Series Analysis of Assertions in the Linux Kernel
by: Ruohonen, Jukka
Published: (2024)
by: Ruohonen, Jukka
Published: (2024)
ContractEval: A Benchmark for Evaluating Contract-Satisfying Assertions in Code Generation
by: Lim, Soohan, et al.
Published: (2025)
by: Lim, Soohan, et al.
Published: (2025)
Improving Retrieval-Augmented Deep Assertion Generation via Joint Training
by: Zhang, Quanjun, et al.
Published: (2025)
by: Zhang, Quanjun, et al.
Published: (2025)
Improving Deep Assertion Generation via Fine-Tuning Retrieval-Augmented Pre-trained Language Models
by: Zhang, Quanjun, et al.
Published: (2025)
by: Zhang, Quanjun, et al.
Published: (2025)
A Regression Testing Framework with Automated Assertion Generation for Machine Learning Notebooks
by: Yao, Yingao Elaine, et al.
Published: (2025)
by: Yao, Yingao Elaine, et al.
Published: (2025)
OSS-Bench: Benchmark Generator for Coding LLMs
by: Jiang, Yuancheng, et al.
Published: (2025)
by: Jiang, Yuancheng, et al.
Published: (2025)
IDE-Bench: Evaluating Large Language Models as IDE Agents on Real-World Software Engineering Tasks
by: Mateega, Spencer, et al.
Published: (2026)
by: Mateega, Spencer, et al.
Published: (2026)
Bloch Vector Assertions for Debugging Quantum Programs
by: Oldfield, Noah H., et al.
Published: (2025)
by: Oldfield, Noah H., et al.
Published: (2025)
AICD Bench: A Challenging Benchmark for AI-Generated Code Detection
by: Orel, Daniil, et al.
Published: (2026)
by: Orel, Daniil, et al.
Published: (2026)
CodeIF: Benchmarking the Instruction-Following Capabilities of Large Language Models for Code Generation
by: Yan, Kaiwen, et al.
Published: (2025)
by: Yan, Kaiwen, et al.
Published: (2025)
ASSERTIFY: Utilizing Large Language Models to Generate Assertions for Production Code
by: Torkamani, Mohammad Jalili, et al.
Published: (2024)
by: Torkamani, Mohammad Jalili, et al.
Published: (2024)
LiveCodeBench: Holistic and Contamination Free Evaluation of Large Language Models for Code
by: Jain, Naman, et al.
Published: (2024)
by: Jain, Naman, et al.
Published: (2024)
MermaidSeqBench: An Evaluation Benchmark for NL-to-Mermaid Sequence Diagram Generation
by: Shbita, Basel, et al.
Published: (2025)
by: Shbita, Basel, et al.
Published: (2025)
Towards Automatic Translation of Machine Learning Visual Insights to Analytical Assertions
by: Shome, Arumoy, et al.
Published: (2024)
by: Shome, Arumoy, et al.
Published: (2024)
EsoLang-Bench: Evaluating Genuine Reasoning in Large Language Models via Esoteric Programming Languages
by: Sharma, Aman, et al.
Published: (2026)
by: Sharma, Aman, et al.
Published: (2026)
EnvBench: A Benchmark for Automated Environment Setup
by: Eliseeva, Aleksandra, et al.
Published: (2025)
by: Eliseeva, Aleksandra, et al.
Published: (2025)
DevBench: A Realistic, Developer-Informed Benchmark for Code Generation Models
by: Kumarappan, Adarsh, et al.
Published: (2026)
by: Kumarappan, Adarsh, et al.
Published: (2026)
Large Language Models for Code Generation: A Comprehensive Survey of Challenges, Techniques, Evaluation, and Applications
by: Huynh, Nam, et al.
Published: (2025)
by: Huynh, Nam, et al.
Published: (2025)
Benchmarking Large Language Models with Integer Sequence Generation Tasks
by: O'Malley, Daniel, et al.
Published: (2024)
by: O'Malley, Daniel, et al.
Published: (2024)
On the Rationale and Use of Assertion Messages in Test Code: Insights from Software Practitioners
by: Peruma, Anthony, et al.
Published: (2024)
by: Peruma, Anthony, et al.
Published: (2024)
ThrowBench: Benchmarking LLMs by Predicting Runtime Exceptions
by: Prenner, Julian Aron, et al.
Published: (2025)
by: Prenner, Julian Aron, et al.
Published: (2025)
AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models
by: Lee, Jaeho, et al.
Published: (2025)
by: Lee, Jaeho, et al.
Published: (2025)
CodeEditorBench: Evaluating Code Editing Capability of Large Language Models
by: Guo, Jiawei, et al.
Published: (2024)
by: Guo, Jiawei, et al.
Published: (2024)
MobileDev-Bench: A Benchmark for Issue Resolution in Mobile Application Development
by: Fakorede, Moshood A., et al.
Published: (2026)
by: Fakorede, Moshood A., et al.
Published: (2026)
Deep-Bench: Deep Learning Benchmark Dataset for Code Generation
by: Daghighfarsoodeh, Alireza, et al.
Published: (2025)
by: Daghighfarsoodeh, Alireza, et al.
Published: (2025)
Similar Items
-
Are LLMs Ready for Practical Adoption for Assertion Generation?
by: Pulavarthi, Vaishnavi, et al.
Published: (2025) -
LAUDE: LLM-Assisted Unit Test Generation and Debugging of Hardware DEsigns
by: Nandal, Deeksha, et al.
Published: (2026) -
ChIRAAG: ChatGPT Informed Rapid and Automated Assertion Generation
by: Mali, Bhabesh, et al.
Published: (2024) -
Towards Counterfactual Explanation and Assertion Inference for CPS Debugging
by: Ghazal, Zaid, et al.
Published: (2026) -
Assertion Messages with Large Language Models (LLMs) for Code
by: Aljohani, Ahmed, et al.
Published: (2025)