PromptPex: Automatic Test Generation for Language Model Prompts
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Sharma, Reshabh K, De Halleux, Jonathan, Barke, Shraddha, Grossman, Dan, Zorn, Benjamin |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Willful Disobedience: Automatically Detecting Failures in Agentic Traces
par: Sharma, Reshabh K, et autres
Publié: (2026)
par: Sharma, Reshabh K, et autres
Publié: (2026)
ContextCov: Deriving and Enforcing Executable Constraints from Agent Instruction Files
par: Sharma, Reshabh K
Publié: (2026)
par: Sharma, Reshabh K
Publié: (2026)
Learning Correct Behavior from Examples: Validating Sequential Execution in Autonomous Agents
par: Sharma, Reshabh K, et autres
Publié: (2026)
par: Sharma, Reshabh K, et autres
Publié: (2026)
Solving Data-centric Tasks using Large Language Models
par: Barke, Shraddha, et autres
Publié: (2024)
par: Barke, Shraddha, et autres
Publié: (2024)
Validating LLM-Generated Programs with Metamorphic Prompt Testing
par: Wang, Xiaoyin, et autres
Publié: (2024)
par: Wang, Xiaoyin, et autres
Publié: (2024)
Impact of Code Context and Prompting Strategies on Automated Unit Test Generation with Modern General-Purpose Large Language Models
par: Walczak, Jakub, et autres
Publié: (2025)
par: Walczak, Jakub, et autres
Publié: (2025)
Tests as Prompt: A Test-Driven-Development Benchmark for LLM Code Generation
par: Cui, Yi
Publié: (2025)
par: Cui, Yi
Publié: (2025)
An Empirically-grounded tool for Automatic Prompt Linting and Repair: A Case Study on Bias, Vulnerability, and Optimization in Developer Prompts
par: Rzig, Dhia Elhaq, et autres
Publié: (2025)
par: Rzig, Dhia Elhaq, et autres
Publié: (2025)
The Prompt Alchemist: Automated LLM-Tailored Prompt Optimization for Test Case Generation
par: Gao, Shuzheng, et autres
Publié: (2025)
par: Gao, Shuzheng, et autres
Publié: (2025)
Multi-Sample Prompting and Actor-Critic Prompt Optimization for Diverse Synthetic Data Generation
par: El-Hajjami, Abdelkarim, et autres
Publié: (2025)
par: El-Hajjami, Abdelkarim, et autres
Publié: (2025)
Conventional Commit Classification using Large Language Models and Prompt Engineering
par: Quadir, H. M. Sazzad, et autres
Publié: (2026)
par: Quadir, H. M. Sazzad, et autres
Publié: (2026)
JTPRO: A Joint Tool-Prompt Reflective Optimization Framework for Language Agents
par: Ghoshal, Sandip, et autres
Publié: (2026)
par: Ghoshal, Sandip, et autres
Publié: (2026)
GEMS: Generative Expert Metric System through Iterative Prompt Priming
par: Cheng, Ti-Chung, et autres
Publié: (2024)
par: Cheng, Ti-Chung, et autres
Publié: (2024)
Prompt2DAG: A Modular Methodology for LLM-Based Data Enrichment Pipeline Generation
par: Alidu, Abubakari, et autres
Publié: (2025)
par: Alidu, Abubakari, et autres
Publié: (2025)
INTERVENOR: Prompting the Coding Ability of Large Language Models with the Interactive Chain of Repair
par: Wang, Hanbin, et autres
Publié: (2023)
par: Wang, Hanbin, et autres
Publié: (2023)
Turbulence: Systematically and Automatically Testing Instruction-Tuned Large Language Models for Code
par: Honarvar, Shahin, et autres
Publié: (2023)
par: Honarvar, Shahin, et autres
Publié: (2023)
MultiAIGCD: A Comprehensive dataset for AI Generated Code Detection Covering Multiple Languages, Models,Prompts, and Scenarios
par: Demirok, Basak, et autres
Publié: (2025)
par: Demirok, Basak, et autres
Publié: (2025)
Task-oriented Prompt Enhancement via Script Generation
par: Wang, Chung-Yu, et autres
Publié: (2024)
par: Wang, Chung-Yu, et autres
Publié: (2024)
Evaluating Reliability Gaps in Large Language Model Safety via Repeated Prompt Sampling
par: Broadwater, Keita
Publié: (2026)
par: Broadwater, Keita
Publié: (2026)
Prompt Less, Smile More: MTP with Semantic Engineering in Lieu of Prompt Engineering
par: Dantanarayana, Jayanaka L., et autres
Publié: (2025)
par: Dantanarayana, Jayanaka L., et autres
Publié: (2025)
HoarePrompt: Structural Reasoning About Program Correctness in Natural Language
par: Bouras, Dimitrios Stamatios, et autres
Publié: (2025)
par: Bouras, Dimitrios Stamatios, et autres
Publié: (2025)
TDD Governance for Multi-Agent Code Generation via Prompt Engineering
par: Hasanli, Tarlan, et autres
Publié: (2026)
par: Hasanli, Tarlan, et autres
Publié: (2026)
Analyzing Prompt Influence on Automated Method Generation: An Empirical Study with Copilot
par: Fagadau, Ionut Daniel, et autres
Publié: (2024)
par: Fagadau, Ionut Daniel, et autres
Publié: (2024)
The Readability Spectrum: Patterns, Issues, and Prompt Effects in LLM-Generated Code
par: Ye, Hengzhi, et autres
Publié: (2026)
par: Ye, Hengzhi, et autres
Publié: (2026)
Prompt Migration: Stabilizing GenAI Applications with Evolving Large Language Models
par: Tripathi, Shivani, et autres
Publié: (2025)
par: Tripathi, Shivani, et autres
Publié: (2025)
Mitigating Prompt-Induced Cognitive Biases in General-Purpose AI for Software Engineering
par: Sovrano, Francesco, et autres
Publié: (2026)
par: Sovrano, Francesco, et autres
Publié: (2026)
Mind the Prompt: Self-adaptive Generation of Task Plan Explanations via LLMs
par: Vázquez, Gricel, et autres
Publié: (2026)
par: Vázquez, Gricel, et autres
Publié: (2026)
PathOCL: Path-Based Prompt Augmentation for OCL Generation with GPT-4
par: Abukhalaf, Seif, et autres
Publié: (2024)
par: Abukhalaf, Seif, et autres
Publié: (2024)
Selection of Prompt Engineering Techniques for Code Generation through Predicting Code Complexity
par: Wang, Chung-Yu, et autres
Publié: (2024)
par: Wang, Chung-Yu, et autres
Publié: (2024)
Online Prompt Selection for Program Synthesis
par: Li, Yixuan, et autres
Publié: (2025)
par: Li, Yixuan, et autres
Publié: (2025)
Spreadsheet Modeling Experiments Using GPTs on Small Problem Statements and the Wall Task
par: Grossman, Thomas A., et autres
Publié: (2026)
par: Grossman, Thomas A., et autres
Publié: (2026)
Effective Code Membership Inference for Code Completion Models via Adversarial Prompts
par: Jiang, Yuan, et autres
Publié: (2025)
par: Jiang, Yuan, et autres
Publié: (2025)
A System for Automated Unit Test Generation Using Large Language Models and Assessment of Generated Test Suites
par: Lops, Andrea, et autres
Publié: (2024)
par: Lops, Andrea, et autres
Publié: (2024)
app.build: A Production Framework for Scaling Agentic Prompt-to-App Generation with Environment Scaffolding
par: Kniazev, Evgenii, et autres
Publié: (2025)
par: Kniazev, Evgenii, et autres
Publié: (2025)
RAG-MCP: Mitigating Prompt Bloat in LLM Tool Selection via Retrieval-Augmented Generation
par: Gan, Tiantian, et autres
Publié: (2025)
par: Gan, Tiantian, et autres
Publié: (2025)
Large Language Models for Software Testing: A Research Roadmap
par: Augusto, Cristian, et autres
Publié: (2025)
par: Augusto, Cristian, et autres
Publié: (2025)
Prompt Driven Development with Claude Code: Building a Complete TUI Framework for the Ring Programming Language
par: Fayed, Mahmoud Samir, et autres
Publié: (2026)
par: Fayed, Mahmoud Samir, et autres
Publié: (2026)
Cost-Efficient Prompt Engineering for Unsupervised Entity Resolution
par: Nananukul, Navapat, et autres
Publié: (2023)
par: Nananukul, Navapat, et autres
Publié: (2023)
Benchmarking Prompt Engineering Techniques for Secure Code Generation with GPT Models
par: Bruni, Marc, et autres
Publié: (2025)
par: Bruni, Marc, et autres
Publié: (2025)
Automatically Generating Web Applications from Requirements Via Multi-Agent Test-Driven Development
par: Wan, Yuxuan, et autres
Publié: (2025)
par: Wan, Yuxuan, et autres
Publié: (2025)
Documents similaires
-
Willful Disobedience: Automatically Detecting Failures in Agentic Traces
par: Sharma, Reshabh K, et autres
Publié: (2026) -
ContextCov: Deriving and Enforcing Executable Constraints from Agent Instruction Files
par: Sharma, Reshabh K
Publié: (2026) -
Learning Correct Behavior from Examples: Validating Sequential Execution in Autonomous Agents
par: Sharma, Reshabh K, et autres
Publié: (2026) -
Solving Data-centric Tasks using Large Language Models
par: Barke, Shraddha, et autres
Publié: (2024) -
Validating LLM-Generated Programs with Metamorphic Prompt Testing
par: Wang, Xiaoyin, et autres
Publié: (2024)