Enregistré dans:
| Auteur principal: | McMillan, Damon |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2605.10039 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Structured Context Engineering for File-Native Agentic Systems: Evaluating Schema Accuracy, Format Effectiveness, and Multi-File Navigation at Scale
par: McMillan, Damon
Publié: (2026)
par: McMillan, Damon
Publié: (2026)
MultiFileTest: A Multi-File-Level LLM Unit Test Generation Benchmark and Impact of Error Fixing Mechanisms
par: Wang, Yibo, et autres
Publié: (2025)
par: Wang, Yibo, et autres
Publié: (2025)
Agent READMEs: An Empirical Study of Context Files for Agentic Coding
par: Chatlatanagulchai, Worawalan, et autres
Publié: (2025)
par: Chatlatanagulchai, Worawalan, et autres
Publié: (2025)
APIDA-Chat: Structured Synthesis of API Search Dialogues to Bootstrap Conversational Agents
par: Eberhart, Zachary, et autres
Publié: (2025)
par: Eberhart, Zachary, et autres
Publié: (2025)
The Stability Trap: Evaluating the Reliability of LLM-Based Instruction Adherence Auditing
par: Shergadwala, Murtuza N.
Publié: (2026)
par: Shergadwala, Murtuza N.
Publié: (2026)
Exploring Direct Instruction and Summary-Mediated Prompting in LLM-Assisted Code Modification
par: Tang, Ningzhi, et autres
Publié: (2025)
par: Tang, Ningzhi, et autres
Publié: (2025)
Attention Mechanism and Heuristic Approach: Context-Aware File Ranking Using Multi-Head Self-Attention
par: Sharma, Pradeep Kumar, et autres
Publié: (2026)
par: Sharma, Pradeep Kumar, et autres
Publié: (2026)
Do Code LLMs Do Static Analysis?
par: Su, Chia-Yi, et autres
Publié: (2025)
par: Su, Chia-Yi, et autres
Publié: (2025)
CMind: An AI Agent for Localizing C Memory Bugs
par: Su, Chia-Yi, et autres
Publié: (2026)
par: Su, Chia-Yi, et autres
Publié: (2026)
OpenCodeInstruct: A Large-scale Instruction Tuning Dataset for Code LLMs
par: Ahmad, Wasi Uddin, et autres
Publié: (2025)
par: Ahmad, Wasi Uddin, et autres
Publié: (2025)
Distilled GPT for Source Code Summarization
par: Su, Chia-Yi, et autres
Publié: (2023)
par: Su, Chia-Yi, et autres
Publié: (2023)
Encrypted Container File: Design and Implementation of a Hybrid-Encrypted Multi-Recipient File Structure
par: Bauer, Tobias J., et autres
Publié: (2024)
par: Bauer, Tobias J., et autres
Publié: (2024)
An Empirical Study of Dotfiles Repositories Containing User-Specific Configuration Files
par: Zhu, Wenhan, et autres
Publié: (2025)
par: Zhu, Wenhan, et autres
Publié: (2025)
Semantic Similarity Loss for Neural Source Code Summarization
par: Su, Chia-Yi, et autres
Publié: (2023)
par: Su, Chia-Yi, et autres
Publié: (2023)
AI-Mediated Code Comment Improvement
par: Dhakal, Maria, et autres
Publié: (2025)
par: Dhakal, Maria, et autres
Publié: (2025)
ISD-Agent-Bench: A Comprehensive Benchmark for Evaluating LLM-based Instructional Design Agents
par: Jeon, YoungHoon, et autres
Publié: (2026)
par: Jeon, YoungHoon, et autres
Publié: (2026)
ContextCov: Deriving and Enforcing Executable Constraints from Agent Instruction Files
par: Sharma, Reshabh K
Publié: (2026)
par: Sharma, Reshabh K
Publié: (2026)
InstructCoder: Instruction Tuning Large Language Models for Code Editing
par: Li, Kaixin, et autres
Publié: (2023)
par: Li, Kaixin, et autres
Publié: (2023)
AgentPack: A Dataset of Code Changes, Co-Authored by Agents and Humans
par: Zi, Yangtian, et autres
Publié: (2025)
par: Zi, Yangtian, et autres
Publié: (2025)
Operationalizing Ethics for AI Agents: How Developers Encode Values into Repository Context Files
par: Treude, Christoph, et autres
Publié: (2026)
par: Treude, Christoph, et autres
Publié: (2026)
From Output to Evaluation: Does Raw Instruction-Tuned Code LLMs Output Suffice for Fill-in-the-Middle Code Generation?
par: Ahmad, Wasi Uddin, et autres
Publié: (2025)
par: Ahmad, Wasi Uddin, et autres
Publié: (2025)
From Code Foundation Models to Agents and Applications: A Comprehensive Survey and Practical Guide to Code Intelligence
par: Yang, Jian, et autres
Publié: (2025)
par: Yang, Jian, et autres
Publié: (2025)
Evaluating AGENTS.md: Are Repository-Level Context Files Helpful for Coding Agents?
par: Gloaguen, Thibaud, et autres
Publié: (2026)
par: Gloaguen, Thibaud, et autres
Publié: (2026)
Automatically Benchmarking LLM Code Agents through Agent-Driven Annotation and Evaluation
par: Fu, Lingyue, et autres
Publié: (2025)
par: Fu, Lingyue, et autres
Publié: (2025)
Is Vibe Coding Safe? Benchmarking Vulnerability of Agent-Generated Code in Real-World Tasks
par: Zhao, Songwen, et autres
Publié: (2025)
par: Zhao, Songwen, et autres
Publié: (2025)
NALA_MAINZ at BLP-2025 Task 2: A Multi-agent Approach for Bangla Instruction to Python Code Generation
par: Saadi, Hossain Shaikh, et autres
Publié: (2025)
par: Saadi, Hossain Shaikh, et autres
Publié: (2025)
From Completion to Editing: Unlocking Context-Aware Code Infilling via Search-and-Replace Instruction Tuning
par: Zhang, Jiajun, et autres
Publié: (2026)
par: Zhang, Jiajun, et autres
Publié: (2026)
CodeScout: Contextual Problem Statement Enhancement for Software Agents
par: Suri, Manan, et autres
Publié: (2026)
par: Suri, Manan, et autres
Publié: (2026)
SWE-Pruner: Self-Adaptive Context Pruning for Coding Agents
par: Wang, Yuhang, et autres
Publié: (2026)
par: Wang, Yuhang, et autres
Publié: (2026)
A Study on Developer Behaviors for Validating and Repairing LLM-Generated Code Using Eye Tracking and IDE Actions
par: Tang, Ningzhi, et autres
Publié: (2024)
par: Tang, Ningzhi, et autres
Publié: (2024)
EffiSkill: Agent Skill Based Automated Code Efficiency Optimization
par: Wang, Zimu, et autres
Publié: (2026)
par: Wang, Zimu, et autres
Publié: (2026)
Towards Exception Safety Code Generation with Intermediate Representation Agents Framework
par: Zhang, Xuanming, et autres
Publié: (2024)
par: Zhang, Xuanming, et autres
Publié: (2024)
Leveraging LLMs for Multi-File DSL Code Generation: An Industrial Case Study
par: Chand, Sivajeet, et autres
Publié: (2026)
par: Chand, Sivajeet, et autres
Publié: (2026)
Process-Level Trajectory Evaluation for Environment Configuration in Software Engineering Agents
par: Kuang, Jiayi, et autres
Publié: (2025)
par: Kuang, Jiayi, et autres
Publié: (2025)
BigCodeBench: Benchmarking Code Generation with Diverse Function Calls and Complex Instructions
par: Zhuo, Terry Yue, et autres
Publié: (2024)
par: Zhuo, Terry Yue, et autres
Publié: (2024)
ProjectEval: A Benchmark for Programming Agents Automated Evaluation on Project-Level Code Generation
par: Liu, Kaiyuan, et autres
Publié: (2025)
par: Liu, Kaiyuan, et autres
Publié: (2025)
Measuring LLM Code Generation Stability via Structural Entropy
par: Song, Yewei, et autres
Publié: (2025)
par: Song, Yewei, et autres
Publié: (2025)
Agent-Diff: Benchmarking LLM Agents on Enterprise API Tasks via Code Execution with State-Diff-Based Evaluation
par: Pysklo, Hubert M., et autres
Publié: (2026)
par: Pysklo, Hubert M., et autres
Publié: (2026)
Agentic Harness Engineering: Observability-Driven Automatic Evolution of Coding-Agent Harnesses
par: Lin, Jiahang, et autres
Publié: (2026)
par: Lin, Jiahang, et autres
Publié: (2026)
Seeker: Towards Exception Safety Code Generation with Intermediate Language Agents Framework
par: Zhang, Xuanming, et autres
Publié: (2024)
par: Zhang, Xuanming, et autres
Publié: (2024)
Documents similaires
-
Structured Context Engineering for File-Native Agentic Systems: Evaluating Schema Accuracy, Format Effectiveness, and Multi-File Navigation at Scale
par: McMillan, Damon
Publié: (2026) -
MultiFileTest: A Multi-File-Level LLM Unit Test Generation Benchmark and Impact of Error Fixing Mechanisms
par: Wang, Yibo, et autres
Publié: (2025) -
Agent READMEs: An Empirical Study of Context Files for Agentic Coding
par: Chatlatanagulchai, Worawalan, et autres
Publié: (2025) -
APIDA-Chat: Structured Synthesis of API Search Dialogues to Bootstrap Conversational Agents
par: Eberhart, Zachary, et autres
Publié: (2025) -
The Stability Trap: Evaluating the Reliability of LLM-Based Instruction Adherence Auditing
par: Shergadwala, Murtuza N.
Publié: (2026)