Towards Structured, State-Aware, and Execution-Grounded Reasoning for Software Engineering Agents
Fuente:
arXiv
Salvato in:
| Autori principali: | Tse-Hsun, Chen |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Identifying Performance-Sensitive Configurations in Software Systems through Code Analysis with LLM Agents
di: Wang, Zehao, et al.
Pubblicazione: (2024)
di: Wang, Zehao, et al.
Pubblicazione: (2024)
AgentForge: Execution-Grounded Multi-Agent LLM Framework for Autonomous Software Engineering
di: Kumar, Rajesh, et al.
Pubblicazione: (2026)
di: Kumar, Rajesh, et al.
Pubblicazione: (2026)
Agentic Software Engineering: Foundational Pillars and a Research Roadmap
di: Hassan, Ahmed E., et al.
Pubblicazione: (2025)
di: Hassan, Ahmed E., et al.
Pubblicazione: (2025)
RobuNFR: Evaluating the Robustness of Large Language Models on Non-Functional Requirements Aware Code Generation
di: Lin, Feng, et al.
Pubblicazione: (2025)
di: Lin, Feng, et al.
Pubblicazione: (2025)
LibreLog: Accurate and Efficient Unsupervised Log Parsing Using Open-Source Large Language Models
di: Ma, Zeyang, et al.
Pubblicazione: (2024)
di: Ma, Zeyang, et al.
Pubblicazione: (2024)
Unified Software Engineering Agent as AI Software Engineer
di: Applis, Leonhard, et al.
Pubblicazione: (2025)
di: Applis, Leonhard, et al.
Pubblicazione: (2025)
Static Program Slicing Using Language Models With Dataflow-Aware Pretraining and Constrained Decoding
di: He, Pengfei, et al.
Pubblicazione: (2026)
di: He, Pengfei, et al.
Pubblicazione: (2026)
Debugging the Debuggers: Failure-Anchored Structured Recovery for Software Engineering Agents
di: Zhao, Chenyu, et al.
Pubblicazione: (2026)
di: Zhao, Chenyu, et al.
Pubblicazione: (2026)
SOEN-101: Code Generation by Emulating Software Process Models Using Large Language Model Agents
di: Lin, Feng, et al.
Pubblicazione: (2024)
di: Lin, Feng, et al.
Pubblicazione: (2024)
Structurally Aligned Subtask-Level Memory for Software Engineering Agents
di: Shen, Kangning, et al.
Pubblicazione: (2026)
di: Shen, Kangning, et al.
Pubblicazione: (2026)
Order Matters! An Empirical Study on Large Language Models' Input Order Bias in Software Fault Localization
di: Rafi, Md Nakhla, et al.
Pubblicazione: (2024)
di: Rafi, Md Nakhla, et al.
Pubblicazione: (2024)
The Semi-Executable Stack: Agentic Software Engineering and the Expanding Scope of SE
di: Feldt, Robert, et al.
Pubblicazione: (2026)
di: Feldt, Robert, et al.
Pubblicazione: (2026)
SWE-Hub: A Unified Production System for Scalable, Executable Software Engineering Tasks
di: Zeng, Yucheng, et al.
Pubblicazione: (2026)
di: Zeng, Yucheng, et al.
Pubblicazione: (2026)
LLMParser: An Exploratory Study on Using Large Language Models for Log Parsing
di: Ma, Zeyang, et al.
Pubblicazione: (2024)
di: Ma, Zeyang, et al.
Pubblicazione: (2024)
Loosely-Structured Software: Engineering Context, Structure, and Evolution Entropy in Runtime-Rewired Multi-Agent Systems
di: Zhang, Weihao, et al.
Pubblicazione: (2026)
di: Zhang, Weihao, et al.
Pubblicazione: (2026)
Rethinking the Value of Agent-Generated Tests for LLM-Based Software Engineering Agents
di: Chen, Zhi, et al.
Pubblicazione: (2026)
di: Chen, Zhi, et al.
Pubblicazione: (2026)
TOM-SWE: User Mental Modeling For Software Engineering Agents
di: Zhou, Xuhui, et al.
Pubblicazione: (2025)
di: Zhou, Xuhui, et al.
Pubblicazione: (2025)
SWE-Next: Scalable Real-World Software Engineering Tasks for Agents
di: Liang, Jiarong, et al.
Pubblicazione: (2026)
di: Liang, Jiarong, et al.
Pubblicazione: (2026)
Large Language Model-Based Agents for Software Engineering: A Survey
di: Liu, Junwei, et al.
Pubblicazione: (2024)
di: Liu, Junwei, et al.
Pubblicazione: (2024)
Towards Adaptive Software Agents for Debugging
di: Majdoub, Yacine, et al.
Pubblicazione: (2025)
di: Majdoub, Yacine, et al.
Pubblicazione: (2025)
Trae Agent: An LLM-based Agent for Software Engineering with Test-time Scaling
di: Trae Research Team, et al.
Pubblicazione: (2025)
di: Trae Research Team, et al.
Pubblicazione: (2025)
MEnvAgent: Scalable Polyglot Environment Construction for Verifiable Software Engineering
di: Guo, Chuanzhe, et al.
Pubblicazione: (2026)
di: Guo, Chuanzhe, et al.
Pubblicazione: (2026)
Towards Comprehensive Benchmarking Infrastructure for LLMs In Software Engineering
di: Rodriguez-Cardenas, Daniel, et al.
Pubblicazione: (2026)
di: Rodriguez-Cardenas, Daniel, et al.
Pubblicazione: (2026)
From Patches to Trajectories: Privileged Process Supervision for Software-Engineering Agents
di: Ma, Murong, et al.
Pubblicazione: (2026)
di: Ma, Murong, et al.
Pubblicazione: (2026)
ZS4C: Zero-Shot Synthesis of Compilable Code for Incomplete Code Snippets using LLMs
di: Kabir, Azmain, et al.
Pubblicazione: (2024)
di: Kabir, Azmain, et al.
Pubblicazione: (2024)
LoCoBench-Agent: An Interactive Benchmark for LLM Agents in Long-Context Software Engineering
di: Qiu, Jielin, et al.
Pubblicazione: (2025)
di: Qiu, Jielin, et al.
Pubblicazione: (2025)
HyperAgent: Generalist Software Engineering Agents to Solve Coding Tasks at Scale
di: Phan, Huy Nhat, et al.
Pubblicazione: (2024)
di: Phan, Huy Nhat, et al.
Pubblicazione: (2024)
Lifecycle-Aware code generation: Leveraging Software Engineering Phases in LLMs
di: Xing, Xing, et al.
Pubblicazione: (2025)
di: Xing, Xing, et al.
Pubblicazione: (2025)
FlowMind: Execute-Summarize for Structured Workflow Generation from LLM Reasoning
di: Liu, Yihao, et al.
Pubblicazione: (2026)
di: Liu, Yihao, et al.
Pubblicazione: (2026)
daVinci-Dev: Agent-native Mid-training for Software Engineering
di: Zeng, Ji, et al.
Pubblicazione: (2026)
di: Zeng, Ji, et al.
Pubblicazione: (2026)
SkillMOO: Multi-Objective Optimization of Agent Skills for Software Engineering
di: Gong, Jingzhi, et al.
Pubblicazione: (2026)
di: Gong, Jingzhi, et al.
Pubblicazione: (2026)
ALMAS: an Autonomous LLM-based Multi-Agent Software Engineering Framework
di: Tawosi, Vali, et al.
Pubblicazione: (2025)
di: Tawosi, Vali, et al.
Pubblicazione: (2025)
Software Performance Engineering for Foundation Model-Powered Software
di: Zhang, Haoxiang, et al.
Pubblicazione: (2024)
di: Zhang, Haoxiang, et al.
Pubblicazione: (2024)
Software Reuse in the Generative AI Era: From Cargo Cult Towards AI Native Software Engineering
di: Mikkonen, Tommi, et al.
Pubblicazione: (2025)
di: Mikkonen, Tommi, et al.
Pubblicazione: (2025)
Code Reasoning for Software Engineering Tasks: A Survey and A Call to Action
di: Pujar, Saurabh, et al.
Pubblicazione: (2025)
di: Pujar, Saurabh, et al.
Pubblicazione: (2025)
Towards a Science of Causal Interpretability in Deep Learning for Software Engineering
di: Palacio, David N.
Pubblicazione: (2025)
di: Palacio, David N.
Pubblicazione: (2025)
Same Signal, Different Semantics: A Cross-Framework Behavioral Analysis of Software Engineering Agents
di: Ma, Wei, et al.
Pubblicazione: (2026)
di: Ma, Wei, et al.
Pubblicazione: (2026)
SWE-Skills-Bench: Do Agent Skills Actually Help in Real-World Software Engineering?
di: Han, Tingxu, et al.
Pubblicazione: (2026)
di: Han, Tingxu, et al.
Pubblicazione: (2026)
Thinking Longer, Not Larger: Enhancing Software Engineering Agents via Scaling Test-Time Compute
di: Ma, Yingwei, et al.
Pubblicazione: (2025)
di: Ma, Yingwei, et al.
Pubblicazione: (2025)
Accountable Agents in Software Engineering: An Analysis of Terms of Service and a Research Roadmap
di: Treude, Christoph
Pubblicazione: (2026)
di: Treude, Christoph
Pubblicazione: (2026)
Documenti analoghi
-
Identifying Performance-Sensitive Configurations in Software Systems through Code Analysis with LLM Agents
di: Wang, Zehao, et al.
Pubblicazione: (2024) -
AgentForge: Execution-Grounded Multi-Agent LLM Framework for Autonomous Software Engineering
di: Kumar, Rajesh, et al.
Pubblicazione: (2026) -
Agentic Software Engineering: Foundational Pillars and a Research Roadmap
di: Hassan, Ahmed E., et al.
Pubblicazione: (2025) -
RobuNFR: Evaluating the Robustness of Large Language Models on Non-Functional Requirements Aware Code Generation
di: Lin, Feng, et al.
Pubblicazione: (2025) -
LibreLog: Accurate and Efficient Unsupervised Log Parsing Using Open-Source Large Language Models
di: Ma, Zeyang, et al.
Pubblicazione: (2024)