SWE-Debate: Competitive Multi-Agent Debate for Software Issue Resolution
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Li, Han, Shi, Yuling, Lin, Shaoxin, Gu, Xiaodong, Lian, Heng, Wang, Xin, Jia, Yantao, Huang, Tao, Wang, Qianxiang |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
SWE-Exp: Experience-Driven Software Issue Resolution
von: Chen, Silin, et al.
Veröffentlicht: (2025)
von: Chen, Silin, et al.
Veröffentlicht: (2025)
SWE-Pruner: Self-Adaptive Context Pruning for Coding Agents
von: Wang, Yuhang, et al.
Veröffentlicht: (2026)
von: Wang, Yuhang, et al.
Veröffentlicht: (2026)
Training Software Engineering Agents and Verifiers with SWE-Gym
von: Pan, Jiayi, et al.
Veröffentlicht: (2024)
von: Pan, Jiayi, et al.
Veröffentlicht: (2024)
SWE-QA: Can Language Models Answer Repository-level Code Questions?
von: Peng, Weihan, et al.
Veröffentlicht: (2025)
von: Peng, Weihan, et al.
Veröffentlicht: (2025)
SWE-Cycle: Benchmarking Code Agents across the Complete Issue Resolution Cycle
von: Guan, Hao, et al.
Veröffentlicht: (2026)
von: Guan, Hao, et al.
Veröffentlicht: (2026)
SWE-bench-java: A GitHub Issue Resolving Benchmark for Java
von: Zan, Daoguang, et al.
Veröffentlicht: (2024)
von: Zan, Daoguang, et al.
Veröffentlicht: (2024)
REAgent: Requirement-Driven LLM Agents for Software Issue Resolution
von: Kuang, Shiqi, et al.
Veröffentlicht: (2026)
von: Kuang, Shiqi, et al.
Veröffentlicht: (2026)
Rethinking the Value of Agent-Generated Tests for LLM-Based Software Engineering Agents
von: Chen, Zhi, et al.
Veröffentlicht: (2026)
von: Chen, Zhi, et al.
Veröffentlicht: (2026)
SWE Atlas: Benchmarking Coding Agents Beyond Issue Resolution
von: Raghavendra, Mohit, et al.
Veröffentlicht: (2026)
von: Raghavendra, Mohit, et al.
Veröffentlicht: (2026)
TOM-SWE: User Mental Modeling For Software Engineering Agents
von: Zhou, Xuhui, et al.
Veröffentlicht: (2025)
von: Zhou, Xuhui, et al.
Veröffentlicht: (2025)
SWE-Master: Unleashing the Potential of Software Engineering Agents via Post-Training
von: Song, Huatong, et al.
Veröffentlicht: (2026)
von: Song, Huatong, et al.
Veröffentlicht: (2026)
SWE-Lego: Pushing the Limits of Supervised Fine-tuning for Software Issue Resolving
von: Tao, Chaofan, et al.
Veröffentlicht: (2026)
von: Tao, Chaofan, et al.
Veröffentlicht: (2026)
SWE-World: Building Software Engineering Agents in Docker-Free Environments
von: Sun, Shuang, et al.
Veröffentlicht: (2026)
von: Sun, Shuang, et al.
Veröffentlicht: (2026)
CodeR: Issue Resolving with Multi-Agent and Task Graphs
von: Chen, Dong, et al.
Veröffentlicht: (2024)
von: Chen, Dong, et al.
Veröffentlicht: (2024)
Rethinking Code Complexity Through the Lens of Large Language Models
von: Xie, Chen, et al.
Veröffentlicht: (2026)
von: Xie, Chen, et al.
Veröffentlicht: (2026)
Test vs Mutant: Adversarial LLM Agents for Robust Unit Test Generation
von: Chang, Pengyu, et al.
Veröffentlicht: (2026)
von: Chang, Pengyu, et al.
Veröffentlicht: (2026)
Multi-Agent Debate Strategies to Enhance Requirements Engineering with Large Language Models
von: Oriol, Marc, et al.
Veröffentlicht: (2025)
von: Oriol, Marc, et al.
Veröffentlicht: (2025)
SWE-Mirror: Scaling Issue-Resolving Datasets by Mirroring Issues Across Repositories
von: Wang, Junhao, et al.
Veröffentlicht: (2025)
von: Wang, Junhao, et al.
Veröffentlicht: (2025)
SWE-Factory: Your Automated Factory for Issue Resolution Training Data and Evaluation Benchmarks
von: Guo, Lianghong, et al.
Veröffentlicht: (2025)
von: Guo, Lianghong, et al.
Veröffentlicht: (2025)
SWE-Fuse: Empowering Software Agents via Issue-free Trajectory Learning and Entropy-aware RLVR Training
von: Wen, Xin-Cheng, et al.
Veröffentlicht: (2026)
von: Wen, Xin-Cheng, et al.
Veröffentlicht: (2026)
From SWE-ZERO to SWE-HERO: Execution-free to Execution-based Fine-tuning for Software Engineering Agents
von: Ludwig, Nikolai, et al.
Veröffentlicht: (2026)
von: Ludwig, Nikolai, et al.
Veröffentlicht: (2026)
Is Multi-Agent Debate (MAD) the Silver Bullet? An Empirical Analysis of MAD in Code Summarization and Translation
von: Chun, Jina, et al.
Veröffentlicht: (2025)
von: Chun, Jina, et al.
Veröffentlicht: (2025)
SWE-Next: Scalable Real-World Software Engineering Tasks for Agents
von: Liang, Jiarong, et al.
Veröffentlicht: (2026)
von: Liang, Jiarong, et al.
Veröffentlicht: (2026)
SWE-Skills-Bench: Do Agent Skills Actually Help in Real-World Software Engineering?
von: Han, Tingxu, et al.
Veröffentlicht: (2026)
von: Han, Tingxu, et al.
Veröffentlicht: (2026)
SWE-TRACE: Optimizing Long-Horizon SWE Agents Through Rubric Process Reward Models and Heuristic Test-Time Scaling
von: Han, Hao, et al.
Veröffentlicht: (2026)
von: Han, Hao, et al.
Veröffentlicht: (2026)
Runnable Directories: The Solution to the Monorepo vs. Multi-repo Debate
von: Ghasemnezhad, Shayan, et al.
Veröffentlicht: (2025)
von: Ghasemnezhad, Shayan, et al.
Veröffentlicht: (2025)
SWE-smith: Scaling Data for Software Engineering Agents
von: Yang, John, et al.
Veröffentlicht: (2025)
von: Yang, John, et al.
Veröffentlicht: (2025)
Are "Solved Issues" in SWE-bench Really Solved Correctly? An Empirical Study
von: Wang, You, et al.
Veröffentlicht: (2025)
von: Wang, You, et al.
Veröffentlicht: (2025)
Agents in Software Engineering: Survey, Landscape, and Vision
von: Wang, Yanlin, et al.
Veröffentlicht: (2024)
von: Wang, Yanlin, et al.
Veröffentlicht: (2024)
EffiSkill: Agent Skill Based Automated Code Efficiency Optimization
von: Wang, Zimu, et al.
Veröffentlicht: (2026)
von: Wang, Zimu, et al.
Veröffentlicht: (2026)
SWE-Effi: Re-Evaluating Software AI Agent System Effectiveness Under Resource Constraints
von: Fan, Zhiyu, et al.
Veröffentlicht: (2025)
von: Fan, Zhiyu, et al.
Veröffentlicht: (2025)
Reproduction Test Generation for Java SWE Issues
von: Ahmed, Toufique, et al.
Veröffentlicht: (2026)
von: Ahmed, Toufique, et al.
Veröffentlicht: (2026)
SWE-Bench Pro: Can AI Agents Solve Long-Horizon Software Engineering Tasks?
von: Deng, Xiang, et al.
Veröffentlicht: (2025)
von: Deng, Xiang, et al.
Veröffentlicht: (2025)
SWE-Shepherd: Advancing PRMs for Reinforcing Code Agents
von: Dihan, Mahir Labib, et al.
Veröffentlicht: (2026)
von: Dihan, Mahir Labib, et al.
Veröffentlicht: (2026)
SWE-rebench: An Automated Pipeline for Task Collection and Decontaminated Evaluation of Software Engineering Agents
von: Badertdinov, Ibragim, et al.
Veröffentlicht: (2025)
von: Badertdinov, Ibragim, et al.
Veröffentlicht: (2025)
SWE-Sharp-Bench: A Reproducible Benchmark for C# Software Engineering Tasks
von: Mhatre, Sanket, et al.
Veröffentlicht: (2025)
von: Mhatre, Sanket, et al.
Veröffentlicht: (2025)
SWE-MiniSandbox: Container-Free Reinforcement Learning for Building Software Engineering Agents
von: Yuan, Danlong, et al.
Veröffentlicht: (2026)
von: Yuan, Danlong, et al.
Veröffentlicht: (2026)
MAGIS: LLM-Based Multi-Agent Framework for GitHub Issue Resolution
von: Tao, Wei, et al.
Veröffentlicht: (2024)
von: Tao, Wei, et al.
Veröffentlicht: (2024)
SWE-Dev: Evaluating and Training Autonomous Feature-Driven Software Development
von: Du, Yaxin, et al.
Veröffentlicht: (2025)
von: Du, Yaxin, et al.
Veröffentlicht: (2025)
GHIssuemarket: A Sandbox Environment for SWE-Agents Economic Experimentation
von: Fouad, Mohamed A., et al.
Veröffentlicht: (2024)
von: Fouad, Mohamed A., et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
SWE-Exp: Experience-Driven Software Issue Resolution
von: Chen, Silin, et al.
Veröffentlicht: (2025) -
SWE-Pruner: Self-Adaptive Context Pruning for Coding Agents
von: Wang, Yuhang, et al.
Veröffentlicht: (2026) -
Training Software Engineering Agents and Verifiers with SWE-Gym
von: Pan, Jiayi, et al.
Veröffentlicht: (2024) -
SWE-QA: Can Language Models Answer Repository-level Code Questions?
von: Peng, Weihan, et al.
Veröffentlicht: (2025) -
SWE-Cycle: Benchmarking Code Agents across the Complete Issue Resolution Cycle
von: Guan, Hao, et al.
Veröffentlicht: (2026)