SWE-Lego: Pushing the Limits of Supervised Fine-tuning for Software Issue Resolving
Fuente:
arXiv
Salvato in:
| Autori principali: | Tao, Chaofan, Chen, Jierun, Jiang, Yuxin, Kou, Kaiqi, Wang, Shaowei, Wang, Ruoyu, Li, Xiaohui, Yang, Sidi, Du, Yiming, Dai, Jianbo, Mao, Zhiming, Wang, Xinyu, Shang, Lifeng, Bai, Haoli |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
REAgent: Requirement-Driven LLM Agents for Software Issue Resolution
di: Kuang, Shiqi, et al.
Pubblicazione: (2026)
di: Kuang, Shiqi, et al.
Pubblicazione: (2026)
From Verifiable Dot to Reward Chain: Harnessing Verifiable Reference-based Rewards for Reinforcement Learning of Open-ended Generation
di: Jiang, Yuxin, et al.
Pubblicazione: (2026)
di: Jiang, Yuxin, et al.
Pubblicazione: (2026)
GRPO-VPS: Enhancing Group Relative Policy Optimization with Verifiable Process Supervision for Effective Reasoning
di: Wang, Jingyi, et al.
Pubblicazione: (2026)
di: Wang, Jingyi, et al.
Pubblicazione: (2026)
ASFT: Aligned Supervised Fine-Tuning through Absolute Likelihood
di: Wang, Ruoyu, et al.
Pubblicazione: (2024)
di: Wang, Ruoyu, et al.
Pubblicazione: (2024)
From SWE-ZERO to SWE-HERO: Execution-free to Execution-based Fine-tuning for Software Engineering Agents
di: Ludwig, Nikolai, et al.
Pubblicazione: (2026)
di: Ludwig, Nikolai, et al.
Pubblicazione: (2026)
The Harder The Better: Maintaining Supervised Fine-tuning Generalization with Less but Harder Data
di: Shang, Zhaoyang, et al.
Pubblicazione: (2025)
di: Shang, Zhaoyang, et al.
Pubblicazione: (2025)
The Synergy Dilemma of Long-CoT SFT and RL: Investigating Post-Training Techniques for Reasoning VLMs
di: Chen, Jierun, et al.
Pubblicazione: (2025)
di: Chen, Jierun, et al.
Pubblicazione: (2025)
OVD: On-policy Verbal Distillation
di: Xiong, Jing, et al.
Pubblicazione: (2026)
di: Xiong, Jing, et al.
Pubblicazione: (2026)
Safeguarding LLM Fine-tuning via Push-Pull Distributional Alignment
di: Wang, Haozhong, et al.
Pubblicazione: (2026)
di: Wang, Haozhong, et al.
Pubblicazione: (2026)
TOM-SWE: User Mental Modeling For Software Engineering Agents
di: Zhou, Xuhui, et al.
Pubblicazione: (2025)
di: Zhou, Xuhui, et al.
Pubblicazione: (2025)
FG-CLTP: Fine-Grained Contrastive Language Tactile Pretraining for Robotic Manipulation
di: Ma, Wenxuan, et al.
Pubblicazione: (2026)
di: Ma, Wenxuan, et al.
Pubblicazione: (2026)
Training Software Engineering Agents and Verifiers with SWE-Gym
di: Pan, Jiayi, et al.
Pubblicazione: (2024)
di: Pan, Jiayi, et al.
Pubblicazione: (2024)
Quantum Lego and XP Stabilizer Codes
di: Shen, Ruohan, et al.
Pubblicazione: (2023)
di: Shen, Ruohan, et al.
Pubblicazione: (2023)
SWE-Mirror: Scaling Issue-Resolving Datasets by Mirroring Issues Across Repositories
di: Wang, Junhao, et al.
Pubblicazione: (2025)
di: Wang, Junhao, et al.
Pubblicazione: (2025)
SWE-Debate: Competitive Multi-Agent Debate for Software Issue Resolution
di: Li, Han, et al.
Pubblicazione: (2025)
di: Li, Han, et al.
Pubblicazione: (2025)
SWE-Exp: Experience-Driven Software Issue Resolution
di: Chen, Silin, et al.
Pubblicazione: (2025)
di: Chen, Silin, et al.
Pubblicazione: (2025)
Packing Analysis: Packing Is More Appropriate for Large Models or Datasets in Supervised Fine-tuning
di: Wang, Shuhe, et al.
Pubblicazione: (2024)
di: Wang, Shuhe, et al.
Pubblicazione: (2024)
Munsit at NADI 2025 Shared Task 2: Pushing the Boundaries of Multidialectal Arabic ASR with Weakly Supervised Pretraining and Continual Supervised Fine-tuning
di: Salhab, Mahmoud, et al.
Pubblicazione: (2025)
di: Salhab, Mahmoud, et al.
Pubblicazione: (2025)
SWE-Dev: Building Software Engineering Agents with Training and Inference Scaling
di: Wang, Haoran, et al.
Pubblicazione: (2025)
di: Wang, Haoran, et al.
Pubblicazione: (2025)
Better Supervised Fine-tuning for VQA: Integer-Only Loss
di: Qian, Baihong, et al.
Pubblicazione: (2025)
di: Qian, Baihong, et al.
Pubblicazione: (2025)
ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning
di: Du, Yiming, et al.
Pubblicazione: (2025)
di: Du, Yiming, et al.
Pubblicazione: (2025)
AlignSum: Data Pyramid Hierarchical Fine-tuning for Aligning with Human Summarization Preference
di: Han, Yang, et al.
Pubblicazione: (2024)
di: Han, Yang, et al.
Pubblicazione: (2024)
SWE-bench-java: A GitHub Issue Resolving Benchmark for Java
di: Zan, Daoguang, et al.
Pubblicazione: (2024)
di: Zan, Daoguang, et al.
Pubblicazione: (2024)
Normalization through Fine-tuning: Understanding Wav2vec 2.0 Embeddings for Phonetic Analysis
di: Wang, Yiming, et al.
Pubblicazione: (2025)
di: Wang, Yiming, et al.
Pubblicazione: (2025)
Stabilizing LLM Supervised Fine-Tuning via Explicit Distributional Control
di: Wang, Xinyu, et al.
Pubblicazione: (2026)
di: Wang, Xinyu, et al.
Pubblicazione: (2026)
Live-SWE-agent: Can Software Engineering Agents Self-Evolve on the Fly?
di: Xia, Chunqiu Steven, et al.
Pubblicazione: (2025)
di: Xia, Chunqiu Steven, et al.
Pubblicazione: (2025)
Low-Rank Adaptation with Task-Relevant Feature Enhancement for Fine-tuning Language Models
di: Li, Changqun, et al.
Pubblicazione: (2024)
di: Li, Changqun, et al.
Pubblicazione: (2024)
SWE-Dev: Evaluating and Training Autonomous Feature-Driven Software Development
di: Du, Yaxin, et al.
Pubblicazione: (2025)
di: Du, Yaxin, et al.
Pubblicazione: (2025)
UltraLink: An Open-Source Knowledge-Enhanced Multilingual Supervised Fine-tuning Dataset
di: Wang, Haoyu, et al.
Pubblicazione: (2024)
di: Wang, Haoyu, et al.
Pubblicazione: (2024)
Multi-SWE-bench: A Multilingual Benchmark for Issue Resolving
di: Zan, Daoguang, et al.
Pubblicazione: (2025)
di: Zan, Daoguang, et al.
Pubblicazione: (2025)
Resolving Java Code Repository Issues with iSWE Agent
di: Ganhotra, Jatin, et al.
Pubblicazione: (2026)
di: Ganhotra, Jatin, et al.
Pubblicazione: (2026)
Utility-Diversity Aware Online Batch Selection for LLM Supervised Fine-tuning
di: Zou, Heming, et al.
Pubblicazione: (2025)
di: Zou, Heming, et al.
Pubblicazione: (2025)
StableLego: Stability Analysis of Block Stacking Assembly
di: Liu, Ruixuan, et al.
Pubblicazione: (2024)
di: Liu, Ruixuan, et al.
Pubblicazione: (2024)
SWE-Master: Unleashing the Potential of Software Engineering Agents via Post-Training
di: Song, Huatong, et al.
Pubblicazione: (2026)
di: Song, Huatong, et al.
Pubblicazione: (2026)
FastCode: Fast and Cost-Efficient Code Understanding and Reasoning
di: Li, Zhonghang, et al.
Pubblicazione: (2026)
di: Li, Zhonghang, et al.
Pubblicazione: (2026)
SWE-Search: Enhancing Software Agents with Monte Carlo Tree Search and Iterative Refinement
di: Antoniades, Antonis, et al.
Pubblicazione: (2024)
di: Antoniades, Antonis, et al.
Pubblicazione: (2024)
SpikingTac: A Miniaturized Neuromorphic Visuotactile Sensor for High-Precision Dynamic Tactile Imprint Tracking
di: Jiang, Tianyu, et al.
Pubblicazione: (2026)
di: Jiang, Tianyu, et al.
Pubblicazione: (2026)
Memory-T1: Reinforcement Learning for Temporal Reasoning in Multi-session Agents
di: Du, Yiming, et al.
Pubblicazione: (2025)
di: Du, Yiming, et al.
Pubblicazione: (2025)
Toward Training Superintelligent Software Agents through Self-Play SWE-RL
di: Wei, Yuxiang, et al.
Pubblicazione: (2025)
di: Wei, Yuxiang, et al.
Pubblicazione: (2025)
Data-efficient Fine-tuning for LLM-based Recommendation
di: Lin, Xinyu, et al.
Pubblicazione: (2024)
di: Lin, Xinyu, et al.
Pubblicazione: (2024)
Documenti analoghi
-
REAgent: Requirement-Driven LLM Agents for Software Issue Resolution
di: Kuang, Shiqi, et al.
Pubblicazione: (2026) -
From Verifiable Dot to Reward Chain: Harnessing Verifiable Reference-based Rewards for Reinforcement Learning of Open-ended Generation
di: Jiang, Yuxin, et al.
Pubblicazione: (2026) -
GRPO-VPS: Enhancing Group Relative Policy Optimization with Verifiable Process Supervision for Effective Reasoning
di: Wang, Jingyi, et al.
Pubblicazione: (2026) -
ASFT: Aligned Supervised Fine-Tuning through Absolute Likelihood
di: Wang, Ruoyu, et al.
Pubblicazione: (2024) -
From SWE-ZERO to SWE-HERO: Execution-free to Execution-based Fine-tuning for Software Engineering Agents
di: Ludwig, Nikolai, et al.
Pubblicazione: (2026)