KOCO-BENCH: Can Large Language Models Leverage Domain Knowledge in Software Development?
Fuente:
arXiv
Saved in:
| Main Authors: | Jiang, Xue, Li, Ge, Qian, Jiaru, Shi, Xianjie, Li, Chenjie, Zhu, Hao, Wang, Ziyu, Zhang, Jielun, Zhao, Zheyu, Wu, Lingwei, Zhang, Kechi, Li, Jia, Jiao, Wenpin, Jin, Zhi, Dong, Yihong |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
A Viable Paradigm of Software Automation: Iterative End-to-End Automated Software Development
by: Li, Jia, et al.
Published: (2025)
by: Li, Jia, et al.
Published: (2025)
A Survey on Code Generation with LLM-based Agents
by: Dong, Yihong, et al.
Published: (2025)
by: Dong, Yihong, et al.
Published: (2025)
CodeAgent: Enhancing Code Generation with Tool-Integrated Agent Systems for Real-World Repo-level Coding Challenges
by: Zhang, Kechi, et al.
Published: (2024)
by: Zhang, Kechi, et al.
Published: (2024)
Theoretical Proof that Auto-regressive Language Models Collapse when Real-world Data is a Finite Set
by: Wang, Lecheng, et al.
Published: (2024)
by: Wang, Lecheng, et al.
Published: (2024)
Evaluating the Formal Reasoning Capabilities of Large Language Models through Chomsky Hierarchy
by: Dong, Yihong, et al.
Published: (2026)
by: Dong, Yihong, et al.
Published: (2026)
Focused-DPO: Enhancing Code Generation Through Focused Preference Optimization on Error-Prone Points
by: Zhang, Kechi, et al.
Published: (2025)
by: Zhang, Kechi, et al.
Published: (2025)
Exploring Data-Efficient Adaptation of Large Language Models for Code Generation
by: Jiang, Xue, et al.
Published: (2024)
by: Jiang, Xue, et al.
Published: (2024)
SEAlign: Alignment Training for Software Engineering Agent
by: Zhang, Kechi, et al.
Published: (2025)
by: Zhang, Kechi, et al.
Published: (2025)
aiXcoder-7B-v2: Training LLMs to Fully Utilize the Long Context in Repository-level Code Completion
by: Li, Jia, et al.
Published: (2025)
by: Li, Jia, et al.
Published: (2025)
StackTrans: From Large Language Model to Large Pushdown Automata Model
by: Zhang, Kechi, et al.
Published: (2025)
by: Zhang, Kechi, et al.
Published: (2025)
ROCODE: Integrating Backtracking Mechanism and Program Analysis in Large Language Models for Code Generation
by: Jiang, Xue, et al.
Published: (2024)
by: Jiang, Xue, et al.
Published: (2024)
Signal Classification Recovery Across Domains Using Unsupervised Domain Adaptation
by: Ali, Mohammad, et al.
Published: (2025)
by: Ali, Mohammad, et al.
Published: (2025)
SATURN: SAT-based Reinforcement Learning to Unleash LLMs Reasoning
by: Liu, Huanyu, et al.
Published: (2025)
by: Liu, Huanyu, et al.
Published: (2025)
GraphCodeAgent: Dual Graph-Guided LLM Agent for Retrieval-Augmented Repo-Level Code Generation
by: Li, Jia, et al.
Published: (2025)
by: Li, Jia, et al.
Published: (2025)
HiRoPE: Length Extrapolation for Code Models Using Hierarchical Position
by: Zhang, Kechi, et al.
Published: (2024)
by: Zhang, Kechi, et al.
Published: (2024)
Self-planning Code Generation with Large Language Models
by: Jiang, Xue, et al.
Published: (2023)
by: Jiang, Xue, et al.
Published: (2023)
RealBench: A Repo-Level Code Generation Benchmark Aligned with Real-World Software Development Practices
by: Li, Jia, et al.
Published: (2026)
by: Li, Jia, et al.
Published: (2026)
MEFA: Multisource Entropy‐Weighted Feature Adaptation for Cross‐Domain Intrusion Detection
by: Daniel Perez Fiadzeawu, et al.
Published: (2025)
by: Daniel Perez Fiadzeawu, et al.
Published: (2025)
From I/O to Code with Discovery Agent
by: Dong, Yihong, et al.
Published: (2026)
by: Dong, Yihong, et al.
Published: (2026)
Think Anywhere in Code Generation
by: Jiang, Xue, et al.
Published: (2026)
by: Jiang, Xue, et al.
Published: (2026)
CodeDPO: Aligning Code Models with Self Generated and Verified Source Code
by: Zhang, Kechi, et al.
Published: (2024)
by: Zhang, Kechi, et al.
Published: (2024)
FAN: Fourier Analysis Networks
by: Dong, Yihong, et al.
Published: (2024)
by: Dong, Yihong, et al.
Published: (2024)
Large Language Model Unlearning for Source Code
by: Jiang, Xue, et al.
Published: (2025)
by: Jiang, Xue, et al.
Published: (2025)
Computational Thinking Reasoning in Large Language Models
by: Zhang, Kechi, et al.
Published: (2025)
by: Zhang, Kechi, et al.
Published: (2025)
A Contradiction-Centered Model for the Emergence of Swarm Intelligence
by: Jiao, Wenpin
Published: (2025)
by: Jiao, Wenpin
Published: (2025)
A Generic Model for Swarm Intelligence and Its Validations
by: Jiao, Wenpin
Published: (2017)
by: Jiao, Wenpin
Published: (2017)
EvoCodeBench: An Evolving Code Generation Benchmark Aligned with Real-World Code Repositories
by: Li, Jia, et al.
Published: (2024)
by: Li, Jia, et al.
Published: (2024)
Detecting Data Contamination from Reinforcement Learning Post-training for Large Language Models
by: Tao, Yongding, et al.
Published: (2025)
by: Tao, Yongding, et al.
Published: (2025)
EvoCodeBench: An Evolving Code Generation Benchmark with Domain-Specific Evaluations
by: Li, Jia, et al.
Published: (2024)
by: Li, Jia, et al.
Published: (2024)
Self-collaboration Code Generation via ChatGPT
by: Dong, Yihong, et al.
Published: (2023)
by: Dong, Yihong, et al.
Published: (2023)
Reasoning is Periodicity? Improving Large Language Models Through Effective Periodicity Modeling
by: Dong, Yihong, et al.
Published: (2025)
by: Dong, Yihong, et al.
Published: (2025)
CodeRL+: Improving Code Generation via Reinforcement with Execution Semantics Alignment
by: Jiang, Xue, et al.
Published: (2025)
by: Jiang, Xue, et al.
Published: (2025)
Enhancing LLM Generation with Knowledge Hypergraph for Evidence-Based Medicine
by: Dou, Chengfeng, et al.
Published: (2025)
by: Dou, Chengfeng, et al.
Published: (2025)
RepoScope: Leveraging Call Chain-Aware Multi-View Context for Repository-Level Code Generation
by: Liu, Yang, et al.
Published: (2025)
by: Liu, Yang, et al.
Published: (2025)
Saber: An Efficient Sampling with Adaptive Acceleration and Backtracking Enhanced Remasking for Diffusion Language Model
by: Dong, Yihong, et al.
Published: (2025)
by: Dong, Yihong, et al.
Published: (2025)
VulInstruct: Teaching LLMs Root-Cause Reasoning for Vulnerability Detection via Security Specifications
by: Zhu, Hao, et al.
Published: (2025)
by: Zhu, Hao, et al.
Published: (2025)
LONGCODEU: Benchmarking Long-Context Language Models on Long Code Understanding
by: Li, Jia, et al.
Published: (2025)
by: Li, Jia, et al.
Published: (2025)
Uncertainty-Guided Chain-of-Thought for Code Generation with LLMs
by: Zhu, Yuqi, et al.
Published: (2025)
by: Zhu, Yuqi, et al.
Published: (2025)
PACE: Improving Prompt with Actor-Critic Editing for Large Language Model
by: Dong, Yihong, et al.
Published: (2023)
by: Dong, Yihong, et al.
Published: (2023)
Rethinking Repetition Problems of LLMs in Code Generation
by: Dong, Yihong, et al.
Published: (2025)
by: Dong, Yihong, et al.
Published: (2025)
Similar Items
-
A Viable Paradigm of Software Automation: Iterative End-to-End Automated Software Development
by: Li, Jia, et al.
Published: (2025) -
A Survey on Code Generation with LLM-based Agents
by: Dong, Yihong, et al.
Published: (2025) -
CodeAgent: Enhancing Code Generation with Tool-Integrated Agent Systems for Real-World Repo-level Coding Challenges
by: Zhang, Kechi, et al.
Published: (2024) -
Theoretical Proof that Auto-regressive Language Models Collapse when Real-world Data is a Finite Set
by: Wang, Lecheng, et al.
Published: (2024) -
Evaluating the Formal Reasoning Capabilities of Large Language Models through Chomsky Hierarchy
by: Dong, Yihong, et al.
Published: (2026)