Beyond Retrieval: A Multitask Benchmark and Model for Code Search
Fuente:
arXiv
Salvato in:
| Autori principali: | Xue, Siqiao, Liao, Zihan, Qin, Jin, Zhang, Ziyin, Mu, Yixiang, Zhou, Fan, Yu, Hang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Unifying the Perspectives of NLP and Software Engineering: A Survey on Language Models for Code
di: Zhang, Ziyin, et al.
Pubblicazione: (2023)
di: Zhang, Ziyin, et al.
Pubblicazione: (2023)
Beyond Function-Level Search: Repository-Aware Dual-Encoder Code Retrieval with Adversarial Verification
di: Liu, Aofan, et al.
Pubblicazione: (2025)
di: Liu, Aofan, et al.
Pubblicazione: (2025)
InfCode-C++: Intent-Guided Semantic Retrieval and AST-Structured Search for C++ Issue Resolution
di: Dong, Qingao, et al.
Pubblicazione: (2025)
di: Dong, Qingao, et al.
Pubblicazione: (2025)
CodeFuse-CR-Bench: A Comprehensiveness-aware Benchmark for End-to-End Code Review Evaluation in Python Projects
di: Guo, Hanyang, et al.
Pubblicazione: (2025)
di: Guo, Hanyang, et al.
Pubblicazione: (2025)
AdaptEval: A Benchmark for Evaluating Large Language Models on Code Snippet Adaptation
di: Zhang, Tanghaoran, et al.
Pubblicazione: (2026)
di: Zhang, Tanghaoran, et al.
Pubblicazione: (2026)
Benchmarking Multimodal LLMs on Code Generation for Complex Interactive Webpages
di: Wu, Fan, et al.
Pubblicazione: (2026)
di: Wu, Fan, et al.
Pubblicazione: (2026)
Beyond Output Correctness: Benchmarking and Evaluating Large Language Model Reasoning in Coding Tasks
di: Li, Yuangang, et al.
Pubblicazione: (2026)
di: Li, Yuangang, et al.
Pubblicazione: (2026)
CodeScope: An Execution-based Multilingual Multitask Multidimensional Benchmark for Evaluating LLMs on Code Understanding and Generation
di: Yan, Weixiang, et al.
Pubblicazione: (2023)
di: Yan, Weixiang, et al.
Pubblicazione: (2023)
MulVul: Retrieval-augmented Multi-Agent Code Vulnerability Detection via Cross-Model Prompt Evolution
di: Wu, Zihan, et al.
Pubblicazione: (2026)
di: Wu, Zihan, et al.
Pubblicazione: (2026)
Deep Learning for Code Intelligence: Survey, Benchmark and Toolkit
di: Wan, Yao, et al.
Pubblicazione: (2023)
di: Wan, Yao, et al.
Pubblicazione: (2023)
Beyond Code Snippets: Benchmarking LLMs on Repository-Level Question Answering
di: Alebachew, Yoseph Berhanu, et al.
Pubblicazione: (2026)
di: Alebachew, Yoseph Berhanu, et al.
Pubblicazione: (2026)
CodeXEmbed: A Generalist Embedding Model Family for Multiligual and Multi-task Code Retrieval
di: Liu, Ye, et al.
Pubblicazione: (2024)
di: Liu, Ye, et al.
Pubblicazione: (2024)
FeatureBench: Benchmarking Agentic Coding for Complex Feature Development
di: Zhou, Qixing, et al.
Pubblicazione: (2026)
di: Zhou, Qixing, et al.
Pubblicazione: (2026)
CoQuIR: A Comprehensive Benchmark for Code Quality-Aware Information Retrieval
di: Geng, Jiahui, et al.
Pubblicazione: (2025)
di: Geng, Jiahui, et al.
Pubblicazione: (2025)
SPENCER: Self-Adaptive Model Distillation for Efficient Code Retrieval
di: Gu, Wenchao, et al.
Pubblicazione: (2025)
di: Gu, Wenchao, et al.
Pubblicazione: (2025)
RedCode: Risky Code Execution and Generation Benchmark for Code Agents
di: Guo, Chengquan, et al.
Pubblicazione: (2024)
di: Guo, Chengquan, et al.
Pubblicazione: (2024)
MLDebugging: Towards Benchmarking Code Debugging Across Multi-Library Scenarios
di: Huang, Jinyang, et al.
Pubblicazione: (2025)
di: Huang, Jinyang, et al.
Pubblicazione: (2025)
Lyra: A Benchmark for Turducken-Style Code Generation
di: Liang, Qingyuan, et al.
Pubblicazione: (2021)
di: Liang, Qingyuan, et al.
Pubblicazione: (2021)
XSearch: Explainable Code Search via Concept-to-Code Alignment
di: Liu, Yiming, et al.
Pubblicazione: (2026)
di: Liu, Yiming, et al.
Pubblicazione: (2026)
Does Your Neural Code Completion Model Use My Code? A Membership Inference Approach
di: Wan, Yao, et al.
Pubblicazione: (2024)
di: Wan, Yao, et al.
Pubblicazione: (2024)
Optimizing Code Runtime Performance through Context-Aware Retrieval-Augmented Generation
di: Acharya, Manish, et al.
Pubblicazione: (2025)
di: Acharya, Manish, et al.
Pubblicazione: (2025)
A New Benchmark for the Appropriate Evaluation of RTL Code Optimization
di: Lu, Yao, et al.
Pubblicazione: (2026)
di: Lu, Yao, et al.
Pubblicazione: (2026)
Code Review Agent Benchmark
di: Zhang, Yuntong, et al.
Pubblicazione: (2026)
di: Zhang, Yuntong, et al.
Pubblicazione: (2026)
SELF-REDRAFT: Eliciting Intrinsic Exploration-Exploitation Balance in Test-Time Scaling for Code Generation
di: Chen, Yixiang, et al.
Pubblicazione: (2025)
di: Chen, Yixiang, et al.
Pubblicazione: (2025)
A Benchmark for Localizing Code and Non-Code Issues in Software Projects
di: Zhang, Zejun, et al.
Pubblicazione: (2025)
di: Zhang, Zejun, et al.
Pubblicazione: (2025)
CodeGeeX: A Pre-Trained Model for Code Generation with Multilingual Benchmarking on HumanEval-X
di: Zheng, Qinkai, et al.
Pubblicazione: (2023)
di: Zheng, Qinkai, et al.
Pubblicazione: (2023)
One Model, Many Skills: Parameter-Efficient Fine-Tuning for Multitask Code Analysis
di: Akli, Amal, et al.
Pubblicazione: (2026)
di: Akli, Amal, et al.
Pubblicazione: (2026)
Goedel-Code-Prover: Hierarchical Proof Search for Open State-of-the-Art Code Verification
di: Li, Zenan, et al.
Pubblicazione: (2026)
di: Li, Zenan, et al.
Pubblicazione: (2026)
From Charts to Code: A Hierarchical Benchmark for Multimodal Models
di: Tang, Jiahao, et al.
Pubblicazione: (2025)
di: Tang, Jiahao, et al.
Pubblicazione: (2025)
Beyond Autoregression: An Empirical Study of Diffusion Large Language Models for Code Generation
di: Li, Chengze, et al.
Pubblicazione: (2025)
di: Li, Chengze, et al.
Pubblicazione: (2025)
SpareCodeSearch: Searching for Code Context When You Have No Spare GPU
di: Nguyen, Minh
Pubblicazione: (2025)
di: Nguyen, Minh
Pubblicazione: (2025)
SimdBench: Benchmarking Large Language Models for SIMD-Intrinsic Code Generation
di: He, Yibo, et al.
Pubblicazione: (2025)
di: He, Yibo, et al.
Pubblicazione: (2025)
Benchmarking Correctness and Security in Multi-Turn Code Generation
di: Rawal, Ruchit, et al.
Pubblicazione: (2025)
di: Rawal, Ruchit, et al.
Pubblicazione: (2025)
Unseen Horizons: Unveiling the Real Capability of LLM Code Generation Beyond the Familiar
di: Zhang, Yuanliang, et al.
Pubblicazione: (2024)
di: Zhang, Yuanliang, et al.
Pubblicazione: (2024)
Beyond Correctness: Benchmarking Multi-dimensional Code Generation for Large Language Models
di: Zheng, Jiasheng, et al.
Pubblicazione: (2024)
di: Zheng, Jiasheng, et al.
Pubblicazione: (2024)
SpecAgent: A Speculative Retrieval and Forecasting Agent for Code Completion
di: Ma, George, et al.
Pubblicazione: (2025)
di: Ma, George, et al.
Pubblicazione: (2025)
ReCode: Improving LLM-based Code Repair with Fine-Grained Retrieval-Augmented Generation
di: Zhao, Yicong, et al.
Pubblicazione: (2025)
di: Zhao, Yicong, et al.
Pubblicazione: (2025)
A.S.E: A Repository-Level Benchmark for Evaluating Security in AI-Generated Code
di: Lian, Keke, et al.
Pubblicazione: (2025)
di: Lian, Keke, et al.
Pubblicazione: (2025)
Beyond Accuracy: Characterizing Code Comprehension Capabilities in (Large) Language Models
di: Mächtle, Felix, et al.
Pubblicazione: (2026)
di: Mächtle, Felix, et al.
Pubblicazione: (2026)
FastCoder: Accelerating Repository-level Code Generation via Efficient Retrieval and Verification
di: Zhao, Qianhui, et al.
Pubblicazione: (2025)
di: Zhao, Qianhui, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Unifying the Perspectives of NLP and Software Engineering: A Survey on Language Models for Code
di: Zhang, Ziyin, et al.
Pubblicazione: (2023) -
Beyond Function-Level Search: Repository-Aware Dual-Encoder Code Retrieval with Adversarial Verification
di: Liu, Aofan, et al.
Pubblicazione: (2025) -
InfCode-C++: Intent-Guided Semantic Retrieval and AST-Structured Search for C++ Issue Resolution
di: Dong, Qingao, et al.
Pubblicazione: (2025) -
CodeFuse-CR-Bench: A Comprehensiveness-aware Benchmark for End-to-End Code Review Evaluation in Python Projects
di: Guo, Hanyang, et al.
Pubblicazione: (2025) -
AdaptEval: A Benchmark for Evaluating Large Language Models on Code Snippet Adaptation
di: Zhang, Tanghaoran, et al.
Pubblicazione: (2026)