Improving Code Search with Hard Negative Sampling Based on Fine-tuning
Fuente:
arXiv
Guardado en:
| Autores principales: | Dong, Hande, Lin, Jiayi, Wang, Yanlin, Leng, Yichong, Chen, Jiawei, Xie, Yutao |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Scaling Laws Behind Code Understanding Model
por: Lin, Jiayi, et al.
Publicado: (2024)
por: Lin, Jiayi, et al.
Publicado: (2024)
Towards Better Code Understanding in Decoder-Only Models with Contrastive Learning
por: Lin, Jiayi, et al.
Publicado: (2024)
por: Lin, Jiayi, et al.
Publicado: (2024)
Does the Order of Fine-tuning Matter and Why?
por: Chen, Qihong, et al.
Publicado: (2024)
por: Chen, Qihong, et al.
Publicado: (2024)
Structure-aware Fine-tuning for Code Pre-trained Models
por: Wu, Jiayi, et al.
Publicado: (2024)
por: Wu, Jiayi, et al.
Publicado: (2024)
Improving the Robustness of Large Language Models for Code Tasks via Fine-tuning with Perturbed Data
por: Liu, Yang, et al.
Publicado: (2026)
por: Liu, Yang, et al.
Publicado: (2026)
AP2O-Coder: Adaptively Progressive Preference Optimization for Reducing Compilation and Runtime Errors in LLM-Generated Code
por: Zhang, Jianqing, et al.
Publicado: (2025)
por: Zhang, Jianqing, et al.
Publicado: (2025)
Revisiting Code Search in a Two-Stage Paradigm
por: Hu, Fan, et al.
Publicado: (2022)
por: Hu, Fan, et al.
Publicado: (2022)
Tackling Long Code Search with Splitting, Encoding, and Aggregating
por: Hu, Fan, et al.
Publicado: (2022)
por: Hu, Fan, et al.
Publicado: (2022)
A Hierarchical and Evolvable Benchmark for Fine-Grained Code Instruction Following with Multi-Turn Feedback
por: Duan, Guoliang, et al.
Publicado: (2025)
por: Duan, Guoliang, et al.
Publicado: (2025)
RAG or Fine-tuning? A Comparative Study on LCMs-based Code Completion in Industry
por: Wang, Chaozheng, et al.
Publicado: (2025)
por: Wang, Chaozheng, et al.
Publicado: (2025)
MORepair: Teaching LLMs to Repair Code via Multi-Objective Fine-tuning
por: Yang, Boyang, et al.
Publicado: (2024)
por: Yang, Boyang, et al.
Publicado: (2024)
You Augment Me: Exploring ChatGPT-based Data Augmentation for Semantic Code Search
por: Wang, Yanlin, et al.
Publicado: (2024)
por: Wang, Yanlin, et al.
Publicado: (2024)
Repair Ingredients Are All You Need: Improving Large Language Model-Based Program Repair via Repair Ingredients Search
por: Zhang, Jiayi, et al.
Publicado: (2025)
por: Zhang, Jiayi, et al.
Publicado: (2025)
D-LiFT: Improving LLM-based Decompiler Backend via Code Quality-driven Fine-tuning
por: Zou, Muqi, et al.
Publicado: (2025)
por: Zou, Muqi, et al.
Publicado: (2025)
Are Decoder-Only Large Language Models the Silver Bullet for Code Search?
por: Chen, Yuxuan, et al.
Publicado: (2024)
por: Chen, Yuxuan, et al.
Publicado: (2024)
Devstral: Fine-tuning Language Models for Coding Agent Applications
por: Rastogi, Abhinav, et al.
Publicado: (2025)
por: Rastogi, Abhinav, et al.
Publicado: (2025)
RLCoder: Reinforcement Learning for Repository-Level Code Completion
por: Wang, Yanlin, et al.
Publicado: (2024)
por: Wang, Yanlin, et al.
Publicado: (2024)
AnomalyGen: Enhancing Log-Based Anomaly Detection with Code-Guided Data Augmentation
por: Li, Xinyu, et al.
Publicado: (2026)
por: Li, Xinyu, et al.
Publicado: (2026)
Identifying Smart Contract Security Issues in Code Snippets from Stack Overflow
por: Chen, Jiachi, et al.
Publicado: (2024)
por: Chen, Jiachi, et al.
Publicado: (2024)
Code Less, Align More: Efficient LLM Fine-tuning for Code Generation with Data Pruning
por: Tsai, Yun-Da, et al.
Publicado: (2024)
por: Tsai, Yun-Da, et al.
Publicado: (2024)
RustRepoTrans: Repository-level Code Translation Benchmark Targeting Rust
por: Ou, Guangsheng, et al.
Publicado: (2024)
por: Ou, Guangsheng, et al.
Publicado: (2024)
Fault Localization from the Semantic Code Search Perspective
por: Qin, Yihao, et al.
Publicado: (2024)
por: Qin, Yihao, et al.
Publicado: (2024)
EffiCoder: Enhancing Code Generation in Large Language Models through Efficiency-Aware Fine-tuning
por: Huang, Dong, et al.
Publicado: (2024)
por: Huang, Dong, et al.
Publicado: (2024)
SparseCoder: Identifier-Aware Sparse Transformer for File-Level Code Summarization
por: Wang, Yanlin, et al.
Publicado: (2024)
por: Wang, Yanlin, et al.
Publicado: (2024)
Fine-Tuning Code Language Models to Detect Cross-Language Bugs
por: Li, Zengyang, et al.
Publicado: (2025)
por: Li, Zengyang, et al.
Publicado: (2025)
A Survey of Large Language Models for Code: Evolution, Benchmarking, and Future Trends
por: Zheng, Zibin, et al.
Publicado: (2023)
por: Zheng, Zibin, et al.
Publicado: (2023)
AI-assisted Code Authoring at Scale: Fine-tuning, deploying, and mixed methods evaluation
por: Murali, Vijayaraghavan, et al.
Publicado: (2023)
por: Murali, Vijayaraghavan, et al.
Publicado: (2023)
An Empirical Study of False Negatives and Positives of Static Code Analyzers From the Perspective of Historical Issues
por: Cui, Han, et al.
Publicado: (2024)
por: Cui, Han, et al.
Publicado: (2024)
EffiReasonTrans: RL-Optimized Reasoning for Code Translation
por: Wang, Yanlin, et al.
Publicado: (2025)
por: Wang, Yanlin, et al.
Publicado: (2025)
ReCode: Improving LLM-based Code Repair with Fine-Grained Retrieval-Augmented Generation
por: Zhao, Yicong, et al.
Publicado: (2025)
por: Zhao, Yicong, et al.
Publicado: (2025)
Search-Induced Issues in Web-Augmented LLM Code Generation: Detecting and Repairing Error-Inducing Pages
por: Wang, Guoqing, et al.
Publicado: (2026)
por: Wang, Guoqing, et al.
Publicado: (2026)
Breaking Memorization Barriers in LLM Code Fine-Tuning via Information Bottleneck for Improved Generalization
por: Wang, Changsheng, et al.
Publicado: (2025)
por: Wang, Changsheng, et al.
Publicado: (2025)
A Framework for Devising, Evaluating and Fine-tuning Indoor Tracking Algorithms
por: Diallo, Alpha, et al.
Publicado: (2025)
por: Diallo, Alpha, et al.
Publicado: (2025)
A Large-scale Empirical Study on Fine-tuning Large Language Models for Unit Testing
por: Shang, Ye, et al.
Publicado: (2024)
por: Shang, Ye, et al.
Publicado: (2024)
APPT: Boosting Automated Patch Correctness Prediction via Fine-tuning Pre-trained Models
por: Zhang, Quanjun, et al.
Publicado: (2023)
por: Zhang, Quanjun, et al.
Publicado: (2023)
An Empirical Study on Low-Code Programming using Traditional vs Large Language Model Support
por: Liu, Yongkun, et al.
Publicado: (2024)
por: Liu, Yongkun, et al.
Publicado: (2024)
A Preliminary Study on the Robustness of Code Generation by Large Language Models
por: Li, Zike, et al.
Publicado: (2025)
por: Li, Zike, et al.
Publicado: (2025)
Improving Code Localization with Repository Memory
por: Wang, Boshi, et al.
Publicado: (2025)
por: Wang, Boshi, et al.
Publicado: (2025)
CLARC: C/C++ Benchmark for Robust Code Search
por: Wang, Kaicheng, et al.
Publicado: (2026)
por: Wang, Kaicheng, et al.
Publicado: (2026)
ProfInfer: An eBPF-based Fine-Grained LLM Inference Profiler
por: Zou, Bohua, et al.
Publicado: (2026)
por: Zou, Bohua, et al.
Publicado: (2026)
Ejemplares similares
-
Scaling Laws Behind Code Understanding Model
por: Lin, Jiayi, et al.
Publicado: (2024) -
Towards Better Code Understanding in Decoder-Only Models with Contrastive Learning
por: Lin, Jiayi, et al.
Publicado: (2024) -
Does the Order of Fine-tuning Matter and Why?
por: Chen, Qihong, et al.
Publicado: (2024) -
Structure-aware Fine-tuning for Code Pre-trained Models
por: Wu, Jiayi, et al.
Publicado: (2024) -
Improving the Robustness of Large Language Models for Code Tasks via Fine-tuning with Perturbed Data
por: Liu, Yang, et al.
Publicado: (2026)