An Effective Approach to Embedding Source Code by Combining Large Language and Sentence Embedding Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Xian, Zixiang, Cui, Chenhui, Huang, Rubing, Fang, Chunrong, Chen, Zhenyu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
TransformCode: A Contrastive Learning Framework for Code Embedding via Subtree Transformation
di: Xian, Zixiang, et al.
Pubblicazione: (2023)
di: Xian, Zixiang, et al.
Pubblicazione: (2023)
EmbedAgent: Benchmarking Large Language Models in Embedded System Development
di: Xu, Ruiyang, et al.
Pubblicazione: (2025)
di: Xu, Ruiyang, et al.
Pubblicazione: (2025)
Source Code Summarization in the Era of Large Language Models
di: Sun, Weisong, et al.
Pubblicazione: (2024)
di: Sun, Weisong, et al.
Pubblicazione: (2024)
Combining Large Language Models with Static Analyzers for Code Review Generation
di: Jaoua, Imen, et al.
Pubblicazione: (2025)
di: Jaoua, Imen, et al.
Pubblicazione: (2025)
Selecting and Combining Large Language Models for Scalable Code Clone Detection
di: Chochlov, Muslim, et al.
Pubblicazione: (2025)
di: Chochlov, Muslim, et al.
Pubblicazione: (2025)
Effective, Platform-Independent GUI Testing via Image Embedding and Reinforcement Learning
di: Yu, Shengcheng, et al.
Pubblicazione: (2022)
di: Yu, Shengcheng, et al.
Pubblicazione: (2022)
Towards Leveraging Large Language Model Summaries for Topic Modeling in Source Code
di: Carissimi, Michele, et al.
Pubblicazione: (2025)
di: Carissimi, Michele, et al.
Pubblicazione: (2025)
CodeXEmbed: A Generalist Embedding Model Family for Multiligual and Multi-task Code Retrieval
di: Liu, Ye, et al.
Pubblicazione: (2024)
di: Liu, Ye, et al.
Pubblicazione: (2024)
Large Language Models for Automated Web-Form-Test Generation: An Empirical Study
di: Li, Tao, et al.
Pubblicazione: (2024)
di: Li, Tao, et al.
Pubblicazione: (2024)
SWE-Skills-Bench: Do Agent Skills Actually Help in Real-World Software Engineering?
di: Han, Tingxu, et al.
Pubblicazione: (2026)
di: Han, Tingxu, et al.
Pubblicazione: (2026)
Large Language Models for Mobile GUI Text Input Generation: An Empirical Study
di: Cui, Chenhui, et al.
Pubblicazione: (2024)
di: Cui, Chenhui, et al.
Pubblicazione: (2024)
Asm2SrcEval: Evaluating Large Language Models for Assembly-to-Source Code Translation
di: Hamedi, Parisa, et al.
Pubblicazione: (2025)
di: Hamedi, Parisa, et al.
Pubblicazione: (2025)
Enhancing Cross-Language Code Translation via Task-Specific Embedding Alignment in Retrieval-Augmented Generation
di: Bhattarai, Manish, et al.
Pubblicazione: (2024)
di: Bhattarai, Manish, et al.
Pubblicazione: (2024)
On the Limitations of Embedding Based Methods for Measuring Functional Correctness for Code Generation
di: Naik, Atharva
Pubblicazione: (2024)
di: Naik, Atharva
Pubblicazione: (2024)
Generating Software Architecture Description from Source Code using Reverse Engineering and Large Language Model
di: Hatahet, Ahmad, et al.
Pubblicazione: (2025)
di: Hatahet, Ahmad, et al.
Pubblicazione: (2025)
INTERVENOR: Prompting the Coding Ability of Large Language Models with the Interactive Chain of Repair
di: Wang, Hanbin, et al.
Pubblicazione: (2023)
di: Wang, Hanbin, et al.
Pubblicazione: (2023)
Generating High-Quality Datasets for Code Editing via Open-Source Language Models
di: Zhang, Zekai, et al.
Pubblicazione: (2025)
di: Zhang, Zekai, et al.
Pubblicazione: (2025)
CodeCSE: A Simple Multilingual Model for Code and Comment Sentence Embeddings
di: Varkey, Anthony, et al.
Pubblicazione: (2024)
di: Varkey, Anthony, et al.
Pubblicazione: (2024)
When the Code Autopilot Breaks: Why LLMs Falter in Embedded Machine Learning
di: Morabito, Roberto, et al.
Pubblicazione: (2025)
di: Morabito, Roberto, et al.
Pubblicazione: (2025)
CodeVision: Detecting LLM-Generated Code Using 2D Token Probability Maps and Vision Models
di: Xu, Zhenyu, et al.
Pubblicazione: (2025)
di: Xu, Zhenyu, et al.
Pubblicazione: (2025)
Insights from Benchmarking Frontier Language Models on Web App Code Generation
di: Cui, Yi
Pubblicazione: (2024)
di: Cui, Yi
Pubblicazione: (2024)
Task Abstention for Large Language Models in Code Generation
di: Zhou, Yanke, et al.
Pubblicazione: (2026)
di: Zhou, Yanke, et al.
Pubblicazione: (2026)
SimdBench: Benchmarking Large Language Models for SIMD-Intrinsic Code Generation
di: He, Yibo, et al.
Pubblicazione: (2025)
di: He, Yibo, et al.
Pubblicazione: (2025)
Exploring and Unleashing the Power of Large Language Models in Automated Code Translation
di: Yang, Zhen, et al.
Pubblicazione: (2024)
di: Yang, Zhen, et al.
Pubblicazione: (2024)
Personality-Guided Code Generation Using Large Language Models
di: Guo, Yaoqi, et al.
Pubblicazione: (2024)
di: Guo, Yaoqi, et al.
Pubblicazione: (2024)
Effective Code Membership Inference for Code Completion Models via Adversarial Prompts
di: Jiang, Yuan, et al.
Pubblicazione: (2025)
di: Jiang, Yuan, et al.
Pubblicazione: (2025)
An Evaluation of Context Length Extrapolation in Long Code via Positional Embeddings and Efficient Attention
di: Ghosh, Madhusudan, et al.
Pubblicazione: (2026)
di: Ghosh, Madhusudan, et al.
Pubblicazione: (2026)
Do Machines and Humans Focus on Similar Code? Exploring Explainability of Large Language Models in Code Summarization
di: Li, Jiliang, et al.
Pubblicazione: (2024)
di: Li, Jiliang, et al.
Pubblicazione: (2024)
Evaluating Large Language Models for Code Review
di: Cihan, Umut, et al.
Pubblicazione: (2025)
di: Cihan, Umut, et al.
Pubblicazione: (2025)
Structure-Aware Corpus Construction and User-Perception-Aligned Metrics for Large-Language-Model Code Completion
di: Liu, Dengfeng, et al.
Pubblicazione: (2025)
di: Liu, Dengfeng, et al.
Pubblicazione: (2025)
AutoCoder: Enhancing Code Large Language Model with \textsc{AIEV-Instruct}
di: Lei, Bin, et al.
Pubblicazione: (2024)
di: Lei, Bin, et al.
Pubblicazione: (2024)
ESALE: Enhancing Code-Summary Alignment Learning for Source Code Summarization
di: Fang, Chunrong, et al.
Pubblicazione: (2024)
di: Fang, Chunrong, et al.
Pubblicazione: (2024)
Towards Advancing Code Generation with Large Language Models: A Research Roadmap
di: Jin, Haolin, et al.
Pubblicazione: (2025)
di: Jin, Haolin, et al.
Pubblicazione: (2025)
Large Language Models (LLMs) for Source Code Analysis: applications, models and datasets
di: Jelodar, Hamed, et al.
Pubblicazione: (2025)
di: Jelodar, Hamed, et al.
Pubblicazione: (2025)
NARRepair: Non-Autoregressive Code Generation Model for Automatic Program Repair
di: Yang, Zhenyu, et al.
Pubblicazione: (2024)
di: Yang, Zhenyu, et al.
Pubblicazione: (2024)
A Deep Dive Into Large Language Model Code Generation Mistakes: What and Why?
di: Chen, QiHong, et al.
Pubblicazione: (2024)
di: Chen, QiHong, et al.
Pubblicazione: (2024)
Enhancing High-Quality Code Generation in Large Language Models with Comparative Prefix-Tuning
di: Jiang, Yuan, et al.
Pubblicazione: (2025)
di: Jiang, Yuan, et al.
Pubblicazione: (2025)
LLM4EFFI: Leveraging Large Language Models to Enhance Code Efficiency and Correctness
di: Ye, Tong, et al.
Pubblicazione: (2025)
di: Ye, Tong, et al.
Pubblicazione: (2025)
Embedding Software Intent: Lightweight Java Module Recovery
di: He, Yirui, et al.
Pubblicazione: (2025)
di: He, Yirui, et al.
Pubblicazione: (2025)
GeoCode-GPT: A Large Language Model for Geospatial Code Generation Tasks
di: Hou, Shuyang, et al.
Pubblicazione: (2024)
di: Hou, Shuyang, et al.
Pubblicazione: (2024)
Documenti analoghi
-
TransformCode: A Contrastive Learning Framework for Code Embedding via Subtree Transformation
di: Xian, Zixiang, et al.
Pubblicazione: (2023) -
EmbedAgent: Benchmarking Large Language Models in Embedded System Development
di: Xu, Ruiyang, et al.
Pubblicazione: (2025) -
Source Code Summarization in the Era of Large Language Models
di: Sun, Weisong, et al.
Pubblicazione: (2024) -
Combining Large Language Models with Static Analyzers for Code Review Generation
di: Jaoua, Imen, et al.
Pubblicazione: (2025) -
Selecting and Combining Large Language Models for Scalable Code Clone Detection
di: Chochlov, Muslim, et al.
Pubblicazione: (2025)