Semantic Source Code Segmentation using Small and Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Dahou, Abdelhalim, Scherp, Ansgar, Kurten, Sebastian, Mathiak, Brigitte, Chauhan, Madhu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
On the Anatomy of Real-World R Code for Static Analysis
di: Sihler, Florian, et al.
Pubblicazione: (2024)
di: Sihler, Florian, et al.
Pubblicazione: (2024)
LLMigrate: Transforming "Lazy" Large Language Models into Efficient Source Code Migrators
di: Liu, Yuchen, et al.
Pubblicazione: (2025)
di: Liu, Yuchen, et al.
Pubblicazione: (2025)
CodeMind: Evaluating Large Language Models for Code Reasoning
di: Liu, Changshu, et al.
Pubblicazione: (2024)
di: Liu, Changshu, et al.
Pubblicazione: (2024)
How Programming Concepts and Neurons Are Shared in Code Language Models
di: Kargaran, Amir Hossein, et al.
Pubblicazione: (2025)
di: Kargaran, Amir Hossein, et al.
Pubblicazione: (2025)
Neural Models for Source Code Synthesis and Completion
di: Niyogi, Mitodru
Pubblicazione: (2024)
di: Niyogi, Mitodru
Pubblicazione: (2024)
SWE-QA: Can Language Models Answer Repository-level Code Questions?
di: Peng, Weihan, et al.
Pubblicazione: (2025)
di: Peng, Weihan, et al.
Pubblicazione: (2025)
Scalable, Validated Code Translation of Entire Projects using Large Language Models
di: Zhang, Hanliang, et al.
Pubblicazione: (2024)
di: Zhang, Hanliang, et al.
Pubblicazione: (2024)
NExT: Teaching Large Language Models to Reason about Code Execution
di: Ni, Ansong, et al.
Pubblicazione: (2024)
di: Ni, Ansong, et al.
Pubblicazione: (2024)
SV-TrustEval-C: Evaluating Structure and Semantic Reasoning in Large Language Models for Source Code Vulnerability Analysis
di: Li, Yansong, et al.
Pubblicazione: (2025)
di: Li, Yansong, et al.
Pubblicazione: (2025)
Strengthening Programming Comprehension in Large Language Models through Code Generation
di: Ren, Xiaoning, et al.
Pubblicazione: (2025)
di: Ren, Xiaoning, et al.
Pubblicazione: (2025)
HumanEval-XL: A Multilingual Code Generation Benchmark for Cross-lingual Natural Language Generalization
di: Peng, Qiwei, et al.
Pubblicazione: (2024)
di: Peng, Qiwei, et al.
Pubblicazione: (2024)
A Multi-Perspective Architecture for Semantic Code Search
di: Haldar, Rajarshi, et al.
Pubblicazione: (2020)
di: Haldar, Rajarshi, et al.
Pubblicazione: (2020)
PerfCodeBench: Benchmarking LLMs for System-Level High-Performance Code Optimization
di: Jing, Huihao, et al.
Pubblicazione: (2026)
di: Jing, Huihao, et al.
Pubblicazione: (2026)
COBOL-Coder: Domain-Adapted Large Language Models for COBOL Code Generation and Translation
di: Dau, Anh T. V., et al.
Pubblicazione: (2026)
di: Dau, Anh T. V., et al.
Pubblicazione: (2026)
From Effectiveness to Efficiency: Uncovering Linguistic Bias in Large Language Model-based Code Generation
di: Jiang, Weipeng, et al.
Pubblicazione: (2024)
di: Jiang, Weipeng, et al.
Pubblicazione: (2024)
Structural Code Search using Natural Language Queries
di: Limpanukorn, Ben, et al.
Pubblicazione: (2025)
di: Limpanukorn, Ben, et al.
Pubblicazione: (2025)
Evaluating Program Semantics Reasoning with Type Inference in System F
di: He, Yifeng, et al.
Pubblicazione: (2025)
di: He, Yifeng, et al.
Pubblicazione: (2025)
Generating Equivalent Representations of Code By A Self-Reflection Approach
di: Li, Jia, et al.
Pubblicazione: (2024)
di: Li, Jia, et al.
Pubblicazione: (2024)
Revisiting Code Similarity Evaluation with Abstract Syntax Tree Edit Distance
di: Song, Yewei, et al.
Pubblicazione: (2024)
di: Song, Yewei, et al.
Pubblicazione: (2024)
LLMs Lean on Priors, Not Programming Language Semantics
di: Thimmaiah, Aditya, et al.
Pubblicazione: (2025)
di: Thimmaiah, Aditya, et al.
Pubblicazione: (2025)
SaraCoder: Orchestrating Semantic and Structural Cues for Resource-Optimized Repository-Level Code Completion
di: Chen, Xiaohan, et al.
Pubblicazione: (2025)
di: Chen, Xiaohan, et al.
Pubblicazione: (2025)
Compilation of Commit Changes within Java Source Code Repositories
di: Schott, Stefan, et al.
Pubblicazione: (2024)
di: Schott, Stefan, et al.
Pubblicazione: (2024)
Functional Consistency of LLM Code Embeddings: A Self-Evolving Data Synthesis Framework for Benchmarking
di: Li, Zhuohao, et al.
Pubblicazione: (2025)
di: Li, Zhuohao, et al.
Pubblicazione: (2025)
FASSILA: A Corpus for Algerian Dialect Fake News Detection and Sentiment Analysis
di: Abdedaiem, Amin, et al.
Pubblicazione: (2024)
di: Abdedaiem, Amin, et al.
Pubblicazione: (2024)
EnStack: An Ensemble Stacking Framework of Large Language Models for Enhanced Vulnerability Detection in Source Code
di: Ridoy, Shahriyar Zaman, et al.
Pubblicazione: (2024)
di: Ridoy, Shahriyar Zaman, et al.
Pubblicazione: (2024)
A Survey of using Large Language Models for Generating Infrastructure as Code
di: Srivatsa, Kalahasti Ganesh, et al.
Pubblicazione: (2024)
di: Srivatsa, Kalahasti Ganesh, et al.
Pubblicazione: (2024)
Enhanced Automated Code Vulnerability Repair using Large Language Models
di: de-Fitero-Dominguez, David, et al.
Pubblicazione: (2024)
di: de-Fitero-Dominguez, David, et al.
Pubblicazione: (2024)
Refactoring Programs Using Large Language Models with Few-Shot Examples
di: Shirafuji, Atsushi, et al.
Pubblicazione: (2023)
di: Shirafuji, Atsushi, et al.
Pubblicazione: (2023)
VisCoder2: Building Multi-Language Visualization Coding Agents
di: Ni, Yuansheng, et al.
Pubblicazione: (2025)
di: Ni, Yuansheng, et al.
Pubblicazione: (2025)
Benchmarking LLM Code Generation for Audio Programming with Visual Dataflow Languages
di: Zhang, William, et al.
Pubblicazione: (2024)
di: Zhang, William, et al.
Pubblicazione: (2024)
Mix-of-Language-Experts Architecture for Multilingual Programming
di: Zong, Yifan, et al.
Pubblicazione: (2025)
di: Zong, Yifan, et al.
Pubblicazione: (2025)
EquiBench: Benchmarking Large Language Models' Reasoning about Program Semantics via Equivalence Checking
di: Wei, Anjiang, et al.
Pubblicazione: (2025)
di: Wei, Anjiang, et al.
Pubblicazione: (2025)
SwiftEval: Developing a Language-Specific Benchmark for LLM-generated Code Evaluation
di: Petrukha, Ivan, et al.
Pubblicazione: (2025)
di: Petrukha, Ivan, et al.
Pubblicazione: (2025)
Calibration of Large Language Models on Code Summarization
di: Virk, Yuvraj, et al.
Pubblicazione: (2024)
di: Virk, Yuvraj, et al.
Pubblicazione: (2024)
Bridging Code Graphs and Large Language Models for Better Code Understanding
di: Chen, Zeqi, et al.
Pubblicazione: (2025)
di: Chen, Zeqi, et al.
Pubblicazione: (2025)
Mercury: A Code Efficiency Benchmark for Code Large Language Models
di: Du, Mingzhe, et al.
Pubblicazione: (2024)
di: Du, Mingzhe, et al.
Pubblicazione: (2024)
A Roadmap for Tamed Interactions with Large Language Models
di: Scotti, Vincenzo, et al.
Pubblicazione: (2025)
di: Scotti, Vincenzo, et al.
Pubblicazione: (2025)
LPR: Large Language Models-Aided Program Reduction
di: Zhang, Mengxiao, et al.
Pubblicazione: (2023)
di: Zhang, Mengxiao, et al.
Pubblicazione: (2023)
Large Language Models for Multilingual Code Intelligence: A Survey
di: Jiang, Chao, et al.
Pubblicazione: (2026)
di: Jiang, Chao, et al.
Pubblicazione: (2026)
CodeFuse-Query: A Data-Centric Static Code Analysis System for Large-Scale Organizations
di: Xie, Xiaoheng, et al.
Pubblicazione: (2024)
di: Xie, Xiaoheng, et al.
Pubblicazione: (2024)
Documenti analoghi
-
On the Anatomy of Real-World R Code for Static Analysis
di: Sihler, Florian, et al.
Pubblicazione: (2024) -
LLMigrate: Transforming "Lazy" Large Language Models into Efficient Source Code Migrators
di: Liu, Yuchen, et al.
Pubblicazione: (2025) -
CodeMind: Evaluating Large Language Models for Code Reasoning
di: Liu, Changshu, et al.
Pubblicazione: (2024) -
How Programming Concepts and Neurons Are Shared in Code Language Models
di: Kargaran, Amir Hossein, et al.
Pubblicazione: (2025) -
Neural Models for Source Code Synthesis and Completion
di: Niyogi, Mitodru
Pubblicazione: (2024)