The Struggles of LLMs in Cross-lingual Code Clone Detection
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Moumoula, Micheline Bénédicte, Kabore, Abdoul Kader, Klein, Jacques, Bissyande, Tegawendé |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Programming Language Confusion: When Code LLMs Can't Keep their Languages Straight
par: Moumoula, Micheline Bénédicte, et autres
Publié: (2025)
par: Moumoula, Micheline Bénédicte, et autres
Publié: (2025)
The Code Barrier: What LLMs Actually Understand?
par: Nikiema, Serge Lionel, et autres
Publié: (2025)
par: Nikiema, Serge Lionel, et autres
Publié: (2025)
Beyond Language Barriers: Multi-Agent Coordination for Multi-Language Code Generation
par: Moumoula, Micheline Bénédicte, et autres
Publié: (2025)
par: Moumoula, Micheline Bénédicte, et autres
Publié: (2025)
Correctness isnt Efficiency: Runtime Memory Divergence in LLM-Generated Code
par: Rajput, Prateek, et autres
Publié: (2026)
par: Rajput, Prateek, et autres
Publié: (2026)
Detection of security smells in IaC scripts through semantics-aware code and language processing
par: War, Aicha, et autres
Publié: (2025)
par: War, Aicha, et autres
Publié: (2025)
Learned or Memorized ? Quantifying Memorization Advantage in Code LLMs
par: Euraste, Djiré Albérick, et autres
Publié: (2026)
par: Euraste, Djiré Albérick, et autres
Publié: (2026)
Dynamic Stability of LLM-Generated Code
par: Rajput, Prateek, et autres
Publié: (2025)
par: Rajput, Prateek, et autres
Publié: (2025)
Security smells in infrastructure as code: a taxonomy update beyond the seven sins
par: War, Aicha, et autres
Publié: (2025)
par: War, Aicha, et autres
Publié: (2025)
Using Contrastive Learning to Improve Two-Way Reasoning in Large Language Models: The Obfuscation Task as a Case Study
par: Nikiema, Serge Lionel, et autres
Publié: (2025)
par: Nikiema, Serge Lionel, et autres
Publié: (2025)
Reinforcement Learning-Guided Chain-of-Draft for Token-Efficient Code Generation
par: Tang, Xunzhu, et autres
Publié: (2025)
par: Tang, Xunzhu, et autres
Publié: (2025)
How Small Transformation Expose the Weakness of Semantic Similarity Measures
par: Nikiema, Serge Lionel, et autres
Publié: (2025)
par: Nikiema, Serge Lionel, et autres
Publié: (2025)
Standing on the Shoulders of Giants: Stabilized Knowledge Distillation for Cross--Language Code Clone Detection
par: Khajezade, Mohamad, et autres
Publié: (2026)
par: Khajezade, Mohamad, et autres
Publié: (2026)
SIEVE: Towards Verifiable Certification for Code-datasets
par: Mbodji, Fatou Ndiaye, et autres
Publié: (2025)
par: Mbodji, Fatou Ndiaye, et autres
Publié: (2025)
Characterizing Build Compromises Through Vulnerability Disclosure Analysis
par: Diao, Maimouna Tamah, et autres
Publié: (2025)
par: Diao, Maimouna Tamah, et autres
Publié: (2025)
From Rookie to Expert: Manipulating LLMs for Automated Vulnerability Exploitation in Enterprise Software
par: Diouf, Moustapha Awwalou, et autres
Publié: (2025)
par: Diouf, Moustapha Awwalou, et autres
Publié: (2025)
Security Evaluation of Android apps in budget African Mobile Devices
par: Diallo, Alioune, et autres
Publié: (2025)
par: Diallo, Alioune, et autres
Publié: (2025)
DetectBERT: Towards Full App-Level Representation Learning to Detect Android Malware
par: Sun, Tiezhu, et autres
Publié: (2024)
par: Sun, Tiezhu, et autres
Publié: (2024)
Large-scale, Independent and Comprehensive study of the power of LLMs for test case generation
par: Ouédraogo, Wendkûuni C., et autres
Publié: (2024)
par: Ouédraogo, Wendkûuni C., et autres
Publié: (2024)
In-Context Code-Text Learning for Bimodal Software Engineering
par: Tang, Xunzhu, et autres
Publié: (2024)
par: Tang, Xunzhu, et autres
Publié: (2024)
CodeFuse-13B: A Pretrained Multi-lingual Code Large Language Model
par: Di, Peng, et autres
Publié: (2023)
par: Di, Peng, et autres
Publié: (2023)
Enriching Automatic Test Case Generation by Extracting Relevant Test Inputs from Bug Reports
par: Ouédraogo, Wendkûuni C., et autres
Publié: (2023)
par: Ouédraogo, Wendkûuni C., et autres
Publié: (2023)
Boosting Open-Source LLMs for Program Repair via Reasoning Transfer and LLM-Guided Reinforcement Learning
par: Tang, Xunzhu, et autres
Publié: (2025)
par: Tang, Xunzhu, et autres
Publié: (2025)
SimClone: Detecting Tabular Data Clones using Value Similarity
par: Yang, Xu, et autres
Publié: (2024)
par: Yang, Xu, et autres
Publié: (2024)
Investigating the Efficacy of Large Language Models for Code Clone Detection
par: Khajezade, Mohamad, et autres
Publié: (2024)
par: Khajezade, Mohamad, et autres
Publié: (2024)
Memorization or Interpolation ? Detecting LLM Memorization through Input Perturbation Analysis
par: Djiré, Albérick Euraste, et autres
Publié: (2025)
par: Djiré, Albérick Euraste, et autres
Publié: (2025)
HGAdapter: Hypergraph-based Adapters in Language Models for Code Summarization and Clone Detection
par: Yang, Guang, et autres
Publié: (2025)
par: Yang, Guang, et autres
Publié: (2025)
An Empirical Study of AI Techniques in Mobile Applications
par: Li, Yinghua, et autres
Publié: (2022)
par: Li, Yinghua, et autres
Publié: (2022)
An Empirical Evaluation of Locally Deployed LLMs for Bug Detection in Python Code
par: Vulićević, Jelena Ilić
Publié: (2026)
par: Vulićević, Jelena Ilić
Publié: (2026)
AndroLibZoo: A Reliable Dataset of Libraries Based on Software Dependency Analysis
par: Samhi, Jordan, et autres
Publié: (2023)
par: Samhi, Jordan, et autres
Publié: (2023)
On LLMs' Internal Representation of Code Correctness
par: Ribeiro, Francisco, et autres
Publié: (2025)
par: Ribeiro, Francisco, et autres
Publié: (2025)
Operational Robustness of LLMs on Code Generation
par: Paul, Debalina Ghosh, et autres
Publié: (2026)
par: Paul, Debalina Ghosh, et autres
Publié: (2026)
CodeTaste: Can LLMs Generate Human-Level Code Refactorings?
par: Thillen, Alex, et autres
Publié: (2026)
par: Thillen, Alex, et autres
Publié: (2026)
Evaluating the Use of LLMs for Documentation to Code Traceability
par: Alor, Ebube, et autres
Publié: (2025)
par: Alor, Ebube, et autres
Publié: (2025)
Open-Source AI-based SE Tools: Opportunities and Challenges of Collaborative Software Learning
par: Lin, Zhihao, et autres
Publié: (2024)
par: Lin, Zhihao, et autres
Publié: (2024)
LLMs in Coding and their Impact on the Commercial Software Engineering Landscape
par: Belozerov, Vladislav, et autres
Publié: (2025)
par: Belozerov, Vladislav, et autres
Publié: (2025)
Protocode: Prototype-Driven Interpretability for Code Generation in LLMs
par: Bodla, Krishna Vamshi, et autres
Publié: (2025)
par: Bodla, Krishna Vamshi, et autres
Publié: (2025)
DexRay: A Simple, yet Effective Deep Learning Approach to Android Malware Detection based on Image Representation of Bytecode
par: Daoudi, Nadia, et autres
Publié: (2021)
par: Daoudi, Nadia, et autres
Publié: (2021)
Automating Code Adaptation for MLOps -- A Benchmarking Study on LLMs
par: Patel, Harsh, et autres
Publié: (2024)
par: Patel, Harsh, et autres
Publié: (2024)
Drawing Pandas: A Benchmark for LLMs in Generating Plotting Code
par: Galimzyanov, Timur, et autres
Publié: (2024)
par: Galimzyanov, Timur, et autres
Publié: (2024)
LiCoEval: Evaluating LLMs on License Compliance in Code Generation
par: Xu, Weiwei, et autres
Publié: (2024)
par: Xu, Weiwei, et autres
Publié: (2024)
Documents similaires
-
Programming Language Confusion: When Code LLMs Can't Keep their Languages Straight
par: Moumoula, Micheline Bénédicte, et autres
Publié: (2025) -
The Code Barrier: What LLMs Actually Understand?
par: Nikiema, Serge Lionel, et autres
Publié: (2025) -
Beyond Language Barriers: Multi-Agent Coordination for Multi-Language Code Generation
par: Moumoula, Micheline Bénédicte, et autres
Publié: (2025) -
Correctness isnt Efficiency: Runtime Memory Divergence in LLM-Generated Code
par: Rajput, Prateek, et autres
Publié: (2026) -
Detection of security smells in IaC scripts through semantics-aware code and language processing
par: War, Aicha, et autres
Publié: (2025)