Efficient and Scalable Provenance Tracking for LLM-Generated Code Snippets
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Gurioli, Andrea, D'Ascenzo, Davide, Pennino, Federico, Gabbrielli, Maurizio, Zacchiroli, Stefano |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Is This You, LLM? Recognizing AI-written Programs with Multilingual Code Stylometry
par: Gurioli, Andrea, et autres
Publié: (2024)
par: Gurioli, Andrea, et autres
Publié: (2024)
Do not copy and paste! Rewriting strategies for code retrieval
par: Gurioli, Andrea, et autres
Publié: (2026)
par: Gurioli, Andrea, et autres
Publié: (2026)
MoSE: Hierarchical Self-Distillation Enhances Early Layer Embeddings
par: Gurioli, Andrea, et autres
Publié: (2025)
par: Gurioli, Andrea, et autres
Publié: (2025)
DeepCodeSeek: Real-Time API Retrieval for Context-Aware Code Generation
par: Esakkiraja, Esakkivel, et autres
Publié: (2025)
par: Esakkiraja, Esakkivel, et autres
Publié: (2025)
In-Context Learning as an Effective Estimator of Functional Correctness of LLM-Generated Code
par: Das, Susmita, et autres
Publié: (2025)
par: Das, Susmita, et autres
Publié: (2025)
Context-Augmented Code Generation Using Programming Knowledge Graphs
par: Saberi, Iman, et autres
Publié: (2024)
par: Saberi, Iman, et autres
Publié: (2024)
Can Code Evaluation Metrics Detect Code Plagiarism?
par: Ebrahim, Fahad, et autres
Publié: (2026)
par: Ebrahim, Fahad, et autres
Publié: (2026)
MRWeb: An Exploration of Generating Multi-Page Resource-Aware Web Code from UI Designs
par: Wan, Yuxuan, et autres
Publié: (2024)
par: Wan, Yuxuan, et autres
Publié: (2024)
Developing Retrieval Augmented Generation (RAG) based LLM Systems from PDFs: An Experience Report
par: Khan, Ayman Asad, et autres
Publié: (2024)
par: Khan, Ayman Asad, et autres
Publié: (2024)
Dynamic ReAct: Scalable Tool Selection for Large-Scale MCP Environments
par: Gaurav, Nishant, et autres
Publié: (2025)
par: Gaurav, Nishant, et autres
Publié: (2025)
LLM Agents Improve Semantic Code Search
par: Jain, Sarthak, et autres
Publié: (2024)
par: Jain, Sarthak, et autres
Publié: (2024)
LLM-Cure: LLM-based Competitor User Review Analysis for Feature Enhancement
par: Assi, Maram, et autres
Publié: (2024)
par: Assi, Maram, et autres
Publié: (2024)
SweRank: Software Issue Localization with Code Ranking
par: Reddy, Revanth Gangi, et autres
Publié: (2025)
par: Reddy, Revanth Gangi, et autres
Publié: (2025)
TreeRanker: Fast and Model-agnostic Ranking System for Code Suggestions in IDEs
par: Cipollone, Daniele, et autres
Publié: (2025)
par: Cipollone, Daniele, et autres
Publié: (2025)
LLM Based Long Code Translation using Identifier Replacement
par: Chakraborty, Manojit, et autres
Publié: (2025)
par: Chakraborty, Manojit, et autres
Publié: (2025)
Modular Layout Synthesis (MLS): Front-end Code via Structure Normalization and Constrained Generation
par: Liu, Chong, et autres
Publié: (2025)
par: Liu, Chong, et autres
Publié: (2025)
Examining the Usage of Generative AI Models in Student Learning Activities for Software Programming
par: Chen, Rufeng, et autres
Publié: (2025)
par: Chen, Rufeng, et autres
Publié: (2025)
Code-Craft: Hierarchical Graph-Based Code Summarization for Enhanced Context Retrieval
par: Sounthiraraj, David, et autres
Publié: (2025)
par: Sounthiraraj, David, et autres
Publié: (2025)
Tracking Software Security Topics
par: Vu, Phong Minh, et autres
Publié: (2024)
par: Vu, Phong Minh, et autres
Publié: (2024)
cAST: Enhancing Code Retrieval-Augmented Generation with Structural Chunking via Abstract Syntax Tree
par: Zhang, Yilin, et autres
Publié: (2025)
par: Zhang, Yilin, et autres
Publié: (2025)
Long Code Arena: a Set of Benchmarks for Long-Context Code Models
par: Bogomolov, Egor, et autres
Publié: (2024)
par: Bogomolov, Egor, et autres
Publié: (2024)
Source Code Clone Detection Using Unsupervised Similarity Measures
par: Martinez-Gil, Jorge
Publié: (2024)
par: Martinez-Gil, Jorge
Publié: (2024)
GNN-Coder: Boosting Semantic Code Retrieval with Combined GNNs and Transformer
par: Ye, Yufan, et autres
Publié: (2025)
par: Ye, Yufan, et autres
Publié: (2025)
Deep Code Search with Naming-Agnostic Contrastive Multi-View Learning
par: Feng, Jiadong, et autres
Publié: (2024)
par: Feng, Jiadong, et autres
Publié: (2024)
MGS3: A Multi-Granularity Self-Supervised Code Search Framework
par: Li, Rui, et autres
Publié: (2025)
par: Li, Rui, et autres
Publié: (2025)
Evaluating LLM-Based Mobile App Recommendations: An Empirical Study
par: Motger, Quim, et autres
Publié: (2025)
par: Motger, Quim, et autres
Publié: (2025)
ARIES: A Scalable Multi-Agent Orchestration Framework for Real-Time Epidemiological Surveillance and Outbreak Monitoring
par: Wattamwar, Aniket, et autres
Publié: (2026)
par: Wattamwar, Aniket, et autres
Publié: (2026)
SBAN: A Framework & Multi-Dimensional Dataset for Large Language Model Pre-Training and Software Code Mining
par: Jelodar, Hamed, et autres
Publié: (2025)
par: Jelodar, Hamed, et autres
Publié: (2025)
CodeKGC: Code Language Model for Generative Knowledge Graph Construction
par: Bi, Zhen, et autres
Publié: (2023)
par: Bi, Zhen, et autres
Publié: (2023)
Repairing Language Model Pipelines by Meta Self-Refining Competing Constraints at Runtime
par: Eshghie, Mojtaba
Publié: (2025)
par: Eshghie, Mojtaba
Publié: (2025)
Formal Concept Analysis: a Structural Framework for Variability Extraction and Analysis
par: Galasso, Jessie
Publié: (2025)
par: Galasso, Jessie
Publié: (2025)
Unveiling Bias in Fairness Evaluations of Large Language Models: A Critical Literature Review of Music and Movie Recommendation Systems
par: Sah, Chandan Kumar, et autres
Publié: (2024)
par: Sah, Chandan Kumar, et autres
Publié: (2024)
Do Deployment Constraints Make LLMs Hallucinate Citations? An Empirical Study across Four Models and Five Prompting Regimes
par: Zhao, Chen, et autres
Publié: (2026)
par: Zhao, Chen, et autres
Publié: (2026)
Large Language Models to Enhance Business Process Modeling: Past, Present, and Future Trends
par: Bettencourt, João, et autres
Publié: (2026)
par: Bettencourt, João, et autres
Publié: (2026)
Language Model Powered Digital Biology with BRAD
par: Pickard, Joshua, et autres
Publié: (2024)
par: Pickard, Joshua, et autres
Publié: (2024)
CPRet: A Dataset, Benchmark, and Model for Retrieval in Competitive Programming
par: Deng, Han, et autres
Publié: (2025)
par: Deng, Han, et autres
Publié: (2025)
Taxonomy of the Retrieval System Framework: Pitfalls and Paradigms
par: Shah, Deep, et autres
Publié: (2026)
par: Shah, Deep, et autres
Publié: (2026)
Reformulate, Retrieve, Localize: Agents for Repository-Level Bug Localization
par: Caumartin, Genevieve, et autres
Publié: (2025)
par: Caumartin, Genevieve, et autres
Publié: (2025)
Enhancing Open-Domain Task-Solving Capability of LLMs via Autonomous Tool Integration from GitHub
par: Lyu, Bohan, et autres
Publié: (2023)
par: Lyu, Bohan, et autres
Publié: (2023)
Leveraging Graph-RAG and Prompt Engineering to Enhance LLM-Based Automated Requirement Traceability and Compliance Checks
par: Masoudifard, Arsalan, et autres
Publié: (2024)
par: Masoudifard, Arsalan, et autres
Publié: (2024)
Documents similaires
-
Is This You, LLM? Recognizing AI-written Programs with Multilingual Code Stylometry
par: Gurioli, Andrea, et autres
Publié: (2024) -
Do not copy and paste! Rewriting strategies for code retrieval
par: Gurioli, Andrea, et autres
Publié: (2026) -
MoSE: Hierarchical Self-Distillation Enhances Early Layer Embeddings
par: Gurioli, Andrea, et autres
Publié: (2025) -
DeepCodeSeek: Real-Time API Retrieval for Context-Aware Code Generation
par: Esakkiraja, Esakkivel, et autres
Publié: (2025) -
In-Context Learning as an Effective Estimator of Functional Correctness of LLM-Generated Code
par: Das, Susmita, et autres
Publié: (2025)