Looking into Black Box Code Language Models
Fuente:
arXiv
Saved in:
| Main Authors: | Haider, Muhammad Umair, Farooq, Umar, Siddique, A. B., Marron, Mark |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
What Users Value and Critique: Large-Scale Analysis of User Feedback on AI-Powered Mobile Apps
by: Chhetri, Vinaik, et al.
Published: (2025)
by: Chhetri, Vinaik, et al.
Published: (2025)
A Large-Scale Study on the Development and Issues of Multi-Agent AI Systems
by: Liu, Daniel, et al.
Published: (2026)
by: Liu, Daniel, et al.
Published: (2026)
Toward an Agentic Infused Software Ecosystem
by: Marron, Mark
Published: (2026)
by: Marron, Mark
Published: (2026)
The Competence Shadow: Theory and Bounds of AI Assistance in Safety Engineering
by: Siddique, Umair
Published: (2026)
by: Siddique, Umair
Published: (2026)
Understanding Robustness of Model Editing in Code LLMs
by: Chhetri, Vinaik, et al.
Published: (2025)
by: Chhetri, Vinaik, et al.
Published: (2025)
Turbulence: Systematically and Automatically Testing Instruction-Tuned Large Language Models for Code
by: Honarvar, Shahin, et al.
Published: (2023)
by: Honarvar, Shahin, et al.
Published: (2023)
Understanding Defects in Generated Codes by Language Models
by: Esfahani, Ali Mohammadi, et al.
Published: (2024)
by: Esfahani, Ali Mohammadi, et al.
Published: (2024)
Analyzing the Evolution and Maintenance of Quantum Software Repositories
by: Upadhyay, Krishna, et al.
Published: (2025)
by: Upadhyay, Krishna, et al.
Published: (2025)
A PennyLane-Centric Dataset to Enhance LLM-based Quantum Code Generation using RAG
by: Basit, Abdul, et al.
Published: (2025)
by: Basit, Abdul, et al.
Published: (2025)
Detecting Data Poisoning in Code Generation LLMs via Black-Box, Vulnerability-Oriented Scanning
by: Yan, Shenao, et al.
Published: (2026)
by: Yan, Shenao, et al.
Published: (2026)
Energy-Aware Code Generation with LLMs: Benchmarking Small vs. Large Language Models for Sustainable AI Programming
by: Ashraf, Humza, et al.
Published: (2025)
by: Ashraf, Humza, et al.
Published: (2025)
I Can Find You in Seconds! Leveraging Large Language Models for Code Authorship Attribution
by: Choi, Soohyeon, et al.
Published: (2025)
by: Choi, Soohyeon, et al.
Published: (2025)
Evaluating Large Language Models for Code Review
by: Cihan, Umut, et al.
Published: (2025)
by: Cihan, Umut, et al.
Published: (2025)
Localized Calibrated Uncertainty in Code Language Models
by: Gros, David, et al.
Published: (2025)
by: Gros, David, et al.
Published: (2025)
WebCompass: Towards Multimodal Web Coding Evaluation for Code Language Models
by: Lei, Xinping, et al.
Published: (2026)
by: Lei, Xinping, et al.
Published: (2026)
Fine-Tuning Code Language Models to Detect Cross-Language Bugs
by: Li, Zengyang, et al.
Published: (2025)
by: Li, Zengyang, et al.
Published: (2025)
GeoCode-GPT: A Large Language Model for Geospatial Code Generation Tasks
by: Hou, Shuyang, et al.
Published: (2024)
by: Hou, Shuyang, et al.
Published: (2024)
Augmenting Large Language Models with Static Code Analysis for Automated Code Quality Improvements
by: Abtahi, Seyed Moein, et al.
Published: (2025)
by: Abtahi, Seyed Moein, et al.
Published: (2025)
Task Abstention for Large Language Models in Code Generation
by: Zhou, Yanke, et al.
Published: (2026)
by: Zhou, Yanke, et al.
Published: (2026)
CodeGolf Bench: A Multi-Language Benchmark for Evaluating Concise Code Generation Capabilities of Large Language Models
by: Padwal, Vedant
Published: (2026)
by: Padwal, Vedant
Published: (2026)
Do Current Language Models Support Code Intelligence for R Programming Language?
by: Zhao, ZiXiao, et al.
Published: (2024)
by: Zhao, ZiXiao, et al.
Published: (2024)
Flow2Code: Evaluating Large Language Models for Flowchart-based Code Generation Capability
by: He, Mengliang, et al.
Published: (2025)
by: He, Mengliang, et al.
Published: (2025)
Personality-Guided Code Generation Using Large Language Models
by: Guo, Yaoqi, et al.
Published: (2024)
by: Guo, Yaoqi, et al.
Published: (2024)
Bugs in Large Language Models Generated Code: An Empirical Study
by: Tambon, Florian, et al.
Published: (2024)
by: Tambon, Florian, et al.
Published: (2024)
Assessing the Code Clone Detection Capability of Large Language Models
by: Zhang, Zixian, et al.
Published: (2024)
by: Zhang, Zixian, et al.
Published: (2024)
Large Language Model Guided Self-Debugging Code Generation
by: Adnan, Muntasir, et al.
Published: (2025)
by: Adnan, Muntasir, et al.
Published: (2025)
Devstral: Fine-tuning Language Models for Coding Agent Applications
by: Rastogi, Abhinav, et al.
Published: (2025)
by: Rastogi, Abhinav, et al.
Published: (2025)
Do Machines and Humans Focus on Similar Code? Exploring Explainability of Large Language Models in Code Summarization
by: Li, Jiliang, et al.
Published: (2024)
by: Li, Jiliang, et al.
Published: (2024)
CrossPL: Evaluating Large Language Models on Cross Programming Language Code Generation
by: Xiong, Zhanhang, et al.
Published: (2025)
by: Xiong, Zhanhang, et al.
Published: (2025)
Towards Leveraging Large Language Model Summaries for Topic Modeling in Source Code
by: Carissimi, Michele, et al.
Published: (2025)
by: Carissimi, Michele, et al.
Published: (2025)
Large Language Model-Driven Code Compliance Checking in Building Information Modeling
by: Madireddy, Soumya, et al.
Published: (2025)
by: Madireddy, Soumya, et al.
Published: (2025)
On the Compression of Language Models for Code: An Empirical Study on CodeBERT
by: d'Aloisio, Giordano, et al.
Published: (2024)
by: d'Aloisio, Giordano, et al.
Published: (2024)
Output Format Biases in the Evaluation of Large Language Models for Code Translation
by: Macedo, Marcos, et al.
Published: (2024)
by: Macedo, Marcos, et al.
Published: (2024)
An Empirical Study on Capability of Large Language Models in Understanding Code Semantics
by: Nguyen, Thu-Trang, et al.
Published: (2024)
by: Nguyen, Thu-Trang, et al.
Published: (2024)
Exploring and Unleashing the Power of Large Language Models in Automated Code Translation
by: Yang, Zhen, et al.
Published: (2024)
by: Yang, Zhen, et al.
Published: (2024)
Automated Repair of AI Code with Large Language Models and Formal Verification
by: Charalambous, Yiannis, et al.
Published: (2024)
by: Charalambous, Yiannis, et al.
Published: (2024)
Large Language Models in Code Co-generation for Safe Autonomous Vehicles
by: Nouri, Ali, et al.
Published: (2025)
by: Nouri, Ali, et al.
Published: (2025)
Combining Large Language Models with Static Analyzers for Code Review Generation
by: Jaoua, Imen, et al.
Published: (2025)
by: Jaoua, Imen, et al.
Published: (2025)
A Comparative Analysis of Large Language Models for Code Documentation Generation
by: Dvivedi, Shubhang Shekhar, et al.
Published: (2023)
by: Dvivedi, Shubhang Shekhar, et al.
Published: (2023)
Automated Code Review Using Large Language Models with Symbolic Reasoning
by: Icoz, Busra, et al.
Published: (2025)
by: Icoz, Busra, et al.
Published: (2025)
Similar Items
-
What Users Value and Critique: Large-Scale Analysis of User Feedback on AI-Powered Mobile Apps
by: Chhetri, Vinaik, et al.
Published: (2025) -
A Large-Scale Study on the Development and Issues of Multi-Agent AI Systems
by: Liu, Daniel, et al.
Published: (2026) -
Toward an Agentic Infused Software Ecosystem
by: Marron, Mark
Published: (2026) -
The Competence Shadow: Theory and Bounds of AI Assistance in Safety Engineering
by: Siddique, Umair
Published: (2026) -
Understanding Robustness of Model Editing in Code LLMs
by: Chhetri, Vinaik, et al.
Published: (2025)