The Invisible Hand: Unveiling Provider Bias in Large Language Models for Code Generation
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhang, Xiaoyu, Zhai, Juan, Ma, Shiqing, Bao, Qingshuang, Jiang, Weipeng, Wang, Qian, Shen, Chao, Liu, Yang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
False Friends in the Shell: Unveiling the Emoticon Semantic Confusion in Large Language Models
por: Jiang, Weipeng, et al.
Publicado: (2026)
por: Jiang, Weipeng, et al.
Publicado: (2026)
Train in Vain: Functionality-Preserving Poisoning to Prevent Unauthorized Use of Code Datasets
por: Xiao, Yuan, et al.
Publicado: (2026)
por: Xiao, Yuan, et al.
Publicado: (2026)
From Effectiveness to Efficiency: Uncovering Linguistic Bias in Large Language Model-based Code Generation
por: Jiang, Weipeng, et al.
Publicado: (2024)
por: Jiang, Weipeng, et al.
Publicado: (2024)
DeCoMa: Detecting and Purifying Code Dataset Watermarks through Dual Channel Code Abstraction
por: Xiao, Yuan, et al.
Publicado: (2025)
por: Xiao, Yuan, et al.
Publicado: (2025)
Rethinking Technology Stack Selection with AI Coding Proficiency
por: Zhang, Xiaoyu, et al.
Publicado: (2025)
por: Zhang, Xiaoyu, et al.
Publicado: (2025)
Probing Privacy Leaks in LLM-based Code Generation via Test Generation
por: Ge, Yifei, et al.
Publicado: (2026)
por: Ge, Yifei, et al.
Publicado: (2026)
GenSIaC: Toward Security-Aware Infrastructure-as-Code Generation with Large Language Models
por: Li, Yikun, et al.
Publicado: (2025)
por: Li, Yikun, et al.
Publicado: (2025)
Automated Generation of Accurate Privacy Captions From Android Source Code Using Large Language Models
por: Jain, Vijayanta, et al.
Publicado: (2026)
por: Jain, Vijayanta, et al.
Publicado: (2026)
On the Adversarial Robustness of Instruction-Tuned Large Language Models for Code
por: Hossen, Md Imran, et al.
Publicado: (2024)
por: Hossen, Md Imran, et al.
Publicado: (2024)
Large Language Models for Secure Code Assessment: A Multi-Language Empirical Study
por: Dozono, Kohei, et al.
Publicado: (2024)
por: Dozono, Kohei, et al.
Publicado: (2024)
MegaVul: A C/C++ Vulnerability Dataset with Comprehensive Code Representation
por: Ni, Chao, et al.
Publicado: (2024)
por: Ni, Chao, et al.
Publicado: (2024)
An Empirical Study on the Effectiveness of Large Language Models for Binary Code Understanding
por: Shang, Xiuwei, et al.
Publicado: (2025)
por: Shang, Xiuwei, et al.
Publicado: (2025)
Large Language Models for Code Analysis: Do LLMs Really Do Their Job?
por: Fang, Chongzhou, et al.
Publicado: (2023)
por: Fang, Chongzhou, et al.
Publicado: (2023)
CEBin: A Cost-Effective Framework for Large-Scale Binary Code Similarity Detection
por: Wang, Hao, et al.
Publicado: (2024)
por: Wang, Hao, et al.
Publicado: (2024)
RepoMark: A Data-Usage Auditing Framework for Code Large Language Models
por: Qu, Wenjie, et al.
Publicado: (2025)
por: Qu, Wenjie, et al.
Publicado: (2025)
How Far Have We Gone in Binary Code Understanding Using Large Language Models
por: Shang, Xiuwei, et al.
Publicado: (2024)
por: Shang, Xiuwei, et al.
Publicado: (2024)
WildCode: An Empirical Analysis of Code Generated by ChatGPT
por: Khanmohammadi, Kobra, et al.
Publicado: (2025)
por: Khanmohammadi, Kobra, et al.
Publicado: (2025)
Harnessing Large Language Models for Seed Generation in Greybox Fuzzing
por: Shi, Wenxuan, et al.
Publicado: (2024)
por: Shi, Wenxuan, et al.
Publicado: (2024)
CKGFuzzer: LLM-Based Fuzz Driver Generation Enhanced By Code Knowledge Graph
por: Xu, Hanxiang, et al.
Publicado: (2024)
por: Xu, Hanxiang, et al.
Publicado: (2024)
VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities
por: Wang, Weizhe, et al.
Publicado: (2025)
por: Wang, Weizhe, et al.
Publicado: (2025)
Beyond the Protocol: Unveiling Attack Vectors in the Model Context Protocol (MCP) Ecosystem
por: Song, Hao, et al.
Publicado: (2025)
por: Song, Hao, et al.
Publicado: (2025)
Evaluating Large Language Models for Line-Level Vulnerability Localization
por: Zhang, Jian, et al.
Publicado: (2024)
por: Zhang, Jian, et al.
Publicado: (2024)
Understanding the Supply Chain and Risks of Large Language Model Applications
por: Ma, Yujie, et al.
Publicado: (2025)
por: Ma, Yujie, et al.
Publicado: (2025)
CrossCommitVuln-Bench: A Dataset of Multi-Commit Python Vulnerabilities Invisible to Per-Commit Static Analysis
por: Majumdar, Arunabh
Publicado: (2026)
por: Majumdar, Arunabh
Publicado: (2026)
Security of Language Models for Code: A Systematic Literature Review
por: Chen, Yuchen, et al.
Publicado: (2024)
por: Chen, Yuchen, et al.
Publicado: (2024)
Concerned with Data Contamination? Assessing Countermeasures in Code Language Model
por: Cao, Jialun, et al.
Publicado: (2024)
por: Cao, Jialun, et al.
Publicado: (2024)
Unveiling Dynamic Binary Instrumentation Techniques
por: Llorente-Vazquez, Oscar, et al.
Publicado: (2025)
por: Llorente-Vazquez, Oscar, et al.
Publicado: (2025)
ORCA: Unveiling Obscure Containers In The Wild
por: Bufalino, Jacopo, et al.
Publicado: (2025)
por: Bufalino, Jacopo, et al.
Publicado: (2025)
Semantic Consensus Decoding: Backdoor Defense for Verilog Code Generation
por: Yang, Guang, et al.
Publicado: (2026)
por: Yang, Guang, et al.
Publicado: (2026)
SAFuzz: Semantic-Guided Adaptive Fuzzing for LLM-Generated Code
por: Yang, Ziyi, et al.
Publicado: (2026)
por: Yang, Ziyi, et al.
Publicado: (2026)
SOSecure: Safer Code Generation with RAG and StackOverflow Discussions
por: Mukherjee, Manisha, et al.
Publicado: (2025)
por: Mukherjee, Manisha, et al.
Publicado: (2025)
Detecting Stealthy Data Poisoning Attacks in AI Code Generators
por: Improta, Cristina
Publicado: (2025)
por: Improta, Cristina
Publicado: (2025)
An Empirical Security Evaluation of LLM-Generated Cryptographic Rust Code
por: Elsayed, Mohamed, et al.
Publicado: (2026)
por: Elsayed, Mohamed, et al.
Publicado: (2026)
DLAP: A Deep Learning Augmented Large Language Model Prompting Framework for Software Vulnerability Detection
por: Yang, Yanjing, et al.
Publicado: (2024)
por: Yang, Yanjing, et al.
Publicado: (2024)
Does Teaming-Up LLMs Improve Secure Code Generation? A Comprehensive Evaluation with Multi-LLMSecCodeEval
por: Sabir, Bushra, et al.
Publicado: (2026)
por: Sabir, Bushra, et al.
Publicado: (2026)
Tactics, Techniques, and Procedures (TTPs) in Interpreted Malware: A Zero-Shot Generation with Large Language Models
por: Zhang, Ying, et al.
Publicado: (2024)
por: Zhang, Ying, et al.
Publicado: (2024)
Traces of Memorisation in Large Language Models for Code
por: Al-Kaswan, Ali, et al.
Publicado: (2023)
por: Al-Kaswan, Ali, et al.
Publicado: (2023)
On Trojan Signatures in Large Language Models of Code
por: Hussain, Aftab, et al.
Publicado: (2024)
por: Hussain, Aftab, et al.
Publicado: (2024)
KVerus: Scalable and Resilient Formal Verification Proof Generation for Rust Code
por: Liu, Yuwei, et al.
Publicado: (2026)
por: Liu, Yuwei, et al.
Publicado: (2026)
Exploring the Security Threats of Retriever Backdoors in Retrieval-Augmented Code Generation
por: Li, Tian, et al.
Publicado: (2025)
por: Li, Tian, et al.
Publicado: (2025)
Ejemplares similares
-
False Friends in the Shell: Unveiling the Emoticon Semantic Confusion in Large Language Models
por: Jiang, Weipeng, et al.
Publicado: (2026) -
Train in Vain: Functionality-Preserving Poisoning to Prevent Unauthorized Use of Code Datasets
por: Xiao, Yuan, et al.
Publicado: (2026) -
From Effectiveness to Efficiency: Uncovering Linguistic Bias in Large Language Model-based Code Generation
por: Jiang, Weipeng, et al.
Publicado: (2024) -
DeCoMa: Detecting and Purifying Code Dataset Watermarks through Dual Channel Code Abstraction
por: Xiao, Yuan, et al.
Publicado: (2025) -
Rethinking Technology Stack Selection with AI Coding Proficiency
por: Zhang, Xiaoyu, et al.
Publicado: (2025)