AuthAttLyzer-V2: Unveiling Code Authorship Attribution using Enhanced Ensemble Learning Models & Generating Benchmark Dataset
Fuente:
arXiv
Guardado en:
| Autores principales: | Joshi, Bhaskar, Khani, Sepideh HajiHossein, HabibiLashkari, Arash |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Reassessing Code Authorship Attribution in the Era of Language Models
por: Dipongkor, Atish Kumar, et al.
Publicado: (2025)
por: Dipongkor, Atish Kumar, et al.
Publicado: (2025)
I Can Find You in Seconds! Leveraging Large Language Models for Code Authorship Attribution
por: Choi, Soohyeon, et al.
Publicado: (2025)
por: Choi, Soohyeon, et al.
Publicado: (2025)
I Know Which LLM Wrote Your Code Last Summer: LLM generated Code Stylometry for Authorship Attribution
por: Bisztray, Tamas, et al.
Publicado: (2025)
por: Bisztray, Tamas, et al.
Publicado: (2025)
MACAA: Belief-Revision Multi-Agent Reasoning for Code Authorship Verification
por: Ye, Jingwei, et al.
Publicado: (2026)
por: Ye, Jingwei, et al.
Publicado: (2026)
Automated Testing of Broken Authentication Vulnerabilities in Web APIs with AuthREST
por: Corradini, Davide, et al.
Publicado: (2025)
por: Corradini, Davide, et al.
Publicado: (2025)
SDPERL: A Framework for Software Defect Prediction Using Ensemble Feature Extraction and Reinforcement Learning
por: Hesamolhokama, Mohsen, et al.
Publicado: (2024)
por: Hesamolhokama, Mohsen, et al.
Publicado: (2024)
SWE-Bench+: Enhanced Coding Benchmark for LLMs
por: Aleithan, Reem, et al.
Publicado: (2024)
por: Aleithan, Reem, et al.
Publicado: (2024)
Enhancing LLM Code Generation with Ensembles: A Similarity-Based Selection Approach
por: Mahmud, Tarek, et al.
Publicado: (2025)
por: Mahmud, Tarek, et al.
Publicado: (2025)
Unveiling Memorization in Code Models
por: Yang, Zhou, et al.
Publicado: (2023)
por: Yang, Zhou, et al.
Publicado: (2023)
ML-EcoLyzer: Quantifying the Environmental Cost of Machine Learning Inference Across Frameworks and Hardware
por: Minoza, Jose Marie Antonio, et al.
Publicado: (2025)
por: Minoza, Jose Marie Antonio, et al.
Publicado: (2025)
CodeSense: a Real-World Benchmark and Dataset for Code Semantic Reasoning
por: Roy, Monoshi Kumar, et al.
Publicado: (2025)
por: Roy, Monoshi Kumar, et al.
Publicado: (2025)
The Auth Shim: A Lightweight Architectural Pattern for Integrating Enterprise SSO with Standalone Open-Source Applications
por: Agrawal, Yuvraj
Publicado: (2025)
por: Agrawal, Yuvraj
Publicado: (2025)
SWE-QA: A Dataset and Benchmark for Complex Code Understanding
por: Elkoussy, Laïla, et al.
Publicado: (2026)
por: Elkoussy, Laïla, et al.
Publicado: (2026)
Evaluating ChatGPT-3.5 Efficiency in Solving Coding Problems of Different Complexity Levels: An Empirical Analysis
por: Li, Minda, et al.
Publicado: (2024)
por: Li, Minda, et al.
Publicado: (2024)
Packed Malware Detection Using Grayscale Binary-to-Image Representations
por: Alkhateeb, Ehab, et al.
Publicado: (2025)
por: Alkhateeb, Ehab, et al.
Publicado: (2025)
Future-Proofing Cloud Security Against Quantum Attacks: Risk, Transition, and Mitigation Strategies
por: Baseri, Yaser, et al.
Publicado: (2025)
por: Baseri, Yaser, et al.
Publicado: (2025)
CodeAssistBench (CAB): Dataset & Benchmarking for Multi-turn Chat-Based Code Assistance
por: Kim, Myeongsoo, et al.
Publicado: (2025)
por: Kim, Myeongsoo, et al.
Publicado: (2025)
Code Fingerprints: Disentangled Attribution of LLM-Generated Code
por: Guo, Jiaxun, et al.
Publicado: (2026)
por: Guo, Jiaxun, et al.
Publicado: (2026)
Ensemble-Based Uncertainty Estimation for Code Correctness Estimation
por: Wei, Yunxiang, et al.
Publicado: (2026)
por: Wei, Yunxiang, et al.
Publicado: (2026)
Clean Code, Better Models: Enhancing LLM Performance with Smell-Cleaned Dataset
por: Xue, Zhipeng, et al.
Publicado: (2025)
por: Xue, Zhipeng, et al.
Publicado: (2025)
Unveiling Code Clones in the Eclipse IIoT Software Ecosystem
por: Li, Zengyang, et al.
Publicado: (2026)
por: Li, Zengyang, et al.
Publicado: (2026)
ADC: Enhancing Function Calling Via Adversarial Datasets and Code Line-Level Feedback
por: Zhang, Wei, et al.
Publicado: (2024)
por: Zhang, Wei, et al.
Publicado: (2024)
Enhancing Security in Third-Party Library Reuse -- Comprehensive Detection of 1-day Vulnerability through Code Patch Analysis
por: Xu, Shangzhi, et al.
Publicado: (2024)
por: Xu, Shangzhi, et al.
Publicado: (2024)
VecIntrinBench: Benchmarking Cross-Architecture Intrinsic Code Migration for RISC-V Vector
por: Han, Liutong, et al.
Publicado: (2025)
por: Han, Liutong, et al.
Publicado: (2025)
Which Code Statements Implement Privacy Behaviors in Android Applications?
por: Su, Chia-Yi, et al.
Publicado: (2025)
por: Su, Chia-Yi, et al.
Publicado: (2025)
Deep-Bench: Deep Learning Benchmark Dataset for Code Generation
por: Daghighfarsoodeh, Alireza, et al.
Publicado: (2025)
por: Daghighfarsoodeh, Alireza, et al.
Publicado: (2025)
Bias Unveiled: Investigating Social Bias in LLM-Generated Code
por: Ling, Lin, et al.
Publicado: (2024)
por: Ling, Lin, et al.
Publicado: (2024)
Retrospective: Data Mining Static Code Attributes to Learn Defect Predictors
por: Menzies, Tim
Publicado: (2025)
por: Menzies, Tim
Publicado: (2025)
COFFE: A Code Efficiency Benchmark for Code Generation
por: Peng, Yun, et al.
Publicado: (2025)
por: Peng, Yun, et al.
Publicado: (2025)
Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?
por: Vitale, Antonio, et al.
Publicado: (2025)
por: Vitale, Antonio, et al.
Publicado: (2025)
Ensembling Large Language Models for Code Vulnerability Detection: An Empirical Evaluation
por: Sun, Zhihong, et al.
Publicado: (2025)
por: Sun, Zhihong, et al.
Publicado: (2025)
MANILA: A Low-Code Application to Benchmark Machine Learning Models and Fairness-Enhancing Methods
por: d'Aloisio, Giordano
Publicado: (2025)
por: d'Aloisio, Giordano
Publicado: (2025)
EnStack: An Ensemble Stacking Framework of Large Language Models for Enhanced Vulnerability Detection in Source Code
por: Ridoy, Shahriyar Zaman, et al.
Publicado: (2024)
por: Ridoy, Shahriyar Zaman, et al.
Publicado: (2024)
Bridging Behavioral Biometrics and Source Code Stylometry: A Survey of Programmer Attribution
por: Horvath, Marek, et al.
Publicado: (2026)
por: Horvath, Marek, et al.
Publicado: (2026)
PromptSet: A Programmer's Prompting Dataset
por: Pister, Kaiser, et al.
Publicado: (2024)
por: Pister, Kaiser, et al.
Publicado: (2024)
A Benchmarking Framework for Model Datasets
por: Glaser, Philipp-Lorenz, et al.
Publicado: (2026)
por: Glaser, Philipp-Lorenz, et al.
Publicado: (2026)
Automated Generation of Accurate Privacy Captions From Android Source Code Using Large Language Models
por: Jain, Vijayanta, et al.
Publicado: (2026)
por: Jain, Vijayanta, et al.
Publicado: (2026)
CodeCircuit: Toward Inferring LLM-Generated Code Correctness via Attribution Graphs
por: He, Yicheng, et al.
Publicado: (2026)
por: He, Yicheng, et al.
Publicado: (2026)
A Vulnerability Code Intent Summary Dataset
por: Huang, Yifan, et al.
Publicado: (2025)
por: Huang, Yifan, et al.
Publicado: (2025)
ComplexCodeEval: A Benchmark for Evaluating Large Code Models on More Complex Code
por: Feng, Jia, et al.
Publicado: (2024)
por: Feng, Jia, et al.
Publicado: (2024)
Ejemplares similares
-
Reassessing Code Authorship Attribution in the Era of Language Models
por: Dipongkor, Atish Kumar, et al.
Publicado: (2025) -
I Can Find You in Seconds! Leveraging Large Language Models for Code Authorship Attribution
por: Choi, Soohyeon, et al.
Publicado: (2025) -
I Know Which LLM Wrote Your Code Last Summer: LLM generated Code Stylometry for Authorship Attribution
por: Bisztray, Tamas, et al.
Publicado: (2025) -
MACAA: Belief-Revision Multi-Agent Reasoning for Code Authorship Verification
por: Ye, Jingwei, et al.
Publicado: (2026) -
Automated Testing of Broken Authentication Vulnerabilities in Web APIs with AuthREST
por: Corradini, Davide, et al.
Publicado: (2025)