Machine Learning in the Wild: Early Evidence of Non-Compliant ML-Automation in Open-Source Software
Fuente:
arXiv
Salvato in:
| Autori principali: | Arshid, Zohaib, Bifolco, Daniele, Zampetti, Fiorella, Di Penta, Massimiliano |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Do LLMs Provide Links to Code Similar to what they Generate? A Study with Gemini and Bing CoPilot
di: Bifolco, Daniele, et al.
Pubblicazione: (2025)
di: Bifolco, Daniele, et al.
Pubblicazione: (2025)
CodeGenLink: A Tool to Find the Likely Origin and License of Automatically Generated Code
di: Bifolco, Daniele, et al.
Pubblicazione: (2025)
di: Bifolco, Daniele, et al.
Pubblicazione: (2025)
How are MLOps Frameworks Used in Open Source Projects? An Empirical Characterization
di: Zampetti, Fiorella, et al.
Pubblicazione: (2026)
di: Zampetti, Fiorella, et al.
Pubblicazione: (2026)
Developers and Generative AI: A Study of Self-Admitted Usage in Open Source Projects
di: Tufano, Rosalia, et al.
Pubblicazione: (2026)
di: Tufano, Rosalia, et al.
Pubblicazione: (2026)
A Taxonomy of Self-Admitted Technical Debt in Deep Learning Systems
di: Pepe, Federica, et al.
Pubblicazione: (2024)
di: Pepe, Federica, et al.
Pubblicazione: (2024)
Guidelines to Prompt Large Language Models for Code Generation: An Empirical Characterization
di: Midolo, Alessandro, et al.
Pubblicazione: (2026)
di: Midolo, Alessandro, et al.
Pubblicazione: (2026)
Automated Refactoring of Non-Idiomatic Python Code: A Differentiated Replication with LLMs
di: Midolo, Alessandro, et al.
Pubblicazione: (2025)
di: Midolo, Alessandro, et al.
Pubblicazione: (2025)
Augmenting Software Bills of Materials with Software Vulnerability Description: A Preliminary Study on GitHub
di: Fucci, Davide, et al.
Pubblicazione: (2025)
di: Fucci, Davide, et al.
Pubblicazione: (2025)
From Human to Machine Refactoring: Assessing GPT-4's Impact on Python Class Quality and Readability
di: Midolo, Alessandro, et al.
Pubblicazione: (2026)
di: Midolo, Alessandro, et al.
Pubblicazione: (2026)
Unveiling ChatGPT's Usage in Open Source Projects: A Mining-based Study
di: Tufano, Rosalia, et al.
Pubblicazione: (2024)
di: Tufano, Rosalia, et al.
Pubblicazione: (2024)
How the Training Procedure Impacts the Performance of Deep Learning-based Vulnerability Patching
di: Mastropaolo, Antonio, et al.
Pubblicazione: (2024)
di: Mastropaolo, Antonio, et al.
Pubblicazione: (2024)
BOMs Away! Inside the Minds of Stakeholders: A Comprehensive Study of Bills of Materials for Software Systems
di: Stalnaker, Trevor, et al.
Pubblicazione: (2023)
di: Stalnaker, Trevor, et al.
Pubblicazione: (2023)
Future of Software Engineering Research: The SIGSOFT Perspective
di: Di Penta, Massimiliano, et al.
Pubblicazione: (2026)
di: Di Penta, Massimiliano, et al.
Pubblicazione: (2026)
An Analysis of Malicious Packages in Open-Source Software in the Wild
di: Zhou, Xiaoyan, et al.
Pubblicazione: (2024)
di: Zhou, Xiaoyan, et al.
Pubblicazione: (2024)
"Let it be Chaos in the Plumbing!" Usage and Efficacy of Chaos Engineering in DevOps Pipelines
di: Fossati, Stefano, et al.
Pubblicazione: (2025)
di: Fossati, Stefano, et al.
Pubblicazione: (2025)
Automatic Categorization of GitHub Actions with Transformers and Few-shot Learning
di: Nguyen, Phuong T., et al.
Pubblicazione: (2024)
di: Nguyen, Phuong T., et al.
Pubblicazione: (2024)
Automated Extraction and Analysis of Developer's Rationale in Open Source Software
di: Dhaouadi, Mouna, et al.
Pubblicazione: (2025)
di: Dhaouadi, Mouna, et al.
Pubblicazione: (2025)
Developers' Perspectives on Software Licensing: Current Practices, Challenges, and Tools
di: Wintersgill, Nathan, et al.
Pubblicazione: (2025)
di: Wintersgill, Nathan, et al.
Pubblicazione: (2025)
Evaluating the Impact of Post-Training Quantization on Large Language Models for Code Generation
di: Giagnorio, Alessandro, et al.
Pubblicazione: (2025)
di: Giagnorio, Alessandro, et al.
Pubblicazione: (2025)
Optimizing Datasets for Code Summarization: Is Code-Comment Coherence Enough?
di: Vitale, Antonio, et al.
Pubblicazione: (2025)
di: Vitale, Antonio, et al.
Pubblicazione: (2025)
Self-Admitted Technical Debt in LLM Software: An Empirical Comparison with ML and Non-ML Software
di: Selvanayagam, Niruthiha, et al.
Pubblicazione: (2026)
di: Selvanayagam, Niruthiha, et al.
Pubblicazione: (2026)
Not All Tokens Matter: Data-Centric Optimization for Efficient Code Summarization
di: Afrin, Saima, et al.
Pubblicazione: (2026)
di: Afrin, Saima, et al.
Pubblicazione: (2026)
An Empirical Analysis of Machine Learning Model and Dataset Documentation, Supply Chain, and Licensing Challenges on Hugging Face
di: Stalnaker, Trevor, et al.
Pubblicazione: (2025)
di: Stalnaker, Trevor, et al.
Pubblicazione: (2025)
CXXCrafter: An LLM-Based Agent for Automated C/C++ Open Source Software Building
di: Yu, Zhengmin, et al.
Pubblicazione: (2025)
di: Yu, Zhengmin, et al.
Pubblicazione: (2025)
Developer Perspectives on Licensing and Copyright Issues Arising from Generative AI for Software Development
di: Stalnaker, Trevor, et al.
Pubblicazione: (2024)
di: Stalnaker, Trevor, et al.
Pubblicazione: (2024)
Measuring Software Development Waste in Open-Source Software Projects
di: Varanasi, Dhiraj SM, et al.
Pubblicazione: (2024)
di: Varanasi, Dhiraj SM, et al.
Pubblicazione: (2024)
Measuring Software Innovation with Open Source Software Development Data
di: Brown, Eva Maxfield, et al.
Pubblicazione: (2024)
di: Brown, Eva Maxfield, et al.
Pubblicazione: (2024)
Unlocking Reproducibility: Automating re-Build Process for Open-Source Software
di: Hassanshahi, Behnaz, et al.
Pubblicazione: (2025)
di: Hassanshahi, Behnaz, et al.
Pubblicazione: (2025)
AWML: An Open-Source ML-based Robotics Perception Framework to Deploy for ROS-based Autonomous Driving Software
di: Tanaka, Satoshi, et al.
Pubblicazione: (2025)
di: Tanaka, Satoshi, et al.
Pubblicazione: (2025)
Understanding Underrepresented Groups in Open Source Software
di: Santos, Reydne, et al.
Pubblicazione: (2025)
di: Santos, Reydne, et al.
Pubblicazione: (2025)
Extension Decisions in Open Source Software Ecosystem
di: Onagh, Elmira, et al.
Pubblicazione: (2025)
di: Onagh, Elmira, et al.
Pubblicazione: (2025)
Many-Objective Optimization of Non-Functional Attributes based on Refactoring of Software Models
di: Cortellessa, Vittorio, et al.
Pubblicazione: (2023)
di: Cortellessa, Vittorio, et al.
Pubblicazione: (2023)
Interactive GDPR-Compliant Privacy Policy Generation for Software Applications
di: Sangaroonsilp, Pattaraporn, et al.
Pubblicazione: (2024)
di: Sangaroonsilp, Pattaraporn, et al.
Pubblicazione: (2024)
Game Elements to Engage Students Learning the Open Source Software Contribution Process
di: Santos, Italo, et al.
Pubblicazione: (2024)
di: Santos, Italo, et al.
Pubblicazione: (2024)
Towards a Classification of Open-Source ML Models and Datasets for Software Engineering
di: González, Alexandra, et al.
Pubblicazione: (2024)
di: González, Alexandra, et al.
Pubblicazione: (2024)
Community Engagement and the Lifespan of Open-Source Software Projects
di: Kaushik, Mohit, et al.
Pubblicazione: (2025)
di: Kaushik, Mohit, et al.
Pubblicazione: (2025)
Context Engineering for AI Agents in Open-Source Software
di: Mohsenimofidi, Seyedmoein, et al.
Pubblicazione: (2025)
di: Mohsenimofidi, Seyedmoein, et al.
Pubblicazione: (2025)
Dataset: Copy-based Reuse in Open Source Software
di: Jahanshahi, Mahmoud, et al.
Pubblicazione: (2023)
di: Jahanshahi, Mahmoud, et al.
Pubblicazione: (2023)
The Product Beyond the Model -- An Empirical Study of Repositories of Open-Source ML Products
di: Nahar, Nadia, et al.
Pubblicazione: (2023)
di: Nahar, Nadia, et al.
Pubblicazione: (2023)
Don't Disturb Me: Challenges of Interacting with SoftwareBots on Open Source Software Projects
di: Wessel, Mairieli, et al.
Pubblicazione: (2021)
di: Wessel, Mairieli, et al.
Pubblicazione: (2021)
Documenti analoghi
-
Do LLMs Provide Links to Code Similar to what they Generate? A Study with Gemini and Bing CoPilot
di: Bifolco, Daniele, et al.
Pubblicazione: (2025) -
CodeGenLink: A Tool to Find the Likely Origin and License of Automatically Generated Code
di: Bifolco, Daniele, et al.
Pubblicazione: (2025) -
How are MLOps Frameworks Used in Open Source Projects? An Empirical Characterization
di: Zampetti, Fiorella, et al.
Pubblicazione: (2026) -
Developers and Generative AI: A Study of Self-Admitted Usage in Open Source Projects
di: Tufano, Rosalia, et al.
Pubblicazione: (2026) -
A Taxonomy of Self-Admitted Technical Debt in Deep Learning Systems
di: Pepe, Federica, et al.
Pubblicazione: (2024)