Vibe Coding on Trial: Operating Characteristics of Unanimous LLM Juries
Fuente:
arXiv
Guardado en:
| Autores principales: | Ullah, Muhammad Aziz, Serwadda, Abdul |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Vibe Coding vs. Agentic Coding: Fundamentals and Practical Implications of Agentic AI
por: Sapkota, Ranjan, et al.
Publicado: (2025)
por: Sapkota, Ranjan, et al.
Publicado: (2025)
Unmasking the giant: A comprehensive evaluation of ChatGPT's proficiency in coding algorithms and data structures
por: Arefin, Sayed Erfan, et al.
Publicado: (2023)
por: Arefin, Sayed Erfan, et al.
Publicado: (2023)
AutoGEEval: A Multimodal and Automated Framework for Geospatial Code Generation on GEE with Large Language Models
por: Hou, Shuyang, et al.
Publicado: (2025)
por: Hou, Shuyang, et al.
Publicado: (2025)
Automating Database-Native Function Code Synthesis with LLMs
por: Zhou, Wei, et al.
Publicado: (2026)
por: Zhou, Wei, et al.
Publicado: (2026)
RISE: Rule-Driven SQL Dialect Translation via Query Reduction
por: Xie, Xudong, et al.
Publicado: (2026)
por: Xie, Xudong, et al.
Publicado: (2026)
Towards Automated Data Sciences with Natural Language and SageCopilot: Practices and Lessons Learned
por: Liao, Yuan, et al.
Publicado: (2024)
por: Liao, Yuan, et al.
Publicado: (2024)
Dialect2SQL: A Novel Text-to-SQL Dataset for Arabic Dialects with a Focus on Moroccan Darija
por: Chafik, Salmane, et al.
Publicado: (2025)
por: Chafik, Salmane, et al.
Publicado: (2025)
Translating between SQL Dialects for Cloud Migration
por: Zmigrod, Ran, et al.
Publicado: (2024)
por: Zmigrod, Ran, et al.
Publicado: (2024)
SecureVibeBench: Benchmarking Secure Vibe Coding of AI Agents via Reconstructing Vulnerability-Introducing Scenarios
por: Chen, Junkai, et al.
Publicado: (2025)
por: Chen, Junkai, et al.
Publicado: (2025)
Vibe Checker: Aligning Code Evaluation with Human Preference
por: Zhong, Ming, et al.
Publicado: (2025)
por: Zhong, Ming, et al.
Publicado: (2025)
Academic Vibe Coding: Opportunities for Accelerating Research in an Era of Resource Constraint
por: Crowson, Matthew G, et al.
Publicado: (2025)
por: Crowson, Matthew G, et al.
Publicado: (2025)
GEE-OPs: An Operator Knowledge Base for Geospatial Code Generation on the Google Earth Engine Platform Powered by Large Language Models
por: Hou, Shuyang, et al.
Publicado: (2024)
por: Hou, Shuyang, et al.
Publicado: (2024)
Geo-FuB: A Method for Constructing an Operator-Function Knowledge Base for Geospatial Code Generation Tasks Using Large Language Models
por: Hou, Shuyang, et al.
Publicado: (2024)
por: Hou, Shuyang, et al.
Publicado: (2024)
Polygon: Symbolic Reasoning for SQL using Conflict-Driven Under-Approximation Search
por: Zhao, Pinhan, et al.
Publicado: (2025)
por: Zhao, Pinhan, et al.
Publicado: (2025)
LeGo-Code: Can Modular Curriculum Learning Advance Complex Code Generation? Insights from Text-to-SQL
por: Chafik, Salmane, et al.
Publicado: (2026)
por: Chafik, Salmane, et al.
Publicado: (2026)
Vibe Code Bench: Evaluating AI Models on End-to-End Web Application Development
por: Tran, Hung, et al.
Publicado: (2026)
por: Tran, Hung, et al.
Publicado: (2026)
Is Vibe Coding the Future? An Empirical Assessment of LLM Generated Codes for Construction Safety
por: Uddin, S M Jamil
Publicado: (2026)
por: Uddin, S M Jamil
Publicado: (2026)
Verification Limits Code LLM Training
por: Gureja, Srishti, et al.
Publicado: (2025)
por: Gureja, Srishti, et al.
Publicado: (2025)
CodeJudgeBench: Benchmarking LLM-as-a-Judge for Coding Tasks
por: Jiang, Hongchao, et al.
Publicado: (2025)
por: Jiang, Hongchao, et al.
Publicado: (2025)
Quality Assessment of Tabular Data using Large Language Models and Code Generation
por: Akella, Ashlesha, et al.
Publicado: (2025)
por: Akella, Ashlesha, et al.
Publicado: (2025)
Stingy Context: 18:1 Hierarchical Code Compression for LLM Auto-Coding
por: Ostby, David Linus
Publicado: (2026)
por: Ostby, David Linus
Publicado: (2026)
Adaptive Data Quality Scoring Operations Framework using Drift-Aware Mechanism for Industrial Applications
por: Bayram, Firas, et al.
Publicado: (2024)
por: Bayram, Firas, et al.
Publicado: (2024)
Contextualized Data-Wrangling Code Generation in Computational Notebooks
por: Huang, Junjie, et al.
Publicado: (2024)
por: Huang, Junjie, et al.
Publicado: (2024)
Pragmatic Reasoning improves LLM Code Generation
por: Cao, Zhuchen, et al.
Publicado: (2025)
por: Cao, Zhuchen, et al.
Publicado: (2025)
Crystal: Illuminating LLM Abilities on Language and Code
por: Tao, Tianhua, et al.
Publicado: (2024)
por: Tao, Tianhua, et al.
Publicado: (2024)
Enhancing LLM Fine-tuning for Text-to-SQLs by SQL Quality Measurement
por: Sarker, Shouvon, et al.
Publicado: (2024)
por: Sarker, Shouvon, et al.
Publicado: (2024)
UA-Code-Bench: A Competitive Programming Benchmark for Evaluating LLM Code Generation in Ukrainian
por: Syromiatnikov, Mykyta, et al.
Publicado: (2025)
por: Syromiatnikov, Mykyta, et al.
Publicado: (2025)
KRONE: Scalable LLM-Augmented Log Anomaly Detection via Hierarchical Abstraction
por: Ma, Lei, et al.
Publicado: (2026)
por: Ma, Lei, et al.
Publicado: (2026)
Detect, Localize, and Explain: Interactive Hierarchical Log Anomaly Analytics with LLM Augmentation
por: Ma, Lei, et al.
Publicado: (2026)
por: Ma, Lei, et al.
Publicado: (2026)
Dynamic Stability of LLM-Generated Code
por: Rajput, Prateek, et al.
Publicado: (2025)
por: Rajput, Prateek, et al.
Publicado: (2025)
Task-Aware Reduction for Scalable LLM-Database Systems
por: Barnes, Marcus Emmanuel, et al.
Publicado: (2025)
por: Barnes, Marcus Emmanuel, et al.
Publicado: (2025)
LocAgent: Graph-Guided LLM Agents for Code Localization
por: Chen, Zhaoling, et al.
Publicado: (2025)
por: Chen, Zhaoling, et al.
Publicado: (2025)
LLM Hallucinations in Practical Code Generation: Phenomena, Mechanism, and Mitigation
por: Zhang, Ziyao, et al.
Publicado: (2024)
por: Zhang, Ziyao, et al.
Publicado: (2024)
Collaboration is all you need: LLM Assisted Safe Code Translation
por: Karanjai, Rabimba, et al.
Publicado: (2025)
por: Karanjai, Rabimba, et al.
Publicado: (2025)
Issue Localization via LLM-Driven Iterative Code Graph Searching
por: Jiang, Zhonghao, et al.
Publicado: (2025)
por: Jiang, Zhonghao, et al.
Publicado: (2025)
PerfCodeGen: Improving Performance of LLM Generated Code with Execution Feedback
por: Peng, Yun, et al.
Publicado: (2024)
por: Peng, Yun, et al.
Publicado: (2024)
Vibe Coding in Practice: Flow, Technical Debt, and Guidelines for Sustainable Use
por: Waseem, Muhammad, et al.
Publicado: (2025)
por: Waseem, Muhammad, et al.
Publicado: (2025)
CodeNav: Beyond tool-use to using real-world codebases with LLM agents
por: Gupta, Tanmay, et al.
Publicado: (2024)
por: Gupta, Tanmay, et al.
Publicado: (2024)
Benchmarking LLM Code Generation for Audio Programming with Visual Dataflow Languages
por: Zhang, William, et al.
Publicado: (2024)
por: Zhang, William, et al.
Publicado: (2024)
Deployability-Centric Infrastructure-as-Code Generation: Fail, Learn, Refine, and Succeed through LLM-Empowered DevOps Simulation
por: Zhang, Tianyi, et al.
Publicado: (2025)
por: Zhang, Tianyi, et al.
Publicado: (2025)
Ejemplares similares
-
Vibe Coding vs. Agentic Coding: Fundamentals and Practical Implications of Agentic AI
por: Sapkota, Ranjan, et al.
Publicado: (2025) -
Unmasking the giant: A comprehensive evaluation of ChatGPT's proficiency in coding algorithms and data structures
por: Arefin, Sayed Erfan, et al.
Publicado: (2023) -
AutoGEEval: A Multimodal and Automated Framework for Geospatial Code Generation on GEE with Large Language Models
por: Hou, Shuyang, et al.
Publicado: (2025) -
Automating Database-Native Function Code Synthesis with LLMs
por: Zhou, Wei, et al.
Publicado: (2026) -
RISE: Rule-Driven SQL Dialect Translation via Query Reduction
por: Xie, Xudong, et al.
Publicado: (2026)