Guardado en:
| Autor principal: | Oliveira, William |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2604.24636 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
LessLeak-Bench: A First Investigation of Data Leakage in LLMs Across 83 Software Engineering Benchmarks
por: Zhou, Xin, et al.
Publicado: (2025)
por: Zhou, Xin, et al.
Publicado: (2025)
State-of-the-art Small Language Coder Model: Mify-Coder
por: Parmar, Abhinav, et al.
Publicado: (2025)
por: Parmar, Abhinav, et al.
Publicado: (2025)
Does Model Size Matter? A Comparison of Small and Large Language Models for Requirements Classification
por: Zadenoori, Mohammad Amin, et al.
Publicado: (2025)
por: Zadenoori, Mohammad Amin, et al.
Publicado: (2025)
AdaptiveLog: An Adaptive Log Analysis Framework with the Collaboration of Large and Small Language Model
por: Ma, Lipeng, et al.
Publicado: (2025)
por: Ma, Lipeng, et al.
Publicado: (2025)
SWE-Protégé: Learning to Selectively Collaborate With an Expert Unlocks Small Language Models as Software Engineering Agents
por: Kon, Patrick Tser Jern, et al.
Publicado: (2026)
por: Kon, Patrick Tser Jern, et al.
Publicado: (2026)
Unifying the Perspectives of NLP and Software Engineering: A Survey on Language Models for Code
por: Zhang, Ziyin, et al.
Publicado: (2023)
por: Zhang, Ziyin, et al.
Publicado: (2023)
EHR-Based Mobile and Web Platform for Chronic Disease Risk Prediction Using Large Language Multimodal Models
por: Liao, Chun-Chieh, et al.
Publicado: (2024)
por: Liao, Chun-Chieh, et al.
Publicado: (2024)
Testing the Effect of Code Documentation on Large Language Model Code Understanding
por: Macke, William, et al.
Publicado: (2024)
por: Macke, William, et al.
Publicado: (2024)
From LLMs to LLM-based Agents for Software Engineering: A Survey of Current, Challenges and Future
por: Jin, Haolin, et al.
Publicado: (2024)
por: Jin, Haolin, et al.
Publicado: (2024)
SWE-MERA: A Dynamic Benchmark for Agenticly Evaluating Large Language Models on Software Engineering Tasks
por: Adamenko, Pavel, et al.
Publicado: (2025)
por: Adamenko, Pavel, et al.
Publicado: (2025)
Prompt Less, Smile More: MTP with Semantic Engineering in Lieu of Prompt Engineering
por: Dantanarayana, Jayanaka L., et al.
Publicado: (2025)
por: Dantanarayana, Jayanaka L., et al.
Publicado: (2025)
FeatBench: Towards More Realistic Evaluation of Feature-level Code Generation
por: Chen, Haorui, et al.
Publicado: (2025)
por: Chen, Haorui, et al.
Publicado: (2025)
AutoIOT: LLM-Driven Automated Natural Language Programming for AIoT Applications
por: Shen, Leming, et al.
Publicado: (2025)
por: Shen, Leming, et al.
Publicado: (2025)
BigCodeArena: Unveiling More Reliable Human Preferences in Code Generation via Execution
por: Zhuo, Terry Yue, et al.
Publicado: (2025)
por: Zhuo, Terry Yue, et al.
Publicado: (2025)
Introduction to Analytical Software Engineering Design Paradigm
por: Houichime, Tarik, et al.
Publicado: (2025)
por: Houichime, Tarik, et al.
Publicado: (2025)
MCP-Solver: Integrating Language Models with Constraint Programming Systems
por: Szeider, Stefan
Publicado: (2024)
por: Szeider, Stefan
Publicado: (2024)
Diversity Empowers Intelligence: Integrating Expertise of Software Engineering Agents
por: Zhang, Kexun, et al.
Publicado: (2024)
por: Zhang, Kexun, et al.
Publicado: (2024)
Advancing Language Models for Code-related Tasks
por: Tian, Zhao
Publicado: (2026)
por: Tian, Zhao
Publicado: (2026)
Revisiting the Reliability of Language Models in Instruction-Following
por: Dong, Jianshuo, et al.
Publicado: (2025)
por: Dong, Jianshuo, et al.
Publicado: (2025)
Text2BIM: Generating Building Models Using a Large Language Model-based Multi-Agent Framework
por: Du, Changyu, et al.
Publicado: (2024)
por: Du, Changyu, et al.
Publicado: (2024)
Agents in Software Engineering: Survey, Landscape, and Vision
por: Wang, Yanlin, et al.
Publicado: (2024)
por: Wang, Yanlin, et al.
Publicado: (2024)
ConCodeEval: Evaluating Large Language Models for Code Constraints in Domain-Specific Languages
por: Kammakomati, Mehant, et al.
Publicado: (2024)
por: Kammakomati, Mehant, et al.
Publicado: (2024)
Mitigating Gender Bias in Code Large Language Models via Model Editing
por: Qin, Zhanyue, et al.
Publicado: (2024)
por: Qin, Zhanyue, et al.
Publicado: (2024)
A Survey on Large Language Models for Code Generation
por: Jiang, Juyong, et al.
Publicado: (2024)
por: Jiang, Juyong, et al.
Publicado: (2024)
Analyzing the Performance of Large Language Models on Code Summarization
por: Haldar, Rajarshi, et al.
Publicado: (2024)
por: Haldar, Rajarshi, et al.
Publicado: (2024)
Effective Harness Engineering for Algorithm Discovery with Coding Agents
por: Ishibashi, Yoichi, et al.
Publicado: (2026)
por: Ishibashi, Yoichi, et al.
Publicado: (2026)
Dialogue Systems Engineering: A Survey and Future Directions
por: Nakano, Mikio, et al.
Publicado: (2025)
por: Nakano, Mikio, et al.
Publicado: (2025)
SWE-smith: Scaling Data for Software Engineering Agents
por: Yang, John, et al.
Publicado: (2025)
por: Yang, John, et al.
Publicado: (2025)
Crystal: Illuminating LLM Abilities on Language and Code
por: Tao, Tianhua, et al.
Publicado: (2024)
por: Tao, Tianhua, et al.
Publicado: (2024)
ICE-Score: Instructing Large Language Models to Evaluate Code
por: Zhuo, Terry Yue
Publicado: (2023)
por: Zhuo, Terry Yue
Publicado: (2023)
CodeMirage: Hallucinations in Code Generated by Large Language Models
por: Agarwal, Vibhor, et al.
Publicado: (2024)
por: Agarwal, Vibhor, et al.
Publicado: (2024)
A Code Comprehension Benchmark for Large Language Models for Code
por: Havare, Jayant, et al.
Publicado: (2025)
por: Havare, Jayant, et al.
Publicado: (2025)
Exploring Language Model's Code Generation Ability with Auxiliary Functions
por: Lee, Seonghyeon, et al.
Publicado: (2024)
por: Lee, Seonghyeon, et al.
Publicado: (2024)
DebugBench: Evaluating Debugging Capability of Large Language Models
por: Tian, Runchu, et al.
Publicado: (2024)
por: Tian, Runchu, et al.
Publicado: (2024)
OmniCode: A Benchmark for Evaluating Software Engineering Agents
por: Sonwane, Atharv, et al.
Publicado: (2026)
por: Sonwane, Atharv, et al.
Publicado: (2026)
Jailbreaking ChatGPT via Prompt Engineering: An Empirical Study
por: Liu, Yi, et al.
Publicado: (2023)
por: Liu, Yi, et al.
Publicado: (2023)
Value-Conflict Diagnostics Reveal Widespread Alignment Faking in Language Models
por: Nair, Inderjeet, et al.
Publicado: (2026)
por: Nair, Inderjeet, et al.
Publicado: (2026)
Exploring Data-Efficient Adaptation of Large Language Models for Code Generation
por: Jiang, Xue, et al.
Publicado: (2024)
por: Jiang, Xue, et al.
Publicado: (2024)
Astraios: Parameter-Efficient Instruction Tuning Code Large Language Models
por: Zhuo, Terry Yue, et al.
Publicado: (2024)
por: Zhuo, Terry Yue, et al.
Publicado: (2024)
How Effective are Generative Large Language Models in Performing Requirements Classification?
por: Alhoshan, Waad, et al.
Publicado: (2025)
por: Alhoshan, Waad, et al.
Publicado: (2025)
Ejemplares similares
-
LessLeak-Bench: A First Investigation of Data Leakage in LLMs Across 83 Software Engineering Benchmarks
por: Zhou, Xin, et al.
Publicado: (2025) -
State-of-the-art Small Language Coder Model: Mify-Coder
por: Parmar, Abhinav, et al.
Publicado: (2025) -
Does Model Size Matter? A Comparison of Small and Large Language Models for Requirements Classification
por: Zadenoori, Mohammad Amin, et al.
Publicado: (2025) -
AdaptiveLog: An Adaptive Log Analysis Framework with the Collaboration of Large and Small Language Model
por: Ma, Lipeng, et al.
Publicado: (2025) -
SWE-Protégé: Learning to Selectively Collaborate With an Expert Unlocks Small Language Models as Software Engineering Agents
por: Kon, Patrick Tser Jern, et al.
Publicado: (2026)