CodeNav: Beyond tool-use to using real-world codebases with LLM agents
Fuente:
arXiv
Salvato in:
| Autori principali: | Gupta, Tanmay, Weihs, Luca, Kembhavi, Aniruddha |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MutaGReP: Execution-Free Repository-Grounded Plan Search for Code-Use
di: Khan, Zaid, et al.
Pubblicazione: (2025)
di: Khan, Zaid, et al.
Pubblicazione: (2025)
Verification Limits Code LLM Training
di: Gureja, Srishti, et al.
Pubblicazione: (2025)
di: Gureja, Srishti, et al.
Pubblicazione: (2025)
CodeJudgeBench: Benchmarking LLM-as-a-Judge for Coding Tasks
di: Jiang, Hongchao, et al.
Pubblicazione: (2025)
di: Jiang, Hongchao, et al.
Pubblicazione: (2025)
Stingy Context: 18:1 Hierarchical Code Compression for LLM Auto-Coding
di: Ostby, David Linus
Pubblicazione: (2026)
di: Ostby, David Linus
Pubblicazione: (2026)
Crystal: Illuminating LLM Abilities on Language and Code
di: Tao, Tianhua, et al.
Pubblicazione: (2024)
di: Tao, Tianhua, et al.
Pubblicazione: (2024)
Pragmatic Reasoning improves LLM Code Generation
di: Cao, Zhuchen, et al.
Pubblicazione: (2025)
di: Cao, Zhuchen, et al.
Pubblicazione: (2025)
UA-Code-Bench: A Competitive Programming Benchmark for Evaluating LLM Code Generation in Ukrainian
di: Syromiatnikov, Mykyta, et al.
Pubblicazione: (2025)
di: Syromiatnikov, Mykyta, et al.
Pubblicazione: (2025)
LLMs for Science: Usage for Code Generation and Data Analysis
di: Nejjar, Mohamed, et al.
Pubblicazione: (2023)
di: Nejjar, Mohamed, et al.
Pubblicazione: (2023)
Beyond Correctness: Benchmarking Multi-dimensional Code Generation for Large Language Models
di: Zheng, Jiasheng, et al.
Pubblicazione: (2024)
di: Zheng, Jiasheng, et al.
Pubblicazione: (2024)
LLM Hallucinations in Practical Code Generation: Phenomena, Mechanism, and Mitigation
di: Zhang, Ziyao, et al.
Pubblicazione: (2024)
di: Zhang, Ziyao, et al.
Pubblicazione: (2024)
LocAgent: Graph-Guided LLM Agents for Code Localization
di: Chen, Zhaoling, et al.
Pubblicazione: (2025)
di: Chen, Zhaoling, et al.
Pubblicazione: (2025)
Beyond Code Pairs: Dialogue-Based Data Generation for LLM Code Translation
di: Chen, Le, et al.
Pubblicazione: (2025)
di: Chen, Le, et al.
Pubblicazione: (2025)
Collaboration is all you need: LLM Assisted Safe Code Translation
di: Karanjai, Rabimba, et al.
Pubblicazione: (2025)
di: Karanjai, Rabimba, et al.
Pubblicazione: (2025)
Issue Localization via LLM-Driven Iterative Code Graph Searching
di: Jiang, Zhonghao, et al.
Pubblicazione: (2025)
di: Jiang, Zhonghao, et al.
Pubblicazione: (2025)
SoAy: A Solution-based LLM API-using Methodology for Academic Information Seeking
di: Wang, Yuanchun, et al.
Pubblicazione: (2024)
di: Wang, Yuanchun, et al.
Pubblicazione: (2024)
A Survey of Neural Code Intelligence: Paradigms, Advances and Beyond
di: Sun, Qiushi, et al.
Pubblicazione: (2024)
di: Sun, Qiushi, et al.
Pubblicazione: (2024)
PerfCodeGen: Improving Performance of LLM Generated Code with Execution Feedback
di: Peng, Yun, et al.
Pubblicazione: (2024)
di: Peng, Yun, et al.
Pubblicazione: (2024)
AlgoVeri: An Aligned Benchmark for Verified Code Generation on Classical Algorithms
di: Zhao, Haoyu, et al.
Pubblicazione: (2026)
di: Zhao, Haoyu, et al.
Pubblicazione: (2026)
Benchmarking LLM Code Generation for Audio Programming with Visual Dataflow Languages
di: Zhang, William, et al.
Pubblicazione: (2024)
di: Zhang, William, et al.
Pubblicazione: (2024)
RovoDev Code Reviewer: A Large-Scale Online Evaluation of LLM-based Code Review Automation at Atlassian
di: Tantithamthavorn, Kla, et al.
Pubblicazione: (2026)
di: Tantithamthavorn, Kla, et al.
Pubblicazione: (2026)
Deployability-Centric Infrastructure-as-Code Generation: Fail, Learn, Refine, and Succeed through LLM-Empowered DevOps Simulation
di: Zhang, Tianyi, et al.
Pubblicazione: (2025)
di: Zhang, Tianyi, et al.
Pubblicazione: (2025)
Evaluating LLM-Based Goal Extraction in Requirements Engineering: Prompting Strategies and Their Limitations
di: Arnaudo, Anna, et al.
Pubblicazione: (2026)
di: Arnaudo, Anna, et al.
Pubblicazione: (2026)
Investigating Execution-Aware Language Models for Code Optimization
di: Di Menna, Federico, et al.
Pubblicazione: (2025)
di: Di Menna, Federico, et al.
Pubblicazione: (2025)
Vibe Coding on Trial: Operating Characteristics of Unanimous LLM Juries
di: Ullah, Muhammad Aziz, et al.
Pubblicazione: (2026)
di: Ullah, Muhammad Aziz, et al.
Pubblicazione: (2026)
EvoCodeBench: An Evolving Code Generation Benchmark Aligned with Real-World Code Repositories
di: Li, Jia, et al.
Pubblicazione: (2024)
di: Li, Jia, et al.
Pubblicazione: (2024)
Rethinking Code Refinement: Learning to Judge Code Efficiency
di: Seo, Minju, et al.
Pubblicazione: (2024)
di: Seo, Minju, et al.
Pubblicazione: (2024)
IndustryCode: A Benchmark for Industry Code Generation
di: Zeng, Puyu, et al.
Pubblicazione: (2026)
di: Zeng, Puyu, et al.
Pubblicazione: (2026)
OpenCodeInterpreter: Integrating Code Generation with Execution and Refinement
di: Zheng, Tianyu, et al.
Pubblicazione: (2024)
di: Zheng, Tianyu, et al.
Pubblicazione: (2024)
CodeMirage: Hallucinations in Code Generated by Large Language Models
di: Agarwal, Vibhor, et al.
Pubblicazione: (2024)
di: Agarwal, Vibhor, et al.
Pubblicazione: (2024)
A Code Comprehension Benchmark for Large Language Models for Code
di: Havare, Jayant, et al.
Pubblicazione: (2025)
di: Havare, Jayant, et al.
Pubblicazione: (2025)
Multi-agent Application System in Office Collaboration Scenarios
di: Sun, Songtao, et al.
Pubblicazione: (2025)
di: Sun, Songtao, et al.
Pubblicazione: (2025)
CodeS: Natural Language to Code Repository via Multi-Layer Sketch
di: Zan, Daoguang, et al.
Pubblicazione: (2024)
di: Zan, Daoguang, et al.
Pubblicazione: (2024)
Testing the Effect of Code Documentation on Large Language Model Code Understanding
di: Macke, William, et al.
Pubblicazione: (2024)
di: Macke, William, et al.
Pubblicazione: (2024)
CodeScout: An Effective Recipe for Reinforcement Learning of Code Search Agents
di: Sutawika, Lintang, et al.
Pubblicazione: (2026)
di: Sutawika, Lintang, et al.
Pubblicazione: (2026)
CodeArt: Better Code Models by Attention Regularization When Symbols Are Lacking
di: Su, Zian, et al.
Pubblicazione: (2024)
di: Su, Zian, et al.
Pubblicazione: (2024)
CRScore: Grounding Automated Evaluation of Code Review Comments in Code Claims and Smells
di: Naik, Atharva, et al.
Pubblicazione: (2024)
di: Naik, Atharva, et al.
Pubblicazione: (2024)
Granite Code Models: A Family of Open Foundation Models for Code Intelligence
di: Mishra, Mayank, et al.
Pubblicazione: (2024)
di: Mishra, Mayank, et al.
Pubblicazione: (2024)
ArchCode: Incorporating Software Requirements in Code Generation with Large Language Models
di: Han, Hojae, et al.
Pubblicazione: (2024)
di: Han, Hojae, et al.
Pubblicazione: (2024)
MERA Code: A Unified Framework for Evaluating Code Generation Across Tasks
di: Chervyakov, Artem, et al.
Pubblicazione: (2025)
di: Chervyakov, Artem, et al.
Pubblicazione: (2025)
CodeRL+: Improving Code Generation via Reinforcement with Execution Semantics Alignment
di: Jiang, Xue, et al.
Pubblicazione: (2025)
di: Jiang, Xue, et al.
Pubblicazione: (2025)
Documenti analoghi
-
MutaGReP: Execution-Free Repository-Grounded Plan Search for Code-Use
di: Khan, Zaid, et al.
Pubblicazione: (2025) -
Verification Limits Code LLM Training
di: Gureja, Srishti, et al.
Pubblicazione: (2025) -
CodeJudgeBench: Benchmarking LLM-as-a-Judge for Coding Tasks
di: Jiang, Hongchao, et al.
Pubblicazione: (2025) -
Stingy Context: 18:1 Hierarchical Code Compression for LLM Auto-Coding
di: Ostby, David Linus
Pubblicazione: (2026) -
Crystal: Illuminating LLM Abilities on Language and Code
di: Tao, Tianhua, et al.
Pubblicazione: (2024)