CallNavi, A Challenge and Empirical Study on LLM Function Calling and Routing
Fuente:
arXiv
Salvato in:
| Autori principali: | Song, Yewei, Tang, Xunzhu, Lothritz, Cedric, Ezzini, Saad, Klein, Jacques, Bissyandé, Tegawendé F., Boytsov, Andrey, Ble, Ulrick, Goujon, Anne |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Enhancing Text-to-SQL Translation for Financial System Design
di: Song, Yewei, et al.
Pubblicazione: (2023)
di: Song, Yewei, et al.
Pubblicazione: (2023)
CodeAgent: Autonomous Communicative Agents for Code Review
di: Tang, Xunzhu, et al.
Pubblicazione: (2024)
di: Tang, Xunzhu, et al.
Pubblicazione: (2024)
Empirical Evaluation of PDF Parsing and Chunking for Financial Question Answering with RAG
di: Bachyr, Omar El, et al.
Pubblicazione: (2026)
di: Bachyr, Omar El, et al.
Pubblicazione: (2026)
Revisiting Code Similarity Evaluation with Abstract Syntax Tree Edit Distance
di: Song, Yewei, et al.
Pubblicazione: (2024)
di: Song, Yewei, et al.
Pubblicazione: (2024)
Patch-CLIP: A Patch-Text Pre-Trained Model
di: Tang, Xunzhu, et al.
Pubblicazione: (2023)
di: Tang, Xunzhu, et al.
Pubblicazione: (2023)
Boosting Open-Source LLMs for Program Repair via Reasoning Transfer and LLM-Guided Reinforcement Learning
di: Tang, Xunzhu, et al.
Pubblicazione: (2025)
di: Tang, Xunzhu, et al.
Pubblicazione: (2025)
Measuring LLM Code Generation Stability via Structural Entropy
di: Song, Yewei, et al.
Pubblicazione: (2025)
di: Song, Yewei, et al.
Pubblicazione: (2025)
Call Graph Soundness in Android Static Analysis
di: Samhi, Jordan, et al.
Pubblicazione: (2024)
di: Samhi, Jordan, et al.
Pubblicazione: (2024)
MalLoc: Toward Fine-grained Android Malicious Payload Localization via LLMs
di: Sun, Tiezhu, et al.
Pubblicazione: (2025)
di: Sun, Tiezhu, et al.
Pubblicazione: (2025)
Reinforcement Learning-Guided Chain-of-Draft for Token-Efficient Code Generation
di: Tang, Xunzhu, et al.
Pubblicazione: (2025)
di: Tang, Xunzhu, et al.
Pubblicazione: (2025)
Is Small Language Model the Silver Bullet to Low-Resource Languages Machine Translation?
di: Song, Yewei, et al.
Pubblicazione: (2025)
di: Song, Yewei, et al.
Pubblicazione: (2025)
AndroLibZoo: A Reliable Dataset of Libraries Based on Software Dependency Analysis
di: Samhi, Jordan, et al.
Pubblicazione: (2023)
di: Samhi, Jordan, et al.
Pubblicazione: (2023)
Test smells in LLM-Generated Unit Tests
di: Ouédraogo, Wendkûuni C., et al.
Pubblicazione: (2024)
di: Ouédraogo, Wendkûuni C., et al.
Pubblicazione: (2024)
Correctness isnt Efficiency: Runtime Memory Divergence in LLM-Generated Code
di: Rajput, Prateek, et al.
Pubblicazione: (2026)
di: Rajput, Prateek, et al.
Pubblicazione: (2026)
Evaluating Large Language Models in detecting Secrets in Android Apps
di: Alecci, Marco, et al.
Pubblicazione: (2025)
di: Alecci, Marco, et al.
Pubblicazione: (2025)
How Secure is Secure Code Generation? Adversarial Prompts Put LLM Defenses to the Test
di: Tessa, Melissa, et al.
Pubblicazione: (2026)
di: Tessa, Melissa, et al.
Pubblicazione: (2026)
Software Security in Software-Defined Networking: A Systematic Literature Review
di: Diouf, Moustapha Awwalou, et al.
Pubblicazione: (2025)
di: Diouf, Moustapha Awwalou, et al.
Pubblicazione: (2025)
MT4DP: Data Poisoning Attack Detection for DL-based Code Search Models via Metamorphic Testing
di: Chen, Gong, et al.
Pubblicazione: (2025)
di: Chen, Gong, et al.
Pubblicazione: (2025)
In-Context Code-Text Learning for Bimodal Software Engineering
di: Tang, Xunzhu, et al.
Pubblicazione: (2024)
di: Tang, Xunzhu, et al.
Pubblicazione: (2024)
Enhancing Small Language Models for Cross-Lingual Generalized Zero-Shot Classification with Soft Prompt Tuning
di: Philippy, Fred, et al.
Pubblicazione: (2025)
di: Philippy, Fred, et al.
Pubblicazione: (2025)
The Struggles of LLMs in Cross-lingual Code Clone Detection
di: Moumoula, Micheline Bénédicte, et al.
Pubblicazione: (2024)
di: Moumoula, Micheline Bénédicte, et al.
Pubblicazione: (2024)
An Empirical Study of AI Techniques in Mobile Applications
di: Li, Yinghua, et al.
Pubblicazione: (2022)
di: Li, Yinghua, et al.
Pubblicazione: (2022)
Unlocking LLM Repair Capabilities Through Cross-Language Translation and Multi-Agent Refinement
di: Luo, Wenqiang, et al.
Pubblicazione: (2025)
di: Luo, Wenqiang, et al.
Pubblicazione: (2025)
CREF: An LLM-based Conversational Software Repair Framework for Programming Tutors
di: Yang, Boyang, et al.
Pubblicazione: (2024)
di: Yang, Boyang, et al.
Pubblicazione: (2024)
Programming Language Confusion: When Code LLMs Can't Keep their Languages Straight
di: Moumoula, Micheline Bénédicte, et al.
Pubblicazione: (2025)
di: Moumoula, Micheline Bénédicte, et al.
Pubblicazione: (2025)
Beyond Surface Similarity: Evaluating LLM-Based Test Refactorings with Structural and Semantic Awareness
di: Ouédraogo, Wendkûuni C., et al.
Pubblicazione: (2025)
di: Ouédraogo, Wendkûuni C., et al.
Pubblicazione: (2025)
The Code Barrier: What LLMs Actually Understand?
di: Nikiema, Serge Lionel, et al.
Pubblicazione: (2025)
di: Nikiema, Serge Lionel, et al.
Pubblicazione: (2025)
Dynamic Stability of LLM-Generated Code
di: Rajput, Prateek, et al.
Pubblicazione: (2025)
di: Rajput, Prateek, et al.
Pubblicazione: (2025)
Learned or Memorized ? Quantifying Memorization Advantage in Code LLMs
di: Euraste, Djiré Albérick, et al.
Pubblicazione: (2026)
di: Euraste, Djiré Albérick, et al.
Pubblicazione: (2026)
LLM for Mobile: An Initial Roadmap
di: Chen, Daihang, et al.
Pubblicazione: (2024)
di: Chen, Daihang, et al.
Pubblicazione: (2024)
Soft Prompt Tuning for Cross-Lingual Transfer: When Less is More
di: Philippy, Fred, et al.
Pubblicazione: (2024)
di: Philippy, Fred, et al.
Pubblicazione: (2024)
DetectBERT: Towards Full App-Level Representation Learning to Detect Android Malware
di: Sun, Tiezhu, et al.
Pubblicazione: (2024)
di: Sun, Tiezhu, et al.
Pubblicazione: (2024)
ContractTrace: Retracing Smart Contract Versions for Security Analyses
di: Mbodji, Fatou Ndiaye, et al.
Pubblicazione: (2024)
di: Mbodji, Fatou Ndiaye, et al.
Pubblicazione: (2024)
Enriching Automatic Test Case Generation by Extracting Relevant Test Inputs from Bug Reports
di: Ouédraogo, Wendkûuni C., et al.
Pubblicazione: (2023)
di: Ouédraogo, Wendkûuni C., et al.
Pubblicazione: (2023)
SIEVE: Towards Verifiable Certification for Code-datasets
di: Mbodji, Fatou Ndiaye, et al.
Pubblicazione: (2025)
di: Mbodji, Fatou Ndiaye, et al.
Pubblicazione: (2025)
Open-Source AI-based SE Tools: Opportunities and Challenges of Collaborative Software Learning
di: Lin, Zhihao, et al.
Pubblicazione: (2024)
di: Lin, Zhihao, et al.
Pubblicazione: (2024)
Security smells in infrastructure as code: a taxonomy update beyond the seven sins
di: War, Aicha, et al.
Pubblicazione: (2025)
di: War, Aicha, et al.
Pubblicazione: (2025)
Beyond Language Barriers: Multi-Agent Coordination for Multi-Language Code Generation
di: Moumoula, Micheline Bénédicte, et al.
Pubblicazione: (2025)
di: Moumoula, Micheline Bénédicte, et al.
Pubblicazione: (2025)
ScaleCall -- Agentic Tool Calling at Scale for Fintech: Challenges, Methods, and Deployment Insights
di: Osuagwu, Richard, et al.
Pubblicazione: (2025)
di: Osuagwu, Richard, et al.
Pubblicazione: (2025)
When Fine-Tuning LLMs Meets Data Privacy: An Empirical Study of Federated Learning in LLM-Based Program Repair
di: Luo, Wenqiang, et al.
Pubblicazione: (2024)
di: Luo, Wenqiang, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Enhancing Text-to-SQL Translation for Financial System Design
di: Song, Yewei, et al.
Pubblicazione: (2023) -
CodeAgent: Autonomous Communicative Agents for Code Review
di: Tang, Xunzhu, et al.
Pubblicazione: (2024) -
Empirical Evaluation of PDF Parsing and Chunking for Financial Question Answering with RAG
di: Bachyr, Omar El, et al.
Pubblicazione: (2026) -
Revisiting Code Similarity Evaluation with Abstract Syntax Tree Edit Distance
di: Song, Yewei, et al.
Pubblicazione: (2024) -
Patch-CLIP: A Patch-Text Pre-Trained Model
di: Tang, Xunzhu, et al.
Pubblicazione: (2023)