Achieving Tool Calling Functionality in LLMs Using Only Prompt Engineering Without Fine-Tuning
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | He, Shengtao |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Augment Engineering: A Methodology for Multi-Tool AI Orchestration Across Professional Domains
par: Calboreanu, Elias
Publié: (2026)
par: Calboreanu, Elias
Publié: (2026)
Componentization: Decomposing Monolithic LLM Responses into Manipulable Semantic Units
par: Lingo, Ryan, et autres
Publié: (2025)
par: Lingo, Ryan, et autres
Publié: (2025)
Agentic Education: Using Claude Code to Teach Claude Code
par: Naboulsi, Zain
Publié: (2026)
par: Naboulsi, Zain
Publié: (2026)
Mind the GAP: Text Safety Does Not Transfer to Tool-Call Safety in LLM Agents
par: Cartagena, Arnold, et autres
Publié: (2026)
par: Cartagena, Arnold, et autres
Publié: (2026)
A Comparative Study of DSL Code Generation: Fine-Tuning vs. Optimized Retrieval Augmentation
par: Bassamzadeh, Nastaran, et autres
Publié: (2024)
par: Bassamzadeh, Nastaran, et autres
Publié: (2024)
Using LLMs to Establish Implicit User Sentiment of Software Desirability
par: Weitl-Harms, Sherri, et autres
Publié: (2024)
par: Weitl-Harms, Sherri, et autres
Publié: (2024)
Reconsidering Requirements Engineering: Human-AI Collaboration in AI-Native Software Development
par: Abbasi, Mateen Ahmed, et autres
Publié: (2025)
par: Abbasi, Mateen Ahmed, et autres
Publié: (2025)
Fine-Tuning LLMs to Analyze Multiple Dimensions of Code Review: A Maximum Entropy Regulated Long Chain-of-Thought Approach
par: Yu, Yongda, et autres
Publié: (2025)
par: Yu, Yongda, et autres
Publié: (2025)
A Framework for Testing and Adapting REST APIs as LLM Tools
par: Bandlamudi, Jayachandu, et autres
Publié: (2025)
par: Bandlamudi, Jayachandu, et autres
Publié: (2025)
The Transformative Influence of LLMs on Software Development & Developer Productivity
par: Jalil, Sajed
Publié: (2023)
par: Jalil, Sajed
Publié: (2023)
Fine-Tuning Open-Weight Language Models to Deliver Cognitive Behavioral Therapy for Depression: A Feasibility Study
par: Tahir, Talha
Publié: (2024)
par: Tahir, Talha
Publié: (2024)
PROTEA: Offline Evaluation and Iterative Refinement for Multi-Agent LLM Workflows
par: Kawamura, Kazuki, et autres
Publié: (2026)
par: Kawamura, Kazuki, et autres
Publié: (2026)
Finetuning LLMs for Automatic Form Interaction on Web-Browser in Selenium Testing Framework
par: Le, Nguyen-Khang, et autres
Publié: (2025)
par: Le, Nguyen-Khang, et autres
Publié: (2025)
Tool-Schema Compression Enables Agentic RAG Under Constrained Context Budgets
par: Sakizli, Furkan
Publié: (2026)
par: Sakizli, Furkan
Publié: (2026)
Same Voice, Different Lab: On the Homogenization of Frontier LLM Personalities
par: Krishna, Avinash, et autres
Publié: (2026)
par: Krishna, Avinash, et autres
Publié: (2026)
Development and Benchmarking of a Blended Human-AI Qualitative Research Assistant
par: Matveyenko, Joseph, et autres
Publié: (2025)
par: Matveyenko, Joseph, et autres
Publié: (2025)
MoodBench 1.0: An Evaluation Benchmark for Emotional Companionship Dialogue Systems
par: Jing, Haifeng, et autres
Publié: (2025)
par: Jing, Haifeng, et autres
Publié: (2025)
An Analysis of LLM Fine-Tuning and Few-Shot Learning for Flaky Test Detection and Classification
par: More, Riddhi, et autres
Publié: (2025)
par: More, Riddhi, et autres
Publié: (2025)
Learning Software Bug Reports: A Systematic Literature Review
par: Long, Guoming, et autres
Publié: (2025)
par: Long, Guoming, et autres
Publié: (2025)
Prompt Engineering Strategies for LLM-based Qualitative Coding of Psychological Safety in Software Engineering Communities: A Controlled Empirical Study
par: Alshaikh, Moaath, et autres
Publié: (2026)
par: Alshaikh, Moaath, et autres
Publié: (2026)
Improving Knowledge Extraction from LLMs for Task Learning through Agent Analysis
par: Kirk, James R., et autres
Publié: (2023)
par: Kirk, James R., et autres
Publié: (2023)
Helping Johnny Make Sense of Privacy Policies with LLMs
par: Freiberger, Vincent, et autres
Publié: (2025)
par: Freiberger, Vincent, et autres
Publié: (2025)
CIDR: A Large-Scale Industrial Source Code Dataset for Software Engineering Research
par: Savenkov, Vladislav
Publié: (2026)
par: Savenkov, Vladislav
Publié: (2026)
Co-Refine: AI-Powered Tool Supporting Qualitative Analysis
par: Jeyaganthan, Athikash, et autres
Publié: (2026)
par: Jeyaganthan, Athikash, et autres
Publié: (2026)
Towards Human-AI Synergy in Requirements Engineering: A Framework and Preliminary Study
par: Abbasi, Mateen Ahmed, et autres
Publié: (2025)
par: Abbasi, Mateen Ahmed, et autres
Publié: (2025)
AutoTRIZ: Automating Engineering Innovation with TRIZ and Large Language Models
par: Jiang, Shuo, et autres
Publié: (2024)
par: Jiang, Shuo, et autres
Publié: (2024)
Symbolically Scaffolded Play: Designing Role-Sensitive Prompts for Generative NPC Dialogue
par: Figueiredo, Vanessa, et autres
Publié: (2025)
par: Figueiredo, Vanessa, et autres
Publié: (2025)
CueTip: An Interactive and Explainable Physics-aware Pool Assistant
par: Memery, Sean, et autres
Publié: (2025)
par: Memery, Sean, et autres
Publié: (2025)
Humanizing AI Grading: Student-Centered Insights on Fairness, Trust, Consistency and Transparency
par: Riahi, Bahare, et autres
Publié: (2026)
par: Riahi, Bahare, et autres
Publié: (2026)
Discovering High Level Patterns from Simulation Traces
par: Memery, Sean, et autres
Publié: (2026)
par: Memery, Sean, et autres
Publié: (2026)
Beyond Greenfield: The D3 Framework for AI-Driven Productivity in Brownfield Engineering
par: Sharma, Krishna Kumaar
Publié: (2025)
par: Sharma, Krishna Kumaar
Publié: (2025)
Does Structured Intent Representation Generalize? A Cross-Language, Cross-Model Empirical Study of 5W3H Prompting
par: Gang, Peng
Publié: (2026)
par: Gang, Peng
Publié: (2026)
ContractBench: Can LLM Agents Preserve Observation Contracts?
par: Wang, Jicheng, et autres
Publié: (2026)
par: Wang, Jicheng, et autres
Publié: (2026)
The Spark Effect: On Engineering Creative Diversity in Multi-Agent AI Systems
par: Doudkin, Alexander, et autres
Publié: (2025)
par: Doudkin, Alexander, et autres
Publié: (2025)
Automating Domain-Driven Design: Experience with a Prompting Framework
par: Eisenreich, Tobias, et autres
Publié: (2026)
par: Eisenreich, Tobias, et autres
Publié: (2026)
Relational Intervention During Functional Collapse in Large Language Models: A Lexical-Statistical Ablation and a Structure x Register Factorial
par: Santana, Franco, et autres
Publié: (2026)
par: Santana, Franco, et autres
Publié: (2026)
Functional Flexibility in Generative AI Interfaces: Text Editing with LLMs through Conversations, Toolbars, and Prompts
par: Lehmann, Florian, et autres
Publié: (2024)
par: Lehmann, Florian, et autres
Publié: (2024)
Failure by Interference: Language Models Make Balanced Parentheses Errors When Faulty Mechanisms Overshadow Sound Ones
par: Rai, Daking, et autres
Publié: (2025)
par: Rai, Daking, et autres
Publié: (2025)
Vibe Code Bench: Evaluating AI Models on End-to-End Web Application Development
par: Tran, Hung, et autres
Publié: (2026)
par: Tran, Hung, et autres
Publié: (2026)
Automated Web Application Testing: End-to-End Test Case Generation with Large Language Models and Screen Transition Graphs
par: Le, Nguyen-Khang, et autres
Publié: (2025)
par: Le, Nguyen-Khang, et autres
Publié: (2025)
Documents similaires
-
Augment Engineering: A Methodology for Multi-Tool AI Orchestration Across Professional Domains
par: Calboreanu, Elias
Publié: (2026) -
Componentization: Decomposing Monolithic LLM Responses into Manipulable Semantic Units
par: Lingo, Ryan, et autres
Publié: (2025) -
Agentic Education: Using Claude Code to Teach Claude Code
par: Naboulsi, Zain
Publié: (2026) -
Mind the GAP: Text Safety Does Not Transfer to Tool-Call Safety in LLM Agents
par: Cartagena, Arnold, et autres
Publié: (2026) -
A Comparative Study of DSL Code Generation: Fine-Tuning vs. Optimized Retrieval Augmentation
par: Bassamzadeh, Nastaran, et autres
Publié: (2024)