Trajectory Supervision for Continual Tool-Use Learning in LLMs
Fuente:
arXiv
Salvato in:
| Autori principali: | Reddy, Vishnu Vardhan, Chatterjee, Sagnik, Bhatta, Soumik |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
An Executable Benchmarking Suite for Tool-Using Agents
di: Zhong, Zhiqing, et al.
Pubblicazione: (2026)
di: Zhong, Zhiqing, et al.
Pubblicazione: (2026)
Lessons Learned: A Multi-Agent Framework for Code LLMs to Learn and Improve
di: Liu, Yuanzhe, et al.
Pubblicazione: (2025)
di: Liu, Yuanzhe, et al.
Pubblicazione: (2025)
Agile V: A Compliance-Ready Framework for AI-Augmented Engineering -- From Concept to Audit-Ready Delivery
di: Koch, Christopher, et al.
Pubblicazione: (2026)
di: Koch, Christopher, et al.
Pubblicazione: (2026)
Automated Root-Cause Subclassification and No-Code Fix Generation for Invalid Bug Reports
di: Gon, Mahmut Furkan, et al.
Pubblicazione: (2026)
di: Gon, Mahmut Furkan, et al.
Pubblicazione: (2026)
LDP: An Identity-Aware Protocol for Multi-Agent LLM Systems
di: Prakash, Sunil
Pubblicazione: (2026)
di: Prakash, Sunil
Pubblicazione: (2026)
RIVA: Leveraging LLM Agents for Reliable Configuration Drift Detection
di: Abuzakuk, Sami, et al.
Pubblicazione: (2026)
di: Abuzakuk, Sami, et al.
Pubblicazione: (2026)
Qualixar OS: A Universal Operating System for AI Agent Orchestration
di: Bhardwaj, Varun Pratap
Pubblicazione: (2026)
di: Bhardwaj, Varun Pratap
Pubblicazione: (2026)
A Research Agenda on Agents and Software Engineering: Outcomes from the Rio A2SE Seminar
di: Taibi, Davide, et al.
Pubblicazione: (2026)
di: Taibi, Davide, et al.
Pubblicazione: (2026)
From Agent Loops to Deterministic Graphs: Execution Lineage for Reproducible AI-Native Work
di: Rosen, Josh, et al.
Pubblicazione: (2026)
di: Rosen, Josh, et al.
Pubblicazione: (2026)
Bridging Protocol and Production: Design Patterns for Deploying AI Agents with Model Context Protocol
di: Srinivasan, Vasundra
Pubblicazione: (2026)
di: Srinivasan, Vasundra
Pubblicazione: (2026)
Modality-Native Routing in Agent-to-Agent Networks: A Multimodal A2A Protocol Extension
di: Srinivasan, Vasundra
Pubblicazione: (2026)
di: Srinivasan, Vasundra
Pubblicazione: (2026)
Tokenomics: Quantifying Where Tokens Are Used in Agentic Software Engineering
di: Salim, Mohamad, et al.
Pubblicazione: (2026)
di: Salim, Mohamad, et al.
Pubblicazione: (2026)
No Test Cases, No Problem: Distillation-Driven Code Generation for Scientific Workflows
di: Raghavan, Siddeshwar, et al.
Pubblicazione: (2026)
di: Raghavan, Siddeshwar, et al.
Pubblicazione: (2026)
The Specification Gap: Coordination Failure Under Partial Knowledge in Code Agents
di: Sartori, Camilo Chacón
Pubblicazione: (2026)
di: Sartori, Camilo Chacón
Pubblicazione: (2026)
Sibyl-AutoResearch: Autonomous Research Needs Self-Evolving Trial-and-Error Harnesses, Not Paper Generators
di: Wang, Chengcheng, et al.
Pubblicazione: (2026)
di: Wang, Chengcheng, et al.
Pubblicazione: (2026)
Spec Kit Agents: Context-Grounded Agentic Workflows
di: Taghavi, Pardis, et al.
Pubblicazione: (2026)
di: Taghavi, Pardis, et al.
Pubblicazione: (2026)
Governed Evolution of Agent Runtimes through Executable Operational Cognition
di: Garralda-Barrio, Mariano
Pubblicazione: (2026)
di: Garralda-Barrio, Mariano
Pubblicazione: (2026)
Agentic Agile-V: From Vibe Coding to Verified Engineering in Software and Hardware Development
di: Koch, Christopher
Pubblicazione: (2026)
di: Koch, Christopher
Pubblicazione: (2026)
Agent Behavioral Contracts: Formal Specification and Runtime Enforcement for Reliable Autonomous AI Agents
di: Bhardwaj, Varun Pratap
Pubblicazione: (2026)
di: Bhardwaj, Varun Pratap
Pubblicazione: (2026)
Resolving Java Code Repository Issues with iSWE Agent
di: Ganhotra, Jatin, et al.
Pubblicazione: (2026)
di: Ganhotra, Jatin, et al.
Pubblicazione: (2026)
Facilitating Trustworthy Human-Agent Collaboration in LLM-based Multi-Agent System oriented Software Engineering
di: Ronanki, Krishna
Pubblicazione: (2025)
di: Ronanki, Krishna
Pubblicazione: (2025)
XABPs: Towards eXplainable Autonomous Business Processes
di: Fettke, Peter, et al.
Pubblicazione: (2025)
di: Fettke, Peter, et al.
Pubblicazione: (2025)
Affordance Representation and Recognition for Autonomous Agents
di: Gidey, Habtom Kahsay, et al.
Pubblicazione: (2025)
di: Gidey, Habtom Kahsay, et al.
Pubblicazione: (2025)
Multi-Agent LLM Committees for Autonomous Software Beta Testing
di: Karanam, Sumanth Bharadwaj Hachalli, et al.
Pubblicazione: (2025)
di: Karanam, Sumanth Bharadwaj Hachalli, et al.
Pubblicazione: (2025)
IACT: A Self-Organizing Recursive Model for General AI Agents: A Technical White Paper on the Architecture Behind kragent.ai
di: Lu, Pengju
Pubblicazione: (2025)
di: Lu, Pengju
Pubblicazione: (2025)
Beyond Task Completion: An Assessment Framework for Evaluating Agentic AI Systems
di: Akshathala, Sreemaee, et al.
Pubblicazione: (2025)
di: Akshathala, Sreemaee, et al.
Pubblicazione: (2025)
TDFlow: Agentic Workflows for Test Driven Development
di: Han, Kevin, et al.
Pubblicazione: (2025)
di: Han, Kevin, et al.
Pubblicazione: (2025)
AI-Generated Code Is Not Reproducible (Yet): An Empirical Study of Dependency Gaps in LLM-Based Coding Agents
di: Vangala, Bhanu Prakash, et al.
Pubblicazione: (2025)
di: Vangala, Bhanu Prakash, et al.
Pubblicazione: (2025)
EnergyTwin: A Multi-Agent System for Simulating and Coordinating Energy Microgrids
di: Muszyński, Jakub, et al.
Pubblicazione: (2025)
di: Muszyński, Jakub, et al.
Pubblicazione: (2025)
Self-Evolving Multi-Agent Collaboration Networks for Software Development
di: Hu, Yue, et al.
Pubblicazione: (2024)
di: Hu, Yue, et al.
Pubblicazione: (2024)
Murakkab: Resource-Efficient Agentic Workflow Orchestration in Cloud Platforms
di: Chaudhry, Gohar Irfan, et al.
Pubblicazione: (2025)
di: Chaudhry, Gohar Irfan, et al.
Pubblicazione: (2025)
Toward Agentic Software Engineering Beyond Code: Framing Vision, Values, and Vocabulary
di: Hoda, Rashina
Pubblicazione: (2025)
di: Hoda, Rashina
Pubblicazione: (2025)
A Scoresheet for Explainable AI
di: Winikoff, Michael, et al.
Pubblicazione: (2025)
di: Winikoff, Michael, et al.
Pubblicazione: (2025)
Nexus: A Lightweight and Scalable Multi-Agent Framework for Complex Tasks Automation
di: Sami, Humza, et al.
Pubblicazione: (2025)
di: Sami, Humza, et al.
Pubblicazione: (2025)
Computational Foundations for Strategic Coopetition: Formalizing Interdependence and Complementarity
di: Pant, Vik, et al.
Pubblicazione: (2025)
di: Pant, Vik, et al.
Pubblicazione: (2025)
Accelerating Drug Discovery Through Agentic AI: A Multi-Agent Approach to Laboratory Automation in the DMTA Cycle
di: Fehlis, Yao, et al.
Pubblicazione: (2025)
di: Fehlis, Yao, et al.
Pubblicazione: (2025)
AgentGit: A Version Control Framework for Reliable and Scalable LLM-Powered Multi-Agent Systems
di: Li, Yang, et al.
Pubblicazione: (2025)
di: Li, Yang, et al.
Pubblicazione: (2025)
SemAgent: A Semantics Aware Program Repair Agent
di: Pabba, Anvith, et al.
Pubblicazione: (2025)
di: Pabba, Anvith, et al.
Pubblicazione: (2025)
Applying Large Language Models in Knowledge Graph-based Enterprise Modeling: Challenges and Opportunities
di: Reitemeyer, Benedikt, et al.
Pubblicazione: (2025)
di: Reitemeyer, Benedikt, et al.
Pubblicazione: (2025)
Exploring the Potential of Conversational Test Suite Based Program Repair on SWE-bench
di: Cheshkov, Anton, et al.
Pubblicazione: (2024)
di: Cheshkov, Anton, et al.
Pubblicazione: (2024)
Documenti analoghi
-
An Executable Benchmarking Suite for Tool-Using Agents
di: Zhong, Zhiqing, et al.
Pubblicazione: (2026) -
Lessons Learned: A Multi-Agent Framework for Code LLMs to Learn and Improve
di: Liu, Yuanzhe, et al.
Pubblicazione: (2025) -
Agile V: A Compliance-Ready Framework for AI-Augmented Engineering -- From Concept to Audit-Ready Delivery
di: Koch, Christopher, et al.
Pubblicazione: (2026) -
Automated Root-Cause Subclassification and No-Code Fix Generation for Invalid Bug Reports
di: Gon, Mahmut Furkan, et al.
Pubblicazione: (2026) -
LDP: An Identity-Aware Protocol for Multi-Agent LLM Systems
di: Prakash, Sunil
Pubblicazione: (2026)