Doc2Agent: Scalable Generation of Tool-Using Agents from API Documentation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ni, Xinyi, Jian, Haonan, Wang, Qiuyang, Shah, Vedanshi Chetan, Hong, Pengyu |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
ToolFactory: Automating Tool Generation by Leveraging LLM to Understand REST API Documentations
par: Ni, Xinyi, et autres
Publié: (2025)
par: Ni, Xinyi, et autres
Publié: (2025)
What is Visualization for Communication? Analyzing Four Years of VisComm Papers
par: Shah, Vedanshi Chetan, et autres
Publié: (2025)
par: Shah, Vedanshi Chetan, et autres
Publié: (2025)
Multiple Abstraction Level Retrieve Augment Generation
par: Zheng, Zheng, et autres
Publié: (2025)
par: Zheng, Zheng, et autres
Publié: (2025)
DocLens : A Tool-Augmented Multi-Agent Framework for Long Visual Document Understanding
par: Zhu, Dawei, et autres
Publié: (2025)
par: Zhu, Dawei, et autres
Publié: (2025)
DocAgent: A Multi-Agent System for Automated Code Documentation Generation
par: Yang, Dayu, et autres
Publié: (2025)
par: Yang, Dayu, et autres
Publié: (2025)
Demonstrating ViviDoc: Generating Interactive Documents through Human-Agent Collaboration
par: Tang, Yinghao, et autres
Publié: (2026)
par: Tang, Yinghao, et autres
Publié: (2026)
Tool-to-Agent Retrieval: Bridging Tools and Agents for Scalable LLM Multi-Agent Systems
par: Lumer, Elias, et autres
Publié: (2025)
par: Lumer, Elias, et autres
Publié: (2025)
AnyTool: Self-Reflective, Hierarchical Agents for Large-Scale API Calls
par: Du, Yu, et autres
Publié: (2024)
par: Du, Yu, et autres
Publié: (2024)
Doc-Guided Sent2Sent++: A Sent2Sent++ Agent with Doc-Guided memory for Document-level Machine Translation
par: Guo, Jiaxin, et autres
Publié: (2025)
par: Guo, Jiaxin, et autres
Publié: (2025)
Infant Agent: A Tool-Integrated, Logic-Driven Agent with Cost-Effective API Usage
par: Lei, Bin, et autres
Publié: (2024)
par: Lei, Bin, et autres
Publié: (2024)
GTA: A Benchmark for General Tool Agents
par: Wang, Jize, et autres
Publié: (2024)
par: Wang, Jize, et autres
Publié: (2024)
SpeCrawler: Generating OpenAPI Specifications from API Documentation Using Large Language Models
par: Lazar, Koren, et autres
Publié: (2024)
par: Lazar, Koren, et autres
Publié: (2024)
GTA-2: Benchmarking General Tool Agents from Atomic Tool-Use to Open-Ended Workflows
par: Wang, Jize, et autres
Publié: (2026)
par: Wang, Jize, et autres
Publié: (2026)
In-N-Out: A Parameter-Level API Graph Dataset for Tool Agents
par: Lee, Seungkyu, et autres
Publié: (2025)
par: Lee, Seungkyu, et autres
Publié: (2025)
TRACER: Verifiable Generative Provenance for Multimodal Tool-Using Agents
par: Yu, Bihui, et autres
Publié: (2026)
par: Yu, Bihui, et autres
Publié: (2026)
DocTabQA: Answering Questions from Long Documents Using Tables
par: Wang, Haochen, et autres
Publié: (2024)
par: Wang, Haochen, et autres
Publié: (2024)
DocGraphLM: Documental Graph Language Model for Information Extraction
par: Wang, Dongsheng, et autres
Publié: (2024)
par: Wang, Dongsheng, et autres
Publié: (2024)
From Failure to Mastery: Generating Hard Samples for Tool-use Agents
par: Hao, Bingguang, et autres
Publié: (2026)
par: Hao, Bingguang, et autres
Publié: (2026)
Doc2Chart: Intent-Driven Zero-Shot Chart Generation from Documents
par: Jain, Akriti, et autres
Publié: (2025)
par: Jain, Akriti, et autres
Publié: (2025)
MM-Doc-R1: Training Agents for Long Document Visual Question Answering through Multi-turn Reinforcement Learning
par: Lin, Jiahang, et autres
Publié: (2026)
par: Lin, Jiahang, et autres
Publié: (2026)
Beyond Browsing: API-Based Web Agents
par: Song, Yueqi, et autres
Publié: (2024)
par: Song, Yueqi, et autres
Publié: (2024)
AgentSynth: Scalable Task Generation for Generalist Computer-Use Agents
par: Xie, Jingxu, et autres
Publié: (2025)
par: Xie, Jingxu, et autres
Publié: (2025)
SpeechAgents: Human-Communication Simulation with Multi-Modal Multi-Agent Systems
par: Zhang, Dong, et autres
Publié: (2024)
par: Zhang, Dong, et autres
Publié: (2024)
Multi2: Multi-Agent Test-Time Scalable Framework for Multi-Document Processing
par: Cao, Juntai, et autres
Publié: (2025)
par: Cao, Juntai, et autres
Publié: (2025)
DocCGen: Document-based Controlled Code Generation
par: Pimparkhede, Sameer, et autres
Publié: (2024)
par: Pimparkhede, Sameer, et autres
Publié: (2024)
PP-DocBee: Improving Multimodal Document Understanding Through a Bag of Tricks
par: Ni, Feng, et autres
Publié: (2025)
par: Ni, Feng, et autres
Publié: (2025)
VeriAgent: A Tool-Integrated Multi-Agent System with Evolving Memory for PPA-Aware RTL Code Generation
par: Wang, Yaoxiang, et autres
Publié: (2026)
par: Wang, Yaoxiang, et autres
Publié: (2026)
DocFusion: A Unified Framework for Document Parsing Tasks
par: Chai, Mingxu, et autres
Publié: (2024)
par: Chai, Mingxu, et autres
Publié: (2024)
EMULATE: A Multi-Agent Framework for Determining the Veracity of Atomic Claims by Emulating Human Actions
par: Hong, Spencer, et autres
Publié: (2025)
par: Hong, Spencer, et autres
Publié: (2025)
Doc-V*:Coarse-to-Fine Interactive Visual Reasoning for Multi-Page Document VQA
par: Zheng, Yuanlei, et autres
Publié: (2026)
par: Zheng, Yuanlei, et autres
Publié: (2026)
MCP-Bench: Benchmarking Tool-Using LLM Agents with Complex Real-World Tasks via MCP Servers
par: Wang, Zhenting, et autres
Publié: (2025)
par: Wang, Zhenting, et autres
Publié: (2025)
DocDancer: Towards Agentic Document-Grounded Information Seeking
par: Zhang, Qintong, et autres
Publié: (2026)
par: Zhang, Qintong, et autres
Publié: (2026)
ReflecTool: Towards Reflection-Aware Tool-Augmented Clinical Agents
par: Liao, Yusheng, et autres
Publié: (2024)
par: Liao, Yusheng, et autres
Publié: (2024)
PostDoc: Generating Poster from a Long Multimodal Document Using Deep Submodular Optimization
par: Jaisankar, Vijay, et autres
Publié: (2024)
par: Jaisankar, Vijay, et autres
Publié: (2024)
DeepAgent: A General Reasoning Agent with Scalable Toolsets
par: Li, Xiaoxi, et autres
Publié: (2025)
par: Li, Xiaoxi, et autres
Publié: (2025)
DocTER: Evaluating Document-based Knowledge Editing
par: Wu, Suhang, et autres
Publié: (2023)
par: Wu, Suhang, et autres
Publié: (2023)
ToolMem: Enhancing Multimodal Agents with Learnable Tool Capability Memory
par: Xiao, Yunzhong, et autres
Publié: (2025)
par: Xiao, Yunzhong, et autres
Publié: (2025)
ToolScope: Enhancing LLM Agent Tool Use through Tool Merging and Context-Aware Filtering
par: Liu, Marianne Menglin, et autres
Publié: (2025)
par: Liu, Marianne Menglin, et autres
Publié: (2025)
DocTalk: Scalable Graph-based Dialogue Synthesis for Enhancing LLM Conversational Capabilities
par: Lee, Jing Yang, et autres
Publié: (2025)
par: Lee, Jing Yang, et autres
Publié: (2025)
SciDoc2Diagrammer-MAF: Towards Generation of Scientific Diagrams from Documents guided by Multi-Aspect Feedback Refinement
par: Mondal, Ishani, et autres
Publié: (2024)
par: Mondal, Ishani, et autres
Publié: (2024)
Documents similaires
-
ToolFactory: Automating Tool Generation by Leveraging LLM to Understand REST API Documentations
par: Ni, Xinyi, et autres
Publié: (2025) -
What is Visualization for Communication? Analyzing Four Years of VisComm Papers
par: Shah, Vedanshi Chetan, et autres
Publié: (2025) -
Multiple Abstraction Level Retrieve Augment Generation
par: Zheng, Zheng, et autres
Publié: (2025) -
DocLens : A Tool-Augmented Multi-Agent Framework for Long Visual Document Understanding
par: Zhu, Dawei, et autres
Publié: (2025) -
DocAgent: A Multi-Agent System for Automated Code Documentation Generation
par: Yang, Dayu, et autres
Publié: (2025)