TheMCPCompany: Creating General-purpose Agents with Task-specific Tools
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Esfandiarpoor, Reza, Suryanarayanan, Vishwas, Bach, Stephen H., Chowdhary, Vishal, Aue, Anthony |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Follow-Up Differential Descriptions: Language Models Resolve Ambiguities for Image Classification
par: Esfandiarpoor, Reza, et autres
Publié: (2023)
par: Esfandiarpoor, Reza, et autres
Publié: (2023)
If CLIP Could Talk: Understanding Vision-Language Model Representations Through Their Preferred Concept Descriptions
par: Esfandiarpoor, Reza, et autres
Publié: (2024)
par: Esfandiarpoor, Reza, et autres
Publié: (2024)
Beyond Contrastive Learning: Synthetic Data Enables List-wise Training with Multiple Levels of Relevance
par: Esfandiarpoor, Reza, et autres
Publié: (2025)
par: Esfandiarpoor, Reza, et autres
Publié: (2025)
Local Prompt Optimization
par: Jain, Yash, et autres
Publié: (2025)
par: Jain, Yash, et autres
Publié: (2025)
VerificAgent: Domain-Specific Memory Verification for Scalable Oversight of Aligned Computer-Use Agents
par: Nguyen, Thong Q., et autres
Publié: (2025)
par: Nguyen, Thong Q., et autres
Publié: (2025)
Trove: A Flexible Toolkit for Dense Retrieval
par: Esfandiarpoor, Reza, et autres
Publié: (2025)
par: Esfandiarpoor, Reza, et autres
Publié: (2025)
GATE X-E : A Challenge Set for Gender-Fair Translations from Weakly-Gendered Languages
par: Rarrick, Spencer, et autres
Publié: (2024)
par: Rarrick, Spencer, et autres
Publié: (2024)
Learning to Generate Instruction Tuning Datasets for Zero-Shot Task Adaptation
par: Nayak, Nihal V., et autres
Publié: (2024)
par: Nayak, Nihal V., et autres
Publié: (2024)
$K$-MSHC: Unmasking Minimally Sufficient Head Circuits in Large Language Models with Experiments on Syntactic Classification Tasks
par: Chowdhary, Pratim, et autres
Publié: (2025)
par: Chowdhary, Pratim, et autres
Publié: (2025)
Multimedia Generative Script Learning for Task Planning
par: Wang, Qingyun, et autres
Publié: (2022)
par: Wang, Qingyun, et autres
Publié: (2022)
A General-purpose AI Avatar in Healthcare
par: Yan, Nicholas, et autres
Publié: (2024)
par: Yan, Nicholas, et autres
Publié: (2024)
CORE: A Conceptual Reasoning Layer for Large Language Models
par: Hegde, Vishwas, et autres
Publié: (2025)
par: Hegde, Vishwas, et autres
Publié: (2025)
Self-Jailbreaking: Language Models Can Reason Themselves Out of Safety Alignment After Benign Reasoning Training
par: Yong, Zheng-Xin, et autres
Publié: (2025)
par: Yong, Zheng-Xin, et autres
Publié: (2025)
General-purpose Dataflow Model with Neuromorphic Primitives
par: Zhang, Weihao, et autres
Publié: (2024)
par: Zhang, Weihao, et autres
Publié: (2024)
AgentSynth: Scalable Task Generation for Generalist Computer-Use Agents
par: Xie, Jingxu, et autres
Publié: (2025)
par: Xie, Jingxu, et autres
Publié: (2025)
Tool-to-Agent Retrieval: Bridging Tools and Agents for Scalable LLM Multi-Agent Systems
par: Lumer, Elias, et autres
Publié: (2025)
par: Lumer, Elias, et autres
Publié: (2025)
An Adaptive Method for Weak Supervision with Drifting Data
par: Mazzetto, Alessio, et autres
Publié: (2023)
par: Mazzetto, Alessio, et autres
Publié: (2023)
AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models
par: Lee, Jaeho, et autres
Publié: (2025)
par: Lee, Jaeho, et autres
Publié: (2025)
LexC-Gen: Generating Data for Extremely Low-Resource Languages with Large Language Models and Bilingual Lexicons
par: Yong, Zheng-Xin, et autres
Publié: (2024)
par: Yong, Zheng-Xin, et autres
Publié: (2024)
TRACER: Verifiable Generative Provenance for Multimodal Tool-Using Agents
par: Yu, Bihui, et autres
Publié: (2026)
par: Yu, Bihui, et autres
Publié: (2026)
Doc2Agent: Scalable Generation of Tool-Using Agents from API Documentation
par: Ni, Xinyi, et autres
Publié: (2025)
par: Ni, Xinyi, et autres
Publié: (2025)
BAR: A Backward Reasoning based Agent for Complex Minecraft Tasks
par: Du, Weihong, et autres
Publié: (2025)
par: Du, Weihong, et autres
Publié: (2025)
GTA: A Benchmark for General Tool Agents
par: Wang, Jize, et autres
Publié: (2024)
par: Wang, Jize, et autres
Publié: (2024)
Development and Evaluation of a Retrieval-Augmented Generation Tool for Creating SAPPhIRE Models of Artificial Systems
par: Majumder, Anubhab, et autres
Publié: (2024)
par: Majumder, Anubhab, et autres
Publié: (2024)
Preference Tuning For Toxicity Mitigation Generalizes Across Languages
par: Li, Xiaochen, et autres
Publié: (2024)
par: Li, Xiaochen, et autres
Publié: (2024)
Revisiting Generalization Across Difficulty Levels: It's Not So Easy
par: Kordi, Yeganeh, et autres
Publié: (2025)
par: Kordi, Yeganeh, et autres
Publié: (2025)
Specializing General-purpose LLM Embeddings for Implicit Hate Speech Detection across Datasets
par: Cheremetiev, Vassiliy, et autres
Publié: (2025)
par: Cheremetiev, Vassiliy, et autres
Publié: (2025)
VeriAgent: A Tool-Integrated Multi-Agent System with Evolving Memory for PPA-Aware RTL Code Generation
par: Wang, Yaoxiang, et autres
Publié: (2026)
par: Wang, Yaoxiang, et autres
Publié: (2026)
The Tool Illusion: Rethinking Tool Use in Web Agents
par: Lou, Renze, et autres
Publié: (2026)
par: Lou, Renze, et autres
Publié: (2026)
From Failure to Mastery: Generating Hard Samples for Tool-use Agents
par: Hao, Bingguang, et autres
Publié: (2026)
par: Hao, Bingguang, et autres
Publié: (2026)
MCP-Bench: Benchmarking Tool-Using LLM Agents with Complex Real-World Tasks via MCP Servers
par: Wang, Zhenting, et autres
Publié: (2025)
par: Wang, Zhenting, et autres
Publié: (2025)
The Tool Decathlon: Benchmarking Language Agents for Diverse, Realistic, and Long-Horizon Task Execution
par: Li, Junlong, et autres
Publié: (2025)
par: Li, Junlong, et autres
Publié: (2025)
TDAG: A Multi-Agent Framework based on Dynamic Task Decomposition and Agent Generation
par: Wang, Yaoxiang, et autres
Publié: (2024)
par: Wang, Yaoxiang, et autres
Publié: (2024)
Does It Run and Is That Enough? Revisiting Text-to-Chart Generation with a Multi-Agent Approach
par: Ford, James, et autres
Publié: (2025)
par: Ford, James, et autres
Publié: (2025)
Synergizing In-context Learning with Hints for End-to-end Task-oriented Dialog Systems
par: Saley, Vishal Vivek, et autres
Publié: (2024)
par: Saley, Vishal Vivek, et autres
Publié: (2024)
PLANTS: A Novel Problem and Dataset for Summarization of Planning-Like (PL) Tasks
par: Pallagani, Vishal, et autres
Publié: (2024)
par: Pallagani, Vishal, et autres
Publié: (2024)
Trajectory2Task: Training Robust Tool-Calling Agents with Synthesized Yet Verifiable Data for Complex User Intents
par: Wang, Ziyi, et autres
Publié: (2026)
par: Wang, Ziyi, et autres
Publié: (2026)
Using Generative Agents to Create Tip Sheets for Investigative Data Reporting
par: Veerbeek, Joris, et autres
Publié: (2024)
par: Veerbeek, Joris, et autres
Publié: (2024)
Pralekha: Cross-Lingual Document Alignment for Indic Languages
par: Suryanarayanan, Sanjay, et autres
Publié: (2024)
par: Suryanarayanan, Sanjay, et autres
Publié: (2024)
Toolshed: Scale Tool-Equipped Agents with Advanced RAG-Tool Fusion and Tool Knowledge Bases
par: Lumer, Elias, et autres
Publié: (2024)
par: Lumer, Elias, et autres
Publié: (2024)
Documents similaires
-
Follow-Up Differential Descriptions: Language Models Resolve Ambiguities for Image Classification
par: Esfandiarpoor, Reza, et autres
Publié: (2023) -
If CLIP Could Talk: Understanding Vision-Language Model Representations Through Their Preferred Concept Descriptions
par: Esfandiarpoor, Reza, et autres
Publié: (2024) -
Beyond Contrastive Learning: Synthetic Data Enables List-wise Training with Multiple Levels of Relevance
par: Esfandiarpoor, Reza, et autres
Publié: (2025) -
Local Prompt Optimization
par: Jain, Yash, et autres
Publié: (2025) -
VerificAgent: Domain-Specific Memory Verification for Scalable Oversight of Aligned Computer-Use Agents
par: Nguyen, Thong Q., et autres
Publié: (2025)