ToolLibGen: Scalable Automatic Tool Creation and Aggregation for LLM Reasoning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yue, Murong, Liu, Zhiwei, Yang, Liangwei, Zhang, Jianguo, Liu, Zuxin, Chen, Haolin, Yao, Ziyu, Savarese, Silvio, Xiong, Caiming, Heinecke, Shelby, Wang, Huan |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models
par: Liu, Zhiwei, et autres
Publié: (2025)
par: Liu, Zhiwei, et autres
Publié: (2025)
Test-Time Adaptation for LLM Agents via Environment Interaction
par: Chen, Arthur, et autres
Publié: (2025)
par: Chen, Arthur, et autres
Publié: (2025)
UserBench: An Interactive Gym Environment for User-Centric Agents
par: Qian, Cheng, et autres
Publié: (2025)
par: Qian, Cheng, et autres
Publié: (2025)
Language Models are Hidden Reasoners: Unlocking Latent Reasoning Capabilities via Self-Rewarding
par: Chen, Haolin, et autres
Publié: (2024)
par: Chen, Haolin, et autres
Publié: (2024)
Promptomatix: An Automatic Prompt Optimization Framework for Large Language Models
par: Murthy, Rithesh, et autres
Publié: (2025)
par: Murthy, Rithesh, et autres
Publié: (2025)
ToolScan: A Benchmark for Characterizing Errors in Tool-Use LLMs
par: Kokane, Shirley, et autres
Publié: (2024)
par: Kokane, Shirley, et autres
Publié: (2024)
AgentLite: A Lightweight Library for Building and Advancing Task-Oriented LLM Agent System
par: Liu, Zhiwei, et autres
Publié: (2024)
par: Liu, Zhiwei, et autres
Publié: (2024)
Entropy-Based Block Pruning for Efficient Large Language Models
par: Yang, Liangwei, et autres
Publié: (2025)
par: Yang, Liangwei, et autres
Publié: (2025)
Personalized Multi-task Training for Recommender System
par: Yang, Liangwei, et autres
Publié: (2024)
par: Yang, Liangwei, et autres
Publié: (2024)
PRACT: Optimizing Principled Reasoning and Acting of LLM Agent
par: Liu, Zhiwei, et autres
Publié: (2024)
par: Liu, Zhiwei, et autres
Publié: (2024)
PersonaBench: Evaluating AI Models on Understanding Personal Information through Accessing (Synthetic) Private User Data
par: Tan, Juntao, et autres
Publié: (2025)
par: Tan, Juntao, et autres
Publié: (2025)
DialogStudio: Towards Richest and Most Diverse Unified Dataset Collection for Conversational AI
par: Zhang, Jianguo, et autres
Publié: (2023)
par: Zhang, Jianguo, et autres
Publié: (2023)
UserRL: Training Interactive User-Centric Agent via Reinforcement Learning
par: Qian, Cheng, et autres
Publié: (2025)
par: Qian, Cheng, et autres
Publié: (2025)
xRouter: Training Cost-Aware LLMs Orchestration System via Reinforcement Learning
par: Qian, Cheng, et autres
Publié: (2025)
par: Qian, Cheng, et autres
Publié: (2025)
LoCoBench: A Benchmark for Long-Context Large Language Models in Complex Software Engineering
par: Qiu, Jielin, et autres
Publié: (2025)
par: Qiu, Jielin, et autres
Publié: (2025)
Prompt Optimization Via Diffusion Language Models
par: Wang, Shiyu, et autres
Publié: (2026)
par: Wang, Shiyu, et autres
Publié: (2026)
APIGen-MT: Agentic Pipeline for Multi-Turn Data Generation via Simulated Agent-Human Interplay
par: Prabhakar, Akshara, et autres
Publié: (2025)
par: Prabhakar, Akshara, et autres
Publié: (2025)
Position: Vector Prompt Interfaces Should Be Exposed to Enable Customization of Large Language Models
par: Yang, Liangwei, et autres
Publié: (2026)
par: Yang, Liangwei, et autres
Publié: (2026)
Enterprise Sales Copilot: Enabling Real-Time AI Support with Automatic Information Retrieval in Live Sales Calls
par: Qiu, Jielin, et autres
Publié: (2026)
par: Qiu, Jielin, et autres
Publié: (2026)
ActionStudio: A Lightweight Framework for Data and Training of Large Action Models
par: Zhang, Jianguo, et autres
Publié: (2025)
par: Zhang, Jianguo, et autres
Publié: (2025)
CoDA: Coding LM via Diffusion Adaptation
par: Chen, Haolin, et autres
Publié: (2025)
par: Chen, Haolin, et autres
Publié: (2025)
APIGen: Automated Pipeline for Generating Verifiable and Diverse Function-Calling Datasets
par: Liu, Zuxin, et autres
Publié: (2024)
par: Liu, Zuxin, et autres
Publié: (2024)
Webscale-RL: Automated Data Pipeline for Scaling RL Data to Pretraining Levels
par: Cen, Zhepeng, et autres
Publié: (2025)
par: Cen, Zhepeng, et autres
Publié: (2025)
MobileAIBench: Benchmarking LLMs and LMMs for On-Device Use Cases
par: Murthy, Rithesh, et autres
Publié: (2024)
par: Murthy, Rithesh, et autres
Publié: (2024)
AgentOhana: Design Unified Data and Training Pipeline for Effective Agent Learning
par: Zhang, Jianguo, et autres
Publié: (2024)
par: Zhang, Jianguo, et autres
Publié: (2024)
AudioCapBench: Quick Evaluation on Audio Captioning across Sound, Music, and Speech
par: Qiu, Jielin, et autres
Publié: (2026)
par: Qiu, Jielin, et autres
Publié: (2026)
VoiceAgentRAG: Solving the RAG Latency Bottleneck in Real-Time Voice Agents Using Dual-Agent Architectures
par: Qiu, Jielin, et autres
Publié: (2026)
par: Qiu, Jielin, et autres
Publié: (2026)
LATTE: Learning to Think with Vision Specialists
par: Ma, Zixian, et autres
Publié: (2024)
par: Ma, Zixian, et autres
Publié: (2024)
Causal Layering via Conditional Entropy
par: Feigenbaum, Itai, et autres
Publié: (2024)
par: Feigenbaum, Itai, et autres
Publié: (2024)
Editing Arbitrary Propositions in LLMs without Subject Labels
par: Feigenbaum, Itai, et autres
Publié: (2024)
par: Feigenbaum, Itai, et autres
Publié: (2024)
LoCoBench-Agent: An Interactive Benchmark for LLM Agents in Long-Context Software Engineering
par: Qiu, Jielin, et autres
Publié: (2025)
par: Qiu, Jielin, et autres
Publié: (2025)
Whisper-AuT: Domain-Adapted Audio Encoder for Efficient Audio-LLM Training
par: Qiu, Jielin, et autres
Publié: (2026)
par: Qiu, Jielin, et autres
Publié: (2026)
Building Enterprise Realtime Voice Agents from Scratch: A Technical Tutorial
par: Qiu, Jielin, et autres
Publié: (2026)
par: Qiu, Jielin, et autres
Publié: (2026)
GeoGNN: Quantifying and Mitigating Semantic Drift in Text-Attributed Graphs
par: Yang, Liangwei, et autres
Publié: (2025)
par: Yang, Liangwei, et autres
Publié: (2025)
Asynchronous Tool Usage for Real-Time Agents
par: Ginart, Antonio A., et autres
Publié: (2024)
par: Ginart, Antonio A., et autres
Publié: (2024)
Enabling High Data Throughput Reinforcement Learning on GPUs: A Domain Agnostic Framework for Data-Driven Scientific Research
par: Lan, Tian, et autres
Publié: (2024)
par: Lan, Tian, et autres
Publié: (2024)
RealUserSim: Bridging the Reality Gap in Agent Benchmarking via Grounded User Simulation
par: Zhu, Ming, et autres
Publié: (2026)
par: Zhu, Ming, et autres
Publié: (2026)
Diversity Empowers Intelligence: Integrating Expertise of Software Engineering Agents
par: Zhang, Kexun, et autres
Publié: (2024)
par: Zhang, Kexun, et autres
Publié: (2024)
LAM SIMULATOR: Advancing Data Generation for Large Action Model Training via Online Exploration and Trajectory Feedback
par: Hoang, Thai, et autres
Publié: (2025)
par: Hoang, Thai, et autres
Publié: (2025)
Reasoning Curriculum: Bootstrapping Broad LLM Reasoning from Math
par: Pang, Bo, et autres
Publié: (2025)
par: Pang, Bo, et autres
Publié: (2025)
Documents similaires
-
MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models
par: Liu, Zhiwei, et autres
Publié: (2025) -
Test-Time Adaptation for LLM Agents via Environment Interaction
par: Chen, Arthur, et autres
Publié: (2025) -
UserBench: An Interactive Gym Environment for User-Centric Agents
par: Qian, Cheng, et autres
Publié: (2025) -
Language Models are Hidden Reasoners: Unlocking Latent Reasoning Capabilities via Self-Rewarding
par: Chen, Haolin, et autres
Publié: (2024) -
Promptomatix: An Automatic Prompt Optimization Framework for Large Language Models
par: Murthy, Rithesh, et autres
Publié: (2025)