TaskCraft: Automated Generation of Agentic Tasks
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Shi, Dingfeng, Cao, Jingyi, Chen, Qianben, Sun, Weichen, Li, Weizhen, Lu, Hongxuan, Dong, Fangchen, Qin, Tianrui, Zhu, King, Liu, Minghao, Yang, Jian, Zhang, Ge, Liu, Jiaheng, Zhang, Changwang, Wang, Jun, Jiang, Yuchen Eleanor, Zhou, Wangchunshu |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Flash-Searcher: Fast and Effective Web Agents via DAG-Based Parallel Execution
par: Qin, Tianrui, et autres
Publié: (2025)
par: Qin, Tianrui, et autres
Publié: (2025)
A$^2$FM: An Adaptive Agent Foundation Model for Tool-Aware Hybrid Reasoning
par: Chen, Qianben, et autres
Publié: (2025)
par: Chen, Qianben, et autres
Publié: (2025)
Chain-of-Agents: End-to-End Agent Foundation Models via Multi-Agent Distillation and Agentic RL
par: Li, Weizhen, et autres
Publié: (2025)
par: Li, Weizhen, et autres
Publié: (2025)
Search More, Think Less: Rethinking Long-Horizon Agentic Search for Efficiency and Generalization
par: Chen, Qianben, et autres
Publié: (2026)
par: Chen, Qianben, et autres
Publié: (2026)
ACADREASON: Exploring the Limits of Reasoning Models with Academic Research Problems
par: Gui, Xin, et autres
Publié: (2025)
par: Gui, Xin, et autres
Publié: (2025)
Scaling Test-time Compute for LLM Agents
par: Zhu, King, et autres
Publié: (2025)
par: Zhu, King, et autres
Publié: (2025)
O-Researcher: An Open Ended Deep Research Model via Multi-Agent Distillation and Agentic RL
par: Yao, Yi, et autres
Publié: (2026)
par: Yao, Yi, et autres
Publié: (2026)
Efficient Agents: Building Effective Agents While Reducing Cost
par: Wang, Ningning, et autres
Publié: (2025)
par: Wang, Ningning, et autres
Publié: (2025)
How Far Are We from Genuinely Useful Deep Research Agents?
par: Zhang, Dingling, et autres
Publié: (2025)
par: Zhang, Dingling, et autres
Publié: (2025)
OAgents: An Empirical Study of Building Effective Agents
par: Zhu, He, et autres
Publié: (2025)
par: Zhu, He, et autres
Publié: (2025)
KOR-Bench: Benchmarking Language Models on Knowledge-Orthogonal Reasoning Tasks
par: Ma, Kaijing, et autres
Publié: (2024)
par: Ma, Kaijing, et autres
Publié: (2024)
LeoTask: a fast, flexible and reliable framework for computational research
par: Zhang, Changwang, et autres
Publié: (2015)
par: Zhang, Changwang, et autres
Publié: (2015)
TSEmbed: Unlocking Task Scaling in Universal Multimodal Embeddings
par: Wu, Yebo, et autres
Publié: (2026)
par: Wu, Yebo, et autres
Publié: (2026)
SEAL: Can Saturated Benchmarks Be Revived by LLM-as-a-Meta-Judge?
par: Chen, Jiamin, et autres
Publié: (2026)
par: Chen, Jiamin, et autres
Publié: (2026)
Coherence-Aware Task Graph Modeling for Realistic Application
par: Xiong, Guochu, et autres
Publié: (2025)
par: Xiong, Guochu, et autres
Publié: (2025)
ViTaMIn: Learning Contact-Rich Tasks Through Robot-Free Visuo-Tactile Manipulation Interface
par: Liu, Fangchen, et autres
Publié: (2025)
par: Liu, Fangchen, et autres
Publié: (2025)
Agent KB: Leveraging Cross-Domain Experience for Agentic Problem Solving
par: Tang, Xiangru, et autres
Publié: (2025)
par: Tang, Xiangru, et autres
Publié: (2025)
OThink-SRR1: Search, Refine and Reasoning with Reinforced Learning for Large Language Models
par: Liang, Haijian, et autres
Publié: (2026)
par: Liang, Haijian, et autres
Publié: (2026)
O-Mem: Omni Memory System for Personalized, Long Horizon, Self-Evolving Agents
par: Wang, Piaohong, et autres
Publié: (2025)
par: Wang, Piaohong, et autres
Publié: (2025)
GeoFlow: Agentic Workflow Automation for Geospatial Tasks
par: Bhattaram, Amulya, et autres
Publié: (2025)
par: Bhattaram, Amulya, et autres
Publié: (2025)
Component Selection for Craft Assembly Tasks
par: Isume, Vitor Hideyo, et autres
Publié: (2024)
par: Isume, Vitor Hideyo, et autres
Publié: (2024)
Incorporating Large Language Models into Production Systems for Enhanced Task Automation and Flexibility
par: Xia, Yuchen, et autres
Publié: (2024)
par: Xia, Yuchen, et autres
Publié: (2024)
Video2Policy: Scaling up Manipulation Tasks in Simulation through Internet Videos
par: Ye, Weirui, et autres
Publié: (2025)
par: Ye, Weirui, et autres
Publié: (2025)
Towards Personalized Deep Research: Benchmarks and Evaluations
par: Liang, Yuan, et autres
Publié: (2025)
par: Liang, Yuan, et autres
Publié: (2025)
TimeScope: Towards Task-Oriented Temporal Grounding In Long Videos
par: Liu, Xiangrui, et autres
Publié: (2025)
par: Liu, Xiangrui, et autres
Publié: (2025)
On Transferring, Merging, and Splitting Task-Oriented Network Digital Twins
par: Zhang, Zifan, et autres
Publié: (2025)
par: Zhang, Zifan, et autres
Publié: (2025)
ASSISTGUI: Task-Oriented Desktop Graphical User Interface Automation
par: Gao, Difei, et autres
Publié: (2023)
par: Gao, Difei, et autres
Publié: (2023)
From Task to Tutorial: An Automated GUI Framework for Excel Tutorial Document and Video Creation
par: Xie, Yuhang, et autres
Publié: (2025)
par: Xie, Yuhang, et autres
Publié: (2025)
Supplement Generation Training for Enhancing Agentic Task Performance
par: Cho, Young Min, et autres
Publié: (2026)
par: Cho, Young Min, et autres
Publié: (2026)
RAM-NAS: Resource-aware Multiobjective Neural Architecture Search Method for Robot Vision Tasks
par: Mao, Shouren, et autres
Publié: (2025)
par: Mao, Shouren, et autres
Publié: (2025)
Systematic Evaluation of Stencil Configuration, Forcing Scheme, and Resolution Effects in the Stratified Taylor--Green Vortex: A Lattice Boltzmann Study
par: Zhang, Hongxuan
Publié: (2026)
par: Zhang, Hongxuan
Publié: (2026)
AutoKaggle: A Multi-Agent Framework for Autonomous Data Science Competitions
par: Li, Ziming, et autres
Publié: (2024)
par: Li, Ziming, et autres
Publié: (2024)
GlycanML: A Multi-Task and Multi-Structure Benchmark for Glycan Machine Learning
par: Xu, Minghao, et autres
Publié: (2024)
par: Xu, Minghao, et autres
Publié: (2024)
MLE-Smith: Scaling MLE Tasks with Automated Multi-Agent Pipeline
par: Qiang, Rushi, et autres
Publié: (2025)
par: Qiang, Rushi, et autres
Publié: (2025)
AutoDroid: LLM-powered Task Automation in Android
par: Wen, Hao, et autres
Publié: (2023)
par: Wen, Hao, et autres
Publié: (2023)
AFSPP: Agent Framework for Shaping Preference and Personality with Large Language Models
par: He, Zihong, et autres
Publié: (2024)
par: He, Zihong, et autres
Publié: (2024)
EcoGym: Evaluating LLMs for Long-Horizon Plan-and-Execute in Interactive Economies
par: Hu, Xavier, et autres
Publié: (2026)
par: Hu, Xavier, et autres
Publié: (2026)
DIVE: Scaling Diversity in Agentic Task Synthesis for Generalizable Tool Use
par: Chen, Aili, et autres
Publié: (2026)
par: Chen, Aili, et autres
Publié: (2026)
Vibe AIGC: A New Paradigm for Content Generation via Agentic Orchestration
par: Liu, Jiaheng, et autres
Publié: (2026)
par: Liu, Jiaheng, et autres
Publié: (2026)
IFEvalCode: Controlled Code Generation
par: Yang, Jian, et autres
Publié: (2025)
par: Yang, Jian, et autres
Publié: (2025)
Documents similaires
-
Flash-Searcher: Fast and Effective Web Agents via DAG-Based Parallel Execution
par: Qin, Tianrui, et autres
Publié: (2025) -
A$^2$FM: An Adaptive Agent Foundation Model for Tool-Aware Hybrid Reasoning
par: Chen, Qianben, et autres
Publié: (2025) -
Chain-of-Agents: End-to-End Agent Foundation Models via Multi-Agent Distillation and Agentic RL
par: Li, Weizhen, et autres
Publié: (2025) -
Search More, Think Less: Rethinking Long-Horizon Agentic Search for Efficiency and Generalization
par: Chen, Qianben, et autres
Publié: (2026) -
ACADREASON: Exploring the Limits of Reasoning Models with Academic Research Problems
par: Gui, Xin, et autres
Publié: (2025)