Understanding and Optimizing Agentic Workflows via Shapley value
Fuente:
arXiv
Salvato in:
| Autori principali: | Yang, Yingxuan, Huang, Bo, Qi, Siyuan, Feng, Chao, Hu, Haoyi, Zhu, Yuxuan, Hu, Jinbo, Zhao, Haoran, He, Ziyi, Liu, Xiao, Wen, Muning, Wang, Zongyu, Qiu, Lin, Cao, Xuezhi, Cai, Xunliang, Yu, Yong, Zhang, Weinan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
A Survey of AI Agent Protocols
di: Yang, Yingxuan, et al.
Pubblicazione: (2025)
di: Yang, Yingxuan, et al.
Pubblicazione: (2025)
DynaTree: Dynamic Agentic Retrieval Tree for Time-Sensitive News Retrieval
di: Qi, Siyuan, et al.
Pubblicazione: (2026)
di: Qi, Siyuan, et al.
Pubblicazione: (2026)
Why Not Act on What You Know? Unleashing Safety Potential of LLMs via Self-Aware Guard Enhancement
di: Ding, Peng, et al.
Pubblicazione: (2025)
di: Ding, Peng, et al.
Pubblicazione: (2025)
Understanding Agent Scaling in LLM-Based Multi-Agent Systems via Diversity
di: Yang, Yingxuan, et al.
Pubblicazione: (2026)
di: Yang, Yingxuan, et al.
Pubblicazione: (2026)
CoreCodeBench: Decoupling Code Intelligence via Fine-Grained Repository-Level Tasks
di: Fu, Lingyue, et al.
Pubblicazione: (2025)
di: Fu, Lingyue, et al.
Pubblicazione: (2025)
Position: Agentic AI System Is a Foreseeable Pathway to AGI
di: Liao, Junwei, et al.
Pubblicazione: (2026)
di: Liao, Junwei, et al.
Pubblicazione: (2026)
Friend or Foe: How LLMs' Safety Mind Gets Fooled by Intent Shift Attack
di: Ding, Peng, et al.
Pubblicazione: (2025)
di: Ding, Peng, et al.
Pubblicazione: (2025)
Automatically Benchmarking LLM Code Agents through Agent-Driven Annotation and Evaluation
di: Fu, Lingyue, et al.
Pubblicazione: (2025)
di: Fu, Lingyue, et al.
Pubblicazione: (2025)
P3: A Policy-Driven, Pace-Adaptive, and Diversity-Promoted Framework for data pruning in LLM Training
di: Yang, Yingxuan, et al.
Pubblicazione: (2024)
di: Yang, Yingxuan, et al.
Pubblicazione: (2024)
TRAD: Enhancing LLM Agents with Step-Wise Thought Retrieval and Aligned Decision
di: Zhou, Ruiwen, et al.
Pubblicazione: (2024)
di: Zhou, Ruiwen, et al.
Pubblicazione: (2024)
Audio Turing Test: Benchmarking the Human-likeness of Large Language Model-based Text-to-Speech Systems in Chinese
di: Wang, Xihuai, et al.
Pubblicazione: (2025)
di: Wang, Xihuai, et al.
Pubblicazione: (2025)
SWE-Cycle: Benchmarking Code Agents across the Complete Issue Resolution Cycle
di: Guan, Hao, et al.
Pubblicazione: (2026)
di: Guan, Hao, et al.
Pubblicazione: (2026)
AMemGym: Interactive Memory Benchmarking for Assistants in Long-Horizon Conversations
di: Jiayang, Cheng, et al.
Pubblicazione: (2026)
di: Jiayang, Cheng, et al.
Pubblicazione: (2026)
CATArena: Evaluating Evolutionary Capabilities of Code Agents via Iterative Tournaments
di: Fu, Lingyue, et al.
Pubblicazione: (2025)
di: Fu, Lingyue, et al.
Pubblicazione: (2025)
MARFT: Multi-Agent Reinforcement Fine-Tuning
di: Liao, Junwei, et al.
Pubblicazione: (2025)
di: Liao, Junwei, et al.
Pubblicazione: (2025)
LARY: A Latent Action Representation Yielding Benchmark for Generalizable Vision-to-Action Alignment
di: Nie, Dujun, et al.
Pubblicazione: (2026)
di: Nie, Dujun, et al.
Pubblicazione: (2026)
Benchmarking Agentic Workflow Generation
di: Qiao, Shuofei, et al.
Pubblicazione: (2024)
di: Qiao, Shuofei, et al.
Pubblicazione: (2024)
AgentNet: Decentralized Evolutionary Coordination for LLM-based Multi-Agent Systems
di: Yang, Yingxuan, et al.
Pubblicazione: (2025)
di: Yang, Yingxuan, et al.
Pubblicazione: (2025)
Sherlock: Reliable and Efficient Agentic Workflow Execution
di: Ro, Yeonju, et al.
Pubblicazione: (2025)
di: Ro, Yeonju, et al.
Pubblicazione: (2025)
GradPower: Powering Gradients for Faster Language Model Pre-Training
di: Wang, Jinbo, et al.
Pubblicazione: (2025)
di: Wang, Jinbo, et al.
Pubblicazione: (2025)
Murakkab: Resource-Efficient Agentic Workflow Orchestration in Cloud Platforms
di: Chaudhry, Gohar Irfan, et al.
Pubblicazione: (2025)
di: Chaudhry, Gohar Irfan, et al.
Pubblicazione: (2025)
Instance-level Randomization: Toward More Stable LLM Evaluations
di: Li, Yiyang, et al.
Pubblicazione: (2025)
di: Li, Yiyang, et al.
Pubblicazione: (2025)
EnvX: Agentize Everything with Agentic AI
di: Chen, Linyao, et al.
Pubblicazione: (2025)
di: Chen, Linyao, et al.
Pubblicazione: (2025)
Autonomous Goal Detection and Cessation in Reinforcement Learning: A Case Study on Source Term Estimation
di: Shi, Yiwei, et al.
Pubblicazione: (2024)
di: Shi, Yiwei, et al.
Pubblicazione: (2024)
GLOW: Graph-Language Co-Reasoning for Agentic Workflow Performance Prediction
di: Guan, Wei, et al.
Pubblicazione: (2025)
di: Guan, Wei, et al.
Pubblicazione: (2025)
Reinforcing Language Agents via Policy Optimization with Action Decomposition
di: Wen, Muning, et al.
Pubblicazione: (2024)
di: Wen, Muning, et al.
Pubblicazione: (2024)
Agent Exchange: Shaping the Future of AI Agent Economics
di: Yang, Yingxuan, et al.
Pubblicazione: (2025)
di: Yang, Yingxuan, et al.
Pubblicazione: (2025)
UNO-Bench: A Unified Benchmark for Exploring the Compositional Law Between Uni-modal and Omni-modal in Omni Models
di: Chen, Chen, et al.
Pubblicazione: (2025)
di: Chen, Chen, et al.
Pubblicazione: (2025)
SALM: Spatial Audio Language Model with Structured Embeddings for Understanding and Editing
di: Hu, Jinbo, et al.
Pubblicazione: (2025)
di: Hu, Jinbo, et al.
Pubblicazione: (2025)
Leveraging Dual Process Theory in Language Agent Framework for Real-time Simultaneous Human-AI Collaboration
di: Zhang, Shao, et al.
Pubblicazione: (2025)
di: Zhang, Shao, et al.
Pubblicazione: (2025)
Fast Catch-Up, Late Switching: Optimal Batch Size Scheduling via Functional Scaling Laws
di: Wang, Jinbo, et al.
Pubblicazione: (2026)
di: Wang, Jinbo, et al.
Pubblicazione: (2026)
Holos: A Web-Scale LLM-Based Multi-Agent System for the Agentic Web
di: Nie, Xiaohang, et al.
Pubblicazione: (2026)
di: Nie, Xiaohang, et al.
Pubblicazione: (2026)
Agentic Web: Weaving the Next Web with AI Agents
di: Yang, Yingxuan, et al.
Pubblicazione: (2025)
di: Yang, Yingxuan, et al.
Pubblicazione: (2025)
Agentic Workflow for Education: Concepts and Applications
di: Jiang, Yuan-Hao, et al.
Pubblicazione: (2025)
di: Jiang, Yuan-Hao, et al.
Pubblicazione: (2025)
EvoFlow: Evolving Diverse Agentic Workflows On The Fly
di: Zhang, Guibin, et al.
Pubblicazione: (2025)
di: Zhang, Guibin, et al.
Pubblicazione: (2025)
Length Desensitization in Direct Preference Optimization
di: Liu, Wei, et al.
Pubblicazione: (2024)
di: Liu, Wei, et al.
Pubblicazione: (2024)
AgentEscapeBench: Evaluating Out-of-Domain Tool-Grounded Reasoning in LLM Agents
di: Guo, Zhengkang, et al.
Pubblicazione: (2026)
di: Guo, Zhengkang, et al.
Pubblicazione: (2026)
Entropy-Regularized Token-Level Policy Optimization for Language Agent Reinforcement
di: Wen, Muning, et al.
Pubblicazione: (2024)
di: Wen, Muning, et al.
Pubblicazione: (2024)
Helpful Agent Meets Deceptive Judge: Understanding Vulnerabilities in Agentic Workflows
di: Ming, Yifei, et al.
Pubblicazione: (2025)
di: Ming, Yifei, et al.
Pubblicazione: (2025)
LiveFMBench: Unveiling the Power and Limits of Agentic Workflows in Specification Generation
di: Xu, Dong, et al.
Pubblicazione: (2026)
di: Xu, Dong, et al.
Pubblicazione: (2026)
Documenti analoghi
-
A Survey of AI Agent Protocols
di: Yang, Yingxuan, et al.
Pubblicazione: (2025) -
DynaTree: Dynamic Agentic Retrieval Tree for Time-Sensitive News Retrieval
di: Qi, Siyuan, et al.
Pubblicazione: (2026) -
Why Not Act on What You Know? Unleashing Safety Potential of LLMs via Self-Aware Guard Enhancement
di: Ding, Peng, et al.
Pubblicazione: (2025) -
Understanding Agent Scaling in LLM-Based Multi-Agent Systems via Diversity
di: Yang, Yingxuan, et al.
Pubblicazione: (2026) -
CoreCodeBench: Decoupling Code Intelligence via Fine-Grained Repository-Level Tasks
di: Fu, Lingyue, et al.
Pubblicazione: (2025)