Pythia: Exploiting Workflow Predictability for Efficient Agent-Native LLM Serving
Fuente:
arXiv
Salvato in:
| Autori principali: | Yu, Shan, Shu, Junyi, Ni, Yuanjiang, Qian, Kun, Li, Xue, Wang, Yang, Zhang, Jinyuan, Xu, Ziyi, Yang, Shuo, Zhu, Lingjun, Zhai, Ennan, Lu, Qingda, Xing, Jiarong, Lu, Youyou, Jin, Xin, Liu, Xuanzhe, Xu, Harry |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Efficient LLM Serving for Agentic Workflows: A Data Systems Perspective
di: Wadlom, Noppanat, et al.
Pubblicazione: (2026)
di: Wadlom, Noppanat, et al.
Pubblicazione: (2026)
LLM-Enhanced Multi-Agent Reinforcement Learning with Expert Workflow for Real-Time P2P Energy Trading
di: Lou, Chengwei, et al.
Pubblicazione: (2025)
di: Lou, Chengwei, et al.
Pubblicazione: (2025)
MA2RL: Masked Autoencoders for Generalizable Multi-Agent Reinforcement Learning
di: Feng, Jinyuan, et al.
Pubblicazione: (2025)
di: Feng, Jinyuan, et al.
Pubblicazione: (2025)
BAMAS: Structuring Budget-Aware Multi-Agent Systems
di: Yang, Liming, et al.
Pubblicazione: (2025)
di: Yang, Liming, et al.
Pubblicazione: (2025)
RobustFlow: Towards Robust Agentic Workflow Generation
di: Xu, Shengxiang, et al.
Pubblicazione: (2025)
di: Xu, Shengxiang, et al.
Pubblicazione: (2025)
Is Your LLM-Based Multi-Agent a Reliable Real-World Planner? Exploring Fraud Detection in Travel Planning
di: Yao, Junchi, et al.
Pubblicazione: (2025)
di: Yao, Junchi, et al.
Pubblicazione: (2025)
Agentic LLM Workflows for Generating Patient-Friendly Medical Reports
di: Sudarshan, Malavikha, et al.
Pubblicazione: (2024)
di: Sudarshan, Malavikha, et al.
Pubblicazione: (2024)
Large Language Model-Driven Cross-Domain Orchestration Using Multi-Agent Workflow
di: Xu, Xiaonan, et al.
Pubblicazione: (2024)
di: Xu, Xiaonan, et al.
Pubblicazione: (2024)
Camouflage Adversarial Attacks on Multiple Agent Systems
di: Lu, Ziqing, et al.
Pubblicazione: (2024)
di: Lu, Ziqing, et al.
Pubblicazione: (2024)
GNNs as Predictors of Agentic Workflow Performances
di: Zhang, Yuanshuo, et al.
Pubblicazione: (2025)
di: Zhang, Yuanshuo, et al.
Pubblicazione: (2025)
MedDCR: Learning to Design Agentic Workflows for Medical Coding
di: Zheng, Jiyang, et al.
Pubblicazione: (2025)
di: Zheng, Jiyang, et al.
Pubblicazione: (2025)
AgentConductor: Topology Evolution for Multi-Agent Competition-Level Code Generation
di: Wang, Siyu, et al.
Pubblicazione: (2026)
di: Wang, Siyu, et al.
Pubblicazione: (2026)
CataractSurg-80K: Knowledge-Driven Benchmarking for Structured Reasoning in Ophthalmic Surgery Planning
di: Meng, Yang, et al.
Pubblicazione: (2025)
di: Meng, Yang, et al.
Pubblicazione: (2025)
Pancake: Hierarchical Memory System for Multi-Agent LLM Serving
di: Hu, Zhengding, et al.
Pubblicazione: (2026)
di: Hu, Zhengding, et al.
Pubblicazione: (2026)
HAWK: A Hierarchical Workflow Framework for Multi-Agent Collaboration
di: Cheng, Yuyang, et al.
Pubblicazione: (2025)
di: Cheng, Yuyang, et al.
Pubblicazione: (2025)
EncGPT: A Multi-Agent Workflow for Dynamic Encryption Algorithms
di: Li, Donghe, et al.
Pubblicazione: (2025)
di: Li, Donghe, et al.
Pubblicazione: (2025)
ClawMobile: Rethinking Smartphone-Native Agentic Systems
di: Du, Hongchao, et al.
Pubblicazione: (2026)
di: Du, Hongchao, et al.
Pubblicazione: (2026)
ClimateAgents: A Multi-Agent Research Assistant for Social-Climate Dynamics Analysis
di: Shan, Shan
Pubblicazione: (2026)
di: Shan, Shan
Pubblicazione: (2026)
Self-Organizing Agent Network for LLM-based Workflow Automation
di: Xiong, Yiming, et al.
Pubblicazione: (2025)
di: Xiong, Yiming, et al.
Pubblicazione: (2025)
Agent-Based Modelling for Real-World Stock Markets under Behavioral Economic Principles
di: He, Tianlang, et al.
Pubblicazione: (2023)
di: He, Tianlang, et al.
Pubblicazione: (2023)
Dynamics-Based Algorithm-Level Privacy Preservation for Push-Sum Average Consensus
di: Cheng, Huqiang, et al.
Pubblicazione: (2023)
di: Cheng, Huqiang, et al.
Pubblicazione: (2023)
MARINE: Theoretical Optimization and Design for Multi-Agent Recursive IN-context Enhancement
di: Zhang, Hongwei, et al.
Pubblicazione: (2025)
di: Zhang, Hongwei, et al.
Pubblicazione: (2025)
COCO: Cognitive Operating System with Continuous Oversight for Multi-Agent Workflow Reliability
di: Liang, Churong, et al.
Pubblicazione: (2025)
di: Liang, Churong, et al.
Pubblicazione: (2025)
CogSearch: A Cognitive-Aligned Multi-Agent Framework for Proactive Decision Support in E-Commerce Search
di: Zhai, Zhouwei, et al.
Pubblicazione: (2026)
di: Zhai, Zhouwei, et al.
Pubblicazione: (2026)
WMAS: A Multi-Agent System Towards Intelligent and Customized Wireless Networks
di: Peng, Jingchen, et al.
Pubblicazione: (2025)
di: Peng, Jingchen, et al.
Pubblicazione: (2025)
Communication to Completion: Modeling Collaborative Workflows with Intelligent Multi-Agent Communication
di: Lu, Yiming, et al.
Pubblicazione: (2025)
di: Lu, Yiming, et al.
Pubblicazione: (2025)
ThunderAgent: A Simple, Fast and Program-Aware Agentic Inference System
di: Kang, Hao, et al.
Pubblicazione: (2026)
di: Kang, Hao, et al.
Pubblicazione: (2026)
STLGame: Signal Temporal Logic Games in Adversarial Multi-Agent Systems
di: Yang, Shuo, et al.
Pubblicazione: (2024)
di: Yang, Shuo, et al.
Pubblicazione: (2024)
Automotive Engineering-Centric Agentic AI Workflow Framework
di: Son, Tong Duy, et al.
Pubblicazione: (2026)
di: Son, Tong Duy, et al.
Pubblicazione: (2026)
Aegis:An Advanced LLM-Based Multi-Agent for Intelligent Functional Safety Engineering
di: Shi, Lu, et al.
Pubblicazione: (2024)
di: Shi, Lu, et al.
Pubblicazione: (2024)
Multi-Agent Cooperative Learning for Robust Vision-Language Alignment under OOD Concepts
di: Xu, Philip
Pubblicazione: (2026)
di: Xu, Philip
Pubblicazione: (2026)
Optimizing Highway Traffic Flow in Mixed Autonomy: A Multiagent Truncated Rollout Approach
di: Liu, Lu, et al.
Pubblicazione: (2025)
di: Liu, Lu, et al.
Pubblicazione: (2025)
MARLIN: Multi-Agent Reinforcement Learning with Murmuration Intelligence and LLM Guidance for Reservoir Management
di: Fu, Heming, et al.
Pubblicazione: (2025)
di: Fu, Heming, et al.
Pubblicazione: (2025)
Maximum Entropy Heterogeneous-Agent Reinforcement Learning
di: Liu, Jiarong, et al.
Pubblicazione: (2023)
di: Liu, Jiarong, et al.
Pubblicazione: (2023)
UAVGENT: A Language-Guided Distributed Control Framework
di: Zhang, Ziyi, et al.
Pubblicazione: (2026)
di: Zhang, Ziyi, et al.
Pubblicazione: (2026)
$A^2Flow:$ Automating Agentic Workflow Generation via Self-Adaptive Abstraction Operators
di: Zhao, Mingming, et al.
Pubblicazione: (2025)
di: Zhao, Mingming, et al.
Pubblicazione: (2025)
Symphony-Coord: Adaptive Routing for Multi-Agent LLM Systems
di: Guan, Zhaoyang, et al.
Pubblicazione: (2026)
di: Guan, Zhaoyang, et al.
Pubblicazione: (2026)
Beyond the All-in-One Agent: Benchmarking Role-Specialized Multi-Agent Collaboration in Enterprise Workflows
di: Yu, Tao, et al.
Pubblicazione: (2026)
di: Yu, Tao, et al.
Pubblicazione: (2026)
Asynchronous Distributed Bandit Submodular Maximization under Heterogeneous Communication Delays
di: Sharma, Pranjal, et al.
Pubblicazione: (2026)
di: Sharma, Pranjal, et al.
Pubblicazione: (2026)
FinDeepForecast: A Live Multi-Agent System for Benchmarking Deep Research Agents in Financial Forecasting
di: Li, Xiangyu, et al.
Pubblicazione: (2026)
di: Li, Xiangyu, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Efficient LLM Serving for Agentic Workflows: A Data Systems Perspective
di: Wadlom, Noppanat, et al.
Pubblicazione: (2026) -
LLM-Enhanced Multi-Agent Reinforcement Learning with Expert Workflow for Real-Time P2P Energy Trading
di: Lou, Chengwei, et al.
Pubblicazione: (2025) -
MA2RL: Masked Autoencoders for Generalizable Multi-Agent Reinforcement Learning
di: Feng, Jinyuan, et al.
Pubblicazione: (2025) -
BAMAS: Structuring Budget-Aware Multi-Agent Systems
di: Yang, Liming, et al.
Pubblicazione: (2025) -
RobustFlow: Towards Robust Agentic Workflow Generation
di: Xu, Shengxiang, et al.
Pubblicazione: (2025)