KVCOMM: Online Cross-context KV-cache Communication for Efficient LLM-based Multi-agent Systems
Fuente:
arXiv
Saved in:
| Main Authors: | Ye, Hancheng, Gao, Zhengqi, Ma, Mingyuan, Wang, Qinsi, Fu, Yuzhe, Chung, Ming-Yu, Lin, Yueqian, Liu, Zhijian, Zhang, Jianyi, Zhuo, Danyang, Chen, Yiran |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
MARS: Efficient, Adaptive Co-Scheduling for Heterogeneous Agentic Systems
by: Wang, Yifei, et al.
Published: (2026)
by: Wang, Yifei, et al.
Published: (2026)
CoreMatching: A Co-adaptive Sparse Inference Framework with Token and Neuron Pruning for Comprehensive Acceleration of Vision-Language Models
by: Wang, Qinsi, et al.
Published: (2025)
by: Wang, Qinsi, et al.
Published: (2025)
Angles Don't Lie: Unlocking Training-Efficient RL Through the Model's Own Signals
by: Wang, Qinsi, et al.
Published: (2025)
by: Wang, Qinsi, et al.
Published: (2025)
DroidSpeak: KV Cache Sharing for Cross-LLM Communication and Multi-LLM Serving
by: Liu, Yuhan, et al.
Published: (2024)
by: Liu, Yuhan, et al.
Published: (2024)
KVComm: Enabling Efficient LLM Communication through Selective KV Sharing
by: Shi, Xiangyu, et al.
Published: (2025)
by: Shi, Xiangyu, et al.
Published: (2025)
Multi-agent In-context Coordination via Decentralized Memory Retrieval
by: Jiang, Tao, et al.
Published: (2025)
by: Jiang, Tao, et al.
Published: (2025)
When KV Cache Reuse Fails in Multi-Agent Systems: Cross-Candidate Interaction is Crucial for LLM Judges
by: Liang, Sichu, et al.
Published: (2026)
by: Liang, Sichu, et al.
Published: (2026)
HippoMM: Hippocampal-inspired Multimodal Memory for Long Audiovisual Event Understanding
by: Lin, Yueqian, et al.
Published: (2025)
by: Lin, Yueqian, et al.
Published: (2025)
CASPIAN: Online Detection and Attribution of Cascade Attacks in LLM Multi-Agent Systems via Cross-Channel Causal Monitoring
by: Venkatesh, Kavana, et al.
Published: (2026)
by: Venkatesh, Kavana, et al.
Published: (2026)
FlashFPS: Efficient Farthest Point Sampling for Large-Scale Point Clouds via Pruning and Caching
by: Fu, Yuzhe, et al.
Published: (2026)
by: Fu, Yuzhe, et al.
Published: (2026)
Graph-theoretic Agreement Framework for Multi-agent LLM Systems
by: Javed, Muhammad Umar
Published: (2026)
by: Javed, Muhammad Umar
Published: (2026)
Self-Refining Topology Optimization via an LLM-Based Multi-Agent Framework
by: Park, Hyunjee, et al.
Published: (2026)
by: Park, Hyunjee, et al.
Published: (2026)
Q-KVComm: Efficient Multi-Agent Communication Via Adaptive KV Cache Compression
by: Kriuk, Boris, et al.
Published: (2025)
by: Kriuk, Boris, et al.
Published: (2025)
MCP4EDA: LLM-Powered Model Context Protocol RTL-to-GDSII Automation with Backend Aware Synthesis Optimization
by: Wang, Yiting, et al.
Published: (2025)
by: Wang, Yiting, et al.
Published: (2025)
PP-MARL: Efficient Privacy-Preserving Multi-Agent Reinforcement Learning for Cooperative Intelligence in Communications
by: Yuan, Tingting, et al.
Published: (2022)
by: Yuan, Tingting, et al.
Published: (2022)
Robust Multi-agent Communication Based on Decentralization-Oriented Adversarial Training
by: Ma, Xuyan, et al.
Published: (2025)
by: Ma, Xuyan, et al.
Published: (2025)
Language Grounded Multi-agent Reinforcement Learning with Human-interpretable Communication
by: Li, Huao, et al.
Published: (2024)
by: Li, Huao, et al.
Published: (2024)
IFS: Information Flow Structure for Multi-agent Ad Hoc System
by: Fu, Yanqing, et al.
Published: (2025)
by: Fu, Yanqing, et al.
Published: (2025)
Efficient Leave-one-out Approximation in LLM Multi-agent Debate Based on Introspection
by: Cui, Yue, et al.
Published: (2025)
by: Cui, Yue, et al.
Published: (2025)
CPIG: Leveraging Consistency Policy with Intention Guidance for Multi-agent Exploration
by: Fu, Yuqian, et al.
Published: (2024)
by: Fu, Yuqian, et al.
Published: (2024)
CoreInfer: Accelerating Large Language Model Inference with Semantics-Inspired Adaptive Sparse Activation
by: Wang, Qinsi, et al.
Published: (2024)
by: Wang, Qinsi, et al.
Published: (2024)
LLM Harmony: Multi-Agent Communication for Problem Solving
by: Rasal, Sumedh
Published: (2024)
by: Rasal, Sumedh
Published: (2024)
ReSo: A Reward-driven Self-organizing LLM-based Multi-Agent System for Reasoning Tasks
by: Zhou, Heng, et al.
Published: (2025)
by: Zhou, Heng, et al.
Published: (2025)
Context-aware Communication for Multi-agent Reinforcement Learning
by: Li, Xinran, et al.
Published: (2023)
by: Li, Xinran, et al.
Published: (2023)
HiveMind: Contribution-Guided Online Prompt Optimization of LLM Multi-Agent Systems
by: Xia, Yihan, et al.
Published: (2025)
by: Xia, Yihan, et al.
Published: (2025)
Strategic Communication and Language Bias in Multi-Agent LLM Coordination
by: Buscemi, Alessio, et al.
Published: (2025)
by: Buscemi, Alessio, et al.
Published: (2025)
A Multi-agent Reinforcement Learning Study of Evolution of Communication and Teaching under Libertarian and Utilitarian Governing Systems
by: Dizaji, Aslan S.
Published: (2024)
by: Dizaji, Aslan S.
Published: (2024)
Distributed online constrained convex optimization with event-triggered communication
by: Zhang, Kunpeng, et al.
Published: (2023)
by: Zhang, Kunpeng, et al.
Published: (2023)
CORRECT: COndensed eRror RECognition via knowledge Transfer in multi-agent systems
by: Yu, Yifan, et al.
Published: (2025)
by: Yu, Yifan, et al.
Published: (2025)
VIL2C: Value-of-Information Aware Low-Latency Communication for Multi-Agent Reinforcement Learning
by: Zhang, Qian, et al.
Published: (2025)
by: Zhang, Qian, et al.
Published: (2025)
Consensus Tracking Control of Multi-agent Systems with A Time-varying Reference State under Binary-valued Communication
by: Wang, Ting, et al.
Published: (2025)
by: Wang, Ting, et al.
Published: (2025)
PanelTR: Zero-Shot Table Reasoning Framework Through Multi-Agent Scientific Discussion
by: Ma, Yiran Rex
Published: (2025)
by: Ma, Yiran Rex
Published: (2025)
Robust Multi-agent Communication via Multi-view Message Certification
by: Yuan, Lei, et al.
Published: (2023)
by: Yuan, Lei, et al.
Published: (2023)
Verco: Learning Coordinated Verbal Communication for Multi-agent Reinforcement Learning
by: Li, Dapeng, et al.
Published: (2024)
by: Li, Dapeng, et al.
Published: (2024)
Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems
by: Zhang, Shaokun, et al.
Published: (2025)
by: Zhang, Shaokun, et al.
Published: (2025)
Adaptive Episode Length Adjustment for Multi-agent Reinforcement Learning
by: Yoo, Byunghyun, et al.
Published: (2025)
by: Yoo, Byunghyun, et al.
Published: (2025)
Collaborating Action by Action: A Multi-agent LLM Framework for Embodied Reasoning
by: White, Isadora, et al.
Published: (2025)
by: White, Isadora, et al.
Published: (2025)
Online Relational Inference for Evolving Multi-agent Interacting Systems
by: Kang, Beomseok, et al.
Published: (2024)
by: Kang, Beomseok, et al.
Published: (2024)
Learning Communication Skills in Multi-task Multi-agent Deep Reinforcement Learning
by: Zhu, Changxi, et al.
Published: (2025)
by: Zhu, Changxi, et al.
Published: (2025)
QKVShare: Quantized KV-Cache Handoff for Multi-Agent On-Device LLMs
by: Honavar, Pratik, et al.
Published: (2026)
by: Honavar, Pratik, et al.
Published: (2026)
Similar Items
-
MARS: Efficient, Adaptive Co-Scheduling for Heterogeneous Agentic Systems
by: Wang, Yifei, et al.
Published: (2026) -
CoreMatching: A Co-adaptive Sparse Inference Framework with Token and Neuron Pruning for Comprehensive Acceleration of Vision-Language Models
by: Wang, Qinsi, et al.
Published: (2025) -
Angles Don't Lie: Unlocking Training-Efficient RL Through the Model's Own Signals
by: Wang, Qinsi, et al.
Published: (2025) -
DroidSpeak: KV Cache Sharing for Cross-LLM Communication and Multi-LLM Serving
by: Liu, Yuhan, et al.
Published: (2024) -
KVComm: Enabling Efficient LLM Communication through Selective KV Sharing
by: Shi, Xiangyu, et al.
Published: (2025)