Reuse, Don't Recompute: Efficient Large Reasoning Model Inference via Memory Orchestration
Fuente:
arXiv
Salvato in:
| Autori principali: | Patel, Daivik, Patel, Shrenik |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ENGRAM: Effective, Lightweight Memory Orchestration for Conversational Agents
di: Patel, Daivik, et al.
Pubblicazione: (2025)
di: Patel, Daivik, et al.
Pubblicazione: (2025)
CacheFlow: Compressive Streaming Memory for Efficient Long-Form Video Understanding
di: Patel, Shrenik, et al.
Pubblicazione: (2025)
di: Patel, Shrenik, et al.
Pubblicazione: (2025)
DoubleTake: Contrastive Reasoning for Faithful Decision-Making in Medical Imaging
di: Patel, Daivik, et al.
Pubblicazione: (2026)
di: Patel, Daivik, et al.
Pubblicazione: (2026)
Towards Generalized Routing: Model and Agent Orchestration for Adaptive and Efficient Inference
di: Guo, Xiyu, et al.
Pubblicazione: (2025)
di: Guo, Xiyu, et al.
Pubblicazione: (2025)
MemFlow: Intent-Driven Memory Orchestration for Small Language Model Agents
di: Chen, Jiayi, et al.
Pubblicazione: (2026)
di: Chen, Jiayi, et al.
Pubblicazione: (2026)
Don't Trust Stubborn Neighbors: A Security Framework for Agentic Networks
di: Abedini, Samira, et al.
Pubblicazione: (2026)
di: Abedini, Samira, et al.
Pubblicazione: (2026)
Large Language Model-Driven Cross-Domain Orchestration Using Multi-Agent Workflow
di: Xu, Xiaonan, et al.
Pubblicazione: (2024)
di: Xu, Xiaonan, et al.
Pubblicazione: (2024)
Second Order State Hallucinations for Adversarial Attack Mitigation in Formation Control of Multi-Agent Systems
di: Patel, Laksh, et al.
Pubblicazione: (2025)
di: Patel, Laksh, et al.
Pubblicazione: (2025)
Recomputing Solutions to Perturbed Multi-Commodity Pickup and Delivery Vehicle Routing Problems using Monte Carlo Tree Search
di: Goutham, Mithun, et al.
Pubblicazione: (2023)
di: Goutham, Mithun, et al.
Pubblicazione: (2023)
MCP-Cosmos: World Model-Augmented Agents for Complex Task Execution in MCP Environments
di: Ganapavarapu, Giridhar, et al.
Pubblicazione: (2026)
di: Ganapavarapu, Giridhar, et al.
Pubblicazione: (2026)
HASHIRU: Hierarchical Agent System for Hybrid Intelligent Resource Utilization
di: Pai, Kunal, et al.
Pubblicazione: (2025)
di: Pai, Kunal, et al.
Pubblicazione: (2025)
Reasoning-Aware Prompt Orchestration: A Foundation Model for Multi-Agent Language Model Coordination
di: Dhrif, Hassen
Pubblicazione: (2025)
di: Dhrif, Hassen
Pubblicazione: (2025)
A Plan Reuse Mechanism for LLM-Driven Agent
di: Li, Guopeng, et al.
Pubblicazione: (2025)
di: Li, Guopeng, et al.
Pubblicazione: (2025)
Orchestrator: Active Inference for Multi-Agent Systems in Long-Horizon Tasks
di: Beckenbauer, Lukas, et al.
Pubblicazione: (2025)
di: Beckenbauer, Lukas, et al.
Pubblicazione: (2025)
Dynamic Attentional Context Scoping: Agent-Triggered Focus Sessions for Isolated Per-Agent Steering in Multi-Agent LLM Orchestration
di: Patel, Nickson
Pubblicazione: (2026)
di: Patel, Nickson
Pubblicazione: (2026)
CXRAgent: Director-Orchestrated Multi-Stage Reasoning for Chest X-Ray Interpretation
di: Lou, Jinhui, et al.
Pubblicazione: (2025)
di: Lou, Jinhui, et al.
Pubblicazione: (2025)
PyraVid: Hierarchical Multimodal Memory for Long-Horizon Video Reasoning
di: Yan, Sikuan, et al.
Pubblicazione: (2026)
di: Yan, Sikuan, et al.
Pubblicazione: (2026)
Memory-R1: Enhancing Large Language Model Agents to Manage and Utilize Memories via Reinforcement Learning
di: Yan, Sikuan, et al.
Pubblicazione: (2025)
di: Yan, Sikuan, et al.
Pubblicazione: (2025)
From Pixels to Cooperation Multi Agent Reinforcement Learning based on Multimodal World Models
di: Akin, Sureyya, et al.
Pubblicazione: (2025)
di: Akin, Sureyya, et al.
Pubblicazione: (2025)
Adaptive Orchestration: Scalable Self-Evolving Multi-Agent Systems
di: Sampath, Sathish, et al.
Pubblicazione: (2026)
di: Sampath, Sathish, et al.
Pubblicazione: (2026)
Navigating Complexity: Orchestrated Problem Solving with Multi-Agent LLMs
di: Rasal, Sumedh, et al.
Pubblicazione: (2024)
di: Rasal, Sumedh, et al.
Pubblicazione: (2024)
Hierarchical Multi-Agent Reinforcement Learning-based Coordinated Spatial Reuse for Next Generation WLANs
di: Yu, Jiaming, et al.
Pubblicazione: (2025)
di: Yu, Jiaming, et al.
Pubblicazione: (2025)
Don't Overthink It: Inter-Rollout Action Agreement as a Free Adaptive-Compute Signal for LLM Agents
di: Sethi, Khushal
Pubblicazione: (2026)
di: Sethi, Khushal
Pubblicazione: (2026)
A Multi-LLM Orchestration Engine for Personalized, Context-Rich Assistance
di: Rasal, Sumedh
Pubblicazione: (2024)
di: Rasal, Sumedh
Pubblicazione: (2024)
Multi-Agent Coordination Adaptation via Structure-Guided Orchestration
di: Li, Haoran, et al.
Pubblicazione: (2026)
di: Li, Haoran, et al.
Pubblicazione: (2026)
Credit Network Modeling and Analysis via Large Language Models
di: Sun, Enbo, et al.
Pubblicazione: (2025)
di: Sun, Enbo, et al.
Pubblicazione: (2025)
NAAMSE: Framework for Evolutionary Security Evaluation of Agents
di: Pai, Kunal, et al.
Pubblicazione: (2026)
di: Pai, Kunal, et al.
Pubblicazione: (2026)
ToolOrchestra: Elevating Intelligence via Efficient Model and Tool Orchestration
di: Su, Hongjin, et al.
Pubblicazione: (2025)
di: Su, Hongjin, et al.
Pubblicazione: (2025)
Using Distributed Reinforcement Learning for Resource Orchestration in a Network Slicing Scenario
di: Mason, Federico, et al.
Pubblicazione: (2021)
di: Mason, Federico, et al.
Pubblicazione: (2021)
Towards Efficient Collaboration via Graph Modeling in Reinforcement Learning
di: Fan, Wenzhe, et al.
Pubblicazione: (2024)
di: Fan, Wenzhe, et al.
Pubblicazione: (2024)
Enhancing Traffic Signal Control through Model-based Reinforcement Learning and Policy Reuse
di: Li, Yihong, et al.
Pubblicazione: (2025)
di: Li, Yihong, et al.
Pubblicazione: (2025)
Self-Evolving Multi-Agent Systems via Decentralized Memory
di: Hao, Guangya, et al.
Pubblicazione: (2026)
di: Hao, Guangya, et al.
Pubblicazione: (2026)
Don't Retrieve, Navigate: Distilling Enterprise Knowledge into Navigable Agent Skills for QA and RAG
di: Sun, Yiqun, et al.
Pubblicazione: (2026)
di: Sun, Yiqun, et al.
Pubblicazione: (2026)
M2I2: Learning Efficient Multi-Agent Communication via Masked State Modeling and Intention Inference
di: Sun, Chuxiong, et al.
Pubblicazione: (2024)
di: Sun, Chuxiong, et al.
Pubblicazione: (2024)
Decentralizing AI Memory: SHIMI, a Semantic Hierarchical Memory Index for Scalable Agent Reasoning
di: Helmi, Tooraj
Pubblicazione: (2025)
di: Helmi, Tooraj
Pubblicazione: (2025)
When Skills Don't Help: A Negative Result on Procedural Knowledge for Tool-Grounded Agents in Offensive Cybersecurity
di: Chacko, Samuel Jacob, et al.
Pubblicazione: (2026)
di: Chacko, Samuel Jacob, et al.
Pubblicazione: (2026)
Don't Guess, Escalate: Towards Explainable Uncertainty-Calibrated AI Forensic Agents
di: Boato, Giulia, et al.
Pubblicazione: (2025)
di: Boato, Giulia, et al.
Pubblicazione: (2025)
Enwar 3.0: An Agentic Multi-Modal LLM Orchestrator for Situation-Aware Beamforming, Blockage Prediction, and Handover Management
di: Nazar, Ahmad M., et al.
Pubblicazione: (2026)
di: Nazar, Ahmad M., et al.
Pubblicazione: (2026)
Multi-Agent Collaboration via Evolving Orchestration
di: Dang, Yufan, et al.
Pubblicazione: (2025)
di: Dang, Yufan, et al.
Pubblicazione: (2025)
Murakkab: Resource-Efficient Agentic Workflow Orchestration in Cloud Platforms
di: Chaudhry, Gohar Irfan, et al.
Pubblicazione: (2025)
di: Chaudhry, Gohar Irfan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
ENGRAM: Effective, Lightweight Memory Orchestration for Conversational Agents
di: Patel, Daivik, et al.
Pubblicazione: (2025) -
CacheFlow: Compressive Streaming Memory for Efficient Long-Form Video Understanding
di: Patel, Shrenik, et al.
Pubblicazione: (2025) -
DoubleTake: Contrastive Reasoning for Faithful Decision-Making in Medical Imaging
di: Patel, Daivik, et al.
Pubblicazione: (2026) -
Towards Generalized Routing: Model and Agent Orchestration for Adaptive and Efficient Inference
di: Guo, Xiyu, et al.
Pubblicazione: (2025) -
MemFlow: Intent-Driven Memory Orchestration for Small Language Model Agents
di: Chen, Jiayi, et al.
Pubblicazione: (2026)