VikingMem: A Memory Base Management System for Stateful LLM-based Applications
Fuente:
arXiv
Saved in:
| Main Authors: | Fu, Jiajie, Chen, Junwen, Wang, Mengzhao, He, Aoxiang, Sheng, Maojia, Ke, Xiangyu, Zhu, Yifan, Gao, Yunjun |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Accelerating Graph Indexing for ANNS on Modern CPUs
by: Wang, Mengzhao, et al.
Published: (2025)
by: Wang, Mengzhao, et al.
Published: (2025)
An Interactive Multi-modal Query Answering System with Retrieval-Augmented Large Language Models
by: Wang, Mengzhao, et al.
Published: (2024)
by: Wang, Mengzhao, et al.
Published: (2024)
In-context Clustering-based Entity Resolution with Large Language Models: A Design Space Exploration
by: Fu, Jiajie, et al.
Published: (2025)
by: Fu, Jiajie, et al.
Published: (2025)
Balancing the Blend: An Experimental Analysis of Trade-offs in Hybrid Search
by: Wang, Mengzhao, et al.
Published: (2025)
by: Wang, Mengzhao, et al.
Published: (2025)
GTS: GPU-based Tree Index for Fast Similarity Search
by: Zhu, Yifan, et al.
Published: (2024)
by: Zhu, Yifan, et al.
Published: (2024)
HC-SpMM: Accelerating Sparse Matrix-Matrix Multiplication for Graphs with Hybrid GPU Cores
by: Li, Zhonggen, et al.
Published: (2024)
by: Li, Zhonggen, et al.
Published: (2024)
Efficient Graph Embedding at Scale: Optimizing CPU-GPU-SSD Integration
by: Li, Zhonggen, et al.
Published: (2025)
by: Li, Zhonggen, et al.
Published: (2025)
Scalable Graph Indexing using GPUs for Approximate Nearest Neighbor Search
by: Li, Zhonggen, et al.
Published: (2025)
by: Li, Zhonggen, et al.
Published: (2025)
PlugMem: A Task-Agnostic Plugin Memory Module for LLM Agents
by: Yang, Ke, et al.
Published: (2026)
by: Yang, Ke, et al.
Published: (2026)
PiLLar: Matching for Pivot Table Schema via LLM-guided Monte-Carlo Tree Search
by: Gao, Yunjun, et al.
Published: (2026)
by: Gao, Yunjun, et al.
Published: (2026)
OneDB: A Distributed Multi-Metric Data Similarity Search System
by: Qian, Tang, et al.
Published: (2025)
by: Qian, Tang, et al.
Published: (2025)
Empowering Graph-based Approximate Nearest Neighbor Search with Adaptive Awareness Capabilities
by: Ruan, Jiancheng, et al.
Published: (2025)
by: Ruan, Jiancheng, et al.
Published: (2025)
Anomalous Nernst Effect and Transverse Thermoelectric Conversion in Co 2 Mn Al‐Based Heusler Magnets
by: Sheng Qian, et al.
Published: (2025)
by: Sheng Qian, et al.
Published: (2025)
Beyond Relational: Semantic-Aware Multi-Modal Analytics with LLM-Native Query Optimization
by: Zhu, Junhao, et al.
Published: (2025)
by: Zhu, Junhao, et al.
Published: (2025)
MemEvolve: Meta-Evolution of Agent Memory Systems
by: Zhang, Guibin, et al.
Published: (2025)
by: Zhang, Guibin, et al.
Published: (2025)
LatentMem: Customizing Latent Memory for Multi-Agent Systems
by: Fu, Muxin, et al.
Published: (2026)
by: Fu, Muxin, et al.
Published: (2026)
FluxMem: Adaptive Hierarchical Memory for Streaming Video Understanding
by: Xie, Yiweng, et al.
Published: (2026)
by: Xie, Yiweng, et al.
Published: (2026)
LLM-MemCluster: Empowering Large Language Models with Dynamic Memory for Text Clustering
by: Zhu, Yuanjie, et al.
Published: (2025)
by: Zhu, Yuanjie, et al.
Published: (2025)
View-based Explanations for Graph Neural Networks
by: Chen, Tingyang, et al.
Published: (2024)
by: Chen, Tingyang, et al.
Published: (2024)
Stitching Inner Product and Euclidean Metrics for Topology-aware Maximum Inner Product Search
by: Chen, Tingyang, et al.
Published: (2025)
by: Chen, Tingyang, et al.
Published: (2025)
RecMem: Recurrence-based Memory Consolidation for Efficient and Effective Long-Running LLM Agents
by: Dai, Zijie, et al.
Published: (2026)
by: Dai, Zijie, et al.
Published: (2026)
MemCompiler: Compile, Don't Inject -- State-Conditioned Memory for Embodied Agents
by: Ding, Xin, et al.
Published: (2026)
by: Ding, Xin, et al.
Published: (2026)
Fine-Mem: Fine-Grained Feedback Alignment for Long-Horizon Memory Management
by: Ma, Weitao, et al.
Published: (2026)
by: Ma, Weitao, et al.
Published: (2026)
MemFail: Stress-Testing Failure Modes of LLM Memory Systems
by: Garg, Ishir, et al.
Published: (2026)
by: Garg, Ishir, et al.
Published: (2026)
D-Mem: A Dual-Process Memory System for LLM Agents
by: You, Zhixing, et al.
Published: (2026)
by: You, Zhixing, et al.
Published: (2026)
NextMem: Towards Latent Factual Memory for LLM-based Agents
by: Zhang, Zeyu, et al.
Published: (2026)
by: Zhang, Zeyu, et al.
Published: (2026)
Starling: An I/O-Efficient Disk-Resident Graph Index Framework for High-Dimensional Vector Similarity Search on Data Segment
by: Wang, Mengzhao, et al.
Published: (2024)
by: Wang, Mengzhao, et al.
Published: (2024)
MemSim: A Bayesian Simulator for Evaluating Memory of LLM-based Personal Assistants
by: Zhang, Zeyu, et al.
Published: (2024)
by: Zhang, Zeyu, et al.
Published: (2024)
Accelerating Biclique Counting on GPU
by: Qiu, Linshan, et al.
Published: (2024)
by: Qiu, Linshan, et al.
Published: (2024)
A Benchmark Study of Deep-RL Methods for Maximum Coverage Problems over Graphs
by: Liang, Zhicheng, et al.
Published: (2024)
by: Liang, Zhicheng, et al.
Published: (2024)
HeLa-Mem: Hebbian Learning and Associative Memory for LLM Agents
by: Zhu, Jinchang, et al.
Published: (2026)
by: Zhu, Jinchang, et al.
Published: (2026)
Spin-NeuroMem: A Low-Power Neuromorphic Associative Memory Design Based on Spintronic Devices
by: Fu, Siqing, et al.
Published: (2024)
by: Fu, Siqing, et al.
Published: (2024)
AriadneMem: Threading the Maze of Lifelong Memory for LLM Agents
by: Zhu, Wenhui, et al.
Published: (2026)
by: Zhu, Wenhui, et al.
Published: (2026)
MemAscend: System Memory Optimization for SSD-Offloaded LLM Fine-Tuning
by: Liaw, Yong-Cheng, et al.
Published: (2025)
by: Liaw, Yong-Cheng, et al.
Published: (2025)
MemFlow: Optical Flow Estimation and Prediction with Memory
by: Dong, Qiaole, et al.
Published: (2024)
by: Dong, Qiaole, et al.
Published: (2024)
MemBench: Towards More Comprehensive Evaluation on the Memory of LLM-based Agents
by: Tan, Haoran, et al.
Published: (2025)
by: Tan, Haoran, et al.
Published: (2025)
SimpleMem: Efficient Lifelong Memory for LLM Agents
by: Liu, Jiaqi, et al.
Published: (2026)
by: Liu, Jiaqi, et al.
Published: (2026)
MemInsight: Autonomous Memory Augmentation for LLM Agents
by: Salama, Rana, et al.
Published: (2025)
by: Salama, Rana, et al.
Published: (2025)
Viking
Published: (2018)
Published: (2018)
MemGS: Memory-Efficient Gaussian Splatting for Real-Time SLAM
by: Bai, Yinlong, et al.
Published: (2025)
by: Bai, Yinlong, et al.
Published: (2025)
Similar Items
-
Accelerating Graph Indexing for ANNS on Modern CPUs
by: Wang, Mengzhao, et al.
Published: (2025) -
An Interactive Multi-modal Query Answering System with Retrieval-Augmented Large Language Models
by: Wang, Mengzhao, et al.
Published: (2024) -
In-context Clustering-based Entity Resolution with Large Language Models: A Design Space Exploration
by: Fu, Jiajie, et al.
Published: (2025) -
Balancing the Blend: An Experimental Analysis of Trade-offs in Hybrid Search
by: Wang, Mengzhao, et al.
Published: (2025) -
GTS: GPU-based Tree Index for Fast Similarity Search
by: Zhu, Yifan, et al.
Published: (2024)