Towards Compressive and Scalable Recurrent Memory
Fuente:
arXiv
Salvato in:
| Autori principali: | Song, Yunchong, Kai, Jushi, Lu, Liming, Qiu, Kaixi, Lin, Zhouhan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
One Size Does Not Fit All: Token-Wise Adaptive Compression for KV Cache
di: Lu, Liming, et al.
Pubblicazione: (2026)
di: Lu, Liming, et al.
Pubblicazione: (2026)
Cluster-wise Graph Transformer with Dual-granularity Kernelized Attention
di: Huang, Siyuan, et al.
Pubblicazione: (2024)
di: Huang, Siyuan, et al.
Pubblicazione: (2024)
Graph Parsing Networks
di: Song, Yunchong, et al.
Pubblicazione: (2024)
di: Song, Yunchong, et al.
Pubblicazione: (2024)
Controlling Exploration-Exploitation in GFlowNets via Markov Chain Perspectives
di: Chen, Lin, et al.
Pubblicazione: (2026)
di: Chen, Lin, et al.
Pubblicazione: (2026)
SH2: Self-Highlighted Hesitation Helps You Decode More Truthfully
di: Kai, Jushi, et al.
Pubblicazione: (2024)
di: Kai, Jushi, et al.
Pubblicazione: (2024)
Leveraging Grammar Induction for Language Understanding and Generation
di: Kai, Jushi, et al.
Pubblicazione: (2024)
di: Kai, Jushi, et al.
Pubblicazione: (2024)
CrimeAlarm: Towards Intensive Intent Dynamics in Fine-grained Crime Prediction
di: Hu, Kaixi, et al.
Pubblicazione: (2024)
di: Hu, Kaixi, et al.
Pubblicazione: (2024)
Symmetry-Guided Memory Augmentation for Efficient Locomotion Learning
di: Bao, Kaixi, et al.
Pubblicazione: (2025)
di: Bao, Kaixi, et al.
Pubblicazione: (2025)
Fourier Compressor: Frequency-Domain Visual Token Compression for Vision-Language Models
di: Wang, Huanyu, et al.
Pubblicazione: (2025)
di: Wang, Huanyu, et al.
Pubblicazione: (2025)
MLP Memory: A Retriever-Pretrained Memory for Large Language Models
di: Wei, Rubin, et al.
Pubblicazione: (2025)
di: Wei, Rubin, et al.
Pubblicazione: (2025)
Mitigating Premature Discretization with Progressive Quantization for Robust Vector Tokenization
di: Zhao, Wenhao, et al.
Pubblicazione: (2026)
di: Zhao, Wenhao, et al.
Pubblicazione: (2026)
FreqKV: Key-Value Compression in Frequency Domain for Context Window Extension
di: Kai, Jushi, et al.
Pubblicazione: (2025)
di: Kai, Jushi, et al.
Pubblicazione: (2025)
PRES: Toward Scalable Memory-Based Dynamic Graph Neural Networks
di: Su, Junwei, et al.
Pubblicazione: (2024)
di: Su, Junwei, et al.
Pubblicazione: (2024)
Compact Recurrent Transformer with Persistent Memory
di: Mucllari, Edison, et al.
Pubblicazione: (2025)
di: Mucllari, Edison, et al.
Pubblicazione: (2025)
Scalable Graph Compressed Convolutions
di: Sun, Junshu, et al.
Pubblicazione: (2024)
di: Sun, Junshu, et al.
Pubblicazione: (2024)
Certified Signed Graph Unlearning
di: Zhao, Junpeng, et al.
Pubblicazione: (2025)
di: Zhao, Junpeng, et al.
Pubblicazione: (2025)
Recurrent Action Transformer with Memory
di: Cherepanov, Egor, et al.
Pubblicazione: (2023)
di: Cherepanov, Egor, et al.
Pubblicazione: (2023)
Memory Capacity of Nonlinear Recurrent Networks: Is it Informative?
di: Ballarin, Giovanni, et al.
Pubblicazione: (2025)
di: Ballarin, Giovanni, et al.
Pubblicazione: (2025)
Recurrent Memory for Online Interdomain Gaussian Processes
di: Chen, Wenlong, et al.
Pubblicazione: (2025)
di: Chen, Wenlong, et al.
Pubblicazione: (2025)
COAT: Compressing Optimizer states and Activation for Memory-Efficient FP8 Training
di: Xi, Haocheng, et al.
Pubblicazione: (2024)
di: Xi, Haocheng, et al.
Pubblicazione: (2024)
CoDAR: Continuous Diffusion Language Models are More Powerful Than You Think
di: Shen, Junzhe, et al.
Pubblicazione: (2026)
di: Shen, Junzhe, et al.
Pubblicazione: (2026)
Critical Data Size of Language Models from a Grokking Perspective
di: Zhu, Xuekai, et al.
Pubblicazione: (2024)
di: Zhu, Xuekai, et al.
Pubblicazione: (2024)
Unifying Sparse Attention with Hierarchical Memory for Scalable Long-Context LLM Serving
di: Zhao, Zihan, et al.
Pubblicazione: (2026)
di: Zhao, Zihan, et al.
Pubblicazione: (2026)
Compressed Context Memory For Online Language Model Interaction
di: Kim, Jang-Hyun, et al.
Pubblicazione: (2023)
di: Kim, Jang-Hyun, et al.
Pubblicazione: (2023)
MuteSwap: Visual-informed Silent Video Identity Conversion
di: Liu, Yifan, et al.
Pubblicazione: (2025)
di: Liu, Yifan, et al.
Pubblicazione: (2025)
DiVISe: Direct Visual-Input Speech Synthesis Preserving Speaker Characteristics And Intelligibility
di: Liu, Yifan, et al.
Pubblicazione: (2025)
di: Liu, Yifan, et al.
Pubblicazione: (2025)
Key-Value Means: Transformers with Expandable Block-Recurrent Compressed Memory
di: Goldstein, Daniel, et al.
Pubblicazione: (2026)
di: Goldstein, Daniel, et al.
Pubblicazione: (2026)
Towards Scalable Automated Alignment of LLMs: A Survey
di: Cao, Boxi, et al.
Pubblicazione: (2024)
di: Cao, Boxi, et al.
Pubblicazione: (2024)
Auxiliary-predicted Compress Memory Model(ApCM Model): A Neural Memory Storage Model Based on Invertible Compression and Learnable Prediction
di: Ou, Weinuo
Pubblicazione: (2026)
di: Ou, Weinuo
Pubblicazione: (2026)
Early Quantization Shrinks Codebook: A Simple Fix for Diversity-Preserving Tokenization
di: Zhao, Wenhao, et al.
Pubblicazione: (2026)
di: Zhao, Wenhao, et al.
Pubblicazione: (2026)
Decision Trees That Remember: Gradient-Based Learning of Recurrent Decision Trees with Memory
di: Marton, Sascha, et al.
Pubblicazione: (2025)
di: Marton, Sascha, et al.
Pubblicazione: (2025)
Lattice: Learning to Efficiently Compress the Memory
di: Karami, Mahdi, et al.
Pubblicazione: (2025)
di: Karami, Mahdi, et al.
Pubblicazione: (2025)
NGDB-Zoo: Towards Efficient and Scalable Neural Graph Databases Training
di: Xie, Zhongwei, et al.
Pubblicazione: (2026)
di: Xie, Zhongwei, et al.
Pubblicazione: (2026)
Less Memory Means smaller GPUs: Backpropagation with Compressed Activations
di: Barley, Daniel, et al.
Pubblicazione: (2024)
di: Barley, Daniel, et al.
Pubblicazione: (2024)
Disentangling Structured Components: Towards Adaptive, Interpretable and Scalable Time Series Forecasting
di: Deng, Jinliang, et al.
Pubblicazione: (2023)
di: Deng, Jinliang, et al.
Pubblicazione: (2023)
Towards Scalable and Structured Spatiotemporal Forecasting
di: Chen, Hongyi, et al.
Pubblicazione: (2025)
di: Chen, Hongyi, et al.
Pubblicazione: (2025)
Associative Recurrent Memory Transformer
di: Rodkin, Ivan, et al.
Pubblicazione: (2024)
di: Rodkin, Ivan, et al.
Pubblicazione: (2024)
LoMA: Lossless Compressed Memory Attention
di: Wang, Yumeng, et al.
Pubblicazione: (2024)
di: Wang, Yumeng, et al.
Pubblicazione: (2024)
MELODI: Exploring Memory Compression for Long Contexts
di: Chen, Yinpeng, et al.
Pubblicazione: (2024)
di: Chen, Yinpeng, et al.
Pubblicazione: (2024)
Task Vector Bases: A Unified and Scalable Framework for Compressed Task Arithmetic
di: Zeng, Siqi, et al.
Pubblicazione: (2025)
di: Zeng, Siqi, et al.
Pubblicazione: (2025)
Documenti analoghi
-
One Size Does Not Fit All: Token-Wise Adaptive Compression for KV Cache
di: Lu, Liming, et al.
Pubblicazione: (2026) -
Cluster-wise Graph Transformer with Dual-granularity Kernelized Attention
di: Huang, Siyuan, et al.
Pubblicazione: (2024) -
Graph Parsing Networks
di: Song, Yunchong, et al.
Pubblicazione: (2024) -
Controlling Exploration-Exploitation in GFlowNets via Markov Chain Perspectives
di: Chen, Lin, et al.
Pubblicazione: (2026) -
SH2: Self-Highlighted Hesitation Helps You Decode More Truthfully
di: Kai, Jushi, et al.
Pubblicazione: (2024)