Language Model Memory and Memory Models for Language
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Badger, Benjamin L. |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Toeplitz MLP Mixers are Low Complexity, Information-Rich Sequence Models
par: Badger, Benjamin L., et autres
Publié: (2026)
par: Badger, Benjamin L., et autres
Publié: (2026)
Memory-Efficient Looped Transformer: Decoupling Compute from Memory in Looped Language Models
par: Vendrell, Victor Conchello, et autres
Publié: (2026)
par: Vendrell, Victor Conchello, et autres
Publié: (2026)
Needle in the Haystack for Memory Based Large Language Models
par: Nelson, Elliot, et autres
Publié: (2024)
par: Nelson, Elliot, et autres
Publié: (2024)
MemGuard: Preventing Memory Contamination in Long-Term Memory-Augmented Large Language Models
par: Ha, Hyeonjeong, et autres
Publié: (2026)
par: Ha, Hyeonjeong, et autres
Publié: (2026)
Know Your Limits: Entropy Estimation Modeling for Compression and Generalization
par: Badger, Benjamin L., et autres
Publié: (2025)
par: Badger, Benjamin L., et autres
Publié: (2025)
Clustering-driven Memory Compression for On-device Large Language Models
par: Bohdal, Ondrej, et autres
Publié: (2026)
par: Bohdal, Ondrej, et autres
Publié: (2026)
Episodic Memories Generation and Evaluation Benchmark for Large Language Models
par: Huet, Alexis, et autres
Publié: (2025)
par: Huet, Alexis, et autres
Publié: (2025)
Echo: A Large Language Model with Temporal Episodic Memory
par: Liu, WenTao, et autres
Publié: (2025)
par: Liu, WenTao, et autres
Publié: (2025)
Language Diffusion Models are Associative Memories Capable of Retrieving Unseen Data
par: Pham, Bao, et autres
Publié: (2026)
par: Pham, Bao, et autres
Publié: (2026)
Pre-training Limited Memory Language Models with Internal and External Knowledge
par: Zhao, Linxi, et autres
Publié: (2025)
par: Zhao, Linxi, et autres
Publié: (2025)
MemTrace: Tracing and Attributing Errors in Large Language Model Memory Systems
par: Deng, Xinle, et autres
Publié: (2026)
par: Deng, Xinle, et autres
Publié: (2026)
FOREVER: Forgetting Curve-Inspired Memory Replay for Language Model Continual Learning
par: Feng, Yujie, et autres
Publié: (2026)
par: Feng, Yujie, et autres
Publié: (2026)
Mini-batch Coresets for Memory-efficient Language Model Training on Data Mixtures
par: Nguyen, Dang, et autres
Publié: (2024)
par: Nguyen, Dang, et autres
Publié: (2024)
UltraEdit: Training-, Subject-, and Memory-Free Lifelong Editing in Language Models
par: Gu, Xiaojie, et autres
Publié: (2025)
par: Gu, Xiaojie, et autres
Publié: (2025)
Memory Tokens: Large Language Models Can Generate Reversible Sentence Embeddings
par: Sastre, Ignacio, et autres
Publié: (2025)
par: Sastre, Ignacio, et autres
Publié: (2025)
LLM in a flash: Efficient Large Language Model Inference with Limited Memory
par: Alizadeh, Keivan, et autres
Publié: (2023)
par: Alizadeh, Keivan, et autres
Publié: (2023)
MetaState: Persistent Working Memory Enhances Reasoning in Discrete Diffusion Language Models
par: Xia, Kejing, et autres
Publié: (2026)
par: Xia, Kejing, et autres
Publié: (2026)
ME-Switch: A Memory-Efficient Expert Switching Framework for Large Language Models
par: Liu, Jing, et autres
Publié: (2024)
par: Liu, Jing, et autres
Publié: (2024)
MOM: Memory-Efficient Offloaded Mini-Sequence Inference for Long Context Language Models
par: Zhang, Junyang, et autres
Publié: (2025)
par: Zhang, Junyang, et autres
Publié: (2025)
Boundary-Guided Policy Optimization for Memory-efficient RL of Diffusion Large Language Models
par: Lin, Nianyi, et autres
Publié: (2025)
par: Lin, Nianyi, et autres
Publié: (2025)
LOLAMEME: Logic, Language, Memory, Mechanistic Framework
par: Desai, Jay, et autres
Publié: (2024)
par: Desai, Jay, et autres
Publié: (2024)
$\text{Memory}^3$: Language Modeling with Explicit Memory
par: Yang, Hongkang, et autres
Publié: (2024)
par: Yang, Hongkang, et autres
Publié: (2024)
Did You Forget What I Asked? Prospective Memory Failures in Large Language Models
par: Mittal, Avni
Publié: (2026)
par: Mittal, Avni
Publié: (2026)
MemoryPrompt: A Light Wrapper to Improve Context Tracking in Pre-trained Language Models
par: Rakotonirina, Nathanaël Carraz, et autres
Publié: (2024)
par: Rakotonirina, Nathanaël Carraz, et autres
Publié: (2024)
Not All Adapters Matter: Selective Adapter Freezing for Memory-Efficient Fine-Tuning of Language Models
par: Son, Hyegang, et autres
Publié: (2024)
par: Son, Hyegang, et autres
Publié: (2024)
LifeAlign: Lifelong Alignment for Large Language Models with Memory-Augmented Focalized Preference Optimization
par: Li, Junsong, et autres
Publié: (2025)
par: Li, Junsong, et autres
Publié: (2025)
Train Small, Infer Large: Memory-Efficient LoRA Training for Large Language Models
par: Zhang, Jun, et autres
Publié: (2025)
par: Zhang, Jun, et autres
Publié: (2025)
A Benchmark for Procedural Memory Retrieval in Language Agents
par: Kohar, Ishant, et autres
Publié: (2025)
par: Kohar, Ishant, et autres
Publié: (2025)
Memory Injections: Correcting Multi-Hop Reasoning Failures during Inference in Transformer-Based Language Models
par: Sakarvadia, Mansi, et autres
Publié: (2023)
par: Sakarvadia, Mansi, et autres
Publié: (2023)
MeMo: Memory as a Model
par: Quek, Ryan Wei Heng, et autres
Publié: (2026)
par: Quek, Ryan Wei Heng, et autres
Publié: (2026)
AdaZeta: Adaptive Zeroth-Order Tensor-Train Adaption for Memory-Efficient Large Language Models Fine-Tuning
par: Yang, Yifan, et autres
Publié: (2024)
par: Yang, Yifan, et autres
Publié: (2024)
PHOTON: Hierarchical Autoregressive Modeling for Lightspeed and Memory-Efficient Language Generation
par: Ichikawa, Yuma, et autres
Publié: (2025)
par: Ichikawa, Yuma, et autres
Publié: (2025)
Masked Mixers for Language Generation and Retrieval
par: Badger, Benjamin L.
Publié: (2024)
par: Badger, Benjamin L.
Publié: (2024)
Distinguishing the Knowable from the Unknowable with Language Models
par: Ahdritz, Gustaf, et autres
Publié: (2024)
par: Ahdritz, Gustaf, et autres
Publié: (2024)
MoM: Linear Sequence Modeling with Mixture-of-Memories
par: Du, Jusen, et autres
Publié: (2025)
par: Du, Jusen, et autres
Publié: (2025)
DP-MemArc: Differential Privacy Transfer Learning for Memory Efficient Language Models
par: Liu, Yanming, et autres
Publié: (2024)
par: Liu, Yanming, et autres
Publié: (2024)
LISA: Layerwise Importance Sampling for Memory-Efficient Large Language Model Fine-Tuning
par: Pan, Rui, et autres
Publié: (2024)
par: Pan, Rui, et autres
Publié: (2024)
Phase-Associative Memory: Sequence Modeling in Complex Hilbert Space
par: Vishwakarma, Gowrav, et autres
Publié: (2026)
par: Vishwakarma, Gowrav, et autres
Publié: (2026)
MemMamba: Rethinking Memory Patterns in State Space Model
par: Wang, Youjin, et autres
Publié: (2025)
par: Wang, Youjin, et autres
Publié: (2025)
On Language Generation in the Limit with Bounded Memory
par: Kleinberg, Jon, et autres
Publié: (2026)
par: Kleinberg, Jon, et autres
Publié: (2026)
Documents similaires
-
Toeplitz MLP Mixers are Low Complexity, Information-Rich Sequence Models
par: Badger, Benjamin L., et autres
Publié: (2026) -
Memory-Efficient Looped Transformer: Decoupling Compute from Memory in Looped Language Models
par: Vendrell, Victor Conchello, et autres
Publié: (2026) -
Needle in the Haystack for Memory Based Large Language Models
par: Nelson, Elliot, et autres
Publié: (2024) -
MemGuard: Preventing Memory Contamination in Long-Term Memory-Augmented Large Language Models
par: Ha, Hyeonjeong, et autres
Publié: (2026) -
Know Your Limits: Entropy Estimation Modeling for Compression and Generalization
par: Badger, Benjamin L., et autres
Publié: (2025)