Beyond Memorization: The Challenge of Random Memory Access in Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhu, Tongyao, Liu, Qian, Pang, Liang, Jiang, Zhengbao, Kan, Min-Yen, Lin, Min |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
RegMix: Data Mixture as Regression for Language Model Pre-training
di: Liu, Qian, et al.
Pubblicazione: (2024)
di: Liu, Qian, et al.
Pubblicazione: (2024)
Retentive or Forgetful? Diving into the Knowledge Memorizing Mechanism of Language Models
di: Cao, Boxi, et al.
Pubblicazione: (2023)
di: Cao, Boxi, et al.
Pubblicazione: (2023)
Improved Few-Shot Jailbreaking Can Circumvent Aligned Language Models and Their Defenses
di: Zheng, Xiaosen, et al.
Pubblicazione: (2024)
di: Zheng, Xiaosen, et al.
Pubblicazione: (2024)
Beyond Memorization: Assessing Semantic Generalization in Large Language Models Using Phrasal Constructions
di: Scivetti, Wesley, et al.
Pubblicazione: (2025)
di: Scivetti, Wesley, et al.
Pubblicazione: (2025)
Memorization in Large Language Models in Medicine: Prevalence, Characteristics, and Implications
di: Li, Anran, et al.
Pubblicazione: (2025)
di: Li, Anran, et al.
Pubblicazione: (2025)
Purifying Large Language Models by Ensembling a Small Language Model
di: Li, Tianlin, et al.
Pubblicazione: (2024)
di: Li, Tianlin, et al.
Pubblicazione: (2024)
Memorizing Documents with Guidance in Large Language Models
di: Park, Bumjin, et al.
Pubblicazione: (2024)
di: Park, Bumjin, et al.
Pubblicazione: (2024)
Arithmetic with Language Models: from Memorization to Computation
di: Maltoni, Davide, et al.
Pubblicazione: (2023)
di: Maltoni, Davide, et al.
Pubblicazione: (2023)
Memorization in Fine-Tuned Large Language Models
di: Savine, Danil
Pubblicazione: (2025)
di: Savine, Danil
Pubblicazione: (2025)
Variational Reasoning for Language Models
di: Zhou, Xiangxin, et al.
Pubblicazione: (2025)
di: Zhou, Xiangxin, et al.
Pubblicazione: (2025)
Beyond RAG for Agent Memory: Retrieval by Decoupling and Aggregation
di: Hu, Zhanghao, et al.
Pubblicazione: (2026)
di: Hu, Zhanghao, et al.
Pubblicazione: (2026)
LoraHub: Efficient Cross-Task Generalization via Dynamic LoRA Composition
di: Huang, Chengsong, et al.
Pubblicazione: (2023)
di: Huang, Chengsong, et al.
Pubblicazione: (2023)
Improving Your Model Ranking on Chatbot Arena by Vote Rigging
di: Min, Rui, et al.
Pubblicazione: (2025)
di: Min, Rui, et al.
Pubblicazione: (2025)
MemoryRewardBench: Benchmarking Reward Models for Long-Term Memory Management in Large Language Models
di: Tang, Zecheng, et al.
Pubblicazione: (2026)
di: Tang, Zecheng, et al.
Pubblicazione: (2026)
When Attention Sink Emerges in Language Models: An Empirical View
di: Gu, Xiangming, et al.
Pubblicazione: (2024)
di: Gu, Xiangming, et al.
Pubblicazione: (2024)
FastMem: Fast Memorization of Prompt Improves Context Awareness of Large Language Models
di: Zhu, Junyi, et al.
Pubblicazione: (2024)
di: Zhu, Junyi, et al.
Pubblicazione: (2024)
SkyLadder: Better and Faster Pretraining via Context Window Scheduling
di: Zhu, Tongyao, et al.
Pubblicazione: (2025)
di: Zhu, Tongyao, et al.
Pubblicazione: (2025)
Undesirable Memorization in Large Language Models: A Survey
di: Satvaty, Ali, et al.
Pubblicazione: (2024)
di: Satvaty, Ali, et al.
Pubblicazione: (2024)
Mitigating Memorization In Language Models
di: Sakarvadia, Mansi, et al.
Pubblicazione: (2024)
di: Sakarvadia, Mansi, et al.
Pubblicazione: (2024)
Sailor: Open Language Models for South-East Asia
di: Dou, Longxu, et al.
Pubblicazione: (2024)
di: Dou, Longxu, et al.
Pubblicazione: (2024)
Cheating Automatic LLM Benchmarks: Null Models Achieve High Win Rates
di: Zheng, Xiaosen, et al.
Pubblicazione: (2024)
di: Zheng, Xiaosen, et al.
Pubblicazione: (2024)
Self-Adaptive Sampling for Efficient Video Question-Answering on Image--Text Models
di: Han, Wei, et al.
Pubblicazione: (2023)
di: Han, Wei, et al.
Pubblicazione: (2023)
A Multi-Perspective Analysis of Memorization in Large Language Models
di: Chen, Bowen, et al.
Pubblicazione: (2024)
di: Chen, Bowen, et al.
Pubblicazione: (2024)
Generalization or Memorization? Brittleness Testing for Chess-Trained Language Models
di: Tang, Ethan
Pubblicazione: (2026)
di: Tang, Ethan
Pubblicazione: (2026)
Impact of Fine-Tuning Methods on Memorization in Large Language Models
di: Hou, Jie, et al.
Pubblicazione: (2025)
di: Hou, Jie, et al.
Pubblicazione: (2025)
Exploring Memorization in Fine-tuned Language Models
di: Zeng, Shenglai, et al.
Pubblicazione: (2023)
di: Zeng, Shenglai, et al.
Pubblicazione: (2023)
Scaling up Masked Diffusion Models on Text
di: Nie, Shen, et al.
Pubblicazione: (2024)
di: Nie, Shen, et al.
Pubblicazione: (2024)
Detecting Memorization in Large Language Models
di: Slonski, Eduardo
Pubblicazione: (2024)
di: Slonski, Eduardo
Pubblicazione: (2024)
CMT: A Memory Compression Method for Continual Knowledge Learning of Large Language Models
di: Li, Dongfang, et al.
Pubblicazione: (2024)
di: Li, Dongfang, et al.
Pubblicazione: (2024)
CCSBench: Evaluating Compositional Controllability in LLMs for Scientific Document Summarization
di: Ding, Yixi, et al.
Pubblicazione: (2024)
di: Ding, Yixi, et al.
Pubblicazione: (2024)
Hierarchical Memorization in Large Language Models: Evidence from Citation Generation
di: Niimi, Junichiro
Pubblicazione: (2025)
di: Niimi, Junichiro
Pubblicazione: (2025)
The Reasoning-Memorization Interplay in Language Models Is Mediated by a Single Direction
di: Hong, Yihuai, et al.
Pubblicazione: (2025)
di: Hong, Yihuai, et al.
Pubblicazione: (2025)
Semantic XPath: Structured Agentic Memory Access for Conversational AI
di: Liu, Yifan Simon, et al.
Pubblicazione: (2026)
di: Liu, Yifan Simon, et al.
Pubblicazione: (2026)
MemLong: Memory-Augmented Retrieval for Long Text Modeling
di: Liu, Weijie, et al.
Pubblicazione: (2024)
di: Liu, Weijie, et al.
Pubblicazione: (2024)
PsychCounsel-Bench: Evaluating the Psychology Intelligence of Large Language Models
di: Zeng, Min
Pubblicazione: (2025)
di: Zeng, Min
Pubblicazione: (2025)
When to Memorize and When to Stop: Gated Recurrent Memory for Long-Context Reasoning
di: Sheng, Leheng, et al.
Pubblicazione: (2026)
di: Sheng, Leheng, et al.
Pubblicazione: (2026)
A Closer Look at Machine Unlearning for Large Language Models
di: Yuan, Xiaojian, et al.
Pubblicazione: (2024)
di: Yuan, Xiaojian, et al.
Pubblicazione: (2024)
Reversible Diffusion Decoding for Diffusion Language Models
di: Wang, Xinyun, et al.
Pubblicazione: (2026)
di: Wang, Xinyun, et al.
Pubblicazione: (2026)
Assessing and Mitigating Data Memorization Risks in Fine-Tuned Large Language Models
di: Ramakrishnan, Badrinath, et al.
Pubblicazione: (2025)
di: Ramakrishnan, Badrinath, et al.
Pubblicazione: (2025)
Understanding or Memorizing? A Case Study of German Definite Articles in Language Models
di: Drechsel, Jonathan, et al.
Pubblicazione: (2026)
di: Drechsel, Jonathan, et al.
Pubblicazione: (2026)
Documenti analoghi
-
RegMix: Data Mixture as Regression for Language Model Pre-training
di: Liu, Qian, et al.
Pubblicazione: (2024) -
Retentive or Forgetful? Diving into the Knowledge Memorizing Mechanism of Language Models
di: Cao, Boxi, et al.
Pubblicazione: (2023) -
Improved Few-Shot Jailbreaking Can Circumvent Aligned Language Models and Their Defenses
di: Zheng, Xiaosen, et al.
Pubblicazione: (2024) -
Beyond Memorization: Assessing Semantic Generalization in Large Language Models Using Phrasal Constructions
di: Scivetti, Wesley, et al.
Pubblicazione: (2025) -
Memorization in Large Language Models in Medicine: Prevalence, Characteristics, and Implications
di: Li, Anran, et al.
Pubblicazione: (2025)