Context Memorization for Efficient Long Context Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Okoshi, Yasuyuki, Chen, Hao Mark, Lu, Guanxi, Fan, Hongxiang, Motomura, Masato, Fujiki, Daichi |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Rethinking Optimal Verification Granularity for Compute-Efficient Test-Time Scaling
par: Chen, Hao Mark, et autres
Publié: (2025)
par: Chen, Hao Mark, et autres
Publié: (2025)
AQPIM: Breaking the PIM Capacity Wall for LLMs with In-Memory Activation Quantization
par: Matsushima, Kosuke, et autres
Publié: (2026)
par: Matsushima, Kosuke, et autres
Publié: (2026)
The Strong Lottery Ticket Hypothesis for Multi-Head Attention Mechanisms
par: Otsuka, Hikari, et autres
Publié: (2025)
par: Otsuka, Hikari, et autres
Publié: (2025)
AdaBlock-dLLM: Semantic-Aware Diffusion LLM Inference via Adaptive Block Size
par: Lu, Guanxi, et autres
Publié: (2025)
par: Lu, Guanxi, et autres
Publié: (2025)
Memorization in In-Context Learning
par: Golchin, Shahriar, et autres
Publié: (2024)
par: Golchin, Shahriar, et autres
Publié: (2024)
Binary Quadratic Quantization: Beyond First-Order Quantization for Real-Valued Matrix Compression
par: Kuroki, Kyo, et autres
Publié: (2025)
par: Kuroki, Kyo, et autres
Publié: (2025)
When to Memorize and When to Stop: Gated Recurrent Memory for Long-Context Reasoning
par: Sheng, Leheng, et autres
Publié: (2026)
par: Sheng, Leheng, et autres
Publié: (2026)
Towards Better Generalization in Open-Domain Question Answering by Mitigating Context Memorization
par: Zhang, Zixuan, et autres
Publié: (2024)
par: Zhang, Zixuan, et autres
Publié: (2024)
ATLAS: Learning to Optimally Memorize the Context at Test Time
par: Behrouz, Ali, et autres
Publié: (2025)
par: Behrouz, Ali, et autres
Publié: (2025)
Partially Frozen Random Networks Contain Compact Strong Lottery Tickets
par: Otsuka, Hikari, et autres
Publié: (2024)
par: Otsuka, Hikari, et autres
Publié: (2024)
Efficient Context Scaling with LongCat ZigZag Attention
par: Zhang, Chen, et autres
Publié: (2025)
par: Zhang, Chen, et autres
Publié: (2025)
Illusion or Algorithm? Investigating Memorization, Emergence, and Symbolic Processing in In-Context Learning
par: Niu, Jingcheng, et autres
Publié: (2025)
par: Niu, Jingcheng, et autres
Publié: (2025)
LiteLong: Resource-Efficient Long-Context Data Synthesis for LLMs
par: Jia, Junlong, et autres
Publié: (2025)
par: Jia, Junlong, et autres
Publié: (2025)
Long-Context Generalization with Sparse Attention
par: Vasylenko, Pavlo, et autres
Publié: (2025)
par: Vasylenko, Pavlo, et autres
Publié: (2025)
QUITO: Accelerating Long-Context Reasoning through Query-Guided Context Compression
par: Wang, Wenshan, et autres
Publié: (2024)
par: Wang, Wenshan, et autres
Publié: (2024)
Generalizing From Short to Long: Effective Data Synthesis for Long-Context Instruction Tuning
par: Zhu, Wenhao, et autres
Publié: (2025)
par: Zhu, Wenhao, et autres
Publié: (2025)
FastMem: Fast Memorization of Prompt Improves Context Awareness of Large Language Models
par: Zhu, Junyi, et autres
Publié: (2024)
par: Zhu, Junyi, et autres
Publié: (2024)
LooGLE: Can Long-Context Language Models Understand Long Contexts?
par: Li, Jiaqi, et autres
Publié: (2023)
par: Li, Jiaqi, et autres
Publié: (2023)
Quantifying In-Context Reasoning Effects and Memorization Effects in LLMs
par: Lou, Siyu, et autres
Publié: (2024)
par: Lou, Siyu, et autres
Publié: (2024)
Recurrent Context Compression: Efficiently Expanding the Context Window of LLM
par: Huang, Chensen, et autres
Publié: (2024)
par: Huang, Chensen, et autres
Publié: (2024)
APCE: Adaptive Progressive Context Expansion for Long Context Processing
par: Lee, Baisub, et autres
Publié: (2025)
par: Lee, Baisub, et autres
Publié: (2025)
Are Long-LLMs A Necessity For Long-Context Tasks?
par: Qian, Hongjin, et autres
Publié: (2024)
par: Qian, Hongjin, et autres
Publié: (2024)
$π$-Attention: Periodic Sparse Transformers for Efficient Long-Context Modeling
par: Liu, Dong, et autres
Publié: (2025)
par: Liu, Dong, et autres
Publié: (2025)
In-Context Learning for Long-Context Sentiment Analysis on Infrastructure Project Opinions
par: Shamshiri, Alireza, et autres
Publié: (2024)
par: Shamshiri, Alireza, et autres
Publié: (2024)
LongSafety: Evaluating Long-Context Safety of Large Language Models
par: Lu, Yida, et autres
Publié: (2025)
par: Lu, Yida, et autres
Publié: (2025)
Efficient Context Selection for Long-Context QA: No Tuning, No Iteration, Just Adaptive-$k$
par: Taguchi, Chihiro, et autres
Publié: (2025)
par: Taguchi, Chihiro, et autres
Publié: (2025)
InfLLM: Training-Free Long-Context Extrapolation for LLMs with an Efficient Context Memory
par: Xiao, Chaojun, et autres
Publié: (2024)
par: Xiao, Chaojun, et autres
Publié: (2024)
Is It Really Long Context if All You Need Is Retrieval? Towards Genuinely Difficult Long Context NLP
par: Goldman, Omer, et autres
Publié: (2024)
par: Goldman, Omer, et autres
Publié: (2024)
Pipelined Decoder for Efficient Context-Aware Text Generation
par: Huang, Zixian, et autres
Publié: (2025)
par: Huang, Zixian, et autres
Publié: (2025)
LongHeads: Multi-Head Attention is Secretly a Long Context Processor
par: Lu, Yi, et autres
Publié: (2024)
par: Lu, Yi, et autres
Publié: (2024)
Schema for In-Context Learning
par: Chen, Pan, et autres
Publié: (2025)
par: Chen, Pan, et autres
Publié: (2025)
ATACompressor: Adaptive Task-Aware Compression for Efficient Long-Context Processing in LLMs
par: Li, Xuancheng, et autres
Publié: (2026)
par: Li, Xuancheng, et autres
Publié: (2026)
Decoupled Reasoning with Implicit Fact Tokens (DRIFT): A Dual-Model Framework for Efficient Long-Context Inference
par: Xie, Wenxuan, et autres
Publié: (2026)
par: Xie, Wenxuan, et autres
Publié: (2026)
SemToken: Semantic-Aware Tokenization for Efficient Long-Context Language Modeling
par: Liu, Dong, et autres
Publié: (2025)
par: Liu, Dong, et autres
Publié: (2025)
Task Matters: Knowledge Requirements Shape LLM Responses to Context-Memory Conflict
par: Sun, Kaiser, et autres
Publié: (2025)
par: Sun, Kaiser, et autres
Publié: (2025)
Towards Long Context Hallucination Detection
par: Liu, Siyi, et autres
Publié: (2025)
par: Liu, Siyi, et autres
Publié: (2025)
Long Context Compression with Activation Beacon
par: Zhang, Peitian, et autres
Publié: (2024)
par: Zhang, Peitian, et autres
Publié: (2024)
ACC: Compiling Agent Trajectories for Long-Context Training
par: Su, Qisheng, et autres
Publié: (2026)
par: Su, Qisheng, et autres
Publié: (2026)
EntropyLong: Effective Long-Context Training via Predictive Uncertainty
par: Jia, Junlong, et autres
Publié: (2025)
par: Jia, Junlong, et autres
Publié: (2025)
Artificial Hippocampus Networks for Efficient Long-Context Modeling
par: Fang, Yunhao, et autres
Publié: (2025)
par: Fang, Yunhao, et autres
Publié: (2025)
Documents similaires
-
Rethinking Optimal Verification Granularity for Compute-Efficient Test-Time Scaling
par: Chen, Hao Mark, et autres
Publié: (2025) -
AQPIM: Breaking the PIM Capacity Wall for LLMs with In-Memory Activation Quantization
par: Matsushima, Kosuke, et autres
Publié: (2026) -
The Strong Lottery Ticket Hypothesis for Multi-Head Attention Mechanisms
par: Otsuka, Hikari, et autres
Publié: (2025) -
AdaBlock-dLLM: Semantic-Aware Diffusion LLM Inference via Adaptive Block Size
par: Lu, Guanxi, et autres
Publié: (2025) -
Memorization in In-Context Learning
par: Golchin, Shahriar, et autres
Publié: (2024)