Forgetting Curve: A Reliable Method for Evaluating Memorization Capability for Long-context Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Liu, Xinyu, Zhao, Runsong, Huang, Pengcheng, Xiao, Chunyang, Li, Bei, Wang, Jingang, Xiao, Tong, Zhu, Jingbo |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Position IDs Matter: An Enhanced Position Layout for Efficient Context Compression in Large Language Models
por: Zhao, Runsong, et al.
Publicado: (2024)
por: Zhao, Runsong, et al.
Publicado: (2024)
Autoencoding-Free Context Compression for LLMs via Contextual Semantic Anchors
por: Liu, Xin, et al.
Publicado: (2025)
por: Liu, Xin, et al.
Publicado: (2025)
Translate-and-Revise: Boosting Large Language Models for Constrained Translation
por: Huang, Pengcheng, et al.
Publicado: (2024)
por: Huang, Pengcheng, et al.
Publicado: (2024)
IIET: Efficient Numerical Transformer via Implicit Iterative Euler Method
por: Liu, Xinyu, et al.
Publicado: (2025)
por: Liu, Xinyu, et al.
Publicado: (2025)
MemoSight: Unifying Context Compression and Multi Token Prediction for Reasoning Acceleration
por: Liu, Xinyu, et al.
Publicado: (2026)
por: Liu, Xinyu, et al.
Publicado: (2026)
MTR-Suite: A Framework for Evaluating and Synthesizing Conversational Retrieval Benchmarks
por: Ruan, Junhao, et al.
Publicado: (2026)
por: Ruan, Junhao, et al.
Publicado: (2026)
Early Exit Is a Natural Capability in Transformer-based Models: An Empirical Study on Early Exit without Joint Optimization
por: Shan, Weiqiao, et al.
Publicado: (2024)
por: Shan, Weiqiao, et al.
Publicado: (2024)
Causal Autoregressive Diffusion Language Model
por: Ruan, Junhao, et al.
Publicado: (2026)
por: Ruan, Junhao, et al.
Publicado: (2026)
EIT: Enhanced Interactive Transformer
por: Zheng, Tong, et al.
Publicado: (2022)
por: Zheng, Tong, et al.
Publicado: (2022)
Foundations of Large Language Models
por: Xiao, Tong, et al.
Publicado: (2025)
por: Xiao, Tong, et al.
Publicado: (2025)
Dissecting Long-Chain-of-Thought Reasoning Models: An Empirical Study
por: Mu, Yongyu, et al.
Publicado: (2025)
por: Mu, Yongyu, et al.
Publicado: (2025)
PoC: Performance-oriented Context Compression for Large Language Models via Performance Prediction
por: Zhao, Runsong, et al.
Publicado: (2026)
por: Zhao, Runsong, et al.
Publicado: (2026)
Predictor-Corrector Enhanced Transformers with Exponential Moving Average Coefficient Learning
por: Li, Bei, et al.
Publicado: (2024)
por: Li, Bei, et al.
Publicado: (2024)
PartialFormer: Modeling Part Instead of Whole for Machine Translation
por: Zheng, Tong, et al.
Publicado: (2023)
por: Zheng, Tong, et al.
Publicado: (2023)
MTP-S2UT: Enhancing Speech-to-Speech Translation Quality with Multi-token Prediction
por: Wang, Jianjin, et al.
Publicado: (2025)
por: Wang, Jianjin, et al.
Publicado: (2025)
Probing Preference Representations: A Multi-Dimensional Evaluation and Analysis Method for Reward Models
por: Wang, Chenglong, et al.
Publicado: (2025)
por: Wang, Chenglong, et al.
Publicado: (2025)
KRAIL: A Knowledge-Driven Framework for Base Human Reliability Analysis Integrating IDHEAS and Large Language Models
por: Xiao, Xingyu, et al.
Publicado: (2024)
por: Xiao, Xingyu, et al.
Publicado: (2024)
StyleBench: Evaluating Speech Language Models on Conversational Speaking Style Control
por: Zhao, Haishu, et al.
Publicado: (2026)
por: Zhao, Haishu, et al.
Publicado: (2026)
ReMamba: Equip Mamba with Effective Long-Sequence Modeling
por: Yuan, Danlong, et al.
Publicado: (2024)
por: Yuan, Danlong, et al.
Publicado: (2024)
Language-Specific Layer Matters: Efficient Multilingual Enhancement for Large Vision-Language Models
por: Fan, Yuchun, et al.
Publicado: (2025)
por: Fan, Yuchun, et al.
Publicado: (2025)
Hybrid Alignment Training for Large Language Models
por: Wang, Chenglong, et al.
Publicado: (2024)
por: Wang, Chenglong, et al.
Publicado: (2024)
Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models
por: Wu, Junjie, et al.
Publicado: (2025)
por: Wu, Junjie, et al.
Publicado: (2025)
Efficient Prompting Methods for Large Language Models: A Survey
por: Chang, Kaiyan, et al.
Publicado: (2024)
por: Chang, Kaiyan, et al.
Publicado: (2024)
LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance
por: Fan, Yuchun, et al.
Publicado: (2026)
por: Fan, Yuchun, et al.
Publicado: (2026)
FOREVER: Forgetting Curve-Inspired Memory Replay for Language Model Continual Learning
por: Feng, Yujie, et al.
Publicado: (2026)
por: Feng, Yujie, et al.
Publicado: (2026)
NDP: Next Distribution Prediction as a More Broad Target
por: Ruan, Junhao, et al.
Publicado: (2024)
por: Ruan, Junhao, et al.
Publicado: (2024)
Retentive or Forgetful? Diving into the Knowledge Memorizing Mechanism of Language Models
por: Cao, Boxi, et al.
Publicado: (2023)
por: Cao, Boxi, et al.
Publicado: (2023)
Beyond Decoder-only: Large Language Models Can be Good Encoders for Machine Translation
por: Luo, Yingfeng, et al.
Publicado: (2025)
por: Luo, Yingfeng, et al.
Publicado: (2025)
Teaching Language Models to Self-Improve by Learning from Language Feedback
por: Hu, Chi, et al.
Publicado: (2024)
por: Hu, Chi, et al.
Publicado: (2024)
Elephants Never Forget: Testing Language Models for Memorization of Tabular Data
por: Bordt, Sebastian, et al.
Publicado: (2024)
por: Bordt, Sebastian, et al.
Publicado: (2024)
Learning Evaluation Models from Large Language Models for Sequence Generation
por: Wang, Chenglong, et al.
Publicado: (2023)
por: Wang, Chenglong, et al.
Publicado: (2023)
NeedleInATable: Exploring Long-Context Capability of Large Language Models towards Long-Structured Tables
por: Wang, Lanrui, et al.
Publicado: (2025)
por: Wang, Lanrui, et al.
Publicado: (2025)
RouteLMT: Learned Sample Routing for Hybrid LLM Translation Deployment
por: Luo, Yingfeng, et al.
Publicado: (2026)
por: Luo, Yingfeng, et al.
Publicado: (2026)
Graceful Forgetting in Generative Language Models
por: Jiang, Chunyang, et al.
Publicado: (2025)
por: Jiang, Chunyang, et al.
Publicado: (2025)
Fuse to Forget: Bias Reduction and Selective Memorization through Model Fusion
por: Zaman, Kerem, et al.
Publicado: (2023)
por: Zaman, Kerem, et al.
Publicado: (2023)
Headlines You Won't Forget: Can Pronoun Insertion Increase Memorability?
por: Meyer, Selina, et al.
Publicado: (2026)
por: Meyer, Selina, et al.
Publicado: (2026)
Revealing the Parallel Multilingual Learning within Large Language Models
por: Mu, Yongyu, et al.
Publicado: (2024)
por: Mu, Yongyu, et al.
Publicado: (2024)
Prior Constraints-based Reward Model Training for Aligning Large Language Models
por: Zhou, Hang, et al.
Publicado: (2024)
por: Zhou, Hang, et al.
Publicado: (2024)
Unveiling Language Competence Neurons: A Psycholinguistic Approach to Model Interpretability
por: Duan, Xufeng, et al.
Publicado: (2024)
por: Duan, Xufeng, et al.
Publicado: (2024)
A Novel Task-Driven Method with Evolvable Interactive Agents Using Event Trees for Enhanced Emergency Decision Support
por: Xiao, Xingyu, et al.
Publicado: (2024)
por: Xiao, Xingyu, et al.
Publicado: (2024)
Ejemplares similares
-
Position IDs Matter: An Enhanced Position Layout for Efficient Context Compression in Large Language Models
por: Zhao, Runsong, et al.
Publicado: (2024) -
Autoencoding-Free Context Compression for LLMs via Contextual Semantic Anchors
por: Liu, Xin, et al.
Publicado: (2025) -
Translate-and-Revise: Boosting Large Language Models for Constrained Translation
por: Huang, Pengcheng, et al.
Publicado: (2024) -
IIET: Efficient Numerical Transformer via Implicit Iterative Euler Method
por: Liu, Xinyu, et al.
Publicado: (2025) -
MemoSight: Unifying Context Compression and Multi Token Prediction for Reasoning Acceleration
por: Liu, Xinyu, et al.
Publicado: (2026)