Salvato in:
| Autori principali: | Petrov, Aleksandar, Sandler, Mark, Zhmoginov, Andrey, Miller, Nolan, Vladymyrov, Max |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2504.08934 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Continual HyperTransformer: A Meta-Learner for Continual Few-Shot Learning
di: Vladymyrov, Max, et al.
Pubblicazione: (2023)
di: Vladymyrov, Max, et al.
Pubblicazione: (2023)
Learning and Unlearning of Fabricated Knowledge in Language Models
di: Sun, Chen, et al.
Pubblicazione: (2024)
di: Sun, Chen, et al.
Pubblicazione: (2024)
Contextually Guided Transformers via Low-Rank Adaptation
di: Zhmoginov, Andrey, et al.
Pubblicazione: (2025)
di: Zhmoginov, Andrey, et al.
Pubblicazione: (2025)
Narrowing the Focus: Learned Optimizers for Pretrained Models
di: Kristiansen, Gus, et al.
Pubblicazione: (2024)
di: Kristiansen, Gus, et al.
Pubblicazione: (2024)
MELODI: Exploring Memory Compression for Long Contexts
di: Chen, Yinpeng, et al.
Pubblicazione: (2024)
di: Chen, Yinpeng, et al.
Pubblicazione: (2024)
How new data permeates LLM knowledge and how to dilute it
di: Sun, Chen, et al.
Pubblicazione: (2025)
di: Sun, Chen, et al.
Pubblicazione: (2025)
Linear Transformers are Versatile In-Context Learners
di: Vladymyrov, Max, et al.
Pubblicazione: (2024)
di: Vladymyrov, Max, et al.
Pubblicazione: (2024)
Sentence-Anchored Gist Compression for Long-Context LLMs
di: Tarasov, Dmitrii, et al.
Pubblicazione: (2025)
di: Tarasov, Dmitrii, et al.
Pubblicazione: (2025)
A Human-Inspired Reading Agent with Gist Memory of Very Long Contexts
di: Lee, Kuang-Huei, et al.
Pubblicazione: (2024)
di: Lee, Kuang-Huei, et al.
Pubblicazione: (2024)
Projectable Models: One-Shot Generation of Small Specialized Transformers from Large Ones
di: Zhmoginov, Andrey, et al.
Pubblicazione: (2025)
di: Zhmoginov, Andrey, et al.
Pubblicazione: (2025)
EmoGist: Efficient In-Context Learning for Visual Emotion Understanding
di: Seoh, Ronald, et al.
Pubblicazione: (2025)
di: Seoh, Ronald, et al.
Pubblicazione: (2025)
Uncovering mesa-optimization algorithms in Transformers
di: von Oswald, Johannes, et al.
Pubblicazione: (2023)
di: von Oswald, Johannes, et al.
Pubblicazione: (2023)
Compressing Lengthy Context With UltraGist
di: Zhang, Peitian, et al.
Pubblicazione: (2024)
di: Zhang, Peitian, et al.
Pubblicazione: (2024)
Universal In-Context Approximation By Prompting Fully Recurrent Models
di: Petrov, Aleksandar, et al.
Pubblicazione: (2024)
di: Petrov, Aleksandar, et al.
Pubblicazione: (2024)
Forget, Then Recall: Learnable Compression and Selective Unfolding via Gist Sparse Attention
di: Mao, Yuzhen, et al.
Pubblicazione: (2026)
di: Mao, Yuzhen, et al.
Pubblicazione: (2026)
GistScore: Learning Better Representations for In-Context Example Selection with Gist Bottlenecks
di: Gupta, Shivanshu, et al.
Pubblicazione: (2023)
di: Gupta, Shivanshu, et al.
Pubblicazione: (2023)
GeneZip: Region-Aware Compression for Long Context DNA Modeling
di: Zhao, Jianan, et al.
Pubblicazione: (2026)
di: Zhao, Jianan, et al.
Pubblicazione: (2026)
ContextEvolve: Multi-Agent Context Compression for Systems Code Optimization
di: Su, Hongyuan, et al.
Pubblicazione: (2026)
di: Su, Hongyuan, et al.
Pubblicazione: (2026)
Compressing Many-Shots in In-Context Learning
di: Khatri, Devvrit, et al.
Pubblicazione: (2025)
di: Khatri, Devvrit, et al.
Pubblicazione: (2025)
Technical Debt in In-Context Learning: Diminishing Efficiency in Long Context
di: Joo, Taejong, et al.
Pubblicazione: (2025)
di: Joo, Taejong, et al.
Pubblicazione: (2025)
ContextBench: Modifying Contexts for Targeted Latent Activation
di: Graham, Robert, et al.
Pubblicazione: (2025)
di: Graham, Robert, et al.
Pubblicazione: (2025)
Prompting a Pretrained Transformer Can Be a Universal Approximator
di: Petrov, Aleksandar, et al.
Pubblicazione: (2024)
di: Petrov, Aleksandar, et al.
Pubblicazione: (2024)
Long-Context Attention Benchmark: From Kernel Efficiency to Distributed Context Parallelism
di: Bu, Tao, et al.
Pubblicazione: (2025)
di: Bu, Tao, et al.
Pubblicazione: (2025)
Hierarchical Context Merging: Better Long Context Understanding for Pre-trained LLMs
di: Song, Woomin, et al.
Pubblicazione: (2024)
di: Song, Woomin, et al.
Pubblicazione: (2024)
Revisiting In-Context Learning with Long Context Language Models
di: Baek, Jinheon, et al.
Pubblicazione: (2024)
di: Baek, Jinheon, et al.
Pubblicazione: (2024)
UniGist: Towards General and Hardware-aligned Sequence-level Long Context Compression
di: Deng, Chenlong, et al.
Pubblicazione: (2025)
di: Deng, Chenlong, et al.
Pubblicazione: (2025)
100-LongBench: Are de facto Long-Context Benchmarks Literally Evaluating Long-Context Ability?
di: Yang, Wang, et al.
Pubblicazione: (2025)
di: Yang, Wang, et al.
Pubblicazione: (2025)
PolicyLong: Towards On-Policy Context Extension
di: Jia, Junlong, et al.
Pubblicazione: (2026)
di: Jia, Junlong, et al.
Pubblicazione: (2026)
Goal-Directed Search Outperforms Goal-Agnostic Memory Compression in Long-Context Memory Tasks
di: Zheng, Yicong, et al.
Pubblicazione: (2025)
di: Zheng, Yicong, et al.
Pubblicazione: (2025)
PEEK: Context Map as an Orientation Cache for Long-Context LLM Agents
di: Gu, Zhuohan, et al.
Pubblicazione: (2026)
di: Gu, Zhuohan, et al.
Pubblicazione: (2026)
Latent Context Compilation: Distilling Long Context into Compact Portable Memory
di: Li, Zeju, et al.
Pubblicazione: (2026)
di: Li, Zeju, et al.
Pubblicazione: (2026)
Understand Then Memory: A Cognitive Gist-Driven RAG Framework with Global Semantic Diffusion
di: Zhou, Pengcheng, et al.
Pubblicazione: (2026)
di: Zhou, Pengcheng, et al.
Pubblicazione: (2026)
The Dynamic Gist-Based Memory Model (DGMM): A Memory-Centric Architecture for Artificial Intelligence
di: Dorsey, Terry, et al.
Pubblicazione: (2026)
di: Dorsey, Terry, et al.
Pubblicazione: (2026)
Overflow Prevention Enhances Long-Context Recurrent LLMs
di: Ben-Kish, Assaf, et al.
Pubblicazione: (2025)
di: Ben-Kish, Assaf, et al.
Pubblicazione: (2025)
Breaking the Context Bottleneck on Long Time Series Forecasting
di: Ma, Chao, et al.
Pubblicazione: (2024)
di: Ma, Chao, et al.
Pubblicazione: (2024)
Longer Context, Deeper Thinking: Uncovering the Role of Long-Context Ability in Reasoning
di: Yang, Wang, et al.
Pubblicazione: (2025)
di: Yang, Wang, et al.
Pubblicazione: (2025)
The Impossibility Triangle of Long-Context Modeling
di: Zhou, Yan
Pubblicazione: (2026)
di: Zhou, Yan
Pubblicazione: (2026)
No Mean Feat: Simple, Strong Baselines for Context Compression
di: Feldman, Yair, et al.
Pubblicazione: (2025)
di: Feldman, Yair, et al.
Pubblicazione: (2025)
LongSafety: Enhance Safety for Long-Context LLMs
di: Huang, Mianqiu, et al.
Pubblicazione: (2024)
di: Huang, Mianqiu, et al.
Pubblicazione: (2024)
RMAAT: Astrocyte-Inspired Memory Compression and Replay for Efficient Long-Context Transformers
di: Mia, Md Zesun Ahmed, et al.
Pubblicazione: (2026)
di: Mia, Md Zesun Ahmed, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Continual HyperTransformer: A Meta-Learner for Continual Few-Shot Learning
di: Vladymyrov, Max, et al.
Pubblicazione: (2023) -
Learning and Unlearning of Fabricated Knowledge in Language Models
di: Sun, Chen, et al.
Pubblicazione: (2024) -
Contextually Guided Transformers via Low-Rank Adaptation
di: Zhmoginov, Andrey, et al.
Pubblicazione: (2025) -
Narrowing the Focus: Learned Optimizers for Pretrained Models
di: Kristiansen, Gus, et al.
Pubblicazione: (2024) -
MELODI: Exploring Memory Compression for Long Contexts
di: Chen, Yinpeng, et al.
Pubblicazione: (2024)