YaRN: Efficient Context Window Extension of Large Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Peng, Bowen, Quesnelle, Jeffrey, Fan, Honglu, Shippole, Enrico |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Sliding Window Attention Training for Efficient Large Language Models
por: Fu, Zichuan, et al.
Publicado: (2025)
por: Fu, Zichuan, et al.
Publicado: (2025)
From 128K to 4M: Efficient Training of Ultra-Long Context Large Language Models
por: Xu, Chejian, et al.
Publicado: (2025)
por: Xu, Chejian, et al.
Publicado: (2025)
Training-Free Exponential Context Extension via Cascading KV Cache
por: Willette, Jeffrey, et al.
Publicado: (2024)
por: Willette, Jeffrey, et al.
Publicado: (2024)
EfficientQAT: Efficient Quantization-Aware Training for Large Language Models
por: Chen, Mengzhao, et al.
Publicado: (2024)
por: Chen, Mengzhao, et al.
Publicado: (2024)
Scalable Efficient Training of Large Language Models with Low-dimensional Projected Attention
por: Lv, Xingtai, et al.
Publicado: (2024)
por: Lv, Xingtai, et al.
Publicado: (2024)
LongLoRA: Efficient Fine-tuning of Long-Context Large Language Models
por: Chen, Yukang, et al.
Publicado: (2023)
por: Chen, Yukang, et al.
Publicado: (2023)
Disentangling Logic: The Role of Context in Large Language Model Reasoning Capabilities
por: Hua, Wenyue, et al.
Publicado: (2024)
por: Hua, Wenyue, et al.
Publicado: (2024)
LaCache: Ladder-Shaped KV Caching for Efficient Long-Context Modeling of Large Language Models
por: Shi, Dachuan, et al.
Publicado: (2025)
por: Shi, Dachuan, et al.
Publicado: (2025)
Large Language Models are Miscalibrated In-Context Learners
por: Li, Chengzu, et al.
Publicado: (2023)
por: Li, Chengzu, et al.
Publicado: (2023)
ACER: Automatic Language Model Context Extension via Retrieval
por: Gao, Luyu, et al.
Publicado: (2024)
por: Gao, Luyu, et al.
Publicado: (2024)
Learn To be Efficient: Build Structured Sparsity in Large Language Models
por: Zheng, Haizhong, et al.
Publicado: (2024)
por: Zheng, Haizhong, et al.
Publicado: (2024)
BESA: Pruning Large Language Models with Blockwise Parameter-Efficient Sparsity Allocation
por: Xu, Peng, et al.
Publicado: (2024)
por: Xu, Peng, et al.
Publicado: (2024)
The Role of Diversity in In-Context Learning for Large Language Models
por: Xiao, Wenyang, et al.
Publicado: (2025)
por: Xiao, Wenyang, et al.
Publicado: (2025)
In-context Autoencoder for Context Compression in a Large Language Model
por: Ge, Tao, et al.
Publicado: (2023)
por: Ge, Tao, et al.
Publicado: (2023)
An Experimental Design Framework for Label-Efficient Supervised Finetuning of Large Language Models
por: Bhatt, Gantavya, et al.
Publicado: (2024)
por: Bhatt, Gantavya, et al.
Publicado: (2024)
On Prompt-Driven Safeguarding for Large Language Models
por: Zheng, Chujie, et al.
Publicado: (2024)
por: Zheng, Chujie, et al.
Publicado: (2024)
ContextFocus: Activation Steering for Contextual Faithfulness in Large Language Models
por: Anand, Nikhil, et al.
Publicado: (2026)
por: Anand, Nikhil, et al.
Publicado: (2026)
Uncovering Emergent Physics Representations Learned In-Context by Large Language Models
por: Song, Yeongwoo, et al.
Publicado: (2025)
por: Song, Yeongwoo, et al.
Publicado: (2025)
Manifold-based Sampling for In-Context Hallucination Detection in Large Language Models
por: Vamshi, Bodla Krishna, et al.
Publicado: (2026)
por: Vamshi, Bodla Krishna, et al.
Publicado: (2026)
EfficientLLM: Efficiency in Large Language Models
por: Yuan, Zhengqing, et al.
Publicado: (2025)
por: Yuan, Zhengqing, et al.
Publicado: (2025)
Large Language Model Unlearning via Embedding-Corrupted Prompts
por: Liu, Chris Yuhao, et al.
Publicado: (2024)
por: Liu, Chris Yuhao, et al.
Publicado: (2024)
Retrieval meets Long Context Large Language Models
por: Xu, Peng, et al.
Publicado: (2023)
por: Xu, Peng, et al.
Publicado: (2023)
SelfCite: Self-Supervised Alignment for Context Attribution in Large Language Models
por: Chuang, Yung-Sung, et al.
Publicado: (2025)
por: Chuang, Yung-Sung, et al.
Publicado: (2025)
Understanding Subword Compositionality of Large Language Models
por: Peng, Qiwei, et al.
Publicado: (2025)
por: Peng, Qiwei, et al.
Publicado: (2025)
Token-Efficient Leverage Learning in Large Language Models
por: Zeng, Yuanhao, et al.
Publicado: (2024)
por: Zeng, Yuanhao, et al.
Publicado: (2024)
SmallToLarge (S2L): Scalable Data Selection for Fine-tuning Large Language Models by Summarizing Training Trajectories of Small Models
por: Yang, Yu, et al.
Publicado: (2024)
por: Yang, Yu, et al.
Publicado: (2024)
Large Language Models Are Latent Variable Models: Explaining and Finding Good Demonstrations for In-Context Learning
por: Wang, Xinyi, et al.
Publicado: (2023)
por: Wang, Xinyi, et al.
Publicado: (2023)
MOM: Memory-Efficient Offloaded Mini-Sequence Inference for Long Context Language Models
por: Zhang, Junyang, et al.
Publicado: (2025)
por: Zhang, Junyang, et al.
Publicado: (2025)
LLM Maybe LongLM: Self-Extend LLM Context Window Without Tuning
por: Jin, Hongye, et al.
Publicado: (2024)
por: Jin, Hongye, et al.
Publicado: (2024)
Revisiting In-Context Learning with Long Context Language Models
por: Baek, Jinheon, et al.
Publicado: (2024)
por: Baek, Jinheon, et al.
Publicado: (2024)
Benchmarking Benchmark Leakage in Large Language Models
por: Xu, Ruijie, et al.
Publicado: (2024)
por: Xu, Ruijie, et al.
Publicado: (2024)
RAVEN: In-Context Learning with Retrieval-Augmented Encoder-Decoder Language Models
por: Huang, Jie, et al.
Publicado: (2023)
por: Huang, Jie, et al.
Publicado: (2023)
Diagnosing Retrieval Bias Under Multiple In-Context Knowledge Updates in Large Language Models
por: Qiao, Boyu, et al.
Publicado: (2026)
por: Qiao, Boyu, et al.
Publicado: (2026)
DynaSpec: Context-aware Dynamic Speculative Sampling for Large-Vocabulary Language Models
por: Zhang, Jinbin, et al.
Publicado: (2025)
por: Zhang, Jinbin, et al.
Publicado: (2025)
Self-Evolving Critique Abilities in Large Language Models
por: Tang, Zhengyang, et al.
Publicado: (2025)
por: Tang, Zhengyang, et al.
Publicado: (2025)
Breach in the Shield: Unveiling the Vulnerabilities of Large Language Models
por: Dai, Runpeng, et al.
Publicado: (2025)
por: Dai, Runpeng, et al.
Publicado: (2025)
Federated Data-Efficient Instruction Tuning for Large Language Models
por: Qin, Zhen, et al.
Publicado: (2024)
por: Qin, Zhen, et al.
Publicado: (2024)
An Efficient Inference Framework for Early-exit Large Language Models
por: Miao, Ruijie, et al.
Publicado: (2024)
por: Miao, Ruijie, et al.
Publicado: (2024)
Efficient Compositional Multi-tasking for On-device Large Language Models
por: Bohdal, Ondrej, et al.
Publicado: (2025)
por: Bohdal, Ondrej, et al.
Publicado: (2025)
Crafting Efficient Fine-Tuning Strategies for Large Language Models
por: Oliver, Michael, et al.
Publicado: (2024)
por: Oliver, Michael, et al.
Publicado: (2024)
Ejemplares similares
-
Sliding Window Attention Training for Efficient Large Language Models
por: Fu, Zichuan, et al.
Publicado: (2025) -
From 128K to 4M: Efficient Training of Ultra-Long Context Large Language Models
por: Xu, Chejian, et al.
Publicado: (2025) -
Training-Free Exponential Context Extension via Cascading KV Cache
por: Willette, Jeffrey, et al.
Publicado: (2024) -
EfficientQAT: Efficient Quantization-Aware Training for Large Language Models
por: Chen, Mengzhao, et al.
Publicado: (2024) -
Scalable Efficient Training of Large Language Models with Low-dimensional Projected Attention
por: Lv, Xingtai, et al.
Publicado: (2024)