Position IDs Matter: An Enhanced Position Layout for Efficient Context Compression in Large Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhao, Runsong, Liu, Xin, Liu, Xinyu, Huang, Pengcheng, Xiao, Chunyang, Xiao, Tong, Zhu, Jingbo |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Autoencoding-Free Context Compression for LLMs via Contextual Semantic Anchors
por: Liu, Xin, et al.
Publicado: (2025)
por: Liu, Xin, et al.
Publicado: (2025)
Forgetting Curve: A Reliable Method for Evaluating Memorization Capability for Long-context Models
por: Liu, Xinyu, et al.
Publicado: (2024)
por: Liu, Xinyu, et al.
Publicado: (2024)
PoC: Performance-oriented Context Compression for Large Language Models via Performance Prediction
por: Zhao, Runsong, et al.
Publicado: (2026)
por: Zhao, Runsong, et al.
Publicado: (2026)
Translate-and-Revise: Boosting Large Language Models for Constrained Translation
por: Huang, Pengcheng, et al.
Publicado: (2024)
por: Huang, Pengcheng, et al.
Publicado: (2024)
MemoSight: Unifying Context Compression and Multi Token Prediction for Reasoning Acceleration
por: Liu, Xinyu, et al.
Publicado: (2026)
por: Liu, Xinyu, et al.
Publicado: (2026)
Foundations of Large Language Models
por: Xiao, Tong, et al.
Publicado: (2025)
por: Xiao, Tong, et al.
Publicado: (2025)
Language-Specific Layer Matters: Efficient Multilingual Enhancement for Large Vision-Language Models
por: Fan, Yuchun, et al.
Publicado: (2025)
por: Fan, Yuchun, et al.
Publicado: (2025)
Efficient Prompting Methods for Large Language Models: A Survey
por: Chang, Kaiyan, et al.
Publicado: (2024)
por: Chang, Kaiyan, et al.
Publicado: (2024)
Beyond Position Bias: Shifting Context Compression from Position-Driven to Semantic-Driven
por: Tang, Jiwei, et al.
Publicado: (2026)
por: Tang, Jiwei, et al.
Publicado: (2026)
MTP-S2UT: Enhancing Speech-to-Speech Translation Quality with Multi-token Prediction
por: Wang, Jianjin, et al.
Publicado: (2025)
por: Wang, Jianjin, et al.
Publicado: (2025)
Exploring Context Window of Large Language Models via Decomposed Positional Vectors
por: Dong, Zican, et al.
Publicado: (2024)
por: Dong, Zican, et al.
Publicado: (2024)
An Efficient Recipe for Long Context Extension via Middle-Focused Positional Encoding
por: Wu, Tong, et al.
Publicado: (2024)
por: Wu, Tong, et al.
Publicado: (2024)
Hybrid Alignment Training for Large Language Models
por: Wang, Chenglong, et al.
Publicado: (2024)
por: Wang, Chenglong, et al.
Publicado: (2024)
Prior Constraints-based Reward Model Training for Aligning Large Language Models
por: Zhou, Hang, et al.
Publicado: (2024)
por: Zhou, Hang, et al.
Publicado: (2024)
Attention Basin: Why Contextual Position Matters in Large Language Models
por: Yi, Zihao, et al.
Publicado: (2025)
por: Yi, Zihao, et al.
Publicado: (2025)
Data Distribution Matters: A Data-Centric Perspective on Context Compression for Large Language Model
por: Lv, Kangtao, et al.
Publicado: (2026)
por: Lv, Kangtao, et al.
Publicado: (2026)
EIT: Enhanced Interactive Transformer
por: Zheng, Tong, et al.
Publicado: (2022)
por: Zheng, Tong, et al.
Publicado: (2022)
Teaching Language Models to Self-Improve by Learning from Language Feedback
por: Hu, Chi, et al.
Publicado: (2024)
por: Hu, Chi, et al.
Publicado: (2024)
Learning Evaluation Models from Large Language Models for Sequence Generation
por: Wang, Chenglong, et al.
Publicado: (2023)
por: Wang, Chenglong, et al.
Publicado: (2023)
In-Context Former: Lightning-fast Compressing Context for Large Language Model
por: Wang, Xiangfeng, et al.
Publicado: (2024)
por: Wang, Xiangfeng, et al.
Publicado: (2024)
StyleBench: Evaluating Speech Language Models on Conversational Speaking Style Control
por: Zhao, Haishu, et al.
Publicado: (2026)
por: Zhao, Haishu, et al.
Publicado: (2026)
InfoMerge: Information-aware Token Compression for Efficient Video Large Language Models
por: Liu, Xinxin, et al.
Publicado: (2026)
por: Liu, Xinxin, et al.
Publicado: (2026)
The Role of Diversity in In-Context Learning for Large Language Models
por: Xiao, Wenyang, et al.
Publicado: (2025)
por: Xiao, Wenyang, et al.
Publicado: (2025)
A Comprehensive Survey of Large Language Models and Multimodal Large Language Models in Medicine
por: Xiao, Hanguang, et al.
Publicado: (2024)
por: Xiao, Hanguang, et al.
Publicado: (2024)
Read As Human: Compressing Context via Parallelizable Close Reading and Skimming
por: Tang, Jiwei, et al.
Publicado: (2026)
por: Tang, Jiwei, et al.
Publicado: (2026)
FlashBack:Efficient Retrieval-Augmented Language Modeling for Long Context Inference
por: Liu, Runheng, et al.
Publicado: (2024)
por: Liu, Runheng, et al.
Publicado: (2024)
Towards Position-Robust Talent Recommendation via Large Language Models
por: Du, Silin, et al.
Publicado: (2026)
por: Du, Silin, et al.
Publicado: (2026)
Beyond Decoder-only: Large Language Models Can be Good Encoders for Machine Translation
por: Luo, Yingfeng, et al.
Publicado: (2025)
por: Luo, Yingfeng, et al.
Publicado: (2025)
Enhancing Aspect-based Sentiment Analysis in Tourism Using Large Language Models and Positional Information
por: Xu, Chun, et al.
Publicado: (2024)
por: Xu, Chun, et al.
Publicado: (2024)
LLMsPark: A Benchmark for Evaluating Large Language Models in Strategic Gaming Contexts
por: Chen, Junhao, et al.
Publicado: (2025)
por: Chen, Junhao, et al.
Publicado: (2025)
IIET: Efficient Numerical Transformer via Implicit Iterative Euler Method
por: Liu, Xinyu, et al.
Publicado: (2025)
por: Liu, Xinyu, et al.
Publicado: (2025)
RePo: Language Models with Context Re-Positioning
por: Li, Huayang, et al.
Publicado: (2025)
por: Li, Huayang, et al.
Publicado: (2025)
Flexibly Scaling Large Language Models Contexts Through Extensible Tokenization
por: Shao, Ninglu, et al.
Publicado: (2024)
por: Shao, Ninglu, et al.
Publicado: (2024)
Revealing the Parallel Multilingual Learning within Large Language Models
por: Mu, Yongyu, et al.
Publicado: (2024)
por: Mu, Yongyu, et al.
Publicado: (2024)
Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models
por: Chang, Kaiyan, et al.
Publicado: (2025)
por: Chang, Kaiyan, et al.
Publicado: (2025)
EfficientGraph-RAG: Structured Retrieval-State Management for Cross-Task Retrieval-Augmented Generation
por: Niu, Miaohe, et al.
Publicado: (2026)
por: Niu, Miaohe, et al.
Publicado: (2026)
DREAMSTATE: Diffusing States and Parameters for Recurrent Large Language Models
por: Xiao, Liu
Publicado: (2026)
por: Xiao, Liu
Publicado: (2026)
Causal Autoregressive Diffusion Language Model
por: Ruan, Junhao, et al.
Publicado: (2026)
por: Ruan, Junhao, et al.
Publicado: (2026)
Mitigating Posterior Salience Attenuation in Long-Context LLMs with Positional Contrastive Decoding
por: Xiao, Zikai, et al.
Publicado: (2025)
por: Xiao, Zikai, et al.
Publicado: (2025)
Serial Position Effects of Large Language Models
por: Guo, Xiaobo, et al.
Publicado: (2024)
por: Guo, Xiaobo, et al.
Publicado: (2024)
Ejemplares similares
-
Autoencoding-Free Context Compression for LLMs via Contextual Semantic Anchors
por: Liu, Xin, et al.
Publicado: (2025) -
Forgetting Curve: A Reliable Method for Evaluating Memorization Capability for Long-context Models
por: Liu, Xinyu, et al.
Publicado: (2024) -
PoC: Performance-oriented Context Compression for Large Language Models via Performance Prediction
por: Zhao, Runsong, et al.
Publicado: (2026) -
Translate-and-Revise: Boosting Large Language Models for Constrained Translation
por: Huang, Pengcheng, et al.
Publicado: (2024) -
MemoSight: Unifying Context Compression and Multi Token Prediction for Reasoning Acceleration
por: Liu, Xinyu, et al.
Publicado: (2026)