Position IDs Matter: An Enhanced Position Layout for Efficient Context Compression in Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhao, Runsong, Liu, Xin, Liu, Xinyu, Huang, Pengcheng, Xiao, Chunyang, Xiao, Tong, Zhu, Jingbo |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Autoencoding-Free Context Compression for LLMs via Contextual Semantic Anchors
par: Liu, Xin, et autres
Publié: (2025)
par: Liu, Xin, et autres
Publié: (2025)
Forgetting Curve: A Reliable Method for Evaluating Memorization Capability for Long-context Models
par: Liu, Xinyu, et autres
Publié: (2024)
par: Liu, Xinyu, et autres
Publié: (2024)
PoC: Performance-oriented Context Compression for Large Language Models via Performance Prediction
par: Zhao, Runsong, et autres
Publié: (2026)
par: Zhao, Runsong, et autres
Publié: (2026)
Translate-and-Revise: Boosting Large Language Models for Constrained Translation
par: Huang, Pengcheng, et autres
Publié: (2024)
par: Huang, Pengcheng, et autres
Publié: (2024)
MemoSight: Unifying Context Compression and Multi Token Prediction for Reasoning Acceleration
par: Liu, Xinyu, et autres
Publié: (2026)
par: Liu, Xinyu, et autres
Publié: (2026)
Foundations of Large Language Models
par: Xiao, Tong, et autres
Publié: (2025)
par: Xiao, Tong, et autres
Publié: (2025)
Language-Specific Layer Matters: Efficient Multilingual Enhancement for Large Vision-Language Models
par: Fan, Yuchun, et autres
Publié: (2025)
par: Fan, Yuchun, et autres
Publié: (2025)
Efficient Prompting Methods for Large Language Models: A Survey
par: Chang, Kaiyan, et autres
Publié: (2024)
par: Chang, Kaiyan, et autres
Publié: (2024)
Beyond Position Bias: Shifting Context Compression from Position-Driven to Semantic-Driven
par: Tang, Jiwei, et autres
Publié: (2026)
par: Tang, Jiwei, et autres
Publié: (2026)
MTP-S2UT: Enhancing Speech-to-Speech Translation Quality with Multi-token Prediction
par: Wang, Jianjin, et autres
Publié: (2025)
par: Wang, Jianjin, et autres
Publié: (2025)
Exploring Context Window of Large Language Models via Decomposed Positional Vectors
par: Dong, Zican, et autres
Publié: (2024)
par: Dong, Zican, et autres
Publié: (2024)
An Efficient Recipe for Long Context Extension via Middle-Focused Positional Encoding
par: Wu, Tong, et autres
Publié: (2024)
par: Wu, Tong, et autres
Publié: (2024)
Hybrid Alignment Training for Large Language Models
par: Wang, Chenglong, et autres
Publié: (2024)
par: Wang, Chenglong, et autres
Publié: (2024)
Prior Constraints-based Reward Model Training for Aligning Large Language Models
par: Zhou, Hang, et autres
Publié: (2024)
par: Zhou, Hang, et autres
Publié: (2024)
Attention Basin: Why Contextual Position Matters in Large Language Models
par: Yi, Zihao, et autres
Publié: (2025)
par: Yi, Zihao, et autres
Publié: (2025)
Data Distribution Matters: A Data-Centric Perspective on Context Compression for Large Language Model
par: Lv, Kangtao, et autres
Publié: (2026)
par: Lv, Kangtao, et autres
Publié: (2026)
EIT: Enhanced Interactive Transformer
par: Zheng, Tong, et autres
Publié: (2022)
par: Zheng, Tong, et autres
Publié: (2022)
Teaching Language Models to Self-Improve by Learning from Language Feedback
par: Hu, Chi, et autres
Publié: (2024)
par: Hu, Chi, et autres
Publié: (2024)
Learning Evaluation Models from Large Language Models for Sequence Generation
par: Wang, Chenglong, et autres
Publié: (2023)
par: Wang, Chenglong, et autres
Publié: (2023)
In-Context Former: Lightning-fast Compressing Context for Large Language Model
par: Wang, Xiangfeng, et autres
Publié: (2024)
par: Wang, Xiangfeng, et autres
Publié: (2024)
StyleBench: Evaluating Speech Language Models on Conversational Speaking Style Control
par: Zhao, Haishu, et autres
Publié: (2026)
par: Zhao, Haishu, et autres
Publié: (2026)
InfoMerge: Information-aware Token Compression for Efficient Video Large Language Models
par: Liu, Xinxin, et autres
Publié: (2026)
par: Liu, Xinxin, et autres
Publié: (2026)
The Role of Diversity in In-Context Learning for Large Language Models
par: Xiao, Wenyang, et autres
Publié: (2025)
par: Xiao, Wenyang, et autres
Publié: (2025)
A Comprehensive Survey of Large Language Models and Multimodal Large Language Models in Medicine
par: Xiao, Hanguang, et autres
Publié: (2024)
par: Xiao, Hanguang, et autres
Publié: (2024)
Read As Human: Compressing Context via Parallelizable Close Reading and Skimming
par: Tang, Jiwei, et autres
Publié: (2026)
par: Tang, Jiwei, et autres
Publié: (2026)
FlashBack:Efficient Retrieval-Augmented Language Modeling for Long Context Inference
par: Liu, Runheng, et autres
Publié: (2024)
par: Liu, Runheng, et autres
Publié: (2024)
Towards Position-Robust Talent Recommendation via Large Language Models
par: Du, Silin, et autres
Publié: (2026)
par: Du, Silin, et autres
Publié: (2026)
Beyond Decoder-only: Large Language Models Can be Good Encoders for Machine Translation
par: Luo, Yingfeng, et autres
Publié: (2025)
par: Luo, Yingfeng, et autres
Publié: (2025)
Enhancing Aspect-based Sentiment Analysis in Tourism Using Large Language Models and Positional Information
par: Xu, Chun, et autres
Publié: (2024)
par: Xu, Chun, et autres
Publié: (2024)
LLMsPark: A Benchmark for Evaluating Large Language Models in Strategic Gaming Contexts
par: Chen, Junhao, et autres
Publié: (2025)
par: Chen, Junhao, et autres
Publié: (2025)
IIET: Efficient Numerical Transformer via Implicit Iterative Euler Method
par: Liu, Xinyu, et autres
Publié: (2025)
par: Liu, Xinyu, et autres
Publié: (2025)
RePo: Language Models with Context Re-Positioning
par: Li, Huayang, et autres
Publié: (2025)
par: Li, Huayang, et autres
Publié: (2025)
Flexibly Scaling Large Language Models Contexts Through Extensible Tokenization
par: Shao, Ninglu, et autres
Publié: (2024)
par: Shao, Ninglu, et autres
Publié: (2024)
Revealing the Parallel Multilingual Learning within Large Language Models
par: Mu, Yongyu, et autres
Publié: (2024)
par: Mu, Yongyu, et autres
Publié: (2024)
Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models
par: Chang, Kaiyan, et autres
Publié: (2025)
par: Chang, Kaiyan, et autres
Publié: (2025)
EfficientGraph-RAG: Structured Retrieval-State Management for Cross-Task Retrieval-Augmented Generation
par: Niu, Miaohe, et autres
Publié: (2026)
par: Niu, Miaohe, et autres
Publié: (2026)
DREAMSTATE: Diffusing States and Parameters for Recurrent Large Language Models
par: Xiao, Liu
Publié: (2026)
par: Xiao, Liu
Publié: (2026)
Causal Autoregressive Diffusion Language Model
par: Ruan, Junhao, et autres
Publié: (2026)
par: Ruan, Junhao, et autres
Publié: (2026)
Mitigating Posterior Salience Attenuation in Long-Context LLMs with Positional Contrastive Decoding
par: Xiao, Zikai, et autres
Publié: (2025)
par: Xiao, Zikai, et autres
Publié: (2025)
Serial Position Effects of Large Language Models
par: Guo, Xiaobo, et autres
Publié: (2024)
par: Guo, Xiaobo, et autres
Publié: (2024)
Documents similaires
-
Autoencoding-Free Context Compression for LLMs via Contextual Semantic Anchors
par: Liu, Xin, et autres
Publié: (2025) -
Forgetting Curve: A Reliable Method for Evaluating Memorization Capability for Long-context Models
par: Liu, Xinyu, et autres
Publié: (2024) -
PoC: Performance-oriented Context Compression for Large Language Models via Performance Prediction
par: Zhao, Runsong, et autres
Publié: (2026) -
Translate-and-Revise: Boosting Large Language Models for Constrained Translation
par: Huang, Pengcheng, et autres
Publié: (2024) -
MemoSight: Unifying Context Compression and Multi Token Prediction for Reasoning Acceleration
par: Liu, Xinyu, et autres
Publié: (2026)