PoPE: Legendre Orthogonal Polynomials Based Position Encoding for Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Aggarwal, Arpit |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
RePo: Language Models with Context Re-Positioning
par: Li, Huayang, et autres
Publié: (2025)
par: Li, Huayang, et autres
Publié: (2025)
SeqPE: Transformer with Sequential Position Encoding
par: Li, Huayang, et autres
Publié: (2025)
par: Li, Huayang, et autres
Publié: (2025)
HoPE: A Novel Positional Encoding Without Long-Term Decay for Enhanced Context Awareness and Extrapolation
par: Chen, Yuhan, et autres
Publié: (2024)
par: Chen, Yuhan, et autres
Publié: (2024)
Group Representational Position Encoding
par: Zhang, Yifan, et autres
Publié: (2025)
par: Zhang, Yifan, et autres
Publié: (2025)
Polynomial Composition Activations: Unleashing the Dynamics of Large Language Models
par: Zhuo, Zhijian, et autres
Publié: (2024)
par: Zhuo, Zhijian, et autres
Publié: (2024)
Hierarchical Orthogonal Residual Spread for Precise Massive Editing in Large Language Models
par: Gu, Xiaojie, et autres
Publié: (2026)
par: Gu, Xiaojie, et autres
Publié: (2026)
Position Engineering: Boosting Large Language Models through Positional Information Manipulation
par: He, Zhiyuan, et autres
Publié: (2024)
par: He, Zhiyuan, et autres
Publié: (2024)
Rotary Positional Embeddings as Phase Modulation: Theoretical Bounds on the RoPE Base for Long-Context Transformers
par: Liu, Feilong
Publié: (2026)
par: Liu, Feilong
Publié: (2026)
Fourier Head: Helping Large Language Models Learn Complex Probability Distributions
par: Gillman, Nate, et autres
Publié: (2024)
par: Gillman, Nate, et autres
Publié: (2024)
RoPE Distinguishes Neither Positions Nor Tokens in Long Contexts, Provably
par: Du, Yufeng, et autres
Publié: (2026)
par: Du, Yufeng, et autres
Publié: (2026)
Extracting and Encoding: Leveraging Large Language Models and Medical Knowledge to Enhance Radiological Text Representation
par: Messina, Pablo, et autres
Publié: (2024)
par: Messina, Pablo, et autres
Publié: (2024)
ORION: Teaching Language Models to Reason Efficiently in the Language of Thought
par: Tanmay, Kumar, et autres
Publié: (2025)
par: Tanmay, Kumar, et autres
Publié: (2025)
Group-Aware Reinforcement Learning for Output Diversity in Large Language Models
par: Anschel, Oron, et autres
Publié: (2025)
par: Anschel, Oron, et autres
Publié: (2025)
HoPE: Hyperbolic Rotary Positional Encoding for Stable Long-Range Dependency Modeling in Large Language Models
par: Dai, Chang, et autres
Publié: (2025)
par: Dai, Chang, et autres
Publié: (2025)
Two Stones Hit One Bird: Bilevel Positional Encoding for Better Length Extrapolation
par: He, Zhenyu, et autres
Publié: (2024)
par: He, Zhenyu, et autres
Publié: (2024)
MYTE: Morphology-Driven Byte Encoding for Better and Fairer Multilingual Language Modeling
par: Limisiewicz, Tomasz, et autres
Publié: (2024)
par: Limisiewicz, Tomasz, et autres
Publié: (2024)
L1: Controlling How Long A Reasoning Model Thinks With Reinforcement Learning
par: Aggarwal, Pranjal, et autres
Publié: (2025)
par: Aggarwal, Pranjal, et autres
Publié: (2025)
Needle in the Haystack for Memory Based Large Language Models
par: Nelson, Elliot, et autres
Publié: (2024)
par: Nelson, Elliot, et autres
Publié: (2024)
CoPE: Clipped RoPE as A Scalable Free Lunch for Long Context LLMs
par: Li, Haoran, et autres
Publié: (2026)
par: Li, Haoran, et autres
Publié: (2026)
Sequential Large Language Model-Based Hyper-parameter Optimization
par: Mahammadli, Kanan, et autres
Publié: (2024)
par: Mahammadli, Kanan, et autres
Publié: (2024)
PoTPTQ: A Two-step Power-of-Two Post-training for LLMs
par: Wang, Xinyu, et autres
Publié: (2025)
par: Wang, Xinyu, et autres
Publié: (2025)
Struc-EMB: The Potential of Structure-Aware Encoding in Language Embeddings
par: Liu, Shikun, et autres
Publié: (2025)
par: Liu, Shikun, et autres
Publié: (2025)
Position: Uncertainty Quantification Needs Reassessment for Large-language Model Agents
par: Kirchhof, Michael, et autres
Publié: (2025)
par: Kirchhof, Michael, et autres
Publié: (2025)
From Construction to Injection: Edit-Based Fingerprints for Large Language Models
par: Li, Yue, et autres
Publié: (2025)
par: Li, Yue, et autres
Publié: (2025)
PoPreRo: A New Dataset for Popularity Prediction of Romanian Reddit Posts
par: Rogoz, Ana-Cristina, et autres
Publié: (2024)
par: Rogoz, Ana-Cristina, et autres
Publié: (2024)
Method-Based Reasoning for Large Language Models: Extraction, Reuse, and Continuous Improvement
par: Su, Hong
Publié: (2025)
par: Su, Hong
Publié: (2025)
PhySense: Principle-Based Physics Reasoning Benchmarking for Large Language Models
par: Xu, Yinggan, et autres
Publié: (2025)
par: Xu, Yinggan, et autres
Publié: (2025)
CASCADE: Case-Based Continual Adaptation for Large Language Models During Deployment
par: Guo, Siyuan, et autres
Publié: (2026)
par: Guo, Siyuan, et autres
Publié: (2026)
Self-Supervised Position Debiasing for Large Language Models
par: Liu, Zhongkun, et autres
Publié: (2024)
par: Liu, Zhongkun, et autres
Publié: (2024)
Unraveling LoRA Interference: Orthogonal Subspaces for Robust Model Merging
par: Zhang, Haobo, et autres
Publié: (2025)
par: Zhang, Haobo, et autres
Publié: (2025)
Large Language Model Pruning
par: Huang, Hanjuan, et autres
Publié: (2024)
par: Huang, Hanjuan, et autres
Publié: (2024)
Causality for Large Language Models
par: Wu, Anpeng, et autres
Publié: (2024)
par: Wu, Anpeng, et autres
Publié: (2024)
Large Language Model Unlearning
par: Yao, Yuanshun, et autres
Publié: (2023)
par: Yao, Yuanshun, et autres
Publié: (2023)
Foundations of Large Language Models
par: Xiao, Tong, et autres
Publié: (2025)
par: Xiao, Tong, et autres
Publié: (2025)
Large Language Models as Optimizers
par: Yang, Chengrun, et autres
Publié: (2023)
par: Yang, Chengrun, et autres
Publié: (2023)
BAPO: Base-Anchored Preference Optimization for Overcoming Forgetting in Large Language Models Personalization
par: Lee, Gihun, et autres
Publié: (2024)
par: Lee, Gihun, et autres
Publié: (2024)
Lightweight Retrieval-Augmented Generation and Large Language Model-Based Modeling for Scalable Patient-Trial Matching
par: Li, Xiaodi, et autres
Publié: (2026)
par: Li, Xiaodi, et autres
Publié: (2026)
Demystifying the Slash Pattern in Attention: The Role of RoPE
par: Cheng, Yuan, et autres
Publié: (2026)
par: Cheng, Yuan, et autres
Publié: (2026)
Orthogonal Finetuning for Direct Preference Optimization
par: Yang, Chenxu, et autres
Publié: (2024)
par: Yang, Chenxu, et autres
Publié: (2024)
The Geometries of Truth Are Orthogonal Across Tasks
par: Azizian, Waiss, et autres
Publié: (2025)
par: Azizian, Waiss, et autres
Publié: (2025)
Documents similaires
-
RePo: Language Models with Context Re-Positioning
par: Li, Huayang, et autres
Publié: (2025) -
SeqPE: Transformer with Sequential Position Encoding
par: Li, Huayang, et autres
Publié: (2025) -
HoPE: A Novel Positional Encoding Without Long-Term Decay for Enhanced Context Awareness and Extrapolation
par: Chen, Yuhan, et autres
Publié: (2024) -
Group Representational Position Encoding
par: Zhang, Yifan, et autres
Publié: (2025) -
Polynomial Composition Activations: Unleashing the Dynamics of Large Language Models
par: Zhuo, Zhijian, et autres
Publié: (2024)