Jordan-RoPE: Non-Semisimple Relative Positional Encoding via Complex Jordan Blocks
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Zhang, Yaobo |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Circuit Complexity Bounds for RoPE-based Transformer Architecture
par: Chen, Bo, et autres
Publié: (2024)
par: Chen, Bo, et autres
Publié: (2024)
Frayed RoPE and Long Inputs: A Geometric Perspective
par: Wertheimer, Davis, et autres
Publié: (2026)
par: Wertheimer, Davis, et autres
Publié: (2026)
RoPE Distinguishes Neither Positions Nor Tokens in Long Contexts, Provably
par: Du, Yufeng, et autres
Publié: (2026)
par: Du, Yufeng, et autres
Publié: (2026)
Demystifying the Slash Pattern in Attention: The Role of RoPE
par: Cheng, Yuan, et autres
Publié: (2026)
par: Cheng, Yuan, et autres
Publié: (2026)
Fractional Rotation, Full Potential? Investigating Performance and Convergence of Partial RoPE
par: Khan, Mohammad Aflah, et autres
Publié: (2026)
par: Khan, Mohammad Aflah, et autres
Publié: (2026)
RoPE Attention Can Be Trained in Almost Linear Time
par: Cao, Yang, et autres
Publié: (2024)
par: Cao, Yang, et autres
Publié: (2024)
Rotary Positional Embeddings as Phase Modulation: Theoretical Bounds on the RoPE Base for Long-Context Transformers
par: Liu, Feilong
Publié: (2026)
par: Liu, Feilong
Publié: (2026)
CoPE: Clipped RoPE as A Scalable Free Lunch for Long Context LLMs
par: Li, Haoran, et autres
Publié: (2026)
par: Li, Haoran, et autres
Publié: (2026)
Theoretical Constraints on the Expressive Power of $\mathsf{RoPE}$-based Tensor Attention Transformers
par: Li, Xiaoyu, et autres
Publié: (2024)
par: Li, Xiaoyu, et autres
Publié: (2024)
EliteKV: Scalable KV Cache Compression via RoPE Frequency Selection and Joint Low-Rank Projection
par: Zhou, Yuhao, et autres
Publié: (2025)
par: Zhou, Yuhao, et autres
Publié: (2025)
RoPE-LIME: RoPE-Space Locality + Sparse-K Sampling for Efficient LLM Attribution
par: Picov, Isaac, et autres
Publié: (2026)
par: Picov, Isaac, et autres
Publié: (2026)
Base of RoPE Bounds Context Length
par: Men, Xin, et autres
Publié: (2024)
par: Men, Xin, et autres
Publié: (2024)
Scaling Laws of RoPE-based Extrapolation
par: Liu, Xiaoran, et autres
Publié: (2023)
par: Liu, Xiaoran, et autres
Publié: (2023)
Periodic RoPE for Infinite Context LLMs
par: Huo, Simin
Publié: (2026)
par: Huo, Simin
Publié: (2026)
Rethinking RoPE: A Mathematical Blueprint for N-dimensional Positional Embedding
par: Liu, Haiping, et autres
Publié: (2025)
par: Liu, Haiping, et autres
Publié: (2025)
Learning the RoPEs: Better 2D and 3D Position Encodings with STRING
par: Schenck, Connor, et autres
Publié: (2025)
par: Schenck, Connor, et autres
Publié: (2025)
Understanding the RoPE Extensions of Long-Context LLMs: An Attention Perspective
par: Zhong, Meizhi, et autres
Publié: (2024)
par: Zhong, Meizhi, et autres
Publié: (2024)
SeqPE: Transformer with Sequential Position Encoding
par: Li, Huayang, et autres
Publié: (2025)
par: Li, Huayang, et autres
Publié: (2025)
RoPeSLR: 3D RoPE-driven Sparse-LowRank Attention for Efficient Diffusion Transformers
par: Liu, Yuxi, et autres
Publié: (2026)
par: Liu, Yuxi, et autres
Publié: (2026)
RAP: KV-Cache Compression via RoPE-Aligned Pruning
par: Xin, Jihao, et autres
Publié: (2026)
par: Xin, Jihao, et autres
Publié: (2026)
RoPECraft: Training-Free Motion Transfer with Trajectory-Guided RoPE Optimization on Diffusion Transformers
par: Gokmen, Ahmet Berke, et autres
Publié: (2025)
par: Gokmen, Ahmet Berke, et autres
Publié: (2025)
When Precision Meets Position: BFloat16 Breaks Down RoPE in Long-Context Training
par: Wang, Haonan, et autres
Publié: (2024)
par: Wang, Haonan, et autres
Publié: (2024)
LinearARD: Linear-Memory Attention Distillation for RoPE Restoration
par: Yang, Ning, et autres
Publié: (2026)
par: Yang, Ning, et autres
Publié: (2026)
ID-Align: RoPE-Conscious Position Remapping for Dynamic High-Resolution Adaptation in Vision-Language Models
par: Li, Bozhou, et autres
Publié: (2025)
par: Li, Bozhou, et autres
Publié: (2025)
Positional versus Symbolic Attention Heads: Learning Dynamics, RoPE Geometry, and Length Generalization
par: Urrutia, Felipe, et autres
Publié: (2026)
par: Urrutia, Felipe, et autres
Publié: (2026)
RayRoPE: Projective Ray Positional Encoding for Multi-view Attention
par: Wu, Yu, et autres
Publié: (2026)
par: Wu, Yu, et autres
Publié: (2026)
PoPE: Legendre Orthogonal Polynomials Based Position Encoding for Large Language Models
par: Aggarwal, Arpit
Publié: (2024)
par: Aggarwal, Arpit
Publié: (2024)
Shuffle the Context: RoPE-Perturbed Self-Distillation for Long-Context Adaptation
par: Li, Zichong, et autres
Publié: (2026)
par: Li, Zichong, et autres
Publié: (2026)
On the token distance modeling ability of higher RoPE attention dimension
par: Hong, Xiangyu, et autres
Publié: (2024)
par: Hong, Xiangyu, et autres
Publié: (2024)
ReRoPE: Repurposing RoPE for Relative Camera Control
par: Li, Chunyang, et autres
Publié: (2026)
par: Li, Chunyang, et autres
Publié: (2026)
Q-ROAR: Outlier-Aware Rescaling for RoPE Position Interpolation in Quantized Long-Context LLMs
par: Qiao, Ye, et autres
Publié: (2025)
par: Qiao, Ye, et autres
Publié: (2025)
Resonance RoPE: Improving Context Length Generalization of Large Language Models
par: Wang, Suyuchen, et autres
Publié: (2024)
par: Wang, Suyuchen, et autres
Publié: (2024)
On the Geometry of Positional Encodings in Transformers
par: Cirrincione, Giansalvo
Publié: (2026)
par: Cirrincione, Giansalvo
Publié: (2026)
HoPE: A Novel Positional Encoding Without Long-Term Decay for Enhanced Context Awareness and Extrapolation
par: Chen, Yuhan, et autres
Publié: (2024)
par: Chen, Yuhan, et autres
Publié: (2024)
RoSA: Enhancing Parameter-Efficient Fine-Tuning via RoPE-aware Selective Adaptation in Large Language Models
par: Pan, Dayan, et autres
Publié: (2025)
par: Pan, Dayan, et autres
Publié: (2025)
Position Information Emerges in Causal Transformers Without Positional Encodings via Similarity of Nearby Embeddings
par: Zuo, Chunsheng, et autres
Publié: (2024)
par: Zuo, Chunsheng, et autres
Publié: (2024)
PaTH Attention: Position Encoding via Accumulating Householder Transformations
par: Yang, Songlin, et autres
Publié: (2025)
par: Yang, Songlin, et autres
Publié: (2025)
RoBERTurk: Adjusting RoBERTa for Turkish
par: Tas, Nuri
Publié: (2024)
par: Tas, Nuri
Publié: (2024)
Fast RoPE Attention: Combining the Polynomial Method and Fast Fourier Transform
par: Alman, Josh, et autres
Publié: (2025)
par: Alman, Josh, et autres
Publié: (2025)
Group Representational Position Encoding
par: Zhang, Yifan, et autres
Publié: (2025)
par: Zhang, Yifan, et autres
Publié: (2025)
Documents similaires
-
Circuit Complexity Bounds for RoPE-based Transformer Architecture
par: Chen, Bo, et autres
Publié: (2024) -
Frayed RoPE and Long Inputs: A Geometric Perspective
par: Wertheimer, Davis, et autres
Publié: (2026) -
RoPE Distinguishes Neither Positions Nor Tokens in Long Contexts, Provably
par: Du, Yufeng, et autres
Publié: (2026) -
Demystifying the Slash Pattern in Attention: The Role of RoPE
par: Cheng, Yuan, et autres
Publié: (2026) -
Fractional Rotation, Full Potential? Investigating Performance and Convergence of Partial RoPE
par: Khan, Mohammad Aflah, et autres
Publié: (2026)