Rotary Offset Features in Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Jonasson, André |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Offset Unlearning for Large Language Models
par: Huang, James Y., et autres
Publié: (2024)
par: Huang, James Y., et autres
Publié: (2024)
Selective Rotary Position Embedding
par: Movahedi, Sajad, et autres
Publié: (2025)
par: Movahedi, Sajad, et autres
Publié: (2025)
Automatically Interpreting Millions of Features in Large Language Models
par: Paulo, Gonçalo, et autres
Publié: (2024)
par: Paulo, Gonçalo, et autres
Publié: (2024)
Semantic Structure of Feature Space in Large Language Models
par: Kozlowski, Austin C., et autres
Publié: (2026)
par: Kozlowski, Austin C., et autres
Publié: (2026)
Persistent Topological Features in Large Language Models
par: Gardinazzi, Yuri, et autres
Publié: (2024)
par: Gardinazzi, Yuri, et autres
Publié: (2024)
Latent Feature Mining for Predictive Model Enhancement with Large Language Models
par: Li, Bingxuan, et autres
Publié: (2024)
par: Li, Bingxuan, et autres
Publié: (2024)
Feature Alignment and Representation Transfer in Knowledge Distillation for Large Language Models
par: Yang, Junjie, et autres
Publié: (2025)
par: Yang, Junjie, et autres
Publié: (2025)
Round and Round We Go! What makes Rotary Positional Encodings useful?
par: Barbero, Federico, et autres
Publié: (2024)
par: Barbero, Federico, et autres
Publié: (2024)
Qwen-Scope: Turning Sparse Features into Development Tools for Large Language Models
par: Deng, Boyi, et autres
Publié: (2026)
par: Deng, Boyi, et autres
Publié: (2026)
Pre-trained Large Language Models Use Fourier Features to Compute Addition
par: Zhou, Tianyi, et autres
Publié: (2024)
par: Zhou, Tianyi, et autres
Publié: (2024)
Narrative Feature or Structured Feature? A Study of Large Language Models to Identify Cancer Patients at Risk of Heart Failure
par: Chen, Ziyi, et autres
Publié: (2024)
par: Chen, Ziyi, et autres
Publié: (2024)
The Birth of Knowledge: Emergent Features across Time, Space, and Scale in Large Language Models
par: Sawmya, Shashata, et autres
Publié: (2025)
par: Sawmya, Shashata, et autres
Publié: (2025)
LLM-Select: Feature Selection with Large Language Models
par: Jeong, Daniel P., et autres
Publié: (2024)
par: Jeong, Daniel P., et autres
Publié: (2024)
The Rotary Position Embedding May Cause Dimension Inefficiency in Attention Heads for Long-Distance Retrieval
par: Chiang, Ting-Rui, et autres
Publié: (2025)
par: Chiang, Ting-Rui, et autres
Publié: (2025)
Adaptive Feature-based Low-Rank Compression of Large Language Models via Bayesian Optimization
par: Ji, Yixin, et autres
Publié: (2024)
par: Ji, Yixin, et autres
Publié: (2024)
Direct Preference Optimization with an Offset
par: Amini, Afra, et autres
Publié: (2024)
par: Amini, Afra, et autres
Publié: (2024)
Knowledge-Driven Feature Selection and Engineering for Genotype Data with Large Language Models
par: Lee, Joseph, et autres
Publié: (2024)
par: Lee, Joseph, et autres
Publié: (2024)
Transferring Linear Features Across Language Models With Model Stitching
par: Chen, Alan, et autres
Publié: (2025)
par: Chen, Alan, et autres
Publié: (2025)
Invariant Features in Language Models: Geometric Characterization and Model Attribution
par: Dasgupta, Agnibh, et autres
Publié: (2026)
par: Dasgupta, Agnibh, et autres
Publié: (2026)
Interpretable Steering of Large Language Models with Feature Guided Activation Additions
par: Soo, Samuel, et autres
Publié: (2025)
par: Soo, Samuel, et autres
Publié: (2025)
Language Model Training Paradigms for Clinical Feature Embeddings
par: Hu, Yurong, et autres
Publié: (2023)
par: Hu, Yurong, et autres
Publié: (2023)
On the Thinking-Language Modeling Gap in Large Language Models
par: Liu, Chenxi, et autres
Publié: (2025)
par: Liu, Chenxi, et autres
Publié: (2025)
Large Language Diffusion Models
par: Nie, Shen, et autres
Publié: (2025)
par: Nie, Shen, et autres
Publié: (2025)
ELF-Gym: Evaluating Large Language Models Generated Features for Tabular Prediction
par: Zhang, Yanlin, et autres
Publié: (2024)
par: Zhang, Yanlin, et autres
Publié: (2024)
Analyze Feature Flow to Enhance Interpretation and Steering in Language Models
par: Laptev, Daniil, et autres
Publié: (2025)
par: Laptev, Daniil, et autres
Publié: (2025)
Active Model Selection for Large Language Models
par: Durmazkeser, Yavuz, et autres
Publié: (2025)
par: Durmazkeser, Yavuz, et autres
Publié: (2025)
3-in-1: 2D Rotary Adaptation for Efficient Finetuning, Efficient Batching and Composability
par: Liao, Baohao, et autres
Publié: (2024)
par: Liao, Baohao, et autres
Publié: (2024)
Feature Extraction and Steering for Enhanced Chain-of-Thought Reasoning in Language Models
par: Li, Zihao, et autres
Publié: (2025)
par: Li, Zihao, et autres
Publié: (2025)
Quantifying Feature Space Universality Across Large Language Models via Sparse Autoencoders
par: Lan, Michael, et autres
Publié: (2024)
par: Lan, Michael, et autres
Publié: (2024)
Massive Activations in Large Language Models
par: Sun, Mingjie, et autres
Publié: (2024)
par: Sun, Mingjie, et autres
Publié: (2024)
Confidence in the Reasoning of Large Language Models
par: Pawitan, Yudi, et autres
Publié: (2024)
par: Pawitan, Yudi, et autres
Publié: (2024)
Concept Bottleneck Large Language Models
par: Sun, Chung-En, et autres
Publié: (2024)
par: Sun, Chung-En, et autres
Publié: (2024)
Telecom Language Models: Must They Be Large?
par: Piovesan, Nicola, et autres
Publié: (2024)
par: Piovesan, Nicola, et autres
Publié: (2024)
Function Vectors in Large Language Models
par: Todd, Eric, et autres
Publié: (2023)
par: Todd, Eric, et autres
Publié: (2023)
The Mosaic Memory of Large Language Models
par: Shilov, Igor, et autres
Publié: (2024)
par: Shilov, Igor, et autres
Publié: (2024)
Evaluating Large Language Models with fmeval
par: Schwöbel, Pola, et autres
Publié: (2024)
par: Schwöbel, Pola, et autres
Publié: (2024)
Performance Law of Large Language Models
par: Wu, Chuhan, et autres
Publié: (2024)
par: Wu, Chuhan, et autres
Publié: (2024)
Model Internal Sleuthing: Finding Lexical Identity and Inflectional Features in Modern Language Models
par: Li, Michael, et autres
Publié: (2025)
par: Li, Michael, et autres
Publié: (2025)
Advancing Multi-Step Mathematical Reasoning in Large Language Models through Multi-Layered Self-Reflection with Auto-Prompting
par: Loureiro, André de Souza, et autres
Publié: (2025)
par: Loureiro, André de Souza, et autres
Publié: (2025)
Model Hemorrhage and the Robustness Limits of Large Language Models
par: Ma, Ziyang, et autres
Publié: (2025)
par: Ma, Ziyang, et autres
Publié: (2025)
Documents similaires
-
Offset Unlearning for Large Language Models
par: Huang, James Y., et autres
Publié: (2024) -
Selective Rotary Position Embedding
par: Movahedi, Sajad, et autres
Publié: (2025) -
Automatically Interpreting Millions of Features in Large Language Models
par: Paulo, Gonçalo, et autres
Publié: (2024) -
Semantic Structure of Feature Space in Large Language Models
par: Kozlowski, Austin C., et autres
Publié: (2026) -
Persistent Topological Features in Large Language Models
par: Gardinazzi, Yuri, et autres
Publié: (2024)