On the Geometric Structure of Layer Updates in Deep Language Models
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Yoo, Jun-Sik |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
The Confidence Manifold: Geometric Structure of Correctness Representations in Language Models
par: Cho, Seonglae, et autres
Publié: (2026)
par: Cho, Seonglae, et autres
Publié: (2026)
Layer by Layer: Uncovering Hidden Representations in Language Models
par: Skean, Oscar, et autres
Publié: (2025)
par: Skean, Oscar, et autres
Publié: (2025)
SWEA: Updating Factual Knowledge in Large Language Models via Subject Word Embedding Altering
par: Li, Xiaopeng, et autres
Publié: (2024)
par: Li, Xiaopeng, et autres
Publié: (2024)
ALAS: Autonomous Learning Agent for Self-Updating Language Models
par: Atreja, Dhruv
Publié: (2025)
par: Atreja, Dhruv
Publié: (2025)
LoRAP: Transformer Sub-Layers Deserve Differentiated Structured Compression for Large Language Models
par: Li, Guangyan, et autres
Publié: (2024)
par: Li, Guangyan, et autres
Publié: (2024)
Geometric Interpretation of Layer Normalization and a Comparative Analysis with RMSNorm
par: Gupta, Akshat, et autres
Publié: (2024)
par: Gupta, Akshat, et autres
Publié: (2024)
Peri-LN: Revisiting Normalization Layer in the Transformer Architecture
par: Kim, Jeonghoon, et autres
Publié: (2025)
par: Kim, Jeonghoon, et autres
Publié: (2025)
Sample-aware Adaptive Structured Pruning for Large Language Models
par: Kong, Jun, et autres
Publié: (2025)
par: Kong, Jun, et autres
Publié: (2025)
LayerIF: Estimating Layer Quality for Large Language Models using Influence Functions
par: Askari, Hadi, et autres
Publié: (2025)
par: Askari, Hadi, et autres
Publié: (2025)
Diagnosing Retrieval Bias Under Multiple In-Context Knowledge Updates in Large Language Models
par: Qiao, Boyu, et autres
Publié: (2026)
par: Qiao, Boyu, et autres
Publié: (2026)
Structured Agent Distillation for Large Language Model
par: Liu, Jun, et autres
Publié: (2025)
par: Liu, Jun, et autres
Publié: (2025)
Cross-Layer Discrete Concept Discovery for Interpreting Language Models
par: Garg, Ankur, et autres
Publié: (2025)
par: Garg, Ankur, et autres
Publié: (2025)
Aligning Large Language Models by On-Policy Self-Judgment
par: Lee, Sangkyu, et autres
Publié: (2024)
par: Lee, Sangkyu, et autres
Publié: (2024)
Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models
par: Kongmanee, Jaturong
Publié: (2025)
par: Kongmanee, Jaturong
Publié: (2025)
Understanding Unreliability of Steering Vectors in Language Models: Geometric Predictors and the Limits of Linear Approximations
par: Braun, Joschka
Publié: (2026)
par: Braun, Joschka
Publié: (2026)
Align to Structure: Aligning Large Language Models with Structural Information
par: Kim, Zae Myung, et autres
Publié: (2025)
par: Kim, Zae Myung, et autres
Publié: (2025)
DoLa: Decoding by Contrasting Layers Improves Factuality in Large Language Models
par: Chuang, Yung-Sung, et autres
Publié: (2023)
par: Chuang, Yung-Sung, et autres
Publié: (2023)
Layer Swapping for Zero-Shot Cross-Lingual Transfer in Large Language Models
par: Bandarkar, Lucas, et autres
Publié: (2024)
par: Bandarkar, Lucas, et autres
Publié: (2024)
Active Layer-Contrastive Decoding Reduces Hallucination in Large Language Model Generation
par: Zhang, Hongxiang, et autres
Publié: (2025)
par: Zhang, Hongxiang, et autres
Publié: (2025)
DeepCritic: Deliberate Critique with Large Language Models
par: Yang, Wenkai, et autres
Publié: (2025)
par: Yang, Wenkai, et autres
Publié: (2025)
AuditoryBench++: Can Language Models Understand Auditory Knowledge without Hearing?
par: Ok, Hyunjong, et autres
Publié: (2025)
par: Ok, Hyunjong, et autres
Publié: (2025)
SLOT: Structuring the Output of Large Language Models
par: Wang, Darren Yow-Bang, et autres
Publié: (2025)
par: Wang, Darren Yow-Bang, et autres
Publié: (2025)
Structured Prompts Improve Evaluation of Language Models
par: Aali, Asad, et autres
Publié: (2025)
par: Aali, Asad, et autres
Publié: (2025)
Federated Learning with Layer Skipping: Efficient Training of Large Language Models for Healthcare NLP
par: Zhang, Lihong, et autres
Publié: (2025)
par: Zhang, Lihong, et autres
Publié: (2025)
Toward a Functional Geometric Algebra for Natural Language Semantics
par: Pustejovsky, James
Publié: (2026)
par: Pustejovsky, James
Publié: (2026)
Physics of Language Models: Part 1, Learning Hierarchical Language Structures
par: Allen-Zhu, Zeyuan, et autres
Publié: (2023)
par: Allen-Zhu, Zeyuan, et autres
Publié: (2023)
Large Language Models as Computable Approximations to Solomonoff Induction
par: Wan, Jun, et autres
Publié: (2025)
par: Wan, Jun, et autres
Publié: (2025)
LLaSA: Large Language and Structured Data Assistant
par: Xu, Yao, et autres
Publié: (2024)
par: Xu, Yao, et autres
Publié: (2024)
MeTHanol: Modularized Thinking Language Models with Intermediate Layer Thinking, Decoding and Bootstrapping Reasoning
par: Xi, Ningyuan, et autres
Publié: (2024)
par: Xi, Ningyuan, et autres
Publié: (2024)
Exploring Concept Depth: How Large Language Models Acquire Knowledge and Concept at Different Layers?
par: Jin, Mingyu, et autres
Publié: (2024)
par: Jin, Mingyu, et autres
Publié: (2024)
Toward Adaptive Large Language Models Structured Pruning via Hybrid-grained Weight Importance Assessment
par: Liu, Jun, et autres
Publié: (2024)
par: Liu, Jun, et autres
Publié: (2024)
DeepSeek LLM: Scaling Open-Source Language Models with Longtermism
par: DeepSeek-AI, et autres
Publié: (2024)
par: DeepSeek-AI, et autres
Publié: (2024)
Multilinguality of Large Language Models From a Structural Perspective
par: Sakajo, Haruki, et autres
Publié: (2026)
par: Sakajo, Haruki, et autres
Publié: (2026)
Adaptive Pruning for Large Language Models with Structural Importance Awareness
par: Zheng, Haotian, et autres
Publié: (2024)
par: Zheng, Haotian, et autres
Publié: (2024)
Sequences of Logits Reveal the Low Rank Structure of Language Models
par: Golowich, Noah, et autres
Publié: (2025)
par: Golowich, Noah, et autres
Publié: (2025)
Learn To be Efficient: Build Structured Sparsity in Large Language Models
par: Zheng, Haizhong, et autres
Publié: (2024)
par: Zheng, Haizhong, et autres
Publié: (2024)
Liger: Linearizing Large Language Models to Gated Recurrent Structures
par: Lan, Disen, et autres
Publié: (2025)
par: Lan, Disen, et autres
Publié: (2025)
The Structure of Relation Decoding Linear Operators in Large Language Models
par: Christ, Miranda Anna, et autres
Publié: (2025)
par: Christ, Miranda Anna, et autres
Publié: (2025)
Training Language Models with Language Feedback at Scale
par: Scheurer, Jérémy, et autres
Publié: (2023)
par: Scheurer, Jérémy, et autres
Publié: (2023)
Text2TimeSeries: Enhancing Financial Forecasting through Time Series Prediction Updates with Event-Driven Insights from Large Language Models
par: Kurisinkel, Litton Jose, et autres
Publié: (2024)
par: Kurisinkel, Litton Jose, et autres
Publié: (2024)
Documents similaires
-
The Confidence Manifold: Geometric Structure of Correctness Representations in Language Models
par: Cho, Seonglae, et autres
Publié: (2026) -
Layer by Layer: Uncovering Hidden Representations in Language Models
par: Skean, Oscar, et autres
Publié: (2025) -
SWEA: Updating Factual Knowledge in Large Language Models via Subject Word Embedding Altering
par: Li, Xiaopeng, et autres
Publié: (2024) -
ALAS: Autonomous Learning Agent for Self-Updating Language Models
par: Atreja, Dhruv
Publié: (2025) -
LoRAP: Transformer Sub-Layers Deserve Differentiated Structured Compression for Large Language Models
par: Li, Guangyan, et autres
Publié: (2024)