Architecture, Not Scale: Circuit Localization in Large Language Models
Fuente:
arXiv
Gespeichert in:
| 1. Verfasser: | Venkatesh, Sohan |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Negative Before Positive: Asymmetric Valence Processing in Large Language Models
von: Venkatesh, Sohan
Veröffentlicht: (2026)
von: Venkatesh, Sohan
Veröffentlicht: (2026)
Large Language Models are Algorithmically Blind
von: Venkatesh, Sohan, et al.
Veröffentlicht: (2026)
von: Venkatesh, Sohan, et al.
Veröffentlicht: (2026)
Repeated-Token Counting Reveals a Dissociation Between Representations and Outputs
von: Venkatesh, Sohan
Veröffentlicht: (2026)
von: Venkatesh, Sohan
Veröffentlicht: (2026)
How Alignment Routes: Localizing, Scaling, and Controlling Policy Circuits in Language Models
von: Frank, Gregory N.
Veröffentlicht: (2026)
von: Frank, Gregory N.
Veröffentlicht: (2026)
Large Language Models Prompting With Episodic Memory
von: Do, Dai, et al.
Veröffentlicht: (2024)
von: Do, Dai, et al.
Veröffentlicht: (2024)
Learning Together to Perform Better: Teaching Small-Scale LLMs to Collaborate via Preferential Rationale Tuning
von: Patnaik, Sohan, et al.
Veröffentlicht: (2025)
von: Patnaik, Sohan, et al.
Veröffentlicht: (2025)
Mechanistic Circuit-Based Knowledge Editing in Large Language Models
von: Zhao, Tianyi, et al.
Veröffentlicht: (2026)
von: Zhao, Tianyi, et al.
Veröffentlicht: (2026)
Electronic Circuit Principles of Large Language Models
von: Chen, Qiguang, et al.
Veröffentlicht: (2025)
von: Chen, Qiguang, et al.
Veröffentlicht: (2025)
Exploring Scaling Laws for Local SGD in Large Language Model Training
von: He, Qiaozhi, et al.
Veröffentlicht: (2024)
von: He, Qiaozhi, et al.
Veröffentlicht: (2024)
Triggers Hijack Language Circuits: A Mechanistic Analysis of Backdoor Behaviors in Large Language Models
von: Lasnier, Théo, et al.
Veröffentlicht: (2026)
von: Lasnier, Théo, et al.
Veröffentlicht: (2026)
Self-Data Distillation for Recovering Quality in Pruned Large Language Models
von: Thangarasa, Vithursan, et al.
Veröffentlicht: (2024)
von: Thangarasa, Vithursan, et al.
Veröffentlicht: (2024)
Metadata Conditioned Large Language Models for Localization
von: Mukherjee, Anjishnu, et al.
Veröffentlicht: (2026)
von: Mukherjee, Anjishnu, et al.
Veröffentlicht: (2026)
LogiPart: Local Large Language Models for Data Exploration at Scale with Logical Partitioning
von: Tavares, Tiago Fernandes
Veröffentlicht: (2025)
von: Tavares, Tiago Fernandes
Veröffentlicht: (2025)
Temporal Scaling Law for Large Language Models
von: Xiong, Yizhe, et al.
Veröffentlicht: (2024)
von: Xiong, Yizhe, et al.
Veröffentlicht: (2024)
Architectural Foundations for the Large Language Model Infrastructures
von: Zhu, Hongyin
Veröffentlicht: (2024)
von: Zhu, Hongyin
Veröffentlicht: (2024)
On the Non-Identifiability of Steering Vectors in Large Language Models
von: Venkatesh, Sohan, et al.
Veröffentlicht: (2026)
von: Venkatesh, Sohan, et al.
Veröffentlicht: (2026)
Language Model Behavioral Phases are Consistent Across Architecture, Training Data, and Scale
von: Michaelov, James A., et al.
Veröffentlicht: (2025)
von: Michaelov, James A., et al.
Veröffentlicht: (2025)
Multi-Reference Preference Optimization for Large Language Models
von: Le, Hung, et al.
Veröffentlicht: (2024)
von: Le, Hung, et al.
Veröffentlicht: (2024)
Compressed Sensing for Capability Localization in Large Language Models
von: Bair, Anna, et al.
Veröffentlicht: (2026)
von: Bair, Anna, et al.
Veröffentlicht: (2026)
AceGPT, Localizing Large Language Models in Arabic
von: Huang, Huang, et al.
Veröffentlicht: (2023)
von: Huang, Huang, et al.
Veröffentlicht: (2023)
Scaling Laws for Fact Memorization of Large Language Models
von: Lu, Xingyu, et al.
Veröffentlicht: (2024)
von: Lu, Xingyu, et al.
Veröffentlicht: (2024)
Revisiting the Reliability of Psychological Scales on Large Language Models
von: Huang, Jen-tse, et al.
Veröffentlicht: (2023)
von: Huang, Jen-tse, et al.
Veröffentlicht: (2023)
Circuit Stability Characterizes Language Model Generalization
von: Sun, Alan
Veröffentlicht: (2025)
von: Sun, Alan
Veröffentlicht: (2025)
Dissecting the Ledger: Locating and Suppressing "Liar Circuits" in Financial Large Language Models
von: Mirajkar, Soham
Veröffentlicht: (2025)
von: Mirajkar, Soham
Veröffentlicht: (2025)
Large Malaysian Language Model Based on Mistral for Enhanced Local Language Understanding
von: Zolkepli, Husein, et al.
Veröffentlicht: (2024)
von: Zolkepli, Husein, et al.
Veröffentlicht: (2024)
Revisiting In-context Learning Inference Circuit in Large Language Models
von: Cho, Hakaze, et al.
Veröffentlicht: (2024)
von: Cho, Hakaze, et al.
Veröffentlicht: (2024)
The Art of Scaling Test-Time Compute for Large Language Models
von: Agarwal, Aradhye, et al.
Veröffentlicht: (2025)
von: Agarwal, Aradhye, et al.
Veröffentlicht: (2025)
Structured In-context Environment Scaling for Large Language Model Reasoning
von: Yu, Peng, et al.
Veröffentlicht: (2025)
von: Yu, Peng, et al.
Veröffentlicht: (2025)
Training-Free Long-Context Scaling of Large Language Models
von: An, Chenxin, et al.
Veröffentlicht: (2024)
von: An, Chenxin, et al.
Veröffentlicht: (2024)
Findings of the BlackboxNLP 2025 Shared Task: Localizing Circuits and Causal Variables in Language Models
von: Arad, Dana, et al.
Veröffentlicht: (2025)
von: Arad, Dana, et al.
Veröffentlicht: (2025)
How Much Do Circuits Tell Us? Measuring the Consistency and Specificity of Language Model Circuits
von: Li, Michael, et al.
Veröffentlicht: (2026)
von: Li, Michael, et al.
Veröffentlicht: (2026)
The Compositional Architecture of Regret in Large Language Models
von: Cui, Xiangxiang, et al.
Veröffentlicht: (2025)
von: Cui, Xiangxiang, et al.
Veröffentlicht: (2025)
Transport and Merge: Cross-Architecture Merging for Large Language Models
von: Cui, Chenhang, et al.
Veröffentlicht: (2026)
von: Cui, Chenhang, et al.
Veröffentlicht: (2026)
Understanding Language Model Circuits through Knowledge Editing
von: Ge, Huaizhi, et al.
Veröffentlicht: (2024)
von: Ge, Huaizhi, et al.
Veröffentlicht: (2024)
LaoBench: A Large-Scale Multidimensional Lao Benchmark for Large Language Models
von: Gao, Jian, et al.
Veröffentlicht: (2025)
von: Gao, Jian, et al.
Veröffentlicht: (2025)
Scaling Model and Data for Multilingual Machine Translation with Open Large Language Models
von: Shang, Yuzhe, et al.
Veröffentlicht: (2026)
von: Shang, Yuzhe, et al.
Veröffentlicht: (2026)
Characterizing Truthfulness in Large Language Model Generations with Local Intrinsic Dimension
von: Yin, Fan, et al.
Veröffentlicht: (2024)
von: Yin, Fan, et al.
Veröffentlicht: (2024)
Semantic Scaling: Bayesian Ideal Point Estimates with Large Language Models
von: Burnham, Michael
Veröffentlicht: (2024)
von: Burnham, Michael
Veröffentlicht: (2024)
Pitfalls of Scale: Investigating the Inverse Task of Redefinition in Large Language Models
von: Stringli, Elena, et al.
Veröffentlicht: (2025)
von: Stringli, Elena, et al.
Veröffentlicht: (2025)
CodeSimpleQA: Scaling Factuality in Code Large Language Models
von: Yang, Jian, et al.
Veröffentlicht: (2025)
von: Yang, Jian, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Negative Before Positive: Asymmetric Valence Processing in Large Language Models
von: Venkatesh, Sohan
Veröffentlicht: (2026) -
Large Language Models are Algorithmically Blind
von: Venkatesh, Sohan, et al.
Veröffentlicht: (2026) -
Repeated-Token Counting Reveals a Dissociation Between Representations and Outputs
von: Venkatesh, Sohan
Veröffentlicht: (2026) -
How Alignment Routes: Localizing, Scaling, and Controlling Policy Circuits in Language Models
von: Frank, Gregory N.
Veröffentlicht: (2026) -
Large Language Models Prompting With Episodic Memory
von: Do, Dai, et al.
Veröffentlicht: (2024)