Architecture, Not Scale: Circuit Localization in Large Language Models
Fuente:
arXiv
Guardado en:
| Autor principal: | Venkatesh, Sohan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Negative Before Positive: Asymmetric Valence Processing in Large Language Models
por: Venkatesh, Sohan
Publicado: (2026)
por: Venkatesh, Sohan
Publicado: (2026)
Large Language Models are Algorithmically Blind
por: Venkatesh, Sohan, et al.
Publicado: (2026)
por: Venkatesh, Sohan, et al.
Publicado: (2026)
Repeated-Token Counting Reveals a Dissociation Between Representations and Outputs
por: Venkatesh, Sohan
Publicado: (2026)
por: Venkatesh, Sohan
Publicado: (2026)
How Alignment Routes: Localizing, Scaling, and Controlling Policy Circuits in Language Models
por: Frank, Gregory N.
Publicado: (2026)
por: Frank, Gregory N.
Publicado: (2026)
Large Language Models Prompting With Episodic Memory
por: Do, Dai, et al.
Publicado: (2024)
por: Do, Dai, et al.
Publicado: (2024)
Learning Together to Perform Better: Teaching Small-Scale LLMs to Collaborate via Preferential Rationale Tuning
por: Patnaik, Sohan, et al.
Publicado: (2025)
por: Patnaik, Sohan, et al.
Publicado: (2025)
Mechanistic Circuit-Based Knowledge Editing in Large Language Models
por: Zhao, Tianyi, et al.
Publicado: (2026)
por: Zhao, Tianyi, et al.
Publicado: (2026)
Electronic Circuit Principles of Large Language Models
por: Chen, Qiguang, et al.
Publicado: (2025)
por: Chen, Qiguang, et al.
Publicado: (2025)
Exploring Scaling Laws for Local SGD in Large Language Model Training
por: He, Qiaozhi, et al.
Publicado: (2024)
por: He, Qiaozhi, et al.
Publicado: (2024)
Triggers Hijack Language Circuits: A Mechanistic Analysis of Backdoor Behaviors in Large Language Models
por: Lasnier, Théo, et al.
Publicado: (2026)
por: Lasnier, Théo, et al.
Publicado: (2026)
Self-Data Distillation for Recovering Quality in Pruned Large Language Models
por: Thangarasa, Vithursan, et al.
Publicado: (2024)
por: Thangarasa, Vithursan, et al.
Publicado: (2024)
Metadata Conditioned Large Language Models for Localization
por: Mukherjee, Anjishnu, et al.
Publicado: (2026)
por: Mukherjee, Anjishnu, et al.
Publicado: (2026)
LogiPart: Local Large Language Models for Data Exploration at Scale with Logical Partitioning
por: Tavares, Tiago Fernandes
Publicado: (2025)
por: Tavares, Tiago Fernandes
Publicado: (2025)
Temporal Scaling Law for Large Language Models
por: Xiong, Yizhe, et al.
Publicado: (2024)
por: Xiong, Yizhe, et al.
Publicado: (2024)
Architectural Foundations for the Large Language Model Infrastructures
por: Zhu, Hongyin
Publicado: (2024)
por: Zhu, Hongyin
Publicado: (2024)
On the Non-Identifiability of Steering Vectors in Large Language Models
por: Venkatesh, Sohan, et al.
Publicado: (2026)
por: Venkatesh, Sohan, et al.
Publicado: (2026)
Language Model Behavioral Phases are Consistent Across Architecture, Training Data, and Scale
por: Michaelov, James A., et al.
Publicado: (2025)
por: Michaelov, James A., et al.
Publicado: (2025)
Multi-Reference Preference Optimization for Large Language Models
por: Le, Hung, et al.
Publicado: (2024)
por: Le, Hung, et al.
Publicado: (2024)
Compressed Sensing for Capability Localization in Large Language Models
por: Bair, Anna, et al.
Publicado: (2026)
por: Bair, Anna, et al.
Publicado: (2026)
AceGPT, Localizing Large Language Models in Arabic
por: Huang, Huang, et al.
Publicado: (2023)
por: Huang, Huang, et al.
Publicado: (2023)
Scaling Laws for Fact Memorization of Large Language Models
por: Lu, Xingyu, et al.
Publicado: (2024)
por: Lu, Xingyu, et al.
Publicado: (2024)
Revisiting the Reliability of Psychological Scales on Large Language Models
por: Huang, Jen-tse, et al.
Publicado: (2023)
por: Huang, Jen-tse, et al.
Publicado: (2023)
Circuit Stability Characterizes Language Model Generalization
por: Sun, Alan
Publicado: (2025)
por: Sun, Alan
Publicado: (2025)
Dissecting the Ledger: Locating and Suppressing "Liar Circuits" in Financial Large Language Models
por: Mirajkar, Soham
Publicado: (2025)
por: Mirajkar, Soham
Publicado: (2025)
Large Malaysian Language Model Based on Mistral for Enhanced Local Language Understanding
por: Zolkepli, Husein, et al.
Publicado: (2024)
por: Zolkepli, Husein, et al.
Publicado: (2024)
Revisiting In-context Learning Inference Circuit in Large Language Models
por: Cho, Hakaze, et al.
Publicado: (2024)
por: Cho, Hakaze, et al.
Publicado: (2024)
The Art of Scaling Test-Time Compute for Large Language Models
por: Agarwal, Aradhye, et al.
Publicado: (2025)
por: Agarwal, Aradhye, et al.
Publicado: (2025)
Structured In-context Environment Scaling for Large Language Model Reasoning
por: Yu, Peng, et al.
Publicado: (2025)
por: Yu, Peng, et al.
Publicado: (2025)
Training-Free Long-Context Scaling of Large Language Models
por: An, Chenxin, et al.
Publicado: (2024)
por: An, Chenxin, et al.
Publicado: (2024)
Findings of the BlackboxNLP 2025 Shared Task: Localizing Circuits and Causal Variables in Language Models
por: Arad, Dana, et al.
Publicado: (2025)
por: Arad, Dana, et al.
Publicado: (2025)
How Much Do Circuits Tell Us? Measuring the Consistency and Specificity of Language Model Circuits
por: Li, Michael, et al.
Publicado: (2026)
por: Li, Michael, et al.
Publicado: (2026)
The Compositional Architecture of Regret in Large Language Models
por: Cui, Xiangxiang, et al.
Publicado: (2025)
por: Cui, Xiangxiang, et al.
Publicado: (2025)
Transport and Merge: Cross-Architecture Merging for Large Language Models
por: Cui, Chenhang, et al.
Publicado: (2026)
por: Cui, Chenhang, et al.
Publicado: (2026)
Understanding Language Model Circuits through Knowledge Editing
por: Ge, Huaizhi, et al.
Publicado: (2024)
por: Ge, Huaizhi, et al.
Publicado: (2024)
LaoBench: A Large-Scale Multidimensional Lao Benchmark for Large Language Models
por: Gao, Jian, et al.
Publicado: (2025)
por: Gao, Jian, et al.
Publicado: (2025)
Scaling Model and Data for Multilingual Machine Translation with Open Large Language Models
por: Shang, Yuzhe, et al.
Publicado: (2026)
por: Shang, Yuzhe, et al.
Publicado: (2026)
Characterizing Truthfulness in Large Language Model Generations with Local Intrinsic Dimension
por: Yin, Fan, et al.
Publicado: (2024)
por: Yin, Fan, et al.
Publicado: (2024)
Semantic Scaling: Bayesian Ideal Point Estimates with Large Language Models
por: Burnham, Michael
Publicado: (2024)
por: Burnham, Michael
Publicado: (2024)
Pitfalls of Scale: Investigating the Inverse Task of Redefinition in Large Language Models
por: Stringli, Elena, et al.
Publicado: (2025)
por: Stringli, Elena, et al.
Publicado: (2025)
CodeSimpleQA: Scaling Factuality in Code Large Language Models
por: Yang, Jian, et al.
Publicado: (2025)
por: Yang, Jian, et al.
Publicado: (2025)
Ejemplares similares
-
Negative Before Positive: Asymmetric Valence Processing in Large Language Models
por: Venkatesh, Sohan
Publicado: (2026) -
Large Language Models are Algorithmically Blind
por: Venkatesh, Sohan, et al.
Publicado: (2026) -
Repeated-Token Counting Reveals a Dissociation Between Representations and Outputs
por: Venkatesh, Sohan
Publicado: (2026) -
How Alignment Routes: Localizing, Scaling, and Controlling Policy Circuits in Language Models
por: Frank, Gregory N.
Publicado: (2026) -
Large Language Models Prompting With Episodic Memory
por: Do, Dai, et al.
Publicado: (2024)