Variational Neurons in Transformers for Language Modeling
Fuente:
arXiv
Gespeichert in:
| 1. Verfasser: | Ruffenach, Yves |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Variational Distributional Neuron
von: Ruffenach, Yves
Veröffentlicht: (2026)
von: Ruffenach, Yves
Veröffentlicht: (2026)
Exploring the Dimensions of a Variational Neuron
von: Ruffenach, Yves
Veröffentlicht: (2026)
von: Ruffenach, Yves
Veröffentlicht: (2026)
Agentic Control in Variational Language Models
von: Ruffenach, Yves
Veröffentlicht: (2026)
von: Ruffenach, Yves
Veröffentlicht: (2026)
Autoregressivity in the Latent Space of a GP-VAE Language Model: An Empirical Ablation Study
von: Ruffenach, Yves
Veröffentlicht: (2025)
von: Ruffenach, Yves
Veröffentlicht: (2025)
Latent-Autoregressive GP-VAE Language Model
von: Ruffenach, Yves
Veröffentlicht: (2025)
von: Ruffenach, Yves
Veröffentlicht: (2025)
Selective Neuron Amplification in Transformer Language Models
von: Akhtar, Ryyan, et al.
Veröffentlicht: (2026)
von: Akhtar, Ryyan, et al.
Veröffentlicht: (2026)
GLUScope: A Tool for Analyzing GLU Neurons in Transformer Language Models
von: Gerstner, Sebastian, et al.
Veröffentlicht: (2026)
von: Gerstner, Sebastian, et al.
Veröffentlicht: (2026)
SafeNeuron: Neuron-Level Safety Alignment for Large Language Models
von: Wang, Zhaoxin, et al.
Veröffentlicht: (2026)
von: Wang, Zhaoxin, et al.
Veröffentlicht: (2026)
Did the Neurons Read your Book? Document-level Membership Inference for Large Language Models
von: Meeus, Matthieu, et al.
Veröffentlicht: (2023)
von: Meeus, Matthieu, et al.
Veröffentlicht: (2023)
NeuronScope: A Multi-Agent Framework for Explaining Polysemantic Neurons in Language Models
von: Liu, Weiqi, et al.
Veröffentlicht: (2026)
von: Liu, Weiqi, et al.
Veröffentlicht: (2026)
Confidence Regulation Neurons in Language Models
von: Stolfo, Alessandro, et al.
Veröffentlicht: (2024)
von: Stolfo, Alessandro, et al.
Veröffentlicht: (2024)
Neuron-Level Knowledge Attribution in Large Language Models
von: Yu, Zeping, et al.
Veröffentlicht: (2023)
von: Yu, Zeping, et al.
Veröffentlicht: (2023)
Controllable Value Alignment in Large Language Models through Neuron-Level Editing
von: Yang, Yonghui, et al.
Veröffentlicht: (2026)
von: Yang, Yonghui, et al.
Veröffentlicht: (2026)
Improving Model Fusion by Training-time Neuron Alignment with Fixed Neuron Anchors
von: Li, Zexi, et al.
Veröffentlicht: (2024)
von: Li, Zexi, et al.
Veröffentlicht: (2024)
Tracing Stereotypes in Pre-trained Transformers: From Biased Neurons to Fairer Models
von: Voria, Gianmario, et al.
Veröffentlicht: (2026)
von: Voria, Gianmario, et al.
Veröffentlicht: (2026)
Hedonic Neurons: A Mechanistic Mapping of Latent Coalitions in Transformer MLPs
von: Chowdhury, Tanya, et al.
Veröffentlicht: (2025)
von: Chowdhury, Tanya, et al.
Veröffentlicht: (2025)
Neuron Patching: Semantic-based Neuron-level Language Model Repair for Code Generation
von: Gu, Jian, et al.
Veröffentlicht: (2023)
von: Gu, Jian, et al.
Veröffentlicht: (2023)
Universal Neurons in GPT2 Language Models
von: Gurnee, Wes, et al.
Veröffentlicht: (2024)
von: Gurnee, Wes, et al.
Veröffentlicht: (2024)
Improving Neuron-level Interpretability with White-box Language Models
von: Bai, Hao, et al.
Veröffentlicht: (2024)
von: Bai, Hao, et al.
Veröffentlicht: (2024)
Detecting and Pruning Prominent but Detrimental Neurons in Large Language Models
von: Ali, Ameen, et al.
Veröffentlicht: (2025)
von: Ali, Ameen, et al.
Veröffentlicht: (2025)
Automated Neuron Labelling Enables Generative Steering and Interpretability in Protein Language Models
von: Banerjee, Arjun, et al.
Veröffentlicht: (2025)
von: Banerjee, Arjun, et al.
Veröffentlicht: (2025)
CPT: Controllable and Editable Design Variations with Language Models
von: Suresh, Karthik, et al.
Veröffentlicht: (2026)
von: Suresh, Karthik, et al.
Veröffentlicht: (2026)
Finding Culture-Sensitive Neurons in Vision-Language Models
von: Zhao, Xiutian, et al.
Veröffentlicht: (2025)
von: Zhao, Xiutian, et al.
Veröffentlicht: (2025)
Interpreting Neurons in Deep Vision Networks with Language Models
von: Bai, Nicholas, et al.
Veröffentlicht: (2024)
von: Bai, Nicholas, et al.
Veröffentlicht: (2024)
Understanding Gated Neurons in Transformers from Their Input-Output Functionality
von: Gerstner, Sebastian, et al.
Veröffentlicht: (2025)
von: Gerstner, Sebastian, et al.
Veröffentlicht: (2025)
Neuronal Fluctuations: Learning Rates vs Participating Neurons
von: Pareek, Darsh, et al.
Veröffentlicht: (2025)
von: Pareek, Darsh, et al.
Veröffentlicht: (2025)
Learnable Privacy Neurons Localization in Language Models
von: Chen, Ruizhe, et al.
Veröffentlicht: (2024)
von: Chen, Ruizhe, et al.
Veröffentlicht: (2024)
WINA: Weight Informed Neuron Activation for Accelerating Large Language Model Inference
von: Chen, Sihan, et al.
Veröffentlicht: (2025)
von: Chen, Sihan, et al.
Veröffentlicht: (2025)
NeuRel-Attack: Neuron Relearning for Safety Disalignment in Large Language Models
von: Zhou, Yi, et al.
Veröffentlicht: (2025)
von: Zhou, Yi, et al.
Veröffentlicht: (2025)
Unveiling the Influence of Amplifying Language-Specific Neurons
von: Rahmanisa, Inaya, et al.
Veröffentlicht: (2025)
von: Rahmanisa, Inaya, et al.
Veröffentlicht: (2025)
On the Runway Cascade of Transformers for Language Modeling
von: Lee, Hunjae, et al.
Veröffentlicht: (2026)
von: Lee, Hunjae, et al.
Veröffentlicht: (2026)
Transformer as an Euler Discretization of Score-based Variational Flow
von: Liao, Huadong
Veröffentlicht: (2026)
von: Liao, Huadong
Veröffentlicht: (2026)
Variational Reasoning for Language Models
von: Zhou, Xiangxin, et al.
Veröffentlicht: (2025)
von: Zhou, Xiangxin, et al.
Veröffentlicht: (2025)
Neuron-Anchored Rule Extraction for Large Language Models via Contrastive Hierarchical Ablation
von: Sovrano, Francesco, et al.
Veröffentlicht: (2026)
von: Sovrano, Francesco, et al.
Veröffentlicht: (2026)
The Mosaic Memory of Large Language Models
von: Shilov, Igor, et al.
Veröffentlicht: (2024)
von: Shilov, Igor, et al.
Veröffentlicht: (2024)
Model Fusion via Neuron Transplantation
von: Öz, Muhammed, et al.
Veröffentlicht: (2025)
von: Öz, Muhammed, et al.
Veröffentlicht: (2025)
Expand Neurons, Not Parameters
von: Kong, Linghao, et al.
Veröffentlicht: (2025)
von: Kong, Linghao, et al.
Veröffentlicht: (2025)
Threshold Neuron: A Brain-inspired Artificial Neuron for Efficient On-device Inference
von: Zheng, Zihao, et al.
Veröffentlicht: (2024)
von: Zheng, Zihao, et al.
Veröffentlicht: (2024)
Generalized Graph Transformer Variational Autoencoder
von: Karki, Siddhant
Veröffentlicht: (2025)
von: Karki, Siddhant
Veröffentlicht: (2025)
Cross-Model Comparative Loss for Enhancing Neuronal Utility in Language Understanding
von: Zhu, Yunchang, et al.
Veröffentlicht: (2023)
von: Zhu, Yunchang, et al.
Veröffentlicht: (2023)
Ähnliche Einträge
-
Variational Distributional Neuron
von: Ruffenach, Yves
Veröffentlicht: (2026) -
Exploring the Dimensions of a Variational Neuron
von: Ruffenach, Yves
Veröffentlicht: (2026) -
Agentic Control in Variational Language Models
von: Ruffenach, Yves
Veröffentlicht: (2026) -
Autoregressivity in the Latent Space of a GP-VAE Language Model: An Empirical Ablation Study
von: Ruffenach, Yves
Veröffentlicht: (2025) -
Latent-Autoregressive GP-VAE Language Model
von: Ruffenach, Yves
Veröffentlicht: (2025)