Enregistré dans:
| Auteur principal: | Ruffenach, Yves |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2603.28219 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Variational Distributional Neuron
par: Ruffenach, Yves
Publié: (2026)
par: Ruffenach, Yves
Publié: (2026)
Exploring the Dimensions of a Variational Neuron
par: Ruffenach, Yves
Publié: (2026)
par: Ruffenach, Yves
Publié: (2026)
Agentic Control in Variational Language Models
par: Ruffenach, Yves
Publié: (2026)
par: Ruffenach, Yves
Publié: (2026)
Autoregressivity in the Latent Space of a GP-VAE Language Model: An Empirical Ablation Study
par: Ruffenach, Yves
Publié: (2025)
par: Ruffenach, Yves
Publié: (2025)
Latent-Autoregressive GP-VAE Language Model
par: Ruffenach, Yves
Publié: (2025)
par: Ruffenach, Yves
Publié: (2025)
Selective Neuron Amplification in Transformer Language Models
par: Akhtar, Ryyan, et autres
Publié: (2026)
par: Akhtar, Ryyan, et autres
Publié: (2026)
GLUScope: A Tool for Analyzing GLU Neurons in Transformer Language Models
par: Gerstner, Sebastian, et autres
Publié: (2026)
par: Gerstner, Sebastian, et autres
Publié: (2026)
SafeNeuron: Neuron-Level Safety Alignment for Large Language Models
par: Wang, Zhaoxin, et autres
Publié: (2026)
par: Wang, Zhaoxin, et autres
Publié: (2026)
Did the Neurons Read your Book? Document-level Membership Inference for Large Language Models
par: Meeus, Matthieu, et autres
Publié: (2023)
par: Meeus, Matthieu, et autres
Publié: (2023)
NeuronScope: A Multi-Agent Framework for Explaining Polysemantic Neurons in Language Models
par: Liu, Weiqi, et autres
Publié: (2026)
par: Liu, Weiqi, et autres
Publié: (2026)
Confidence Regulation Neurons in Language Models
par: Stolfo, Alessandro, et autres
Publié: (2024)
par: Stolfo, Alessandro, et autres
Publié: (2024)
Neuron-Level Knowledge Attribution in Large Language Models
par: Yu, Zeping, et autres
Publié: (2023)
par: Yu, Zeping, et autres
Publié: (2023)
Neuron Patching: Semantic-based Neuron-level Language Model Repair for Code Generation
par: Gu, Jian, et autres
Publié: (2023)
par: Gu, Jian, et autres
Publié: (2023)
Universal Neurons in GPT2 Language Models
par: Gurnee, Wes, et autres
Publié: (2024)
par: Gurnee, Wes, et autres
Publié: (2024)
Tracing Stereotypes in Pre-trained Transformers: From Biased Neurons to Fairer Models
par: Voria, Gianmario, et autres
Publié: (2026)
par: Voria, Gianmario, et autres
Publié: (2026)
Controllable Value Alignment in Large Language Models through Neuron-Level Editing
par: Yang, Yonghui, et autres
Publié: (2026)
par: Yang, Yonghui, et autres
Publié: (2026)
Improving Neuron-level Interpretability with White-box Language Models
par: Bai, Hao, et autres
Publié: (2024)
par: Bai, Hao, et autres
Publié: (2024)
Detecting and Pruning Prominent but Detrimental Neurons in Large Language Models
par: Ali, Ameen, et autres
Publié: (2025)
par: Ali, Ameen, et autres
Publié: (2025)
Improving Model Fusion by Training-time Neuron Alignment with Fixed Neuron Anchors
par: Li, Zexi, et autres
Publié: (2024)
par: Li, Zexi, et autres
Publié: (2024)
Hedonic Neurons: A Mechanistic Mapping of Latent Coalitions in Transformer MLPs
par: Chowdhury, Tanya, et autres
Publié: (2025)
par: Chowdhury, Tanya, et autres
Publié: (2025)
Finding Culture-Sensitive Neurons in Vision-Language Models
par: Zhao, Xiutian, et autres
Publié: (2025)
par: Zhao, Xiutian, et autres
Publié: (2025)
Interpreting Neurons in Deep Vision Networks with Language Models
par: Bai, Nicholas, et autres
Publié: (2024)
par: Bai, Nicholas, et autres
Publié: (2024)
Automated Neuron Labelling Enables Generative Steering and Interpretability in Protein Language Models
par: Banerjee, Arjun, et autres
Publié: (2025)
par: Banerjee, Arjun, et autres
Publié: (2025)
Learnable Privacy Neurons Localization in Language Models
par: Chen, Ruizhe, et autres
Publié: (2024)
par: Chen, Ruizhe, et autres
Publié: (2024)
Understanding Gated Neurons in Transformers from Their Input-Output Functionality
par: Gerstner, Sebastian, et autres
Publié: (2025)
par: Gerstner, Sebastian, et autres
Publié: (2025)
CPT: Controllable and Editable Design Variations with Language Models
par: Suresh, Karthik, et autres
Publié: (2026)
par: Suresh, Karthik, et autres
Publié: (2026)
Unveiling the Influence of Amplifying Language-Specific Neurons
par: Rahmanisa, Inaya, et autres
Publié: (2025)
par: Rahmanisa, Inaya, et autres
Publié: (2025)
Neuronal Fluctuations: Learning Rates vs Participating Neurons
par: Pareek, Darsh, et autres
Publié: (2025)
par: Pareek, Darsh, et autres
Publié: (2025)
WINA: Weight Informed Neuron Activation for Accelerating Large Language Model Inference
par: Chen, Sihan, et autres
Publié: (2025)
par: Chen, Sihan, et autres
Publié: (2025)
NeuRel-Attack: Neuron Relearning for Safety Disalignment in Large Language Models
par: Zhou, Yi, et autres
Publié: (2025)
par: Zhou, Yi, et autres
Publié: (2025)
Variational Reasoning for Language Models
par: Zhou, Xiangxin, et autres
Publié: (2025)
par: Zhou, Xiangxin, et autres
Publié: (2025)
The Mosaic Memory of Large Language Models
par: Shilov, Igor, et autres
Publié: (2024)
par: Shilov, Igor, et autres
Publié: (2024)
Property Neurons in Self-Supervised Speech Transformers
par: Lin, Tzu-Quan, et autres
Publié: (2024)
par: Lin, Tzu-Quan, et autres
Publié: (2024)
Discovering Influential Neuron Path in Vision Transformers
par: Wang, Yifan, et autres
Publié: (2025)
par: Wang, Yifan, et autres
Publié: (2025)
Cross-Model Comparative Loss for Enhancing Neuronal Utility in Language Understanding
par: Zhu, Yunchang, et autres
Publié: (2023)
par: Zhu, Yunchang, et autres
Publié: (2023)
Neuron-Anchored Rule Extraction for Large Language Models via Contrastive Hierarchical Ablation
par: Sovrano, Francesco, et autres
Publié: (2026)
par: Sovrano, Francesco, et autres
Publié: (2026)
Model Fusion via Neuron Transplantation
par: Öz, Muhammed, et autres
Publié: (2025)
par: Öz, Muhammed, et autres
Publié: (2025)
Transformer as an Euler Discretization of Score-based Variational Flow
par: Liao, Huadong
Publié: (2026)
par: Liao, Huadong
Publié: (2026)
Generalized Graph Transformer Variational Autoencoder
par: Karki, Siddhant
Publié: (2025)
par: Karki, Siddhant
Publié: (2025)
On the Runway Cascade of Transformers for Language Modeling
par: Lee, Hunjae, et autres
Publié: (2026)
par: Lee, Hunjae, et autres
Publié: (2026)
Documents similaires
-
Variational Distributional Neuron
par: Ruffenach, Yves
Publié: (2026) -
Exploring the Dimensions of a Variational Neuron
par: Ruffenach, Yves
Publié: (2026) -
Agentic Control in Variational Language Models
par: Ruffenach, Yves
Publié: (2026) -
Autoregressivity in the Latent Space of a GP-VAE Language Model: An Empirical Ablation Study
par: Ruffenach, Yves
Publié: (2025) -
Latent-Autoregressive GP-VAE Language Model
par: Ruffenach, Yves
Publié: (2025)