Selective Neuron Amplification in Transformer Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Akhtar, Ryyan, Pahwa, Payal, Arora, Monika |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Music Genre Classification Using Machine Learning Techniques
di: Mishra, Alokit, et al.
Pubblicazione: (2025)
di: Mishra, Alokit, et al.
Pubblicazione: (2025)
GLUScope: A Tool for Analyzing GLU Neurons in Transformer Language Models
di: Gerstner, Sebastian, et al.
Pubblicazione: (2026)
di: Gerstner, Sebastian, et al.
Pubblicazione: (2026)
Training Language Models to Reason Efficiently
di: Arora, Daman, et al.
Pubblicazione: (2025)
di: Arora, Daman, et al.
Pubblicazione: (2025)
NeuronScope: A Multi-Agent Framework for Explaining Polysemantic Neurons in Language Models
di: Liu, Weiqi, et al.
Pubblicazione: (2026)
di: Liu, Weiqi, et al.
Pubblicazione: (2026)
Persona-aware Generative Model for Code-mixed Language
di: Sengupta, Ayan, et al.
Pubblicazione: (2023)
di: Sengupta, Ayan, et al.
Pubblicazione: (2023)
Trainable Transformer in Transformer
di: Panigrahi, Abhishek, et al.
Pubblicazione: (2023)
di: Panigrahi, Abhishek, et al.
Pubblicazione: (2023)
Neuron-Level Knowledge Attribution in Large Language Models
di: Yu, Zeping, et al.
Pubblicazione: (2023)
di: Yu, Zeping, et al.
Pubblicazione: (2023)
Improving Neuron-level Interpretability with White-box Language Models
di: Bai, Hao, et al.
Pubblicazione: (2024)
di: Bai, Hao, et al.
Pubblicazione: (2024)
Detecting and Pruning Prominent but Detrimental Neurons in Large Language Models
di: Ali, Ameen, et al.
Pubblicazione: (2025)
di: Ali, Ameen, et al.
Pubblicazione: (2025)
Iterative Augmentation with Summarization Refinement (IASR) Evaluation for Unstructured Survey data Modeling and Analysis
di: Bhattad, Payal, et al.
Pubblicazione: (2025)
di: Bhattad, Payal, et al.
Pubblicazione: (2025)
Confidence Regulation Neurons in Language Models
di: Stolfo, Alessandro, et al.
Pubblicazione: (2024)
di: Stolfo, Alessandro, et al.
Pubblicazione: (2024)
Bias Amplification in Language Model Evolution: An Iterated Learning Perspective
di: Ren, Yi, et al.
Pubblicazione: (2024)
di: Ren, Yi, et al.
Pubblicazione: (2024)
Understanding Gated Neurons in Transformers from Their Input-Output Functionality
di: Gerstner, Sebastian, et al.
Pubblicazione: (2025)
di: Gerstner, Sebastian, et al.
Pubblicazione: (2025)
Design of a Multidimensional Model Using Object Oriented Features in UML
di: Payal Pahwa
Pubblicazione: (2011)
di: Payal Pahwa
Pubblicazione: (2011)
Unveiling the Influence of Amplifying Language-Specific Neurons
di: Rahmanisa, Inaya, et al.
Pubblicazione: (2025)
di: Rahmanisa, Inaya, et al.
Pubblicazione: (2025)
Neuron Patching: Semantic-based Neuron-level Language Model Repair for Code Generation
di: Gu, Jian, et al.
Pubblicazione: (2023)
di: Gu, Jian, et al.
Pubblicazione: (2023)
Universal Neurons in GPT2 Language Models
di: Gurnee, Wes, et al.
Pubblicazione: (2024)
di: Gurnee, Wes, et al.
Pubblicazione: (2024)
Automated Composition of Agents: A Knapsack Approach for Agentic Component Selection
di: Yuan, Michelle, et al.
Pubblicazione: (2025)
di: Yuan, Michelle, et al.
Pubblicazione: (2025)
Finding Culture-Sensitive Neurons in Vision-Language Models
di: Zhao, Xiutian, et al.
Pubblicazione: (2025)
di: Zhao, Xiutian, et al.
Pubblicazione: (2025)
Are Retrials All You Need? Enhancing Large Language Model Reasoning Without Verbalized Feedback
di: Potamitis, Nearchos, et al.
Pubblicazione: (2025)
di: Potamitis, Nearchos, et al.
Pubblicazione: (2025)
Active Model Selection for Large Language Models
di: Durmazkeser, Yavuz, et al.
Pubblicazione: (2025)
di: Durmazkeser, Yavuz, et al.
Pubblicazione: (2025)
Selective Generation for Controllable Language Models
di: Lee, Minjae, et al.
Pubblicazione: (2023)
di: Lee, Minjae, et al.
Pubblicazione: (2023)
Investigating and Alleviating Harm Amplification in LLM Interactions
di: Guo, Ruohao, et al.
Pubblicazione: (2026)
di: Guo, Ruohao, et al.
Pubblicazione: (2026)
Anatomical Heterogeneity in Transformer Language Models
di: Wietrzykowski, Tomasz
Pubblicazione: (2026)
di: Wietrzykowski, Tomasz
Pubblicazione: (2026)
Fine-Tuning Language Models with Just Forward Passes
di: Malladi, Sadhika, et al.
Pubblicazione: (2023)
di: Malladi, Sadhika, et al.
Pubblicazione: (2023)
Why is Your Language Model a Poor Implicit Reward Model?
di: Razin, Noam, et al.
Pubblicazione: (2025)
di: Razin, Noam, et al.
Pubblicazione: (2025)
Large Language Model Selection with Limited Annotations
di: Durmazkeser, Yavuz, et al.
Pubblicazione: (2026)
di: Durmazkeser, Yavuz, et al.
Pubblicazione: (2026)
A Survey on Data Selection for Language Models
di: Albalak, Alon, et al.
Pubblicazione: (2024)
di: Albalak, Alon, et al.
Pubblicazione: (2024)
Automatic Prompt Selection for Large Language Models
di: Do, Viet-Tung, et al.
Pubblicazione: (2024)
di: Do, Viet-Tung, et al.
Pubblicazione: (2024)
Cross-Model Comparative Loss for Enhancing Neuronal Utility in Language Understanding
di: Zhu, Yunchang, et al.
Pubblicazione: (2023)
di: Zhu, Yunchang, et al.
Pubblicazione: (2023)
Sparser, Faster, Lighter Transformer Language Models
di: Cetin, Edoardo, et al.
Pubblicazione: (2026)
di: Cetin, Edoardo, et al.
Pubblicazione: (2026)
Overview of the 2023 ICON Shared Task on Gendered Abuse Detection in Indic Languages
di: Vaidya, Aatman, et al.
Pubblicazione: (2024)
di: Vaidya, Aatman, et al.
Pubblicazione: (2024)
Revealing Fine-Grained Values and Opinions in Large Language Models
di: Wright, Dustin, et al.
Pubblicazione: (2024)
di: Wright, Dustin, et al.
Pubblicazione: (2024)
Transformers with Selective Access to Early Representations
di: Gunasekaran, Skye, et al.
Pubblicazione: (2026)
di: Gunasekaran, Skye, et al.
Pubblicazione: (2026)
Large Language Models for Computer-Aided Design: A Survey
di: Zhang, Licheng, et al.
Pubblicazione: (2025)
di: Zhang, Licheng, et al.
Pubblicazione: (2025)
Learnable Privacy Neurons Localization in Language Models
di: Chen, Ruizhe, et al.
Pubblicazione: (2024)
di: Chen, Ruizhe, et al.
Pubblicazione: (2024)
A Single Neuron Is Sufficient to Bypass Safety Alignment in Large Language Models
di: Kazemi, Hamid, et al.
Pubblicazione: (2026)
di: Kazemi, Hamid, et al.
Pubblicazione: (2026)
Mitigating Biases for Instruction-following Language Models via Bias Neurons Elimination
di: Yang, Nakyeong, et al.
Pubblicazione: (2023)
di: Yang, Nakyeong, et al.
Pubblicazione: (2023)
SPIN: Sparsifying and Integrating Internal Neurons in Large Language Models for Text Classification
di: Jiao, Difan, et al.
Pubblicazione: (2023)
di: Jiao, Difan, et al.
Pubblicazione: (2023)
Jamba: A Hybrid Transformer-Mamba Language Model
di: Lieber, Opher, et al.
Pubblicazione: (2024)
di: Lieber, Opher, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Music Genre Classification Using Machine Learning Techniques
di: Mishra, Alokit, et al.
Pubblicazione: (2025) -
GLUScope: A Tool for Analyzing GLU Neurons in Transformer Language Models
di: Gerstner, Sebastian, et al.
Pubblicazione: (2026) -
Training Language Models to Reason Efficiently
di: Arora, Daman, et al.
Pubblicazione: (2025) -
NeuronScope: A Multi-Agent Framework for Explaining Polysemantic Neurons in Language Models
di: Liu, Weiqi, et al.
Pubblicazione: (2026) -
Persona-aware Generative Model for Code-mixed Language
di: Sengupta, Ayan, et al.
Pubblicazione: (2023)