Unveiling Language Competence Neurons: A Psycholinguistic Approach to Model Interpretability
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Duan, Xufeng, Zhou, Xinyu, Xiao, Bei, Cai, Zhenguang G. |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
HLB: Benchmarking LLMs' Humanlikeness in Language Use
par: Duan, Xufeng, et autres
Publié: (2024)
par: Duan, Xufeng, et autres
Publié: (2024)
SCALPEL: Selective Capability Ablation via Low-rank Parameter Editing for Large Language Model Interpretability Analysis
par: Fu, Zihao, et autres
Publié: (2026)
par: Fu, Zihao, et autres
Publié: (2026)
Linguistic Minimal Pairs Elicit Linguistic Similarity in Large Language Models
par: Zhou, Xinyu, et autres
Publié: (2024)
par: Zhou, Xinyu, et autres
Publié: (2024)
Do Large Language Models Plan Answer Positions? Position Bias in Multiple-Choice Question Generation
par: Tang, Xuemei, et autres
Publié: (2026)
par: Tang, Xuemei, et autres
Publié: (2026)
Large Language Models for Automated Literature Review: An Evaluation of Reference Generation, Abstract Writing, and Review Composition
par: Tang, Xuemei, et autres
Publié: (2024)
par: Tang, Xuemei, et autres
Publié: (2024)
Grammaticality Representation in ChatGPT as Compared to Linguists and Laypeople
par: Qiu, Zhuang, et autres
Publié: (2024)
par: Qiu, Zhuang, et autres
Publié: (2024)
Distinct social-linguistic processing between humans and large audio-language models: Evidence from model-brain alignment
par: Wu, Hanlin, et autres
Publié: (2025)
par: Wu, Hanlin, et autres
Publié: (2025)
How Syntax Specialization Emerges in Language Models
par: Duan, Xufeng, et autres
Publié: (2025)
par: Duan, Xufeng, et autres
Publié: (2025)
Information Loss in LLMs' Multilingual Translation: The Role of Training Data, Language Proximity, and Language Family
par: Lin, Yumeng, et autres
Publié: (2025)
par: Lin, Yumeng, et autres
Publié: (2025)
MacBehaviour: An R package for behavioural experimentation on large language models
par: Duan, Xufeng, et autres
Publié: (2024)
par: Duan, Xufeng, et autres
Publié: (2024)
Do large language models resemble humans in language use?
par: Cai, Zhenguang G., et autres
Publié: (2023)
par: Cai, Zhenguang G., et autres
Publié: (2023)
Large Language Models for Psycholinguistic Plausibility Pretesting
par: Amouyal, Samuel Joseph, et autres
Publié: (2024)
par: Amouyal, Samuel Joseph, et autres
Publié: (2024)
A Psycholinguistic Evaluation of Language Models' Sensitivity to Argument Roles
par: Lee, Eun-Kyoung Rosa, et autres
Publié: (2024)
par: Lee, Eun-Kyoung Rosa, et autres
Publié: (2024)
When a Man Says He Is Pregnant: Event-related Potential Evidence for a Rational Account of Speaker-contextualized Language Comprehension
par: Wu, Hanlin, et autres
Publié: (2024)
par: Wu, Hanlin, et autres
Publié: (2024)
A Temporal Psycholinguistics Approach to Identity Resolution of Social Media Users
par: Islam, Md Touhidul
Publié: (2024)
par: Islam, Md Touhidul
Publié: (2024)
From Monolingual to Bilingual: Investigating Language Conditioning in Large Language Models for Psycholinguistic Tasks
par: Yuan, Shuzhou, et autres
Publié: (2025)
par: Yuan, Shuzhou, et autres
Publié: (2025)
Speaker effects in language comprehension: An integrative model of language and speaker processing
par: Wu, Hanlin, et autres
Publié: (2024)
par: Wu, Hanlin, et autres
Publié: (2024)
On the Proper Treatment of Tokenization in Psycholinguistics
par: Giulianelli, Mario, et autres
Publié: (2024)
par: Giulianelli, Mario, et autres
Publié: (2024)
When AI companions become witty: Can human brain recognize AI-generated irony?
par: Rao, Xiaohui, et autres
Publié: (2025)
par: Rao, Xiaohui, et autres
Publié: (2025)
A funny companion: Distinct neural responses to perceived AI- versus human-generated humor
par: Rao, Xiaohui, et autres
Publié: (2025)
par: Rao, Xiaohui, et autres
Publié: (2025)
A Survey of Idiom Datasets for Psycholinguistic and Computational Research
par: Flor, Michael, et autres
Publié: (2025)
par: Flor, Michael, et autres
Publié: (2025)
Unveiling the Influence of Amplifying Language-Specific Neurons
par: Rahmanisa, Inaya, et autres
Publié: (2025)
par: Rahmanisa, Inaya, et autres
Publié: (2025)
To Words and Beyond: Probing Large Language Models for Sentence-Level Psycholinguistic Norms of Memorability and Reading Times
par: Clark, Thomas Hikaru, et autres
Publié: (2026)
par: Clark, Thomas Hikaru, et autres
Publié: (2026)
Probabilistic adaptation of language comprehension for individual speakers: evidence from neural oscillations
par: Wu, Hanlin, et autres
Publié: (2025)
par: Wu, Hanlin, et autres
Publié: (2025)
Improving Neuron-level Interpretability with White-box Language Models
par: Bai, Hao, et autres
Publié: (2024)
par: Bai, Hao, et autres
Publié: (2024)
Psycholinguistic Word Features: a New Approach for the Evaluation of LLMs Alignment with Humans
par: Conde, Javier, et autres
Publié: (2025)
par: Conde, Javier, et autres
Publié: (2025)
Interpreting Arithmetic Mechanism in Large Language Models through Comparative Neuron Analysis
par: Yu, Zeping, et autres
Publié: (2024)
par: Yu, Zeping, et autres
Publié: (2024)
The Devil is in the Neurons: Interpreting and Mitigating Social Biases in Pre-trained Language Models
par: Liu, Yan, et autres
Publié: (2024)
par: Liu, Yan, et autres
Publié: (2024)
Unveiling Factual Recall Behaviors of Large Language Models through Knowledge Neurons
par: Wang, Yifei, et autres
Publié: (2024)
par: Wang, Yifei, et autres
Publié: (2024)
MMNeuron: Discovering Neuron-Level Domain-Specific Interpretation in Multimodal Large Language Model
par: Huo, Jiahao, et autres
Publié: (2024)
par: Huo, Jiahao, et autres
Publié: (2024)
Flash Interpretability: Decoding Specialised Feature Neurons in Large Language Models with the LM-Head
par: Davies, Harry J
Publié: (2025)
par: Davies, Harry J
Publié: (2025)
Adapting Psycholinguistic Research for LLMs: Gender-inclusive Language in a Coreference Context
par: Bartl, Marion, et autres
Publié: (2025)
par: Bartl, Marion, et autres
Publié: (2025)
LanguaShrink: Reducing Token Overhead with Psycholinguistics
par: Liang, Xuechen, et autres
Publié: (2024)
par: Liang, Xuechen, et autres
Publié: (2024)
From Behavioral Performance to Internal Competence: Interpreting Vision-Language Models with VLM-Lens
par: Sheta, Hala, et autres
Publié: (2025)
par: Sheta, Hala, et autres
Publié: (2025)
Psychological Profiling in Cybersecurity: A Look at LLMs and Psycholinguistic Features
par: Tshimula, Jean Marie, et autres
Publié: (2024)
par: Tshimula, Jean Marie, et autres
Publié: (2024)
Psycholinguistic Analyses in Software Engineering Text: A Systematic Literature Review
par: Sajadi, Amirali, et autres
Publié: (2025)
par: Sajadi, Amirali, et autres
Publié: (2025)
Themis: A Reference-free NLG Evaluation Language Model with Flexibility and Interpretability
par: Hu, Xinyu, et autres
Publié: (2024)
par: Hu, Xinyu, et autres
Publié: (2024)
Unveiling the Potential of Diffusion Large Language Model in Controllable Generation
par: Xiong, Zhen, et autres
Publié: (2025)
par: Xiong, Zhen, et autres
Publié: (2025)
Uncovering Visual-Semantic Psycholinguistic Properties from the Distributional Structure of Text Embedding Space
par: Wu, Si, et autres
Publié: (2025)
par: Wu, Si, et autres
Publié: (2025)
Interpreting Bias in Large Language Models: A Feature-Based Approach
par: Prakash, Nirmalendu, et autres
Publié: (2024)
par: Prakash, Nirmalendu, et autres
Publié: (2024)
Documents similaires
-
HLB: Benchmarking LLMs' Humanlikeness in Language Use
par: Duan, Xufeng, et autres
Publié: (2024) -
SCALPEL: Selective Capability Ablation via Low-rank Parameter Editing for Large Language Model Interpretability Analysis
par: Fu, Zihao, et autres
Publié: (2026) -
Linguistic Minimal Pairs Elicit Linguistic Similarity in Large Language Models
par: Zhou, Xinyu, et autres
Publié: (2024) -
Do Large Language Models Plan Answer Positions? Position Bias in Multiple-Choice Question Generation
par: Tang, Xuemei, et autres
Publié: (2026) -
Large Language Models for Automated Literature Review: An Evaluation of Reference Generation, Abstract Writing, and Review Composition
par: Tang, Xuemei, et autres
Publié: (2024)