Language-Specific Neurons: The Key to Multilingual Capabilities in Large Language Models
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Tang, Tianyi, Luo, Wenyang, Huang, Haoyang, Zhang, Dongdong, Wang, Xiaolei, Zhao, Xin, Wei, Furu, Wen, Ji-Rong |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Neuron-based Personality Trait Induction in Large Language Models
von: Deng, Jia, et al.
Veröffentlicht: (2024)
von: Deng, Jia, et al.
Veröffentlicht: (2024)
Chain-of-Dictionary Prompting Elicits Translation in Large Language Models
von: Lu, Hongyuan, et al.
Veröffentlicht: (2023)
von: Lu, Hongyuan, et al.
Veröffentlicht: (2023)
Rethinking the Evaluation for Conversational Recommendation in the Era of Large Language Models
von: Wang, Xiaolei, et al.
Veröffentlicht: (2023)
von: Wang, Xiaolei, et al.
Veröffentlicht: (2023)
MMATH: A Multilingual Benchmark for Mathematical Reasoning
von: Luo, Wenyang, et al.
Veröffentlicht: (2025)
von: Luo, Wenyang, et al.
Veröffentlicht: (2025)
BAMBOO: A Comprehensive Benchmark for Evaluating Long Text Modeling Capacities of Large Language Models
von: Dong, Zican, et al.
Veröffentlicht: (2023)
von: Dong, Zican, et al.
Veröffentlicht: (2023)
Disentangling Language and Culture for Evaluating Multilingual Large Language Models
von: Ying, Jiahao, et al.
Veröffentlicht: (2025)
von: Ying, Jiahao, et al.
Veröffentlicht: (2025)
Unleashing the Potential of Large Language Models as Prompt Optimizers: Analogical Analysis with Gradient-based Model Optimizers
von: Tang, Xinyu, et al.
Veröffentlicht: (2024)
von: Tang, Xinyu, et al.
Veröffentlicht: (2024)
ShifCon: Enhancing Non-Dominant Language Capabilities with a Shift-based Multilingual Contrastive Framework
von: Zhang, Hengyuan, et al.
Veröffentlicht: (2024)
von: Zhang, Hengyuan, et al.
Veröffentlicht: (2024)
CRANE: Causal Relevance Analysis of Language-Specific Neurons in Multilingual Large Language Models
von: Le, Yifan, et al.
Veröffentlicht: (2026)
von: Le, Yifan, et al.
Veröffentlicht: (2026)
Not All Metrics Are Guilty: Improving NLG Evaluation by Diversifying References
von: Tang, Tianyi, et al.
Veröffentlicht: (2023)
von: Tang, Tianyi, et al.
Veröffentlicht: (2023)
Isolating Culture Neurons in Multilingual Large Language Models
von: Namazifard, Danial, et al.
Veröffentlicht: (2025)
von: Namazifard, Danial, et al.
Veröffentlicht: (2025)
On Relation-Specific Neurons in Large Language Models
von: Liu, Yihong, et al.
Veröffentlicht: (2025)
von: Liu, Yihong, et al.
Veröffentlicht: (2025)
Adapting Large Language Models to Domains via Reading Comprehension
von: Cheng, Daixuan, et al.
Veröffentlicht: (2023)
von: Cheng, Daixuan, et al.
Veröffentlicht: (2023)
Unlocking General Long Chain-of-Thought Reasoning Capabilities of Large Language Models via Representation Engineering
von: Tang, Xinyu, et al.
Veröffentlicht: (2025)
von: Tang, Xinyu, et al.
Veröffentlicht: (2025)
The Role of Diversity in In-Context Learning for Large Language Models
von: Xiao, Wenyang, et al.
Veröffentlicht: (2025)
von: Xiao, Wenyang, et al.
Veröffentlicht: (2025)
Towards Coarse-to-Fine Evaluation of Inference Efficiency for Large Language Models
von: Chen, Yushuo, et al.
Veröffentlicht: (2024)
von: Chen, Yushuo, et al.
Veröffentlicht: (2024)
Crosslingual Capabilities and Knowledge Barriers in Multilingual Large Language Models
von: Chua, Lynn, et al.
Veröffentlicht: (2024)
von: Chua, Lynn, et al.
Veröffentlicht: (2024)
How Does Alignment Enhance LLMs' Multilingual Capabilities? A Language Neurons Perspective
von: Zhang, Shimao, et al.
Veröffentlicht: (2025)
von: Zhang, Shimao, et al.
Veröffentlicht: (2025)
Marco-Bench-MIF: On Multilingual Instruction-Following Capability of Large Language Models
von: Zeng, Bo, et al.
Veröffentlicht: (2025)
von: Zeng, Bo, et al.
Veröffentlicht: (2025)
On the Multilingual Ability of Decoder-based Pre-trained Language Models: Finding and Controlling Language-Specific Neurons
von: Kojima, Takeshi, et al.
Veröffentlicht: (2024)
von: Kojima, Takeshi, et al.
Veröffentlicht: (2024)
From Neurons to Semantics: Evaluating Cross-Linguistic Alignment Capabilities of Large Language Models via Neurons Alignment
von: Huang, Chongxuan, et al.
Veröffentlicht: (2025)
von: Huang, Chongxuan, et al.
Veröffentlicht: (2025)
ChainLM: Empowering Large Language Models with Improved Chain-of-Thought Prompting
von: Cheng, Xiaoxue, et al.
Veröffentlicht: (2024)
von: Cheng, Xiaoxue, et al.
Veröffentlicht: (2024)
Textual Aesthetics in Large Language Models
von: Jiang, Lingjie, et al.
Veröffentlicht: (2024)
von: Jiang, Lingjie, et al.
Veröffentlicht: (2024)
DAWN-ICL: Strategic Planning of Problem-solving Trajectories for Zero-Shot In-Context Learning
von: Tang, Xinyu, et al.
Veröffentlicht: (2024)
von: Tang, Xinyu, et al.
Veröffentlicht: (2024)
Language-Specific Layer Matters: Efficient Multilingual Enhancement for Large Vision-Language Models
von: Fan, Yuchun, et al.
Veröffentlicht: (2025)
von: Fan, Yuchun, et al.
Veröffentlicht: (2025)
Dial-insight: Fine-tuning Large Language Models with High-Quality Domain-Specific Data Preventing Capability Collapse
von: Sun, Jianwei, et al.
Veröffentlicht: (2024)
von: Sun, Jianwei, et al.
Veröffentlicht: (2024)
MiniLLM: On-Policy Distillation of Large Language Models
von: Gu, Yuxian, et al.
Veröffentlicht: (2023)
von: Gu, Yuxian, et al.
Veröffentlicht: (2023)
MuBench: Assessment of Multilingual Capabilities of Large Language Models Across 61 Languages
von: Han, Wenhan, et al.
Veröffentlicht: (2025)
von: Han, Wenhan, et al.
Veröffentlicht: (2025)
RoT: Enhancing Large Language Models with Reflection on Search Trees
von: Hui, Wenyang, et al.
Veröffentlicht: (2024)
von: Hui, Wenyang, et al.
Veröffentlicht: (2024)
LLMBox: A Comprehensive Library for Large Language Models
von: Tang, Tianyi, et al.
Veröffentlicht: (2024)
von: Tang, Tianyi, et al.
Veröffentlicht: (2024)
A Survey of Large Language Models
von: Zhao, Wayne Xin, et al.
Veröffentlicht: (2023)
von: Zhao, Wayne Xin, et al.
Veröffentlicht: (2023)
Investigating the Pre-Training Dynamics of In-Context Learning: Task Recognition vs. Task Learning
von: Wang, Xiaolei, et al.
Veröffentlicht: (2024)
von: Wang, Xiaolei, et al.
Veröffentlicht: (2024)
Learning to Retrieve In-Context Examples for Large Language Models
von: Wang, Liang, et al.
Veröffentlicht: (2023)
von: Wang, Liang, et al.
Veröffentlicht: (2023)
MINER: Mining the Underlying Pattern of Modality-Specific Neurons in Multimodal Large Language Models
von: Huang, Kaichen, et al.
Veröffentlicht: (2024)
von: Huang, Kaichen, et al.
Veröffentlicht: (2024)
Challenging the Boundaries of Reasoning: An Olympiad-Level Math Benchmark for Large Language Models
von: Sun, Haoxiang, et al.
Veröffentlicht: (2025)
von: Sun, Haoxiang, et al.
Veröffentlicht: (2025)
Enhancing Multilingual Capabilities of Large Language Models through Self-Distillation from Resource-Rich Languages
von: Zhang, Yuanchi, et al.
Veröffentlicht: (2024)
von: Zhang, Yuanchi, et al.
Veröffentlicht: (2024)
Unveiling the Flaws: Exploring Imperfections in Synthetic Data and Mitigation Strategies for Large Language Models
von: Chen, Jie, et al.
Veröffentlicht: (2024)
von: Chen, Jie, et al.
Veröffentlicht: (2024)
Multilingual Knowledge Editing with Language-Agnostic Factual Neurons
von: Zhang, Xue, et al.
Veröffentlicht: (2024)
von: Zhang, Xue, et al.
Veröffentlicht: (2024)
Just Go Parallel: Improving the Multilingual Capabilities of Large Language Models
von: Qorib, Muhammad Reza, et al.
Veröffentlicht: (2025)
von: Qorib, Muhammad Reza, et al.
Veröffentlicht: (2025)
Evaluating the Elementary Multilingual Capabilities of Large Language Models with MultiQ
von: Holtermann, Carolin, et al.
Veröffentlicht: (2024)
von: Holtermann, Carolin, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Neuron-based Personality Trait Induction in Large Language Models
von: Deng, Jia, et al.
Veröffentlicht: (2024) -
Chain-of-Dictionary Prompting Elicits Translation in Large Language Models
von: Lu, Hongyuan, et al.
Veröffentlicht: (2023) -
Rethinking the Evaluation for Conversational Recommendation in the Era of Large Language Models
von: Wang, Xiaolei, et al.
Veröffentlicht: (2023) -
MMATH: A Multilingual Benchmark for Mathematical Reasoning
von: Luo, Wenyang, et al.
Veröffentlicht: (2025) -
BAMBOO: A Comprehensive Benchmark for Evaluating Long Text Modeling Capacities of Large Language Models
von: Dong, Zican, et al.
Veröffentlicht: (2023)