Language-Specific Neurons: The Key to Multilingual Capabilities in Large Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Tang, Tianyi, Luo, Wenyang, Huang, Haoyang, Zhang, Dongdong, Wang, Xiaolei, Zhao, Xin, Wei, Furu, Wen, Ji-Rong |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Neuron-based Personality Trait Induction in Large Language Models
por: Deng, Jia, et al.
Publicado: (2024)
por: Deng, Jia, et al.
Publicado: (2024)
Chain-of-Dictionary Prompting Elicits Translation in Large Language Models
por: Lu, Hongyuan, et al.
Publicado: (2023)
por: Lu, Hongyuan, et al.
Publicado: (2023)
Rethinking the Evaluation for Conversational Recommendation in the Era of Large Language Models
por: Wang, Xiaolei, et al.
Publicado: (2023)
por: Wang, Xiaolei, et al.
Publicado: (2023)
MMATH: A Multilingual Benchmark for Mathematical Reasoning
por: Luo, Wenyang, et al.
Publicado: (2025)
por: Luo, Wenyang, et al.
Publicado: (2025)
BAMBOO: A Comprehensive Benchmark for Evaluating Long Text Modeling Capacities of Large Language Models
por: Dong, Zican, et al.
Publicado: (2023)
por: Dong, Zican, et al.
Publicado: (2023)
Disentangling Language and Culture for Evaluating Multilingual Large Language Models
por: Ying, Jiahao, et al.
Publicado: (2025)
por: Ying, Jiahao, et al.
Publicado: (2025)
Unleashing the Potential of Large Language Models as Prompt Optimizers: Analogical Analysis with Gradient-based Model Optimizers
por: Tang, Xinyu, et al.
Publicado: (2024)
por: Tang, Xinyu, et al.
Publicado: (2024)
ShifCon: Enhancing Non-Dominant Language Capabilities with a Shift-based Multilingual Contrastive Framework
por: Zhang, Hengyuan, et al.
Publicado: (2024)
por: Zhang, Hengyuan, et al.
Publicado: (2024)
CRANE: Causal Relevance Analysis of Language-Specific Neurons in Multilingual Large Language Models
por: Le, Yifan, et al.
Publicado: (2026)
por: Le, Yifan, et al.
Publicado: (2026)
Not All Metrics Are Guilty: Improving NLG Evaluation by Diversifying References
por: Tang, Tianyi, et al.
Publicado: (2023)
por: Tang, Tianyi, et al.
Publicado: (2023)
Isolating Culture Neurons in Multilingual Large Language Models
por: Namazifard, Danial, et al.
Publicado: (2025)
por: Namazifard, Danial, et al.
Publicado: (2025)
On Relation-Specific Neurons in Large Language Models
por: Liu, Yihong, et al.
Publicado: (2025)
por: Liu, Yihong, et al.
Publicado: (2025)
Adapting Large Language Models to Domains via Reading Comprehension
por: Cheng, Daixuan, et al.
Publicado: (2023)
por: Cheng, Daixuan, et al.
Publicado: (2023)
Unlocking General Long Chain-of-Thought Reasoning Capabilities of Large Language Models via Representation Engineering
por: Tang, Xinyu, et al.
Publicado: (2025)
por: Tang, Xinyu, et al.
Publicado: (2025)
The Role of Diversity in In-Context Learning for Large Language Models
por: Xiao, Wenyang, et al.
Publicado: (2025)
por: Xiao, Wenyang, et al.
Publicado: (2025)
Towards Coarse-to-Fine Evaluation of Inference Efficiency for Large Language Models
por: Chen, Yushuo, et al.
Publicado: (2024)
por: Chen, Yushuo, et al.
Publicado: (2024)
Crosslingual Capabilities and Knowledge Barriers in Multilingual Large Language Models
por: Chua, Lynn, et al.
Publicado: (2024)
por: Chua, Lynn, et al.
Publicado: (2024)
How Does Alignment Enhance LLMs' Multilingual Capabilities? A Language Neurons Perspective
por: Zhang, Shimao, et al.
Publicado: (2025)
por: Zhang, Shimao, et al.
Publicado: (2025)
Marco-Bench-MIF: On Multilingual Instruction-Following Capability of Large Language Models
por: Zeng, Bo, et al.
Publicado: (2025)
por: Zeng, Bo, et al.
Publicado: (2025)
On the Multilingual Ability of Decoder-based Pre-trained Language Models: Finding and Controlling Language-Specific Neurons
por: Kojima, Takeshi, et al.
Publicado: (2024)
por: Kojima, Takeshi, et al.
Publicado: (2024)
From Neurons to Semantics: Evaluating Cross-Linguistic Alignment Capabilities of Large Language Models via Neurons Alignment
por: Huang, Chongxuan, et al.
Publicado: (2025)
por: Huang, Chongxuan, et al.
Publicado: (2025)
ChainLM: Empowering Large Language Models with Improved Chain-of-Thought Prompting
por: Cheng, Xiaoxue, et al.
Publicado: (2024)
por: Cheng, Xiaoxue, et al.
Publicado: (2024)
Textual Aesthetics in Large Language Models
por: Jiang, Lingjie, et al.
Publicado: (2024)
por: Jiang, Lingjie, et al.
Publicado: (2024)
DAWN-ICL: Strategic Planning of Problem-solving Trajectories for Zero-Shot In-Context Learning
por: Tang, Xinyu, et al.
Publicado: (2024)
por: Tang, Xinyu, et al.
Publicado: (2024)
Language-Specific Layer Matters: Efficient Multilingual Enhancement for Large Vision-Language Models
por: Fan, Yuchun, et al.
Publicado: (2025)
por: Fan, Yuchun, et al.
Publicado: (2025)
Dial-insight: Fine-tuning Large Language Models with High-Quality Domain-Specific Data Preventing Capability Collapse
por: Sun, Jianwei, et al.
Publicado: (2024)
por: Sun, Jianwei, et al.
Publicado: (2024)
MiniLLM: On-Policy Distillation of Large Language Models
por: Gu, Yuxian, et al.
Publicado: (2023)
por: Gu, Yuxian, et al.
Publicado: (2023)
MuBench: Assessment of Multilingual Capabilities of Large Language Models Across 61 Languages
por: Han, Wenhan, et al.
Publicado: (2025)
por: Han, Wenhan, et al.
Publicado: (2025)
RoT: Enhancing Large Language Models with Reflection on Search Trees
por: Hui, Wenyang, et al.
Publicado: (2024)
por: Hui, Wenyang, et al.
Publicado: (2024)
LLMBox: A Comprehensive Library for Large Language Models
por: Tang, Tianyi, et al.
Publicado: (2024)
por: Tang, Tianyi, et al.
Publicado: (2024)
A Survey of Large Language Models
por: Zhao, Wayne Xin, et al.
Publicado: (2023)
por: Zhao, Wayne Xin, et al.
Publicado: (2023)
Investigating the Pre-Training Dynamics of In-Context Learning: Task Recognition vs. Task Learning
por: Wang, Xiaolei, et al.
Publicado: (2024)
por: Wang, Xiaolei, et al.
Publicado: (2024)
Learning to Retrieve In-Context Examples for Large Language Models
por: Wang, Liang, et al.
Publicado: (2023)
por: Wang, Liang, et al.
Publicado: (2023)
MINER: Mining the Underlying Pattern of Modality-Specific Neurons in Multimodal Large Language Models
por: Huang, Kaichen, et al.
Publicado: (2024)
por: Huang, Kaichen, et al.
Publicado: (2024)
Challenging the Boundaries of Reasoning: An Olympiad-Level Math Benchmark for Large Language Models
por: Sun, Haoxiang, et al.
Publicado: (2025)
por: Sun, Haoxiang, et al.
Publicado: (2025)
Enhancing Multilingual Capabilities of Large Language Models through Self-Distillation from Resource-Rich Languages
por: Zhang, Yuanchi, et al.
Publicado: (2024)
por: Zhang, Yuanchi, et al.
Publicado: (2024)
Unveiling the Flaws: Exploring Imperfections in Synthetic Data and Mitigation Strategies for Large Language Models
por: Chen, Jie, et al.
Publicado: (2024)
por: Chen, Jie, et al.
Publicado: (2024)
Multilingual Knowledge Editing with Language-Agnostic Factual Neurons
por: Zhang, Xue, et al.
Publicado: (2024)
por: Zhang, Xue, et al.
Publicado: (2024)
Just Go Parallel: Improving the Multilingual Capabilities of Large Language Models
por: Qorib, Muhammad Reza, et al.
Publicado: (2025)
por: Qorib, Muhammad Reza, et al.
Publicado: (2025)
Evaluating the Elementary Multilingual Capabilities of Large Language Models with MultiQ
por: Holtermann, Carolin, et al.
Publicado: (2024)
por: Holtermann, Carolin, et al.
Publicado: (2024)
Ejemplares similares
-
Neuron-based Personality Trait Induction in Large Language Models
por: Deng, Jia, et al.
Publicado: (2024) -
Chain-of-Dictionary Prompting Elicits Translation in Large Language Models
por: Lu, Hongyuan, et al.
Publicado: (2023) -
Rethinking the Evaluation for Conversational Recommendation in the Era of Large Language Models
por: Wang, Xiaolei, et al.
Publicado: (2023) -
MMATH: A Multilingual Benchmark for Mathematical Reasoning
por: Luo, Wenyang, et al.
Publicado: (2025) -
BAMBOO: A Comprehensive Benchmark for Evaluating Long Text Modeling Capacities of Large Language Models
por: Dong, Zican, et al.
Publicado: (2023)