Multilingual Brain Surgeon: Large Language Models Can be Compressed Leaving No Language Behind
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Zeng, Hongchuan, Xu, Hongshen, Chen, Lu, Yu, Kai |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Converging to a Lingua Franca: Evolution of Linguistic Regions and Semantics Alignment in Multilingual Large Language Models
von: Zeng, Hongchuan, et al.
Veröffentlicht: (2024)
von: Zeng, Hongchuan, et al.
Veröffentlicht: (2024)
Alignment for Efficient Tool Calling of Large Language Models
von: Xu, Hongshen, et al.
Veröffentlicht: (2025)
von: Xu, Hongshen, et al.
Veröffentlicht: (2025)
Sparsity-Accelerated Training for Large Language Models
von: Ma, Da, et al.
Veröffentlicht: (2024)
von: Ma, Da, et al.
Veröffentlicht: (2024)
CLaw: Benchmarking Chinese Legal Knowledge in Large Language Models - A Fine-grained Corpus and Reasoning Analysis
von: Xu, Xinzhe, et al.
Veröffentlicht: (2025)
von: Xu, Xinzhe, et al.
Veröffentlicht: (2025)
Delusions of Large Language Models
von: Xu, Hongshen, et al.
Veröffentlicht: (2025)
von: Xu, Hongshen, et al.
Veröffentlicht: (2025)
GraphGhost: Tracing Structures Behind Large Language Models
von: Dai, Xinnan, et al.
Veröffentlicht: (2025)
von: Dai, Xinnan, et al.
Veröffentlicht: (2025)
A BiRGAT Model for Multi-intent Spoken Language Understanding with Hierarchical Semantic Frames
von: Xu, Hongshen, et al.
Veröffentlicht: (2024)
von: Xu, Hongshen, et al.
Veröffentlicht: (2024)
XToM: Exploring the Multilingual Theory of Mind for Large Language Models
von: Chan, Chunkit, et al.
Veröffentlicht: (2025)
von: Chan, Chunkit, et al.
Veröffentlicht: (2025)
Behind Maya: Building a Multilingual Vision Language Model
von: Alam, Nahid, et al.
Veröffentlicht: (2025)
von: Alam, Nahid, et al.
Veröffentlicht: (2025)
Can Large Language Models Identify Authorship?
von: Huang, Baixiang, et al.
Veröffentlicht: (2024)
von: Huang, Baixiang, et al.
Veröffentlicht: (2024)
Dictionary Insertion Prompting for Multilingual Reasoning on Multilingual Large Language Models
von: Lu, Hongyuan, et al.
Veröffentlicht: (2024)
von: Lu, Hongyuan, et al.
Veröffentlicht: (2024)
On Multilingual Encoder Language Model Compression for Low-Resource Languages
von: Gurgurov, Daniil, et al.
Veröffentlicht: (2025)
von: Gurgurov, Daniil, et al.
Veröffentlicht: (2025)
CoE-SQL: In-Context Learning for Multi-Turn Text-to-SQL with Chain-of-Editions
von: Zhang, Hanchong, et al.
Veröffentlicht: (2024)
von: Zhang, Hanchong, et al.
Veröffentlicht: (2024)
Multilingual Large Language Models and Curse of Multilinguality
von: Gurgurov, Daniil, et al.
Veröffentlicht: (2024)
von: Gurgurov, Daniil, et al.
Veröffentlicht: (2024)
Disentangling Language and Culture for Evaluating Multilingual Large Language Models
von: Ying, Jiahao, et al.
Veröffentlicht: (2025)
von: Ying, Jiahao, et al.
Veröffentlicht: (2025)
Language Surgery in Multilingual Large Language Models
von: Lopo, Joanito Agili, et al.
Veröffentlicht: (2025)
von: Lopo, Joanito Agili, et al.
Veröffentlicht: (2025)
The Role of Mixed-Language Documents for Multilingual Large Language Model Pretraining
von: Shao, Jiandong, et al.
Veröffentlicht: (2026)
von: Shao, Jiandong, et al.
Veröffentlicht: (2026)
Pruning Multilingual Large Language Models for Multilingual Inference
von: Kim, Hwichan, et al.
Veröffentlicht: (2024)
von: Kim, Hwichan, et al.
Veröffentlicht: (2024)
Your Large Language Models Are Leaving Fingerprints
von: McGovern, Hope, et al.
Veröffentlicht: (2024)
von: McGovern, Hope, et al.
Veröffentlicht: (2024)
Quantifying Language Disparities in Multilingual Large Language Models
von: Hu, Songbo, et al.
Veröffentlicht: (2025)
von: Hu, Songbo, et al.
Veröffentlicht: (2025)
Marco-Bench-MIF: On Multilingual Instruction-Following Capability of Large Language Models
von: Zeng, Bo, et al.
Veröffentlicht: (2025)
von: Zeng, Bo, et al.
Veröffentlicht: (2025)
DiSRouter: Distributed Self-Routing for LLM Selections
von: Zheng, Hang, et al.
Veröffentlicht: (2025)
von: Zheng, Hang, et al.
Veröffentlicht: (2025)
Can Large Language Models Understand Context?
von: Zhu, Yilun, et al.
Veröffentlicht: (2024)
von: Zhu, Yilun, et al.
Veröffentlicht: (2024)
Can Large Language Models Understand Preferences in Personalized Recommendation?
von: Tan, Zhaoxuan, et al.
Veröffentlicht: (2025)
von: Tan, Zhaoxuan, et al.
Veröffentlicht: (2025)
Multilingual Large Language Model: A Survey of Resources, Taxonomy and Frontiers
von: Qin, Libo, et al.
Veröffentlicht: (2024)
von: Qin, Libo, et al.
Veröffentlicht: (2024)
The Rise and Down of Babel Tower: Investigating the Evolution Process of Multilingual Code Large Language Model
von: Chen, Jiawei, et al.
Veröffentlicht: (2024)
von: Chen, Jiawei, et al.
Veröffentlicht: (2024)
Multilingual Large Language Models: A Systematic Survey
von: Zhu, Shaolin, et al.
Veröffentlicht: (2024)
von: Zhu, Shaolin, et al.
Veröffentlicht: (2024)
Revealing the Parallel Multilingual Learning within Large Language Models
von: Mu, Yongyu, et al.
Veröffentlicht: (2024)
von: Mu, Yongyu, et al.
Veröffentlicht: (2024)
CM-Align: Consistency-based Multilingual Alignment for Large Language Models
von: Zhang, Xue, et al.
Veröffentlicht: (2025)
von: Zhang, Xue, et al.
Veröffentlicht: (2025)
Is It Good Data for Multilingual Instruction Tuning or Just Bad Multilingual Evaluation for Large Language Models?
von: Chen, Pinzhen, et al.
Veröffentlicht: (2024)
von: Chen, Pinzhen, et al.
Veröffentlicht: (2024)
Multilingual Collaborative Defense for Large Language Models
von: Li, Hongliang, et al.
Veröffentlicht: (2025)
von: Li, Hongliang, et al.
Veröffentlicht: (2025)
Enhancing LLM Reliability via Explicit Knowledge Boundary Modeling
von: Zheng, Hang, et al.
Veröffentlicht: (2025)
von: Zheng, Hang, et al.
Veröffentlicht: (2025)
Compressing KV Cache for Long-Context LLM Inference with Inter-Layer Attention Similarity
von: Ma, Da, et al.
Veröffentlicht: (2024)
von: Ma, Da, et al.
Veröffentlicht: (2024)
Multilingual Machine Translation with Large Language Models: Empirical Results and Analysis
von: Zhu, Wenhao, et al.
Veröffentlicht: (2023)
von: Zhu, Wenhao, et al.
Veröffentlicht: (2023)
Can Large Multimodal Models Uncover Deep Semantics Behind Images?
von: Yang, Yixin, et al.
Veröffentlicht: (2024)
von: Yang, Yixin, et al.
Veröffentlicht: (2024)
Exploring Multilingual Probing in Large Language Models: A Cross-Language Analysis
von: Li, Daoyang, et al.
Veröffentlicht: (2024)
von: Li, Daoyang, et al.
Veröffentlicht: (2024)
Multilingual Hallucination Gaps in Large Language Models
von: Chataigner, Cléa, et al.
Veröffentlicht: (2024)
von: Chataigner, Cléa, et al.
Veröffentlicht: (2024)
XTRUST: On the Multilingual Trustworthiness of Large Language Models
von: Li, Yahan, et al.
Veröffentlicht: (2024)
von: Li, Yahan, et al.
Veröffentlicht: (2024)
Multilingual Jailbreak Challenges in Large Language Models
von: Deng, Yue, et al.
Veröffentlicht: (2023)
von: Deng, Yue, et al.
Veröffentlicht: (2023)
All Languages Matter: On the Multilingual Safety of Large Language Models
von: Wang, Wenxuan, et al.
Veröffentlicht: (2023)
von: Wang, Wenxuan, et al.
Veröffentlicht: (2023)
Ähnliche Einträge
-
Converging to a Lingua Franca: Evolution of Linguistic Regions and Semantics Alignment in Multilingual Large Language Models
von: Zeng, Hongchuan, et al.
Veröffentlicht: (2024) -
Alignment for Efficient Tool Calling of Large Language Models
von: Xu, Hongshen, et al.
Veröffentlicht: (2025) -
Sparsity-Accelerated Training for Large Language Models
von: Ma, Da, et al.
Veröffentlicht: (2024) -
CLaw: Benchmarking Chinese Legal Knowledge in Large Language Models - A Fine-grained Corpus and Reasoning Analysis
von: Xu, Xinzhe, et al.
Veröffentlicht: (2025) -
Delusions of Large Language Models
von: Xu, Hongshen, et al.
Veröffentlicht: (2025)