Model Hemorrhage and the Robustness Limits of Large Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Ma, Ziyang, Li, Zuchao, Zhang, Lefei, Xia, Gui-Song, Du, Bo, Zhang, Liangpei, Tao, Dacheng |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Sparse is Enough in Fine-tuning Pre-trained Large Language Models
por: Song, Weixi, et al.
Publicado: (2023)
por: Song, Weixi, et al.
Publicado: (2023)
Bypass Back-propagation: Optimization-based Structural Pruning for Large Language Models via Policy Gradient
por: Gao, Yuan, et al.
Publicado: (2024)
por: Gao, Yuan, et al.
Publicado: (2024)
Segment First or Comprehend First? Explore the Limit of Unsupervised Word Segmentation with Large Language Models
por: Zhang, Zihong, et al.
Publicado: (2025)
por: Zhang, Zihong, et al.
Publicado: (2025)
FusionBench: A Unified Library and Comprehensive Benchmark for Deep Model Fusion
por: Tang, Anke, et al.
Publicado: (2024)
por: Tang, Anke, et al.
Publicado: (2024)
From AR to Diffusion: Efficiently Adapting Large Language Models with Strictly Causal and Elastic Horizons
por: Ma, Xiangyu, et al.
Publicado: (2026)
por: Ma, Xiangyu, et al.
Publicado: (2026)
Faster MoE LLM Inference for Extremely Large Models
por: Yang, Haoqi, et al.
Publicado: (2025)
por: Yang, Haoqi, et al.
Publicado: (2025)
LLM-PS: Empowering Large Language Models for Time Series Forecasting with Temporal Patterns and Semantics
por: Tang, Jialiang, et al.
Publicado: (2025)
por: Tang, Jialiang, et al.
Publicado: (2025)
Improving Large Language Models with Concept-Aware Fine-Tuning
por: Chen, Michael K., et al.
Publicado: (2025)
por: Chen, Michael K., et al.
Publicado: (2025)
Orion-14B: Open-source Multilingual Large Language Models
por: Chen, Du, et al.
Publicado: (2024)
por: Chen, Du, et al.
Publicado: (2024)
Robust and Scalable Model Editing for Large Language Models
por: Chen, Yingfa, et al.
Publicado: (2024)
por: Chen, Yingfa, et al.
Publicado: (2024)
JustLogic: A Comprehensive Benchmark for Evaluating Deductive Reasoning in Large Language Models
por: Chen, Michael K., et al.
Publicado: (2025)
por: Chen, Michael K., et al.
Publicado: (2025)
Reference Trustable Decoding: A Training-Free Augmentation Paradigm for Large Language Models
por: Shi, Luohe, et al.
Publicado: (2024)
por: Shi, Luohe, et al.
Publicado: (2024)
CoViPAL: Layer-wise Contextualized Visual Token Pruning for Large Vision-Language Models
por: Tang, Zicong, et al.
Publicado: (2025)
por: Tang, Zicong, et al.
Publicado: (2025)
SparseEval: Efficient Evaluation of Large Language Models by Sparse Optimization
por: Zhang, Taolin, et al.
Publicado: (2026)
por: Zhang, Taolin, et al.
Publicado: (2026)
Erasing Without Remembering: Implicit Knowledge Forgetting in Large Language Models
por: Wang, Huazheng, et al.
Publicado: (2025)
por: Wang, Huazheng, et al.
Publicado: (2025)
On the Thinking-Language Modeling Gap in Large Language Models
por: Liu, Chenxi, et al.
Publicado: (2025)
por: Liu, Chenxi, et al.
Publicado: (2025)
FBQuant: FeedBack Quantization for Large Language Models
por: Liu, Yijiang, et al.
Publicado: (2025)
por: Liu, Yijiang, et al.
Publicado: (2025)
LLMC: Benchmarking Large Language Model Quantization with a Versatile Compression Toolkit
por: Gong, Ruihao, et al.
Publicado: (2024)
por: Gong, Ruihao, et al.
Publicado: (2024)
Distilling Large Language Models for Text-Attributed Graph Learning
por: Pan, Bo, et al.
Publicado: (2024)
por: Pan, Bo, et al.
Publicado: (2024)
Large Language Model Selection with Limited Annotations
por: Durmazkeser, Yavuz, et al.
Publicado: (2026)
por: Durmazkeser, Yavuz, et al.
Publicado: (2026)
OmniBridge: Unified Multimodal Understanding, Generation, and Retrieval via Latent Space Alignment
por: Xiao, Teng, et al.
Publicado: (2025)
por: Xiao, Teng, et al.
Publicado: (2025)
Merlin's Whisper: Enabling Efficient Reasoning in Large Language Models via Black-box Persuasive Prompting
por: Xia, Heming, et al.
Publicado: (2025)
por: Xia, Heming, et al.
Publicado: (2025)
SambaLingo: Teaching Large Language Models New Languages
por: Csaki, Zoltan, et al.
Publicado: (2024)
por: Csaki, Zoltan, et al.
Publicado: (2024)
Knowledge Graph Large Language Model (KG-LLM) for Link Prediction
por: Shu, Dong, et al.
Publicado: (2024)
por: Shu, Dong, et al.
Publicado: (2024)
IAM: Efficient Inference through Attention Mapping between Different-scale LLMs
por: Zhao, Yi, et al.
Publicado: (2025)
por: Zhao, Yi, et al.
Publicado: (2025)
BoNBoN Alignment for Large Language Models and the Sweetness of Best-of-n Sampling
por: Gui, Lin, et al.
Publicado: (2024)
por: Gui, Lin, et al.
Publicado: (2024)
Energy-Based Reward Models for Robust Language Model Alignment
por: Lochab, Anamika, et al.
Publicado: (2025)
por: Lochab, Anamika, et al.
Publicado: (2025)
MoreauPruner: Robust Pruning of Large Language Models against Weight Perturbations
por: Wang, Zixiao, et al.
Publicado: (2024)
por: Wang, Zixiao, et al.
Publicado: (2024)
Teaching Large Language Models Number-Focused Headline Generation With Key Element Rationales
por: Qian, Zhen, et al.
Publicado: (2025)
por: Qian, Zhen, et al.
Publicado: (2025)
PAT: Pruning-Aware Tuning for Large Language Models
por: Liu, Yijiang, et al.
Publicado: (2024)
por: Liu, Yijiang, et al.
Publicado: (2024)
NOTA: Multimodal Music Notation Understanding for Visual Large Language Model
por: Tang, Mingni, et al.
Publicado: (2025)
por: Tang, Mingni, et al.
Publicado: (2025)
Can Language Models Perform Robust Reasoning in Chain-of-thought Prompting with Noisy Rationales?
por: Zhou, Zhanke, et al.
Publicado: (2024)
por: Zhou, Zhanke, et al.
Publicado: (2024)
LIDAO: Towards Limited Interventions for Debiasing (Large) Language Models
por: Liu, Tianci, et al.
Publicado: (2024)
por: Liu, Tianci, et al.
Publicado: (2024)
Towards Unified Task Embeddings Across Multiple Models: Bridging the Gap for Prompt-Based Large Language Models and Beyond
por: Wang, Xinyu, et al.
Publicado: (2024)
por: Wang, Xinyu, et al.
Publicado: (2024)
R1-VL: Learning to Reason with Multimodal Large Language Models via Step-wise Group Relative Policy Optimization
por: Zhang, Jingyi, et al.
Publicado: (2025)
por: Zhang, Jingyi, et al.
Publicado: (2025)
Quantifying the Impact of Structured Output Format on Large Language Models through Causal Inference
por: Yuan, Han, et al.
Publicado: (2025)
por: Yuan, Han, et al.
Publicado: (2025)
Learning Instruction-Following Policies through Open-Ended Instruction Relabeling with Large Language Models
por: Zhang, Zhicheng, et al.
Publicado: (2025)
por: Zhang, Zhicheng, et al.
Publicado: (2025)
Solving Situation Puzzles with Large Language Model and External Reformulation
por: Li, Kun, et al.
Publicado: (2025)
por: Li, Kun, et al.
Publicado: (2025)
Objective Metrics for Evaluating Large Language Models Using External Data Sources
por: Du, Haoze, et al.
Publicado: (2025)
por: Du, Haoze, et al.
Publicado: (2025)
Model Merging in Pre-training of Large Language Models
por: Li, Yunshui, et al.
Publicado: (2025)
por: Li, Yunshui, et al.
Publicado: (2025)
Ejemplares similares
-
Sparse is Enough in Fine-tuning Pre-trained Large Language Models
por: Song, Weixi, et al.
Publicado: (2023) -
Bypass Back-propagation: Optimization-based Structural Pruning for Large Language Models via Policy Gradient
por: Gao, Yuan, et al.
Publicado: (2024) -
Segment First or Comprehend First? Explore the Limit of Unsupervised Word Segmentation with Large Language Models
por: Zhang, Zihong, et al.
Publicado: (2025) -
FusionBench: A Unified Library and Comprehensive Benchmark for Deep Model Fusion
por: Tang, Anke, et al.
Publicado: (2024) -
From AR to Diffusion: Efficiently Adapting Large Language Models with Strictly Causal and Elastic Horizons
por: Ma, Xiangyu, et al.
Publicado: (2026)