The Butterfly Effect of Model Editing: Few Edits Can Trigger Large Language Models Collapse
Fuente:
arXiv
Guardado en:
| Autores principales: | Yang, Wanli, Sun, Fei, Ma, Xinyu, Liu, Xun, Yin, Dawei, Cheng, Xueqi |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Understanding the Collapse of LLMs in Model Editing
por: Yang, Wanli, et al.
Publicado: (2024)
por: Yang, Wanli, et al.
Publicado: (2024)
StruEdit: Structured Outputs Enable the Fast and Accurate Knowledge Editing for Large Language Models
por: Bi, Baolong, et al.
Publicado: (2024)
por: Bi, Baolong, et al.
Publicado: (2024)
Blinded by Generated Contexts: How Language Models Merge Generated and Retrieved Contexts When Knowledge Conflicts?
por: Tan, Hexiang, et al.
Publicado: (2024)
por: Tan, Hexiang, et al.
Publicado: (2024)
The Mirage of Model Editing: Revisiting Evaluation in the Wild
por: Yang, Wanli, et al.
Publicado: (2025)
por: Yang, Wanli, et al.
Publicado: (2025)
Should We Really Edit Language Models? On the Evaluation of Edited Language Models
por: Li, Qi, et al.
Publicado: (2024)
por: Li, Qi, et al.
Publicado: (2024)
Can It Edit? Evaluating the Ability of Large Language Models to Follow Code Editing Instructions
por: Cassano, Federico, et al.
Publicado: (2023)
por: Cassano, Federico, et al.
Publicado: (2023)
Can We Edit Multimodal Large Language Models?
por: Cheng, Siyuan, et al.
Publicado: (2023)
por: Cheng, Siyuan, et al.
Publicado: (2023)
EditMF: Drawing an Invisible Fingerprint for Your Large Language Models
por: Wu, Jiaxuan, et al.
Publicado: (2025)
por: Wu, Jiaxuan, et al.
Publicado: (2025)
Are We Evaluating the Edit Locality of LLM Model Editing Properly?
por: Liu, Wei, et al.
Publicado: (2026)
por: Liu, Wei, et al.
Publicado: (2026)
AlphaEdit: Null-Space Constrained Knowledge Editing for Language Models
por: Fang, Junfeng, et al.
Publicado: (2024)
por: Fang, Junfeng, et al.
Publicado: (2024)
K-Edit: Language Model Editing with Contextual Knowledge Awareness
por: Markowitz, Elan, et al.
Publicado: (2025)
por: Markowitz, Elan, et al.
Publicado: (2025)
InstructEdit: Instruction-based Knowledge Editing for Large Language Models
por: Zhang, Ningyu, et al.
Publicado: (2024)
por: Zhang, Ningyu, et al.
Publicado: (2024)
EasyEdit: An Easy-to-use Knowledge Editing Framework for Large Language Models
por: Wang, Peng, et al.
Publicado: (2023)
por: Wang, Peng, et al.
Publicado: (2023)
Investigating Context Effects in Similarity Judgements in Large Language Models
por: Uprety, Sagar, et al.
Publicado: (2024)
por: Uprety, Sagar, et al.
Publicado: (2024)
BlazeEdit: Generalist Image Editing on Mobile Devices with Image-to-Image Diffusion Models
por: Deng, Fei, et al.
Publicado: (2026)
por: Deng, Fei, et al.
Publicado: (2026)
Has this Fact been Edited? Detecting Knowledge Edits in Language Models
por: Youssef, Paul, et al.
Publicado: (2024)
por: Youssef, Paul, et al.
Publicado: (2024)
Can Fine-Tuning Erase Your Edits? On the Fragile Coexistence of Knowledge Editing and Adaptation
por: Cheng, Yinjie, et al.
Publicado: (2025)
por: Cheng, Yinjie, et al.
Publicado: (2025)
ReAD: Reinforcement-Guided Capability Distillation for Large Language Models
por: Cheng, Xueqi, et al.
Publicado: (2026)
por: Cheng, Xueqi, et al.
Publicado: (2026)
Plant, Persist, Trigger: Sleeper Attack on Large Language Model Agents
por: Li, Yongxiang, et al.
Publicado: (2026)
por: Li, Yongxiang, et al.
Publicado: (2026)
DLLMQuant: Quantizing Diffusion-based Large Language Models
por: Xu, Chen, et al.
Publicado: (2025)
por: Xu, Chen, et al.
Publicado: (2025)
BiasEdit: Debiasing Stereotyped Language Models via Model Editing
por: Xu, Xin, et al.
Publicado: (2025)
por: Xu, Xin, et al.
Publicado: (2025)
Large Language Models Can Self-Improve in Long-context Reasoning
por: Li, Siheng, et al.
Publicado: (2024)
por: Li, Siheng, et al.
Publicado: (2024)
Uni3D-LLM: Unifying Point Cloud Perception, Generation and Editing with Large Language Models
por: Liu, Dingning, et al.
Publicado: (2024)
por: Liu, Dingning, et al.
Publicado: (2024)
ExpressEdit: Video Editing with Natural Language and Sketching
por: Tilekbay, Bekzat, et al.
Publicado: (2024)
por: Tilekbay, Bekzat, et al.
Publicado: (2024)
ReasonEdit: Editing Vision-Language Models using Human Reasoning
por: Qiu, Jiaxing, et al.
Publicado: (2026)
por: Qiu, Jiaxing, et al.
Publicado: (2026)
DualEdit: Dual Editing for Knowledge Updating in Vision-Language Models
por: Shi, Zhiyi, et al.
Publicado: (2025)
por: Shi, Zhiyi, et al.
Publicado: (2025)
Unleashing the Power of LLMs in Dense Retrieval with Query Likelihood Modeling
por: Zhang, Hengran, et al.
Publicado: (2025)
por: Zhang, Hengran, et al.
Publicado: (2025)
Beyond Accuracy: The Role of Calibration in Self-Improving Large Language Models
por: Huang, Liangjie, et al.
Publicado: (2025)
por: Huang, Liangjie, et al.
Publicado: (2025)
LatentRouter: Can We Choose the Right Multimodal Model Before Seeing Its Answer?
por: Cheng, Xueqi, et al.
Publicado: (2026)
por: Cheng, Xueqi, et al.
Publicado: (2026)
Can Large Language Models Act as Ensembler for Multi-GNNs?
por: Duan, Hanqi, et al.
Publicado: (2024)
por: Duan, Hanqi, et al.
Publicado: (2024)
Resolving UnderEdit & OverEdit with Iterative & Neighbor-Assisted Model Editing
por: Baghel, Bhiman Kumar, et al.
Publicado: (2025)
por: Baghel, Bhiman Kumar, et al.
Publicado: (2025)
Identifying Knowledge Editing Types in Large Language Models
por: Li, Xiaopeng, et al.
Publicado: (2024)
por: Li, Xiaopeng, et al.
Publicado: (2024)
GraphGPT: Graph Instruction Tuning for Large Language Models
por: Tang, Jiabin, et al.
Publicado: (2023)
por: Tang, Jiabin, et al.
Publicado: (2023)
Coarse-to-Fine Open-Set Graph Node Classification with Large Language Models
por: Ma, Xueqi, et al.
Publicado: (2025)
por: Ma, Xueqi, et al.
Publicado: (2025)
Visual-Oriented Fine-Grained Knowledge Editing for MultiModal Large Language Models
por: Zeng, Zhen, et al.
Publicado: (2024)
por: Zeng, Zhen, et al.
Publicado: (2024)
Large Language Model Sourcing: A Survey
por: Pang, Liang, et al.
Publicado: (2025)
por: Pang, Liang, et al.
Publicado: (2025)
A Survey of Large Language Models for Graphs
por: Ren, Xubin, et al.
Publicado: (2024)
por: Ren, Xubin, et al.
Publicado: (2024)
Can Large Language Models do Analytical Reasoning?
por: Hu, Yebowen, et al.
Publicado: (2024)
por: Hu, Yebowen, et al.
Publicado: (2024)
UltraEdit: Training-, Subject-, and Memory-Free Lifelong Editing in Language Models
por: Gu, Xiaojie, et al.
Publicado: (2025)
por: Gu, Xiaojie, et al.
Publicado: (2025)
Internal Safety Collapse in Frontier Large Language Models
por: Wu, Yutao, et al.
Publicado: (2026)
por: Wu, Yutao, et al.
Publicado: (2026)
Ejemplares similares
-
Understanding the Collapse of LLMs in Model Editing
por: Yang, Wanli, et al.
Publicado: (2024) -
StruEdit: Structured Outputs Enable the Fast and Accurate Knowledge Editing for Large Language Models
por: Bi, Baolong, et al.
Publicado: (2024) -
Blinded by Generated Contexts: How Language Models Merge Generated and Retrieved Contexts When Knowledge Conflicts?
por: Tan, Hexiang, et al.
Publicado: (2024) -
The Mirage of Model Editing: Revisiting Evaluation in the Wild
por: Yang, Wanli, et al.
Publicado: (2025) -
Should We Really Edit Language Models? On the Evaluation of Edited Language Models
por: Li, Qi, et al.
Publicado: (2024)