Model Editing Harms General Abilities of Large Language Models: Regularization to the Rescue
Fuente:
arXiv
Salvato in:
| Autori principali: | Gu, Jia-Chen, Xu, Hao-Xiang, Ma, Jun-Yu, Lu, Pan, Ling, Zhen-Hua, Chang, Kai-Wei, Peng, Nanyun |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Neighboring Perturbations of Knowledge Editing on Large Language Models
di: Ma, Jun-Yu, et al.
Pubblicazione: (2024)
di: Ma, Jun-Yu, et al.
Pubblicazione: (2024)
Multiplicative Orthogonal Sequential Editing for Language Models
di: Xu, Hao-Xiang, et al.
Pubblicazione: (2026)
di: Xu, Hao-Xiang, et al.
Pubblicazione: (2026)
Constraining Sequential Model Editing with Editing Anchor Compression
di: Xu, Hao-Xiang, et al.
Pubblicazione: (2025)
di: Xu, Hao-Xiang, et al.
Pubblicazione: (2025)
Energy-Regularized Sequential Model Editing on Hyperspheres
di: Liu, Qingyuan, et al.
Pubblicazione: (2025)
di: Liu, Qingyuan, et al.
Pubblicazione: (2025)
Perturbation-Restrained Sequential Model Editing
di: Ma, Jun-Yu, et al.
Pubblicazione: (2024)
di: Ma, Jun-Yu, et al.
Pubblicazione: (2024)
Evaluating the Reversal Curse in Model Editing
di: Xu, Hao-Xiang, et al.
Pubblicazione: (2023)
di: Xu, Hao-Xiang, et al.
Pubblicazione: (2023)
Control Large Language Models via Divide and Conquer
di: Li, Bingxuan, et al.
Pubblicazione: (2024)
di: Li, Bingxuan, et al.
Pubblicazione: (2024)
DeepEdit: Knowledge Editing as Decoding with Constraints
di: Wang, Yiwei, et al.
Pubblicazione: (2024)
di: Wang, Yiwei, et al.
Pubblicazione: (2024)
On Prompt-Driven Safeguarding for Large Language Models
di: Zheng, Chujie, et al.
Pubblicazione: (2024)
di: Zheng, Chujie, et al.
Pubblicazione: (2024)
MRAG-Bench: Vision-Centric Evaluation for Retrieval-Augmented Multimodal Models
di: Hu, Wenbo, et al.
Pubblicazione: (2024)
di: Hu, Wenbo, et al.
Pubblicazione: (2024)
ConTextual: Evaluating Context-Sensitive Text-Rich Visual Reasoning in Large Multimodal Models
di: Wadhawan, Rohan, et al.
Pubblicazione: (2024)
di: Wadhawan, Rohan, et al.
Pubblicazione: (2024)
LLM-A*: Large Language Model Enhanced Incremental Heuristic Search on Path Planning
di: Meng, Silin, et al.
Pubblicazione: (2024)
di: Meng, Silin, et al.
Pubblicazione: (2024)
Synchronous Faithfulness Monitoring for Trustworthy Retrieval-Augmented Generation
di: Wu, Di, et al.
Pubblicazione: (2024)
di: Wu, Di, et al.
Pubblicazione: (2024)
On Asymmetric Optimization of Reasoning and Perception in Vision-Language Model Post-Training
di: Wu, Xueqing, et al.
Pubblicazione: (2026)
di: Wu, Xueqing, et al.
Pubblicazione: (2026)
Self-Routing RAG: Binding Selective Retrieval with Knowledge Verbalization
di: Wu, Di, et al.
Pubblicazione: (2025)
di: Wu, Di, et al.
Pubblicazione: (2025)
Fact or Guesswork? Evaluating Large Language Models' Medical Knowledge with Structured One-Hop Judgments
di: Li, Jiaxi, et al.
Pubblicazione: (2025)
di: Li, Jiaxi, et al.
Pubblicazione: (2025)
Matryoshka Query Transformer for Large Vision-Language Models
di: Hu, Wenbo, et al.
Pubblicazione: (2024)
di: Hu, Wenbo, et al.
Pubblicazione: (2024)
SALMONN: Towards Generic Hearing Abilities for Large Language Models
di: Tang, Changli, et al.
Pubblicazione: (2023)
di: Tang, Changli, et al.
Pubblicazione: (2023)
Comparing Bad Apples to Good Oranges: Aligning Large Language Models via Joint Preference Optimization
di: Bansal, Hritik, et al.
Pubblicazione: (2024)
di: Bansal, Hritik, et al.
Pubblicazione: (2024)
PhonologyBench: Evaluating Phonological Skills of Large Language Models
di: Suvarna, Ashima, et al.
Pubblicazione: (2024)
di: Suvarna, Ashima, et al.
Pubblicazione: (2024)
METAL: A Multi-Agent Framework for Chart Generation with Test-Time Scaling
di: Li, Bingxuan, et al.
Pubblicazione: (2025)
di: Li, Bingxuan, et al.
Pubblicazione: (2025)
REFFLY: Melody-Constrained Lyrics Editing Model
di: Zhao, Songyan, et al.
Pubblicazione: (2024)
di: Zhao, Songyan, et al.
Pubblicazione: (2024)
MatSciBench: Benchmarking the Reasoning Ability of Large Language Models in Materials Science
di: Zhang, Junkai, et al.
Pubblicazione: (2025)
di: Zhang, Junkai, et al.
Pubblicazione: (2025)
ICLEval: Evaluating In-Context Learning Ability of Large Language Models
di: Chen, Wentong, et al.
Pubblicazione: (2024)
di: Chen, Wentong, et al.
Pubblicazione: (2024)
Empowering Segmentation Ability to Multi-modal Large Language Models
di: Yang, Yuqi, et al.
Pubblicazione: (2024)
di: Yang, Yuqi, et al.
Pubblicazione: (2024)
BRIEF: Bridging Retrieval and Inference for Multi-hop Reasoning via Compression
di: Li, Yuankai, et al.
Pubblicazione: (2024)
di: Li, Yuankai, et al.
Pubblicazione: (2024)
UltraEdit: Training-, Subject-, and Memory-Free Lifelong Editing in Language Models
di: Gu, Xiaojie, et al.
Pubblicazione: (2025)
di: Gu, Xiaojie, et al.
Pubblicazione: (2025)
STAR: Boosting Low-Resource Information Extraction by Structure-to-Text Data Generation with Large Language Models
di: Ma, Mingyu Derek, et al.
Pubblicazione: (2023)
di: Ma, Mingyu Derek, et al.
Pubblicazione: (2023)
Editing Factual Knowledge and Explanatory Ability of Medical Large Language Models
di: Xu, Derong, et al.
Pubblicazione: (2024)
di: Xu, Derong, et al.
Pubblicazione: (2024)
Can Editing LLMs Inject Harm?
di: Chen, Canyu, et al.
Pubblicazione: (2024)
di: Chen, Canyu, et al.
Pubblicazione: (2024)
DLEBench: Evaluating Small-scale Object Editing Ability for Instruction-based Image Editing Model
di: Hong, Shibo, et al.
Pubblicazione: (2026)
di: Hong, Shibo, et al.
Pubblicazione: (2026)
Adversarial Representation Engineering: A General Model Editing Framework for Large Language Models
di: Zhang, Yihao, et al.
Pubblicazione: (2024)
di: Zhang, Yihao, et al.
Pubblicazione: (2024)
Group Relative Policy Optimization for Text-to-Speech with Large Language Models
di: Liu, Chang, et al.
Pubblicazione: (2025)
di: Liu, Chang, et al.
Pubblicazione: (2025)
The Labyrinth and the Thread: Rethinking Regularizations in Sequential Knowledge Editing for Large Language Models
di: Wang, Zheng, et al.
Pubblicazione: (2026)
di: Wang, Zheng, et al.
Pubblicazione: (2026)
Psychological Counseling Ability of Large Language Models
di: Peng, Fangyu, et al.
Pubblicazione: (2025)
di: Peng, Fangyu, et al.
Pubblicazione: (2025)
Voice Attribute Editing with Text Prompt
di: Sheng, Zhengyan, et al.
Pubblicazione: (2024)
di: Sheng, Zhengyan, et al.
Pubblicazione: (2024)
Towards Localized and Disentangled Knowledge Editing for Multimodal Large Language Models
di: Gu, Leijiang, et al.
Pubblicazione: (2026)
di: Gu, Leijiang, et al.
Pubblicazione: (2026)
NPHardEval: Dynamic Benchmark on Reasoning Ability of Large Language Models via Complexity Classes
di: Fan, Lizhou, et al.
Pubblicazione: (2023)
di: Fan, Lizhou, et al.
Pubblicazione: (2023)
Booster: Tackling Harmful Fine-tuning for Large Language Models via Attenuating Harmful Perturbation
di: Huang, Tiansheng, et al.
Pubblicazione: (2024)
di: Huang, Tiansheng, et al.
Pubblicazione: (2024)
Counting Ability of Large Language Models and Impact of Tokenization
di: Zhang, Xiang, et al.
Pubblicazione: (2024)
di: Zhang, Xiang, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Neighboring Perturbations of Knowledge Editing on Large Language Models
di: Ma, Jun-Yu, et al.
Pubblicazione: (2024) -
Multiplicative Orthogonal Sequential Editing for Language Models
di: Xu, Hao-Xiang, et al.
Pubblicazione: (2026) -
Constraining Sequential Model Editing with Editing Anchor Compression
di: Xu, Hao-Xiang, et al.
Pubblicazione: (2025) -
Energy-Regularized Sequential Model Editing on Hyperspheres
di: Liu, Qingyuan, et al.
Pubblicazione: (2025) -
Perturbation-Restrained Sequential Model Editing
di: Ma, Jun-Yu, et al.
Pubblicazione: (2024)