Efficiently Quantifying and Mitigating Ripple Effects in Model Editing
Fuente:
arXiv
Guardado en:
| Autores principales: | Wang, Jianchen, Gu, Zhouhong, Zhu, Xiaoxuan, Zhang, Lin, Ye, Haoning, Xiong, Zhuozhi, Feng, Hongwei, Xiao, Yanghua |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
StrucText-Eval: Evaluating Large Language Model's Reasoning Ability in Structure-Rich Text
por: Gu, Zhouhong, et al.
Publicado: (2024)
por: Gu, Zhouhong, et al.
Publicado: (2024)
RECKON: Large-scale Reference-based Efficient Knowledge Evaluation for Large Language Model
por: Zhang, Lin, et al.
Publicado: (2025)
por: Zhang, Lin, et al.
Publicado: (2025)
Piecing Together Clues: A Benchmark for Evaluating the Detective Skills of Large Language Models
por: Gu, Zhouhong, et al.
Publicado: (2023)
por: Gu, Zhouhong, et al.
Publicado: (2023)
Xiezhi: An Ever-Updating Benchmark for Holistic Domain Knowledge Evaluation
por: Gu, Zhouhong, et al.
Publicado: (2023)
por: Gu, Zhouhong, et al.
Publicado: (2023)
ToReMi: Topic-Aware Data Reweighting for Dynamic Pre-Training Data Selection
por: Zhu, Xiaoxuan, et al.
Publicado: (2025)
por: Zhu, Xiaoxuan, et al.
Publicado: (2025)
DetectBench: Can Large Language Model Detect and Piece Together Implicit Evidence?
por: Gu, Zhouhong, et al.
Publicado: (2024)
por: Gu, Zhouhong, et al.
Publicado: (2024)
LITE: LLM-Impelled efficient Taxonomy Evaluation
por: Zhang, Lin, et al.
Publicado: (2025)
por: Zhang, Lin, et al.
Publicado: (2025)
LLM-GAN: Construct Generative Adversarial Network Through Large Language Models For Explainable Fake News Detection
por: Wang, Yifeng, et al.
Publicado: (2024)
por: Wang, Yifeng, et al.
Publicado: (2024)
VCEval: Rethinking What is a Good Educational Video and How to Automatically Evaluate It
por: Zhu, Xiaoxuan, et al.
Publicado: (2024)
por: Zhu, Xiaoxuan, et al.
Publicado: (2024)
GAPO: Learning Preferential Prompt through Generative Adversarial Policy Optimization
por: Gu, Zhouhong, et al.
Publicado: (2025)
por: Gu, Zhouhong, et al.
Publicado: (2025)
ConcEPT: Concept-Enhanced Pre-Training for Language Models
por: Wang, Xintao, et al.
Publicado: (2024)
por: Wang, Xintao, et al.
Publicado: (2024)
AgentGroupChat: An Interactive Group Chat Simulacra For Better Eliciting Emergent Behavior
por: Gu, Zhouhong, et al.
Publicado: (2024)
por: Gu, Zhouhong, et al.
Publicado: (2024)
AgentGroupChat-V2: Divide-and-Conquer Is What LLM-Based Multi-Agent System Need
por: Gu, Zhouhong, et al.
Publicado: (2025)
por: Gu, Zhouhong, et al.
Publicado: (2025)
MIRAGE: Exploring How Large Language Models Perform in Complex Social Interactive Environments
por: Cai, Yin, et al.
Publicado: (2025)
por: Cai, Yin, et al.
Publicado: (2025)
Can Large Language Models Understand Real-World Complex Instructions?
por: He, Qianyu, et al.
Publicado: (2023)
por: He, Qianyu, et al.
Publicado: (2023)
AutoScraper: A Progressive Understanding Web Agent for Web Scraper Generation
por: Huang, Wenhao, et al.
Publicado: (2024)
por: Huang, Wenhao, et al.
Publicado: (2024)
PrivUn: Unveiling Latent Ripple Effects and Shallow Forgetting in Privacy Unlearning
por: Chen, Xiaoyi, et al.
Publicado: (2026)
por: Chen, Xiaoyi, et al.
Publicado: (2026)
RIPPLECOT: Amplifying Ripple Effect of Knowledge Editing in Language Models via Chain-of-Thought In-Context Learning
por: Zhao, Zihao, et al.
Publicado: (2024)
por: Zhao, Zihao, et al.
Publicado: (2024)
ChainEdit: Propagating Ripple Effects in LLM Knowledge Editing through Logical Rule-Guided Chains
por: Dong, Zilu, et al.
Publicado: (2025)
por: Dong, Zilu, et al.
Publicado: (2025)
Recent Advancement of Emotion Cognition in Large Language Models
por: Chen, Yuyan, et al.
Publicado: (2024)
por: Chen, Yuyan, et al.
Publicado: (2024)
MCiteBench: A Multimodal Benchmark for Generating Text with Citations
por: Hu, Caiyu, et al.
Publicado: (2025)
por: Hu, Caiyu, et al.
Publicado: (2025)
Revealing and Mitigating Over-Attention in Knowledge Editing
por: Wang, Pinzheng, et al.
Publicado: (2025)
por: Wang, Pinzheng, et al.
Publicado: (2025)
How Easily do Irrelevant Inputs Skew the Responses of Large Language Models?
por: Wu, Siye, et al.
Publicado: (2024)
por: Wu, Siye, et al.
Publicado: (2024)
Reward Shaping to Mitigate Reward Hacking in RLHF
por: Fu, Jiayi, et al.
Publicado: (2025)
por: Fu, Jiayi, et al.
Publicado: (2025)
Gradient-guided Attention Map Editing: Towards Efficient Contextual Hallucination Mitigation
por: Wang, Yu, et al.
Publicado: (2025)
por: Wang, Yu, et al.
Publicado: (2025)
Spectral Characterization and Mitigation of Sequential Knowledge Editing Collapse
por: Zhang, Chi, et al.
Publicado: (2026)
por: Zhang, Chi, et al.
Publicado: (2026)
Why Does New Knowledge Create Messy Ripple Effects in LLMs?
por: Qin, Jiaxin, et al.
Publicado: (2024)
por: Qin, Jiaxin, et al.
Publicado: (2024)
Large Language Model Bias Mitigation from the Perspective of Knowledge Editing
por: Chen, Ruizhe, et al.
Publicado: (2024)
por: Chen, Ruizhe, et al.
Publicado: (2024)
TimeArena: Shaping Efficient Multitasking Language Agents in a Time-Aware Simulation
por: Zhang, Yikai, et al.
Publicado: (2024)
por: Zhang, Yikai, et al.
Publicado: (2024)
Privacy Ripple Effects from Adding or Removing Personal Information in Language Model Training
por: Borkar, Jaydeep, et al.
Publicado: (2025)
por: Borkar, Jaydeep, et al.
Publicado: (2025)
Enhancing Language Agent Strategic Reasoning through Self-Play in Adversarial Games
por: Zhang, Yikai, et al.
Publicado: (2025)
por: Zhang, Yikai, et al.
Publicado: (2025)
CODA: Difficulty-Aware Compute Allocation for Adaptive Reasoning
por: Wu, Siye, et al.
Publicado: (2026)
por: Wu, Siye, et al.
Publicado: (2026)
EditLens: Quantifying the Extent of AI Editing in Text
por: Thai, Katherine, et al.
Publicado: (2025)
por: Thai, Katherine, et al.
Publicado: (2025)
E-Sparse: Boosting the Large Language Model Inference through Entropy-based N:M Sparsity
por: Li, Yun, et al.
Publicado: (2023)
por: Li, Yun, et al.
Publicado: (2023)
Improving Recall of Large Language Models: A Model Collaboration Approach for Relational Triple Extraction
por: Ding, Zepeng, et al.
Publicado: (2024)
por: Ding, Zepeng, et al.
Publicado: (2024)
Scaling Behavior of Single LLM-Driven Multi-Agent Systems
por: Li, Jialing, et al.
Publicado: (2026)
por: Li, Jialing, et al.
Publicado: (2026)
PII-Bench: Evaluating Query-Aware Privacy Protection Systems
por: Shen, Hao, et al.
Publicado: (2025)
por: Shen, Hao, et al.
Publicado: (2025)
Towards Fair and Efficient De-identification: Quantifying the Efficiency and Generalizability of De-identification Approaches
por: Zambare, Noopur, et al.
Publicado: (2026)
por: Zambare, Noopur, et al.
Publicado: (2026)
Energy-Regularized Sequential Model Editing on Hyperspheres
por: Liu, Qingyuan, et al.
Publicado: (2025)
por: Liu, Qingyuan, et al.
Publicado: (2025)
From Theft to Bomb-Making: The Ripple Effect of Unlearning in Defending Against Jailbreak Attacks
por: Zhang, Zhexin, et al.
Publicado: (2024)
por: Zhang, Zhexin, et al.
Publicado: (2024)
Ejemplares similares
-
StrucText-Eval: Evaluating Large Language Model's Reasoning Ability in Structure-Rich Text
por: Gu, Zhouhong, et al.
Publicado: (2024) -
RECKON: Large-scale Reference-based Efficient Knowledge Evaluation for Large Language Model
por: Zhang, Lin, et al.
Publicado: (2025) -
Piecing Together Clues: A Benchmark for Evaluating the Detective Skills of Large Language Models
por: Gu, Zhouhong, et al.
Publicado: (2023) -
Xiezhi: An Ever-Updating Benchmark for Holistic Domain Knowledge Evaluation
por: Gu, Zhouhong, et al.
Publicado: (2023) -
ToReMi: Topic-Aware Data Reweighting for Dynamic Pre-Training Data Selection
por: Zhu, Xiaoxuan, et al.
Publicado: (2025)