K-Edit: Language Model Editing with Contextual Knowledge Awareness
Fuente:
arXiv
Guardado en:
| Autores principales: | Markowitz, Elan, Ramakrishna, Anil, Mehrabi, Ninareh, Peris, Charith, Gupta, Rahul, Chang, Kai-Wei, Galstyan, Aram |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Tree-of-Traversals: A Zero-Shot Reasoning Algorithm for Augmenting Black-box Language Models with Knowledge Graphs
por: Markowitz, Elan, et al.
Publicado: (2024)
por: Markowitz, Elan, et al.
Publicado: (2024)
Towards Safety Reasoning in LLMs: AI-agentic Deliberation for Policy-embedded CoT Data Creation
por: Kumarage, Tharindu, et al.
Publicado: (2025)
por: Kumarage, Tharindu, et al.
Publicado: (2025)
SWAN: Semantic Watermarking with Abstract Meaning Representation
por: Ye, Ziping, et al.
Publicado: (2026)
por: Ye, Ziping, et al.
Publicado: (2026)
Kaleidoscopic Teaming in Multi Agent Simulations
por: Mehrabi, Ninareh, et al.
Publicado: (2025)
por: Mehrabi, Ninareh, et al.
Publicado: (2025)
Data Advisor: Dynamic Data Curation for Safety Alignment of Large Language Models
por: Wang, Fei, et al.
Publicado: (2024)
por: Wang, Fei, et al.
Publicado: (2024)
Attribute Controlled Fine-tuning for Large Language Models: A Case Study on Detoxification
por: Meng, Tao, et al.
Publicado: (2024)
por: Meng, Tao, et al.
Publicado: (2024)
KG-LLM-Bench: A Scalable Benchmark for Evaluating LLM Reasoning on Textualized Knowledge Graphs
por: Markowitz, Elan, et al.
Publicado: (2025)
por: Markowitz, Elan, et al.
Publicado: (2025)
Tokenization Matters: Navigating Data-Scarce Tokenization for Gender Inclusive Language Technologies
por: Ovalle, Anaelia, et al.
Publicado: (2023)
por: Ovalle, Anaelia, et al.
Publicado: (2023)
FLIRT: Feedback Loop In-context Red Teaming
por: Mehrabi, Ninareh, et al.
Publicado: (2023)
por: Mehrabi, Ninareh, et al.
Publicado: (2023)
On the steerability of large language models toward data-driven personas
por: Li, Junyi, et al.
Publicado: (2023)
por: Li, Junyi, et al.
Publicado: (2023)
ARES: Adaptive Red-Teaming and End-to-End Repair of Policy-Reward System
por: Liang, Jiacheng, et al.
Publicado: (2026)
por: Liang, Jiacheng, et al.
Publicado: (2026)
Emergent Strategic Reasoning Risks in AI: A Taxonomy-Driven Evaluation Framework
por: Kumarage, Tharindu, et al.
Publicado: (2026)
por: Kumarage, Tharindu, et al.
Publicado: (2026)
DeepEdit: Knowledge Editing as Decoding with Constraints
por: Wang, Yiwei, et al.
Publicado: (2024)
por: Wang, Yiwei, et al.
Publicado: (2024)
Strategize Globally, Adapt Locally: A Multi-Turn Red Teaming Agent with Dual-Level Learning
por: Chen, Si, et al.
Publicado: (2025)
por: Chen, Si, et al.
Publicado: (2025)
DiCoRe: Enhancing Zero-shot Event Detection via Divergent-Convergent LLM Reasoning
por: Parekh, Tanmay, et al.
Publicado: (2025)
por: Parekh, Tanmay, et al.
Publicado: (2025)
Diagnosing Memorization in Chain-of-Thought Reasoning, One Token at a Time
por: Li, Huihan, et al.
Publicado: (2025)
por: Li, Huihan, et al.
Publicado: (2025)
FERRET: Framework for Expansion Reliant Red Teaming
por: Mehrabi, Ninareh, et al.
Publicado: (2026)
por: Mehrabi, Ninareh, et al.
Publicado: (2026)
Has this Fact been Edited? Detecting Knowledge Edits in Language Models
por: Youssef, Paul, et al.
Publicado: (2024)
por: Youssef, Paul, et al.
Publicado: (2024)
AlphaEdit: Null-Space Constrained Knowledge Editing for Language Models
por: Fang, Junfeng, et al.
Publicado: (2024)
por: Fang, Junfeng, et al.
Publicado: (2024)
From Narrow Unlearning to Emergent Misalignment: Causes, Consequences, and Containment in LLMs
por: Mushtaq, Erum, et al.
Publicado: (2025)
por: Mushtaq, Erum, et al.
Publicado: (2025)
FLEKE: Federated Locate-then-Edit Knowledge Editing
por: Zhao, Zongkai, et al.
Publicado: (2025)
por: Zhao, Zongkai, et al.
Publicado: (2025)
DualEdit: Dual Editing for Knowledge Updating in Vision-Language Models
por: Shi, Zhiyi, et al.
Publicado: (2025)
por: Shi, Zhiyi, et al.
Publicado: (2025)
Should We Really Edit Language Models? On the Evaluation of Edited Language Models
por: Li, Qi, et al.
Publicado: (2024)
por: Li, Qi, et al.
Publicado: (2024)
SeRA: Self-Reviewing and Alignment of Large Language Models using Implicit Reward Margins
por: Ko, Jongwoo, et al.
Publicado: (2024)
por: Ko, Jongwoo, et al.
Publicado: (2024)
StruEdit: Structured Outputs Enable the Fast and Accurate Knowledge Editing for Large Language Models
por: Bi, Baolong, et al.
Publicado: (2024)
por: Bi, Baolong, et al.
Publicado: (2024)
MotionEdit: Benchmarking and Learning Motion-Centric Image Editing
por: Wan, Yixin, et al.
Publicado: (2025)
por: Wan, Yixin, et al.
Publicado: (2025)
Prompt Perturbation Consistency Learning for Robust Language Models
por: Qiang, Yao, et al.
Publicado: (2024)
por: Qiang, Yao, et al.
Publicado: (2024)
UltraEdit: Training-, Subject-, and Memory-Free Lifelong Editing in Language Models
por: Gu, Xiaojie, et al.
Publicado: (2025)
por: Gu, Xiaojie, et al.
Publicado: (2025)
MobiEdit: Resource-efficient Knowledge Editing for Personalized On-device LLMs
por: Lu, Zhenyan, et al.
Publicado: (2025)
por: Lu, Zhenyan, et al.
Publicado: (2025)
Controlling the Risk of Corrupted Contexts for Language Models via Early-Exiting
por: Wynn, Andrea, et al.
Publicado: (2025)
por: Wynn, Andrea, et al.
Publicado: (2025)
Are We Evaluating the Edit Locality of LLM Model Editing Properly?
por: Liu, Wei, et al.
Publicado: (2026)
por: Liu, Wei, et al.
Publicado: (2026)
Asking Back: Interaction-Layer Antidistillation Watermarks
por: Yang, Guang, et al.
Publicado: (2026)
por: Yang, Guang, et al.
Publicado: (2026)
BiasEdit: Debiasing Stereotyped Language Models via Model Editing
por: Xu, Xin, et al.
Publicado: (2025)
por: Xu, Xin, et al.
Publicado: (2025)
CaseEdit: Enhancing Localized Commonsense Reasoning via Null-Space Constrained Knowledge Editing in Small Parameter Language Models
por: Reddy, Varun, et al.
Publicado: (2025)
por: Reddy, Varun, et al.
Publicado: (2025)
Co-Evolving Agents: Learning from Failures as Hard Negatives
por: Jung, Yeonsung, et al.
Publicado: (2025)
por: Jung, Yeonsung, et al.
Publicado: (2025)
Beyond Binary Edits Robust Multimodal Knowledge Editing with Adversarial Subspace Alignment
por: Wang, Haoyuan, et al.
Publicado: (2026)
por: Wang, Haoyuan, et al.
Publicado: (2026)
AnyEdit++: Adaptive Long-Form Knowledge Editing via Bayesian Surprise
por: Tian, Bowen, et al.
Publicado: (2026)
por: Tian, Bowen, et al.
Publicado: (2026)
Knowledge Enhanced Multi-Domain Recommendations in an AI Assistant Application
por: Markowitz, Elan, et al.
Publicado: (2023)
por: Markowitz, Elan, et al.
Publicado: (2023)
InstructEdit: Instruction-based Knowledge Editing for Large Language Models
por: Zhang, Ningyu, et al.
Publicado: (2024)
por: Zhang, Ningyu, et al.
Publicado: (2024)
The Butterfly Effect of Model Editing: Few Edits Can Trigger Large Language Models Collapse
por: Yang, Wanli, et al.
Publicado: (2024)
por: Yang, Wanli, et al.
Publicado: (2024)
Ejemplares similares
-
Tree-of-Traversals: A Zero-Shot Reasoning Algorithm for Augmenting Black-box Language Models with Knowledge Graphs
por: Markowitz, Elan, et al.
Publicado: (2024) -
Towards Safety Reasoning in LLMs: AI-agentic Deliberation for Policy-embedded CoT Data Creation
por: Kumarage, Tharindu, et al.
Publicado: (2025) -
SWAN: Semantic Watermarking with Abstract Meaning Representation
por: Ye, Ziping, et al.
Publicado: (2026) -
Kaleidoscopic Teaming in Multi Agent Simulations
por: Mehrabi, Ninareh, et al.
Publicado: (2025) -
Data Advisor: Dynamic Data Curation for Safety Alignment of Large Language Models
por: Wang, Fei, et al.
Publicado: (2024)