Knowledge Editing in Language Models via Adapted Direct Preference Optimization
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Rozner, Amit, Battash, Barak, Wolf, Lior, Lindenbaum, Ofir |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Obtaining Favorable Layouts for Multiple Object Generation
par: Battash, Barak, et autres
Publié: (2024)
par: Battash, Barak, et autres
Publié: (2024)
Anomaly Detection with Variance Stabilized Density Estimation
par: Rozner, Amit, et autres
Publié: (2023)
par: Rozner, Amit, et autres
Publié: (2023)
Efficient Verification-Based Face Identification
par: Rozner, Amit, et autres
Publié: (2023)
par: Rozner, Amit, et autres
Publié: (2023)
Domain-Generalizable Multiple-Domain Clustering
par: Rozner, Amit, et autres
Publié: (2023)
par: Rozner, Amit, et autres
Publié: (2023)
TransformLLM: Adapting Large Language Models via LLM-Transformed Reading Comprehension Text
par: Arbel, Iftach, et autres
Publié: (2024)
par: Arbel, Iftach, et autres
Publié: (2024)
PRILoRA: Pruned and Rank-Increasing Low-Rank Adaptation
par: Benedek, Nadav, et autres
Publié: (2024)
par: Benedek, Nadav, et autres
Publié: (2024)
Controlling Chat Style in Language Models via Single-Direction Editing
par: Xu, Zhenyu, et autres
Publié: (2026)
par: Xu, Zhenyu, et autres
Publié: (2026)
UtilityMax Prompting: A Formal Framework for Multi-Objective Large Language Model Tasks
par: Marom, Ofir
Publié: (2026)
par: Marom, Ofir
Publié: (2026)
Faithfulness Serum: Mitigating the Faithfulness Gap in Textual Explanations of LLM Decisions via Attribution Guidance
par: Alon, Bar, et autres
Publié: (2026)
par: Alon, Bar, et autres
Publié: (2026)
Editing Knowledge Representation of Language Model via Rephrased Prefix Prompts
par: Cai, Yuchen, et autres
Publié: (2024)
par: Cai, Yuchen, et autres
Publié: (2024)
RLearner-LLM: Balancing Logical Grounding and Fluency in Large Language Models via Hybrid Direct Preference Optimization
par: Bao, Qiming, et autres
Publié: (2026)
par: Bao, Qiming, et autres
Publié: (2026)
Context-Robust Knowledge Editing for Language Models
par: Park, Haewon, et autres
Publié: (2025)
par: Park, Haewon, et autres
Publié: (2025)
Fine Tuning Large Language Models for Medicine: The Role and Importance of Direct Preference Optimization
par: Savage, Thomas, et autres
Publié: (2024)
par: Savage, Thomas, et autres
Publié: (2024)
KnowPO: Knowledge-aware Preference Optimization for Controllable Knowledge Selection in Retrieval-Augmented Language Models
par: Zhang, Ruizhe, et autres
Publié: (2024)
par: Zhang, Ruizhe, et autres
Publié: (2024)
From Segments to Concepts: Interpretable Image Classification via Concept-Guided Segmentation
par: Eisenberg, Ran, et autres
Publié: (2025)
par: Eisenberg, Ran, et autres
Publié: (2025)
Backward Lens: Projecting Language Model Gradients into the Vocabulary Space
par: Katz, Shahar, et autres
Publié: (2024)
par: Katz, Shahar, et autres
Publié: (2024)
Token-level Direct Preference Optimization
par: Zeng, Yongcheng, et autres
Publié: (2024)
par: Zeng, Yongcheng, et autres
Publié: (2024)
Identifying Knowledge Editing Types in Large Language Models
par: Li, Xiaopeng, et autres
Publié: (2024)
par: Li, Xiaopeng, et autres
Publié: (2024)
Cross-Lingual Knowledge Editing in Large Language Models
par: Wang, Jiaan, et autres
Publié: (2023)
par: Wang, Jiaan, et autres
Publié: (2023)
Knowledge Editing for Large Language Models: A Survey
par: Wang, Song, et autres
Publié: (2023)
par: Wang, Song, et autres
Publié: (2023)
Preference Packing: Efficient Preference Optimization for Large Language Models
par: Cho, Jaekyung
Publié: (2026)
par: Cho, Jaekyung
Publié: (2026)
Decrypting Cryptic Crosswords: Semantically Complex Wordplay Puzzles as a Target for NLP
par: Rozner, Josh, et autres
Publié: (2021)
par: Rozner, Josh, et autres
Publié: (2021)
Perturbation: A simple and efficient adversarial tracer for representation learning in language models
par: Rozner, Joshua, et autres
Publié: (2026)
par: Rozner, Joshua, et autres
Publié: (2026)
Adapting Multilingual LLMs to Low-Resource Languages with Knowledge Graphs via Adapters
par: Gurgurov, Daniil, et autres
Publié: (2024)
par: Gurgurov, Daniil, et autres
Publié: (2024)
Direct Preference Optimization: Your Language Model is Secretly a Reward Model
par: Rafailov, Rafael, et autres
Publié: (2023)
par: Rafailov, Rafael, et autres
Publié: (2023)
Precision Knowledge Editing: Enhancing Safety in Large Language Models
par: Li, Xuying, et autres
Publié: (2024)
par: Li, Xuying, et autres
Publié: (2024)
Direct Nash Optimization: Teaching Language Models to Self-Improve with General Preferences
par: Rosset, Corby, et autres
Publié: (2024)
par: Rosset, Corby, et autres
Publié: (2024)
Towards Robust Alignment of Language Models: Distributionally Robustifying Direct Preference Optimization
par: Wu, Junkang, et autres
Publié: (2024)
par: Wu, Junkang, et autres
Publié: (2024)
Large Language Model Bias Mitigation from the Perspective of Knowledge Editing
par: Chen, Ruizhe, et autres
Publié: (2024)
par: Chen, Ruizhe, et autres
Publié: (2024)
Has this Fact been Edited? Detecting Knowledge Edits in Language Models
par: Youssef, Paul, et autres
Publié: (2024)
par: Youssef, Paul, et autres
Publié: (2024)
Editing Factual Knowledge and Explanatory Ability of Medical Large Language Models
par: Xu, Derong, et autres
Publié: (2024)
par: Xu, Derong, et autres
Publié: (2024)
AlphaEdit: Null-Space Constrained Knowledge Editing for Language Models
par: Fang, Junfeng, et autres
Publié: (2024)
par: Fang, Junfeng, et autres
Publié: (2024)
$μ$KE: Matryoshka Unstructured Knowledge Editing of Large Language Models
par: Su, Zian, et autres
Publié: (2025)
par: Su, Zian, et autres
Publié: (2025)
Towards Localized and Disentangled Knowledge Editing for Multimodal Large Language Models
par: Gu, Leijiang, et autres
Publié: (2026)
par: Gu, Leijiang, et autres
Publié: (2026)
ICDPO: Effectively Borrowing Alignment Capability of Others via In-context Direct Preference Optimization
par: Song, Feifan, et autres
Publié: (2024)
par: Song, Feifan, et autres
Publié: (2024)
Filtered Direct Preference Optimization
par: Morimura, Tetsuro, et autres
Publié: (2024)
par: Morimura, Tetsuro, et autres
Publié: (2024)
Direct Preference Optimization with an Offset
par: Amini, Afra, et autres
Publié: (2024)
par: Amini, Afra, et autres
Publié: (2024)
Weights-Rotated Preference Optimization for Large Language Models
par: Yang, Chenxu, et autres
Publié: (2025)
par: Yang, Chenxu, et autres
Publié: (2025)
Self-supervised Preference Optimization: Enhance Your Language Model with Preference Degree Awareness
par: Li, Jian, et autres
Publié: (2024)
par: Li, Jian, et autres
Publié: (2024)
Mitigating Hallucination in Multimodal Large Language Model via Hallucination-targeted Direct Preference Optimization
par: Fu, Yuhan, et autres
Publié: (2024)
par: Fu, Yuhan, et autres
Publié: (2024)
Documents similaires
-
Obtaining Favorable Layouts for Multiple Object Generation
par: Battash, Barak, et autres
Publié: (2024) -
Anomaly Detection with Variance Stabilized Density Estimation
par: Rozner, Amit, et autres
Publié: (2023) -
Efficient Verification-Based Face Identification
par: Rozner, Amit, et autres
Publié: (2023) -
Domain-Generalizable Multiple-Domain Clustering
par: Rozner, Amit, et autres
Publié: (2023) -
TransformLLM: Adapting Large Language Models via LLM-Transformed Reading Comprehension Text
par: Arbel, Iftach, et autres
Publié: (2024)