TAXI: Evaluating Categorical Knowledge Editing for Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Powell, Derek, Gerych, Walter, Hartvigsen, Thomas |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Identifying Implicit Social Biases in Vision-Language Models
di: Hamidieh, Kimia, et al.
Pubblicazione: (2024)
di: Hamidieh, Kimia, et al.
Pubblicazione: (2024)
Efficient Knowledge Editing via Minimal Precomputation
di: Gupta, Akshat, et al.
Pubblicazione: (2025)
di: Gupta, Akshat, et al.
Pubblicazione: (2025)
Model Editing with Graph-Based External Memory
di: Atri, Yash Kumar, et al.
Pubblicazione: (2025)
di: Atri, Yash Kumar, et al.
Pubblicazione: (2025)
Lifelong Knowledge Editing requires Better Regularization
di: Gupta, Akshat, et al.
Pubblicazione: (2025)
di: Gupta, Akshat, et al.
Pubblicazione: (2025)
Norm Growth and Stability Challenges in Localized Sequential Knowledge Editing
di: Gupta, Akshat, et al.
Pubblicazione: (2025)
di: Gupta, Akshat, et al.
Pubblicazione: (2025)
Evaluating Temporal Consistency in Multi-Turn Language Models
di: Atri, Yash Kumar, et al.
Pubblicazione: (2026)
di: Atri, Yash Kumar, et al.
Pubblicazione: (2026)
WikiBigEdit: Understanding the Limits of Lifelong Knowledge Editing in LLMs
di: Thede, Lukas, et al.
Pubblicazione: (2025)
di: Thede, Lukas, et al.
Pubblicazione: (2025)
Continually Self-Improving Language Models for Bariatric Surgery Question--Answering
di: Atri, Yash Kumar, et al.
Pubblicazione: (2025)
di: Atri, Yash Kumar, et al.
Pubblicazione: (2025)
Can Large Language Models Predict Associations Among Human Attitudes?
di: Ma, Ana, et al.
Pubblicazione: (2025)
di: Ma, Ana, et al.
Pubblicazione: (2025)
PolygloToxicityPrompts: Multilingual Evaluation of Neural Toxic Degeneration in Large Language Models
di: Jain, Devansh, et al.
Pubblicazione: (2024)
di: Jain, Devansh, et al.
Pubblicazione: (2024)
Can Language Models Identify Side Effects of Breast Cancer Radiation Treatments?
di: Seah, Natalie, et al.
Pubblicazione: (2026)
di: Seah, Natalie, et al.
Pubblicazione: (2026)
KScope: A Framework for Characterizing the Knowledge Status of Language Models
di: Xiao, Yuxin, et al.
Pubblicazione: (2025)
di: Xiao, Yuxin, et al.
Pubblicazione: (2025)
Decoding Knowledge in Large Language Models: A Framework for Categorization and Comprehension
di: Fang, Yanbo, et al.
Pubblicazione: (2025)
di: Fang, Yanbo, et al.
Pubblicazione: (2025)
Stable Knowledge Editing in Large Language Models
di: Wei, Zihao, et al.
Pubblicazione: (2024)
di: Wei, Zihao, et al.
Pubblicazione: (2024)
Inspecting and Editing Knowledge Representations in Language Models
di: Hernandez, Evan, et al.
Pubblicazione: (2023)
di: Hernandez, Evan, et al.
Pubblicazione: (2023)
BendVLM: Test-Time Debiasing of Vision-Language Embeddings
di: Gerych, Walter, et al.
Pubblicazione: (2024)
di: Gerych, Walter, et al.
Pubblicazione: (2024)
Math Neurosurgery: Isolating Language Models' Math Reasoning Abilities Using Only Forward Passes
di: Christ, Bryan R., et al.
Pubblicazione: (2024)
di: Christ, Bryan R., et al.
Pubblicazione: (2024)
Knowledge Graph Enhanced Large Language Model Editing
di: Zhang, Mengqi, et al.
Pubblicazione: (2024)
di: Zhang, Mengqi, et al.
Pubblicazione: (2024)
Understanding Language Model Circuits through Knowledge Editing
di: Ge, Huaizhi, et al.
Pubblicazione: (2024)
di: Ge, Huaizhi, et al.
Pubblicazione: (2024)
Neighboring Perturbations of Knowledge Editing on Large Language Models
di: Ma, Jun-Yu, et al.
Pubblicazione: (2024)
di: Ma, Jun-Yu, et al.
Pubblicazione: (2024)
Benchmarking and Rethinking Knowledge Editing for Large Language Models
di: He, Guoxiu, et al.
Pubblicazione: (2025)
di: He, Guoxiu, et al.
Pubblicazione: (2025)
Disentangling Knowledge Representations for Large Language Model Editing
di: Zhang, Mengqi, et al.
Pubblicazione: (2025)
di: Zhang, Mengqi, et al.
Pubblicazione: (2025)
When Style Breaks Safety: Defending LLMs Against Superficial Style Alignment
di: Xiao, Yuxin, et al.
Pubblicazione: (2025)
di: Xiao, Yuxin, et al.
Pubblicazione: (2025)
Editing the Mind of Giants: An In-Depth Exploration of Pitfalls of Knowledge Editing in Large Language Models
di: Hsueh, Cheng-Hsun, et al.
Pubblicazione: (2024)
di: Hsueh, Cheng-Hsun, et al.
Pubblicazione: (2024)
Mapping from Meaning: Addressing the Miscalibration of Prompt-Sensitive Language Models
di: Cox, Kyle, et al.
Pubblicazione: (2025)
di: Cox, Kyle, et al.
Pubblicazione: (2025)
Knowledge in Superposition: Unveiling the Failures of Lifelong Knowledge Editing for Large Language Models
di: Hu, Chenhui, et al.
Pubblicazione: (2024)
di: Hu, Chenhui, et al.
Pubblicazione: (2024)
Editing Across Languages: A Survey of Multilingual Knowledge Editing
di: Durrani, Nadir, et al.
Pubblicazione: (2025)
di: Durrani, Nadir, et al.
Pubblicazione: (2025)
Knowledge Editing for Large Language Model with Knowledge Neuronal Ensemble
di: Li, Yongchang, et al.
Pubblicazione: (2024)
di: Li, Yongchang, et al.
Pubblicazione: (2024)
Context-Robust Knowledge Editing for Language Models
di: Park, Haewon, et al.
Pubblicazione: (2025)
di: Park, Haewon, et al.
Pubblicazione: (2025)
GeoEdit: Geometric Knowledge Editing for Large Language Models
di: Feng, Yujie, et al.
Pubblicazione: (2025)
di: Feng, Yujie, et al.
Pubblicazione: (2025)
Mechanistic Circuit-Based Knowledge Editing in Large Language Models
di: Zhao, Tianyi, et al.
Pubblicazione: (2026)
di: Zhao, Tianyi, et al.
Pubblicazione: (2026)
MATHWELL: Generating Educational Math Word Problems Using Teacher Annotations
di: Christ, Bryan R, et al.
Pubblicazione: (2024)
di: Christ, Bryan R, et al.
Pubblicazione: (2024)
Aligning Language Models with Real-time Knowledge Editing
di: Tang, Chenming, et al.
Pubblicazione: (2025)
di: Tang, Chenming, et al.
Pubblicazione: (2025)
MLaKE: Multilingual Knowledge Editing Benchmark for Large Language Models
di: Wei, Zihao, et al.
Pubblicazione: (2024)
di: Wei, Zihao, et al.
Pubblicazione: (2024)
Identifying Knowledge Editing Types in Large Language Models
di: Li, Xiaopeng, et al.
Pubblicazione: (2024)
di: Li, Xiaopeng, et al.
Pubblicazione: (2024)
Cross-Lingual Knowledge Editing in Large Language Models
di: Wang, Jiaan, et al.
Pubblicazione: (2023)
di: Wang, Jiaan, et al.
Pubblicazione: (2023)
Knowledge Editing for Large Language Models: A Survey
di: Wang, Song, et al.
Pubblicazione: (2023)
di: Wang, Song, et al.
Pubblicazione: (2023)
Medical Large Language Model Benchmarks Should Prioritize Construct Validity
di: Alaa, Ahmed, et al.
Pubblicazione: (2025)
di: Alaa, Ahmed, et al.
Pubblicazione: (2025)
Language Models Still Struggle to Zero-shot Reason about Time Series
di: Merrill, Mike A., et al.
Pubblicazione: (2024)
di: Merrill, Mike A., et al.
Pubblicazione: (2024)
DIEKAE: Difference Injection for Efficient Knowledge Augmentation and Editing of Large Language Models
di: Galatolo, Alessio, et al.
Pubblicazione: (2024)
di: Galatolo, Alessio, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Identifying Implicit Social Biases in Vision-Language Models
di: Hamidieh, Kimia, et al.
Pubblicazione: (2024) -
Efficient Knowledge Editing via Minimal Precomputation
di: Gupta, Akshat, et al.
Pubblicazione: (2025) -
Model Editing with Graph-Based External Memory
di: Atri, Yash Kumar, et al.
Pubblicazione: (2025) -
Lifelong Knowledge Editing requires Better Regularization
di: Gupta, Akshat, et al.
Pubblicazione: (2025) -
Norm Growth and Stability Challenges in Localized Sequential Knowledge Editing
di: Gupta, Akshat, et al.
Pubblicazione: (2025)