Understanding Language Model Circuits through Knowledge Editing
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ge, Huaizhi, Rudzicz, Frank, Zhu, Zining |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
How Well Can Knowledge Edit Methods Edit Perplexing Knowledge?
par: Ge, Huaizhi, et autres
Publié: (2024)
par: Ge, Huaizhi, et autres
Publié: (2024)
Scenarios and Approaches for Situated Natural Language Explanations
par: Qiu, Pengshuo, et autres
Publié: (2024)
par: Qiu, Pengshuo, et autres
Publié: (2024)
Show, Don't Tell: Uncovering Implicit Character Portrayal using LLMs
par: Jaipersaud, Brandon, et autres
Publié: (2024)
par: Jaipersaud, Brandon, et autres
Publié: (2024)
LLM-Generated Black-box Explanations Can Be Adversarially Helpful
par: Ajwani, Rohan, et autres
Publié: (2024)
par: Ajwani, Rohan, et autres
Publié: (2024)
Plug and Play with Prompts: A Prompt Tuning Approach for Controlling Text Generation
par: Ajwani, Rohan Deepak, et autres
Publié: (2024)
par: Ajwani, Rohan Deepak, et autres
Publié: (2024)
ACCORD: Closing the Commonsense Measurability Gap
par: Roewer-Després, François, et autres
Publié: (2024)
par: Roewer-Després, François, et autres
Publié: (2024)
Situated Natural Language Explanations
par: Zhu, Zining, et autres
Publié: (2023)
par: Zhu, Zining, et autres
Publié: (2023)
Distribution Prompting: Understanding the Expressivity of Language Models Through the Next-Token Distributions They Can Produce
par: Wang, Haojin, et autres
Publié: (2025)
par: Wang, Haojin, et autres
Publié: (2025)
Mechanistic Circuit-Based Knowledge Editing in Large Language Models
par: Zhao, Tianyi, et autres
Publié: (2026)
par: Zhao, Tianyi, et autres
Publié: (2026)
Auxiliary Knowledge-Induced Learning for Automatic Multi-Label Medical Document Classification
par: Wang, Xindi, et autres
Publié: (2024)
par: Wang, Xindi, et autres
Publié: (2024)
What does the Knowledge Neuron Thesis Have to do with Knowledge?
par: Niu, Jingcheng, et autres
Publié: (2024)
par: Niu, Jingcheng, et autres
Publié: (2024)
Brainstorming Brings Power to Large Language Models of Knowledge Reasoning
par: Qin, Zining, et autres
Publié: (2024)
par: Qin, Zining, et autres
Publié: (2024)
Multi-stage Retrieve and Re-rank Model for Automatic Medical Coding Recommendation
par: Wang, Xindi, et autres
Publié: (2024)
par: Wang, Xindi, et autres
Publié: (2024)
Knowledge Editing for Large Language Model with Knowledge Neuronal Ensemble
par: Li, Yongchang, et autres
Publié: (2024)
par: Li, Yongchang, et autres
Publié: (2024)
The GPT-WritingPrompts Dataset: A Comparative Analysis of Character Portrayal in Short Stories
par: Huang, Xi Yu, et autres
Publié: (2024)
par: Huang, Xi Yu, et autres
Publié: (2024)
Exploring the features used for summary evaluation by Human and GPT
par: Sadeghi, Zahra, et autres
Publié: (2025)
par: Sadeghi, Zahra, et autres
Publié: (2025)
Enhancing Multi-hop Reasoning through Knowledge Erasure in Large Language Model Editing
par: Zhang, Mengqi, et autres
Publié: (2024)
par: Zhang, Mengqi, et autres
Publié: (2024)
Stable Knowledge Editing in Large Language Models
par: Wei, Zihao, et autres
Publié: (2024)
par: Wei, Zihao, et autres
Publié: (2024)
Inspecting and Editing Knowledge Representations in Language Models
par: Hernandez, Evan, et autres
Publié: (2023)
par: Hernandez, Evan, et autres
Publié: (2023)
Knowledge Editing for Large Language Models: A Survey
par: Wang, Song, et autres
Publié: (2023)
par: Wang, Song, et autres
Publié: (2023)
Graph-tree Fusion Model with Bidirectional Information Propagation for Long Document Classification
par: Roy, Sudipta Singha, et autres
Publié: (2024)
par: Roy, Sudipta Singha, et autres
Publié: (2024)
Library Learning Doesn't: The Curious Case of the Single-Use "Library"
par: Berlot-Attwell, Ian, et autres
Publié: (2024)
par: Berlot-Attwell, Ian, et autres
Publié: (2024)
Knowledge Editing through Chain-of-Thought
par: Wang, Changyue, et autres
Publié: (2024)
par: Wang, Changyue, et autres
Publié: (2024)
LLM Library Learning Fails: A LEGO-Prover Case Study
par: Berlot-Attwell, Ian, et autres
Publié: (2025)
par: Berlot-Attwell, Ian, et autres
Publié: (2025)
Knowledge Graph Enhanced Large Language Model Editing
par: Zhang, Mengqi, et autres
Publié: (2024)
par: Zhang, Mengqi, et autres
Publié: (2024)
Neighboring Perturbations of Knowledge Editing on Large Language Models
par: Ma, Jun-Yu, et autres
Publié: (2024)
par: Ma, Jun-Yu, et autres
Publié: (2024)
TAXI: Evaluating Categorical Knowledge Editing for Language Models
par: Powell, Derek, et autres
Publié: (2024)
par: Powell, Derek, et autres
Publié: (2024)
Benchmarking and Rethinking Knowledge Editing for Large Language Models
par: He, Guoxiu, et autres
Publié: (2025)
par: He, Guoxiu, et autres
Publié: (2025)
Disentangling Knowledge Representations for Large Language Model Editing
par: Zhang, Mengqi, et autres
Publié: (2025)
par: Zhang, Mengqi, et autres
Publié: (2025)
Editing the Mind of Giants: An In-Depth Exploration of Pitfalls of Knowledge Editing in Large Language Models
par: Hsueh, Cheng-Hsun, et autres
Publié: (2024)
par: Hsueh, Cheng-Hsun, et autres
Publié: (2024)
Knowledge in Superposition: Unveiling the Failures of Lifelong Knowledge Editing for Large Language Models
par: Hu, Chenhui, et autres
Publié: (2024)
par: Hu, Chenhui, et autres
Publié: (2024)
Editing Across Languages: A Survey of Multilingual Knowledge Editing
par: Durrani, Nadir, et autres
Publié: (2025)
par: Durrani, Nadir, et autres
Publié: (2025)
Time Sensitive Knowledge Editing through Efficient Finetuning
par: Ge, Xiou, et autres
Publié: (2024)
par: Ge, Xiou, et autres
Publié: (2024)
Context-Robust Knowledge Editing for Language Models
par: Park, Haewon, et autres
Publié: (2025)
par: Park, Haewon, et autres
Publié: (2025)
GeoEdit: Geometric Knowledge Editing for Large Language Models
par: Feng, Yujie, et autres
Publié: (2025)
par: Feng, Yujie, et autres
Publié: (2025)
Aligning Language Models with Real-time Knowledge Editing
par: Tang, Chenming, et autres
Publié: (2025)
par: Tang, Chenming, et autres
Publié: (2025)
Editing Factual Knowledge and Explanatory Ability of Medical Large Language Models
par: Xu, Derong, et autres
Publié: (2024)
par: Xu, Derong, et autres
Publié: (2024)
MLaKE: Multilingual Knowledge Editing Benchmark for Large Language Models
par: Wei, Zihao, et autres
Publié: (2024)
par: Wei, Zihao, et autres
Publié: (2024)
Identifying Knowledge Editing Types in Large Language Models
par: Li, Xiaopeng, et autres
Publié: (2024)
par: Li, Xiaopeng, et autres
Publié: (2024)
Cross-Lingual Knowledge Editing in Large Language Models
par: Wang, Jiaan, et autres
Publié: (2023)
par: Wang, Jiaan, et autres
Publié: (2023)
Documents similaires
-
How Well Can Knowledge Edit Methods Edit Perplexing Knowledge?
par: Ge, Huaizhi, et autres
Publié: (2024) -
Scenarios and Approaches for Situated Natural Language Explanations
par: Qiu, Pengshuo, et autres
Publié: (2024) -
Show, Don't Tell: Uncovering Implicit Character Portrayal using LLMs
par: Jaipersaud, Brandon, et autres
Publié: (2024) -
LLM-Generated Black-box Explanations Can Be Adversarially Helpful
par: Ajwani, Rohan, et autres
Publié: (2024) -
Plug and Play with Prompts: A Prompt Tuning Approach for Controlling Text Generation
par: Ajwani, Rohan Deepak, et autres
Publié: (2024)