DPN-LE: Dual Personality Neuron Localization and Editing for Large Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Zheng, Lifan, Yang, Xue, Chen, Jiawei, Wu, Chenyan, Zhang, Jingyuan, Kong, Fanheng, Zeng, Xinyi, Chen, Xiang, Tian, Yu |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Rethinking the Reliability of Multi-agent System: A Perspective from Byzantine Fault Tolerance
por: Zheng, Lifan, et al.
Publicado: (2025)
por: Zheng, Lifan, et al.
Publicado: (2025)
Accelerating Diffusion LLM Inference via Local Determinism Propagation
por: Kong, Fanheng, et al.
Publicado: (2025)
por: Kong, Fanheng, et al.
Publicado: (2025)
Me-Agent: A Personalized Mobile Agent with Two-Level User Habit Learning for Enhanced Interaction
por: Wang, Shuoxin, et al.
Publicado: (2026)
por: Wang, Shuoxin, et al.
Publicado: (2026)
Root Defence Strategies: Ensuring Safety of LLM at the Decoding Level
por: Zeng, Xinyi, et al.
Publicado: (2024)
por: Zeng, Xinyi, et al.
Publicado: (2024)
Skills-Coach: A Self-Evolving Skill Optimizer via Training-Free GRPO
por: Tian, Yu, et al.
Publicado: (2026)
por: Tian, Yu, et al.
Publicado: (2026)
From Pixels to Tokens: Revisiting Object Hallucinations in Large Vision-Language Models
por: Shang, Yuying, et al.
Publicado: (2024)
por: Shang, Yuying, et al.
Publicado: (2024)
Neuron-Level Sequential Editing for Large Language Models
por: Jiang, Houcheng, et al.
Publicado: (2024)
por: Jiang, Houcheng, et al.
Publicado: (2024)
Multilingual Knowledge Editing with Language-Agnostic Factual Neurons
por: Zhang, Xue, et al.
Publicado: (2024)
por: Zhang, Xue, et al.
Publicado: (2024)
DiffER: Diffusion Entity-Relation Modeling for Reversal Curse in Diffusion Large Language Models
por: He, Shaokai, et al.
Publicado: (2026)
por: He, Shaokai, et al.
Publicado: (2026)
Knowledge Editing for Large Language Model with Knowledge Neuronal Ensemble
por: Li, Yongchang, et al.
Publicado: (2024)
por: Li, Yongchang, et al.
Publicado: (2024)
Evaluating the Generation Capabilities of Large Chinese Language Models
por: Zeng, Hui, et al.
Publicado: (2023)
por: Zeng, Hui, et al.
Publicado: (2023)
Probing then Editing Response Personality of Large Language Models
por: Ju, Tianjie, et al.
Publicado: (2025)
por: Ju, Tianjie, et al.
Publicado: (2025)
RAGViz: Diagnose and Visualize Retrieval-Augmented Generation
por: Wang, Tevin, et al.
Publicado: (2024)
por: Wang, Tevin, et al.
Publicado: (2024)
Enhancing Semantic Consistency of Large Language Models through Model Editing: An Interpretability-Oriented Approach
por: Yang, Jingyuan, et al.
Publicado: (2025)
por: Yang, Jingyuan, et al.
Publicado: (2025)
Mechanistic Circuit-Based Knowledge Editing in Large Language Models
por: Zhao, Tianyi, et al.
Publicado: (2026)
por: Zhao, Tianyi, et al.
Publicado: (2026)
WisdomBot: Tuning Large Language Models with Artificial Intelligence Knowledge
por: Chen, Jingyuan, et al.
Publicado: (2025)
por: Chen, Jingyuan, et al.
Publicado: (2025)
Towards Effective Model Editing for LLM Personalization
por: Huang, Baixiang, et al.
Publicado: (2025)
por: Huang, Baixiang, et al.
Publicado: (2025)
Linguine: A Natural-Language Programming Language with Formal Semantics and a Clean Compiler Pipeline
por: Hu, Lifan
Publicado: (2025)
por: Hu, Lifan
Publicado: (2025)
Neuron-based Personality Trait Induction in Large Language Models
por: Deng, Jia, et al.
Publicado: (2024)
por: Deng, Jia, et al.
Publicado: (2024)
Precise Attribute Intensity Control in Large Language Models via Targeted Representation Editing
por: Zhang, Rongzhi, et al.
Publicado: (2025)
por: Zhang, Rongzhi, et al.
Publicado: (2025)
Towards Localized and Disentangled Knowledge Editing for Multimodal Large Language Models
por: Gu, Leijiang, et al.
Publicado: (2026)
por: Gu, Leijiang, et al.
Publicado: (2026)
Unveiling Factual Recall Behaviors of Large Language Models through Knowledge Neurons
por: Wang, Yifei, et al.
Publicado: (2024)
por: Wang, Yifei, et al.
Publicado: (2024)
MobileRAG: Enhancing Mobile Agent with Retrieval-Augmented Generation
por: Loo, Gowen, et al.
Publicado: (2025)
por: Loo, Gowen, et al.
Publicado: (2025)
Knowledge Editing for Large Language Models: A Survey
por: Wang, Song, et al.
Publicado: (2023)
por: Wang, Song, et al.
Publicado: (2023)
RePro: Training Language Models to Faithfully Recycle the Web for Pretraining
por: Yu, Zichun, et al.
Publicado: (2025)
por: Yu, Zichun, et al.
Publicado: (2025)
Uncovering Overfitting in Large Language Model Editing
por: Zhang, Mengqi, et al.
Publicado: (2024)
por: Zhang, Mengqi, et al.
Publicado: (2024)
Speech Translation Refinement using Large Language Models
por: Dou, Huaixia, et al.
Publicado: (2025)
por: Dou, Huaixia, et al.
Publicado: (2025)
WebTestBench: Evaluating Computer-Use Agents towards End-to-End Automated Web Testing
por: Kong, Fanheng, et al.
Publicado: (2026)
por: Kong, Fanheng, et al.
Publicado: (2026)
Data Metabolism: An Efficient Data Design Schema For Vision Language Model
por: Zhang, Jingyuan, et al.
Publicado: (2025)
por: Zhang, Jingyuan, et al.
Publicado: (2025)
Editing Personality for Large Language Models
por: Mao, Shengyu, et al.
Publicado: (2023)
por: Mao, Shengyu, et al.
Publicado: (2023)
Dynamic Generation of Personalities with Large Language Models
por: Liu, Jianzhi, et al.
Publicado: (2024)
por: Liu, Jianzhi, et al.
Publicado: (2024)
CASTLE: A Comprehensive Benchmark for Evaluating Student-Tailored Personalized Safety in Large Language Models
por: Jia, Rui, et al.
Publicado: (2026)
por: Jia, Rui, et al.
Publicado: (2026)
Neighboring Perturbations of Knowledge Editing on Large Language Models
por: Ma, Jun-Yu, et al.
Publicado: (2024)
por: Ma, Jun-Yu, et al.
Publicado: (2024)
ResearchArena: Benchmarking Large Language Models' Ability to Collect and Organize Information as Research Agents
por: Kang, Hao, et al.
Publicado: (2024)
por: Kang, Hao, et al.
Publicado: (2024)
Knowledge Graph Enhanced Large Language Model Editing
por: Zhang, Mengqi, et al.
Publicado: (2024)
por: Zhang, Mengqi, et al.
Publicado: (2024)
Personalization of Large Language Models: A Survey
por: Zhang, Zhehao, et al.
Publicado: (2024)
por: Zhang, Zhehao, et al.
Publicado: (2024)
Resolving Editing-Unlearning Conflicts: A Knowledge Codebook Framework for Large Language Model Updating
por: Zhang, Binchi, et al.
Publicado: (2025)
por: Zhang, Binchi, et al.
Publicado: (2025)
Neuron-Aware Data Selection In Instruction Tuning For Large Language Models
por: Chen, Xin, et al.
Publicado: (2026)
por: Chen, Xin, et al.
Publicado: (2026)
Model Editing Harms General Abilities of Large Language Models: Regularization to the Rescue
por: Gu, Jia-Chen, et al.
Publicado: (2024)
por: Gu, Jia-Chen, et al.
Publicado: (2024)
MEMLA: Enhancing Multilingual Knowledge Editing with Neuron-Masked Low-Rank Adaptation
por: Xie, Jiakuan, et al.
Publicado: (2024)
por: Xie, Jiakuan, et al.
Publicado: (2024)
Ejemplares similares
-
Rethinking the Reliability of Multi-agent System: A Perspective from Byzantine Fault Tolerance
por: Zheng, Lifan, et al.
Publicado: (2025) -
Accelerating Diffusion LLM Inference via Local Determinism Propagation
por: Kong, Fanheng, et al.
Publicado: (2025) -
Me-Agent: A Personalized Mobile Agent with Two-Level User Habit Learning for Enhanced Interaction
por: Wang, Shuoxin, et al.
Publicado: (2026) -
Root Defence Strategies: Ensuring Safety of LLM at the Decoding Level
por: Zeng, Xinyi, et al.
Publicado: (2024) -
Skills-Coach: A Self-Evolving Skill Optimizer via Training-Free GRPO
por: Tian, Yu, et al.
Publicado: (2026)