Memory-Driven Role-Playing: Evaluation and Enhancement of Persona Knowledge Utilization in LLMs
Fuente:
arXiv
Guardado en:
| Autores principales: | Wang, Kai, You, Haoyang, Zhang, Yang, Wang, Zhongjie |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
CoSER: A Comprehensive Literary Dataset and Framework for Training and Evaluating LLM Role-Playing and Persona Simulation
por: Wang, Xintao, et al.
Publicado: (2025)
por: Wang, Xintao, et al.
Publicado: (2025)
From Persona to Personalization: A Survey on Role-Playing Language Agents
por: Chen, Jiangjie, et al.
Publicado: (2024)
por: Chen, Jiangjie, et al.
Publicado: (2024)
PsyMem: Fine-grained psychological alignment and Explicit Memory Control for Advanced Role-Playing LLMs
por: Cheng, Xilong, et al.
Publicado: (2025)
por: Cheng, Xilong, et al.
Publicado: (2025)
CharacterGPT: A Persona Reconstruction Framework for Role-Playing Agents
por: Park, Jeiyoon, et al.
Publicado: (2024)
por: Park, Jeiyoon, et al.
Publicado: (2024)
CharacterBox: Evaluating the Role-Playing Capabilities of LLMs in Text-Based Virtual Worlds
por: Wang, Lei, et al.
Publicado: (2024)
por: Wang, Lei, et al.
Publicado: (2024)
Too Good to be Bad: On the Failure of LLMs to Role-Play Villains
por: Yi, Zihao, et al.
Publicado: (2025)
por: Yi, Zihao, et al.
Publicado: (2025)
Enhancing Persona Following at Decoding Time via Dynamic Importance Estimation for Role-Playing Agents
por: Liu, Yuxin, et al.
Publicado: (2026)
por: Liu, Yuxin, et al.
Publicado: (2026)
PersonaGym: Evaluating Persona Agents and LLMs
por: Samuel, Vinay, et al.
Publicado: (2024)
por: Samuel, Vinay, et al.
Publicado: (2024)
Memory Decoder: A Pretrained, Plug-and-Play Memory for Large Language Models
por: Cao, Jiaqi, et al.
Publicado: (2025)
por: Cao, Jiaqi, et al.
Publicado: (2025)
Moral Susceptibility and Robustness under Persona Role-Play in Large Language Models
por: Costa, Davi Bastos, et al.
Publicado: (2025)
por: Costa, Davi Bastos, et al.
Publicado: (2025)
DPRF: A Generalizable Dynamic Persona Refinement Framework for Optimizing Behavior Alignment Between Personalized LLM Role-Playing Agents and Humans
por: Yao, Bingsheng, et al.
Publicado: (2025)
por: Yao, Bingsheng, et al.
Publicado: (2025)
RealMem: Benchmarking LLMs in Real-World Memory-Driven Interaction
por: Bian, Haonan, et al.
Publicado: (2026)
por: Bian, Haonan, et al.
Publicado: (2026)
Role-Playing Evaluation for Large Language Models
por: Boudouri, Yassine El, et al.
Publicado: (2025)
por: Boudouri, Yassine El, et al.
Publicado: (2025)
Playing Language Game with LLMs Leads to Jailbreaking
por: Peng, Yu, et al.
Publicado: (2024)
por: Peng, Yu, et al.
Publicado: (2024)
Persona-Augmented Benchmarking: Evaluating LLMs Across Diverse Writing Styles
por: Truong, Kimberly Le, et al.
Publicado: (2025)
por: Truong, Kimberly Le, et al.
Publicado: (2025)
Localizing Persona Representations in LLMs
por: Cintas, Celia, et al.
Publicado: (2025)
por: Cintas, Celia, et al.
Publicado: (2025)
The Oscars of AI Theater: A Survey on Role-Playing with Language Models
por: Chen, Nuo, et al.
Publicado: (2024)
por: Chen, Nuo, et al.
Publicado: (2024)
Improving LLM Reasoning through Interpretable Role-Playing Steering
por: Wang, Anyi, et al.
Publicado: (2025)
por: Wang, Anyi, et al.
Publicado: (2025)
Knowledge Capsules: Structured Nonparametric Memory Units for LLMs
por: Ju, Bin, et al.
Publicado: (2026)
por: Ju, Bin, et al.
Publicado: (2026)
DynSess: Dynamic Session-Level Evaluation and Optimization Framework for Role-Playing Agents
por: Zhang, Rongsheng, et al.
Publicado: (2026)
por: Zhang, Rongsheng, et al.
Publicado: (2026)
Role-Playing Agents Driven by Large Language Models: Current Status, Challenges, and Future Trends
por: Wang, Ye, et al.
Publicado: (2026)
por: Wang, Ye, et al.
Publicado: (2026)
ToMATO: Verbalizing the Mental States of Role-Playing LLMs for Benchmarking Theory of Mind
por: Shinoda, Kazutoshi, et al.
Publicado: (2025)
por: Shinoda, Kazutoshi, et al.
Publicado: (2025)
Evaluating LLMs' Divergent Thinking Capabilities for Scientific Idea Generation with Minimal Context
por: Ruan, Kai, et al.
Publicado: (2024)
por: Ruan, Kai, et al.
Publicado: (2024)
A Text-to-Game Engine for UGC-Based Role-Playing Games
por: Zhang, Lei, et al.
Publicado: (2024)
por: Zhang, Lei, et al.
Publicado: (2024)
RoleLLM: Benchmarking, Eliciting, and Enhancing Role-Playing Abilities of Large Language Models
por: Wang, Zekun Moore, et al.
Publicado: (2023)
por: Wang, Zekun Moore, et al.
Publicado: (2023)
RPGBENCH: Evaluating Large Language Models as Role-Playing Game Engines
por: Yu, Pengfei, et al.
Publicado: (2025)
por: Yu, Pengfei, et al.
Publicado: (2025)
Team-Based Self-Play With Dual Adaptive Weighting for Fine-Tuning LLMs
por: Li, Wu, et al.
Publicado: (2026)
por: Li, Wu, et al.
Publicado: (2026)
PersonaKit (PK): A Plug-and-Play Platform for User Testing Diverse Roles in Full-Duplex Dialogue
por: Jeon, Hyunbae, et al.
Publicado: (2026)
por: Jeon, Hyunbae, et al.
Publicado: (2026)
Ada-LEval: Evaluating long-context LLMs with length-adaptable benchmarks
por: Wang, Chonghua, et al.
Publicado: (2024)
por: Wang, Chonghua, et al.
Publicado: (2024)
Commonsense-augmented Memory Construction and Management in Long-term Conversations via Context-aware Persona Refinement
por: Kim, Hana, et al.
Publicado: (2024)
por: Kim, Hana, et al.
Publicado: (2024)
PersonaMatrix: A Recipe for Persona-Aware Evaluation of Legal Summarization
por: Pang, Tsz Fung, et al.
Publicado: (2025)
por: Pang, Tsz Fung, et al.
Publicado: (2025)
LiveCLKTBench: Towards Reliable Evaluation of Cross-Lingual Knowledge Transfer in Multilingual LLMs
por: Guo, Pei-Fu, et al.
Publicado: (2025)
por: Guo, Pei-Fu, et al.
Publicado: (2025)
Evaluating LLM-Generated Versus Human-Authored Responses in Role-Play Dialogues
por: Lu, Dongxu, et al.
Publicado: (2025)
por: Lu, Dongxu, et al.
Publicado: (2025)
AdaMARP: An Adaptive Multi-Agent Interaction Framework for General Immersive Role-Playing
por: Xu, Zhenhua, et al.
Publicado: (2026)
por: Xu, Zhenhua, et al.
Publicado: (2026)
Too Nice to Tell the Truth: Quantifying Agreeableness-Driven Sycophancy in Role-Playing Language Models
por: Shah, Arya, et al.
Publicado: (2026)
por: Shah, Arya, et al.
Publicado: (2026)
A Multi-Task Role-Playing Agent Capable of Imitating Character Linguistic Styles
por: Chen, Siyuan, et al.
Publicado: (2024)
por: Chen, Siyuan, et al.
Publicado: (2024)
VoxRole: A Comprehensive Benchmark for Evaluating Speech-Based Role-Playing Agents
por: Wu, Weihao, et al.
Publicado: (2025)
por: Wu, Weihao, et al.
Publicado: (2025)
Safety Evaluation and Enhancement of DeepSeek Models in Chinese Contexts
por: Zhang, Wenjing, et al.
Publicado: (2025)
por: Zhang, Wenjing, et al.
Publicado: (2025)
Teaching According to Students' Aptitude: Personalized Mathematics Tutoring via Persona-, Memory-, and Forgetting-Aware LLMs
por: Wu, Yang, et al.
Publicado: (2025)
por: Wu, Yang, et al.
Publicado: (2025)
Encyclo-K: Evaluating LLMs with Dynamically Composed Knowledge Statements
por: Liang, Yiming, et al.
Publicado: (2025)
por: Liang, Yiming, et al.
Publicado: (2025)
Ejemplares similares
-
CoSER: A Comprehensive Literary Dataset and Framework for Training and Evaluating LLM Role-Playing and Persona Simulation
por: Wang, Xintao, et al.
Publicado: (2025) -
From Persona to Personalization: A Survey on Role-Playing Language Agents
por: Chen, Jiangjie, et al.
Publicado: (2024) -
PsyMem: Fine-grained psychological alignment and Explicit Memory Control for Advanced Role-Playing LLMs
por: Cheng, Xilong, et al.
Publicado: (2025) -
CharacterGPT: A Persona Reconstruction Framework for Role-Playing Agents
por: Park, Jeiyoon, et al.
Publicado: (2024) -
CharacterBox: Evaluating the Role-Playing Capabilities of LLMs in Text-Based Virtual Worlds
por: Wang, Lei, et al.
Publicado: (2024)