Role-Playing Evaluation for Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Boudouri, Yassine El, Nuninger, Walter, Alvarez, Julian, Peter, Yvan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
EmoNeXt: an Adapted ConvNeXt for Facial Emotion Recognition
di: Boudouri, Yassine El, et al.
Pubblicazione: (2025)
di: Boudouri, Yassine El, et al.
Pubblicazione: (2025)
RPGBENCH: Evaluating Large Language Models as Role-Playing Game Engines
di: Yu, Pengfei, et al.
Pubblicazione: (2025)
di: Yu, Pengfei, et al.
Pubblicazione: (2025)
RoleLLM: Benchmarking, Eliciting, and Enhancing Role-Playing Abilities of Large Language Models
di: Wang, Zekun Moore, et al.
Pubblicazione: (2023)
di: Wang, Zekun Moore, et al.
Pubblicazione: (2023)
On the Decision-Making Abilities in Role-Playing using Large Language Models
di: Shen, Chenglei, et al.
Pubblicazione: (2024)
di: Shen, Chenglei, et al.
Pubblicazione: (2024)
Orca: Enhancing Role-Playing Abilities of Large Language Models by Integrating Personality Traits
di: Huang, Yuxuan
Pubblicazione: (2024)
di: Huang, Yuxuan
Pubblicazione: (2024)
RoleCraft-GLM: Advancing Personalized Role-Playing in Large Language Models
di: Tao, Meiling, et al.
Pubblicazione: (2023)
di: Tao, Meiling, et al.
Pubblicazione: (2023)
Moral Susceptibility and Robustness under Persona Role-Play in Large Language Models
di: Costa, Davi Bastos, et al.
Pubblicazione: (2025)
di: Costa, Davi Bastos, et al.
Pubblicazione: (2025)
Rehearse With User: Personalized Opinion Summarization via Role-Playing based on Large Language Models
di: Zhang, Yanyue, et al.
Pubblicazione: (2025)
di: Zhang, Yanyue, et al.
Pubblicazione: (2025)
LLM Discussion: Enhancing the Creativity of Large Language Models via Discussion Framework and Role-Play
di: Lu, Li-Chun, et al.
Pubblicazione: (2024)
di: Lu, Li-Chun, et al.
Pubblicazione: (2024)
Fine-Grained Behavior Simulation with Role-Playing Large Language Model on Social Media
di: Li, Kun, et al.
Pubblicazione: (2024)
di: Li, Kun, et al.
Pubblicazione: (2024)
Show, Don't Tell: Evaluating Large Language Models Beyond Textual Understanding with ChildPlay
di: de Carvalho, Gonçalo Hora, et al.
Pubblicazione: (2024)
di: de Carvalho, Gonçalo Hora, et al.
Pubblicazione: (2024)
The Oscars of AI Theater: A Survey on Role-Playing with Language Models
di: Chen, Nuo, et al.
Pubblicazione: (2024)
di: Chen, Nuo, et al.
Pubblicazione: (2024)
Evaluating the Role of Large Language Models in Legal Practice in India
di: Hemrajani, Rahul
Pubblicazione: (2025)
di: Hemrajani, Rahul
Pubblicazione: (2025)
Quantifying Risk Propensities of Large Language Models: Ethical Focus and Bias Detection through Role-Play
di: Zeng, Yifan, et al.
Pubblicazione: (2024)
di: Zeng, Yifan, et al.
Pubblicazione: (2024)
VITA-QinYu: Expressive Spoken Language Model for Role-Playing and Singing
di: Xu, Jiacheng, et al.
Pubblicazione: (2026)
di: Xu, Jiacheng, et al.
Pubblicazione: (2026)
Evaluating Contrast Localizer for Identifying Causal Units in Social & Mathematical Tasks in Language Models
di: Jamaa, Yassine, et al.
Pubblicazione: (2025)
di: Jamaa, Yassine, et al.
Pubblicazione: (2025)
Role-Playing Agents Driven by Large Language Models: Current Status, Challenges, and Future Trends
di: Wang, Ye, et al.
Pubblicazione: (2026)
di: Wang, Ye, et al.
Pubblicazione: (2026)
Role-Play Zero-Shot Prompting with Large Language Models for Open-Domain Human-Machine Conversation
di: Njifenjou, Ahmed, et al.
Pubblicazione: (2024)
di: Njifenjou, Ahmed, et al.
Pubblicazione: (2024)
Credence Calibration Game? Calibrating Large Language Models through Structured Play
di: Fang, Ke, et al.
Pubblicazione: (2025)
di: Fang, Ke, et al.
Pubblicazione: (2025)
Large Language Models as Pokémon Battle Agents: Strategic Play and Content Generation
di: Jain, Daksh, et al.
Pubblicazione: (2025)
di: Jain, Daksh, et al.
Pubblicazione: (2025)
Memory Decoder: A Pretrained, Plug-and-Play Memory for Large Language Models
di: Cao, Jiaqi, et al.
Pubblicazione: (2025)
di: Cao, Jiaqi, et al.
Pubblicazione: (2025)
Plug-and-Play Policy Planner for Large Language Model Powered Dialogue Agents
di: Deng, Yang, et al.
Pubblicazione: (2023)
di: Deng, Yang, et al.
Pubblicazione: (2023)
Too Nice to Tell the Truth: Quantifying Agreeableness-Driven Sycophancy in Role-Playing Language Models
di: Shah, Arya, et al.
Pubblicazione: (2026)
di: Shah, Arya, et al.
Pubblicazione: (2026)
From Persona to Personalization: A Survey on Role-Playing Language Agents
di: Chen, Jiangjie, et al.
Pubblicazione: (2024)
di: Chen, Jiangjie, et al.
Pubblicazione: (2024)
Evaluating LLM-Generated Versus Human-Authored Responses in Role-Play Dialogues
di: Lu, Dongxu, et al.
Pubblicazione: (2025)
di: Lu, Dongxu, et al.
Pubblicazione: (2025)
Memory-Driven Role-Playing: Evaluation and Enhancement of Persona Knowledge Utilization in LLMs
di: Wang, Kai, et al.
Pubblicazione: (2026)
di: Wang, Kai, et al.
Pubblicazione: (2026)
SeRL: Self-Play Reinforcement Learning for Large Language Models with Limited Data
di: Fang, Wenkai, et al.
Pubblicazione: (2025)
di: Fang, Wenkai, et al.
Pubblicazione: (2025)
VoxRole: A Comprehensive Benchmark for Evaluating Speech-Based Role-Playing Agents
di: Wu, Weihao, et al.
Pubblicazione: (2025)
di: Wu, Weihao, et al.
Pubblicazione: (2025)
The Roles of English in Evaluating Multilingual Language Models
di: Poelman, Wessel, et al.
Pubblicazione: (2024)
di: Poelman, Wessel, et al.
Pubblicazione: (2024)
CharacterBox: Evaluating the Role-Playing Capabilities of LLMs in Text-Based Virtual Worlds
di: Wang, Lei, et al.
Pubblicazione: (2024)
di: Wang, Lei, et al.
Pubblicazione: (2024)
DynSess: Dynamic Session-Level Evaluation and Optimization Framework for Role-Playing Agents
di: Zhang, Rongsheng, et al.
Pubblicazione: (2026)
di: Zhang, Rongsheng, et al.
Pubblicazione: (2026)
Rethinking Role-Playing Evaluation: Anonymous Benchmarking and a Systematic Study of Personality Effects
di: Peng, Ji-Lun, et al.
Pubblicazione: (2026)
di: Peng, Ji-Lun, et al.
Pubblicazione: (2026)
Voila: Voice-Language Foundation Models for Real-Time Autonomous Interaction and Voice Role-Play
di: Shi, Yemin, et al.
Pubblicazione: (2025)
di: Shi, Yemin, et al.
Pubblicazione: (2025)
GameTraversalBenchmark: Evaluating Planning Abilities Of Large Language Models Through Traversing 2D Game Maps
di: Nasir, Muhammad Umair, et al.
Pubblicazione: (2024)
di: Nasir, Muhammad Umair, et al.
Pubblicazione: (2024)
BaiJia: A Large-Scale Role-Playing Agent Corpus of Chinese Historical Characters
di: Bai, Ting, et al.
Pubblicazione: (2024)
di: Bai, Ting, et al.
Pubblicazione: (2024)
Unplug and Play Language Models: Decomposing Experts in Language Models at Inference Time
di: Yang, Nakyeong, et al.
Pubblicazione: (2024)
di: Yang, Nakyeong, et al.
Pubblicazione: (2024)
Evaluating Quantized Large Language Models
di: Li, Shiyao, et al.
Pubblicazione: (2024)
di: Li, Shiyao, et al.
Pubblicazione: (2024)
Analyzing the Role of Semantic Representations in the Era of Large Language Models
di: Jin, Zhijing, et al.
Pubblicazione: (2024)
di: Jin, Zhijing, et al.
Pubblicazione: (2024)
LLM-KT: Aligning Large Language Models with Knowledge Tracing using a Plug-and-Play Instruction
di: Wang, Ziwei, et al.
Pubblicazione: (2025)
di: Wang, Ziwei, et al.
Pubblicazione: (2025)
SPFT-SQL: Enhancing Large Language Model for Text-to-SQL Parsing by Self-Play Fine-Tuning
di: Zhang, Yuhao, et al.
Pubblicazione: (2025)
di: Zhang, Yuhao, et al.
Pubblicazione: (2025)
Documenti analoghi
-
EmoNeXt: an Adapted ConvNeXt for Facial Emotion Recognition
di: Boudouri, Yassine El, et al.
Pubblicazione: (2025) -
RPGBENCH: Evaluating Large Language Models as Role-Playing Game Engines
di: Yu, Pengfei, et al.
Pubblicazione: (2025) -
RoleLLM: Benchmarking, Eliciting, and Enhancing Role-Playing Abilities of Large Language Models
di: Wang, Zekun Moore, et al.
Pubblicazione: (2023) -
On the Decision-Making Abilities in Role-Playing using Large Language Models
di: Shen, Chenglei, et al.
Pubblicazione: (2024) -
Orca: Enhancing Role-Playing Abilities of Large Language Models by Integrating Personality Traits
di: Huang, Yuxuan
Pubblicazione: (2024)