CRPO: Character-centric Group Relative Policy Optimization for Role-aware Reasoning in Role-playing Agents
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Tang, Yihong, Chen, Kehai, Yue, Liang, Wang, Benyou, Zhang, Min |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Character-R1: Enhancing Role-Aware Reasoning in Role-Playing Agents via RLVR
par: Tang, Yihong, et autres
Publié: (2026)
par: Tang, Yihong, et autres
Publié: (2026)
Through the Lens of Character: Resolving Modality-Role Interference in Multimodal Role-Playing Agent
par: Tang, Yihong, et autres
Publié: (2026)
par: Tang, Yihong, et autres
Publié: (2026)
Thinking in Character: Advancing Role-Playing Agents with Role-Aware Reasoning
par: Tang, Yihong, et autres
Publié: (2025)
par: Tang, Yihong, et autres
Publié: (2025)
ORPP: Self-Optimizing Role-playing Prompts to Enhance Language Model Capabilities
par: Duan, Yifan, et autres
Publié: (2025)
par: Duan, Yifan, et autres
Publié: (2025)
MASTER: Enhancing Large Language Model via Multi-Agent Simulated Teaching
par: Yue, Liang, et autres
Publié: (2025)
par: Yue, Liang, et autres
Publié: (2025)
The Rise of Darkness: Safety-Utility Trade-Offs in Role-Playing Dialogue Agents
par: Tang, Yihong, et autres
Publié: (2025)
par: Tang, Yihong, et autres
Publié: (2025)
RoleBreak: Character Hallucination as a Jailbreak Attack in Role-Playing Systems
par: Tang, Yihong, et autres
Publié: (2024)
par: Tang, Yihong, et autres
Publié: (2024)
Enhancing Role-playing Systems through Aggressive Queries: Evaluation and Improvement
par: Tang, Yihong, et autres
Publié: (2024)
par: Tang, Yihong, et autres
Publié: (2024)
The Power of Personality: A Human Simulation Perspective to Investigate Large Language Model Agents
par: Duan, Yifan, et autres
Publié: (2025)
par: Duan, Yifan, et autres
Publié: (2025)
CRPO: Confidence-Reward Driven Preference Optimization for Machine Translation
par: Cui, Guofeng, et autres
Publié: (2025)
par: Cui, Guofeng, et autres
Publié: (2025)
CPO: Addressing Reward Ambiguity in Role-playing Dialogue via Comparative Policy Optimization
par: Ye, Xinge, et autres
Publié: (2025)
par: Ye, Xinge, et autres
Publié: (2025)
LLM with Relation Classifier for Document-Level Relation Extraction
par: Li, Xingzuo, et autres
Publié: (2024)
par: Li, Xingzuo, et autres
Publié: (2024)
Latent-GRPO: Group Relative Policy Optimization for Latent Reasoning
par: Deng, Jingcheng, et autres
Publié: (2026)
par: Deng, Jingcheng, et autres
Publié: (2026)
Roles with Rails: Contract-Preserving Role Evolution in Multi-Agent Structured Reasoning
par: Ge, Ling-Yue, et autres
Publié: (2026)
par: Ge, Ling-Yue, et autres
Publié: (2026)
Smurfs: Multi-Agent System using Context-Efficient DFSDT for Tool Planning
par: Chen, Junzhi, et autres
Publié: (2024)
par: Chen, Junzhi, et autres
Publié: (2024)
Beyond Token-Level Policy Gradients for Complex Reasoning with Large Language Models
par: Xu, Mufan, et autres
Publié: (2026)
par: Xu, Mufan, et autres
Publié: (2026)
Crafting Customisable Characters with LLMs: A Persona-Driven Role-Playing Agent Framework
par: Yang, Bohao, et autres
Publié: (2024)
par: Yang, Bohao, et autres
Publié: (2024)
A Multi-Task Role-Playing Agent Capable of Imitating Character Linguistic Styles
par: Chen, Siyuan, et autres
Publié: (2024)
par: Chen, Siyuan, et autres
Publié: (2024)
Quantifying and Optimizing Global Faithfulness in Persona-driven Role-playing
par: Peng, Letian, et autres
Publié: (2024)
par: Peng, Letian, et autres
Publié: (2024)
ERABAL: Enhancing Role-Playing Agents through Boundary-Aware Learning
par: Tang, Yihong, et autres
Publié: (2024)
par: Tang, Yihong, et autres
Publié: (2024)
Large Language Models are Superpositions of All Characters: Attaining Arbitrary Role-play via Self-Alignment
par: Lu, Keming, et autres
Publié: (2024)
par: Lu, Keming, et autres
Publié: (2024)
Empowering Real-World: A Survey on the Technology, Practice, and Evaluation of LLM-driven Industry Agents
par: Tang, Yihong, et autres
Publié: (2025)
par: Tang, Yihong, et autres
Publié: (2025)
InCharacter: Evaluating Personality Fidelity in Role-Playing Agents through Psychological Interviews
par: Wang, Xintao, et autres
Publié: (2023)
par: Wang, Xintao, et autres
Publié: (2023)
Graph-GRPO: Stabilizing Multi-Agent Topology Learning via Group Relative Policy Optimization
par: Cang, Yueyang, et autres
Publié: (2026)
par: Cang, Yueyang, et autres
Publié: (2026)
Training-Free Group Relative Policy Optimization
par: Cai, Yuzheng, et autres
Publié: (2025)
par: Cai, Yuzheng, et autres
Publié: (2025)
On Group Relative Policy Optimization Collapse in Agent Search: The Lazy Likelihood-Displacement
par: Deng, Wenlong, et autres
Publié: (2025)
par: Deng, Wenlong, et autres
Publié: (2025)
Codified Finite-state Machines for Role-playing
par: Peng, Letian, et autres
Publié: (2026)
par: Peng, Letian, et autres
Publié: (2026)
Role-playing Prompt Framework: Generation and Evaluation
par: Liu, Xun, et autres
Publié: (2024)
par: Liu, Xun, et autres
Publié: (2024)
Codifying Character Logic in Role-Playing
par: Peng, Letian, et autres
Publié: (2025)
par: Peng, Letian, et autres
Publié: (2025)
Debating the Unspoken: Role-Anchored Multi-Agent Reasoning for Half-Truth Detection
par: Tang, Yixuan, et autres
Publié: (2026)
par: Tang, Yixuan, et autres
Publié: (2026)
CharacterEval: A Chinese Benchmark for Role-Playing Conversational Agent Evaluation
par: Tu, Quan, et autres
Publié: (2024)
par: Tu, Quan, et autres
Publié: (2024)
Memory-augmented Query Reconstruction for LLM-based Knowledge Graph Reasoning
par: Xu, Mufan, et autres
Publié: (2025)
par: Xu, Mufan, et autres
Publié: (2025)
Can Group Relative Policy Optimization Improve Thai Legal Reasoning and Question Answering?
par: Akarajaradwong, Pawitsapak, et autres
Publié: (2025)
par: Akarajaradwong, Pawitsapak, et autres
Publié: (2025)
OmniCharacter: Towards Immersive Role-Playing Agents with Seamless Speech-Language Personality Interaction
par: Zhang, Haonan, et autres
Publié: (2025)
par: Zhang, Haonan, et autres
Publié: (2025)
LinguaLIFT: An Effective Two-stage Instruction Tuning Framework for Low-Resource Language Reasoning
par: Zhang, Hongbin, et autres
Publié: (2024)
par: Zhang, Hongbin, et autres
Publié: (2024)
SweetieChat: A Strategy-Enhanced Role-playing Framework for Diverse Scenarios Handling Emotional Support Agent
par: Ye, Jing, et autres
Publié: (2024)
par: Ye, Jing, et autres
Publié: (2024)
LLM-based Discriminative Reasoning for Knowledge Graph Question Answering
par: Xu, Mufan, et autres
Publié: (2024)
par: Xu, Mufan, et autres
Publié: (2024)
CharacterGPT: A Persona Reconstruction Framework for Role-Playing Agents
par: Park, Jeiyoon, et autres
Publié: (2024)
par: Park, Jeiyoon, et autres
Publié: (2024)
Beyond Demographics: Aligning Role-playing LLM-based Agents Using Human Belief Networks
par: Chuang, Yun-Shiuan, et autres
Publié: (2024)
par: Chuang, Yun-Shiuan, et autres
Publié: (2024)
BOOKMARKS: Efficient Active Storyline Memory for Role-playing
par: Peng, Letian, et autres
Publié: (2026)
par: Peng, Letian, et autres
Publié: (2026)
Documents similaires
-
Character-R1: Enhancing Role-Aware Reasoning in Role-Playing Agents via RLVR
par: Tang, Yihong, et autres
Publié: (2026) -
Through the Lens of Character: Resolving Modality-Role Interference in Multimodal Role-Playing Agent
par: Tang, Yihong, et autres
Publié: (2026) -
Thinking in Character: Advancing Role-Playing Agents with Role-Aware Reasoning
par: Tang, Yihong, et autres
Publié: (2025) -
ORPP: Self-Optimizing Role-playing Prompts to Enhance Language Model Capabilities
par: Duan, Yifan, et autres
Publié: (2025) -
MASTER: Enhancing Large Language Model via Multi-Agent Simulated Teaching
par: Yue, Liang, et autres
Publié: (2025)