Salvato in:
| Autori principali: | Dai, Yanqi, Hu, Huanran, Wang, Lei, Jin, Shengjie, Chen, Xu, Lu, Zhiwu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2408.04203 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
CharacterBox: Evaluating the Role-Playing Capabilities of LLMs in Text-Based Virtual Worlds
di: Wang, Lei, et al.
Pubblicazione: (2024)
di: Wang, Lei, et al.
Pubblicazione: (2024)
Adaptive Task Balancing for Visual Instruction Tuning via Inter-Task Contribution and Intra-Task Difficulty
di: Dai, Yanqi, et al.
Pubblicazione: (2024)
di: Dai, Yanqi, et al.
Pubblicazione: (2024)
Harder Is Better: Boosting Mathematical Reasoning via Difficulty-Aware GRPO and Multi-Aspect Question Reformulation
di: Dai, Yanqi, et al.
Pubblicazione: (2026)
di: Dai, Yanqi, et al.
Pubblicazione: (2026)
VoxRole: A Comprehensive Benchmark for Evaluating Speech-Based Role-Playing Agents
di: Wu, Weihao, et al.
Pubblicazione: (2025)
di: Wu, Weihao, et al.
Pubblicazione: (2025)
MINDECHO: Role-Playing Language Agents for Key Opinion Leaders
di: Xu, Rui, et al.
Pubblicazione: (2024)
di: Xu, Rui, et al.
Pubblicazione: (2024)
CoSER: A Comprehensive Literary Dataset and Framework for Training and Evaluating LLM Role-Playing and Persona Simulation
di: Wang, Xintao, et al.
Pubblicazione: (2025)
di: Wang, Xintao, et al.
Pubblicazione: (2025)
DynSess: Dynamic Session-Level Evaluation and Optimization Framework for Role-Playing Agents
di: Zhang, Rongsheng, et al.
Pubblicazione: (2026)
di: Zhang, Rongsheng, et al.
Pubblicazione: (2026)
TravelEval: A Comprehensive Benchmarking Framework for Evaluating LLM-Powered Travel Planning Agents
di: Chen, Weiyi, et al.
Pubblicazione: (2026)
di: Chen, Weiyi, et al.
Pubblicazione: (2026)
AdaMARP: An Adaptive Multi-Agent Interaction Framework for General Immersive Role-Playing
di: Xu, Zhenhua, et al.
Pubblicazione: (2026)
di: Xu, Zhenhua, et al.
Pubblicazione: (2026)
MultiEditor: Controllable Multimodal Object Editing for Driving Scenarios Using 3D Gaussian Splatting Priors
di: Lu, Shouyi, et al.
Pubblicazione: (2025)
di: Lu, Shouyi, et al.
Pubblicazione: (2025)
From Persona to Personalization: A Survey on Role-Playing Language Agents
di: Chen, Jiangjie, et al.
Pubblicazione: (2024)
di: Chen, Jiangjie, et al.
Pubblicazione: (2024)
Guess What I am Thinking: A Benchmark for Inner Thought Reasoning of Role-Playing Language Agents
di: Xu, Rui, et al.
Pubblicazione: (2025)
di: Xu, Rui, et al.
Pubblicazione: (2025)
Identity-Driven Hierarchical Role-Playing Agents
di: Sun, Libo, et al.
Pubblicazione: (2024)
di: Sun, Libo, et al.
Pubblicazione: (2024)
TCMBench: A Comprehensive Benchmark for Evaluating Large Language Models in Traditional Chinese Medicine
di: Yue, Wenjing, et al.
Pubblicazione: (2024)
di: Yue, Wenjing, et al.
Pubblicazione: (2024)
CharacterGPT: A Persona Reconstruction Framework for Role-Playing Agents
di: Park, Jeiyoon, et al.
Pubblicazione: (2024)
di: Park, Jeiyoon, et al.
Pubblicazione: (2024)
Enhancing Persona Following at Decoding Time via Dynamic Importance Estimation for Role-Playing Agents
di: Liu, Yuxin, et al.
Pubblicazione: (2026)
di: Liu, Yuxin, et al.
Pubblicazione: (2026)
Character is Destiny: Can Role-Playing Language Agents Make Persona-Driven Decisions?
di: Xu, Rui, et al.
Pubblicazione: (2024)
di: Xu, Rui, et al.
Pubblicazione: (2024)
RoleCDE:Benchmarking and Mitigating Role-Alignment Trade-offs in Role-Playing Agents
di: Lai, Huayi, et al.
Pubblicazione: (2026)
di: Lai, Huayi, et al.
Pubblicazione: (2026)
AISafetyLab: A Comprehensive Framework for AI Safety Evaluation and Improvement
di: Zhang, Zhexin, et al.
Pubblicazione: (2025)
di: Zhang, Zhexin, et al.
Pubblicazione: (2025)
MemBench: Towards More Comprehensive Evaluation on the Memory of LLM-based Agents
di: Tan, Haoran, et al.
Pubblicazione: (2025)
di: Tan, Haoran, et al.
Pubblicazione: (2025)
Skill Drift Is Contract Violation: Proactive Maintenance for LLM Agent Skill Libraries
di: Fan, Linfeng, et al.
Pubblicazione: (2026)
di: Fan, Linfeng, et al.
Pubblicazione: (2026)
DPRF: A Generalizable Dynamic Persona Refinement Framework for Optimizing Behavior Alignment Between Personalized LLM Role-Playing Agents and Humans
di: Yao, Bingsheng, et al.
Pubblicazione: (2025)
di: Yao, Bingsheng, et al.
Pubblicazione: (2025)
LARP: Language-Agent Role Play for Open-World Games
di: Yan, Ming, et al.
Pubblicazione: (2023)
di: Yan, Ming, et al.
Pubblicazione: (2023)
RPA-Check: A Multi-Stage Automated Framework for Evaluating Dynamic LLM-based Role-Playing Agents
di: Rosati, Riccardo, et al.
Pubblicazione: (2026)
di: Rosati, Riccardo, et al.
Pubblicazione: (2026)
OpenAgentSafety: A Comprehensive Framework for Evaluating Real-World AI Agent Safety
di: Vijayvargiya, Sanidhya, et al.
Pubblicazione: (2025)
di: Vijayvargiya, Sanidhya, et al.
Pubblicazione: (2025)
DEPO: Dual-Efficiency Preference Optimization for LLM Agents
di: Chen, Sirui, et al.
Pubblicazione: (2025)
di: Chen, Sirui, et al.
Pubblicazione: (2025)
AgentLens: Revealing The Lucky Pass Problem in SWE-Agent Evaluation
di: Sahoo, Priyam, et al.
Pubblicazione: (2026)
di: Sahoo, Priyam, et al.
Pubblicazione: (2026)
VideoRewardBench: Comprehensive Evaluation of Multimodal Reward Models for Video Understanding
di: Zhang, Zhihong, et al.
Pubblicazione: (2025)
di: Zhang, Zhihong, et al.
Pubblicazione: (2025)
Evaluating LLM-Generated Versus Human-Authored Responses in Role-Play Dialogues
di: Lu, Dongxu, et al.
Pubblicazione: (2025)
di: Lu, Dongxu, et al.
Pubblicazione: (2025)
A Multi-Task Role-Playing Agent Capable of Imitating Character Linguistic Styles
di: Chen, Siyuan, et al.
Pubblicazione: (2024)
di: Chen, Siyuan, et al.
Pubblicazione: (2024)
Role-Playing Evaluation for Large Language Models
di: Boudouri, Yassine El, et al.
Pubblicazione: (2025)
di: Boudouri, Yassine El, et al.
Pubblicazione: (2025)
Alignment Dynamics in LLM Fine-Tuning
di: Huang, Yuhan, et al.
Pubblicazione: (2026)
di: Huang, Yuhan, et al.
Pubblicazione: (2026)
Fine-Grained Behavior Simulation with Role-Playing Large Language Model on Social Media
di: Li, Kun, et al.
Pubblicazione: (2024)
di: Li, Kun, et al.
Pubblicazione: (2024)
Memory as Asset: From Agent-centric to Human-centric Memory Management
di: Pan, Yanqi, et al.
Pubblicazione: (2026)
di: Pan, Yanqi, et al.
Pubblicazione: (2026)
DERM-3R: A Resource-Efficient Multimodal Agents Framework for Dermatologic Diagnosis and Treatment in Real-World Clinical Settings
di: Chen, Ziwen, et al.
Pubblicazione: (2026)
di: Chen, Ziwen, et al.
Pubblicazione: (2026)
An Empirical Study of Agent Developer Practices in AI Agent Frameworks
di: Wang, Yanlin, et al.
Pubblicazione: (2025)
di: Wang, Yanlin, et al.
Pubblicazione: (2025)
Open Role-Playing with Delta-Engines
di: Wu, Hongqiu, et al.
Pubblicazione: (2024)
di: Wu, Hongqiu, et al.
Pubblicazione: (2024)
Emotional RAG: Enhancing Role-Playing Agents through Emotional Retrieval
di: Huang, Le, et al.
Pubblicazione: (2024)
di: Huang, Le, et al.
Pubblicazione: (2024)
Bridging Writing Manner Gap in Visual Instruction Tuning by Creating LLM-aligned Instructions
di: Jing, Dong, et al.
Pubblicazione: (2025)
di: Jing, Dong, et al.
Pubblicazione: (2025)
Learning to play: A Multimodal Agent for 3D Game-Play
di: Yue, Yuguang, et al.
Pubblicazione: (2025)
di: Yue, Yuguang, et al.
Pubblicazione: (2025)
Documenti analoghi
-
CharacterBox: Evaluating the Role-Playing Capabilities of LLMs in Text-Based Virtual Worlds
di: Wang, Lei, et al.
Pubblicazione: (2024) -
Adaptive Task Balancing for Visual Instruction Tuning via Inter-Task Contribution and Intra-Task Difficulty
di: Dai, Yanqi, et al.
Pubblicazione: (2024) -
Harder Is Better: Boosting Mathematical Reasoning via Difficulty-Aware GRPO and Multi-Aspect Question Reformulation
di: Dai, Yanqi, et al.
Pubblicazione: (2026) -
VoxRole: A Comprehensive Benchmark for Evaluating Speech-Based Role-Playing Agents
di: Wu, Weihao, et al.
Pubblicazione: (2025) -
MINDECHO: Role-Playing Language Agents for Key Opinion Leaders
di: Xu, Rui, et al.
Pubblicazione: (2024)