Learning Strategic Language Agents in the Werewolf Game with Iterative Latent Space Policy Optimization
Fuente:
arXiv
Salvato in:
| Autori principali: | Xu, Zelai, Gu, Wanjun, Yu, Chao, Wu, Yi, Wang, Yu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Language Agents with Reinforcement Learning for Strategic Play in the Werewolf Game
di: Xu, Zelai, et al.
Pubblicazione: (2023)
di: Xu, Zelai, et al.
Pubblicazione: (2023)
MAGE: Meta-Reinforcement Learning for Language Agents toward Strategic Exploration and Exploitation
di: Yang, Lu, et al.
Pubblicazione: (2026)
di: Yang, Lu, et al.
Pubblicazione: (2026)
VS-Bench: Evaluating VLMs for Strategic Abilities in Multi-Agent Environments
di: Xu, Zelai, et al.
Pubblicazione: (2025)
di: Xu, Zelai, et al.
Pubblicazione: (2025)
Enhance Reasoning for Large Language Models in the Game Werewolf
di: Wu, Shuang, et al.
Pubblicazione: (2024)
di: Wu, Shuang, et al.
Pubblicazione: (2024)
RE-PO: Robust Enhanced Policy Optimization as a General Framework for LLM Alignment
di: Cao, Xiaoyang, et al.
Pubblicazione: (2025)
di: Cao, Xiaoyang, et al.
Pubblicazione: (2025)
Verbal Werewolf: Engage Users with Verbalized Agentic Werewolf Game Framework
di: Fan, Qihui, et al.
Pubblicazione: (2025)
di: Fan, Qihui, et al.
Pubblicazione: (2025)
Learning to Discuss Strategically: A Case Study on One Night Ultimate Werewolf
di: Jin, Xuanfa, et al.
Pubblicazione: (2024)
di: Jin, Xuanfa, et al.
Pubblicazione: (2024)
AED: Automatic Discovery of Effective and Diverse Vulnerabilities for Autonomous Driving Policy with Large Language Models
di: Qiu, Le, et al.
Pubblicazione: (2025)
di: Qiu, Le, et al.
Pubblicazione: (2025)
VolleyBots: A Testbed for Multi-Drone Volleyball Game Combining Motion Control and Strategic Play
di: Xu, Zelai, et al.
Pubblicazione: (2025)
di: Xu, Zelai, et al.
Pubblicazione: (2025)
MARSHAL: Incentivizing Multi-Agent Reasoning via Self-Play with Strategic LLMs
di: Yuan, Huining, et al.
Pubblicazione: (2025)
di: Yuan, Huining, et al.
Pubblicazione: (2025)
MultiMind: Enhancing Werewolf Agents with Multimodal Reasoning and Theory of Mind
di: Zhang, Zheng, et al.
Pubblicazione: (2025)
di: Zhang, Zheng, et al.
Pubblicazione: (2025)
Verifiable Process Rewards for Agentic Reasoning
di: Yuan, Huining, et al.
Pubblicazione: (2026)
di: Yuan, Huining, et al.
Pubblicazione: (2026)
IIB-LPO: Latent Policy Optimization via Iterative Information Bottleneck
di: Deng, Huilin, et al.
Pubblicazione: (2026)
di: Deng, Huilin, et al.
Pubblicazione: (2026)
Helmsman of the Masses? Evaluate the Opinion Leadership of Large Language Models in the Werewolf Game
di: Du, Silin, et al.
Pubblicazione: (2024)
di: Du, Silin, et al.
Pubblicazione: (2024)
WereWolf-Plus: An Update of Werewolf Game setting Based on DSGBench
di: Xia, Xinyuan, et al.
Pubblicazione: (2025)
di: Xia, Xinyuan, et al.
Pubblicazione: (2025)
WideSeek-R1: Exploring Width Scaling for Broad Information Seeking via Multi-Agent Reinforcement Learning
di: Xu, Zelai, et al.
Pubblicazione: (2026)
di: Xu, Zelai, et al.
Pubblicazione: (2026)
Style-Preserving Policy Optimization for Game Agents
di: Li, Lingfeng, et al.
Pubblicazione: (2025)
di: Li, Lingfeng, et al.
Pubblicazione: (2025)
Adaptive Social Learning via Mode Policy Optimization for Language Agents
di: Wang, Minzheng, et al.
Pubblicazione: (2025)
di: Wang, Minzheng, et al.
Pubblicazione: (2025)
Enhancing Dialogue Generation in Werewolf Game Through Situation Analysis and Persuasion Strategies
di: Qi, Zhiyang, et al.
Pubblicazione: (2024)
di: Qi, Zhiyang, et al.
Pubblicazione: (2024)
Neural Internal Model Control: Learning a Robust Control Policy via Predictive Error Feedback
di: Gao, Feng, et al.
Pubblicazione: (2024)
di: Gao, Feng, et al.
Pubblicazione: (2024)
Safe Equilibrium Policy Optimization for Strategic Agent Policies
di: Arumugam, Karthika, et al.
Pubblicazione: (2026)
di: Arumugam, Karthika, et al.
Pubblicazione: (2026)
Mastering Multi-Drone Volleyball through Hierarchical Co-Self-Play Reinforcement Learning
di: Zhang, Ruize, et al.
Pubblicazione: (2025)
di: Zhang, Ruize, et al.
Pubblicazione: (2025)
Think in Games: Learning to Reason in Games via Reinforcement Learning with Large Language Models
di: Liao, Yi, et al.
Pubblicazione: (2025)
di: Liao, Yi, et al.
Pubblicazione: (2025)
LEPO: Latent Reasoning Policy Optimization for Large Language Models
di: Zhou, Yuyan, et al.
Pubblicazione: (2026)
di: Zhou, Yuyan, et al.
Pubblicazione: (2026)
Extending Test-Time Scaling: A 3D Perspective with Context, Batch, and Turn
di: Yu, Chao, et al.
Pubblicazione: (2025)
di: Yu, Chao, et al.
Pubblicazione: (2025)
Offline Multi-Agent Reinforcement Learning via In-Sample Sequential Policy Optimization
di: Liu, Zongkai, et al.
Pubblicazione: (2024)
di: Liu, Zongkai, et al.
Pubblicazione: (2024)
Strat-Reasoner: Reinforcing Strategic Reasoning of LLMs in Multi-Agent Games
di: He, Yidong, et al.
Pubblicazione: (2026)
di: He, Yidong, et al.
Pubblicazione: (2026)
Global Policy-Space Response Oracles for Two-Player Zero-Sum Games
di: Zhang, Junyu, et al.
Pubblicazione: (2026)
di: Zhang, Junyu, et al.
Pubblicazione: (2026)
Learning Game-Playing Agents with Generative Code Optimization
di: Kuang, Zhiyi, et al.
Pubblicazione: (2025)
di: Kuang, Zhiyi, et al.
Pubblicazione: (2025)
M$^{2}$GRPO: Mamba-based Multi-Agent Group Relative Policy Optimization for Biomimetic Underwater Robots Pursuit
di: Feng, Yukai, et al.
Pubblicazione: (2026)
di: Feng, Yukai, et al.
Pubblicazione: (2026)
Game-TARS: Pretrained Foundation Models for Scalable Generalist Multimodal Game Agents
di: Wang, Zihao, et al.
Pubblicazione: (2025)
di: Wang, Zihao, et al.
Pubblicazione: (2025)
A Survey on Self-play Methods in Reinforcement Learning
di: Zhang, Ruize, et al.
Pubblicazione: (2024)
di: Zhang, Ruize, et al.
Pubblicazione: (2024)
WOLF: Werewolf-based Observations for LLM Deception and Falsehoods
di: Agarwal, Mrinal, et al.
Pubblicazione: (2025)
di: Agarwal, Mrinal, et al.
Pubblicazione: (2025)
Combinatorial Optimization with Policy Adaptation using Latent Space Search
di: Chalumeau, Felix, et al.
Pubblicazione: (2023)
di: Chalumeau, Felix, et al.
Pubblicazione: (2023)
LeTO: Learning Constrained Visuomotor Policy with Differentiable Trajectory Optimization
di: Xu, Zhengtong, et al.
Pubblicazione: (2024)
di: Xu, Zhengtong, et al.
Pubblicazione: (2024)
Nemobot Games: Crafting Strategic AI Gaming Agents for Interactive Learning with Large Language Models
di: Tan, Chee Wei, et al.
Pubblicazione: (2026)
di: Tan, Chee Wei, et al.
Pubblicazione: (2026)
Learnable Game-theoretic Policy Optimization for Data-centric Self-explanation Rationalization
di: Zhao, Yunxiao, et al.
Pubblicazione: (2025)
di: Zhao, Yunxiao, et al.
Pubblicazione: (2025)
Tracing LLM Reasoning Processes with Strategic Games: A Framework for Planning, Revision, and Resource-Constrained Decision Making
di: Yuan, Xiaopeng, et al.
Pubblicazione: (2025)
di: Yuan, Xiaopeng, et al.
Pubblicazione: (2025)
Enabling Agents to Communicate Entirely in Latent Space
di: Du, Zhuoyun, et al.
Pubblicazione: (2025)
di: Du, Zhuoyun, et al.
Pubblicazione: (2025)
WGSR-Bench: Wargame-based Game-theoretic Strategic Reasoning Benchmark for Large Language Models
di: Yin, Qiyue, et al.
Pubblicazione: (2025)
di: Yin, Qiyue, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Language Agents with Reinforcement Learning for Strategic Play in the Werewolf Game
di: Xu, Zelai, et al.
Pubblicazione: (2023) -
MAGE: Meta-Reinforcement Learning for Language Agents toward Strategic Exploration and Exploitation
di: Yang, Lu, et al.
Pubblicazione: (2026) -
VS-Bench: Evaluating VLMs for Strategic Abilities in Multi-Agent Environments
di: Xu, Zelai, et al.
Pubblicazione: (2025) -
Enhance Reasoning for Large Language Models in the Game Werewolf
di: Wu, Shuang, et al.
Pubblicazione: (2024) -
RE-PO: Robust Enhanced Policy Optimization as a General Framework for LLM Alignment
di: Cao, Xiaoyang, et al.
Pubblicazione: (2025)