Cogito, Ergo Ludo: An Agent that Learns to Play by Reasoning and Planning
Fuente:
arXiv
Guardado en:
| Autores principales: | Wang, Sai, Wu, Yu, Xu, Zhongwen |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Understanding Tool-Integrated Reasoning
por: Lin, Heng, et al.
Publicado: (2025)
por: Lin, Heng, et al.
Publicado: (2025)
Language Agents with Reinforcement Learning for Strategic Play in the Werewolf Game
por: Xu, Zelai, et al.
Publicado: (2023)
por: Xu, Zelai, et al.
Publicado: (2023)
Single-stream Policy Optimization
por: Xu, Zhongwen, et al.
Publicado: (2025)
por: Xu, Zhongwen, et al.
Publicado: (2025)
Learning Game-Playing Agents with Generative Code Optimization
por: Kuang, Zhiyi, et al.
Publicado: (2025)
por: Kuang, Zhiyi, et al.
Publicado: (2025)
Learning to Optimize for Reinforcement Learning
por: Lan, Qingfeng, et al.
Publicado: (2023)
por: Lan, Qingfeng, et al.
Publicado: (2023)
Retro-Expert: Collaborative Reasoning for Interpretable Retrosynthesis
por: Li, Xinyi, et al.
Publicado: (2025)
por: Li, Xinyi, et al.
Publicado: (2025)
Mutual Information Regularized Offline Reinforcement Learning
por: Ma, Xiao, et al.
Publicado: (2022)
por: Ma, Xiao, et al.
Publicado: (2022)
Spatial Reasoning and Planning for Deep Embodied Agents
por: Ishida, Shu
Publicado: (2024)
por: Ishida, Shu
Publicado: (2024)
Learning Robust Reasoning through Guided Adversarial Self-Play
por: Li, Shuozhe, et al.
Publicado: (2026)
por: Li, Shuozhe, et al.
Publicado: (2026)
SmartPlay: A Benchmark for LLMs as Intelligent Agents
por: Wu, Yue, et al.
Publicado: (2023)
por: Wu, Yue, et al.
Publicado: (2023)
Reinforced Reasoning for Embodied Planning
por: Wu, Di, et al.
Publicado: (2025)
por: Wu, Di, et al.
Publicado: (2025)
ErgoChat: a Visual Query System for the Ergonomic Risk Assessment of Construction Workers
por: Fan, Chao, et al.
Publicado: (2024)
por: Fan, Chao, et al.
Publicado: (2024)
Learning to play: A Multimodal Agent for 3D Game-Play
por: Yue, Yuguang, et al.
Publicado: (2025)
por: Yue, Yuguang, et al.
Publicado: (2025)
SPIRAL: Self-Play on Zero-Sum Games Incentivizes Reasoning via Multi-Agent Multi-Turn Reinforcement Learning
por: Liu, Bo, et al.
Publicado: (2025)
por: Liu, Bo, et al.
Publicado: (2025)
Why Reasoning Fails to Plan: A Planning-Centric Analysis of Long-Horizon Decision Making in LLM Agents
por: Wang, Zehong, et al.
Publicado: (2026)
por: Wang, Zehong, et al.
Publicado: (2026)
Self-Improving AI Agents through Self-Play
por: Chojecki, Przemyslaw
Publicado: (2025)
por: Chojecki, Przemyslaw
Publicado: (2025)
TriPlay-RL: Tri-Role Self-Play Reinforcement Learning for LLM Safety Alignment
por: Tan, Zhewen, et al.
Publicado: (2026)
por: Tan, Zhewen, et al.
Publicado: (2026)
Agent Q: Advanced Reasoning and Learning for Autonomous AI Agents
por: Putta, Pranav, et al.
Publicado: (2024)
por: Putta, Pranav, et al.
Publicado: (2024)
CPL: Critical Plan Step Learning Boosts LLM Generalization in Reasoning Tasks
por: Wang, Tianlong, et al.
Publicado: (2024)
por: Wang, Tianlong, et al.
Publicado: (2024)
WIST: Web-Grounded Iterative Self-Play Tree for Domain-Targeted Reasoning Improvement
por: Li, Fangyuan, et al.
Publicado: (2026)
por: Li, Fangyuan, et al.
Publicado: (2026)
LUDOBENCH: Evaluating LLM Behavioural Decision-Making Through Spot-Based Board Game Scenarios in Ludo
por: Jain, Ojas, et al.
Publicado: (2026)
por: Jain, Ojas, et al.
Publicado: (2026)
Reason in Chains, Learn in Trees: Self-Rectification and Grafting for Multi-turn Agent Policy Optimization
por: Li, Yu, et al.
Publicado: (2026)
por: Li, Yu, et al.
Publicado: (2026)
OMNIFLOW: A Physics-Grounded Multimodal Agent for Generalized Scientific Reasoning
por: Wu, Hao, et al.
Publicado: (2026)
por: Wu, Hao, et al.
Publicado: (2026)
Play Style Identification Using Low-Level Representations of Play Traces in MicroRTS
por: Xia, Ruizhe Yu, et al.
Publicado: (2025)
por: Xia, Ruizhe Yu, et al.
Publicado: (2025)
Reasoning as Gradient: Scaling MLE Agents Beyond Tree Search
por: Zhang, Yifei, et al.
Publicado: (2026)
por: Zhang, Yifei, et al.
Publicado: (2026)
Near-Optimal Reinforcement Learning with Self-Play under Adaptivity Constraints
por: Qiao, Dan, et al.
Publicado: (2024)
por: Qiao, Dan, et al.
Publicado: (2024)
Agent JIT Compilation for Latency-Optimizing Web Agent Planning and Scheduling
por: Winston, Caleb, et al.
Publicado: (2026)
por: Winston, Caleb, et al.
Publicado: (2026)
Learning to Play Blackjack: A Curriculum Learning Perspective
por: Alasti, Amirreza, et al.
Publicado: (2026)
por: Alasti, Amirreza, et al.
Publicado: (2026)
Learning Concept-Based Causal Transition and Symbolic Reasoning for Visual Planning
por: Qian, Yilue, et al.
Publicado: (2023)
por: Qian, Yilue, et al.
Publicado: (2023)
Demystifying MuZero Planning: Interpreting the Learned Model
por: Guei, Hung, et al.
Publicado: (2024)
por: Guei, Hung, et al.
Publicado: (2024)
ANCORA: Learning to Question via Manifold-Anchored Self-Play for Verifiable Reasoning
por: Yang, Chengcao
Publicado: (2026)
por: Yang, Chengcao
Publicado: (2026)
MASP: Scalable GNN-based Planning for Multi-Agent Navigation
por: Yang, Xinyi, et al.
Publicado: (2023)
por: Yang, Xinyi, et al.
Publicado: (2023)
Thinking with Deltas: Incentivizing Reinforcement Learning via Differential Visual Reasoning Policy
por: Gao, Shujian, et al.
Publicado: (2026)
por: Gao, Shujian, et al.
Publicado: (2026)
Better LLM Reasoning via Dual-Play
por: Zhang, Zhengxin, et al.
Publicado: (2025)
por: Zhang, Zhengxin, et al.
Publicado: (2025)
TextAtari: 100K Frames Game Playing with Language Agents
por: Li, Wenhao, et al.
Publicado: (2025)
por: Li, Wenhao, et al.
Publicado: (2025)
Bidirectional Distillation: A Mixed-Play Framework for Multi-Agent Generalizable Behaviors
por: Feng, Lang, et al.
Publicado: (2025)
por: Feng, Lang, et al.
Publicado: (2025)
Plantain: Plan-Answer Interleaved Reasoning
por: Liang, Anthony, et al.
Publicado: (2025)
por: Liang, Anthony, et al.
Publicado: (2025)
On the Empirical Complexity of Reasoning and Planning in LLMs
por: Kang, Liwei, et al.
Publicado: (2024)
por: Kang, Liwei, et al.
Publicado: (2024)
Role Play: Learning Adaptive Role-Specific Strategies in Multi-Agent Interactions
por: Long, Weifan, et al.
Publicado: (2024)
por: Long, Weifan, et al.
Publicado: (2024)
DreamPRM: Domain-Reweighted Process Reward Model for Multimodal Reasoning
por: Cao, Qi, et al.
Publicado: (2025)
por: Cao, Qi, et al.
Publicado: (2025)
Ejemplares similares
-
Understanding Tool-Integrated Reasoning
por: Lin, Heng, et al.
Publicado: (2025) -
Language Agents with Reinforcement Learning for Strategic Play in the Werewolf Game
por: Xu, Zelai, et al.
Publicado: (2023) -
Single-stream Policy Optimization
por: Xu, Zhongwen, et al.
Publicado: (2025) -
Learning Game-Playing Agents with Generative Code Optimization
por: Kuang, Zhiyi, et al.
Publicado: (2025) -
Learning to Optimize for Reinforcement Learning
por: Lan, Qingfeng, et al.
Publicado: (2023)