LLM-Gomoku: A Large Language Model-Based System for Strategic Gomoku with Self-Play and Reinforcement Learning
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Wang, Hui |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Rapfi: Distilling Efficient Neural Network for the Game of Gomoku
par: Jin, Zhanggen, et autres
Publié: (2025)
par: Jin, Zhanggen, et autres
Publié: (2025)
SeRL: Self-Play Reinforcement Learning for Large Language Models with Limited Data
par: Fang, Wenkai, et autres
Publié: (2025)
par: Fang, Wenkai, et autres
Publié: (2025)
Large Language Models as Pokémon Battle Agents: Strategic Play and Content Generation
par: Jain, Daksh, et autres
Publié: (2025)
par: Jain, Daksh, et autres
Publié: (2025)
RoleLLM: Benchmarking, Eliciting, and Enhancing Role-Playing Abilities of Large Language Models
par: Wang, Zekun Moore, et autres
Publié: (2023)
par: Wang, Zekun Moore, et autres
Publié: (2023)
SLearnLLM: A Self-Learning Framework for Efficient Domain-Specific Adaptation of Large Language Models
par: Liu, Xiang, et autres
Publié: (2025)
par: Liu, Xiang, et autres
Publié: (2025)
TextGames: Learning to Self-Play Text-Based Puzzle Games via Language Model Reasoning
par: Hudi, Frederikus, et autres
Publié: (2025)
par: Hudi, Frederikus, et autres
Publié: (2025)
LLM-KT: Aligning Large Language Models with Knowledge Tracing using a Plug-and-Play Instruction
par: Wang, Ziwei, et autres
Publié: (2025)
par: Wang, Ziwei, et autres
Publié: (2025)
Self-Harmony: Learning to Harmonize Self-Supervision and Self-Play in Test-Time Reinforcement Learning
par: Wang, Ru, et autres
Publié: (2025)
par: Wang, Ru, et autres
Publié: (2025)
Role-Playing Evaluation for Large Language Models
par: Boudouri, Yassine El, et autres
Publié: (2025)
par: Boudouri, Yassine El, et autres
Publié: (2025)
LLM Discussion: Enhancing the Creativity of Large Language Models via Discussion Framework and Role-Play
par: Lu, Li-Chun, et autres
Publié: (2024)
par: Lu, Li-Chun, et autres
Publié: (2024)
Post-Training Large Language Models via Reinforcement Learning from Self-Feedback
par: van Niekerk, Carel, et autres
Publié: (2025)
par: van Niekerk, Carel, et autres
Publié: (2025)
Multi-agent KTO: Reinforcing Strategic Interactions of Large Language Model in Language Game
par: Ye, Rong, et autres
Publié: (2025)
par: Ye, Rong, et autres
Publié: (2025)
SEM: Reinforcement Learning for Search-Efficient Large Language Models
par: Sha, Zeyang, et autres
Publié: (2025)
par: Sha, Zeyang, et autres
Publié: (2025)
SPFT-SQL: Enhancing Large Language Model for Text-to-SQL Parsing by Self-Play Fine-Tuning
par: Zhang, Yuhao, et autres
Publié: (2025)
par: Zhang, Yuhao, et autres
Publié: (2025)
Memory Decoder: A Pretrained, Plug-and-Play Memory for Large Language Models
par: Cao, Jiaqi, et autres
Publié: (2025)
par: Cao, Jiaqi, et autres
Publié: (2025)
Cooperative Strategic Planning Enhances Reasoning Capabilities in Large Language Models
par: Wang, Danqing, et autres
Publié: (2024)
par: Wang, Danqing, et autres
Publié: (2024)
Strategic Data Ordering: Enhancing Large Language Model Performance through Curriculum Learning
par: Kim, Jisu, et autres
Publié: (2024)
par: Kim, Jisu, et autres
Publié: (2024)
Reinforcement Learning Problem Solving with Large Language Models
par: Gholamian, Sina, et autres
Publié: (2024)
par: Gholamian, Sina, et autres
Publié: (2024)
Self-HarmLLM: Can Large Language Model Harm Itself?
par: Kim, Heehwan, et autres
Publié: (2025)
par: Kim, Heehwan, et autres
Publié: (2025)
SPaR: Self-Play with Tree-Search Refinement to Improve Instruction-Following in Large Language Models
par: Cheng, Jiale, et autres
Publié: (2024)
par: Cheng, Jiale, et autres
Publié: (2024)
M-GRPO: Stabilizing Self-Supervised Reinforcement Learning for Large Language Models with Momentum-Anchored Policy Optimization
par: Bai, Bizhe, et autres
Publié: (2025)
par: Bai, Bizhe, et autres
Publié: (2025)
RPGBENCH: Evaluating Large Language Models as Role-Playing Game Engines
par: Yu, Pengfei, et autres
Publié: (2025)
par: Yu, Pengfei, et autres
Publié: (2025)
On the Decision-Making Abilities in Role-Playing using Large Language Models
par: Shen, Chenglei, et autres
Publié: (2024)
par: Shen, Chenglei, et autres
Publié: (2024)
DSCC-HS: A Dynamic Self-Reinforcing Framework for Hallucination Suppression in Large Language Models
par: Zheng, Xiao
Publié: (2025)
par: Zheng, Xiao
Publié: (2025)
Playing 20 Question Game with Policy-Based Reinforcement Learning
par: Hu, Huang, et autres
Publié: (2018)
par: Hu, Huang, et autres
Publié: (2018)
Self-Play Preference Optimization for Language Model Alignment
par: Wu, Yue, et autres
Publié: (2024)
par: Wu, Yue, et autres
Publié: (2024)
Improving the Language Understanding Capabilities of Large Language Models Using Reinforcement Learning
par: Hu, Bokai, et autres
Publié: (2024)
par: Hu, Bokai, et autres
Publié: (2024)
Play Favorites: A Statistical Method to Measure Self-Bias in LLM-as-a-Judge
par: Spiliopoulou, Evangelia, et autres
Publié: (2025)
par: Spiliopoulou, Evangelia, et autres
Publié: (2025)
Consistent Paths Lead to Truth: Self-Rewarding Reinforcement Learning for LLM Reasoning
par: Zhang, Kongcheng, et autres
Publié: (2025)
par: Zhang, Kongcheng, et autres
Publié: (2025)
Towards Large Reasoning Models: A Survey of Reinforced Reasoning with Large Language Models
par: Xu, Fengli, et autres
Publié: (2025)
par: Xu, Fengli, et autres
Publié: (2025)
Credence Calibration Game? Calibrating Large Language Models through Structured Play
par: Fang, Ke, et autres
Publié: (2025)
par: Fang, Ke, et autres
Publié: (2025)
Plug-and-Play Policy Planner for Large Language Model Powered Dialogue Agents
par: Deng, Yang, et autres
Publié: (2023)
par: Deng, Yang, et autres
Publié: (2023)
Embedding Domain Knowledge for Large Language Models via Reinforcement Learning from Augmented Generation
par: Nie, Chaojun, et autres
Publié: (2025)
par: Nie, Chaojun, et autres
Publié: (2025)
Learning to Better Search with Language Models via Guided Reinforced Self-Training
par: Moon, Seungyong, et autres
Publié: (2024)
par: Moon, Seungyong, et autres
Publié: (2024)
OThink-SRR1: Search, Refine and Reasoning with Reinforced Learning for Large Language Models
par: Liang, Haijian, et autres
Publié: (2026)
par: Liang, Haijian, et autres
Publié: (2026)
StraTA: Incentivizing Agentic Reinforcement Learning with Strategic Trajectory Abstraction
par: Xue, Xiangyuan, et autres
Publié: (2026)
par: Xue, Xiangyuan, et autres
Publié: (2026)
K-Level Reasoning: Establishing Higher Order Beliefs in Large Language Models for Strategic Reasoning
par: Zhang, Yadong, et autres
Publié: (2024)
par: Zhang, Yadong, et autres
Publié: (2024)
Learning to Self-Verify Makes Language Models Better Reasoners
par: Chen, Yuxin, et autres
Publié: (2026)
par: Chen, Yuxin, et autres
Publié: (2026)
The Oscars of AI Theater: A Survey on Role-Playing with Language Models
par: Chen, Nuo, et autres
Publié: (2024)
par: Chen, Nuo, et autres
Publié: (2024)
Team-Based Self-Play With Dual Adaptive Weighting for Fine-Tuning LLMs
par: Li, Wu, et autres
Publié: (2026)
par: Li, Wu, et autres
Publié: (2026)
Documents similaires
-
Rapfi: Distilling Efficient Neural Network for the Game of Gomoku
par: Jin, Zhanggen, et autres
Publié: (2025) -
SeRL: Self-Play Reinforcement Learning for Large Language Models with Limited Data
par: Fang, Wenkai, et autres
Publié: (2025) -
Large Language Models as Pokémon Battle Agents: Strategic Play and Content Generation
par: Jain, Daksh, et autres
Publié: (2025) -
RoleLLM: Benchmarking, Eliciting, and Enhancing Role-Playing Abilities of Large Language Models
par: Wang, Zekun Moore, et autres
Publié: (2023) -
SLearnLLM: A Self-Learning Framework for Efficient Domain-Specific Adaptation of Large Language Models
par: Liu, Xiang, et autres
Publié: (2025)