GVGAI-LLM: Evaluating Large Language Model Agents with Infinite Games
Fuente:
arXiv
Saved in:
| Main Authors: | Li, Yuchen, Lin, Cong, Nasir, Muhammad Umair, Bontrager, Philip, Liu, Jialin, Togelius, Julian |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
GameTraversalBenchmark: Evaluating Planning Abilities Of Large Language Models Through Traversing 2D Game Maps
by: Nasir, Muhammad Umair, et al.
Published: (2024)
by: Nasir, Muhammad Umair, et al.
Published: (2024)
Mortar: Evolving Mechanics for Automatic Game Design
by: Nasir, Muhammad U., et al.
Published: (2025)
by: Nasir, Muhammad U., et al.
Published: (2025)
Word2World: Generating Stories and Worlds through Large Language Models
by: Nasir, Muhammad U., et al.
Published: (2024)
by: Nasir, Muhammad U., et al.
Published: (2024)
ScriptDoctor: Automatic Generation of PuzzleScript Games via Large Language Models and Tree Search
by: Earle, Sam, et al.
Published: (2025)
by: Earle, Sam, et al.
Published: (2025)
Autoverse: An Evolvable Game Language for Learning Robust Embodied Agents
by: Earle, Sam, et al.
Published: (2024)
by: Earle, Sam, et al.
Published: (2024)
Word2Minecraft: Generating 3D Game Levels through Large Language Models
by: Huang, Shuo, et al.
Published: (2025)
by: Huang, Shuo, et al.
Published: (2025)
LLMatic: Neural Architecture Search via Large Language Models and Quality Diversity Optimization
by: Nasir, Muhammad U., et al.
Published: (2023)
by: Nasir, Muhammad U., et al.
Published: (2023)
PuzzleJAX: A Benchmark for Reasoning and Learning
by: Earle, Sam, et al.
Published: (2025)
by: Earle, Sam, et al.
Published: (2025)
Continuous Program Search
by: Siper, Matthew, et al.
Published: (2026)
by: Siper, Matthew, et al.
Published: (2026)
Enhancing Player Enjoyment with a Two-Tier DRL and LLM-Based Agent System for Fighting Games
by: Wang, Shouren, et al.
Published: (2025)
by: Wang, Shouren, et al.
Published: (2025)
Game Generation via Large Language Models
by: Hu, Chengpeng, et al.
Published: (2024)
by: Hu, Chengpeng, et al.
Published: (2024)
Missed Connections: Lateral Thinking Puzzles for Large Language Models
by: Todd, Graham, et al.
Published: (2024)
by: Todd, Graham, et al.
Published: (2024)
Large Language Models and Games: A Survey and Roadmap
by: Gallotta, Roberto, et al.
Published: (2024)
by: Gallotta, Roberto, et al.
Published: (2024)
GAVEL: Generating Games Via Evolution and Language Models
by: Todd, Graham, et al.
Published: (2024)
by: Todd, Graham, et al.
Published: (2024)
Amorphous Fortress Online: Collaboratively Designing Open-Ended Multi-Agent AI and Game Environments
by: Charity, M, et al.
Published: (2025)
by: Charity, M, et al.
Published: (2025)
Ludax: A GPU-Accelerated Domain Specific Language for Board Games
by: Todd, Graham, et al.
Published: (2025)
by: Todd, Graham, et al.
Published: (2025)
Video Game Level Design as a Multi-Agent Reinforcement Learning Problem
by: Earle, Sam, et al.
Published: (2025)
by: Earle, Sam, et al.
Published: (2025)
Ethical Considerations of Large Language Models in Game Playing
by: Zhang, Qingquan, et al.
Published: (2025)
by: Zhang, Qingquan, et al.
Published: (2025)
The Ink Splotch Effect: A Case Study on ChatGPT as a Co-Creative Game Designer
by: Anjum, Asad, et al.
Published: (2024)
by: Anjum, Asad, et al.
Published: (2024)
Measuring Diversity of Game Scenarios
by: Li, Yuchen, et al.
Published: (2024)
by: Li, Yuchen, et al.
Published: (2024)
Evaluating the Efficacy of Large Language Models in Identifying Phishing Attempts
by: Patel, Het, et al.
Published: (2024)
by: Patel, Het, et al.
Published: (2024)
A Survey on Large Language Model-Based Game Agents
by: Hu, Sihao, et al.
Published: (2024)
by: Hu, Sihao, et al.
Published: (2024)
Making New Connections: LLMs as Puzzle Generators for The New York Times' Connections Word Game
by: Merino, Tim, et al.
Published: (2024)
by: Merino, Tim, et al.
Published: (2024)
Enhancing Multi-Agent Consensus through Third-Party LLM Integration: Analyzing Uncertainty and Mitigating Hallucinations in Large Language Models
by: Duan, Zhihua, et al.
Published: (2024)
by: Duan, Zhihua, et al.
Published: (2024)
Moonshine: Distilling Game Content Generators into Steerable Generative Models
by: Nie, Yuhe, et al.
Published: (2024)
by: Nie, Yuhe, et al.
Published: (2024)
PCGRLLM: Large Language Model-Driven Reward Design for Procedural Content Generation Reinforcement Learning
by: Baek, In-Chang, et al.
Published: (2025)
by: Baek, In-Chang, et al.
Published: (2025)
Nemobot Games: Crafting Strategic AI Gaming Agents for Interactive Learning with Large Language Models
by: Tan, Chee Wei, et al.
Published: (2026)
by: Tan, Chee Wei, et al.
Published: (2026)
InfiAgent: An Infinite-Horizon Framework for General-Purpose Autonomous Agents
by: Yu, Chenglin, et al.
Published: (2026)
by: Yu, Chenglin, et al.
Published: (2026)
PCGRL+: Scaling, Control and Generalization in Reinforcement Learning Level Generators
by: Earle, Sam, et al.
Published: (2024)
by: Earle, Sam, et al.
Published: (2024)
Agent AI with LangGraph: A Modular Framework for Enhancing Machine Translation Using Large Language Models
by: Wang, Jialin, et al.
Published: (2024)
by: Wang, Jialin, et al.
Published: (2024)
The Procedural Content Generation Benchmark: An Open-source Testbed for Generative Challenges in Games
by: Khalifa, Ahmed, et al.
Published: (2025)
by: Khalifa, Ahmed, et al.
Published: (2025)
Pre-Trained Language Models for Keyphrase Prediction: A Review
by: Umair, Muhammad, et al.
Published: (2024)
by: Umair, Muhammad, et al.
Published: (2024)
Multi-tool Integration Application for Math Reasoning Using Large Language Model
by: Duan, Zhihua, et al.
Published: (2024)
by: Duan, Zhihua, et al.
Published: (2024)
In Search of the Ingredients of Open-Endedness: Replicating Picbreeder with Large Vision-Language Models
by: Earle, Sam, et al.
Published: (2026)
by: Earle, Sam, et al.
Published: (2026)
Agents on the Bench: Large Language Model Based Multi Agent Framework for Trustworthy Digital Justice
by: Jiang, Cong, et al.
Published: (2024)
by: Jiang, Cong, et al.
Published: (2024)
3D Building Generation in Minecraft via Large Language Models
by: Hu, Shiying, et al.
Published: (2024)
by: Hu, Shiying, et al.
Published: (2024)
GameBench: Evaluating Strategic Reasoning Abilities of LLM Agents
by: Costarelli, Anthony, et al.
Published: (2024)
by: Costarelli, Anthony, et al.
Published: (2024)
Agentmandering: A Game-Theoretic Framework for Fair Redistricting via Large Language Model Agents
by: Li, Hao, et al.
Published: (2025)
by: Li, Hao, et al.
Published: (2025)
Evolutionary Level Repair
by: Bhaumik, Debosmita, et al.
Published: (2025)
by: Bhaumik, Debosmita, et al.
Published: (2025)
All Stories Are One Story: Emotional Arc Guided Procedural Game Level Generation
by: Wen, Yunge, et al.
Published: (2025)
by: Wen, Yunge, et al.
Published: (2025)
Similar Items
-
GameTraversalBenchmark: Evaluating Planning Abilities Of Large Language Models Through Traversing 2D Game Maps
by: Nasir, Muhammad Umair, et al.
Published: (2024) -
Mortar: Evolving Mechanics for Automatic Game Design
by: Nasir, Muhammad U., et al.
Published: (2025) -
Word2World: Generating Stories and Worlds through Large Language Models
by: Nasir, Muhammad U., et al.
Published: (2024) -
ScriptDoctor: Automatic Generation of PuzzleScript Games via Large Language Models and Tree Search
by: Earle, Sam, et al.
Published: (2025) -
Autoverse: An Evolvable Game Language for Learning Robust Embodied Agents
by: Earle, Sam, et al.
Published: (2024)