Evaluating Large Language Models with Grid-Based Game Competitions: An Extensible LLM Benchmark and Leaderboard
Fuente:
arXiv
Saved in:
| Main Authors: | Topsakal, Oguzhan, Edell, Colby Jacob, Harper, Jackson Bailey |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Towards Explainable Evolution Strategies with Large Language Models
by: Baumann, Jill, et al.
Published: (2024)
by: Baumann, Jill, et al.
Published: (2024)
Evolutionary Computation in the Era of Large Language Model: Survey and Roadmap
by: Wu, Xingyu, et al.
Published: (2024)
by: Wu, Xingyu, et al.
Published: (2024)
Agent Skill Acquisition for Large Language Models via CycleQD
by: Kuroki, So, et al.
Published: (2024)
by: Kuroki, So, et al.
Published: (2024)
ToxSearch: Evolving Prompts for Toxicity Search in Large Language Models
by: Shelar, Onkar, et al.
Published: (2025)
by: Shelar, Onkar, et al.
Published: (2025)
Benchmarking GPT-4 on Algorithmic Problems: A Systematic Evaluation of Prompting Strategies
by: Petruzzellis, Flavio, et al.
Published: (2024)
by: Petruzzellis, Flavio, et al.
Published: (2024)
LLMatic: Neural Architecture Search via Large Language Models and Quality Diversity Optimization
by: Nasir, Muhammad U., et al.
Published: (2023)
by: Nasir, Muhammad U., et al.
Published: (2023)
Exploring Synaptic Resonance in Large Language Models: A Novel Approach to Contextual Memory Integration
by: Applegarth, George, et al.
Published: (2025)
by: Applegarth, George, et al.
Published: (2025)
LLM-SR: Scientific Equation Discovery via Programming with Large Language Models
by: Shojaee, Parshin, et al.
Published: (2024)
by: Shojaee, Parshin, et al.
Published: (2024)
Solve the Loop: Attractor Models for Language and Reasoning
by: Fein-Ashley, Jacob, et al.
Published: (2026)
by: Fein-Ashley, Jacob, et al.
Published: (2026)
Fine-Tuning and Evaluating Open-Source Large Language Models for the Army Domain
by: Ruiz, Daniel C., et al.
Published: (2024)
by: Ruiz, Daniel C., et al.
Published: (2024)
LLM-Based Instance-Driven Heuristic Bias In the Context of a Biased Random Key Genetic Algorithm
by: Sartori, Camilo Chacón, et al.
Published: (2025)
by: Sartori, Camilo Chacón, et al.
Published: (2025)
The Importance of Directional Feedback for LLM-based Optimizers
by: Nie, Allen, et al.
Published: (2024)
by: Nie, Allen, et al.
Published: (2024)
Hyperbolic Fine-Tuning for Large Language Models
by: Yang, Menglin, et al.
Published: (2024)
by: Yang, Menglin, et al.
Published: (2024)
EvoMerge: Neuroevolution for Large Language Models
by: Jiang, Yushu
Published: (2024)
by: Jiang, Yushu
Published: (2024)
LPC-SM: Local Predictive Coding and Sparse Memory for Long-Context Language Modeling
by: Xie, Keqin
Published: (2026)
by: Xie, Keqin
Published: (2026)
Benchmark for CEC 2024 Competition on Multiparty Multiobjective Optimization
by: Luo, Wenjian, et al.
Published: (2024)
by: Luo, Wenjian, et al.
Published: (2024)
AdaEvolve: Adaptive LLM Driven Zeroth-Order Optimization
by: Cemri, Mert, et al.
Published: (2026)
by: Cemri, Mert, et al.
Published: (2026)
Large Language Model for Multi-objective Evolutionary Optimization
by: Liu, Fei, et al.
Published: (2023)
by: Liu, Fei, et al.
Published: (2023)
H-Node Attack and Defense in Large Language Models
by: Yocam, Eric, et al.
Published: (2026)
by: Yocam, Eric, et al.
Published: (2026)
Pareto-Grid-Guided Large Language Models for Fast and High-Quality Heuristics Design in Multi-Objective Combinatorial Optimization
by: Ha, Minh Hieu, et al.
Published: (2025)
by: Ha, Minh Hieu, et al.
Published: (2025)
An Evolutionary Framework for Automatic Optimization Benchmark Generation via Large Language Models
by: Ono, Yuhiro, et al.
Published: (2026)
by: Ono, Yuhiro, et al.
Published: (2026)
Fleet of Agents: Coordinated Problem Solving with Large Language Models
by: Klein, Lars, et al.
Published: (2024)
by: Klein, Lars, et al.
Published: (2024)
Large Language Models and Emergence: A Complex Systems Perspective
by: Krakauer, David C., et al.
Published: (2025)
by: Krakauer, David C., et al.
Published: (2025)
PaceLLM: Brain-Inspired Large Language Models for Long-Context Understanding
by: Li, Kangcong, et al.
Published: (2025)
by: Li, Kangcong, et al.
Published: (2025)
Assessing the Emergent Symbolic Reasoning Abilities of Llama Large Language Models
by: Petruzzellis, Flavio, et al.
Published: (2024)
by: Petruzzellis, Flavio, et al.
Published: (2024)
Evolutionary Multi-Objective Optimization of Large Language Model Prompts for Balancing Sentiments
by: Baumann, Jill, et al.
Published: (2024)
by: Baumann, Jill, et al.
Published: (2024)
MAR: Efficient Large Language Models via Module-aware Architecture Refinement
by: Cai, Junhong, et al.
Published: (2026)
by: Cai, Junhong, et al.
Published: (2026)
When Large Language Models Meet Evolutionary Algorithms: Potential Enhancements and Challenges
by: Wang, Chao, et al.
Published: (2024)
by: Wang, Chao, et al.
Published: (2024)
Hierarchical Frequency Tagging Probe (HFTP): A Unified Approach to Investigate Syntactic Structure Representations in Large Language Models and the Human Brain
by: An, Jingmin, et al.
Published: (2025)
by: An, Jingmin, et al.
Published: (2025)
EvoGPT-f: An Evolutionary GPT Framework for Benchmarking Formal Math Languages
by: Mercer, Johnathan
Published: (2024)
by: Mercer, Johnathan
Published: (2024)
Competition and Attraction Improve Model Fusion
by: Abrantes, João, et al.
Published: (2025)
by: Abrantes, João, et al.
Published: (2025)
Recent Advances in Federated Learning Driven Large Language Models: A Survey on Architecture, Performance, and Security
by: Qu, Youyang, et al.
Published: (2024)
by: Qu, Youyang, et al.
Published: (2024)
Semantic Mirror Jailbreak: Genetic Algorithm Based Jailbreak Prompts Against Open-source LLMs
by: Li, Xiaoxia, et al.
Published: (2024)
by: Li, Xiaoxia, et al.
Published: (2024)
W-PCA Based Gradient-Free Proxy for Efficient Search of Lightweight Language Models
by: Wang, Shang
Published: (2025)
by: Wang, Shang
Published: (2025)
Text-Utilization for Encoder-dominated Speech Recognition Models
by: Zeyer, Albert, et al.
Published: (2026)
by: Zeyer, Albert, et al.
Published: (2026)
Personalized Language Models via Privacy-Preserving Evolutionary Model Merging
by: Kim, Kyuyoung, et al.
Published: (2025)
by: Kim, Kyuyoung, et al.
Published: (2025)
SpikeLLM: Scaling up Spiking Neural Network to Large Language Models via Saliency-based Spiking
by: Xing, Xingrun, et al.
Published: (2024)
by: Xing, Xingrun, et al.
Published: (2024)
Large Language Model-Based Benchmarking Experiment Settings for Evolutionary Multi-Objective Optimization
by: Pang, Lie Meng, et al.
Published: (2025)
by: Pang, Lie Meng, et al.
Published: (2025)
Interpreting and learning voice commands with a Large Language Model for a robot system
by: Stankevich, Stanislau, et al.
Published: (2024)
by: Stankevich, Stanislau, et al.
Published: (2024)
Simulated Language Acquisition in a Biologically Realistic Model of the Brain
by: Mitropolsky, Daniel, et al.
Published: (2025)
by: Mitropolsky, Daniel, et al.
Published: (2025)
Similar Items
-
Towards Explainable Evolution Strategies with Large Language Models
by: Baumann, Jill, et al.
Published: (2024) -
Evolutionary Computation in the Era of Large Language Model: Survey and Roadmap
by: Wu, Xingyu, et al.
Published: (2024) -
Agent Skill Acquisition for Large Language Models via CycleQD
by: Kuroki, So, et al.
Published: (2024) -
ToxSearch: Evolving Prompts for Toxicity Search in Large Language Models
by: Shelar, Onkar, et al.
Published: (2025) -
Benchmarking GPT-4 on Algorithmic Problems: A Systematic Evaluation of Prompting Strategies
by: Petruzzellis, Flavio, et al.
Published: (2024)