Reasoning Capabilities of Large Language Models on Dynamic Tasks
Fuente:
arXiv
Saved in:
| Main Authors: | Wong, Annie, Bäck, Thomas, Plaat, Aske, van Stein, Niki, Kononova, Anna V. |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
State Design Matters: How Representations Shape Dynamic Reasoning in Large Language Models
by: Wong, Annie, et al.
Published: (2026)
by: Wong, Annie, et al.
Published: (2026)
Multi-Step Reasoning with Large Language Models, a Survey
by: Plaat, Aske, et al.
Published: (2024)
by: Plaat, Aske, et al.
Published: (2024)
How does Chain of Thought Think? Mechanistic Interpretability of Chain-of-Thought Reasoning with Sparse Autoencoding
by: Chen, Xi, et al.
Published: (2025)
by: Chen, Xi, et al.
Published: (2025)
Solving Deep Reinforcement Learning Tasks with Evolution Strategies and Linear Policy Networks
by: Wong, Annie, et al.
Published: (2024)
by: Wong, Annie, et al.
Published: (2024)
Agentic Large Language Models, a survey
by: Plaat, Aske, et al.
Published: (2025)
by: Plaat, Aske, et al.
Published: (2025)
Code Evolution Graphs: Understanding Large Language Model Driven Design of Algorithms
by: van Stein, Niki, et al.
Published: (2025)
by: van Stein, Niki, et al.
Published: (2025)
From Performance to Understanding: A Vision for Explainable Automated Algorithm Design
by: van Stein, Niki, et al.
Published: (2025)
by: van Stein, Niki, et al.
Published: (2025)
Assessing Reproducibility in Evolutionary Computation: A Case Study using Human- and LLM-based Assessment
by: Da Ros, Francesca, et al.
Published: (2026)
by: Da Ros, Francesca, et al.
Published: (2026)
Explainable Benchmarking for Iterative Optimization Heuristics
by: van Stein, Niki, et al.
Published: (2024)
by: van Stein, Niki, et al.
Published: (2024)
LLaMEA: A Large Language Model Evolutionary Algorithm for Automatically Generating Metaheuristics
by: van Stein, Niki, et al.
Published: (2024)
by: van Stein, Niki, et al.
Published: (2024)
BLADE: Benchmark suite for LLM-driven Automated Design and Evolution of iterative optimisation heuristics
by: van Stein, Niki, et al.
Published: (2025)
by: van Stein, Niki, et al.
Published: (2025)
LLaMEA-SAGE: Guiding Automated Algorithm Design with Structural Feedback from Explainable AI
by: van Stein, Niki, et al.
Published: (2026)
by: van Stein, Niki, et al.
Published: (2026)
CoComposer: LLM Multi-agent Collaborative Music Composition
by: Xing, Peiwen, et al.
Published: (2025)
by: Xing, Peiwen, et al.
Published: (2025)
Behaviour Space Analysis of LLM-driven Meta-heuristic Discovery
by: van Stein, Niki, et al.
Published: (2025)
by: van Stein, Niki, et al.
Published: (2025)
A Functional Analysis Approach to Symbolic Regression
by: Antonov, Kirill, et al.
Published: (2024)
by: Antonov, Kirill, et al.
Published: (2024)
Research Re: search & Re-search
by: Plaat, Aske
Published: (2024)
by: Plaat, Aske
Published: (2024)
Baba is LLM: Reasoning in a Game with Dynamic Rules
by: van Wetten, Fien, et al.
Published: (2025)
by: van Wetten, Fien, et al.
Published: (2025)
Controlling the Mutation in Large Language Models for the Efficient Evolution of Algorithms
by: Yin, Haoran, et al.
Published: (2024)
by: Yin, Haoran, et al.
Published: (2024)
Optimizing Photonic Structures with Large Language Model Driven Algorithm Discovery
by: Yin, Haoran, et al.
Published: (2025)
by: Yin, Haoran, et al.
Published: (2025)
A Deep Dive into Effects of Structural Bias on CMA-ES Performance along Affine Trajectories
by: van Stein, Niki, et al.
Published: (2024)
by: van Stein, Niki, et al.
Published: (2024)
Evaluating Consistency and Reasoning Capabilities of Large Language Models
by: Saxena, Yash, et al.
Published: (2024)
by: Saxena, Yash, et al.
Published: (2024)
Reasoning or Reciting? Exploring the Capabilities and Limitations of Language Models Through Counterfactual Tasks
by: Wu, Zhaofeng, et al.
Published: (2023)
by: Wu, Zhaofeng, et al.
Published: (2023)
Unlocking Reasoning Capability on Machine Translation in Large Language Models
by: Rajaee, Sara, et al.
Published: (2026)
by: Rajaee, Sara, et al.
Published: (2026)
A Hybrid Intelligence Method for Argument Mining
by: van der Meer, Michiel, et al.
Published: (2024)
by: van der Meer, Michiel, et al.
Published: (2024)
Cooperative Strategic Planning Enhances Reasoning Capabilities in Large Language Models
by: Wang, Danqing, et al.
Published: (2024)
by: Wang, Danqing, et al.
Published: (2024)
Can Large Language Models Create New Knowledge for Spatial Reasoning Tasks?
by: Greatrix, Thomas, et al.
Published: (2024)
by: Greatrix, Thomas, et al.
Published: (2024)
In-the-loop Hyper-Parameter Optimization for LLM-Based Automated Design of Heuristics
by: van Stein, Niki, et al.
Published: (2024)
by: van Stein, Niki, et al.
Published: (2024)
GraphInstruct: Empowering Large Language Models with Graph Understanding and Reasoning Capability
by: Luo, Zihan, et al.
Published: (2024)
by: Luo, Zihan, et al.
Published: (2024)
Harmonic Reasoning in Large Language Models
by: Kruspe, Anna
Published: (2024)
by: Kruspe, Anna
Published: (2024)
Dynamic Benchmarking of Reasoning Capabilities in Code Large Language Models Under Data Contamination
by: Chen, Simin, et al.
Published: (2025)
by: Chen, Simin, et al.
Published: (2025)
Moral Persuasion in Large Language Models: Evaluating Susceptibility and Ethical Alignment
by: Huang, Allison, et al.
Published: (2024)
by: Huang, Allison, et al.
Published: (2024)
DyVal: Dynamic Evaluation of Large Language Models for Reasoning Tasks
by: Zhu, Kaijie, et al.
Published: (2023)
by: Zhu, Kaijie, et al.
Published: (2023)
Eliciting Causal Abilities in Large Language Models for Reasoning Tasks
by: Wang, Yajing, et al.
Published: (2024)
by: Wang, Yajing, et al.
Published: (2024)
Harnessing the Reasoning Economy: A Survey of Efficient Reasoning for Large Language Models
by: Wang, Rui, et al.
Published: (2025)
by: Wang, Rui, et al.
Published: (2025)
PDDL-Mind: Large Language Models are Capable on Belief Reasoning with Reliable State Tracking
by: Zhu, Wang Bill, et al.
Published: (2026)
by: Zhu, Wang Bill, et al.
Published: (2026)
Survey on Reasoning Capabilities and Accessibility of Large Language Models Using Biology-related Questions
by: Ackerman, Michael
Published: (2024)
by: Ackerman, Michael
Published: (2024)
Lost in the Logic: An Evaluation of Large Language Models' Reasoning Capabilities on LSAT Logic Games
by: Malik, Saumya
Published: (2024)
by: Malik, Saumya
Published: (2024)
Distilling Mathematical Reasoning Capabilities into Small Language Models
by: Zhu, Xunyu, et al.
Published: (2024)
by: Zhu, Xunyu, et al.
Published: (2024)
Evaluating Interventional Reasoning Capabilities of Large Language Models
by: Kasetty, Tejas, et al.
Published: (2024)
by: Kasetty, Tejas, et al.
Published: (2024)
CityBench: Evaluating the Capabilities of Large Language Models for Urban Tasks
by: Feng, Jie, et al.
Published: (2024)
by: Feng, Jie, et al.
Published: (2024)
Similar Items
-
State Design Matters: How Representations Shape Dynamic Reasoning in Large Language Models
by: Wong, Annie, et al.
Published: (2026) -
Multi-Step Reasoning with Large Language Models, a Survey
by: Plaat, Aske, et al.
Published: (2024) -
How does Chain of Thought Think? Mechanistic Interpretability of Chain-of-Thought Reasoning with Sparse Autoencoding
by: Chen, Xi, et al.
Published: (2025) -
Solving Deep Reinforcement Learning Tasks with Evolution Strategies and Linear Policy Networks
by: Wong, Annie, et al.
Published: (2024) -
Agentic Large Language Models, a survey
by: Plaat, Aske, et al.
Published: (2025)