Evolutionary Discovery of Reinforcement Learning Algorithms via Large Language Models
Fuente:
arXiv
Saved in:
| Main Authors: | Sygkounas, Alkis, Loutfi, Amy, Persson, Andreas |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Interactive Double Deep Q-network: Integrating Human Interventions and Evaluative Predictions in Reinforcement Learning of Autonomous Driving
by: Sygkounas, Alkis, et al.
Published: (2025)
by: Sygkounas, Alkis, et al.
Published: (2025)
COvolve: Adversarial Co-Evolution of Large-Language-Model-Generated Policies and Environments via Two-Player Zero-Sum Game
by: Sygkounas, Alkis, et al.
Published: (2026)
by: Sygkounas, Alkis, et al.
Published: (2026)
REvolve: Reward Evolution with Large Language Models using Human Feedback
by: Hazra, Rishi, et al.
Published: (2024)
by: Hazra, Rishi, et al.
Published: (2024)
Affective Priming Score: A Data-Driven Method to Detect Priming in Sequential Datasets
by: Maestro, Eduardo Gutierrez, et al.
Published: (2025)
by: Maestro, Eduardo Gutierrez, et al.
Published: (2025)
Hints-In-Browser: Benchmarking Language Models for Programming Feedback Generation
by: Kotalwar, Nachiket, et al.
Published: (2024)
by: Kotalwar, Nachiket, et al.
Published: (2024)
Entropy-Reinforced Planning with Large Language Models for Drug Discovery
by: Liu, Xuefeng, et al.
Published: (2024)
by: Liu, Xuefeng, et al.
Published: (2024)
Reward Generation via Large Vision-Language Model in Offline Reinforcement Learning
by: Lee, Younghwan, et al.
Published: (2025)
by: Lee, Younghwan, et al.
Published: (2025)
Evolutionary System Prompt Learning for Reinforcement Learning in LLMs
by: Zhang, Lunjun, et al.
Published: (2026)
by: Zhang, Lunjun, et al.
Published: (2026)
Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing
by: Toral, Lukas, et al.
Published: (2025)
by: Toral, Lukas, et al.
Published: (2025)
Discovering Reinforcement Learning Interfaces with Large Language Models
by: Jaswal, Akshat Singh, et al.
Published: (2026)
by: Jaswal, Akshat Singh, et al.
Published: (2026)
Reinforcement Learning with Promising Tokens for Large Language Models
by: Pang, Jing-Cheng, et al.
Published: (2026)
by: Pang, Jing-Cheng, et al.
Published: (2026)
On Predictability of Reinforcement Learning Dynamics for Large Language Models
by: Cai, Yuchen, et al.
Published: (2025)
by: Cai, Yuchen, et al.
Published: (2025)
Learning Safety Constraints for Large Language Models
by: Chen, Xin, et al.
Published: (2025)
by: Chen, Xin, et al.
Published: (2025)
Active Slice Discovery in Large Language Models
by: Zhang, Minhui, et al.
Published: (2025)
by: Zhang, Minhui, et al.
Published: (2025)
Zero-Shot Reinforcement Learning via Function Encoders
by: Ingebrand, Tyler, et al.
Published: (2024)
by: Ingebrand, Tyler, et al.
Published: (2024)
Reinforcement Learning via Value Gradient Flow
by: Xu, Haoran, et al.
Published: (2026)
by: Xu, Haoran, et al.
Published: (2026)
Efficient Reinforcement Learning for Large Language Models with Intrinsic Exploration
by: Sun, Yan, et al.
Published: (2025)
by: Sun, Yan, et al.
Published: (2025)
Offline Regularised Reinforcement Learning for Large Language Models Alignment
by: Richemond, Pierre Harvey, et al.
Published: (2024)
by: Richemond, Pierre Harvey, et al.
Published: (2024)
RLAX: Large-Scale, Distributed Reinforcement Learning for Large Language Models on TPUs
by: Zhou, Runlong, et al.
Published: (2025)
by: Zhou, Runlong, et al.
Published: (2025)
Reinforcement Learning-assisted Evolutionary Algorithm: A Survey and Research Opportunities
by: Song, Yanjie, et al.
Published: (2023)
by: Song, Yanjie, et al.
Published: (2023)
Hierarchical Meta-Reinforcement Learning via Automated Macro-Action Discovery
by: Cho, Minjae, et al.
Published: (2024)
by: Cho, Minjae, et al.
Published: (2024)
Offline Reinforcement Learning in Large State Spaces: Algorithms and Guarantees
by: Jiang, Nan, et al.
Published: (2025)
by: Jiang, Nan, et al.
Published: (2025)
Large Language Model-Powered Evolutionary Code Optimization on a Phylogenetic Tree
by: Zhao, Leyi, et al.
Published: (2026)
by: Zhao, Leyi, et al.
Published: (2026)
Dynamic Adversarial Reinforcement Learning for Robust Multimodal Large Language Models
by: Bao, Yicheng, et al.
Published: (2026)
by: Bao, Yicheng, et al.
Published: (2026)
Evolutionary Task Discovery: Advancing Reasoning Frontiers via Skill Composition and Complexity Scaling
by: Ye, Liqin, et al.
Published: (2026)
by: Ye, Liqin, et al.
Published: (2026)
Distributionally Robust Model-based Reinforcement Learning with Large State Spaces
by: Ramesh, Shyam Sundhar, et al.
Published: (2023)
by: Ramesh, Shyam Sundhar, et al.
Published: (2023)
Optimal Learners for Realizable Regression: PAC Learning and Online Learning
by: Attias, Idan, et al.
Published: (2023)
by: Attias, Idan, et al.
Published: (2023)
Automated Attention Pattern Discovery at Scale in Large Language Models
by: Katzy, Jonathan, et al.
Published: (2026)
by: Katzy, Jonathan, et al.
Published: (2026)
Root Cause Attribution of Delivery Risks via Causal Discovery with Reinforcement Learning
by: Xiao, Minheng
Published: (2024)
by: Xiao, Minheng
Published: (2024)
Large Language Models are Effective Priors for Causal Graph Discovery
by: Darvariu, Victor-Alexandru, et al.
Published: (2024)
by: Darvariu, Victor-Alexandru, et al.
Published: (2024)
Are Large-Language Models Graph Algorithmic Reasoners?
by: Taylor, Alexander K, et al.
Published: (2024)
by: Taylor, Alexander K, et al.
Published: (2024)
Internalizing Meta-Experience into Memory for Guided Reinforcement Learning in Large Language Models
by: Huang, Shiting, et al.
Published: (2026)
by: Huang, Shiting, et al.
Published: (2026)
Extracting Heuristics from Large Language Models for Reward Shaping in Reinforcement Learning
by: Bhambri, Siddhant, et al.
Published: (2024)
by: Bhambri, Siddhant, et al.
Published: (2024)
CAMEL: Continuous Action Masking Enabled by Large Language Models for Reinforcement Learning
by: Zhao, Yanxiao, et al.
Published: (2025)
by: Zhao, Yanxiao, et al.
Published: (2025)
Reinforcement Learning Fine-Tunes a Sparse Subnetwork in Large Language Models
by: Balashov, Andrii
Published: (2025)
by: Balashov, Andrii
Published: (2025)
Robust Evolutionary Multi-Objective Network Architecture Search for Reinforcement Learning (EMNAS-RL)
by: Adde, Nihal Acharya, et al.
Published: (2025)
by: Adde, Nihal Acharya, et al.
Published: (2025)
Tree Search in DAG Space with Model-based Reinforcement Learning for Causal Discovery
by: Darvariu, Victor-Alexandru, et al.
Published: (2023)
by: Darvariu, Victor-Alexandru, et al.
Published: (2023)
LacMaterial: Large Language Models as Analogical Chemists for Materials Discovery
by: Guo, Hongyu
Published: (2025)
by: Guo, Hongyu
Published: (2025)
IGDA: Interactive Graph Discovery through Large Language Model Agents
by: Havrilla, Alex, et al.
Published: (2025)
by: Havrilla, Alex, et al.
Published: (2025)
When Large Language Models Meet Evolutionary Algorithms: Potential Enhancements and Challenges
by: Wang, Chao, et al.
Published: (2024)
by: Wang, Chao, et al.
Published: (2024)
Similar Items
-
Interactive Double Deep Q-network: Integrating Human Interventions and Evaluative Predictions in Reinforcement Learning of Autonomous Driving
by: Sygkounas, Alkis, et al.
Published: (2025) -
COvolve: Adversarial Co-Evolution of Large-Language-Model-Generated Policies and Environments via Two-Player Zero-Sum Game
by: Sygkounas, Alkis, et al.
Published: (2026) -
REvolve: Reward Evolution with Large Language Models using Human Feedback
by: Hazra, Rishi, et al.
Published: (2024) -
Affective Priming Score: A Data-Driven Method to Detect Priming in Sequential Datasets
by: Maestro, Eduardo Gutierrez, et al.
Published: (2025) -
Hints-In-Browser: Benchmarking Language Models for Programming Feedback Generation
by: Kotalwar, Nachiket, et al.
Published: (2024)