EduGym: An Environment and Notebook Suite for Reinforcement Learning Education
Fuente:
arXiv
Guardado en:
| Autores principales: | Moerland, Thomas M., Müller-Brockhausen, Matthias, Yang, Zhao, Bernatavicius, Andrius, Ponse, Koen, Kouwenhoven, Tom, Sauter, Andreas, van der Meer, Michiel, Renting, Bram, Plaat, Aske |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Chargax: A JAX Accelerated EV Charging Simulator
por: Ponse, Koen, et al.
Publicado: (2025)
por: Ponse, Koen, et al.
Publicado: (2025)
EconoJax: A Fast & Scalable Economic Simulation in Jax
por: Ponse, Koen, et al.
Publicado: (2024)
por: Ponse, Koen, et al.
Publicado: (2024)
Reinforcement Learning for Sustainable Energy: A Survey
por: Ponse, Koen, et al.
Publicado: (2024)
por: Ponse, Koen, et al.
Publicado: (2024)
On the Effect of Regularization in Policy Mirror Descent
por: Kleuker, Jan Felix, et al.
Publicado: (2025)
por: Kleuker, Jan Felix, et al.
Publicado: (2025)
Towards a Practical Understanding of Lagrangian Methods in Safe Reinforcement Learning
por: Spoor, Lindsay, et al.
Publicado: (2025)
por: Spoor, Lindsay, et al.
Publicado: (2025)
A Unified Framework for Zero-Shot Reinforcement Learning
por: Di Ventura, Jacopo, et al.
Publicado: (2025)
por: Di Ventura, Jacopo, et al.
Publicado: (2025)
Reset-free Reinforcement Learning with World Models
por: Yang, Zhao, et al.
Publicado: (2024)
por: Yang, Zhao, et al.
Publicado: (2024)
Research Re: search & Re-search
por: Plaat, Aske
Publicado: (2024)
por: Plaat, Aske
Publicado: (2024)
Slot Structured World Models
por: Collu, Jonathan, et al.
Publicado: (2024)
por: Collu, Jonathan, et al.
Publicado: (2024)
Explicitly Disentangled Representations in Object-Centric Learning
por: Majellaro, Riccardo, et al.
Publicado: (2024)
por: Majellaro, Riccardo, et al.
Publicado: (2024)
Traces of Social Competence in Large Language Models
por: Kouwenhoven, Tom, et al.
Publicado: (2026)
por: Kouwenhoven, Tom, et al.
Publicado: (2026)
CORE: Towards Scalable and Efficient Causal Discovery with Reinforcement Learning
por: Sauter, Andreas W. M., et al.
Publicado: (2024)
por: Sauter, Andreas W. M., et al.
Publicado: (2024)
Towards General Negotiation Strategies with End-to-End Reinforcement Learning
por: Renting, Bram M., et al.
Publicado: (2024)
por: Renting, Bram M., et al.
Publicado: (2024)
CausalPlayground: Addressing Data-Generation Requirements in Cutting-Edge Causality Research
por: Sauter, Andreas W M, et al.
Publicado: (2024)
por: Sauter, Andreas W M, et al.
Publicado: (2024)
ACTIVA: Amortized Causal Effect Estimation via Transformer-based Variational Autoencoder
por: Sauter, Andreas, et al.
Publicado: (2025)
por: Sauter, Andreas, et al.
Publicado: (2025)
MycoAI: Fast and accurate taxonomic classification for fungal ITS sequences
por: Luuk Romeijn, et al.
Publicado: (2024)
por: Luuk Romeijn, et al.
Publicado: (2024)
Mirror Mode in Fire Emblem: Beating Players at their own Game with Imitation and Reinforcement Learning
por: Smid, Yanna Elizabeth, et al.
Publicado: (2025)
por: Smid, Yanna Elizabeth, et al.
Publicado: (2025)
A Hybrid Intelligence Method for Argument Mining
por: van der Meer, Michiel, et al.
Publicado: (2024)
por: van der Meer, Michiel, et al.
Publicado: (2024)
Guiding Skill Discovery with Foundation Models
por: Yang, Zhao, et al.
Publicado: (2025)
por: Yang, Zhao, et al.
Publicado: (2025)
CoComposer: LLM Multi-agent Collaborative Music Composition
por: Xing, Peiwen, et al.
Publicado: (2025)
por: Xing, Peiwen, et al.
Publicado: (2025)
Analysis of Bluffing by DQN and CFR in Leduc Hold'em Poker
por: Zaciragic, Tarik, et al.
Publicado: (2025)
por: Zaciragic, Tarik, et al.
Publicado: (2025)
How does Chain of Thought Think? Mechanistic Interpretability of Chain-of-Thought Reasoning with Sparse Autoencoding
por: Chen, Xi, et al.
Publicado: (2025)
por: Chen, Xi, et al.
Publicado: (2025)
Facilitating Opinion Diversity through Hybrid NLP Approaches
por: van der Meer, Michiel
Publicado: (2024)
por: van der Meer, Michiel
Publicado: (2024)
Baba is LLM: Reasoning in a Game with Dynamic Rules
por: van Wetten, Fien, et al.
Publicado: (2025)
por: van Wetten, Fien, et al.
Publicado: (2025)
Solving Deep Reinforcement Learning Tasks with Evolution Strategies and Linear Policy Networks
por: Wong, Annie, et al.
Publicado: (2024)
por: Wong, Annie, et al.
Publicado: (2024)
LLM-enhanced Interactions in Human-Robot Collaborative Drawing with Older Adults
por: Bossema, Marianne, et al.
Publicado: (2025)
por: Bossema, Marianne, et al.
Publicado: (2025)
Pluri-perspectivism in Human-robot Co-creativity with Older Adults
por: Bossema, Marianne, et al.
Publicado: (2025)
por: Bossema, Marianne, et al.
Publicado: (2025)
The Curious Case of Representational Alignment: Unravelling Visio-Linguistic Tasks in Emergent Communication
por: Kouwenhoven, Tom, et al.
Publicado: (2024)
por: Kouwenhoven, Tom, et al.
Publicado: (2024)
Gym4ReaL: A Suite for Benchmarking Real-World Reinforcement Learning
por: Salaorni, Davide, et al.
Publicado: (2025)
por: Salaorni, Davide, et al.
Publicado: (2025)
A Benchmark Study of Deep Reinforcement Learning Algorithms for the Container Stowage Planning Problem
por: Huang, Yunqi, et al.
Publicado: (2025)
por: Huang, Yunqi, et al.
Publicado: (2025)
SafeOR-Gym: A Benchmark Suite for Safe Reinforcement Learning Algorithms on Practical Operations Research Problems
por: Ramanujam, Asha, et al.
Publicado: (2025)
por: Ramanujam, Asha, et al.
Publicado: (2025)
Reinforcement learning for Quantum Tiq-Taq-Toe
por: Dinu, Catalin-Viorel, et al.
Publicado: (2024)
por: Dinu, Catalin-Viorel, et al.
Publicado: (2024)
AnalogGym: An Open and Practical Testing Suite for Analog Circuit Synthesis
por: Li, Jintao, et al.
Publicado: (2024)
por: Li, Jintao, et al.
Publicado: (2024)
Assessing Reproducibility in Evolutionary Computation: A Case Study using Human- and LLM-based Assessment
por: Da Ros, Francesca, et al.
Publicado: (2026)
por: Da Ros, Francesca, et al.
Publicado: (2026)
Reasoning Capabilities of Large Language Models on Dynamic Tasks
por: Wong, Annie, et al.
Publicado: (2025)
por: Wong, Annie, et al.
Publicado: (2025)
State Design Matters: How Representations Shape Dynamic Reasoning in Large Language Models
por: Wong, Annie, et al.
Publicado: (2026)
por: Wong, Annie, et al.
Publicado: (2026)
Spinorial Superspaces and Super Yang-Mills Theories
por: Moerland, Johannes
Publicado: (2024)
por: Moerland, Johannes
Publicado: (2024)
PeersimGym: An Environment for Solving the Task Offloading Problem with Reinforcement Learning
por: Metelo, Frederico, et al.
Publicado: (2024)
por: Metelo, Frederico, et al.
Publicado: (2024)
HistoGym: A Reinforcement Learning Environment for Histopathological Image Analysis
por: Liu, Zhi-Bo, et al.
Publicado: (2024)
por: Liu, Zhi-Bo, et al.
Publicado: (2024)
Quantum Checkers: The Development and Analysis of a Quantum Combinatorial Game
por: Raat, Marien, et al.
Publicado: (2025)
por: Raat, Marien, et al.
Publicado: (2025)
Ejemplares similares
-
Chargax: A JAX Accelerated EV Charging Simulator
por: Ponse, Koen, et al.
Publicado: (2025) -
EconoJax: A Fast & Scalable Economic Simulation in Jax
por: Ponse, Koen, et al.
Publicado: (2024) -
Reinforcement Learning for Sustainable Energy: A Survey
por: Ponse, Koen, et al.
Publicado: (2024) -
On the Effect of Regularization in Policy Mirror Descent
por: Kleuker, Jan Felix, et al.
Publicado: (2025) -
Towards a Practical Understanding of Lagrangian Methods in Safe Reinforcement Learning
por: Spoor, Lindsay, et al.
Publicado: (2025)