Salvato in:
| Autori principali: | Moerland, Thomas M., Müller-Brockhausen, Matthias, Yang, Zhao, Bernatavicius, Andrius, Ponse, Koen, Kouwenhoven, Tom, Sauter, Andreas, van der Meer, Michiel, Renting, Bram, Plaat, Aske |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2311.10590 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Chargax: A JAX Accelerated EV Charging Simulator
di: Ponse, Koen, et al.
Pubblicazione: (2025)
di: Ponse, Koen, et al.
Pubblicazione: (2025)
EconoJax: A Fast & Scalable Economic Simulation in Jax
di: Ponse, Koen, et al.
Pubblicazione: (2024)
di: Ponse, Koen, et al.
Pubblicazione: (2024)
Reinforcement Learning for Sustainable Energy: A Survey
di: Ponse, Koen, et al.
Pubblicazione: (2024)
di: Ponse, Koen, et al.
Pubblicazione: (2024)
On the Effect of Regularization in Policy Mirror Descent
di: Kleuker, Jan Felix, et al.
Pubblicazione: (2025)
di: Kleuker, Jan Felix, et al.
Pubblicazione: (2025)
Towards a Practical Understanding of Lagrangian Methods in Safe Reinforcement Learning
di: Spoor, Lindsay, et al.
Pubblicazione: (2025)
di: Spoor, Lindsay, et al.
Pubblicazione: (2025)
A Unified Framework for Zero-Shot Reinforcement Learning
di: Di Ventura, Jacopo, et al.
Pubblicazione: (2025)
di: Di Ventura, Jacopo, et al.
Pubblicazione: (2025)
Reset-free Reinforcement Learning with World Models
di: Yang, Zhao, et al.
Pubblicazione: (2024)
di: Yang, Zhao, et al.
Pubblicazione: (2024)
Slot Structured World Models
di: Collu, Jonathan, et al.
Pubblicazione: (2024)
di: Collu, Jonathan, et al.
Pubblicazione: (2024)
Explicitly Disentangled Representations in Object-Centric Learning
di: Majellaro, Riccardo, et al.
Pubblicazione: (2024)
di: Majellaro, Riccardo, et al.
Pubblicazione: (2024)
Research Re: search & Re-search
di: Plaat, Aske
Pubblicazione: (2024)
di: Plaat, Aske
Pubblicazione: (2024)
Traces of Social Competence in Large Language Models
di: Kouwenhoven, Tom, et al.
Pubblicazione: (2026)
di: Kouwenhoven, Tom, et al.
Pubblicazione: (2026)
CORE: Towards Scalable and Efficient Causal Discovery with Reinforcement Learning
di: Sauter, Andreas W. M., et al.
Pubblicazione: (2024)
di: Sauter, Andreas W. M., et al.
Pubblicazione: (2024)
Towards General Negotiation Strategies with End-to-End Reinforcement Learning
di: Renting, Bram M., et al.
Pubblicazione: (2024)
di: Renting, Bram M., et al.
Pubblicazione: (2024)
CausalPlayground: Addressing Data-Generation Requirements in Cutting-Edge Causality Research
di: Sauter, Andreas W M, et al.
Pubblicazione: (2024)
di: Sauter, Andreas W M, et al.
Pubblicazione: (2024)
ACTIVA: Amortized Causal Effect Estimation via Transformer-based Variational Autoencoder
di: Sauter, Andreas, et al.
Pubblicazione: (2025)
di: Sauter, Andreas, et al.
Pubblicazione: (2025)
MycoAI: Fast and accurate taxonomic classification for fungal ITS sequences
di: Luuk Romeijn, et al.
Pubblicazione: (2024)
di: Luuk Romeijn, et al.
Pubblicazione: (2024)
A Hybrid Intelligence Method for Argument Mining
di: van der Meer, Michiel, et al.
Pubblicazione: (2024)
di: van der Meer, Michiel, et al.
Pubblicazione: (2024)
Mirror Mode in Fire Emblem: Beating Players at their own Game with Imitation and Reinforcement Learning
di: Smid, Yanna Elizabeth, et al.
Pubblicazione: (2025)
di: Smid, Yanna Elizabeth, et al.
Pubblicazione: (2025)
Guiding Skill Discovery with Foundation Models
di: Yang, Zhao, et al.
Pubblicazione: (2025)
di: Yang, Zhao, et al.
Pubblicazione: (2025)
CoComposer: LLM Multi-agent Collaborative Music Composition
di: Xing, Peiwen, et al.
Pubblicazione: (2025)
di: Xing, Peiwen, et al.
Pubblicazione: (2025)
Analysis of Bluffing by DQN and CFR in Leduc Hold'em Poker
di: Zaciragic, Tarik, et al.
Pubblicazione: (2025)
di: Zaciragic, Tarik, et al.
Pubblicazione: (2025)
How does Chain of Thought Think? Mechanistic Interpretability of Chain-of-Thought Reasoning with Sparse Autoencoding
di: Chen, Xi, et al.
Pubblicazione: (2025)
di: Chen, Xi, et al.
Pubblicazione: (2025)
Baba is LLM: Reasoning in a Game with Dynamic Rules
di: van Wetten, Fien, et al.
Pubblicazione: (2025)
di: van Wetten, Fien, et al.
Pubblicazione: (2025)
Solving Deep Reinforcement Learning Tasks with Evolution Strategies and Linear Policy Networks
di: Wong, Annie, et al.
Pubblicazione: (2024)
di: Wong, Annie, et al.
Pubblicazione: (2024)
Facilitating Opinion Diversity through Hybrid NLP Approaches
di: van der Meer, Michiel
Pubblicazione: (2024)
di: van der Meer, Michiel
Pubblicazione: (2024)
LLM-enhanced Interactions in Human-Robot Collaborative Drawing with Older Adults
di: Bossema, Marianne, et al.
Pubblicazione: (2025)
di: Bossema, Marianne, et al.
Pubblicazione: (2025)
Pluri-perspectivism in Human-robot Co-creativity with Older Adults
di: Bossema, Marianne, et al.
Pubblicazione: (2025)
di: Bossema, Marianne, et al.
Pubblicazione: (2025)
The Curious Case of Representational Alignment: Unravelling Visio-Linguistic Tasks in Emergent Communication
di: Kouwenhoven, Tom, et al.
Pubblicazione: (2024)
di: Kouwenhoven, Tom, et al.
Pubblicazione: (2024)
A Benchmark Study of Deep Reinforcement Learning Algorithms for the Container Stowage Planning Problem
di: Huang, Yunqi, et al.
Pubblicazione: (2025)
di: Huang, Yunqi, et al.
Pubblicazione: (2025)
Gym4ReaL: A Suite for Benchmarking Real-World Reinforcement Learning
di: Salaorni, Davide, et al.
Pubblicazione: (2025)
di: Salaorni, Davide, et al.
Pubblicazione: (2025)
Assessing Reproducibility in Evolutionary Computation: A Case Study using Human- and LLM-based Assessment
di: Da Ros, Francesca, et al.
Pubblicazione: (2026)
di: Da Ros, Francesca, et al.
Pubblicazione: (2026)
Reasoning Capabilities of Large Language Models on Dynamic Tasks
di: Wong, Annie, et al.
Pubblicazione: (2025)
di: Wong, Annie, et al.
Pubblicazione: (2025)
State Design Matters: How Representations Shape Dynamic Reasoning in Large Language Models
di: Wong, Annie, et al.
Pubblicazione: (2026)
di: Wong, Annie, et al.
Pubblicazione: (2026)
Reinforcement learning for Quantum Tiq-Taq-Toe
di: Dinu, Catalin-Viorel, et al.
Pubblicazione: (2024)
di: Dinu, Catalin-Viorel, et al.
Pubblicazione: (2024)
Agentic Large Language Models, a survey
di: Plaat, Aske, et al.
Pubblicazione: (2025)
di: Plaat, Aske, et al.
Pubblicazione: (2025)
Quantum Checkers: The Development and Analysis of a Quantum Combinatorial Game
di: Raat, Marien, et al.
Pubblicazione: (2025)
di: Raat, Marien, et al.
Pubblicazione: (2025)
Multi-Step Reasoning with Large Language Models, a Survey
di: Plaat, Aske, et al.
Pubblicazione: (2024)
di: Plaat, Aske, et al.
Pubblicazione: (2024)
SafeOR-Gym: A Benchmark Suite for Safe Reinforcement Learning Algorithms on Practical Operations Research Problems
di: Ramanujam, Asha, et al.
Pubblicazione: (2025)
di: Ramanujam, Asha, et al.
Pubblicazione: (2025)
Spinorial Superspaces and Super Yang-Mills Theories
di: Moerland, Johannes
Pubblicazione: (2024)
di: Moerland, Johannes
Pubblicazione: (2024)
AnalogGym: An Open and Practical Testing Suite for Analog Circuit Synthesis
di: Li, Jintao, et al.
Pubblicazione: (2024)
di: Li, Jintao, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Chargax: A JAX Accelerated EV Charging Simulator
di: Ponse, Koen, et al.
Pubblicazione: (2025) -
EconoJax: A Fast & Scalable Economic Simulation in Jax
di: Ponse, Koen, et al.
Pubblicazione: (2024) -
Reinforcement Learning for Sustainable Energy: A Survey
di: Ponse, Koen, et al.
Pubblicazione: (2024) -
On the Effect of Regularization in Policy Mirror Descent
di: Kleuker, Jan Felix, et al.
Pubblicazione: (2025) -
Towards a Practical Understanding of Lagrangian Methods in Safe Reinforcement Learning
di: Spoor, Lindsay, et al.
Pubblicazione: (2025)