Pokemon Red via Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Pleines, Marco, Addis, Daniel, Rubinstein, David, Zimmer, Frank, Preuss, Mike, Whidden, Peter |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Memory Gym: Towards Endless Tasks to Benchmark Memory Capabilities of Agents
di: Pleines, Marco, et al.
Pubblicazione: (2023)
di: Pleines, Marco, et al.
Pubblicazione: (2023)
PokeRL: Reinforcement Learning for Pokemon Red
di: Mudireddy, Dheeraj, et al.
Pubblicazione: (2026)
di: Mudireddy, Dheeraj, et al.
Pubblicazione: (2026)
Human-Level Competitive Pokémon via Scalable Offline Reinforcement Learning with Transformers
di: Grigsby, Jake, et al.
Pubblicazione: (2025)
di: Grigsby, Jake, et al.
Pubblicazione: (2025)
In Trust We Survive: Emergent Trust Learning
di: Chen, Qianpu, et al.
Pubblicazione: (2026)
di: Chen, Qianpu, et al.
Pubblicazione: (2026)
Illuminating the Diversity-Fitness Trade-Off in Black-Box Optimization
di: Santoni, Maria Laura, et al.
Pubblicazione: (2024)
di: Santoni, Maria Laura, et al.
Pubblicazione: (2024)
Fox in the Henhouse: Supply-Chain Backdoor Attacks Against Reinforcement Learning
di: Liu, Shijie, et al.
Pubblicazione: (2025)
di: Liu, Shijie, et al.
Pubblicazione: (2025)
Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning
di: Liu, Shijie, et al.
Pubblicazione: (2025)
di: Liu, Shijie, et al.
Pubblicazione: (2025)
Reinforcement Learning in POMDP's via Direct Gradient Ascent
di: Baxter, Jonathan, et al.
Pubblicazione: (2025)
di: Baxter, Jonathan, et al.
Pubblicazione: (2025)
Reinforcement Learning via Self-Distillation
di: Hübotter, Jonas, et al.
Pubblicazione: (2026)
di: Hübotter, Jonas, et al.
Pubblicazione: (2026)
Rescaled Influence Functions: Accurate Data Attribution in High Dimension
di: Rubinstein, Ittai, et al.
Pubblicazione: (2025)
di: Rubinstein, Ittai, et al.
Pubblicazione: (2025)
Interpreting Reinforcement Learning Agents with Susceptibilities
di: Elliott, Chris, et al.
Pubblicazione: (2026)
di: Elliott, Chris, et al.
Pubblicazione: (2026)
Global Safe Sequential Learning via Efficient Knowledge Transfer
di: Li, Cen-You, et al.
Pubblicazione: (2024)
di: Li, Cen-You, et al.
Pubblicazione: (2024)
VGC-Bench: Towards Mastering Diverse Team Strategies in Competitive Pokémon
di: Angliss, Cameron, et al.
Pubblicazione: (2025)
di: Angliss, Cameron, et al.
Pubblicazione: (2025)
Safe Active Learning for Gaussian Differential Equations
di: Glass, Leon, et al.
Pubblicazione: (2024)
di: Glass, Leon, et al.
Pubblicazione: (2024)
Adaptive Gain Scheduling using Reinforcement Learning for Quadcopter Control
di: Timmerman, Mike, et al.
Pubblicazione: (2024)
di: Timmerman, Mike, et al.
Pubblicazione: (2024)
Autonomous Assessment of Demonstration Sufficiency via Bayesian Inverse Reinforcement Learning
di: Trinh, Tu, et al.
Pubblicazione: (2022)
di: Trinh, Tu, et al.
Pubblicazione: (2022)
Leveraging Reinforcement Learning in Red Teaming for Advanced Ransomware Attack Simulations
di: Wang, Cheng, et al.
Pubblicazione: (2024)
di: Wang, Cheng, et al.
Pubblicazione: (2024)
The Pokémon Theorem and other Fairness Impossibility Results
di: Smola, Daniel Matsui, et al.
Pubblicazione: (2026)
di: Smola, Daniel Matsui, et al.
Pubblicazione: (2026)
Extracting Dynamical Models from Data
di: Zimmer, Michael F.
Pubblicazione: (2021)
di: Zimmer, Michael F.
Pubblicazione: (2021)
Comment on "Machine learning conservation laws from differential equations"
di: Zimmer, Michael F.
Pubblicazione: (2024)
di: Zimmer, Michael F.
Pubblicazione: (2024)
RedRFT: A Light-Weight Benchmark for Reinforcement Fine-Tuning-Based Red Teaming
di: Zheng, Xiang, et al.
Pubblicazione: (2025)
di: Zheng, Xiang, et al.
Pubblicazione: (2025)
Red-Team Multi-Agent Reinforcement Learning for Emergency Braking Scenario
di: Chen, Yinsong, et al.
Pubblicazione: (2025)
di: Chen, Yinsong, et al.
Pubblicazione: (2025)
PISmith: Reinforcement Learning-based Red Teaming for Prompt Injection Defenses
di: Yin, Chenlong, et al.
Pubblicazione: (2026)
di: Yin, Chenlong, et al.
Pubblicazione: (2026)
Stagewise Reinforcement Learning and the Geometry of the Regret Landscape
di: Elliott, Chris, et al.
Pubblicazione: (2026)
di: Elliott, Chris, et al.
Pubblicazione: (2026)
Safe Active Learning for Time-Series Modeling with Gaussian Processes
di: Zimmer, Christoph, et al.
Pubblicazione: (2024)
di: Zimmer, Christoph, et al.
Pubblicazione: (2024)
Parallel Sampling via Counting
di: Anari, Nima, et al.
Pubblicazione: (2024)
di: Anari, Nima, et al.
Pubblicazione: (2024)
Vulnerability Analysis of Safe Reinforcement Learning via Inverse Constrained Reinforcement Learning
di: Fan, Jialiang, et al.
Pubblicazione: (2026)
di: Fan, Jialiang, et al.
Pubblicazione: (2026)
Discrete Compositional Generation via General Soft Operators and Robust Reinforcement Learning
di: Jiralerspong, Marco, et al.
Pubblicazione: (2025)
di: Jiralerspong, Marco, et al.
Pubblicazione: (2025)
Online Symbolic Music Alignment with Offline Reinforcement Learning
di: Peter, Silvan David
Pubblicazione: (2023)
di: Peter, Silvan David
Pubblicazione: (2023)
Approximating Latent Manifolds in Neural Networks via Vanishing Ideals
di: Pelleriti, Nico, et al.
Pubblicazione: (2025)
di: Pelleriti, Nico, et al.
Pubblicazione: (2025)
AttackGNN: Red-Teaming GNNs in Hardware Security Using Reinforcement Learning
di: Gohil, Vasudev, et al.
Pubblicazione: (2024)
di: Gohil, Vasudev, et al.
Pubblicazione: (2024)
Guaranteeing Control Requirements via Reward Shaping in Reinforcement Learning
di: De Lellis, Francesco, et al.
Pubblicazione: (2023)
di: De Lellis, Francesco, et al.
Pubblicazione: (2023)
Harnessing intuitive local evolution rules for physical learning
di: Ezraty, Roie, et al.
Pubblicazione: (2025)
di: Ezraty, Roie, et al.
Pubblicazione: (2025)
Adaptive Data Analysis for Growing Data
di: Marchant, Neil G., et al.
Pubblicazione: (2024)
di: Marchant, Neil G., et al.
Pubblicazione: (2024)
Approximating Shapley Explanations in Reinforcement Learning
di: Beechey, Daniel, et al.
Pubblicazione: (2025)
di: Beechey, Daniel, et al.
Pubblicazione: (2025)
Lifelong Reinforcement Learning via Neuromodulation
di: Lee, Sebastian, et al.
Pubblicazione: (2024)
di: Lee, Sebastian, et al.
Pubblicazione: (2024)
Fast Value Tracking for Deep Reinforcement Learning
di: Shih, Frank, et al.
Pubblicazione: (2024)
di: Shih, Frank, et al.
Pubblicazione: (2024)
Heterogeneous RBCs via Deep Multi-Agent Reinforcement Learning
di: Gabriele, Federico, et al.
Pubblicazione: (2025)
di: Gabriele, Federico, et al.
Pubblicazione: (2025)
Robo-taxi Fleet Coordination at Scale via Reinforcement Learning
di: Tresca, Luigi, et al.
Pubblicazione: (2025)
di: Tresca, Luigi, et al.
Pubblicazione: (2025)
Directed Exploration in Reinforcement Learning from Linear Temporal Logic
di: Bagatella, Marco, et al.
Pubblicazione: (2024)
di: Bagatella, Marco, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Memory Gym: Towards Endless Tasks to Benchmark Memory Capabilities of Agents
di: Pleines, Marco, et al.
Pubblicazione: (2023) -
PokeRL: Reinforcement Learning for Pokemon Red
di: Mudireddy, Dheeraj, et al.
Pubblicazione: (2026) -
Human-Level Competitive Pokémon via Scalable Offline Reinforcement Learning with Transformers
di: Grigsby, Jake, et al.
Pubblicazione: (2025) -
In Trust We Survive: Emergent Trust Learning
di: Chen, Qianpu, et al.
Pubblicazione: (2026) -
Illuminating the Diversity-Fitness Trade-Off in Black-Box Optimization
di: Santoni, Maria Laura, et al.
Pubblicazione: (2024)