Pgx: Hardware-Accelerated Parallel Game Simulators for Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Koyamada, Sotetsu, Okano, Shinri, Nishimori, Soichiro, Murata, Yu, Habara, Keigo, Kita, Haruka, Ishii, Shin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Mahjax: A GPU-Accelerated Mahjong Simulator for Reinforcement Learning in JAX
di: Nishimori, Soichiro, et al.
Pubblicazione: (2026)
di: Nishimori, Soichiro, et al.
Pubblicazione: (2026)
A Simple, Solid, and Reproducible Baseline for Bridge Bidding AI
di: Kita, Haruka, et al.
Pubblicazione: (2024)
di: Kita, Haruka, et al.
Pubblicazione: (2024)
A Batch Sequential Halving Algorithm without Performance Degradation
di: Koyamada, Sotetsu, et al.
Pubblicazione: (2024)
di: Koyamada, Sotetsu, et al.
Pubblicazione: (2024)
Emergence of Exploration in Policy Gradient Reinforcement Learning via Retrying
di: Nishimori, Soichiro, et al.
Pubblicazione: (2026)
di: Nishimori, Soichiro, et al.
Pubblicazione: (2026)
On Symmetric Losses for Robust Policy Optimization with Noisy Preferences
di: Nishimori, Soichiro, et al.
Pubblicazione: (2025)
di: Nishimori, Soichiro, et al.
Pubblicazione: (2025)
Parallel Reinforcement Learning Simulation for Visual Quadrotor Navigation
di: Saunders, Jack, et al.
Pubblicazione: (2022)
di: Saunders, Jack, et al.
Pubblicazione: (2022)
Generalization Limits of Reinforcement Learning Alignment
di: Shida, Haruhi, et al.
Pubblicazione: (2026)
di: Shida, Haruhi, et al.
Pubblicazione: (2026)
Robust off-policy Reinforcement Learning via Soft Constrained Adversary
di: Nakanishi, Kosuke, et al.
Pubblicazione: (2024)
di: Nakanishi, Kosuke, et al.
Pubblicazione: (2024)
Mitigating Reward Hacking in RLHF via Advantage Sign Robustness
di: Ono, Shinnosuke, et al.
Pubblicazione: (2026)
di: Ono, Shinnosuke, et al.
Pubblicazione: (2026)
Assistax: A Hardware-Accelerated Reinforcement Learning Benchmark for Assistive Robotics
di: Hinckeldey, Leonard, et al.
Pubblicazione: (2025)
di: Hinckeldey, Leonard, et al.
Pubblicazione: (2025)
Accelerating Reinforcement Learning via Error-Related Human Brain Signals
di: Kim, Suzie, et al.
Pubblicazione: (2025)
di: Kim, Suzie, et al.
Pubblicazione: (2025)
Accelerating Reinforcement Learning with Value-Conditional State Entropy Exploration
di: Kim, Dongyoung, et al.
Pubblicazione: (2023)
di: Kim, Dongyoung, et al.
Pubblicazione: (2023)
Think in Games: Learning to Reason in Games via Reinforcement Learning with Large Language Models
di: Liao, Yi, et al.
Pubblicazione: (2025)
di: Liao, Yi, et al.
Pubblicazione: (2025)
JaxWildfire: A GPU-Accelerated Wildfire Simulator for Reinforcement Learning
di: Çakır, Ufuk, et al.
Pubblicazione: (2025)
di: Çakır, Ufuk, et al.
Pubblicazione: (2025)
Embedded Mean Field Reinforcement Learning for Perimeter-defense Game
di: Wang, Li, et al.
Pubblicazione: (2025)
di: Wang, Li, et al.
Pubblicazione: (2025)
Multiagent Reinforcement Learning for Liquidity Games
di: Vidler, Alicia, et al.
Pubblicazione: (2026)
di: Vidler, Alicia, et al.
Pubblicazione: (2026)
Acceleration for Deep Reinforcement Learning using Parallel and Distributed Computing: A Survey
di: Liu, Zhihong, et al.
Pubblicazione: (2024)
di: Liu, Zhihong, et al.
Pubblicazione: (2024)
PgxSAVy
di: Raj Anurag
Pubblicazione: (2023)
di: Raj Anurag
Pubblicazione: (2023)
Game-Theoretic Multiagent Reinforcement Learning
di: Yang, Yaodong, et al.
Pubblicazione: (2020)
di: Yang, Yaodong, et al.
Pubblicazione: (2020)
Meta-operators for Enabling Parallel Planning Using Deep Reinforcement Learning
di: Aso-Mollar, Ángel, et al.
Pubblicazione: (2024)
di: Aso-Mollar, Ángel, et al.
Pubblicazione: (2024)
Comparing Reinforcement Learning and Human Learning using the Game of Hidden Rules
di: Pulick, Eric, et al.
Pubblicazione: (2023)
di: Pulick, Eric, et al.
Pubblicazione: (2023)
Efficient Reinforcement Learning for Zero-Shot Coordination in Evolving Games
di: Hui, Bingyu, et al.
Pubblicazione: (2025)
di: Hui, Bingyu, et al.
Pubblicazione: (2025)
AIRCHITECT v2: Learning the Hardware Accelerator Design Space through Unified Representations
di: Seo, Jamin, et al.
Pubblicazione: (2025)
di: Seo, Jamin, et al.
Pubblicazione: (2025)
Double Horizon Model-Based Policy Optimization
di: Kubo, Akihiro, et al.
Pubblicazione: (2025)
di: Kubo, Akihiro, et al.
Pubblicazione: (2025)
PyTAG: Tabletop Games for Multi-Agent Reinforcement Learning
di: Balla, Martin, et al.
Pubblicazione: (2024)
di: Balla, Martin, et al.
Pubblicazione: (2024)
SPRIG: Stackelberg Perception-Reinforcement Learning with Internal Game Dynamics
di: Martinez-Lopez, Fernando, et al.
Pubblicazione: (2025)
di: Martinez-Lopez, Fernando, et al.
Pubblicazione: (2025)
Playing a Strategy Game with Knowledge-Based Reinforcement Learning
di: Voss, Viktor, et al.
Pubblicazione: (2019)
di: Voss, Viktor, et al.
Pubblicazione: (2019)
Language Agents with Reinforcement Learning for Strategic Play in the Werewolf Game
di: Xu, Zelai, et al.
Pubblicazione: (2023)
di: Xu, Zelai, et al.
Pubblicazione: (2023)
Accelerating Robotic Reinforcement Learning with Agent Guidance
di: Chen, Haojun, et al.
Pubblicazione: (2026)
di: Chen, Haojun, et al.
Pubblicazione: (2026)
Transfer of Reinforcement Learning-Based Controllers from Model- to Hardware-in-the-Loop
di: Picerno, Mario, et al.
Pubblicazione: (2023)
di: Picerno, Mario, et al.
Pubblicazione: (2023)
ParallelSearch: Train your LLMs to Decompose Query and Search Sub-queries in Parallel with Reinforcement Learning
di: Zhao, Shu, et al.
Pubblicazione: (2025)
di: Zhao, Shu, et al.
Pubblicazione: (2025)
Proof2Silicon: Prompt Repair for Verified Code and Hardware Generation via Reinforcement Learning
di: Jha, Manvi, et al.
Pubblicazione: (2025)
di: Jha, Manvi, et al.
Pubblicazione: (2025)
Impartial Games: A Challenge for Reinforcement Learning
di: Zhou, Bei, et al.
Pubblicazione: (2022)
di: Zhou, Bei, et al.
Pubblicazione: (2022)
Hardware Acceleration of LLMs: A comprehensive survey and comparison
di: Koilia, Nikoletta, et al.
Pubblicazione: (2024)
di: Koilia, Nikoletta, et al.
Pubblicazione: (2024)
SCOPE-RL: A Python Library for Offline Reinforcement Learning and Off-Policy Evaluation
di: Kiyohara, Haruka, et al.
Pubblicazione: (2023)
di: Kiyohara, Haruka, et al.
Pubblicazione: (2023)
Highly Parallelized Reinforcement Learning Training with Relaxed Assignment Dependencies
di: He, Zhouyu, et al.
Pubblicazione: (2025)
di: He, Zhouyu, et al.
Pubblicazione: (2025)
Imitation Game: A Model-based and Imitation Learning Deep Reinforcement Learning Hybrid
di: Veith, Eric MSP, et al.
Pubblicazione: (2024)
di: Veith, Eric MSP, et al.
Pubblicazione: (2024)
Human-Inspired Framework to Accelerate Reinforcement Learning
di: Beikmohammadi, Ali, et al.
Pubblicazione: (2023)
di: Beikmohammadi, Ali, et al.
Pubblicazione: (2023)
Finding Kissing Numbers with Game-theoretic Reinforcement Learning
di: Ma, Chengdong, et al.
Pubblicazione: (2025)
di: Ma, Chengdong, et al.
Pubblicazione: (2025)
Bitwidth-Specific Logarithmic Arithmetic for Future Hardware-Accelerated Training
di: Hamad, Hassan, et al.
Pubblicazione: (2025)
di: Hamad, Hassan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Mahjax: A GPU-Accelerated Mahjong Simulator for Reinforcement Learning in JAX
di: Nishimori, Soichiro, et al.
Pubblicazione: (2026) -
A Simple, Solid, and Reproducible Baseline for Bridge Bidding AI
di: Kita, Haruka, et al.
Pubblicazione: (2024) -
A Batch Sequential Halving Algorithm without Performance Degradation
di: Koyamada, Sotetsu, et al.
Pubblicazione: (2024) -
Emergence of Exploration in Policy Gradient Reinforcement Learning via Retrying
di: Nishimori, Soichiro, et al.
Pubblicazione: (2026) -
On Symmetric Losses for Robust Policy Optimization with Noisy Preferences
di: Nishimori, Soichiro, et al.
Pubblicazione: (2025)