Fly, Fail, Fix: Iterative Game Repair with Reinforcement Learning and Large Multimodal Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Zook, Alex, Spjut, Josef, Tremblay, Jonathan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
GRS: Generating Robotic Simulation Tasks from Real-World Images
por: Zook, Alex, et al.
Publicado: (2024)
por: Zook, Alex, et al.
Publicado: (2024)
Dynamic Adversarial Reinforcement Learning for Robust Multimodal Large Language Models
por: Bao, Yicheng, et al.
Publicado: (2026)
por: Bao, Yicheng, et al.
Publicado: (2026)
FlakyFix: Using Large Language Models for Predicting Flaky Test Fix Categories and Test Code Repair
por: Fatima, Sakina, et al.
Publicado: (2023)
por: Fatima, Sakina, et al.
Publicado: (2023)
Combining Reinforcement Learning and Behavior Trees for NPCs in Video Games with AMD Schola
por: Liu, Tian, et al.
Publicado: (2025)
por: Liu, Tian, et al.
Publicado: (2025)
Learning to play: A Multimodal Agent for 3D Game-Play
por: Yue, Yuguang, et al.
Publicado: (2025)
por: Yue, Yuguang, et al.
Publicado: (2025)
ReasonIF: Large Reasoning Models Fail to Follow Instructions During Reasoning
por: Kwon, Yongchan, et al.
Publicado: (2025)
por: Kwon, Yongchan, et al.
Publicado: (2025)
Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search
por: Najib, Amna, et al.
Publicado: (2024)
por: Najib, Amna, et al.
Publicado: (2024)
CARE What Fails: Contrastive Anchored-REflection for Verifiable Multimodal Reasoning
por: Wang, Yongxin, et al.
Publicado: (2025)
por: Wang, Yongxin, et al.
Publicado: (2025)
Impartial Games: A Challenge for Reinforcement Learning
por: Zhou, Bei, et al.
Publicado: (2022)
por: Zhou, Bei, et al.
Publicado: (2022)
Offline Regularised Reinforcement Learning for Large Language Models Alignment
por: Richemond, Pierre Harvey, et al.
Publicado: (2024)
por: Richemond, Pierre Harvey, et al.
Publicado: (2024)
Guided Game Level Repair via Explainable AI
por: Bazzaz, Mahsa, et al.
Publicado: (2024)
por: Bazzaz, Mahsa, et al.
Publicado: (2024)
Iterative Refinement Neural Operators are Learned Fixed-Point Solvers: A Principled Approach to Spectral Bias Mitigation
por: Liu, Xiaotian, et al.
Publicado: (2026)
por: Liu, Xiaotian, et al.
Publicado: (2026)
Rethinking Multimodality: Optimizing Multimodal Deep Learning for Biomedical Signal Classification
por: Oladunni, Timothy, et al.
Publicado: (2025)
por: Oladunni, Timothy, et al.
Publicado: (2025)
The Art of Repair: Optimizing Iterative Program Repair with Instruction-Tuned Models
por: Ruiz, Fernando Vallecillos, et al.
Publicado: (2025)
por: Ruiz, Fernando Vallecillos, et al.
Publicado: (2025)
Hyperbolic Learning with Multimodal Large Language Models
por: Mandica, Paolo, et al.
Publicado: (2024)
por: Mandica, Paolo, et al.
Publicado: (2024)
RLAX: Large-Scale, Distributed Reinforcement Learning for Large Language Models on TPUs
por: Zhou, Runlong, et al.
Publicado: (2025)
por: Zhou, Runlong, et al.
Publicado: (2025)
Finding Kissing Numbers with Game-theoretic Reinforcement Learning
por: Ma, Chengdong, et al.
Publicado: (2025)
por: Ma, Chengdong, et al.
Publicado: (2025)
Even Heads Fix Odd Errors: Mechanistic Discovery and Surgical Repair in Transformer Attention
por: Sandoval, Gustavo
Publicado: (2025)
por: Sandoval, Gustavo
Publicado: (2025)
The Interpretability of Codebooks in Model-Based Reinforcement Learning is Limited
por: Eaton, Kenneth, et al.
Publicado: (2024)
por: Eaton, Kenneth, et al.
Publicado: (2024)
Pessimistic Value Iteration for Multi-Task Data Sharing in Offline Reinforcement Learning
por: Bai, Chenjia, et al.
Publicado: (2024)
por: Bai, Chenjia, et al.
Publicado: (2024)
Ask Again, Then Fail: Large Language Models' Vacillations in Judgment
por: Xie, Qiming, et al.
Publicado: (2023)
por: Xie, Qiming, et al.
Publicado: (2023)
Reinforcement Learning Agent for a 2D Shooter Game
por: Ackermann, Thomas, et al.
Publicado: (2025)
por: Ackermann, Thomas, et al.
Publicado: (2025)
Efficient Reinforcement Learning for Zero-Shot Coordination in Evolving Games
por: Hui, Bingyu, et al.
Publicado: (2025)
por: Hui, Bingyu, et al.
Publicado: (2025)
A Benchmark Environment for Offline Reinforcement Learning in Racing Games
por: Macaluso, Girolamo, et al.
Publicado: (2024)
por: Macaluso, Girolamo, et al.
Publicado: (2024)
Pgx: Hardware-Accelerated Parallel Game Simulators for Reinforcement Learning
por: Koyamada, Sotetsu, et al.
Publicado: (2023)
por: Koyamada, Sotetsu, et al.
Publicado: (2023)
Mastering the Game of Guandan with Deep Reinforcement Learning and Behavior Regulating
por: Yanggong, Yifan, et al.
Publicado: (2024)
por: Yanggong, Yifan, et al.
Publicado: (2024)
On Predictability of Reinforcement Learning Dynamics for Large Language Models
por: Cai, Yuchen, et al.
Publicado: (2025)
por: Cai, Yuchen, et al.
Publicado: (2025)
Discovering Reinforcement Learning Interfaces with Large Language Models
por: Jaswal, Akshat Singh, et al.
Publicado: (2026)
por: Jaswal, Akshat Singh, et al.
Publicado: (2026)
Reinforcement Learning with Promising Tokens for Large Language Models
por: Pang, Jing-Cheng, et al.
Publicado: (2026)
por: Pang, Jing-Cheng, et al.
Publicado: (2026)
MemFly: On-the-Fly Memory Optimization via Information Bottleneck
por: Zhang, Zhenyuan, et al.
Publicado: (2026)
por: Zhang, Zhenyuan, et al.
Publicado: (2026)
Iterated $Q$-Network: Beyond One-Step Bellman Updates in Deep Reinforcement Learning
por: Vincent, Théo, et al.
Publicado: (2024)
por: Vincent, Théo, et al.
Publicado: (2024)
Ascent Fails to Forget
por: Mavrothalassitis, Ioannis, et al.
Publicado: (2025)
por: Mavrothalassitis, Ioannis, et al.
Publicado: (2025)
Routing-Based Continual Learning for Multimodal Large Language Models
por: Mohta, Jay, et al.
Publicado: (2025)
por: Mohta, Jay, et al.
Publicado: (2025)
Agentic Reinforcement Learning for Real-World Code Repair
por: Zhu, Siyu, et al.
Publicado: (2025)
por: Zhu, Siyu, et al.
Publicado: (2025)
Game-Theoretic Robust Reinforcement Learning Handles Temporally-Coupled Perturbations
por: Liang, Yongyuan, et al.
Publicado: (2023)
por: Liang, Yongyuan, et al.
Publicado: (2023)
Efficient Reinforcement Learning for Large Language Models with Intrinsic Exploration
por: Sun, Yan, et al.
Publicado: (2025)
por: Sun, Yan, et al.
Publicado: (2025)
Fix Initial Codes and Iteratively Refine Textual Directions Toward Safe Multi-Turn Code Correction
por: Tanaka, Yuto, et al.
Publicado: (2026)
por: Tanaka, Yuto, et al.
Publicado: (2026)
Masked Omics Modeling for Multimodal Representation Learning across Histopathology and Molecular Profiles
por: Robinet, Lucas, et al.
Publicado: (2025)
por: Robinet, Lucas, et al.
Publicado: (2025)
Dataset Distillation for Offline Reinforcement Learning
por: Light, Jonathan, et al.
Publicado: (2024)
por: Light, Jonathan, et al.
Publicado: (2024)
Efficient Adaptation of Reinforcement Learning Agents to Sudden Environmental Change
por: Balloch, Jonathan Clifford
Publicado: (2025)
por: Balloch, Jonathan Clifford
Publicado: (2025)
Ejemplares similares
-
GRS: Generating Robotic Simulation Tasks from Real-World Images
por: Zook, Alex, et al.
Publicado: (2024) -
Dynamic Adversarial Reinforcement Learning for Robust Multimodal Large Language Models
por: Bao, Yicheng, et al.
Publicado: (2026) -
FlakyFix: Using Large Language Models for Predicting Flaky Test Fix Categories and Test Code Repair
por: Fatima, Sakina, et al.
Publicado: (2023) -
Combining Reinforcement Learning and Behavior Trees for NPCs in Video Games with AMD Schola
por: Liu, Tian, et al.
Publicado: (2025) -
Learning to play: A Multimodal Agent for 3D Game-Play
por: Yue, Yuguang, et al.
Publicado: (2025)