Odysseus: Scaling VLMs to 100+ Turn Decision-Making in Games via Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Shi, Chengshuai, Li, Wenzhe, Liang, Xinran, Lu, Yizhou, Yang, Wenjia, Feng, Ruirong, Karten, Seth, Yang, Ziran, Ding, Zihan, Sarch, Gabriel, Chen, Danqi, Narasimhan, Karthik, Jin, Chi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
FightLadder: A Benchmark for Competitive Multi-Agent Reinforcement Learning
di: Li, Wenzhe, et al.
Pubblicazione: (2024)
di: Li, Wenzhe, et al.
Pubblicazione: (2024)
Continual Harness: Online Adaptation for Self-Improving Foundation Agents
di: Karten, Seth, et al.
Pubblicazione: (2026)
di: Karten, Seth, et al.
Pubblicazione: (2026)
LLM Economist: Large Population Models and Mechanism Design in Multi-Agent Generative Simulacra
di: Karten, Seth, et al.
Pubblicazione: (2025)
di: Karten, Seth, et al.
Pubblicazione: (2025)
Agent Bazaar: Enabling Economic Alignment in Multi-Agent Marketplaces
di: Karten, Seth, et al.
Pubblicazione: (2026)
di: Karten, Seth, et al.
Pubblicazione: (2026)
Retaining by Doing: The Role of On-Policy Data in Mitigating Forgetting
di: Chen, Howard, et al.
Pubblicazione: (2025)
di: Chen, Howard, et al.
Pubblicazione: (2025)
Automatic Generation of High-Performance RL Environments
di: Karten, Seth, et al.
Pubblicazione: (2026)
di: Karten, Seth, et al.
Pubblicazione: (2026)
PokéChamp: an Expert-level Minimax Language Agent
di: Karten, Seth, et al.
Pubblicazione: (2025)
di: Karten, Seth, et al.
Pubblicazione: (2025)
Vero: An Open RL Recipe for General Visual Reasoning
di: Sarch, Gabriel, et al.
Pubblicazione: (2026)
di: Sarch, Gabriel, et al.
Pubblicazione: (2026)
Out of Sight, Not Out of Context? Egocentric Spatial Reasoning in VLMs Across Disjoint Frames
di: Ravi, Sahithya, et al.
Pubblicazione: (2025)
di: Ravi, Sahithya, et al.
Pubblicazione: (2025)
Transformers as Game Players: Provable In-context Game-playing Capabilities of Pre-trained Models
di: Shi, Chengshuai, et al.
Pubblicazione: (2024)
di: Shi, Chengshuai, et al.
Pubblicazione: (2024)
The Finite Primitive Basis Theorem for Computational Imaging: Formal Foundations of the OperatorGraph Representation
di: Yang, Chengshuai
Pubblicazione: (2026)
di: Yang, Chengshuai
Pubblicazione: (2026)
A Judge Agent Closes the Reliability Gap in AI-Generated Scientific Simulation
di: Yang, Chengshuai
Pubblicazione: (2026)
di: Yang, Chengshuai
Pubblicazione: (2026)
Designing Any Imaging System from Natural Language: Agent-Constrained Composition over a Finite Primitive Basis
di: Yang, Chengshuai
Pubblicazione: (2026)
di: Yang, Chengshuai
Pubblicazione: (2026)
Cultivating Game Sense for Yourself: Making VLMs Gaming Experts
di: Lu, Wenxuan, et al.
Pubblicazione: (2025)
di: Lu, Wenxuan, et al.
Pubblicazione: (2025)
Autonomous Decision Making for UAV Cooperative Pursuit-Evasion Game with Reinforcement Learning
di: Zhao, Yang, et al.
Pubblicazione: (2024)
di: Zhao, Yang, et al.
Pubblicazione: (2024)
VLMs Guided Interpretable Decision Making for Autonomous Driving
di: Hu, Xin, et al.
Pubblicazione: (2025)
di: Hu, Xin, et al.
Pubblicazione: (2025)
GameDevBench: Evaluating Agentic Capabilities Through Game Development
di: Chi, Wayne, et al.
Pubblicazione: (2026)
di: Chi, Wayne, et al.
Pubblicazione: (2026)
Odysseus and the Cult of Apollo at Delos
di: Jim Marks
Pubblicazione: (2016)
di: Jim Marks
Pubblicazione: (2016)
Game-Theoretic Multiagent Reinforcement Learning
di: Yang, Yaodong, et al.
Pubblicazione: (2020)
di: Yang, Yaodong, et al.
Pubblicazione: (2020)
Eleven Primitives and Three Gates: The Universal Structure of Computational Imaging
di: Yang, Chengshuai, et al.
Pubblicazione: (2026)
di: Yang, Chengshuai, et al.
Pubblicazione: (2026)
InverseNet: Benchmarking Operator Mismatch and Calibration Across Compressive Imaging Modalities
di: Yang, Chengshuai, et al.
Pubblicazione: (2026)
di: Yang, Chengshuai, et al.
Pubblicazione: (2026)
LLMs are Superior Feedback Providers: Bootstrapping Reasoning for Lie Detection with Self-Generated Feedback
di: Banerjee, Tanushree, et al.
Pubblicazione: (2024)
di: Banerjee, Tanushree, et al.
Pubblicazione: (2024)
SPARKLE: A Nonparametric Approach for Online Decision-Making with High-Dimensional Covariates
di: Wang, Wenjia, et al.
Pubblicazione: (2025)
di: Wang, Wenjia, et al.
Pubblicazione: (2025)
LLMs for High-Frequency Decision-Making: Normalized Action Reward-Guided Consistency Policy Optimization
di: Zhao, Yang, et al.
Pubblicazione: (2026)
di: Zhao, Yang, et al.
Pubblicazione: (2026)
Scaling Laws for Imitation Learning in Single-Agent Games
di: Tuyls, Jens, et al.
Pubblicazione: (2023)
di: Tuyls, Jens, et al.
Pubblicazione: (2023)
VideoGameBench: Can Vision-Language Models complete popular video games?
di: Zhang, Alex L., et al.
Pubblicazione: (2025)
di: Zhang, Alex L., et al.
Pubblicazione: (2025)
Efficient Prompt Optimization Through the Lens of Best Arm Identification
di: Shi, Chengshuai, et al.
Pubblicazione: (2024)
di: Shi, Chengshuai, et al.
Pubblicazione: (2024)
Grounded Reinforcement Learning for Visual Reasoning
di: Sarch, Gabriel, et al.
Pubblicazione: (2025)
di: Sarch, Gabriel, et al.
Pubblicazione: (2025)
Entropy, Thermodynamics and the Geometrization of the Language Model
di: Yang, Wenzhe
Pubblicazione: (2024)
di: Yang, Wenzhe
Pubblicazione: (2024)
Securing Equal Share: A Principled Approach for Learning Multiplayer Symmetric Games
di: Ge, Jiawei, et al.
Pubblicazione: (2024)
di: Ge, Jiawei, et al.
Pubblicazione: (2024)
Hierarchical Decision-Making in Population Games
di: Chen, Yu-Wen, et al.
Pubblicazione: (2025)
di: Chen, Yu-Wen, et al.
Pubblicazione: (2025)
A Multi-Resolution Dynamic Game Framework for Cross-Echelon Decision-Making in Cyber Warfare
di: Yang, Ya-Ting, et al.
Pubblicazione: (2025)
di: Yang, Ya-Ting, et al.
Pubblicazione: (2025)
Reinforcement Learning in High-frequency Market Making
di: Zheng, Yuheng, et al.
Pubblicazione: (2024)
di: Zheng, Yuheng, et al.
Pubblicazione: (2024)
Code as Reward: Empowering Reinforcement Learning with VLMs
di: Venuto, David, et al.
Pubblicazione: (2024)
di: Venuto, David, et al.
Pubblicazione: (2024)
AMONGAGENTS: Evaluating Large Language Models in the Interactive Text-Based Social Deduction Game
di: Chi, Yizhou, et al.
Pubblicazione: (2024)
di: Chi, Yizhou, et al.
Pubblicazione: (2024)
Morphology-Aware Graph Reinforcement Learning for Tensegrity Robot Locomotion
di: Zhang, Chi, et al.
Pubblicazione: (2025)
di: Zhang, Chi, et al.
Pubblicazione: (2025)
Reinforced Curriculum Pre-Alignment for Domain-Adaptive VLMs
di: Yan, Yuming, et al.
Pubblicazione: (2026)
di: Yan, Yuming, et al.
Pubblicazione: (2026)
Understanding the Effects of AI-Assisted Critical Thinking on Human-AI Decision Making
di: Tian, Harry Yizhou, et al.
Pubblicazione: (2026)
di: Tian, Harry Yizhou, et al.
Pubblicazione: (2026)
AgentGym-RL: Training LLM Agents for Long-Horizon Decision Making through Multi-Turn Reinforcement Learning
di: Xi, Zhiheng, et al.
Pubblicazione: (2025)
di: Xi, Zhiheng, et al.
Pubblicazione: (2025)
Intent-Context Synergy Reinforcement Learning for Autonomous UAV Decision-Making in Air Combat
di: Fu, Jiahao, et al.
Pubblicazione: (2026)
di: Fu, Jiahao, et al.
Pubblicazione: (2026)
Documenti analoghi
-
FightLadder: A Benchmark for Competitive Multi-Agent Reinforcement Learning
di: Li, Wenzhe, et al.
Pubblicazione: (2024) -
Continual Harness: Online Adaptation for Self-Improving Foundation Agents
di: Karten, Seth, et al.
Pubblicazione: (2026) -
LLM Economist: Large Population Models and Mechanism Design in Multi-Agent Generative Simulacra
di: Karten, Seth, et al.
Pubblicazione: (2025) -
Agent Bazaar: Enabling Economic Alignment in Multi-Agent Marketplaces
di: Karten, Seth, et al.
Pubblicazione: (2026) -
Retaining by Doing: The Role of On-Policy Data in Mitigating Forgetting
di: Chen, Howard, et al.
Pubblicazione: (2025)