World Models for Policy Refinement in StarCraft II
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Yixin, Wang, Ziyi, Rong, Yiming, Wang, Haoxi, Jiang, Jinling, Xu, Shuang, Wu, Haoran, Zhou, Shiyu, Xu, Bo |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Adaptive Command: Real-Time Policy Adjustment via Language Models in StarCraft II
di: Ma, Weiyu, et al.
Pubblicazione: (2025)
di: Ma, Weiyu, et al.
Pubblicazione: (2025)
TacticCraft: Natural Language-Driven Tactical Adaptation for StarCraft II
di: Ma, Weiyu, et al.
Pubblicazione: (2025)
di: Ma, Weiyu, et al.
Pubblicazione: (2025)
Large Language Models Play StarCraft II: Benchmarks and A Chain of Summarization Approach
di: Ma, Weiyu, et al.
Pubblicazione: (2023)
di: Ma, Weiyu, et al.
Pubblicazione: (2023)
AVA: Attentive VLM Agent for Mastering StarCraft II
di: Ma, Weiyu, et al.
Pubblicazione: (2025)
di: Ma, Weiyu, et al.
Pubblicazione: (2025)
StarCraft+: Benchmarking Multi-agent Algorithms in Adversary Paradigm
di: Li, Yadong, et al.
Pubblicazione: (2025)
di: Li, Yadong, et al.
Pubblicazione: (2025)
StarCraft
di: Dor, Simon
Pubblicazione: (2024)
di: Dor, Simon
Pubblicazione: (2024)
SwarmBrain: Embodied agent for real-time strategy game StarCraft II via large language models
di: Shao, Xiao, et al.
Pubblicazione: (2024)
di: Shao, Xiao, et al.
Pubblicazione: (2024)
SC-Phi2: A Fine-tuned Small Language Model for StarCraft II Macromanagement Tasks
di: Khan, Muhammad Junaid, et al.
Pubblicazione: (2024)
di: Khan, Muhammad Junaid, et al.
Pubblicazione: (2024)
Scaling Strategy, Not Compute: A Stand-Alone, Open-Source StarCraft II Benchmark for Accessible Reinforcement Learning Research
di: Panda, Sourav, et al.
Pubblicazione: (2026)
di: Panda, Sourav, et al.
Pubblicazione: (2026)
HLSMAC: A New StarCraft Multi-Agent Challenge for High-Level Strategic Decision-Making
di: Hong, Xingxing, et al.
Pubblicazione: (2025)
di: Hong, Xingxing, et al.
Pubblicazione: (2025)
World4RL: Diffusion World Models for Policy Refinement with Reinforcement Learning for Robotic Manipulation
di: Jiang, Zhennan, et al.
Pubblicazione: (2025)
di: Jiang, Zhennan, et al.
Pubblicazione: (2025)
Hierarchical Expert Prompt for Large-Language-Model: An Approach Defeat Elite AI in TextStarCraft II for the First Time
di: Li, Zongyuan, et al.
Pubblicazione: (2025)
di: Li, Zongyuan, et al.
Pubblicazione: (2025)
Speech-Aware Long Context Pruning and Integration for Contextualized Automatic Speech Recognition
di: Rong, Yiming, et al.
Pubblicazione: (2025)
di: Rong, Yiming, et al.
Pubblicazione: (2025)
Carefully Structured Compression: Efficiently Managing StarCraft II Data
di: Ferenczi, Bryce, et al.
Pubblicazione: (2024)
di: Ferenczi, Bryce, et al.
Pubblicazione: (2024)
SC2Tools: StarCraft II Toolset and Dataset API
di: Białecki, Andrzej, et al.
Pubblicazione: (2025)
di: Białecki, Andrzej, et al.
Pubblicazione: (2025)
Esports Training in StarCraft II: Stance Stability and Grip Strength
di: Białecki, Andrzej, et al.
Pubblicazione: (2024)
di: Białecki, Andrzej, et al.
Pubblicazione: (2024)
Towards Realistic Scene Generation with LiDAR Diffusion Models
di: Ran, Haoxi, et al.
Pubblicazione: (2024)
di: Ran, Haoxi, et al.
Pubblicazione: (2024)
Resource-Efficient Reinforcement for Reasoning Large Language Models via Dynamic One-Shot Policy Refinement
di: Zhang, Yunjian, et al.
Pubblicazione: (2026)
di: Zhang, Yunjian, et al.
Pubblicazione: (2026)
WoVR: World Models as Reliable Simulators for Post-Training VLA Policies with RL
di: Jiang, Zhennan, et al.
Pubblicazione: (2026)
di: Jiang, Zhennan, et al.
Pubblicazione: (2026)
Black-box Gradient Attack on Graph Neural Networks: Deeper Insights in Graph-based Attack and Defense
di: Zhan, Haoxi, et al.
Pubblicazione: (2021)
di: Zhan, Haoxi, et al.
Pubblicazione: (2021)
XGrammar-2: Efficient Dynamic Structured Generation Engine for Agentic LLMs
di: Li, Linzhang, et al.
Pubblicazione: (2026)
di: Li, Linzhang, et al.
Pubblicazione: (2026)
AdaWorldPolicy: World-Model-Driven Diffusion Policy with Online Adaptive Learning for Robotic Manipulation
di: Yuan, Ge, et al.
Pubblicazione: (2026)
di: Yuan, Ge, et al.
Pubblicazione: (2026)
LVC: A Lightweight Compression Framework for Enhancing VLMs in Long Video Understanding
di: Wang, Ziyi, et al.
Pubblicazione: (2025)
di: Wang, Ziyi, et al.
Pubblicazione: (2025)
LLMER: Crafting Interactive Extended Reality Worlds with JSON Data Generated by Large Language Models
di: Chen, Jiangong, et al.
Pubblicazione: (2025)
di: Chen, Jiangong, et al.
Pubblicazione: (2025)
MrCoM: A Meta-Regularized World-Model Generalizing Across Multi-Scenarios
di: Xiong, Xuantang, et al.
Pubblicazione: (2025)
di: Xiong, Xuantang, et al.
Pubblicazione: (2025)
Cooperative-Competitive Team Play of Real-World Craft Robots
di: Zhao, Rui, et al.
Pubblicazione: (2026)
di: Zhao, Rui, et al.
Pubblicazione: (2026)
On-Device Diffusion Transformer Policy for Efficient Robot Manipulation
di: Wu, Yiming, et al.
Pubblicazione: (2025)
di: Wu, Yiming, et al.
Pubblicazione: (2025)
Refinement Provenance Inference: Detecting LLM-Refined Training Prompts from Model Behavior
di: Yin, Bo, et al.
Pubblicazione: (2026)
di: Yin, Bo, et al.
Pubblicazione: (2026)
RAG-Star: Enhancing Deliberative Reasoning with Retrieval Augmented Verification and Refinement
di: Jiang, Jinhao, et al.
Pubblicazione: (2024)
di: Jiang, Jinhao, et al.
Pubblicazione: (2024)
Delta-Triplane Transformers as Occupancy World Models
di: Xu, Haoran, et al.
Pubblicazione: (2025)
di: Xu, Haoran, et al.
Pubblicazione: (2025)
Think How to Think: Mitigating Overthinking with Autonomous Difficulty Cognition in Large Reasoning Models
di: Liu, Yongjiang, et al.
Pubblicazione: (2025)
di: Liu, Yongjiang, et al.
Pubblicazione: (2025)
Smaller Models are Natural Explorers for Policy-Level Diversity in GRPO
di: Ren, Yiming, et al.
Pubblicazione: (2026)
di: Ren, Yiming, et al.
Pubblicazione: (2026)
Integrating Hierarchical Semantic into Iterative Generation Model for Entailment Tree Explanation
di: Wang, Qin, et al.
Pubblicazione: (2024)
di: Wang, Qin, et al.
Pubblicazione: (2024)
Predictable Scale: Part II, Farseer: A Refined Scaling Law in Large Language Models
di: Li, Houyi, et al.
Pubblicazione: (2025)
di: Li, Houyi, et al.
Pubblicazione: (2025)
Deep Learning-Based CKM Construction with Image Super-Resolution
di: Wang, Shiyu, et al.
Pubblicazione: (2024)
di: Wang, Shiyu, et al.
Pubblicazione: (2024)
InfiR : Crafting Effective Small Language Models and Multimodal Small Language Models in Reasoning
di: Xie, Congkai, et al.
Pubblicazione: (2025)
di: Xie, Congkai, et al.
Pubblicazione: (2025)
Timer-S1: A Billion-Scale Time Series Foundation Model with Serial Scaling
di: Liu, Yong, et al.
Pubblicazione: (2026)
di: Liu, Yong, et al.
Pubblicazione: (2026)
Timber: Training-free Instruct Model Refining with Base via Effective Rank
di: Wu, Taiqiang, et al.
Pubblicazione: (2025)
di: Wu, Taiqiang, et al.
Pubblicazione: (2025)
DrivAerStar: An Industrial-Grade CFD Dataset for Vehicle Aerodynamic Optimization
di: Qiu, Jiyan, et al.
Pubblicazione: (2025)
di: Qiu, Jiyan, et al.
Pubblicazione: (2025)
Policy Optimization Algorithms in a Unified Framework
di: Wu, Shuang
Pubblicazione: (2025)
di: Wu, Shuang
Pubblicazione: (2025)
Documenti analoghi
-
Adaptive Command: Real-Time Policy Adjustment via Language Models in StarCraft II
di: Ma, Weiyu, et al.
Pubblicazione: (2025) -
TacticCraft: Natural Language-Driven Tactical Adaptation for StarCraft II
di: Ma, Weiyu, et al.
Pubblicazione: (2025) -
Large Language Models Play StarCraft II: Benchmarks and A Chain of Summarization Approach
di: Ma, Weiyu, et al.
Pubblicazione: (2023) -
AVA: Attentive VLM Agent for Mastering StarCraft II
di: Ma, Weiyu, et al.
Pubblicazione: (2025) -
StarCraft+: Benchmarking Multi-agent Algorithms in Adversary Paradigm
di: Li, Yadong, et al.
Pubblicazione: (2025)