Hokoff: Real Game Dataset from Honor of Kings and its Offline Reinforcement Learning Benchmarks
Fuente:
arXiv
Salvato in:
| Autori principali: | Qu, Yun, Wang, Boyuan, Shao, Jianzhun, Jiang, Yuhang, Chen, Chen, Ye, Zhenbin, Liu, Lin, Yang, Junfeng, Lai, Lin, Qin, Hongyang, Deng, Minwen, Zhuo, Juchao, Ye, Deheng, Fu, Qiang, Yang, Wei, Yang, Guang, Huang, Lanxiao, Ji, Xiangyang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Mini Honor of Kings: A Lightweight Environment for Multi-Agent Reinforcement Learning
di: Liu, Lin, et al.
Pubblicazione: (2024)
di: Liu, Lin, et al.
Pubblicazione: (2024)
LLM-Empowered State Representation for Reinforcement Learning
di: Wang, Boyuan, et al.
Pubblicazione: (2024)
di: Wang, Boyuan, et al.
Pubblicazione: (2024)
Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model
di: He, Shuncheng, et al.
Pubblicazione: (2025)
di: He, Shuncheng, et al.
Pubblicazione: (2025)
Playable Game Generation
di: Yang, Mingyu, et al.
Pubblicazione: (2024)
di: Yang, Mingyu, et al.
Pubblicazione: (2024)
Cross-Domain Offline Policy Adaptation via Selective Transition Correction
di: Yan, Mengbei, et al.
Pubblicazione: (2026)
di: Yan, Mengbei, et al.
Pubblicazione: (2026)
AdaptVision: Efficient Vision-Language Models via Adaptive Visual Acquisition
di: Lin, Zichuan, et al.
Pubblicazione: (2025)
di: Lin, Zichuan, et al.
Pubblicazione: (2025)
Stop Wandering, Find the Keys: LLMs Discriminate Key States for Efficient Multi-Agent Exploration
di: Qu, Yun, et al.
Pubblicazione: (2024)
di: Qu, Yun, et al.
Pubblicazione: (2024)
Doubly Mild Generalization for Offline Reinforcement Learning
di: Mao, Yixiu, et al.
Pubblicazione: (2024)
di: Mao, Yixiu, et al.
Pubblicazione: (2024)
SeeNav-Agent: Enhancing Vision-Language Navigation with Visual Prompt and Step-Level Policy Optimization
di: Wang, Zhengcheng, et al.
Pubblicazione: (2025)
di: Wang, Zhengcheng, et al.
Pubblicazione: (2025)
HiRO-Nav: Hybrid ReasOning Enables Efficient Embodied Navigation
di: Zhao, He, et al.
Pubblicazione: (2026)
di: Zhao, He, et al.
Pubblicazione: (2026)
Vul-R2: A Reasoning LLM for Automated Vulnerability Repair
di: Wen, Xin-Cheng, et al.
Pubblicazione: (2025)
di: Wen, Xin-Cheng, et al.
Pubblicazione: (2025)
Robust Policy Expansion for Offline-to-Online RL under Diverse Data Corruption
di: He, Longxiang, et al.
Pubblicazione: (2025)
di: He, Longxiang, et al.
Pubblicazione: (2025)
The Stackelberg Speaker: Optimizing Persuasive Communication in Social Deduction Games
di: Zheng, Zhang, et al.
Pubblicazione: (2025)
di: Zheng, Zhang, et al.
Pubblicazione: (2025)
Debiased Model-based Representations for Sample-efficient Continuous Control
di: Lyu, Jiafei, et al.
Pubblicazione: (2026)
di: Lyu, Jiafei, et al.
Pubblicazione: (2026)
EntroPIC: Towards Stable Long-Term Training of LLMs via Entropy Stabilization with Proportional-Integral Control
di: Yang, Kai, et al.
Pubblicazione: (2025)
di: Yang, Kai, et al.
Pubblicazione: (2025)
Offline Reinforcement Learning with OOD State Correction and OOD Action Suppression
di: Mao, Yixiu, et al.
Pubblicazione: (2024)
di: Mao, Yixiu, et al.
Pubblicazione: (2024)
Pareto-guided Pipeline for Distilling Featherweight AI Agents in Mobile MOBA Games
di: Yang, Xionghui, et al.
Pubblicazione: (2026)
di: Yang, Xionghui, et al.
Pubblicazione: (2026)
Boosting Vulnerability Detection of LLMs via Curriculum Preference Optimization with Synthetic Reasoning Data
di: Wen, Xin-Cheng, et al.
Pubblicazione: (2025)
di: Wen, Xin-Cheng, et al.
Pubblicazione: (2025)
PROF: An LLM-based Reward Code Preference Optimization Framework for Offline Imitation Learning
di: Sun, Shengjie, et al.
Pubblicazione: (2025)
di: Sun, Shengjie, et al.
Pubblicazione: (2025)
Computational, Label, and Data Efficiency in Deep Learning for Sparse 3D Data
di: Li, Lanxiao
Pubblicazione: (2024)
di: Li, Lanxiao
Pubblicazione: (2024)
Liver enzyme and risk of vascular dementia: A univariable and multivariable Mendelian randomization of European descent
di: Jieyu Chen, et al.
Pubblicazione: (2024)
di: Jieyu Chen, et al.
Pubblicazione: (2024)
Improving Sample Efficiency of Reinforcement Learning with Background Knowledge from Large Language Models
di: Zhang, Fuxiang, et al.
Pubblicazione: (2024)
di: Zhang, Fuxiang, et al.
Pubblicazione: (2024)
Learning Versatile Skills with Curriculum Masking
di: Tang, Yao, et al.
Pubblicazione: (2024)
di: Tang, Yao, et al.
Pubblicazione: (2024)
Adaptive Neighborhood-Constrained Q Learning for Offline Reinforcement Learning
di: Mao, Yixiu, et al.
Pubblicazione: (2025)
di: Mao, Yixiu, et al.
Pubblicazione: (2025)
Latent Reward: LLM-Empowered Credit Assignment in Episodic Reinforcement Learning
di: Qu, Yun, et al.
Pubblicazione: (2024)
di: Qu, Yun, et al.
Pubblicazione: (2024)
On the phase of the de Sitter density of states
di: Chen, Yiming, et al.
Pubblicazione: (2025)
di: Chen, Yiming, et al.
Pubblicazione: (2025)
Affordable Generative Agents
di: Yu, Yangbin, et al.
Pubblicazione: (2024)
di: Yu, Yangbin, et al.
Pubblicazione: (2024)
More Agents Is All You Need
di: Li, Junyou, et al.
Pubblicazione: (2024)
di: Li, Junyou, et al.
Pubblicazione: (2024)
Continual Learning in Large Language Models: Methods, Challenges, and Opportunities
di: Chen, Hongyang, et al.
Pubblicazione: (2026)
di: Chen, Hongyang, et al.
Pubblicazione: (2026)
Flow-Matching Based Refiner for Molecular Conformer Generation
di: Xu, Xiangyang, et al.
Pubblicazione: (2025)
di: Xu, Xiangyang, et al.
Pubblicazione: (2025)
M-GLC: Motif-Driven Global-Local Context Graphs for Few-shot Molecular Property Prediction
di: Xu, Xiangyang, et al.
Pubblicazione: (2025)
di: Xu, Xiangyang, et al.
Pubblicazione: (2025)
Corruption-Robust Offline Reinforcement Learning with General Function Approximation
di: Ye, Chenlu, et al.
Pubblicazione: (2023)
di: Ye, Chenlu, et al.
Pubblicazione: (2023)
Egocentric Visual Self-Modeling for Autonomous Robot Dynamics Prediction and Adaptation
di: Hu, Yuhang, et al.
Pubblicazione: (2022)
di: Hu, Yuhang, et al.
Pubblicazione: (2022)
PIPCFR: Pseudo-outcome Imputation with Post-treatment Variables for Individual Treatment Effect Estimation
di: Lin, Zichuan, et al.
Pubblicazione: (2025)
di: Lin, Zichuan, et al.
Pubblicazione: (2025)
PhyCustom: Towards Realistic Physical Customization in Text-to-Image Generation
di: Wu, Fan, et al.
Pubblicazione: (2025)
di: Wu, Fan, et al.
Pubblicazione: (2025)
Multi-agent In-context Coordination via Decentralized Memory Retrieval
di: Jiang, Tao, et al.
Pubblicazione: (2025)
di: Jiang, Tao, et al.
Pubblicazione: (2025)
Quantum Channel Capacity of Traversable Wormhole
di: Lu, Jingru, et al.
Pubblicazione: (2026)
di: Lu, Jingru, et al.
Pubblicazione: (2026)
Comments on the de Sitter Double Cone
di: Yang, Zhenbin, et al.
Pubblicazione: (2025)
di: Yang, Zhenbin, et al.
Pubblicazione: (2025)
Configurations of Sustained Volunteerism: A Fuzzy‐Set Qualitative Comparative Analysis
di: Zhenbin Ding, et al.
Pubblicazione: (2025)
di: Zhenbin Ding, et al.
Pubblicazione: (2025)
A Saddle Point Remedy: Power of Variable Elimination in Non-convex Optimization
di: Gan, Min, et al.
Pubblicazione: (2025)
di: Gan, Min, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Mini Honor of Kings: A Lightweight Environment for Multi-Agent Reinforcement Learning
di: Liu, Lin, et al.
Pubblicazione: (2024) -
LLM-Empowered State Representation for Reinforcement Learning
di: Wang, Boyuan, et al.
Pubblicazione: (2024) -
Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model
di: He, Shuncheng, et al.
Pubblicazione: (2025) -
Playable Game Generation
di: Yang, Mingyu, et al.
Pubblicazione: (2024) -
Cross-Domain Offline Policy Adaptation via Selective Transition Correction
di: Yan, Mengbei, et al.
Pubblicazione: (2026)