Bitboard version of Tetris AI
Fuente:
arXiv
Salvato in:
| Autori principali: | Chen, Xingguo, Xiong, Pingshou, Luo, Zhenyu, Hu, Mengfei, Li, Xinwen, Lü, Yongzhou, Yang, Guang, Li, Chao, Yang, Shangdong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Behavior-Induced Mirror-Prox Temporal-Difference Learning for Faster Off-Policy Prediction
di: Chen, Xingguo, et al.
Pubblicazione: (2026)
di: Chen, Xingguo, et al.
Pubblicazione: (2026)
Behavior-Aware Auxiliary Corrections for Off-Policy Temporal-Difference Prediction
di: Chen, Xingguo, et al.
Pubblicazione: (2026)
di: Chen, Xingguo, et al.
Pubblicazione: (2026)
Regularized Centered Emphatic Temporal Difference Learning
di: Chen, Xingguo, et al.
Pubblicazione: (2026)
di: Chen, Xingguo, et al.
Pubblicazione: (2026)
Bellman Error Centering
di: Chen, Xingguo, et al.
Pubblicazione: (2025)
di: Chen, Xingguo, et al.
Pubblicazione: (2025)
A Variance Minimization Approach to Temporal-Difference Learning
di: Chen, Xingguo, et al.
Pubblicazione: (2024)
di: Chen, Xingguo, et al.
Pubblicazione: (2024)
OpenGuanDan: A Large-Scale Imperfect Information Game Benchmark
di: Li, Chao, et al.
Pubblicazione: (2026)
di: Li, Chao, et al.
Pubblicazione: (2026)
Evaluating Game Difficulty in Tetris Block Puzzle
di: Wang, Chun-Jui, et al.
Pubblicazione: (2026)
di: Wang, Chun-Jui, et al.
Pubblicazione: (2026)
Multi-Agent Reinforcement Learning with Communication-Constrained Priors
di: Yang, Guang, et al.
Pubblicazione: (2025)
di: Yang, Guang, et al.
Pubblicazione: (2025)
Model-Based Offline Reinforcement Learning with Adversarial Data Augmentation
di: Cao, Hongye, et al.
Pubblicazione: (2025)
di: Cao, Hongye, et al.
Pubblicazione: (2025)
Distribution Shift Alignment Helps LLMs Simulate Survey Response Distributions
di: Huang, Ji, et al.
Pubblicazione: (2025)
di: Huang, Ji, et al.
Pubblicazione: (2025)
Efficient Orchestrated AI Workflows Execution on Scale-out Spatial Architecture
di: Deng, Jinyi, et al.
Pubblicazione: (2024)
di: Deng, Jinyi, et al.
Pubblicazione: (2024)
Multi-Modal Experience Inspired AI Creation
di: Cao, Qian, et al.
Pubblicazione: (2022)
di: Cao, Qian, et al.
Pubblicazione: (2022)
DeepSeek: Paradigm Shifts and Technical Evolution in Large AI Models
di: Xiong, Luolin, et al.
Pubblicazione: (2025)
di: Xiong, Luolin, et al.
Pubblicazione: (2025)
ShipTraj-R1: Reinforcing Ship Trajectory Prediction in Large Language Models via Group Relative Policy Optimization
di: Zhan, Yang, et al.
Pubblicazione: (2026)
di: Zhan, Yang, et al.
Pubblicazione: (2026)
Efficient Last-iterate Convergence Algorithms in Solving Games
di: Meng, Linjian, et al.
Pubblicazione: (2023)
di: Meng, Linjian, et al.
Pubblicazione: (2023)
Fingerprinting Deep Neural Networks for Ownership Protection: An Analytical Approach
di: Yang, Guang, et al.
Pubblicazione: (2026)
di: Yang, Guang, et al.
Pubblicazione: (2026)
Beyond Static Assumptions: the Predictive Justified Perspective Model for Epistemic Planning
di: Hu, Guang, et al.
Pubblicazione: (2024)
di: Hu, Guang, et al.
Pubblicazione: (2024)
From Mirage to Grounding: Towards Reliable Multimodal Circuit-to-Verilog Code Generation
di: Yang, Guang, et al.
Pubblicazione: (2026)
di: Yang, Guang, et al.
Pubblicazione: (2026)
UniMIC: Token-Based Multimodal Interactive Coding for Human-AI Collaboration
di: Mao, Qi, et al.
Pubblicazione: (2025)
di: Mao, Qi, et al.
Pubblicazione: (2025)
Do Agents Think Deeper? A Mechanistic Investigation of Layer-Wise Dynamics in Sequential Planning
di: Cui, Zhenyu, et al.
Pubblicazione: (2026)
di: Cui, Zhenyu, et al.
Pubblicazione: (2026)
From Easy to Hard: Building a Shortcut for Differentially Private Image Synthesis
di: Li, Kecen, et al.
Pubblicazione: (2025)
di: Li, Kecen, et al.
Pubblicazione: (2025)
From Challenges and Pitfalls to Recommendations and Opportunities: Implementing Federated Learning in Healthcare
di: Li, Ming, et al.
Pubblicazione: (2024)
di: Li, Ming, et al.
Pubblicazione: (2024)
Responsible AI in Construction Safety: Systematic Evaluation of Large Language Models and Prompt Engineering
di: Sammour, Farouq, et al.
Pubblicazione: (2024)
di: Sammour, Farouq, et al.
Pubblicazione: (2024)
Decoupled Federated Learning on Long-Tailed and Non-IID data with Feature Statistics
di: Chen, Zhuoxin, et al.
Pubblicazione: (2024)
di: Chen, Zhuoxin, et al.
Pubblicazione: (2024)
Wildfire Detection Using Vision Transformer with the Wildfire Dataset
di: Vuppari, Gowtham Raj, et al.
Pubblicazione: (2025)
di: Vuppari, Gowtham Raj, et al.
Pubblicazione: (2025)
Population Aware Diffusion for Time Series Generation
di: Li, Yang, et al.
Pubblicazione: (2025)
di: Li, Yang, et al.
Pubblicazione: (2025)
Self-degraded contrastive domain adaptation for industrial fault diagnosis with bi-imbalanced data
di: Chen, Gecheng, et al.
Pubblicazione: (2024)
di: Chen, Gecheng, et al.
Pubblicazione: (2024)
Reasoning Is All You Need for Urban Planning AI
di: Yang, Sijie, et al.
Pubblicazione: (2025)
di: Yang, Sijie, et al.
Pubblicazione: (2025)
NARRepair: Non-Autoregressive Code Generation Model for Automatic Program Repair
di: Yang, Zhenyu, et al.
Pubblicazione: (2024)
di: Yang, Zhenyu, et al.
Pubblicazione: (2024)
SOP-Agent: Empower General Purpose AI Agent with Domain-Specific SOPs
di: Ye, Anbang, et al.
Pubblicazione: (2025)
di: Ye, Anbang, et al.
Pubblicazione: (2025)
From Mind to Machine: The Rise of Manus AI as a Fully Autonomous Digital Agent
di: Shen, Minjie, et al.
Pubblicazione: (2025)
di: Shen, Minjie, et al.
Pubblicazione: (2025)
Federated Large Language Models: Feasibility, Robustness, Security and Future Directions
di: Jiang, Wenhao, et al.
Pubblicazione: (2025)
di: Jiang, Wenhao, et al.
Pubblicazione: (2025)
Unveiling Latent Causal Rules: A Temporal Point Process Approach for Abnormal Event Explanation
di: Kuang, Yiling, et al.
Pubblicazione: (2024)
di: Kuang, Yiling, et al.
Pubblicazione: (2024)
Efficient Agent: Optimizing Planning Capability for Multimodal Retrieval Augmented Generation
di: Wang, Yuechen, et al.
Pubblicazione: (2025)
di: Wang, Yuechen, et al.
Pubblicazione: (2025)
AI-Researcher: Autonomous Scientific Innovation
di: Tang, Jiabin, et al.
Pubblicazione: (2025)
di: Tang, Jiabin, et al.
Pubblicazione: (2025)
TCAndon-Router: Adaptive Reasoning Router for Multi-Agent Collaboration
di: Zhao, Jiuzhou, et al.
Pubblicazione: (2026)
di: Zhao, Jiuzhou, et al.
Pubblicazione: (2026)
Conv-CoA: Improving Open-domain Question Answering in Large Language Models via Conversational Chain-of-Action
di: Pan, Zhenyu, et al.
Pubblicazione: (2024)
di: Pan, Zhenyu, et al.
Pubblicazione: (2024)
Aligning Deep Implicit Preferences by Learning to Reason Defensively
di: Li, Peiming, et al.
Pubblicazione: (2025)
di: Li, Peiming, et al.
Pubblicazione: (2025)
Reclaiming Lost Text Layers for Source-Free Cross-Domain Few-Shot Learning
di: Zhang, Zhenyu, et al.
Pubblicazione: (2026)
di: Zhang, Zhenyu, et al.
Pubblicazione: (2026)
Automating Traffic Model Enhancement with AI Research Agent
di: Guo, Xusen, et al.
Pubblicazione: (2024)
di: Guo, Xusen, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Behavior-Induced Mirror-Prox Temporal-Difference Learning for Faster Off-Policy Prediction
di: Chen, Xingguo, et al.
Pubblicazione: (2026) -
Behavior-Aware Auxiliary Corrections for Off-Policy Temporal-Difference Prediction
di: Chen, Xingguo, et al.
Pubblicazione: (2026) -
Regularized Centered Emphatic Temporal Difference Learning
di: Chen, Xingguo, et al.
Pubblicazione: (2026) -
Bellman Error Centering
di: Chen, Xingguo, et al.
Pubblicazione: (2025) -
A Variance Minimization Approach to Temporal-Difference Learning
di: Chen, Xingguo, et al.
Pubblicazione: (2024)