Human-aligned Chess with a Bit of Search
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhang, Yiming, Jacob, Athul Paul, Lai, Vivian, Fried, Daniel, Ippolito, Daphne |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Mastering Chinese Chess AI (Xiangqi) Without Search
por: Chen, Yu, et al.
Publicado: (2024)
por: Chen, Yu, et al.
Publicado: (2024)
Implicit Search via Discrete Diffusion: A Study on Chess
por: Ye, Jiacheng, et al.
Publicado: (2025)
por: Ye, Jiacheng, et al.
Publicado: (2025)
Are aligned neural networks adversarially aligned?
por: Carlini, Nicholas, et al.
Publicado: (2023)
por: Carlini, Nicholas, et al.
Publicado: (2023)
ChessQA: Evaluating Large Language Models for Chess Understanding
por: Wen, Qianfeng, et al.
Publicado: (2025)
por: Wen, Qianfeng, et al.
Publicado: (2025)
Diversifying AI: Towards Creative Chess with AlphaZero
por: Zahavy, Tom, et al.
Publicado: (2023)
por: Zahavy, Tom, et al.
Publicado: (2023)
Complete Chess Games Enable LLM Become A Chess Master
por: Zhang, Yinqi, et al.
Publicado: (2025)
por: Zhang, Yinqi, et al.
Publicado: (2025)
Generating Creative Chess Puzzles
por: Feng, Xidong, et al.
Publicado: (2025)
por: Feng, Xidong, et al.
Publicado: (2025)
ChessArena: A Chess Testbed for Evaluating Strategic Reasoning Capabilities of Large Language Models
por: Liu, Jincheng, et al.
Publicado: (2025)
por: Liu, Jincheng, et al.
Publicado: (2025)
Iterative Inference in a Chess-Playing Neural Network
por: Sandmann, Elias, et al.
Publicado: (2025)
por: Sandmann, Elias, et al.
Publicado: (2025)
Enhancing Chess Reinforcement Learning with Graph Representation
por: Rigaux, Tomas, et al.
Publicado: (2024)
por: Rigaux, Tomas, et al.
Publicado: (2024)
UniMaia: Steering Chess Policies with Language for Human-like Play
por: Siu, Sherman, et al.
Publicado: (2026)
por: Siu, Sherman, et al.
Publicado: (2026)
Tree Search for Language Model Agents
por: Koh, Jing Yu, et al.
Publicado: (2024)
por: Koh, Jing Yu, et al.
Publicado: (2024)
A Behavior-Based Knowledge Representation Improves Prediction of Players' Moves in Chess by 25%
por: Skidanov, Benny, et al.
Publicado: (2025)
por: Skidanov, Benny, et al.
Publicado: (2025)
Towards Piece-by-Piece Explanations for Chess Positions with SHAP
por: Spinnato, Francesco
Publicado: (2025)
por: Spinnato, Francesco
Publicado: (2025)
Evidence of Learned Look-Ahead in a Chess-Playing Neural Network
por: Jenner, Erik, et al.
Publicado: (2024)
por: Jenner, Erik, et al.
Publicado: (2024)
Effective Prompt Extraction from Language Models
por: Zhang, Yiming, et al.
Publicado: (2023)
por: Zhang, Yiming, et al.
Publicado: (2023)
Liquid Reasoning Transformers: A Sudoku-Based Prototype for Chess-Scale Algorithmic Tasks
por: Sahni, Shivansh, et al.
Publicado: (2025)
por: Sahni, Shivansh, et al.
Publicado: (2025)
Few-shot Personalization of LLMs with Mis-aligned Responses
por: Kim, Jaehyung, et al.
Publicado: (2024)
por: Kim, Jaehyung, et al.
Publicado: (2024)
Oracle-Guided Soft Shielding for Safe Move Prediction in Chess
por: Rajendran, Prajit T, et al.
Publicado: (2026)
por: Rajendran, Prajit T, et al.
Publicado: (2026)
Evaluating In Silico Creativity: An Expert Review of AI Chess Compositions
por: Veeriah, Vivek, et al.
Publicado: (2025)
por: Veeriah, Vivek, et al.
Publicado: (2025)
Mixture of Masters: Sparse Chess Language Models with Player Routing
por: Frisoni, Giacomo, et al.
Publicado: (2026)
por: Frisoni, Giacomo, et al.
Publicado: (2026)
Amortized Planning with Large-Scale Transformers: A Case Study on Chess
por: Ruoss, Anian, et al.
Publicado: (2024)
por: Ruoss, Anian, et al.
Publicado: (2024)
VAM: Verbalized Action Masking for Controllable Exploration in RL Post-Training -- A Chess Case Study
por: Zhang, Zhicheng, et al.
Publicado: (2026)
por: Zhang, Zhicheng, et al.
Publicado: (2026)
Neural Network-based Information Set Weighting for Playing Reconnaissance Blind Chess
por: Bertram, Timo, et al.
Publicado: (2024)
por: Bertram, Timo, et al.
Publicado: (2024)
Normalized Architectures are Natively 4-Bit
por: Fishman, Maxim, et al.
Publicado: (2026)
por: Fishman, Maxim, et al.
Publicado: (2026)
How Reasoning Evolves from Post-Training Data: An Empirical Study Using Chess
por: Dionisopoulos, Lucas, et al.
Publicado: (2026)
por: Dionisopoulos, Lucas, et al.
Publicado: (2026)
Designing Skill-Compatible AI: Methodologies and Frameworks in Chess
por: Hamade, Karim, et al.
Publicado: (2024)
por: Hamade, Karim, et al.
Publicado: (2024)
Human-compatible driving partners through data-regularized self-play reinforcement learning
por: Cornelisse, Daphne, et al.
Publicado: (2024)
por: Cornelisse, Daphne, et al.
Publicado: (2024)
Can Large Language Models Develop Strategic Reasoning? Post-training Insights from Learning Chess
por: Hwang, Dongyoon, et al.
Publicado: (2025)
por: Hwang, Dongyoon, et al.
Publicado: (2025)
Generating Pragmatic Examples to Train Neural Program Synthesizers
por: Vaduguru, Saujas, et al.
Publicado: (2023)
por: Vaduguru, Saujas, et al.
Publicado: (2023)
Continual Quantization-Aware Pre-Training: When to transition from 16-bit to 1.58-bit pre-training for BitNet language models?
por: Nielsen, Jacob, et al.
Publicado: (2025)
por: Nielsen, Jacob, et al.
Publicado: (2025)
Q-Palette: Fractional-Bit Quantizers Toward Optimal Bit Allocation for Efficient LLM Deployment
por: Lee, Deokjae, et al.
Publicado: (2025)
por: Lee, Deokjae, et al.
Publicado: (2025)
Think Before You Lie: How Reasoning Leads to Honesty
por: Yuan, Ann, et al.
Publicado: (2026)
por: Yuan, Ann, et al.
Publicado: (2026)
Superior Computer Chess with Model Predictive Control, Reinforcement Learning, and Rollout
por: Gundawar, Atharva, et al.
Publicado: (2024)
por: Gundawar, Atharva, et al.
Publicado: (2024)
Attn-QAT: 4-Bit Attention With Quantization-Aware Training
por: Zhang, Peiyuan, et al.
Publicado: (2026)
por: Zhang, Peiyuan, et al.
Publicado: (2026)
CIE: Controlling Language Model Text Generations Using Continuous Signals
por: Samuel, Vinay, et al.
Publicado: (2025)
por: Samuel, Vinay, et al.
Publicado: (2025)
Tiled Bit Networks: Sub-Bit Neural Network Compression Through Reuse of Learnable Binary Vectors
por: Gorbett, Matt, et al.
Publicado: (2024)
por: Gorbett, Matt, et al.
Publicado: (2024)
BitsMoE: Efficient Spectral Energy-Guided Bit Allocation for MoE LLM Quantization
por: Zhao, Jiayu, et al.
Publicado: (2026)
por: Zhao, Jiayu, et al.
Publicado: (2026)
Feature learning as alignment: a structural property of gradient descent in non-linear neural networks
por: Beaglehole, Daniel, et al.
Publicado: (2024)
por: Beaglehole, Daniel, et al.
Publicado: (2024)
On Exact Bit-level Reversible Transformers Without Changing Architectures
por: Zhang, Guoqiang, et al.
Publicado: (2024)
por: Zhang, Guoqiang, et al.
Publicado: (2024)
Ejemplares similares
-
Mastering Chinese Chess AI (Xiangqi) Without Search
por: Chen, Yu, et al.
Publicado: (2024) -
Implicit Search via Discrete Diffusion: A Study on Chess
por: Ye, Jiacheng, et al.
Publicado: (2025) -
Are aligned neural networks adversarially aligned?
por: Carlini, Nicholas, et al.
Publicado: (2023) -
ChessQA: Evaluating Large Language Models for Chess Understanding
por: Wen, Qianfeng, et al.
Publicado: (2025) -
Diversifying AI: Towards Creative Chess with AlphaZero
por: Zahavy, Tom, et al.
Publicado: (2023)