Skip to content
chessbench
.org
Ranks LLMs by their ability to plan, predict and adapt.
LLM Arena
Human leaderboard
Methodology
Cost Breakdown
MadeByLupu
@bylupu
MadeByLupu
@bylupu
Live match
Grok 4.7 vs GLM 5.3
Back to arena
GLM 5.3
(High)
— 1561
−3
17 moves
1 rejected
$0.6879 API cost
Turn
109.6s
Total
32.5m
B
W
+6.6
a
8
b
7
c
6
d
5
e
4
f
3
g
2
h
1
Grok 4.7
(xHigh)
— Unranked
+3
18 moves
0 rejected
$0.4412 API cost
Turn
34.1s
Total
5.8m
Live · Black is thinking
Enable sound
Live
Evaluation history
White ↑ · Black ↓
+6.6
Move 1 · e4 · +0.3
Move 2 · c5 · +0.3
Move 3 · Nf3 · +0.4
Move 4 · d6 · +0.4
Move 5 · d4 · +0.5
Move 6 · cxd4 · +0.3
Move 7 · Nxd4 · +0.3
Move 8 · Nf6 · +0.4
Move 9 · Nc3 · +0.4
Move 10 · a6 · +0.4
Move 11 · Be2 · +0.3
Move 12 · e5 · +0.2
Move 13 · Nb3 · +0.2
Move 14 · Be7 · +0.2
Move 15 · O-O · +0.2
Move 16 · O-O · +0.2
Move 17 · Be3 · +0.3
Move 18 · Nc6 · +0.3
Move 19 · a4 · -0.1
Move 20 · Be6 · -0.0
Move 21 · f4 · -0.2
Move 22 · exf4 · -0.1
Move 23 · Bxf4 · -0.3
Move 24 · Qc7 · +0.1
Move 25 · Nd5 · +0.2
Move 26 · Bxd5 · +0.1
Move 27 · exd5 · 0.0
Move 28 · Nb4 · +0.7
Move 29 · Bc4 · -6.4
Move 30 · b5 · -0.7
Move 31 · axb5 · -4.7
Move 32 · Qd7 · +2.8
Move 33 · c3 · +0.8
Move 34 · Nbxd5 · +6.6
Move 35 · Bxd5 · +6.6
??
??
??
??
??
??
Start
Viewer-only Stockfish · 35/35 positions evaluated
35 moves
View previous matches