coding Coding · llm-stats.com

LiveCodeBench

Continuously refreshed competitive programming problems immune to data contamination.

48
テスト済みモデル
DeepSeek V4 Pro
トップモデル
93.5%
トップスコア
DeepSeek
プロバイダー
#モデルLiveCodeBenchプロバイダーPodium Score
1
93.5%
DeepSeek46.0
2
91.7%
Google51.9
3
91.6%
DeepSeek42.0
4
83.3%
DeepSeek12.9
5
79.4%
xAI54.5
6
76.2%
OpenAI86.2
7
Kimi K3
Moonshot AI
74.7%
Moonshot AI83.3
8
GPT-5.5
OpenAI
74.3%
OpenAI54.0
9
74%
OpenAI66.4
10
74%
OpenAI52.4
11
74%
OpenAI49.1
12
MiniMax M3
MiniMax
74%
MiniMax39.6
13
73.7%
OpenAI80.8
14
73.3%
Xiaomi48.0
15
72.7%
Google60.6
16
71.3%
Z.ai59.1
17
70%
Anthropic93.4
18
Claude Opus 5
Anthropic
70%
Anthropic81.4
19
69.7%
Google65.9
20
69.7%
Meta47.0
21
69.7%
Alibaba32.4
22
69.5%
Alibaba66.8
23
69.3%
Google50.0
24
69%
Alibaba51.0
25
68%
DeepSeek54.5
26
67.7%
Anthropic76.0
27
67.7%
xAI61.3
28
67%
NVIDIA19.0
29
66.7%
Tencent38.9
30
66.5%
Z.ai64.2
31
Kimi K2.7 Code
Moonshot AI
66.3%
Moonshot AI41.8
32
63.3%
Meta69.9
33
Inkling
Thinking Machines
63.3%
Thinking Machines31.7
34
58.7%
Anthropic45.4
35
58.3%
Anthropic61.2
36
58%
IBM58.6
37
57%
Z.ai46.0
38
57%
Anthropic0.0
39
55%
MiniMax45.0
40
45%
IBM49.2
41
43%
Mistral35.0
42
41%
Anthropic24.1
43
39%
Amazon14.4
44
37%
OpenAI30.0
45
36%
IBM42.0
46
28%
Upstage23.0
47
27%
OpenAI22.0
48
27%
K222.0
ベンチマークデータは llm-stats.com から集計。詳細は方法論
0 / 4