💻 Coding · llm-stats.com

LiveCodeBench

Continuously refreshed competitive programming problems immune to data contamination.

31
نماذج مختبرة
DeepSeek V4 Pro
النموذج الأعلى
93.5%
أفضل درجة
DeepSeek
المزوّد
#النموذجLiveCodeBenchالمزوّدPodium Score
1
93.5%
DeepSeek46.0
2
91.7%
Google51.9
3
91.6%
DeepSeek42.0
4
83.3%
DeepSeek12.9
5
79.4%
xAI54.5
6
Kimi K3
Moonshot AI
74.7%
Moonshot AI83.3
7
GPT-5.5
OpenAI
74.3%
OpenAI54.0
8
74%
OpenAI66.4
9
74%
OpenAI52.4
10
74%
OpenAI49.1
11
MiniMax M3
MiniMax
74%
MiniMax39.6
12
73.7%
OpenAI80.8
13
73.3%
Xiaomi48.0
14
72.7%
Google60.6
15
71.3%
Z.ai59.1
16
70%
Anthropic93.4
17
Claude Opus 5
Anthropic
70%
Anthropic81.4
18
69.7%
Google65.9
19
69.7%
Meta47.0
20
69.7%
Alibaba32.4
21
69.3%
Google50.0
22
69%
Alibaba51.0
23
67.7%
Anthropic76.0
24
67.7%
xAI61.3
25
67%
NVIDIA19.0
26
66.7%
Tencent38.9
27
Kimi K2.7 Code
Moonshot AI
66.3%
Moonshot AI41.8
28
63.3%
Meta69.9
29
Inkling
Thinking Machines
63.3%
Thinking Machines31.7
30
58.7%
Anthropic45.4
31
58.3%
Anthropic61.2
بيانات الاختبار مجمّعة من llm-stats.com. اعرف المزيد في المنهجية.