💻 Coding · llmbase.ai

SciCode

Scientific coding problems requiring domain knowledge and multi-function solutions.

31
Modelos testados
Claude Fable 5
Modelo principal
60.2%
Melhor pontuação
Anthropic
Provedor
#ModeloSciCodeProvedorPodium Score
1
60.2%
Anthropic93.4
2
59%
Google60.6
3
Kimi K3
Moonshot AI
58.7%
Moonshot AI83.3
4
58.2%
Meta69.9
5
56.1%
OpenAI80.8
6
GPT-5.5
OpenAI
56.1%
OpenAI54.0
7
56.1%
Google51.9
8
Claude Opus 5
Anthropic
55.7%
Anthropic81.4
9
54.1%
xAI61.3
10
53.9%
OpenAI66.4
11
53.5%
Anthropic76.0
12
53.5%
Alibaba51.0
13
53.2%
OpenAI52.4
14
53.1%
Google50.0
15
52.7%
Google65.9
16
52.5%
OpenAI49.1
17
Kimi K2.6
Moonshot AI
52.2%
Moonshot AI49.0
18
51.5%
Meta47.0
19
51.3%
Alibaba42.2
20
50.5%
Z.ai59.1
21
50.2%
Xiaomi48.0
22
49.9%
DeepSeek42.0
23
48.6%
Anthropic45.4
24
47.6%
Tencent38.9
25
Kimi K2.7 Code
Moonshot AI
47.5%
Moonshot AI41.8
26
Inkling
Thinking Machines
46.1%
Thinking Machines31.7
27
45.7%
Anthropic61.2
28
MiniMax M3
MiniMax
45.4%
MiniMax39.6
29
42.4%
DeepSeek46.0
30
40.7%
Alibaba32.4
31
39.9%
NVIDIA19.0
Dados de benchmark agregados de llmbase.ai. Saiba mais na metodologia.