Grok 4.20 Beta1vsKimi K2.5 Thinking
Grok 4.20 Beta1 guida il Podium Score complessivo con 1.0 punti di vantaggio (74.0 vs 73.0). Vittorie per categoria: Grok 4.20 Beta1 0 — 0 Kimi K2.5 Thinking. Kimi K2.5 Thinking è la scelta più economica ($3/M vs $15/M per 1M di token di output). Grok 4.20 Beta1 è più veloce (50 t/s vs 50 t/s).
| Metrica | Grok 4.20 Beta1 | Kimi K2.5 Thinking |
|---|---|---|
| Podium Score | 74.0 ▲ | 73.0 |
| Arena Elo | — | — |
| Indice di intelligenza | — | — |
| Coding | — | — |
| Matematica | — | — |
| Reasoning | — | — |
| Agentico | — | — |
| Conoscenza | — | — |
| Multimodale | — | — |
| Contesto lungo | — | — |
| Velocità di output | 50 t/s | 50 t/s |
| Prezzo di output | $15/M | $3/M ▲ |
| Finestra di contesto | 128K | 128K |
Punteggi aggregati da cinque classifiche il 2026-08-05. Vedi Metodologia. Altri testa a testa: Grok 4.20 Beta1 vs Claude Mythos Preview · Grok 4.20 Beta1 vs Claude Fable 5 · Grok 4.20 Beta1 vs Kimi K3 · Grok 4.20 Beta1 vs Claude Opus 5