Качество интеллекта

Индекс качества Podium · Чем выше, тем лучше

Скорость генерации

Токенов в секунду · Чем выше, тем лучше

Стоимость за 1M токенов

Смешанный тариф (3:1) · Чем ниже, тем выгоднее
Отслеживаемые лаборатории
OpenAIAnthropicGoogle DeepMindMeta AIxAIDeepSeekMistral AIMoonshot AIAlibaba CloudCohereMicrosoftAmazonZhipu AIBaiduOpenAIAnthropicGoogle DeepMindMeta AIxAIDeepSeekMistral AIMoonshot AIAlibaba CloudCohereMicrosoftAmazonZhipu AIBaidu
01 · Real-Time Rankings

Топ моделей

Смотреть все →

Топ-10 моделей по общему счёту Podium

Смотреть все →
#МодельPodium ScoreElo ареныКодингСкоростьЦена (вывод)
01
Claude Mythos Preview
Anthropic · Proprietary
97.4
80.980 t/s$15/M
02
Claude Fable 5
Anthropic · Proprietary
93.4
150984.171 t/s$50/M
03
Claude Fable 5.1
Anthropic · Proprietary
88.4
95.585 t/s$15/M
4
GPT-6 Astra
OpenAI · Proprietary
86.2
149867.282 t/s$50/M
5
Kimi K3
Moonshot AI · Open Weights
83.3
148561.537 t/s$15/M
6
Claude Opus 5
Anthropic · Proprietary
81.4
149270.460 t/s$25/M
7
GPT-5.6 Sol
OpenAI · Proprietary
80.8
148364.872 t/s$30/M
8
Qwen3.8 Max
Alibaba · Proprietary
79.8
149650.355 t/s$2/M
9
Claude Opus 4.8
Anthropic · Proprietary
76.0
148458.050 t/s$15/M
10
Claude Opus 4 6 Thinking
Anthropic · Unknown
75.0
50 t/s$15/M
02 · Evaluation Domains

Лучшие по задачам

Смотреть все →
03 · Research & Analysis

Последние статьи

Все статьи

Открытая платформа ИИ-аналитики

Найдите идеальную модель для ваших задач.

Сравните точность, цену за токен, задержку и реальную агентскую производительность среди 700 отслеживаемых моделей за секунды.

04 · FAQ

Частые вопросы

Все FAQ
Каждая модель получает Podium Score (0–100) — взвешенную смесь четырёх сигналов: 35% Elo арены из очных сравнений людьми, 30% среднее по бенчмаркам, 20% индекс интеллекта Artificial Analysis и 15% оценка LLM Stats. Все сигналы нормализованы к общей шкале, поэтому оценка — правдоподобная середина между пятью независимыми лидербордами.
Лидирует Claude Mythos Preview с результатом 97.4. Далее — Claude Fable 5 (93.4) и Claude Fable 5.1 (88.4). Рейтинги меняются еженедельно по мере поступления новых голосов и результатов.
Мы курируем 700 флагманских моделей в 18 категориях (кодинг, математика, рассуждение, агенты, знания, мультимодальность, длинный контекст, скорость, цена/качество и открытые веса), плюс полная таблица арены на 726 моделей.
Из пяти публичных лидербордов: Arena.ai, Artificial Analysis, LLM Stats, Vellum Leaderboard, LLMBase. Каждый источник синхронизируется еженедельно; точная формула — на странице методологии.
0 / 4
Сравнить →