추적 중인 AI 연구소
OpenAIAnthropicGoogle DeepMindMeta AIxAIDeepSeekMistral AIMoonshot AIAlibaba CloudCohereMicrosoftAmazonZhipu AIBaiduOpenAIAnthropicGoogle DeepMindMeta AIxAIDeepSeekMistral AIMoonshot AIAlibaba CloudCohereMicrosoftAmazonZhipu AIBaidu
01 · Real-Time Rankings

최상위 모델

전체 보기 →

Podium 종합 점수 기준 Top 10 모델

전체 보기 →
#모델명Podium Score아레나 Elo코딩속도가격 (출력)
01
Claude Mythos Preview
Anthropic · Proprietary
97.4
80.980 t/s$15/M
02
Claude Fable 5
Anthropic · Proprietary
93.4
150984.171 t/s$50/M
03
Claude Fable 5.1
Anthropic · Proprietary
88.4
95.585 t/s$15/M
4
GPT-6 Astra
OpenAI · Proprietary
86.2
149867.282 t/s$50/M
5
Kimi K3
Moonshot AI · Open Weights
83.3
148561.537 t/s$15/M
6
Claude Opus 5
Anthropic · Proprietary
81.4
149270.460 t/s$25/M
7
GPT-5.6 Sol
OpenAI · Proprietary
80.8
148364.872 t/s$30/M
8
Qwen3.8 Max
Alibaba · Proprietary
79.8
149650.355 t/s$2/M
9
Claude Opus 4.8
Anthropic · Proprietary
76.0
148458.050 t/s$15/M
10
Claude Opus 4 6 Thinking
Anthropic · Unknown
75.0
50 t/s$15/M
02 · Evaluation Domains

용도별 최적 모델

전체 보기 →
03 · Research & Analysis

최신 아티클

전체 아티클

오픈 AI 인텔리전스 플랫폼

워크플로에 완벽한 모델을 찾아보세요.

추적 중인 700개 모델의 정확도, 토큰 가격, 지연시간, 실제 에이전트 성능을 몇 초 만에 비교하세요.

04 · FAQ

자주 묻는 질문

전체 FAQ
각 모델은 Podium Score(0–100)를 받습니다: 사용자 블라인드 테스트 아레나 Elo 35%, 벤치마크 평균 30%, Artificial Analysis 지능 지수 20%, LLM Stats 점수 15%의 가중치를 종합하여 산출합니다.
현재 Claude Mythos Preview이(가) 97.4점으로 선두이며, Claude Fable 5(93.4점)와 Claude Fable 5.1(88.4점)가 뒤를 잇고 있습니다.
700개 주요 플래그십 모델을 18개 카테고리(코딩, 수학, 추론, 에이전트, 지식, 멀티모달, 긴 컨텍스트, 속도, 가성비, 오픈 웨이트)별로 추적하며, 726개 모델의 전체 아레나 표도 제공합니다.
5개의 공개 리더보드(Arena.ai, Artificial Analysis, LLM Stats, Vellum Leaderboard, LLMBase)에서 매주 정기 업데이트됩니다.
0 / 4