2026년 추적 모델의 출력 가격은 $0.28/M 토큰(DeepSeek V4 Flash)부터 $50/M(Claude Fable 5)까지 — 178배의 격차입니다. 가성비 랭킹 데이터로 시장이 실제로 어떻게 나뉘는지 봅니다.
세 가지 가격대
- 유틸리티 대 (< $1/M 출력): DeepSeek V4 Flash($0.28), Hunyuan Hy3($0.56), DeepSeek V4 Pro와 MiMo V2.5 Pro($0.87). 분류, 추출, 대량 에이전트에 충분한 속도와 지능.
- 워크호스 대 ($1–10/M 출력): GPT-5.6 Luna($1.2), Kimi K3, 중급 Gemini 모델. 대부분의 프로덕션 워크로드가 여기에 속합니다.
- 프런티어 대 ($25–50/M 출력): Claude Opus 5($25), GPT-5.6 Sol($30), Claude Fable 5($50). 마지막 벤치마크 10–15점을 위해 지불하는 구간입니다.
지능 포인트당 가격
출력 가격을 Podium Score로 나누면 그림이 달라집니다: Kimi K3는 워크호스 가격으로 83.3점을 제공하는 반면, 프런티어 대는 한 자릿수 향상에 10–30배를 청구합니다. 가치 랭킹이 정확히 이것 — API 가격과 결합한 달러당 지능 — 을 정렬합니다.
에이전트에겐 입력 토큰이 중요
에이전틱 워크로드는 출력보다 입력 토큰을 10–50배 더 소모합니다. GPT-5.6 Luna(입력 $0.2/M)나 DeepSeek V4 Flash(입력 $0.14/M) 같은 모델은 장문맥 에이전트에 비정상적으로 저렴합니다. 선택 전 장문맥 랭킹을 확인하세요.
결론
단일 "저렴한" 정답은 없습니다 — 작업 유형마다 저렴한 대가 있습니다. 비교 페이지에서 어떤 모델이든 실시간 가격을 비교하세요.