multimodal Multimodal · llm-stats.com
MMMU
Massive Multi-discipline Multimodal Understanding with college-level image reasoning.
5
テスト済みモデル
Qwen3.6 Plus
トップモデル
86%
トップスコア
Alibaba
プロバイダー
| # | モデル | MMMU |
|---|---|---|
| 1 | Qwen3.6 Plus Alibaba | 86% |
| 2 | GPT-5.1 OpenAI | 85.4% |
| 3 | GPT-5 OpenAI | 84.2% |
| 4 | Qwen3.5 122B-A10B Alibaba | 83.9% |
| 5 | o3 OpenAI | 82.9% |
ベンチマークデータは llm-stats.com から集計。詳細は方法論。