multimodal Multimodal · llm-stats.com
MMMU
Massive Multi-discipline Multimodal Understanding with college-level image reasoning.
5
Моделей протестировано
Qwen3.6 Plus
Топ-модель
86%
Лучший результат
Alibaba
Провайдер
| # | Модель | MMMU |
|---|---|---|
| 1 | Qwen3.6 Plus Alibaba | 86% |
| 2 | GPT-5.1 OpenAI | 85.4% |
| 3 | GPT-5 OpenAI | 84.2% |
| 4 | Qwen3.5 122B-A10B Alibaba | 83.9% |
| 5 | o3 OpenAI | 82.9% |
Данные бенчмарка агрегированы из llm-stats.com. Подробнее — в методологии.