multimodal Multimodal · llm-stats.com

MMMU

Massive Multi-discipline Multimodal Understanding with college-level image reasoning.

5
Modelli testati
Qwen3.6 Plus
Modello di punta
86%
Punteggio migliore
Alibaba
Provider
#ModelloMMMUProviderPodium Score
1
86%
Alibaba32.4
2
GPT-5.1
OpenAI
85.4%
OpenAI42.3
3
GPT-5
OpenAI
84.2%
OpenAI23.0
4
83.9%
Alibaba22.0
5
o3
OpenAI
82.9%
OpenAI32.0
Dati benchmark aggregati da llm-stats.com. Vedi Metodologia.
0 / 4