GeminivsPhi

Comparing Google and Microsoft. Average Podium Score across top models: Gemini (72.8) vs Phi (58.4). Flagship showdown: Gemini 3.1 Pro Preview (74.0) vs Phi 3 Medium 4k Instruct (60.0).

Gemini (Google)

Native multimodal models with massive context windows from Google DeepMind.

Avg Score: 72.8
Licensing: Proprietary API

Phi (Microsoft)

Highly capable Small Language Models (SLMs) from Microsoft Research.

Avg Score: 58.4
Licensing: Open Weights Available

Top Models Showdown

RankModelLabScoreCodingReasoningSpeedPrice / 1M
#1Gemini 3.1 Pro PreviewGoogle74.050 t/s$5/M
#2Gemini 3.5 Flash HighGoogle74.050 t/s$5/M
#3Gemini 3.5 Flash MediumGoogle74.050 t/s$5/M
#4Gemini 3.1 Flash Lite PreviewGoogle72.050 t/s$5/M
#5Gemini 2.5 Flash Preview 09 2025Google70.050 t/s$5/M
#6Phi 3 Medium 4k InstructMicrosoft60.050 t/s$3/M
#7Wizardlm 70bMicrosoft59.050 t/s$3/M
#8Phi 3 Small 8k InstructMicrosoft59.050 t/s$3/M
#9Wizardlm 13bMicrosoft57.050 t/s$3/M
#10Phi 3 Mini 4k Instruct June 2024Microsoft57.050 t/s$3/M
0 / 4 Models Selected