💻 Coding · llm-stats.com

HumanEval

Function-level Python completion, the classic code-generation benchmark.

1
পরীক্ষিত মডেল
GPT-5
শীর্ষ মডেল
93.4%
সেরা স্কোর
OpenAI
প্রদানকারী
#মডেলHumanEvalপ্রদানকারীPodium Score
1
GPT-5
OpenAI
93.4%
OpenAI23.0
বেঞ্চমার্ক ডেটা llm-stats.com থেকে সংকলিত। আরও জানুন পদ্ধতিতে