💻 Coding · llm-stats.com

HumanEval

Function-level Python completion, the classic code-generation benchmark.

1
نماذج مختبرة
GPT-5
النموذج الأعلى
93.4%
أفضل درجة
OpenAI
المزوّد
#النموذجHumanEvalالمزوّدPodium Score
1
GPT-5
OpenAI
93.4%
OpenAI23.0
بيانات الاختبار مجمّعة من llm-stats.com. اعرف المزيد في المنهجية.