💻 Coding · llm-stats.com

HumanEval

Function-level Python completion, the classic code-generation benchmark.

1
جانچے گئے ماڈلز
GPT-5
سرکردہ ماڈل
93.4%
بہترین اسکور
OpenAI
فراہم کنندہ
#ماڈلHumanEvalفراہم کنندہPodium Score
1
GPT-5
OpenAI
93.4%
OpenAI23.0
بینچ مارک ڈیٹا llm-stats.com سے مرتب۔ مزید جانیں طریقہ کار میں۔