HumanEval
HumanEval是OpenAI发布的、用于评估AI模型Python代码生成能力的基准测试。
1篇文章
最近提及 HumanEval是OpenAI于2021年发布的基准测试,给出函数说明后让模型编写Python函数,并以能否通过单元测试判定对错。它由164道题组成,被广泛用于比较大语言模型的编程能力。
本条目依据AIPOST的文章与广为人知的事实整理。如有错误,请通过更正请求告诉我们。
HumanEval是OpenAI发布的、用于评估AI模型Python代码生成能力的基准测试。
HumanEval是OpenAI于2021年发布的基准测试,给出函数说明后让模型编写Python函数,并以能否通过单元测试判定对错。它由164道题组成,被广泛用于比较大语言模型的编程能力。
本条目依据AIPOST的文章与广为人知的事实整理。如有错误,请通过更正请求告诉我们。
AIPOST是一家报道AI应用方法、AI安全、性能、创业、健康、伦理与行业资讯的AI专业媒体。无需注册即可使用,个人信息的处理方式请参阅隐私政策。