硅基参考
首页
机器人产品
零配件
评测
论文
开源
数据集
实验室组织
专家人物
行业资讯
分享
具身数据集库
HumanEval
数据
HumanEval
OpenAI 发布的 164 道 Python 编程题基准,以 pass@k 评估大模型代码生成能力。
返回列表
项目主页
查看来源
数据集
主体信息
OpenAI 发布的 164 道 Python 编程题基准,以 pass@k 评估大模型代码生成能力。
资源
下载与入口
数据集主页