human-eval

OpenAI推出的LLM代码生成评测基准,含164道手写编程题,以pass@k指标衡量功能正确性

Stars3.4k
Forks464
主语言Python
分类安全与评测
作者openai
LicenseMIT

加载项目详情…