OpenAI Blog
OpenAI 发布了 LifeSciBench,一个由专家编写和审核的基准测试,用于评估 AI 系统处理真实生命科学研究任务的能力
AI 摘要
OpenAI 发布了 LifeSciBench,这是一个由领域专家编写和审核的基准测试,旨在评估 AI 系统处理真实生命科学研究任务与决策的能力。该基准对开发者而言,提供了更贴近实际科研场景的评测标准,有助于推动 AI 在生命科学领域的应用与改进。
推荐理由高信息密度,值得细读
原文
无法获取正文,可打开下方原始链接查看。
LifeSciBench基准测试生命科学AI评估71/100
讨论
暂无评论。