主要用于评估 AI 模型在生物学计算任务中的真实研究能力,重点衡量模型面对杂乱数据时的分析判断、方法选择,以及研究结果是否足以支撑后续决策。具体来看,GeneBench-Pro 基准测试任务覆盖基因组学、定量生物学和转化医学等多个方向,总共包含 129 道题目,分布在 10 个大领域和 21 个子领域,涵盖范围包括统计遗传学、群体遗传学、功能基因组学、蛋白质组学等,每道题都会给模型一份接近真实科研环境的数据集,以及简短的实验背景说明和一个与后续决策相关的目标问题。
OpenAI 推出 GeneBench-Pro 基准测试,用于评估 AI 模型生物学计算能力
隐藏内容,支付积分阅读
已有90人购买此隐藏内容
隐藏内容,支付费用阅读
¥
已有86人购买此隐藏内容
隐藏内容,仅限以下用户组阅读
隐藏内容,登录后阅读
登录之后方可阅读隐藏内容
隐藏内容,评论后阅读
请在下面参与讨论之后,方可阅读隐藏内容
隐藏内容,加入AI圈子后阅读
您需要加入AI圈子之后才能查看帖子内容
您猜对了答案,下面是向您展示的隐藏信息:
[]
[¥]
向
提问:
隐藏内容,猜对答案后阅读
猜错啦:您选中的是「」,正确答案是:「」
多选人参与投票
单选人参与投票
PK人参与PK
·已选
已选·
投票后查看结果,您的选择是?
思想因碰撞产生火花,真理因辩论获得升华
热门评论
:
请先登录!
图片审查中...
登录之后回答问题,请先登录!
编辑答案:
我的回答:
最多上传一张图片和一个附件
x


