该初创公司发布了一个名为 SciUniverse 的基准,用于测试模型能否在真实实验室里工作。结果发现,模型虽然很懂科学理论,却在实际操作中频繁遗漏关键细节。它并未声称模型能独自搞定所有动手的活,这个区别划出了实际测试的边界:要测的是模型能否可靠地把一个研究目标转化为人和机器都能照着做的实验步骤,最后再用实验结果指导下一步决策。一些行业内其他动向也值得留意,比如 Insilico Medicine 公司宣布在其 AI 驱动的全机器人药物发现实验室里部署了第一台双足人形机器人,能够用于数据采集和生成,训练具身 AI 系统地学习人类实验室科学家的技能。

