清华大学人工智能学院助理教授陈勇超联合全球科学家团队,携手麻省理工学院、哈佛大学、卡内基梅隆大学、中国科学技术大学、微软研究院等十余所机构开发了名为 ASI-Bench 的全新测试基准,旨在测量 AI 在科研任务中的自主能力。该基准通过逐步减少人类提供的方法和操作步骤,观察 AI 的能力从何处开始下降,以评估其对人类研究方法的依赖程度。
清华大学人工智能学院助理教授陈勇超联合全球科学家团队,携手麻省理工学院、哈佛大学、卡内基梅隆大学、中国科学技术大学、微软研究院等十余所机构开发了名为 ASI-Bench 的全新测试基准,旨在测量 AI 在科研任务中的自主能力。该基准通过逐步减少人类提供的方法和操作步骤,观察 AI 的能力从何处开始下降,以评估其对人类研究方法的依赖程度。