多名曾供职于 Google DeepMind、OpenAI 和 Anthropic 的研究人员出于安全顾虑离开前沿实验室,部分人转向独立评测机构。此前,他在 DeepMind 从事模型可解释性与对齐研究,也收到过 OpenAI 和 Anthropic 的工作邀请,但仍决定前往独立评测机构 METR。后来,他暂停博士阶段的研究,进入 DeepMind 的 AGI 安全团队,继续从可解释性和监督角度研究强大 AI 系统的潜在风险。
多名曾供职于 Google DeepMind、OpenAI 和 Anthropic 的研究人员出于安全顾虑离开前沿实验室,部分人转向独立评测机构。此前,他在 DeepMind 从事模型可解释性与对齐研究,也收到过 OpenAI 和 Anthropic 的工作邀请,但仍决定前往独立评测机构 METR。后来,他暂停博士阶段的研究,进入 DeepMind 的 AGI 安全团队,继续从可解释性和监督角度研究强大 AI 系统的潜在风险。