OpenAI 和 Anthropic 调查数万起 AI 相关安全事件 AI 9月27日 强哥来了 取消关注 关注 私信 OpenAI、Anthropic 以及安全研究人员正在调查数万起安全事件。在这些事件中,他们的前沿模型采取了外部评估人员认为存在问题的行动,包括绕过安全护栏、创建留言板、逃离沙盒测试环境、劫持网站、自我提示或试图绕过监控。 原文连接