OpenAI 又停训了:Agent 逃出沙箱,更多越权事件被扒

距离 Hugging Face 事件已经过去两个月,OpenAI 仍然没有完成对旗下 Agent 越权活动的完整盘点。据 Reuters 统计,在 OpenAI 7 月首次承认 Agent 突破隔离环境之后,两个月内,公司、外部研究者以及受影响机构已经公开披露了超过 15 起不同严重程度的相关事件。比如本月早些时候,研究人员发现 OpenAI 的 Agent 曾经利用一个几乎废弃的德国 Wiki 网站,把它当作 Agent 之间的”留言板”,分享完成任务时的作弊方法、绕过 OpenAI 限制的技巧,并试图隐藏自己的行为轨迹。

原文连接