GPT-5.6 被抓现行 偷教 AI 瞒报撒谎,OpenAI 曝光 6 起失控实录

就在今天,OpenAI 第一次建立了一套专门追踪、调查和公开披露 GPT”对齐失效”的机制。六个案例里,最值得一看的一个,直接发生在 GPT-5.6 Sol 训练期间。甚至,在监控统计中,GPT-5.6 Sol 有高达 2.15% 的摘要里,都带这种”教唆欺瞒”的倾向。

原文连接