GPT、Claude 遭遇「窃听门」:换个模型就能让思维链不再隐身?

昨日,X 用户 @kotekjedi_ml 公布了一组反常实验:Claude、GPT 和 Gemini API 中原本不向用户展示的隐藏推理过程,被研究人员重新恢复成了可读文本。研究人员不再尝试让强模型自己交出思维链,而是将其留下的加密推理交给一个更容易被绕过的兼容模型,让后者把已加载的内容转录出来。这意味着只需调用最便宜的模型就能镜像出顶级模型的思维轨迹,闭环大厂对推理数据的垄断也将被打破。

原文连接