GPT-5.6 系列在 ARC-AGI-3 基准上表现亮眼,其中 Sol 模型性能从 13.3% 提升至 38.3%,输出 Token 减少 6 倍。尽管在官方榜单上 Sol 仅获 7.8%(GPT-5.5 为 0.4%),但最小最便宜的 Luna 模型在 Extra High 设置下达到 84.04%,成本仅 1.33 美元。
GPT-5.6 系列在 ARC-AGI-3 基准上表现亮眼,其中 Sol 模型性能从 13.3% 提升至 38.3%,输出 Token 减少 6 倍。尽管在官方榜单上 Sol 仅获 7.8%(GPT-5.5 为 0.4%),但最小最便宜的 Luna 模型在 Extra High 设置下达到 84.04%,成本仅 1.33 美元。