Sonnet 5.5 的变化,恰好把问题推到了 Agent runtime 本身:为什么更强的前置规划能够减少 Tool Call,批量工具调用到底压缩了什么,以及 effort 增加的 test-time compute,什么时候能减少后续执行,什么时候反而会把执行图越做越大。聊天模型的一次请求结束以后,当前计算基本结束,但 Agent 不一样,它需要持续维护一个会变化的工作状态,其中包括用户目标、已经验证过的假设、工具返回、代码改动、环境状态以及尚未解决的问题。Sonnet 5.5 带来的变化,最终还是落在同一个工程问题上:如何把更多计算放到真正能消除后续执行成本的位置,而不是让 Agent 用更多 reasoning 去制造更大的执行图。

