花了半年等 Fable 5 降价?Anthropic 直接甩出了更狠的一手。Opus 5 在编程、复杂推理和 Agent 任务上逼近 Fable 5 的表现,价格一刀砍半。更低成本、更高效率,还默认开启了思考模式,这次的 Opus 升级不是挤牙膏,是直接换赛道。
产品概述
Claude Opus 5 是 Anthropic 在 2026 年 7 月 24 日发布的新一代旗舰大模型,定位为日常高频使用的高性价比旗舰。它延续了 Opus 系列的定价(输入每百万 Token 5 美元、输出 25 美元),性能却大幅跃进,在多项基准测试中追平甚至超越了价格两倍的 Fable 5。Anthropic 对它的定位非常明确:不是替代 Fable 5 的顶级模型,而是让大多数开发者和企业用更少成本,拿到接近顶级的智能。Opus 5 现已成为 Claude Max 订阅的默认模型,也是 Claude Pro 中最强的选择。
跟前代 Opus 4.8 相比,Opus 5 的核心变化不是堆参数,而是改思考方式。它默认开启 Adaptive Thinking,模型会自己判断什么时候需要深度思考、思考多久,用户通过 Effort 档位调节深度即可。API 模型名为 claude-opus-5,同步在 Claude.ai、Claude Code、Claude Cowork 等平台上线。Anthropic 工程师甚至把 Claude Code 的系统提示词删了 80%,跑分没掉,模型自身的判断力替代了人工规则。
官网:https://www.anthropic.com/news/claude-opus-5 | API 文档:https://platform.claude.com/docs/en/about-claude/models

核心功能实测
把产品背景消化完,接下来逐个看看 Opus 5 到底把力使在了哪些关键能力上。能力升级不是平均撒网,而是集中在编程、Agent 自主性和视觉输出三个方向上做了肉眼可见的提升。以下分解几个最值得关注的功能点。
**智能思考(Adaptive Thinking)**是 Opus 5 架构层面最大的变化。模型在每次对话回合中自主决定思考深度,用户只需设置 Effort 档位(low / high / xhigh / max),高档次给更强智能,低档次更快更省 Token。在交易基准测试中,Opus 5 消耗的推理 Token 只有 Opus 4.8 的约七分之一,延迟不到一半,结果反而更好。
自我校验与迭代能力是这代最让开发者兴奋的地方。Opus 5 不仅写代码,还会自己检查、自己修。一次测试中,它被要求根据机械零件图纸在 FreeCAD 中重建 3D 模型,系统没给直接看图权限,它自己写了一套计算机视觉管线从像素提取几何数据,完成任务。其他模型 5 次尝试全部失败。另一个案例里,它找到了一个开源包管理器中社区补丁遗漏的边缘情况 Bug,而竞品模型只修复了表面症状就报告完成。

大幅增强的视觉输出让 Opus 5 不只是文本模型。用户可以用自然语言让模型生成可交互的 3D 风洞模拟、动物细胞结构图,甚至完整的小游戏。这不是传统意义上的“多模态生成”,而是模型通过写代码(HTML/CSS/Three.js/WebGL)来创建可操作的视觉产物。网友测试的 Minecraft 复刻、弹弓攻城 3D 场景、滑雪游戏,细节密度远超此前任何 Claude 模型。
对话中途工具变更(Beta)是面向开发者的重要 API 升级。开发者可以在一次会话中动态增删 Claude 可调用的工具,Prompt 缓存不会失效。这对 Agent 开发场景意义重大:以前锁定工具列表不敢动,现在可以按任务阶段灵活切换。搭配 API 自动降级功能,被安全分类器拦截的请求自动回退到 Opus 4.8,而不是直接报错,开发体验平滑了不少。
| 核心特性 | Opus 5 | Opus 4.8 | 提升幅度 |
|---|---|---|---|
| 默认思考模式 | 自适应(Adaptive) | 需要手动开启 | 架构升级 |
| 推理 Token 消耗 | 约 1/7 | 基准 | 效率 7x↑ |
| Frontier-Bench 编程 | 超越所有对手 | 基准 | ≥2x↑ |
| 视觉输出能力 | 交互式 3D | 基础图表 | 质的飞跃 |
| 对话中改工具 | 支持(Beta) | 不支持 | 新能力 |
上手体验
功能参数看完了,真正的体验到底怎么样?先从入口聊起。Opus 5 不需要额外注册。如果你已经是 Claude Pro 或 Max 订阅用户,模型选择器里直接多了一个选项。API 用户改一行模型名就行:把 claude-opus-4-8 换成 claude-opus-5,代码不用动。
我试的第一件事是让它写一个带卡牌合成系统的 React 小游戏。给了一段比较模糊的需求描述,没指定技术栈细节。Opus 5 先花了大约 15 秒思考,没有像 Fable 5 那样展示思维过程,这部分是藏在后台的。然后直接输出了完整的组件代码和状态逻辑,一次性编译通过,卡牌拖拽和合成动画都正常。换 Opus 4.8 同样需求,要来回改三轮才把合成逻辑调对。
速度感受上,默认模式比 Opus 4.8 明显快,特别是长代码文件输出时。开 Fast 模式后速度再翻约 2.5 倍,适合高频迭代场景。但要注意 Fast 模式价格也是两倍,输入输出分别是 10 美元和 50 美元每百万 Token,用得爽但钱包疼。
一个意外的发现是 Opus 5 在低努力档位(low)的表现。社区反馈和我的测试一致:Opus 5 的 low 档在很多日常任务上已经超过 Opus 4.8 的 high 档,甚至压过 Sonnet 5 的 high 档,消耗的 Token 反而更少。这意味着很多任务不需要开最高档,把 Effort 调到 low 或 high 就够用,性价比极高。
使用技巧
基础跑通了,下面这几招能让你把 Opus 5 的性价比拉到极致。
很多人不知道 Opus 5 的正确用法不是无脑开 Max。几条实测有效的技巧:
-
低 Effort 起步:日常代码补全、文案润色、简单问答全部用 low 档。效果已经超过 Opus 4.8 的 high 档,Token 消耗却少得多。只有遇到复杂 Bug 追踪或多文件重构才调到 xhigh 或 max。 -
Prompt 写法大幅简化:Anthropic 工程师发现 Opus 5 不再需要长篇系统提示词,Claude Code 的系统提示词被删了 80% 性能没降。给目标 + 约束就够了,不要写一堆“你应该怎么做”的规则。 -
利用对话中途换工具:Agent 场景下,不同阶段需要不同工具集。前期用 WebSearch 和文件读取,后期切换到代码执行和部署。Opus 5 支持中途增删工具而不清缓存,一次会话从头跑到尾。 -
批量 API 省一半:非实时任务走 Batch API,输入 $2.50/MTok、输出 $12.50/MTok,比实时 API 直接打五折。适合大批量代码审查、文档生成、数据标注等场景。 -
Promp t缓存必须开:Opus 5 的缓存最低门槛从 1024 Token 降到了 512 Token。以前太短的 Prompt 缓存不了,现在几乎任何多轮对话都能命中缓存,读取成本只要 $0.50/MTok。
竞品对比
参数纸上够好,拉出来跟主要对手比一圈才看得出它到底站在哪个位置。
当前旗舰大模型赛道已经分化出三个方向:GPT-5 走统一路由、Gemini 2.5 Pro 走深度思考和多模态、Fable 5 走极致智能。Opus 5 的策略不是硬刚任何一方的长板,而是做一张覆盖面积最大的牌。

| 对比维度 | Claude Opus 5 | Claude Fable 5 | GPT-5 | Gemini 2.5 Pro |
|---|---|---|---|---|
| 输入/输出价格(每 MTok) | $5 / $25 | $10 / $50 | $5-15 / $15-60* | $3.50 / $10.50* |
| 上下文窗口 | 1M | 1M | 128K | 1M |
| 最大输出 | 128K | 128K | 128K | 64K |
| 编程(Frontier-Bench) | SOTA | 次优 | 未公布 | 未公布 |
| Agent 自主性 | 极强 | 最强 | 强 | 中等 |
| 视觉输出 | 交互式 3D | 基础 | DALL-E 集成 | 最强多模态 |
| 思考模式 | 默认开启 | 强制开启 | 可选 | Deep Think 模式 |
*GPT-5 和 Gemini 2.5 Pro 价格因服务商和使用方式不同有波动范围。
核心差异很清楚:Fable 5 在极端复杂的 Agent 长程任务上仍是最强,但溢价明显。Gemini 2.5 Pro 的多模态理解和视频分析独一档,编程不如 Opus 5。GPT-5 最全面但价格最高。Opus 5 的卡位精准,编程和 Agent 能力逼近 Fable 5,价格只有一半,性价比在这个赛段里没有直接对手。
用户反馈
官方数据都说好,上线第一天社区的真实反应才见真章。Opus 5 上线不到 24 小时,Reddit 和 Twitter 上的讨论已经炸了。好评集中在三个点上:低档位表现远超预期、视觉生成能力刷新认知、性价比太香。
一位每天做 3 到 4 次重复任务跑了两多月对比的 Reddit 用户总结说:Opus 5 的 low 和 medium 档位已经压过了 Sonnet 5 High 和 Opus 4.8 High,而且 Token 消耗更少、来回对话更少。另一个高频用户的周订阅额只涨了约 2%,Agent 负载反而更重了。
3D 场景测试更是直接炸出了 这不像代码生成,像把提示词直接丢进了图像生成器 的感叹。博主 OmedTheVibeCoder 说 Opus 5 Max 直接打破了他的测试标准,竞技场对决画面根本不是接近 Fable 5,是甩开了。博主 am.will 用不到 30% 的 Max 额度就搭出了一个完整可玩的 Rocket League 克隆版。
负面声音也没有缺席。两个用户独立反馈中文内容偶尔混入乱码(stray Chinese characters)。TypeScript 项目中出现 Opus 4.8 不会出的首编错误。思维链不再可见,排错时看不到模型的推导过程,对习惯了 Fable 5 透明思考的用户是个退步。还有人在 Open-ended 创意写作场景下发现,自我验证机制在没有标准答案的领域增益不如编程那么大。
多维评分
社区反应看完,拉回到六个固定维度给它一个客观的量化定位。
| 维度 | 评分 | 一句话解读 |
|---|---|---|
| 功能完整性 | ⭐⭐⭐⭐☆ | 编程 + Agent + 视觉三条腿都硬,研究支持偏窄 |
| 易用性 | ⭐⭐⭐⭐⭐ | 升级零成本,Prompt 反而更短,Effort 档位直观 |
| 性价比 | ⭐⭐⭐⭐⭐ | 半价追平 Fable 5,低档位就能打,Batch 再省一半 |
| 创新性 | ⭐⭐⭐⭐☆ | 自适应思考 + 视觉代码生成形成壁垒,非原创赛道 |
| 稳定性 | ⭐⭐⭐⭐☆ | 首日偶发乱码和首编错误,整体可控但需观察 |
| 推荐度 | ⭐⭐⭐⭐⭐ | 开发者闭眼入,企业可以等两周稳定性报告 |
综合评分:8.7 / 10
优缺点
优势
-
半价 Fable 5 级编程能力:Frontier-Bench 得分超所有对手,CursorBench 距离 Fable 5 峰值只差 0.5%,单任务成本差一倍 -
自我纠错和根因分析:不像旧模型修表层症状,Opus 5 能定位深层 Bug 并补上边缘情况 -
低档位即打高档:low/medium 档的日常任务表现已碾压 Opus 4.8 high 档,Token 消耗反而更少 -
视觉生成惊艳:通过代码生成的交互式 3D 场景,已经模糊了文本模型和视觉工具的边界 -
升级零摩擦:同样的 API 调用、同样的价格、同样的接口,只改一个模型名
不足
-
思维链不可见:推理过程隐藏在后台,排错和审计体验不如 Fable 5 透明 -
中文偶发乱码:首日上线有用户报告回复中混入中文乱码,可能跟训练数据有关 -
创意写作增益有限:在 Open-ended 和无标准答案的任务上,自我验证机制加不了多少分 -
安全限制仍存在:网络安全相关请求会被回退到 Opus 4.8,纯进攻性研究不如 Mythos 5
适用人群
优缺点看完了,下面帮你对号入座,看看自己属不属于 Opus 5 的目标用户。
-
软件工程师和独立开发者:编程和 Debug 是 Opus 5 的王牌场景,低档位即够用,日均 Token 成本可能比 Sonnet 5 还低。Cognition 和 Cursor 团队已给它背书。 -
AI Agent 开发者:MCP 协议原生支持 + 对话中途换工具 + 自我迭代校验,Agent 开发三件套配齐。Zapier 实测 100% 完成端到端客户流失预防流程。 -
科研人员(尤其生命科学):有机化学涨 10.2 个百分点、蛋白质预测涨 7.7 个百分点,Opus 5 是目前可用于科研的最强通用模型之一。 -
Claude Pro/Max 订阅用户:Max 默认模型就是它,Pro 最强也是它。不用额外掏钱就能完成升级,没理由不切过来。 -
不太适合:追求极致的 Agent 长程任务用户:如果你的工作流高度依赖模型在 8 小时以上的持续自主执行,Fable 5 在极端长程上的稳定性仍然领先。创意写作重度用户也值得观望,Opus 5 的风格控制在这个场景下比 Fable 5 少了一截个性。
定价方案
能力是这个水平的,那花多少钱能拿到手?下面是各消费场景的实际账单。
| 计费方式 | 输入(每 MTok) | 输出(每 MTok) | 适用场景 |
|---|---|---|---|
| 标准 API | $5 | $25 | 日常开发、Agent 调用 |
| 快速模式(Fast) | $10 | $50 | 高频迭代、交互式编程 |
| 批量 API(Batch) | $2.50 | $12.50 | 大批量代码审查、数据处理 |
| 提示缓存读取 | $0.50 | — | 多轮对话、固定上下文 |
以上价格为截至 2026 年 7 月 25 日 Anthropic 官方定价。快速模式不支持批量 API。Managed Agents 会话额外收取 $0.08/会话小时。

价格跟 Opus 4.8 完全一样,但能力提升了至少一个量级。跟主要竞品比:Fable 5 要 $10/$50,GPT-5 在 $5-15/$15-60 之间浮动,Gemini 2.5 Pro 约 $3.50/$10.50。Opus 5 的定价没有像竞品那样拉大高价模型的溢价,反而用同样的钱给了翻倍的性能。如果你本来就在用 Opus 4.8 或 Sonnet 5,切换到 Opus 5 不需要涨预算。
常见问题
看完以上所有信息,你可能心里还有几个不确定的点,一一帮你理清。
Q1:Opus 5 和 Fable 5 到底选哪个?
A1:预算敏感选 Opus 5,极致长程 Agent 选 Fable 5。 Opus 5 在日常编程和推理任务上已逼近 Fable 5,价格只有一半。Fable 5 的优势主要在于持续数小时的复杂 Agent 任务和极端推理场景,日常差距很小。
Q2:Opus 5 支持中文吗?
A2:支持中文,但偶有乱码bug。 Opus 5 的多语言能力覆盖中英文,编程场景的中英文混合需求没问题。不过上线首日有用户反馈回复中偶见中文乱码混入,推测为早期 bug,预计后续修复。
Q3:Opus 5 的上下文窗口多大?
A3:100 万 Token,与前代一致。 1M 上下文窗口是默认值也是最大值,没有更小的变体。单次输出最高 128K Token,Batch API 可扩展到 300K Token。
Q4:需要额外付费才能用吗?
A4:Max 用户默认免费用,Pro 用户可切换。 Claude Max 订阅已将 Opus 5 设为默认模型,Pro 用户可在模型选择器中切换到 Opus 5。API 价格与 Opus 4.8 完全一致。
Q5:比 Opus 4.8 提升有多大?
A5:编程翻倍、推理效率七倍提升。 Frontier-Bench 得分是 Opus 4.8 的两倍以上,推理 Token 消耗约七分之一,延迟不到一半。Lovable 联合创始人称之为 Opus 自 4.5 以来最大的一次飞跃。
Q6:Opus 5 的思维过程能看到吗?
A6:不能,思维链默认隐藏。 与 Fable 5 展示完整思维过程不同,Opus 5 的 Adaptive Thinking 在后台执行。用户只能通过 Effort 档位间接控制思考深度,排错时无法像 Fable 5 那样追踪推理路径。
Q7:适合做科学研究吗?
A7:是目前可用于科研的最强通用模型之一。 所有生命科学评估优于 Opus 4.8,有机化学和蛋白质任务分别提升 10.2 和 7.7 个百分点。但长期自主研究任务仍有重要局限。
Q8:Fast 模式有必要开吗?
A8:交互式编程场景值得开,常规任务没必要。 Fast 模式速度快约 2.5 倍但价格翻倍。适合需要高频迭代输出的场景。大多数日常任务默认模式已足够快。
Q9:免费用户能用吗?
A9:不能,需付费订阅或 API。 Claude Free 用户暂时无法使用 Opus 5。最低门槛是 Claude Pro 订阅($20/月)或通过 API 按量付费。
Q10:和 GPT-5 比怎么样?
A10:编程碾压,多模态和生态覆盖面各有所长。 Opus 5 在 Frontier-Bench 和 CursorBench 等编程基准上超越 GPT-5。GPT-5 在多模态和生态全面性上更强。二者差异化明显,不存在全面替代。
最终建议
Opus 5 可能是 Anthropic 今年最务实的一次发布。它没有追求参数碾压或营销噱头,而是在性价比和智能水平之间找到了一个极其精准的平衡点。对于每天都在用的开发者来说,一样的价格、翻倍的能力,这比任何跑分数字更有说服力。
当然它不完美。思维链不可见影响排错效率,中文偶发乱码需要修复,创意写作的场景下优势没那么大。但这些问题没有一个会动摇它作为 2026 年最值得用的编程模型这个定位。
建议很直接:如果你已经在 Claude 生态里开发,今天就可以切过来,不需要犹豫。如果你在用 GPT-5 或 Gemini 做编程类工作,白嫖一个 Pro 月费试试 Opus 5 的编程能力,大概率回不去。

