SpaceXAI 刚刚发布 Grok 4.7——用于编码和知识工作的最强大模型。

01 主要改进
● 使用了一个新的、更大的基础模型
● 在更难的、多小时任务上训练更长时间
● 更好地验证自己的答案
● 改进了长上下文性能
● 在文档和演示文稿方面更好
● 原生理解 Grok Bot 系统
● 更强的安全性和越狱保护
02 基准测试结果
| 基准测试 | Grok 4.7 | Grok 4.6 |
| CursorBench 4.0 | 46.3% | 40.4% |
| DeepSWE v1.1 | 71.0% | 65.2% |
| AA Briefcase v1.1 | 1,657 | 1,546 |
| Terminal-Bench 4.0 | 38.0% | 20.3% |
| Harvey Legal Benchmark | 19.6% | 15.8% |
| HealthBench Professional | 56.7% | 48.5% |
| EEBench | 64.0% | 53.0% |
Grok 4.7 在列出的法律和电气工程基准测试中,得分也高于 GPT-5.6 Sol 和 Fable 5.1。
03 安全改进
● 在 LatchBio 的生物安全基准测试中得分为 62.4%
● 在 HackerBench 上,只有 3.3% 的高风险网络提示通过
● SpaceXAI 迄今为止拒绝危险请求的最强模型
● 很少阻止合法的网络安全工作
● 选定的安全合作伙伴正在获得仅邀请的红队访问权限
04 定价与可用性
| 计费项 | 价格 |
| 每百万输入token | $2 |
| 每百万输出token | $6 |
与 Grok 4.6 相同的基础价格;快速版本以双倍价格提供双倍输出速度。
现在可在 Cursor、Grok Build 和 Grok API 中使用,也可通过编码工具、模型路由器和云平台使用。
05 总结
SpaceXAI 表示,Grok 4.7 的速度是类似模型的两倍,价格是一半。
它在每个列出的基准测试中都击败了 Grok 4.6,同时保持相同的 API 基础价格。更智能、更安全、更强大,而且仍然令人难以置信的实惠。SpaceXAI 正在以令人难以置信的速度前进。

本文由作者@运营派,授权发布于平台,未经许可禁止转载。
