编程权威榜单：千问 3.7 仅次于 Claude，阿里全球第二

AI
5月26日

强哥来了

与传统的代码基准测试不同，Code Arena 并不考核孤立的代码片段生成或传统算法题，而是由开发者出题，要求模型从零生成完整的、可交互的 Web 应用程序，并交由用户对匿名模型的生成效果进行两两 PK，由投票综合生成榜单，因此 Code Arena 也被认为是目前全球最具公信力的 AI 编程能力评测之一 … 经全球开发者以真实使用体验盲测投票，千问 3.7 模型编程能力位居前 4，打破由 Claude-Opus-4.7 和 4.6 统治已久的前四格局，Qwen3.7-Max 也成为目前榜单中唯一突破 1540 分大关的国产大模型 … 有 AI 机构在相同提示词下同步横评了 Qwen3.7-Max、Claude-4.7 与 GPT-5.5，发现千问 3.7 较上代的性能提升幅度最大、推理成本最低，在输出速度和生成质量两个维度上相较其他模型均有明显优势。

原文连接

{{userData.name}}已认证

编程权威榜单：千问 3.7 仅次于 Claude，阿里全球第二

Ardot

阿里悟空

QClaw

关于我们

商务合作

隐私声明

用户协议

{{userData.name}}已认证

相似站点

Ardot

阿里悟空

QClaw

关于我们

商务合作

隐私声明

用户协议