英伟达:CoreWeave 已将 Vera Rubin NVL72 投入生产,Cognition 测试 Token 吞吐量提升 4.8 倍

Cognition 早期测试显示,Vera Rubin NVL72 在实际软件工程 AI 推理任务中的总 Token 吞吐量最高达到英伟达 GB200 NVL72 的 4.8 倍。CoreWeave 测试显示,搭载英伟达 Vera CPU 的 AI 代理沙箱启动速度提升超过 3 倍。

原文连接