🤖 由 文心大模型 生成的文章摘要

英伟达宣布,AI云服务商CoreWeave已将英伟达Vera Rubin NVL72投入生产,并开始向客户提供基于该平台的云服务。AI软件公司Cognition成为首个在Vera Rubin上运行生产工作负载的客户,其早期测试数据展现出该平台在AI推理任务上的显著性能提升。
据Cognition的早期测试,Vera Rubin NVL72在实际软件工程AI推理任务中的总Token吞吐量最高达到英伟达GB200 NVL72的4.8倍。这一数据表明,新一代平台在处理复杂软件工程类AI推理负载时,具备明显的效率优势,有望显著降低单位推理成本、提升响应速度。
此外,CoreWeave的测试显示,搭载英伟达Vera CPU的AI代理沙箱启动速度提升超过3倍。沙箱启动速度的大幅改善,意味着AI代理类应用能够更快地进入工作状态,对于需要频繁创建、销毁隔离环境的智能体任务而言,这一提升将直接转化为更高的整体吞吐与更低的时延。
Vera Rubin NVL72投入生产并迎来首个生产级客户,标志着英伟达新一代AI计算平台完成了从技术发布到商业化落地的关键一步。CoreWeave作为AI云服务商率先将该平台纳入其云服务组合,Cognition则作为AI软件公司率先在实际业务负载中验证其性能,二者共同构成了“算力平台+云服务+应用客户”的落地链条。
对于AI软件工程这一对推理吞吐和响应速度要求较高的领域而言,Vera Rubin NVL72所展现的性能提升,可能进一步推动AI编程、代码生成与软件工程智能体等应用的规模化部署。






