NVIDIA与CoreWeave公布AI基础设施进展:生产应用、早期测试和预览能力分开看

10-01 5阅读

2026 年 9 月 30 日,NVIDIA 介绍了 CoreWeave 在新一代 AI 基础设施上的进展。公告同时包含生产客户、早期性能测试、即将提供的 CPU 与软件平台更新。阅读这类基础设施消息时,先把每项能力的状态写清楚,才不会把一场发布活动理解成所有服务都已普遍交付。

NVIDIA与CoreWeave公布AI基础设施进展:生产应用、早期测试和预览能力分开看

配图为 AI 生成的概念示意图,非真实产品界面、设备照片或活动照片。

已宣布的进展有哪些

NVIDIA 表示,CoreWeave 已宣布 Vera Rubin NVL72 的可用性,Cognition 是首个运行生产负载的客户,公告也提及早期访问客户。CoreWeave 还将提供 Vera CPU,并推出整合训练、评估和改进工作的 Forge 环境。

软件方面,ARIA 与 Sandboxes 被标为正式可用,RL Rollouts 仍是私有预览。文中“最高 4.8 倍 token 吞吐量”来自 Cognition 针对特定软件工程推理负载、以 GB200 NVL72 为基线的早期测试,不是本站独立测试,也不是所有应用的性能保证。

吞吐提高与任务更快不是同一张验收单

以下是本文的评估建议。团队若考虑新基础设施,先保留自己的工作负载样本:上下文长度、并发任务数、输入输出分布和完成标准。一个平台每秒能输出更多 token,并不能单独回答单个任务是否更早完成,或生成结果是否需要更多人工返工。

可以同时记录成功任务数量、端到端耗时和资源消耗,并明确失败与重试是否计入。测试期间若更换模型、提示词或工具版本,就需要单独记下,否则很难把观察到的变化归到硬件或平台上。先固定比较对象,数字才具有可解释性。

采购前需要确认的仍是具体服务

生产案例证明有人已经在运行特定负载,但普通客户能否立即获得容量、在哪个地区可用、采取何种商业安排,需要查询具体服务信息。本文没有从厂商案例推断普遍供货量,也不根据单次测试给出成本回收承诺。

对开发团队而言,可以先整理训练、评估、部署和反馈各环节目前如何衔接,再判断新平台是否减少真实交接工作。对于预览能力,先安排可隔离的验证任务,记录功能边界与退出条件。把业务结果和发布状态同时看,通常比只关注一个倍率更有帮助。

来源与核验

主要来源:NVIDIA:From Training to Production,公告日期 2026-09-30。本文于北京时间 2026 年 10 月 1 日核验,后续状态以官方更新为准。

文章版权声明:除非注明,否则均为云鹊BLOG原创文章,转载或复制请以超链接形式并注明出处。