APP下载
报价宝  ›  科技  › 

英伟达Vera Rubin系统投产 推理吞吐提升4.8倍

报价宝 来源:baojiabao.com 发布时间:2026-10-04 21:09:48 10月04日更新
报价宝综合消息英伟达Vera Rubin系统投产 推理吞吐提升4.8倍

英伟达Vera Rubin系统投产 推理吞吐提升4.8倍

英伟达下一代数据中心平台正式进入商用阶段。AI 云服务商 CoreWeave 宣布,Vera Rubin NVL72 系统已在 CoreWeave Cloud 投入生产,AI 软件公司 Cognition 成为首个在该平台运行生产负载的客户——它正是 AI 编程助手 Devin 背后的团队。

Cognition 在这套系统上运行 SWE-2 推理任务,实测总 token 吞吐量比上一代 GB200 NVL72 最高提升 4.8 倍;在强化学习场景中,单 GPU 的输出吞吐也达到 3.8 倍,意味着 Devin 能同时处理更多会话、更快完成多步推理。每瓦性能的跃升更为明显:在 DeepSeek-R1 推理基准中,每兆瓦 token 吞吐量达到 GB200 NVL72 的 10 倍,同样电力下能产出更多智能输出。

硬件规格方面,NVL72 机架由 36 颗 Vera CPU 和 72 颗 Rubin GPU 组成,采用百分之百液冷设计。无缆线的模块化托盘结构把整机安装时间从两小时压缩到五分钟,部署效率明显提升。

除了 GPU 系统,CoreWeave 还把 Vera CPU 作为独立计算层开放给客户。单机架可部署 128 颗 Vera CPU、总计 11264 核,支持超过 11000 个并发隔离环境,智能体沙箱的启动速度比 x86 CPU 快 3 倍以上——这恰好是智能体训练与评测最消耗资源的环节。

CoreWeave 同步推出 Forge 开发环境,把 Weights & Biases、OpenPipe 等工具整合成统一的开发层,覆盖实验追踪、模型评估到生产部署的全流程。英伟达超大规模与高性能计算副总裁 Ian Buck 表示,CoreWeave 的 V100 GPU 至今仍在运行客户工作负载,而 Vera Rubin NVL72 已经进入生产,这体现了英伟达平台跨代持续创造价值的长期能力。

对英伟达而言,这一步的象征意义不小:Rubin 架构正式接过撑起数据中心营收的接力棒,而首批生产客户跑的正是智能体编程这类最吃 token 吞吐的工作负载,也印证了推理正在取代训练成为新战场的行业判断。

编译自 快科技,原标题:"英伟达新王炸投产!Vera Rubin NVL72跑出4.8倍Token吞吐"

文章标签: 英伟达 Vera Rubin NVL72 CoreWeave 推理 液冷 报价宝 降噪耳机价格 耳机价格 红米手机价格 华为手机价格 小米手机价格 电视机价格 笔记本电脑价格 笔记本价格 汽车价格 手机价格 笔记本价格 电视机价格 红米手机价格 降噪耳机价格