截至2026年8月25日,NVIDIA最新发布的Rubin系列AI平台虽宣布整体价格上调15%,但其性能跃升幅度仍对大规模模型训练与推理厂商具备显著吸引力。在运行DeepSeek V4 Pro这一参数量达1.6万亿的开源大模型时,Rubin平台的实际表现达到H200显卡的450倍。
此次性能验证基于Vera Rubin NVL72系统展开。测试沿用开源大模型作为基准负载,选用DeepSeek V4 Pro作为典型工作负载,同步对比了前两代主流平台H200与GB300的表现。以H200 NVL8为性能基准,GB300 NVL72实现15倍性能提升;在此基础上,Vera Rubin NVL72相较GB300再度实现30倍跃升,最终较H200代际整体提升达450倍,性能增幅极为显著。
除性能大幅增强外,单位计算成本亦明显优化。以处理100万Token为计量单位,Vera Rubin的单位成本设为1,则GB300对应成本为35,即Rubin平台将单位计算成本压缩至前代的约三十分之一。
需指出的是,上述对比均基于统一软件栈与典型推理场景下的理想化测试条件。当前H200平台多采用8卡配置,而Rubin与GB300均为更高密度集成方案;测试中未纳入整机功耗、散热要求及实际部署开销等系统级指标。关于定价,Vera Rubin NVL72尚无官方零售报价,市场普遍估算其物料成本区间为880万至910万美元,近期传出的15%调价消息或将推动终端售价进一步上行。相比之下,GB300 NVL72物料成本约为300万至400万美元,实际交付价格普遍超过600万美元,不同配置版本间存在较大浮动空间,厂商通常预留70%以上的毛利水平。

评论
更多评论