Kaiyun - 中国官方版权服务网站

关闭
英伟达为最小工作站GPU配备Blackwell架构
作者:小编 日期:2025-08-13 点击数: 

  英伟达最新的Blackwell GPU包含两款小型工作站显卡,旨在70瓦功耗限制内为专业可视化和本地AI工作负载提供最高性能。

  这两款产品于周一在加拿大温哥华的Siggraph大会上发布,分别是RTX Pro 4000小型版(SFF)和RTX Pro 2000,它们采用相同的半高双槽散热器设计。尽管外观相似,但两款显卡性能差异显著,RTX 4000 SFF拥有8960个CUDA核心,是RTX Pro 2000的4352个核心的两倍多。

  虽然技术上这确实是浮点运算2.51倍的提升,但大部分性能提升来自FP4格式而非架构改进。当标准化为FP8时,芯片性能仅提升约25%。

  虽然这款小型显卡的浮点性能提升有限,但内存带宽这一本地推理的关键指标却有显著改进。配备24GB GDDR7内存,带宽达432GB/s,该显卡在运行OpenAI新发布的gpt-oss-20b等大语言模型时,Token生成速度比英伟达上一代产品快约54%。

  英伟达建议RTX Pro 2000主要用于专业可视化工作负载,开云网站同时也承诺显著的性能提升。据该GPU巨头表示,与上一代Ada架构相比,用户可期待3D建模性能提升1.6倍,CAD性能提高1.4倍,渲染速度快1.6倍。

  在AI性能方面,该显卡远不及更大型或更高功耗的同系列产品,但考虑到其仅70W的热设计功耗,表现仍然不俗。该显卡拥有高达545 teraFLOPS的稀疏FP4计算能力,以及由16GB GDDR7提供的280GB/s内存带宽。

  同样在Siggraph大会上,英伟达展示了一款2U服务器平台,可运行两块600W的RTX Pro 6000服务器版显卡。每块GPU拥有高达4 petaFLOPS的稀疏FP4性能。

顶部