NVIDIA 技术博客 8 月 24 日推出 BlueField-4 DPU,同时把 Scale-In 立为 AI 网络的第五根支柱。作者是 Ronil Prasad 和 Itay Ozery。
五根支柱现在长这样。Scale-Up 靠 NVLink,Scale-Out 靠 Spectrum-X 或 Quantum InfiniBand,Scale-Across 靠 Spectrum-XGS,Context Memory 靠基于 STX 的 CMX,Scale-In 就是这次补上的那根。
硬件规格给得很实。BlueField-4 带 64 核 NVIDIA Grace CPU,官方称算力是前代的 6 倍。内联加速引擎处理数据包、RDMA、存储协议、加密和防火墙策略执行,速率最高 800 Gb/s,内存子系统用 LPDDR5X,主机侧走 PCIe Gen6,网络接口 800 Gb/s。对比 BlueField-3 是 4 倍内存带宽、2 倍网络带宽。
在 Vera Rubin NVL72 里怎么接,文中算了一笔。每个计算托盘聚合接口带宽 7.2 Tb/s,等于南北向 BlueField-4 的 800 Gb/s 加上四条各 1.6 Tb/s 的东西向。存储主张是相比现成以太网最高 1.45 倍吞吐,图注标明用 50 GB 传输测得,测试覆盖 5 GB、10 GB 和 50 GB 三种文件尺寸。
分工写得比规格更有意思。ConnectX-9 SuperNIC 在 Scale-Out 上承载租户流量,BlueField-4 跑基础设施服务,同时还兼任 CMX 的数据与存储处理器。安全那句原文很硬,租户软件无法禁用或绕过这些控制。软件栈列了 DOCA Flow、DOCA PCC、DOCA Telemetry、DOCA Platform Framework、DOCA HBN、OVS-DOCA、DOCA Argus 和 DOCA Vault,BlueField Astra 负责跨南北向与东西向域的控制扩展。
页面顶部挂着 AI 生成的摘要,NVIDIA 自己声明这类内容可能概括不完整。这条提示放在一份产品发布页上,本身就够说明现在的文档生产方式了。