返回快讯列表
最新动态

NVIDIA Groq 3 LPX 量产,Nebius 首家上云,CoreWeave 生产跑 Spectrum-X Multiplane

NVIDIA 8 月 24 日宣布 Groq 3 LPX 全面量产,机架最多 256 个 LP30;Artificial Analysis 实测 Gemma 4 31B 十万 token 长上下文下每秒 3400 输出 token。

同一天 8 点整(太平洋时间),NVIDIA 还发了第二条硬件公告,Groq 3 LPX 进入全面量产。这是把推理拆成两半的做法,Rubin GPU 和 LPU 一起算模型的每一层,官方给的设计目标是消掉速度和吞吐之间那个老权衡。

机架级部署里每机架最多 256 个 LP30 加速器,芯片之间直连。第三方数字来自 Artificial Analysis,在开源 agentic 模型 Gemma 4 31B 上,十万 token 长上下文场景实测每秒 3400 个输出 token,官方说法是比最接近的替代平台快 4 倍。

客户名单有三个。Nebius 是首家采用 Groq 3 LPX 的 AI 云,在自家 Token Factory 里跟 Vera Rubin NVL72 配对。CoreWeave 已经在 Vera Rubin 机架上生产部署 Spectrum-X Multiplane。SpaceXAI 用 Vera CPU 跑 agentic AI,覆盖范围从地面数据中心一直到在轨卫星。

网络部分给了一串规格。Spectrum-X Ethernet 相对现成以太网的 AI 网络性能是 1.6 倍,Spectrum-6 ASIC 做到 102.4 Tb/s,ConnectX-9 SuperNIC 每 GPU 最高 1600 Gb/s。Spectrum-X Multiplane 能扩到 51.2 万 GPU 而不需要第三层网络,八平面配置下坏掉一个平面还留约 90% 带宽,硬件恢复比软件式多平面负载均衡快 11 倍,AI 工厂产出提升 1.6 倍。跨站点的 Spectrum-XGS 把 NCCL 集合通信加速 1.9 倍。

文中把 NVIDIA Scale-In 称作 AI 网络的第五根支柱,配套产品还有 Spectrum-X SN6000 系列交换机、NVLink Fusion 与 Rubin CPX。文末顺带预告了 10 月 20 日到 22 日的 GTC Berlin。

更多快讯