2026-08-26-星期三 · 英伟达

收录于 第 73 期(2026-08-26) · 本期共 16 条

❯ 英伟达 Groq 3 LPX 机架进入全面量产,Nebius 成首家采用的 AI 云厂商

量产上线英伟达 8 月 24 日宣布推理加速器 Groq 3 LPX 机架全面量产,将与 Vera 中央处理器、Rubin 图形处理器一同部署,年内在新型云厂商 Nebius 的数据中心上线。这是英伟达 200 亿美元拿下 Groq 之后,第一批真正落地的机架产品。

性能口径按官方公告,单机架塞进 256 颗 LPU,配 128 GB 片上 SRAM、640 TB/s 纵向扩展带宽,采用 MGX 架构全液冷。在 Artificial Analysis 用开源智能体模型 Gemma 4 31B 做的测试中,10 万 token 长上下文场景输出 3400 token/秒,是最接近的替代平台的 4 倍。此前单卡通吃的做法目前也被拆开:Rubin 图形处理器扛上下文预处理,LPU 专收延迟敏感的解码阶段,两者在同一套机柜里分工。

智能体账本同批公布的还有 Vera Rubin NVL72 在真实智能体负载下的成绩。英伟达称,基于 SemiAnalysis 的 AgentX 负载、跑 DeepSeek V4 Pro 模型,每兆瓦吞吐量最高是上代 GB300 NVL72 的 30 倍,每 token 成本最高降 35 倍。这套数字直接冲着 Jalapeño 那张能效表来的——固定电力预算下能撑多少并发智能体,正在取代峰值算力成为机房招标的第一指标。

▪ SIGNAL把预填充和解码拆到两种芯片上,英伟达承认了单一 GPU 通吃推理全流程的时代结束了。