2026-08-26-星期三 · OpenAI · 英伟达 · Kimi

收录于 第 73 期(2026-08-26) · 本期共 16 条

❯ OpenAI 自研推理芯片 Jalapeño 公布首批实测,每瓦性能超英伟达 GB300

首批实测OpenAI 在 8 月 25 日的 Hot Chips 大会上放出自研推理芯片 Jalapeño 的首批性能数据:在 GPT-OSS 120B、DeepSeek R1、Kimi K2.5 1T 三个模型上,每瓦有效算力达到英伟达 GB200 与 GB300 系统的 1.5 至 1.9 倍,端到端延迟低 1.7 至 3.6 倍。芯片由 OpenAI 与博通联合设计,测试跑在 SemiAnalysis 的 InferenceX 平台上。

硬件底牌单封装配 6 组 HBM4,容量 216 GiB、带宽 15.4 TB/s,标称功耗 700 瓦,而实测负载下始终压在 550 瓦以内——对手 GB300 的整卡功耗是 1400 瓦。切到高交互式负载,差距进一步拉开到 2.1 至 4.1 倍。首代芯片就在这条曲线上压过英伟达当代旗舰,是过去三年没出现过的事。

产能是关键OpenAI 自己给的部署节奏很克制:2026 年底才小批量上线,规模化要等 2027 年。所以短期内英伟达的出货量不会掉一片,真正的变化在采购谈判桌上——当模型公司手里有一颗自己能造、且每瓦更划算的推理芯片,议价的底牌就换了一张。在电力受限的数据中心里,每瓦 token 数直接换算成营收,这是 OpenAI 唯一在意的指标。

▪ SIGNAL首代 ASIC 打赢当代旗舰 GPU,赢的不是制程,是把模型、编译器和硅片放进同一个迭代周期的能力。