2026-06-25-星期四 · OpenAI

收录于 第 13 期(2026-06-25) · 本期共 13 条

❯ OpenAI 联手博通发布首款推理芯片 Jalapeño,9 个月走完设计到流片

首颗自研芯片OpenAI 与博通联合发布首款定制推理芯片 Jalapeño,从设计到流片只用 9 个月,号称是高性能先进半导体史上最快的 ASIC 开发周期,计划 2026 年底开始部署。这是 OpenAI 从模型、产品一路向下,第一次把手伸进自家硅片。芯片专为大语言模型推理优化,早期测试显示每瓦性能显著优于现有最高水平。

全栈闭环这颗芯片由 OpenAI 设计加速器、博通负责硅实现与网络互连,制造伙伴还包括 Celestica,是双方共建的多代计算平台中的第一代。关键细节是 OpenAI 用自家模型参与了部分设计与优化,把”AI 设计 AI 芯片”从口号落到流片表上——这也是 9 个月极速周期的来源之一。架构上它通过减少数据搬运、平衡算力内存与网络资源,让实际利用率逼近理论峰值,针对的正是 ChatGPT、Codex 与 API 上真实跑的推理负载。早期样片已在实验室以目标频率和功耗运行,包括 GPT-5.3-Codex-Spark。

算力账重写真正被改写的是 OpenAI 对英伟达的依赖结构。过去它每一份推理算力都要向外采购 GPU,自研芯片让它在采购、功耗与单位推理成本上第一次握有自己的杠杆,并把模型、产品、收入、基础设施串成一个内部飞轮。对英伟达而言,最大的几家客户正一个接一个从”买芯片”转向”设计芯片”;对博通来说,定制 ASIC 业务又添一个超级订单。后续要盯的是详细基准测试——OpenAI 称稍后公布,那才是这颗芯片成色的真考题。

signal: 当模型公司开始自己设计推理芯片,算力护城河就从”谁买得起 GPU”挪到”谁控制得了单位推理成本”。