❯ SemiAnalysis 实测:OpenAI 自研芯片 Jalapeño 多数场景胜过 Blackwell
跑分结果SemiAnalysis 给出对 OpenAI 自研加速器 Jalapeño 的实测结论:在几乎所有场景下都胜过英伟达 Blackwell,且未针对任何单点做调优。具体数字是在测试区间内每瓦峰值吞吐高出 1.5 至 1.9 倍,端到端延迟低 1.7 至 3.6 倍,低延迟与高吞吐两端同时占优。
口径要看清SemiAnalysis 自己先把话说满了又收了回来:这场比较”并不完整、也不公平”,因为 Jalapeño 用的是更新的 HBM4 内存,真正对等的参照物是同样用 HBM4 的英伟达 Rubin。更关键的时间差是——Rubin 已经在向客户出货,Jalapeño 还停在工程样片阶段,尚未商用。这颗芯片本身在设计过程中大量用了 AI,此前已在 Hot Chips 2026 上做过公开拆解。
代价在软件侧自研芯片能不能打过英伟达是今年最大的结构性问题,这是第一份有分量的第三方拆解。研究者 nrehiew_ 的第一反应点出了实操成本:“又要学一门新的领域专用语言”。英伟达最硬的护城河从来不是单芯片性能,而是 CUDA 上十几年的软件积累,开发者迁移成本才是 Jalapeño 真正要翻的那座山。对英伟达的投资者来说,要盯的不是这组跑分,是 Rubin 出货节奏与客户自研的时间赛跑。
▪ SIGNAL每瓦高出 1.9 倍的是工程样片,已经在客户机房里跑的是 Rubin,这场比较真正的赌注是时间。