❯ 谷歌 TPUv7 首批第三方推理成绩公布,SemiAnalysis 称部分场景每美元性能领先英伟达 50%
公开对照芯片研究机构 SemiAnalysis 在 9 月 7 日发布 Ironwood 的 InferenceX 预览结果,首批适配模型是 Qwen3.5 397B。其“最高领先 50%”采用 FP8 同精度比较,对手为 B200/B300;数字来自指定服务配置和成本模型,并非谷歌给出的云服务降价幅度。测试原文。
软件出口这次更有分量的变化是 TorchTPU:开发者可以沿用 PyTorch 和熟悉的推理框架,把开放权重模型部署到 TPU,减少跨框架适配。按研究披露,软件仍在私测,计划约 10 月中旬开源,多轮智能体负载的成绩也尚待发布。Dylan Patel 的同步表态来自同一研究团队,不是第二份独立测试。
竞争缺口英伟达的优势有很大一部分来自“模型发了就能跑”的软件支持。TPU 若能把适配速度补上,较低的运行成本才容易变成外部订单。当前结果给了云厂商一个具体的替代选项,但要从少数模型走向常规采购,还得把模型覆盖做宽;单张漂亮成绩单不足以替代整套开发工具。
▪ SIGNALTPU 要争取外部推理订单,除了每美元多跑多少,还要回答新模型发布后几天能跑起来。