2026-08-14-星期五 · OpenAI · Cerebras

收录于 第 61 期(2026-08-14) · 本期共 13 条

❯ OpenAI 预览 Ultrafast 服务层,GPT-5.6 Sol 提速最高 14 倍

速度换档OpenAI 预览 API 新服务层 Ultrafast:由 Cerebras 晶圆级芯片驱动,运行 GPT-5.6 Sol 输出速度最高 750 tokens/秒,比标准处理快最高 14 倍,智能水平与标准版一致。目前限量开放给一批客户,容量扩大后逐步放开。

硬件原理速度来自 Cerebras 的晶圆级引擎架构:每片晶圆大小的芯片带 44GB 片上 SRAM,模型权重常驻片上,绕开了常规硬件推理的内存带宽瓶颈——此前这类速度只出现在开源小模型上,前沿旗舰是第一次。据两家公司官方公布的参照:2500 题的「人类最后考试」全套跑完只用 11 个小时,同一套题 Claude Fable 5 要三天多;知识工作基准 GDP-Val 上端到端提速 5.6 倍。

供应信号一次任务串起几十次模型调用的智能体场景里,延迟本身就是产品力——这层是给它们准备的。更大的信号在供应链:OpenAI 把前沿模型的生产推理放上英伟达之外的芯片,Cerebras 拿到的是旗舰模型背书,这比任何跑分都值钱。

▪ SIGNAL前沿模型第一次以官方服务层的形式跑在非英伟达芯片上,推理硬件的采购格局撕开了一道口子。