❯ Artificial Analysis 测算:DeepSeek V4-Flash 单次任务成本 3 美分
成本断层独立评测机构 Artificial Analysis 测算,DeepSeek 新发布的 V4-Flash 跑完一次测试平均花费约 3 美分,同口径下 Kimi K3 是 86 美分、GPT-5.6 Sol 是 1.86 美元、Claude Fable 5 是 3.15 美元——最贵的和最便宜的差出 100 倍以上,路透社报道了这组数字。V4-Flash 的挂牌价是每百万输入 token 0.14 美元、输出 0.28 美元。
口径为何重要据 Artificial Analysis 说明,这个测算的关键不在挂牌价,而在它算的是”把一件事做完要花多少钱”:模型为了得出答案要吞掉多少 token,全部折进成本里。此前一年里,企业选型普遍只看挂牌价,这对推理型模型是个残酷的口径——很多模型单价看着不高,但思考链一长,实际账单就翻几倍。V4-Flash 是 2840 亿参数的混合专家模型,官方权重直接以 MXFP4 存放路由专家,其余部分用 FP8 或 BF16,等于把量化提前做进训练里,推理时省下的不只是显存。上周已有第三方放出 14 个量化版本,其中一档专门标注适配 128GB 内存的机器。
谁在承压这条测算最先落在采购侧的比价方式上:过去一年企业选型基本看每百万 token 报价,现在这个数字单独看已经没什么意义。先难受的是那些按 token 单价卖溢价的推理服务商——当同一个任务的完成成本能差两个数量级,“我们贵是有原因的”这句话得拿出比模型质量更硬的东西来撑。DeepSeek 自己的毛利率据其此前披露并不低,成本优势来自工程实现而非补贴,这让跟价变得更难。
▪ SIGNAL每百万 token 的报价正在失去参考价值,值钱的是完成一件事的总账单。