❯ DeepSeek V4-Flash 正式版上线,输出价降到每百万 token 2 元,为 Pro 的十二分之一
价格砍到零头DeepSeek 的 V4-Flash 正式版于 7 月 31 日开放公测,输出价定在每百万 token 2 元,输入 1 元。对比同门旗舰 V4-Pro 的输出 24 元、输入 12 元,Flash 的输出价只有 Pro 的十二分之一,而智能体能力评测反超 Pro 预览版。海外研究者 teortaxes 的说法更直接:比 V4-Pro 便宜十四倍、快五成,还更好用。
便宜不再等于将就关键变化在于这次降价没有伴随能力打折。在智能体测试里,V4-Flash 正式版拿到 25.2 分,逼近 Claude Opus 4.8 的 25.7 分,而 V4-Pro 预览版只有 15.8 分——低价档位第一次贴着顶级闭源模型的水平线跑。海外开发者社区已经有人实测后表示,V4-Flash 的工具调用框架比 Kimi K3 好得多。分析者 kimmonismus 贴出帕累托前沿图,把它标为当前价格性能的赢家。teortaxes 认为,中国实验室里目前只有 Luna 在同一个市场里竞争。
预算表要重画最先要重算账的是做智能体产品的团队。过去把便宜模型放在简单任务、贵模型接管复杂链路的分流设计,是被价格逼出来的妥协;当低价档位能跑到 25 分,分流本身就成了多余的工程成本。压力会先落在按 token 收费的中间层服务商身上——推理成本一旦掉进这个区间,靠转售调用额度赚差价的空间基本被抹平了。
▪ SIGNAL便宜模型追上贵模型的那一刻,被淘汰的不是贵模型,是模型路由这门生意。