2026-07-22-星期三

收录于 第 39 期(2026-07-22) · 本期共 11 条

❯ 谷歌发布 Gemini 3.6 Flash 等三款模型,同步启动 Gemini 4 预训练

[三连发] 据谷歌官方博客,谷歌 7 月 21 日一口气发布 Gemini 3.6 Flash、3.5 Flash-Lite、3.5 Flash Cyber 三款模型,其中主力款 3.6 Flash 在编码、知识工作和多模态上更强,且输出 token 用量较 3.5 Flash 降低 17%;产品高级总监 Tulsee Doshi 同时透露,谷歌已启动「迄今最雄心勃勃的预训练」——面向 Gemini 4。

[价格战] 三款里,3.5 Flash-Lite 主打低时延高吞吐,跑到每秒 350 个输出 token,定价为每百万输入 token 0.3 美元、每百万输出 token 2.5 美元,把成本压到智能体工作流可规模化调用的区间;3.5 Flash Cyber 则专用于在谷歌 CodeMender 智能体内检测和修补软件漏洞,因双重用途的安全风险,目前仅面向政府和可信伙伴限量试用。这一轮更新与近期各家降价同频,把 Flash 系列钉在「效率与质量的甜点位」,明摆着冲着单位推理成本去。

[预算重排] 对做 AI 应用的团队,值钱的是那 17% 的 token 缩减:当同等质量的输出更省 token、每秒吞吐更高,调用成本就从产品预算里的大头项往下掉,此前因单价太贵而搁置的高频、长上下文场景重新算得过账。而 Gemini 4 预训练启动,等于把下一轮竞争的发令枪提前摆上了台面。

▪ SIGNAL一边把 Flash 的 token 成本再削 17%,一边为 Gemini 4 拉开预训练——谷歌在低端打价格、在高端搭代差,两头下注。