❯ Anthropic 发布 Claude Haiku 5.5,10 万 token 以内的请求价格比上一代低九成
小模型大降价Anthropic 10 月 7 日发布 Claude Haiku 5.5,这是它产品线里最小、最快的一档模型。10 万 token 以内的请求,每百万 token 输入 0.10 美元、输出 0.50 美元;超过后升至 0.50 美元和 2.50 美元。上一代 Haiku 4.5 是 1 美元和 5 美元。公司称整体运行成本低约 75%。
第一次能调“用力程度”Haiku 5.5 首次提供 effort 设置,分低、中、高、超高和最高五档,让开发者在成本和准确率之间取舍。Anthropic 建议把它用在摘要、分类、数据库查询、在线客服、浏览器操作和子代理这类量大的任务上,并明确说复杂的代理式编程仍应选 Sonnet 5.5 和 Opus 5.5。模型已在 Claude 平台和 AWS、Google Cloud、微软 Azure 上线。
便宜有条件开发者 Simon Willison 在测试笔记里指出,新价格与 OpenAI 的 GPT-6 Luna 持平,但只在 10 万 token 以内成立,超过后 Luna 划算得多。此外新模型的分词方式不同,同一段提示词消耗的 token 约为上一代的 1.25 倍。Anthropic 同日还把 Sonnet 5.5 的缓存读取价格减半,并向 Max 和 Team 订阅用户每月赠送 API 额度。
谁会换对每天要跑大量短请求的企业,比如客服分流、文档问答,这次降价直接改变账单。Anthropic 引用的客户里,Asana 称延迟下降三成以上,Box 称得分提高 11 分而延迟减半。但提示词经常超过 10 万 token 的长文档场景,省下的钱要少得多。
▮ SIGNAL两家头部实验室的小模型定到了同一个价位,低端模型的竞争已经从“谁更便宜”转到“便宜的条件写在哪里”。