Anthropic 发布 Claude Haiku 5.5:10 万 token 内输入每百万 0.10 美元,平均比 Haiku 4.5 便宜约 75%;Sonnet 5.5 缓存读取同步降价一半
Claude 5.5 家族里最快、最省的模型,面向高并发、对成本敏感的任务,也是第一个带力度(effort)调节的 Haiku。
// 要点
- 价格按提示长度分档:10 万 token 以内输入每百万 0.10 美元、输出 0.50 美元,超过 10 万 token 为 0.50 美元与 2.50 美元;Haiku 4.5 是 1 美元与 5 美元。官方说明新分词器每个任务会多用一些 token,算上这一点平均仍便宜约 75%。
- 对比 Haiku 4.5:OSWorld 2.1(离线子集)72.4% 对 15.7%,Terminal-Bench 4.0 39.2% 对 0.0%;Sonnet 5.5 在 Terminal-Bench 4.0 上是 70.6%,官方仍建议复杂编码任务用 Sonnet 5.5 或 Opus 5.5。
- 同日起 Sonnet 5.5 的缓存读取从每百万 0.20 美元降到 0.10 美元,官方称多数智能体任务因此便宜约 20%;本周起 Max 5x、Max 20x 每月分别送 100 和 200 美元 API 额度,Team 最多 500 美元。
- 模型 ID 为 claude-haiku-5-5,已上 Claude Platform、AWS、Google Cloud 与 Microsoft Azure;Python 与 TypeScript SDK 同时加入 computer use 与 browser use 的 beta 支持。
开发者视角我会马上把 PandaClaws 的分类、摘要和改写,以及 AI 云盘的文档问答这类短提示调用切到 Haiku 5.5 跑一轮对比:10 万 token 以内价格只有原来的十分之一,主模型做规划、Haiku 做子任务的分工终于算得过账。要注意新分词器会多用一点 token,别只看单价,按「完成一个任务的总花费」来算;我在《每月维持三款 AI 产品在线运行的真实成本》里的成本表也得重算了。