Claude Haiku 5.5 在 2026 年 10 月 7 日由 Anthropic 正式发布,是 Claude 5.5 家族中速度最快、成本最低的一档。Free、Pro、Max、Team 和 Enterprise 用户已能在 Claude.ai 的网页、iOS 和 Android 端选用它,开发者可通过 Claude Platform、AWS、Google Cloud 和 Microsoft Foundry 调用,Claude Code 里同样可用,API 模型名为 claude-haiku-5-5。
价格先看分档:100K 提示长度是分水岭
Haiku 5.5 的定价按提示长度分两档:提示不超过 100K token 时,每百万输入 token 0.10 美元、输出 0.50 美元;超过 100K 后跳到每百万输入 0.50 美元、输出 2.50 美元。配合提示缓存最高可省 90%,批处理可再省 50%。和上一代 Haiku 4.5 每百万输入 1 美元、输出 5 美元的标价相比,新价格低了一个数量级;但官方同时更新了分词方式,同等内容折算出的 token 数会略有变化,真实账单降幅要用自己的任务实测,不能直接按标价相除。
它适合接什么样的活
Anthropic 给 Haiku 5.5 的定位是高流量、成本敏感的工作:分类、摘要、文本生成这类批量任务,以及聊天、语音智能体、实时客服和应用内助手等对延迟敏感的场景。它也能当编程子智能体用:由 Opus 或 Fable 这类更大的模型做规划,把定义明确的子任务分给 Haiku 并行执行;桌面与浏览器自动化、跨多文件的小步修改也在它的适用范围内。它还是首个带努力程度(effort)控制的 Haiku,团队可以按任务在成本和智能之间调节。官方同时提醒,复杂编程和长程知识工作仍应优先考虑 Sonnet 5.5 或 Opus 5.5。
早期客户给出的数据
官方页面列出的客户反馈里,Box 称其文档问答场景的测试分数比 Haiku 4.5 高 11 分,延迟约为一半;HubSpot 在 CRM 任务套件上跑出 92.8% 的平均分,是其测试过的模型中最高的;Asana 报告任务完成延迟下降超过 30%,单个智能体回合的推理速度最高提升到 2.5 倍。这些是厂商提供的客户口径,适合当作选型线索,不能替代自己的评测集。安全性方面,路透社在报道中提到,这是首个对一小类高风险网络安全请求内置防护的 Haiku,日常任务不受影响,细节见官方系统卡。
同一天还有两个价格动作
发布当天,Anthropic 还宣布把 Claude Sonnet 5.5 的缓存读取价格减半,从每百万 token 0.20 美元降到 0.10 美元,官方估计长时运行类任务的成本可因此下降约 20%。同时,Claude Max 和 Team 套餐开始发放每月 Claude Platform API 额度:Max 5x 为 100 美元,Max 20x 为 200 美元,Team 最高 500 美元且可在团队内共享,额度可用于任何模型,包括在自己的代码或第三方工具里调用。对订阅用户来说,等于订阅费里第一次明确包含了一笔可编程调用的额度。
选型时要注意什么
最容易踩的坑是长提示涨价:单次请求一旦越过 100K,输入输出单价同时变为五倍,做长文档批处理前先算清楚分档。第二个判断是任务复杂度:Haiku 5.5 的优势在速度和单价,遇到需要多步推理、工具链很长的任务,先用小样本对比 Sonnet 5.5 的完成率再决定,别只看 token 单价。