Anthropic正式推出Claude Haiku 5.5,官方称这是其迄今为止发布的最便宜、最快且能力最强的小型模型。该模型专为高容量、对成本敏感的任务设计,能够可靠处理摘要生成、数据压缩、数据库查询及分类请求等快速重复性工作负载。

Claude Haiku 5.5可与Opus 5.5和Sonnet 5.5协同工作,在编码任务中担任子代理角色。作为Anthropic速度最快的模型,它尤其适用于实时客户支持和浏览器操作等对延迟敏感的场景。相较于前代产品Haiku 4.5,Haiku 5.5的平均运行成本降低了约75%。

性能与“努力程度”调节

Haiku 5.5是首款引入可调节“努力程度”(effort setting)的Haiku级模型。用户可根据实际需求,在优化成本与提升智能水平之间进行选择。基准测试显示,该模型在计算机使用(OSWorld)、知识工作(GDPval-AA)及多学科推理(Humanity’s Last Exam)等场景中表现优异。

早期客户测试反馈证实了其性能与成本优势:

  • Asana:在AI智能体评估套件中,Haiku 5.5使任务完成延迟减少超过30%,推理速度提升高达2.5倍。
  • HubSpot:在CRM任务模拟测试中,Haiku 5.5取得92.8%的平均得分,在处理模糊记录审计任务时,速度最快且假阳性率最低。
  • AlphaSense:在文档问答场景中,Haiku 5.5的表现得分从Haiku 4.5的0.76提升至0.84,具有统计学意义上的显著改进。
  • Box:Haiku 5.5得分比Haiku 4.5高出11分,延迟仅为后者的一半,适用于大规模内容分析工作。
  • Rogo:作为子代理处理10-K表格数据提取时,Haiku 5.5展现出足够的准确性、速度和低成本优势。
  • Cognition:集成至Devin Fusion后,在保持FrontierCode 66.2分顶级水平的同时,有效降低了成本和延迟。

定价策略调整

对于长度在10万令牌以内的提示词(约占此前Haiku模型请求量的90%),Haiku 5.5极具性价比。具体定价如下:

计费项Haiku 5.5 (<=100k / >100k)Haiku 4.5Sonnet 5.5
缓存读取$0.01 / $0.05$0.10$0.10
缓存写入$0.125 / $0.625$1.25$2.50
输入令牌$0.10 / $0.50$1.00$2.00
输出令牌$0.50 / $2.50$5.00$10.00

与此同时,Anthropic宣布将Claude Sonnet 5.5的缓存读取价格减半,从每百万令牌$0.20降至$0.10。由于缓存读取占据令牌消耗的大部分,这一调整使得Sonnet 5.5在大多数智能体任务中的运行成本降低约20%。尽管Sonnet 5.5和Opus 5.5在复杂智能体编码任务上仍具优势,但Haiku 5.5为数据压缩、摘要生成等过去因成本过高而难以大规模实施的任务提供了新选项。

安全性与可用性

在对齐性方面,Haiku 5.5相比Haiku 4.5有重大改进,对齐行为偏差大幅减少,配合滥用的意愿降低。其网络安全评分护栏比Haiku 4.5更严格,但略宽于Sonnet 5.5,允许更广泛的网络防御范围,同时阻止渗透测试等技术。生物安全评分护栏则与Sonnet 5、Sonnet 5.5及Opus 5保持一致。

目前,Claude Haiku 5.5已在Amazon Web Services、Google Cloud和Microsoft Azure全平台上线。开发者可通过claude-haiku-5-5在Claude平台上进行开发。

其他更新

除了模型发布与定价调整,Anthropic还推出了以下更新:

  • 新增API额度:本周起,Max 5x订阅用户每月将获得$100 API额度,Max 20x用户为$200,Team订阅用户共享额度高达$500。这些额度可用于构建调用任意模型的工具、应用和智能体。
  • SDK更新:Claude Python和TypeScript SDK已以Beta形式支持计算机使用和浏览器操作功能,结合Haiku 5.5的速度与成本优势,更适合此类任务开发。