
Anthropic正式推出Claude Haiku 5.5,官方称这是其迄今为止发布的最便宜、最快且能力最强的小型模型。该模型专为高容量、对成本敏感的任务设计,能够可靠处理摘要生成、数据压缩、数据库查询及分类请求等快速重复性工作负载。
Claude Haiku 5.5可与Opus 5.5和Sonnet 5.5协同工作,在编码任务中担任子代理角色。作为Anthropic速度最快的模型,它尤其适用于实时客户支持和浏览器操作等对延迟敏感的场景。相较于前代产品Haiku 4.5,Haiku 5.5的平均运行成本降低了约75%。
性能与“努力程度”调节
Haiku 5.5是首款引入可调节“努力程度”(effort setting)的Haiku级模型。用户可根据实际需求,在优化成本与提升智能水平之间进行选择。基准测试显示,该模型在计算机使用(OSWorld)、知识工作(GDPval-AA)及多学科推理(Humanity’s Last Exam)等场景中表现优异。
早期客户测试反馈证实了其性能与成本优势:
- Asana:在AI智能体评估套件中,Haiku 5.5使任务完成延迟减少超过30%,推理速度提升高达2.5倍。
- HubSpot:在CRM任务模拟测试中,Haiku 5.5取得92.8%的平均得分,在处理模糊记录审计任务时,速度最快且假阳性率最低。
- AlphaSense:在文档问答场景中,Haiku 5.5的表现得分从Haiku 4.5的0.76提升至0.84,具有统计学意义上的显著改进。
- Box:Haiku 5.5得分比Haiku 4.5高出11分,延迟仅为后者的一半,适用于大规模内容分析工作。
- Rogo:作为子代理处理10-K表格数据提取时,Haiku 5.5展现出足够的准确性、速度和低成本优势。
- Cognition:集成至Devin Fusion后,在保持FrontierCode 66.2分顶级水平的同时,有效降低了成本和延迟。
定价策略调整
对于长度在10万令牌以内的提示词(约占此前Haiku模型请求量的90%),Haiku 5.5极具性价比。具体定价如下:
| 计费项 | Haiku 5.5 (<=100k / >100k) | Haiku 4.5 | Sonnet 5.5 |
|---|---|---|---|
| 缓存读取 | $0.01 / $0.05 | $0.10 | $0.10 |
| 缓存写入 | $0.125 / $0.625 | $1.25 | $2.50 |
| 输入令牌 | $0.10 / $0.50 | $1.00 | $2.00 |
| 输出令牌 | $0.50 / $2.50 | $5.00 | $10.00 |
与此同时,Anthropic宣布将Claude Sonnet 5.5的缓存读取价格减半,从每百万令牌$0.20降至$0.10。由于缓存读取占据令牌消耗的大部分,这一调整使得Sonnet 5.5在大多数智能体任务中的运行成本降低约20%。尽管Sonnet 5.5和Opus 5.5在复杂智能体编码任务上仍具优势,但Haiku 5.5为数据压缩、摘要生成等过去因成本过高而难以大规模实施的任务提供了新选项。
安全性与可用性
在对齐性方面,Haiku 5.5相比Haiku 4.5有重大改进,对齐行为偏差大幅减少,配合滥用的意愿降低。其网络安全评分护栏比Haiku 4.5更严格,但略宽于Sonnet 5.5,允许更广泛的网络防御范围,同时阻止渗透测试等技术。生物安全评分护栏则与Sonnet 5、Sonnet 5.5及Opus 5保持一致。
目前,Claude Haiku 5.5已在Amazon Web Services、Google Cloud和Microsoft Azure全平台上线。开发者可通过claude-haiku-5-5在Claude平台上进行开发。
其他更新
除了模型发布与定价调整,Anthropic还推出了以下更新:
- 新增API额度:本周起,Max 5x订阅用户每月将获得$100 API额度,Max 20x用户为$200,Team订阅用户共享额度高达$500。这些额度可用于构建调用任意模型的工具、应用和智能体。
- SDK更新:Claude Python和TypeScript SDK已以Beta形式支持计算机使用和浏览器操作功能,结合Haiku 5.5的速度与成本优势,更适合此类任务开发。