Claude Opus 5.5已在Anthropic平台、Amazon Web Services、Google Cloud和Microsoft Azure全面上线。开发者可通过Claude Platform使用模型名称claude-opus-5-5调用该服务,模型内置了符合欧盟《人工智能法案》要求的水印措施。

专为长周期与复杂任务打造

Opus 5.5面向代码库迁移、软件审计、财务分析、数据收集及跨应用工作流等复杂场景设计。早期测试显示,该模型在执行耗时数小时的工程任务时表现优异。在一项测试中,Opus 5.5在不到三小时内完成了20万行代码库的审计与修复,而上一代Opus 5耗时超过20小时,且Token消耗量为前者的2.5倍。

Clio高级软件工程师Sean Heintz表示,他将一项涵盖六个仓库的大型工程任务交给Opus 5.5无人值守运行。在18多小时里,模型专注于定义服务交互方式并推导应用逻辑,不仅更快达成里程碑,且极少需要返工。其生成的代码注释简短实用,避免了冗长叙述。

据Anthropic报告,Opus 5.5在编码、计算机操作及专业知识工作方面表现突出。基准测试与客户反馈表明,相较于Opus 5,新模型在保持上下文连贯性、智能体委派及结果校验方面均有提升,显著减少了完成任务所需的提示词、工具调用次数及修正环节,整体Token消耗更低。具体性能因任务类型、工具及思考强度设置而异。

德勤咨询首席信息官Carl Bennett指出,即使在最低思考强度下,Opus 5.5在代码审查中也能发现72%的已知漏洞,误报率更低,输出量大幅减少;而Opus 5在高思考强度下检出率仅为56%。在美国咨询分析任务中,低思考强度的输出质量在半数情况下与高思考设置相当,并通过质量检查。这意味着以低思考强度模式交付客户就绪级成果将成为高效选择。

强制开启思考与安全加固

Opus 5.5不支持关闭“思考”功能,推理过程始终启用,开发者仅可调整应用于任务的思考强度。此次发布还引入了“保留思考(Preserved Thinking)”机制,防止API用户编辑历史上下文,从而增加通过大规模蒸馏攻击提取模型能力的难度。该机制适用于2026年8月31日或之后创建的Opus 5.5 API账户。

Anthropic称,新模型更易理解,能将关键信息前置,并更严格地遵循写作指令。

在安全层面,Anthropic首席执行官Dario Amodei强调,AI发展速度应确保安全措施领先于模型能力,以管理风险并在与中国的竞争中保持优势。Opus 5.5针对网络安全、生物学研究及模型复制尝试增加了安全防护。大多数网络安全任务将被重定向至Opus 4.8,Anthropic计划扩展“网络验证计划”,为认证专业人士提供更广泛的访问权限;受限的生物研究组织可申请加入生命科学验证计划。

此外,Anthropic新增了一种分类器,可在执行前筛查编码智能体行为,并推出开源沙箱供安全团队审计,以便在代码合并前捕获漏洞。新模型增强了对抗提示注入攻击的能力,试图规避分配限制的尝试比Opus 5或Claude Mythos 5.1减少约85%。Anthropic表示,所有尝试均属低严重级别且为自我报告。METR和Frontier Design等外部机构在发布前进行了评估,但Anthropic承认当前评估无法在部署前识别所有潜在故障。

API降价与提速

Claude Opus 5.5的API价格较Opus 5有所下调:输入Token价格为每百万4美元(原5美元),输出Token价格为每百万20美元(原25美元);缓存输入读取价格为每百万0.20美元(原0.50美元)。更低的缓存成本有利于编码智能体及频繁查阅相同指令、文件或对话历史的系统。

该模型输出速度比Opus 5快30%以上。通过Claude Code和Claude Platform提供的独立快速模式,速度可达原来的2.5倍,价格为输入Token每百万8美元,输出Token每百万40美元。

Anthropic正在提高Pro、Max、Team及按席位计费的Enterprise客户的五小时使用限额。订阅用户将获得速率限制重置额度,可保存留待后续使用。